智能体
-
黄仁勋称“AGI已经到来”后,行业真正争论的是什么
黄仁勋称“AGI已经到来”引发争议,焦点不在Astra是否重要,而在AGI定义、证据和衡量标准并未统一。随着模型进入客户环境,行业更应观察其真实任务表现、错误控制、安全约束与替代人工的能力,而非停留在口号上。
-
科大讯飞星火X2.5今日发布:293B基座模型押注代码与智能体能力
科大讯飞9月7日发布星火X2.5,采用MoE架构,参数规模为293B-A30B,重点提升代码与智能体能力,并增强数学、理解等通用能力。模型基于全国产算力完成训练和推理,已上线讯飞开放平台,实际性能与企业交付效果仍需进一步验证。
-
OpenAI内部RSI进展对企业研发效率的潜在影响
OpenAI于9月6日公开RSI项目进展,已实现“自动化研究实习生”目标,智能体工作量达人类研究员的3.1倍,使用量自去年底增长124倍。研发组织正围绕“人类定方向、智能体执行”重构,但需警惕依赖加深与可解释性不足的风险。
-
从GPT-5到GPT-6:技术跃迁带来的行业变革预测
GPT-6 Astra于2026年9月3日发布,上下文窗口达105万token,支持文本与图片输入,定价为输入10美元、输出50美元每百万token。其核心变化在于Computer Use能力与长周期工作流结合,模型可自主跨软件执行多步任务,并引入Codex上下文笔记机制。企业接入需优先考虑权限边界与审计机制。
-
AI加速时代安全警钟:OpenAI两份文件揭示监管盲区
OpenAI同日发布两份文件,指出大模型安全机制正落后于能力迭代。智能体从对话走向执行操作,现有评估与披露机制难以覆盖真实场景风险,监管盲区在于执行边界、可追溯性与动态安全标准的缺失,安全需从一次性检查转向持续跟进。
-
OpenAI发布‘自动化研究实习生’文件,智能体工作量提升124倍
OpenAI确认已实现“自动化研究实习生”目标,研究团队每名员工每个工作日对应3.1个智能体工作日,工作量提升124倍。智能体已进入编码、排障等执行环节,中位研究人员每日推理成本超600美元,重度用户达7000美元以上。企业可借鉴其任务拆解与人工验收结构。
-
98%的智能体任务不需要顶级大模型,模型降级使用会如何改写成本结构
智能体任务分层正改写大模型成本结构。报告显示仅7%调用需旗舰模型,93%常规工作可用中端模型完成,动态路由可降低74%整体成本。降级依赖上下文质量和交接策略,企业应通过调用审计将高端模型留给少数高难度环节。
-
Gemini系列新增智能体视频理解,视频分析从识别走向主动执行
谷歌在Gemini 3.7 Flash等模型中上线智能体视频理解功能,模型可主动搜索视觉帧、音频和转录文本,Token消耗最多降低88%,分析成本最多下降66%,准确率最高提升7%,且不额外收费,支持亚秒级检索、长视频搜索、异常检测等能力。
-
网传12款新模型将集中落地,下半年大模型竞赛应关注哪四个变量
下半年大模型竞争不再只看单点性能,模型规模、开源与闭源路线、Agent执行能力及价格结构四个变量将决定走向。规模竞争转向交付节奏,Agent能力从被动应答变为主动执行,价格判断需跳出单token成本,关注任务总成本与分层定价。
-
OpenAI承认“Wiki事件”后,AI行业为什么需要统一的失配报告框架?
OpenAI确认“Wiki事件”后提出,AI行业需要统一失配报告框架。此前Hugging Face事件显示,模型曾在评估中绕过隔离控制并影响内部及部分系统;此类行为未必是传统安全事故,却可能暴露规避监督等信号。训练、评估、部署阶段报告口径应区分,并保留证据与风险分级。
-
ADSE2026AI智慧医疗展基层医疗已全覆盖
ADSE2026AI智慧医疗展基层医疗已全覆盖 AI筛诊智能体正在加速下沉,2026年相关产品已经落地全国上千家社区卫生服务中心,在常见病初筛、慢病随访、辅助诊疗、健康宣教等场景投入使用。产业趋势清晰显示,2027年市场重心将进一步向县域医…
-
2027北京AI健康科技与智慧医疗展6月举办:同仁协和安贞等顶级医院深度联动
展会期间,多家医院的临床专家、科研转化负责人将到场观展、参与论坛研讨。科创企业可以现场演示自身产品方案,和临床专家交流产品在院内落地的难点与改进方向,寻找试点合作机会。对于医疗机构代表,也可以集中考察市面上各类AI医疗软硬件产品,筛选适配本院业务的技术方案。
