Claude Opus 4.1今日正式发布,编程能力刷新纪录并升级智能体任务处理

软盟资讯 · 7×24快讯】(2026年09月12日) Anthropic正式发布新一代大模型Claude Opus 4.1,替代此前旗舰Claude Opus 4。在SWE-bench编程评测中,Opus 4.1以74.5%的成绩超越Claude Opus 4、Gemini 2.5 Pro和o3,刷新最高纪录,拿下编程性能新SOTA。除编程外,模型还升级了深度研究、数据分析能力,特别是在细节追踪与智能体Agent检索方面提升明显,跨文件重构代码的改进尤为突出。定价上”加量不加价”,与Claude Opus 4保持一致。Anthropic称计划未来几周对模型进行更大规模升级,此次更可视为一次承前启后的版本迭代。

软盟观察: Claude Opus 4.1的发布时机很耐人寻味——在GPT-5、Gemini-3消息频传、OpenAI密集放量智能体工具的当口,Anthropic用一次”小步快跑”守住编程SOTA的位置。74.5%的SWE-bench成绩本身含金量十足,更重要的是它把”编程王者”和”Agent推理”绑定在一起卖——明晒模型性能,暗秀客户关系,连乐天、Windsurf都拉来做背书。这背后是头部大模型厂商竞争逻辑的变化:单点刷分已不够,关键看能不能在真实工程与智能体任务里兑现价值。可以预见,代码智能体将成为大模型厂商贴身肉搏的下一个主战场。

上一篇:

下一篇:

发表回复

登录后才能评论