DeepSeek发布V3.1-Terminus”终结版”:稳定性大幅提升,为V4全新架构铺路

9月26日消息,DeepSeek正式发布V3.1-Terminus(终结版)模型,显著提升稳定性,修复中英文混杂与异常字符等关键问题,并优化Code Agent、Search Agent模块。该版本被视为V3系列收官之作,为即将推出的V4全新架构或R2重大更新铺路。

9月26日消息,国产大模型领军企业深度求索(DeepSeek)于近日正式发布DeepSeek-V3.1-Terminus(终结版)模型。作为V3.1系列的重要收官之作,该版本聚焦工程化落地与场景适配,重点修复了长期困扰用户的中英文混杂输出与异常字符等关键问题,并深度优化了Code Agent与Search Agent两大智能体模块,使代码生成与信息检索的准确性和稳定性得到显著提升。业界普遍认为,此举意在为即将推出的V4版本或R2重大更新铺路,V4有望采用全新的架构设计。

官方发布:一次”从算法到工程”的跨越

aiimg6ab72773034a98.99266924
据DeepSeek官方介绍,DeepSeek-V3.1-Terminus在保持模型原有能力的基础上,针对用户反馈的高频问题进行了一系列针对性改进,核心优化集中在两大方向。
一是语言一致性提升。新版模型显著缓解了此前多语言场景下出现的”中英文混杂”问题,同时有效抑制了偶发异常字符的产生,使文本生成更加纯净、可控。这一改进对正式写作、跨语言翻译辅助以及代码生产等场景的可用性提升尤为明显。
二是Agent能力增强。针对开发者高频使用的智能代理功能,DeepSeek对Code Agent的语法解析精度、Search Agent的信息检索召回率进行了专项优化。优化后的模型在工具调用、外部查询等任务中的响应更为精准,任务失败率显著下降。
目前,DeepSeek官方App、网页端、小程序以及DeepSeek API模型均已同步更新至DeepSeek-V3.1-Terminus版本。开源版本权重也已同步上架Hugging Face与ModelScope平台。

性能表现:基准测试全面提升

根据DeepSeek公布的官方测评数据,DeepSeek-V3.1-Terminus在多维度基准测试中均取得可观进步,尤其在需要复杂工具调用的Agentic任务上表现突出。
核心测试成绩变化(对比V3.1):

基准测试 V3.1 V3.1-Terminus 提升幅度
Humanity’s Last Exam 15.9 21.7 +36.5%
BrowseComp 30.0 38.5 +28.3%
Terminal-bench 31.3 36.7 +5.4分
SWE-bench Verified 66.0 68.4 +2.4分
SimpleQA 93.4 96.8 +3.4分

在备受关注的”人类最后考试”(Humanity’s Last Exam)基准上,新版得分从15.9大幅跃升至21.7,提升幅度超过36%,这一成绩仅次于Grok4(25.4)与GPT-5(25.3),并略微超越Gemini 2.5 Pro(21.6)。而在BrowseComp测试中,得分较上一代提升了28.3%,展现出网页浏览与信息整合能力的显著强化。

修复痛点:工程师与开发者的”及时雨”

值得注意的是,此前的DeepSeek-V3.1版本在2025年8月发布后,曾被用户指出存在”极”字等异常输出以及中英俄多语混用等现象,严重时影响代码可用性。有用户反馈:”中英文混杂问题在思考时间很长的时候确实会出现,遇到过几次,还在想这是什么问题,这下子正好给解决了。”
有资深AI投资人士分析指出,本次更新聚焦工程化落地与场景适配,核心突破体现在两大竞争能力的提升:一方面,通过语义层降噪技术显著改善语言一致性,有效抑制中英文混杂、异常字符等干扰;另一方面,深度重构Agent执行框架,针对Code Agent的语法解析精度、Search Agent的信息检索召回率进行专项优化,使智能体输出稳定性大幅提升。
此次全渠道(App/网页/小程序/API)同步升级,被外界视为国产大模型从算法创新向工程可靠性演进的关键跨越,标志着国产模型在复杂任务处理、多模态协同等工业化应用层面迈出了重要一步,为后续垂直领域深度赋能奠定了更坚实的基础。

“Terminus”之名:V3系列的收官之作

“Terminus”在拉丁语中意为”终点、界限”,这一命名被外界解读为DeepSeek对V3架构技术成熟度的宣告。作为V3.1系列的最后一次更新,DeepSeek-V3.1-Terminus被视为整个V3系列的收官之作,其定位是”成熟、经受生产环境考验”的稳定版本。
有分析认为,这一版本的核心战略意义在于为整个V3系列画上一个稳定可靠的句号,同时为下一代重大版本的推出扫清障碍、奠定基础。

展望:V4或采用全新架构设计

随着V3.1-Terminus的发布,外界关注的焦点正转向DeepSeek的下一代重大更新。据相关透露,DeepSeek可能推出的V4版本有望采用全新的架构设计,而备受期待的R2推理模型也可能迎来重大更新。
回顾DeepSeek的发展脉络,从2024年底发布V3,到2025年1月以R1推理模型震撼全球市场、引发开源大模型竞争白热化,再到此后V3.1、V3.2的持续迭代,DeepSeek始终保持着高频的更新节奏与技术突破。作为国产大模型的风向标,DeepSeek的一举一动都备受全球关注。
业界普遍预期,无论最终落地的是V4还是R2,DeepSeek下一代模型都将在推理能力、架构效率与工程可靠性上实现新一轮的跨越式突破,其进展将持续深刻影响全球人工智能竞争格局。
—— 完 ——
(本文为原创新闻稿,相关技术信息参考DeepSeek官方公告及公开报道整理)

关于文章版权的声明:

https://news.softunis.com/82814.html 文章来自软盟资讯

若非本站原创的文章,特别作如下声明:

本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。不承担任何由于内容的合法性及真实性所引起的争议和法律责任。

凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。

如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!

赞 (1)
【每日AI必读资讯】AI智能体与大模型最新动态精选10条(2026年09月26日)
上一篇 2026年9月26日 09:52
微软正式发布新版Copilot”超级应用”:聊天、编程、智能体三合一,剑指AI时代工作方式基座
下一篇 2026年9月26日 09:58

相关文章推荐

发表回复

登录后才能评论