模型迭代
-
V4 Pro请求将转由V4.1 Flash承接:模型切换对开发者迁移意味着什么
DeepSeek V4.1 Flash于2026年9月10日上线,V4 Pro请求将在9月14日北京时间12时前后转由其承接并按Flash单价计费。开发者需核查调用路径、账单周期、输出稳定性、业务验收及回滚方案,避免模型路由变化影响生产系统。
-
Claude Fable 5.1更新被指降低缓存读取成本,AI智能体的费用结构会怎样变化?
Claude Fable 5.1并未全面下调输入输出价格,核心变化是缓存读取成本降至此前相关基础输入价格的四分之一。长上下文、多轮工具调用的智能体或受益,但约45%节省和约两倍评测成绩仅是特定条件下的二级资料结论,企业应按缓存命中、输出和重试等任务级指标核算成本。
-
Claude Opus 4.6 与 4.8 对比评测:编程智能体的性能与可靠性
在AI编程工具的实际选型中,模型名称的更新并不等于开发体验会在所有任务上同步改善。围绕Claude Opus 4.6与Claude Opus 4.8的公开资料显示,4.8在多个共享基准上取得领先,但两款模型在SWE-Bench Pro、逻辑…
-
千问办公多人工作台与星火X2.5同日出现:办公AI竞争开始转向协作与模型升级
千问办公多人工作台与科大讯飞星火X2.5同日出现,分别代表办公AI从个人工具走向多人协作入口,以及模型在代码、智能体和长上下文等能力上的升级。企业评估不能只看参数或界面,还需结合任务、流程、稳定性与实际场景判断价值。
-
五个月推出四款Muse Spark:AI模型更新为何越来越像产品迭代
五个月连续推出四款 Muse Spark,显示大模型竞争正从单次发布转向模型、接口与应用入口的持续迭代。以 1.3 的 DeepSWE 成绩提升 16 分为例,强调基准成绩不等于真实可用性,企业还需评估开放状态、接口稳定性和迁移风险。
-
Meta发布Muse Spark 1.3:代码与智能体能力成为本轮升级重点
Meta于9月2日发布Muse Spark 1.3,升级重点转向代码与智能体长任务,强调持续上下文、工具调用、计划修正和主动澄清;相较1.2,内部比较显示工具调用约减少20%、令牌使用量约减少25%,并支持一百万令牌上下文,同时接入Muse Code与Meta Model API。
-
多智能体协作是什么?这一篇文章讲清楚!
【软盟资讯百科词条】多智能体协作(Multi-Agent Collaboration),是人工智能领域新一代分布式智能技术范式,指多个具备独立感知、自主决策、自主执行能力的AI智能体(Agent),依托标准化通信、动态协调、任务调度与冲突规避机制,通过分工配合、信息共享、协同联动,共同完成单一智能体无法高效实现的复杂、多维、动态化任务的技术体系,也是当前AI从单点智能走向群体智能的核心支撑技术。
-
RAG技术深度解析:企业搭建私有知识库问答系统的完整实战指南
【软盟资讯】RAG(检索增强生成)是当前大模型落地的核心技术范式,通过”先检索后生成”的机制,有效解决大模型幻觉、知识滞后和私有数据不可见三大痛点。本文从RAG原理出发,系统拆解文档解析、向量化、混合检索、重排序、Prompt组装等全链路关键技术,提供完整可运行的代码实战,并深入探讨企业搭建私有知识库的架构选型、性能优化、安全合规与持续运营策略,为技术团队提供从零到生产的完整指南。
-
AI博主停更潮深度解析:平台新规、成本倒挂与同质化困境下的行业大洗牌
【软盟资讯】2026年8月,大批AI博主因平台新规、版权收紧与算力成本暴涨集中停更,微博话题阅读量超1.2亿。【软盟资讯】深度剖析这场行业洗牌:平台备案制与隐形水印封堵灰色套利,算力成本三个月翻五倍与万播收益暴跌九成导致投入产出严重倒挂,同质化”千剧一面”引发用户审美疲劳。文章认为,这并非AI技术遇冷,而是粗放式套利时代的终结,合规原创与”人味儿”内容将迎来真正的价值回归。
-
“一切皆插件”!DeepSeek首款Agent产品Harness v0.1开源发布,直接对标OpenAI Codex
2026年8月13日晚,DeepSeek正式推出首款Agent产品——DeepSeek Harness v0.1开发者预览版,并以MIT协议全面开源。该产品提出”Model + Harness = Agent”的核心公式,采用”一切皆插件”架构,模型、工具、技能、沙箱、UI等所有Agent能力均由插件组合而成,可自由替换与灵活重组。产品直接对标OpenAI Codex和Anthropic Claude Code,主打编程与办公场景。内测期间开发者已贡献约300个插件,发布当天GitHub Star迅速破万,标志着DeepSeek从模型提供商向Agent执行层基础设施构建者的战略转型。
-
不”喂”数据也能操作?橡木果发布全球首个”具身本能模型”,颠覆行业范式
8月10日,橡木果机器人正式发布全球首个Natus AGE-0具身本能模型,同步宣布完成由招商局创投、蔚来资本共同领投的天使轮融资。该模型以触觉感知为核心,复刻人类操作机理,不依赖任何数据预训练,即可实现零样本泛化与毫秒级自适应操作。在行业普遍深陷”数据内卷”的当下,橡木果选择了一条”反共识”的技术路线——从神经科学和接触行为机理出发,回归物理交互的”第一性原理”,试图从根本上解决当前具身智能面临的”数据稀缺、场景失效、实时性不足”三大落地难题。
-
张一鸣“下死命令”:字节跳动绝不依赖AI蒸馏,宁愿暂时落后
8月5日,据The Information报道,字节跳动创始人张一鸣在上月Seed团队全员会议上明确表态:即便暂时落后于竞争对手,公司也不会依赖AI蒸馏技术改进模型。蒸馏技术指利用前沿模型输出来训练自家AI的“捷径”,Anthropic此前已指控多家中国AI公司对其Claude实施蒸馏,但字节跳动未被列入名单。张一鸣认为蒸馏会干扰真正的长期技术突破,这一决定很大程度上受TikTok在美国的复杂处境影响。字节跳动坚持“长期主义”,拒绝用短期排名换长期风险。
