谷歌Gemini与Anthropic Clude双雄竞逐,AI推理速度军备竞赛打响

【软盟资讯 · 7×24快讯】 8月30日消息,据AI科技日报综合报道,AI推理速度正成为新的竞争焦点。OpenAI与Cerebras预览全新API服务层级Ultrafast,在Cerebras硬件上运行GPT-5.6 Sol,吞吐最高达每秒750个输出token,比标准接口快约11倍;谷歌发布Gemini 3.7 Flash,实测每秒330个输出token;Nvidia发布Nemotron 3.5 Lightning,同类最高4倍输出速度。与此同时,谷歌A2A智能体互操作协议正式加入Anthropic主导的MCP,共同并入新成立的”Agentic AI Foundation”,两大智能体生态标准走向统一。MCP协议月下载量已达9700万次。(来源:林伽一·AI科技日报、unrot.co)

【软盟观察】 “每秒750个token”与”每秒330个token”的对比,揭示了AI行业一个正在被重新定义的竞争维度——推理速度。过去,模型竞争的焦点是参数规模和智能水平;而当模型能力普遍接近天花板时,”快”本身就成了一种产品力。OpenAI将GPT-5.6 Sol的推理吞吐提升11倍,直接改变的是AI的可用场景——从”等待回答”到”实时交互”,从”离线的批处理”到”融入人类心流的无缝协作”。这不仅是技术指标的提升,更可能重塑AI的商业模式和用户体验。与此同时,谷歌A2A协议并入Anthropic的MCP、成立”Agentic AI Foundation”,则标志着智能体底层标准从”各自为战”走向”统一生态”——就像TCP/IP统一了互联网,统一的智能体协议将彻底打破”智能体孤岛”,让跨厂商、跨系统的多智能体协同成为可能。当”更快”的推理遇上”更统一”的标准,AI从”单点工具”走向”协同生产力”的基础正在加速夯实。

上一篇:

下一篇:

发表回复

登录后才能评论
分享本页
返回顶部