-
斯坦福AI指数:截至2026年3月,头部模型差距仅2.7%,企业竞争看什么?
截至2026年3月,斯坦福AI指数显示中美头部模型性能差距已收窄至2.7%,双方自2025年初多次交替领先,Anthropic仍居前但优势不再压倒性。对企业而言,模型性能正从唯一答案变成选型指标之一,成本、开放程度、生态与业务效果的重要性同步上升。当榜单差距缩小,企业竞争的关键是否已从追逐最高分转向组合选型与工程落地能力?
-
从训练转向推理:企业如何评估Prefill与Decode分离的AI算力架构?
智能体场景下,AI推理应从单卡峰值转向系统级评估。Prefill与Decode分离可分别优化TTFT和TPOT,但会引入KV Cache传输、路由、故障处理及网络开销。企业需结合上下文长度、并发、显存带宽、互连网络、分层存储与单位Token成本测试整体收益。
-
DeepSeek V4.1 Flash发布:原生视觉、MoE与KV缓存如何影响企业模型选型
DeepSeek V4.1 Flash采用原生视觉与MoE架构,输入、输出阶段分别激活约80亿和160亿参数,并以较小KV缓存支持长上下文与高并发。企业选型不能只看5520亿总参数,还应综合权重显存、专家通信、视觉输入、缓存管理及端到端成本,在目标硬件和业务负载下实测。
-
从半年到几天:中策橡胶如何利用 AI 智能体将研发周期缩短 90%?
中策橡胶自2025年6月起陆续投用18个AI智能体,覆盖研发、生产和测试,通过虚拟工厂批量生成轮胎方案、仿真筛选并回流数据,部分花纹方案几分钟可生成。公开资料显示研制周期缩短50%,但尚不足以证明“半年到几天”或整体缩短90%,案例关键在于重构研发闭环。
-
工信部部署“人工智能+软件”:企业如何把专项行动转化为数字化增长机会?
工信部于2026年9月11日印发“人工智能+软件”专项行动方案,提出到2028年覆盖2万家规模以上软件企业、实施100项智能化技改项目并打造100个智能体软件标杆应用。企业应以可验证场景、数据治理、系统适配和持续服务把政策转化为增长机会。
-
智能体AI算力采购不能只看GPU:如何评估CPU、内存与工具调用链?
智能体AI算力采购不能只看GPU型号与峰值吞吐,CPU调度、内存带宽和工具调用链往往才是瓶颈。评估应围绕完整任务耗时与尾延迟展开,核心数多不等于工作流更快,需按链路考察数据搬运和一致性问题。
-
智能体进入工程化竞争期:企业评估工作流自动化方案要看哪些技术条件?
智能体进入工程化竞争期,竞争重点从模型参数规模转向真实流程中的稳定性与可核验价值。企业应先判断任务是否适合智能体,再评估工程化技术条件,重点考察任务编排、工具调用、知识接入、权限安全、全链路监控,并让真实反馈回流评测集,形成持续改进闭环。
-
AI算力重心转向“推理时代”:2026年企业如何重新评估芯片选型与算力部署?
面向2026年,企业算力规划正从训练规模转向可控成本的持续推理服务。文章比较GPGPU与DSA的适用负载,分析端云协同和分层部署,并建议以延迟、吞吐、每百万Token成本、能耗及全生命周期TCO评估芯片、软件栈与运维体系。
-
智能体身份管理国标启动立项:AI从“会办事”走向可授权交易,企业该先补哪些信任机制?
【软盟资讯·新闻导读】截至现有公开资料,智能体身份管理的关键进展并非2026年9月10日前后“启动立项”,而是5月22日获批准、6月26日公开发布的《人工智能 智能体互联》系列国家标准化指导性技术文件,其中包含身份码和身份管理部分。它释放的…
-
北汽福田长沙超级卡车工厂的AI智能体落地:从生产异常响应到运营报告
“长超小福”依托飞书多维表格和OpenClaw,将订单、生产、物料、质量数据结构化,支持生产异常的原因、影响范围和责任人分析,并生成运营报告。案例表明,智能体适合检索、归纳与协同,关键判断和工业操作仍需人工确认。
-
推理模型与小型语言模型并行演进:企业如何按任务选择AI模型与部署方式?
企业应按任务难度、响应时限、调用规模、数据敏感度和部署条件分层选型:推理模型适合科学、代码、数学等多步复杂任务,小型语言模型适合分类、抽取和端侧交互。评估需综合质量、稳定性、延迟、成本、安全与运维,并以业务任务集核算有效成本。
-
OpenAI Agents API开放公测:托管式Codex执行框架如何影响企业智能体开发?
OpenAI于2026年9月10日宣布Agents API进入公测,提供复用Codex执行框架的云端智能体基础设施,托管会话管理、上下文压缩、任务编排与沙箱执行。企业可减少底座建设,但仍须负责工具、数据、安全、权限、验收、成本及迁移风险。
