-
Perplexity 本地 Agent 采用阿里 Qwen3.8-27B:国产模型海外落地案例
Perplexity将Qwen 3.8-27B用于Portable Computer本地Agent,并推出Qwen 3.8 PPLX 27B版本;方案以沙箱和云调用控制数据流向,展示国产模型服务海外的本地化路径。
-
Mistral 完成30亿欧元D轮融资:欧洲AI资本新动向及影响
法国人工智能公司 Mistral 宣布完成30亿欧元D轮融资,投后估值超过210亿欧元。按公司公布的信息,这是欧洲私人科技企业规模较大的股权融资之一,也使Mistral再次成为欧洲人工智能资本市场的焦点。对投资者和行业观察者而言,这笔交易的…
-
Claude Opus 4.6 与 4.8 对比评测:编程智能体的性能与可靠性
在AI编程工具的实际选型中,模型名称的更新并不等于开发体验会在所有任务上同步改善。围绕Claude Opus 4.6与Claude Opus 4.8的公开资料显示,4.8在多个共享基准上取得领先,但两款模型在SWE-Bench Pro、逻辑…
-
Qwen3-32B 在代码生成中的突破:多语言支持与低延迟实测
文章梳理了 Qwen3-32B 在代码生成中的能力边界:相较 Qwen-2.5-32B-Instruct,其更强调复杂问题理解、多步推理和任务适应性;“支持200余种语言”、低首字延迟与高吞吐量尚缺乏可核验的专项实测,团队应通过生成、修复、迁移及性能测试评估。
-
DeepSeek V4 Flash 词元定价降至每百万0.5元:成本竞争新格局
DeepSeek V4 Flash的成本优势主要来自缓存命中输入每百万词元0.02元,但缓存未命中输入为1元、输出为2元,“每百万0.5元”并非统一单价。团队应结合缓存命中率、输入输出量和调用流程评估真实成本,并通过任务分流与工程优化控制预算。
-
GPT-6 Astra 9月6日正式上线:企业级智能体功能全解析
GPT-6 Astra于9月6日前后分阶段上线,覆盖ChatGPT Work、Codex和API,核心从问答转向跨页面、跨工具完成任务。其支持文本与图像输入、105万token上下文,并提供企业智能体能力;企业仍需评估成本、权限、审批、数据安全和人工复核。
-
从参数竞赛到词元经济学:大模型行业为何开始重算每项任务的成本
大模型竞争正从参数规模和基准分数转向任务总成本。智能体场景中的多轮推理、上下文重复、工具调用与失败重试,会放大词元消耗。企业应以任务账本评估调用轮次、输入输出词元、人工介入及运维成本,按真实工作流选择模型。
-
AI产业进入价值兑现期了吗:从基础设施、Agent到实体应用看增长分化
“AI产业进入价值兑现期了吗?”这个问题,不能只看模型能力是否继续提升,也不能用资本投入是否仍然旺盛来回答。更可靠的判断方式,是观察价值链中不同环节的增长是否开始分化:基础设施仍在扩张,但客户是否愿意为稳定的算力、数据和部署能力付费;Age…
-
具身智能不再只比舞台表演:80%陌生场景完成80%任务意味着什么
“在80%的陌生场景中通过自然语言完成80%的任务”,比单次高难度动作更能衡量具身智能的实用性。机器人需具备跨场景感知、理解、规划与执行能力,并以分场景验收、人工接管和安全边界推动落地,工业自动化缝隙或是优先方向。
-
高校迎新开始使用AI智能体:校园应用如何从问答走向流程服务
高校正将AI智能体用于迎新咨询、校园导航和选课建议,推动校园服务从信息问答走向流程协作。文章指出,应用关键在于可靠知识库、持续更新的数据与清晰的责任边界,并应保留核验、人工转接和用户确认机制。
-
工信部规划2030年智能算力达9800 EFL:基础设施扩张将带来哪些新问题
工信部规划到2030年全国智能算力规模达到9800 EFLOPS,推动万卡、十万卡集群和国产芯片适配。文章分析扩张对数据中心协同、训练与推理供给、应用落地及区域重复建设的影响,强调算力建设应匹配产业需求并提升利用效率。
-
Gemini 3.8 Flash单任务成本上升四成:大模型价格战为何转向真实用量
Gemini3.8Flash任务成本0.58美元,较Gemini3.7Flash的0.40美元涨四成,因输出词元增30%且交互轮次增多。单价不变并不等于账单下降,企业应以任务级词元消耗和业务效果评估模型,而非仅看每百万词元标价。
