开源模型
-
Meta Muse 1.3发布、编码能力反超GPT-5.6:开源模型追赶闭源,企业选型该关注什么?
Meta Muse Spark 1.3 于 9 月 2 日发布,官方称其编码能力已超过 GPT-5.6 Sol。表面是开源模型追赶闭源的里程碑,但细看之下,这场“反超”缺乏完整测试数据与第三方复现支撑。文章更提醒:企业真正需要警惕的,是陷入单一榜单分数的迷信。选型之难,不在名气,而在场景、总成本、数据合规与生态迁移能力的综合权衡。当开源与闭源的差距持续收窄,你的评测机制,是否还停留在“谁分高用谁”?
-
开源模型企业版宣传增多:采购要看清权重、支持与安全补丁边界
“开源模型企业版”频繁出现在AI新闻里,但企业如果只看“开源”“企业级”“可私有化”这些词,很容易误以为已经拿到完整权重、长期更新和安全兜底,合同却可能只覆盖部署或咨询。真正需要拆开的是开源代码、开源权重、商业支持与私有化部署各自的权利边界,并追问权重版本、补丁对象、响应时限和退出机制。与其迷信标签,不如把宣传落成事实、权利、服务、责任四个层面的采购清单。
-
今日AI大模型企业应用动态:管理者应重点核查哪些发布信号?
Kimi K3于7月17日发布,月之暗面披露其参数规模达2.8万亿、上下文长度支持100万Token,但编程和复杂应用优势尚未获独立验证。对企业管理者而言,真正的风险不是错过“最大参数”,而是把发布会口径误当成可上线能力:开源许可、部署成本、数据安全、服务条件和真实业务效果都需核查。如何通过小范围、可量化且可回滚的试点,判断它是否值得进入生产环境?
-
英伟达拟以129亿美元收购Hugging Face:从芯片巨头到开源AI开发者入口
英伟达拟以129.303亿美元收购Hugging Face,交易尚未完成交割,却已将竞争焦点从GPU与数据中心延伸至模型、数据集、开发工具和开发者入口。平台拥有超过1800万名开发者、研究人员和创作者,约300万个模型、50万个数据集和100万个应用,未来或扩大企业选择,也可能带来供应商集中、开源治理与迁移成本问题。多云、多加速器承诺能否真正保持,仍待后续产品与监管进展验证?
-
2026年AI大模型企业动态:国产开源、制造业落地与算力效率成选型新变量
大模型选型正在告别只看参数、价格和榜单的阶段:国产开源模型成为可验证的第二选择,制造业价值开始深入工艺参数,推理成本、延迟、功耗与边缘部署则成为硬约束。本文从许可协议、内部基准复现、数据基础和模型—硬件—推理框架协同出发,梳理企业如何区分宣传口径与可执行事实,找到真正算得清账、落得了地的方案?
-
腾讯开源 Hy4 preview:7700亿参数、百万上下文,国产模型如何加速追赶前沿代差?
腾讯开源Hy4 preview以7700亿参数和百万Token上下文长度,将国产大模型推向新高度。面对海外厂商的快速迭代,腾讯选择“预览版”策略加速追赶,通过MoE架构在控制成本的同时提升长文本处理能力。当模型能力差距被压缩至月级,企业选型的关键已从单点参数转向迭代速度与场景适配。
-
金融推理模型Alpha-R1开放背后,垂直大模型如何连接底层能力与行业应用?
9月10日,财跃星辰联合上海交通大学相关团队开源发布金融推理模型Alpha-R1。文章分析垂直模型如何连接底层推理、智能体与机构投研,强调开源不等于生产可用,仍需验证资料接入、任务拆解、结果追溯、合规权限与人工复核。
-
GLM-5.3与GLM-5.3-Flash接连受到关注,开源模型竞争正在转向编码和智能体能力吗?
GLM-5.3聚焦复杂编程、长程任务和智能体执行,GLM-5.3-Flash则突出原生多模态、视觉编程与低成本交互。两款模型表明,开源竞争正从参数规模转向软件工程、工具调用和真实任务交付,选型应依据任务复杂度与开发场景。
-
智谱发布GLM-5.3-Flash:320B多模态模型为何把价格降到上一代十分之一?
智谱推出GLM-5.3-Flash,保持320B总参数,激活仅18B,层数45层并采用稀疏线性混合注意力,使推理成本降至前代十分之一(输入0.15美元/百万Token,输出0.50美元),支持视觉,适用于前端、游戏和3D仿真等场景。
-
大模型竞争从参数规模转向效率:GLM-5.3-Flash释放了什么产品信号
GLM-5.3-Flash以320B总参数、18B激活参数和混合注意力架构,体现大模型竞争由参数规模转向推理效率、长上下文成本与部署可行性。其原生多模态、开源及适配信息,为企业评估智能体、编程和自动化场景时同步衡量能力、成本与交付能力提供样本。
-
国产大模型 MiniMax M3 在长上下文任务中的表现评测
MiniMax M3面向超长上下文,API最高支持100万Token,开放权重版本上线时支持50万Token;其长程任务和信息检索能力较强,成本定位有吸引力,但并非全面领先,适合文档整理与长对话,法律、财务等场景仍需人工复核。
-
Perplexity本地Agent采用阿里Qwen3.8-27B:中国开源模型为何走向海外应用
Perplexity推出本地Agent Portable Computer,采用阿里开源模型Qwen3.8-27B,面向文件处理、数据分析和编程。文章指出,本地部署强化数据控制与任务执行,中国开源模型通过海外产品落地,但性能和兼容范围仍待验证。
