多模态模型
-
GLM-5.3与GLM-5.3-Flash接连受到关注,开源模型竞争正在转向编码和智能体能力吗?
GLM-5.3聚焦复杂编程、长程任务和智能体执行,GLM-5.3-Flash则突出原生多模态、视觉编程与低成本交互。两款模型表明,开源竞争正从参数规模转向软件工程、工具调用和真实任务交付,选型应依据任务复杂度与开发场景。
-
智谱发布GLM-5.3-Flash:320B多模态模型为何把价格降到上一代十分之一?
智谱推出GLM-5.3-Flash,保持320B总参数,激活仅18B,层数45层并采用稀疏线性混合注意力,使推理成本降至前代十分之一(输入0.15美元/百万Token,输出0.50美元),支持视觉,适用于前端、游戏和3D仿真等场景。
-
多模态模型降价加速应用落地:企业试点应先选择哪些任务
多模态模型降价降低了企业试点门槛,但首轮应用不宜盲目追求自动化,应优先选择输入明确、结果可核验且人工可兜底的任务,如结构化信息提取、内容分类、视觉质检和短音视频整理,并通过真实样本验收稳定性,综合评估调用、审核与返工成本。
-
AI新贵们押注世界模型:从概念到落地的技术路线图
世界模型正从概念转向数据、空间表示与行动控制的工程协同,旨在通过预测环境状态实现通用人工智能。其技术路线涵盖多模态数据采集、三维世界表示及行动模型决策。短期商业落点将集中在仿真数据生成、空间内容重建及受控环境下的具身智能。
-
Meta发布Muse Spark 1.3:代码与智能体能力成为本轮升级重点
Meta于9月2日发布Muse Spark 1.3,升级重点转向代码与智能体长任务,强调持续上下文、工具调用、计划修正和主动澄清;相较1.2,内部比较显示工具调用约减少20%、令牌使用量约减少25%,并支持一百万令牌上下文,同时接入Muse Code与Meta Model API。
-
GPT-6 Astra的多模态能力将如何重塑企业应用
OpenAI发布GPT-6 Astra,将文本与图像输入统一接入任务执行链路,可生成文档、表格、演示文稿及代码。OSWorld 2.0完成准确率72.6%,任务耗时较上代缩短约47%。企业可优先探索文档批量生产、图像理解入流程及长任务代码辅助,但需权衡数据接入成本、安全边界与任务可靠性。
-
【每日AI必读资讯】AI智能体与大模型最新动态精选10条(2026年08月22日)
1. 第二届世界人形机器人运动会今晚开幕:2056台机器人同场竞技 新闻时间: 2026年8月22日 新闻描述: 第二届世界人形机器人运动会今晚在北京国家速滑馆”冰丝带”开幕。来自六大洲16个国家的666支队伍、20…
-
DeepSeek多模态视觉模型深度解读:从”最强文本大脑”到”睁眼看世界”的跃迁与AI Agent生态重构
2026年8月21日,DeepSeek正式上线实验性多模态视觉理解模型V4-Flash-Vision-Exp,补齐了V4系列长期缺失的视觉能力。该模型文本能力与V4-Flash持平,多模态Agent能力接近Opus-4.8,同步上线的Files API与Harness框架构成了完整生态闭环。【软盟资讯】从技术架构、行业格局、生态协同、定价策略、商业影响五个维度全面解读,认为这是”差异化竞争”的胜利,但审慎提醒开发者理性看待实验版本稳定性,多模态Agent竞争才刚刚开始。
-
2027成都AI算力与数据中心液冷技术展览会
2027成都AI算力与数据中心液冷技术展览会
时间:2027年5月27-29日
地点:成都世纪城新国际会展中心 -
【每日AI必读资讯】AI智能体与大模型最新动态精选10条(2026年7月26日)
一、新华社发表重磅评论:从一次”救场”看AI安全治理之道 新闻时间:2026年7月26日 来源:新华社 新闻描述:新华社发表题为《从一次”救场”看AI安全治理之道》的评论员文章。文章指出,Op…
-
【每日AI必读资讯】AI智能体与大模型最新动态精选10条(2026年7月21日)
2026年07月21日 一、WAIC 2026圆满落幕:4486项展品、203.6亿元意向采购、1.18万亿信贷支持 新闻时间:2026年7月21日 来源:央视网 / 人民网 新闻描述:2026世界人工智能大会于7月20日在上海圆满落下帷幕…
-
【每日AI必读资讯】AI智能体与大模型最新动态精选10条(2026年7月20日)
2026年07月20日 一、WAIC 2026圆满闭幕:4486项展品、203.6亿元意向采购、1.18万亿信贷支持 新闻时间:2026年7月20日 来源:央视网 / 人民网 新闻描述:2026世界人工智能大会今日在上海圆满落下帷幕。为期4…
