大模型
-
全球AI大模型调用量115万亿Token,中国占比56%领跑
全球AI大模型周调用量达115万亿Token,中国以56.72万亿Token占比约56%,连续十九周领跑美国。腾讯混元Hy4 preview单周调用量14.7万亿Token居全球第一,编程与智能体任务成为Token消耗主要来源。
-
黄仁勋称AGI已随GPT-6 Astra出现,行业应如何准备?
黄仁勋宣称GPT-6 Astra标志着AGI到来,引发行业热议。文章梳理了该表态背后的信号:模型能力四年快速跃升、算力达十万卡级别且持续扩张,并分析了企业应如何从技术布局、人才准备和算力规划三个方向重新校准AI战略,以应对AI能力边界外移带来的挑战。
-
98%的智能体任务不需要顶级大模型,模型降级使用会如何改写成本结构
智能体任务分层正改写大模型成本结构。报告显示仅7%调用需旗舰模型,93%常规工作可用中端模型完成,动态路由可降低74%整体成本。降级依赖上下文质量和交接策略,企业应通过调用审计将高端模型留给少数高难度环节。
-
DeepSeek被曝采购16万颗华为昇腾950DT,算力国产化进入深度绑定阶段?
彭博社援引知情人士消息称,DeepSeek计划在乌兰察布数据中心部署至少16万颗华为昇腾950DT芯片用于推理,若落地将成为已知规模最大的国产AI芯片集群之一。此举或推动国产算力从“能用”走向大规模商业化验证,但交付周期、集群稳定性和商业效果仍待检验。
-
月之暗面以保密形式递交港交所A1申请,国产大模型IPO竞速进入新阶段
月之暗面以保密形式向港交所递交A1上市申请,同时推进投前估值500亿美元的融资,首批交割已于8月27日完成。公司估值较去年底增长逾10倍,6月年化经常性收入3亿美元,高估值能否被商业化验证成为市场关注焦点。
-
GPT-6 Astra上下文达到105万词元,超长上下文真正改变了哪些工作?
GPT-6 Astra于2026年9月3日发布,上下文窗口达105万token。它能容纳完整代码仓库或数百页资料,但改变主要在工作流:整理从先切碎转向先归档,检索更强调来源边界与版本控制,连续任务有更大工作记忆而单次输出仍有限。上下文长度不等于推理质量,价值在于更大工作台上的筛选与证据保留。
-
2026上海国际AI 算力与芯片技术展览会
2026上海国际AI 算力与芯片技术展览会
时 间:2026年12月9-11日
地 点:上海新国际博览中心 -
AESE2027打通软硬件壁垒,促产业链上下游深度合作
AESE2027打通软硬件壁垒,促产业链上下游深度合作 2027年6月26‑28日,2027年6月北京具身智能机器人展(AESE) 落地北京亦创国际会展中心。具身智能是软硬件强耦合的产业,硬件零部件、整机设备、具身大模型算法,…
-
AACE2026北京AI算力展:7万+专业观众,高价值人脉一次聚齐
2026年11月12‑14日,2026年11月北京AI算力展(AACE) 将在北京亦创国际会展中心盛大启幕。在算力液冷垂直B2B赛道中,产业竞争的核心早已不止产品技术,更在于高质量产业人脉资源与精准供需圈层的积累…
-
实测5款AI办公工具:PPT/表格/文案/会议纪要,真的能替代职场人吗?
2026年国内AI办公桌面端月活突破3000万,豆包、WPS灵犀、千问办公却在6-8月集体收费,职场人最关心的问题来了:这些工具是真能提效,还是智商税?软盟资讯以真实工作场景实测10款工具,深度评测PPT生成、表格处理、文案写作、会议纪要、邮件助手五大品类,给出核心结论:AI能搞定80%的基础工作,剩下20%的判断与创意还得靠人;用得好效率提升3-5倍,用不好只剩返工。
-
企业级AI Agent选型指南:从试用、评估到落地的完整步骤,别再花冤枉钱
2026年国内企业级AI Agent市场规模预计达135.3亿元(赛迪顾问),但Gartner预测超40%的智能体项目将在2027年底前被取消,赛迪数据显示约62%的制造业AI项目上线三个月后使用频次大幅下降。“买了用不起来”正成为企业最大浪费。本文拆解“上线即闲置”的三大真相,给出选型前灵魂三问、五维评估标准、从需求梳理到全面推广的六步流程及五大避坑要点,附可直接套用的评估表格,为企业决策者提供一份拿来即用的采购手册。
-
2026深圳数据中心液冷技术展10月启幕!算力+液冷全链汇聚 展位抢订中!



AI安全与算力成为2026年9月13日的两条主线:Anthropic CEO达里奥提出“全球AI限速三步计划”,奥特曼宣布OpenAI IPO推迟至2027年,中央网信办列出五方面安全风险;与此同时,2026中国算力大会发布首批普惠算力清单,河北智能算力规模达556EFLOPS。面对智能体加速“动手”,行业如何在发展与安全之间踩准刹车?
