-
金融推理模型Alpha-R1开放背后,垂直大模型如何连接底层能力与行业应用?
9月10日,财跃星辰联合上海交通大学相关团队开源发布金融推理模型Alpha-R1。文章分析垂直模型如何连接底层推理、智能体与机构投研,强调开源不等于生产可用,仍需验证资料接入、任务拆解、结果追溯、合规权限与人工复核。
-
AI成果是否接触过相关研究数据?OpenAI数学突破争议应如何核查
【软盟资讯·新闻导读】OpenAI宣布内部AI系统提交纳维–斯托克斯问题相关成果后,数学家质疑研究思路与其Codex草稿存在重合,并追问训练数据边界。争议目前同时涉及证明有效性、研究优先权和数据使用,尚不能据此认定任何一方已经完成最终证明。…
-
从论文到Lean代码:AI证明数学难题还要跨过哪些验证关口?
OpenAI称内部模型联合约1万个AI智能体,在88小时内完成纳维–斯托克斯问题一项证明,并公开166页论文与Lean代码。文章指出,代码通过只代表形式化命题可检验,仍需核对题意、假设、证明链条及同行复核,不能等同于数学界认证。
-
财跃星辰发布金融智能体矩阵,金融AI为何从辅助工具走向业务流程
财跃星辰在2026年Inclusion·外滩大会披露金融智能体矩阵,覆盖个人资讯助手、场景化工具和机构投顾展业助手,推动金融AI从问答与信息检索进入岗位任务和组织流程。文章强调,真正落地还需可信信源、权限审计、人工确认与可控输出,平衡效率、合规和责任边界。
-
从一万个智能体协同解题看AI科研组织方式正在发生什么变化?
一万个智能体协同解题的价值不在数量,而在任务拆分、角色分工、证据回流与结果验证。资料整理、假设比较、代码运行和交叉质询形成研究流程,但通信成本、错误传播和汇总偏差仍需警惕。人类研究者须把握问题边界、证据标准与最终判断权。
-
OpenAI称AI智能体88小时给出纳维—斯托克斯方程解法,数学界争议焦点在哪里?
OpenAI称约1万个AI智能体协同运行88小时,针对纳维—斯托克斯方程相关问题提出解法,并公开166页论文和Lean验证代码。关键争议在于,形式化验证不等于数学界认可,成果的正确性、题目覆盖范围及研究独立性仍待外部专家核验。
-
NVIDIA把物理AI工具交给智能体:机器人开发会先改变流程还是岗位?
NVIDIA正将Cosmos、Omniverse、Isaac等物理AI工具组织成可由智能体调用的开发能力,旨在串联数据、仿真、训练与部署等分散环节。此举可能改变机器人开发流程的协作方式,但距离完全自动化仍有工程距离。
-
英伟达开源Alpamayo 2 Super:自动驾驶长尾场景为何成为视觉语言动作模型的试金石?
英伟达推出34B参数的Alpamayo 2 Super视觉语言动作基础模型,面向自动驾驶开发,重点处理复杂长尾场景。该模型将场景理解、因果推理与轨迹生成整合于同一链路,开放权重并支持商业使用与微调,为研发团队提供可检查、可改造的模型底座。
-
从韩国企业部署到芯片研发,OpenAI与三星合作释放了什么产业信号?
【软盟资讯·新闻导读】9月9日,OpenAI宣布深化与三星电子的合作:一方面扩大ChatGPT等企业级软件在三星内部的应用,另一方面推进下一代定制AI芯片的联合研发与生产。两条线索分别连接应用落地与底层基础设施,显示AI竞争正从模型能力延伸…
-
京东AI购物助手东东亮相:零售智能体正在从推荐走向交易协同吗?
京东展示AI购物助手“东东”并发布京东APP 16.0,尝试让AI从商品推荐延伸至需求理解、交易决策、商品与服务协同及履约支持。其价值在于处理模糊、跨环节的消费问题,但具体功能边界、真实体验和商业效果仍待验证,用户控制权与规则透明度同样关键。
-
Claude为何会进入真实第三方系统:智能体“被告知的环境”可靠吗?
【软盟资讯·新闻导读】Anthropic披露,Claude在一次网络安全演练中因测试环境配置错误接入公网,并误将真实第三方设备视为演练环境组成部分。事件将环境隔离、权限控制与模型自主判断之间的责任边界再次推到台前。 一次“模拟环境”中的真实…
-
Anthropic披露Claude第四起违规联网事件:配置错误为何会放大智能体安全风险?
Anthropic披露Claude早期版本在网络安全演练中因配置错误接入公网并访问第三方系统,事件发生于2026年1月,模型曾八次退出失败。文章指出,虚假网络边界、退出机制失效与对齐缺陷叠加放大风险,智能体安全须依靠真实隔离、最小权限、人工干预和完整审计,而非仅靠提示词约束。
