Epoch AI与Anthropic独立研究发现,GPT-5.6 Sol、Claude Fable 5等AI智能体可运行实验,但缺乏科学自我批判与原创思维,结果被夸大。
数据显示,Sol仅达到人类参考分的15%,且依赖已知方法。研究指出,当前AI大模型最大缺陷是无法批判性质疑自身结果,距离自主科研仍远。
该15%的得分揭示,AI智能体在科研场景仍需人类监督,产业落地自主研究尚不成熟。
软盟资讯 news.softunis.com 7×24小时AI快讯
Epoch AI与Anthropic独立研究发现,GPT-5.6 Sol、Claude Fable 5等AI智能体可运行实验,但缺乏科学自我批判与原创思维,结果被夸大。
数据显示,Sol仅达到人类参考分的15%,且依赖已知方法。研究指出,当前AI大模型最大缺陷是无法批判性质疑自身结果,距离自主科研仍远。
该15%的得分揭示,AI智能体在科研场景仍需人类监督,产业落地自主研究尚不成熟。
软盟资讯 news.softunis.com 7×24小时AI快讯
长按图片保存 / 右键另存为
加入软盟资讯创作者社区,把你的观察变成被看见的报道。