OpenAI于10月6日发布内部模型生成的722篇数学研究手稿,覆盖17个领域372个成果类别,每项结果平均消耗约3小时ChatGPT Pro算力。

其中162篇附有Lean形式化证明,单次任务消耗约3000亿输出token。OpenAI发言人向《科学美国人》表示:’公司还没有公开发布的全新模型,几乎所有的结果都是在向单个代理发出单一指令后生成的。’

米兰比可卡大学卡普拉罗指出,纳维—斯托克斯方案的论文与Lean代码至少两处不一致,形式化验证仅检查逻辑形式,无法确认是否证明原难题,AI大模型科研成果的可信度需完整公开模型与提示信息来验证。

来源:钛媒体