手机中国 4小时前
OpenAI批量发布数学解答未达学界标准 仅10份公开思维链
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

【CNMO 科技消息】近日,OpenAI 公布 719 份由其模型生成的数学问题解答,涉及多项开放研究问题。尽管该公司称发布前曾咨询数学与人工智能顾问小组,但从公开情况看,其流程尚未完全达到该小组提出的标准,尤其缺少对人类理解、形式化验证和同行审查的充分保障。

OpenAI

该顾问小组由普林斯顿高等研究院牵头,成员包括来自全球多家机构的 9 名数学研究人员。小组此前建议,停止使用专有模型测试高等数学问题,但 OpenAI 此次明确使用专有模型评估开放数学问题。在 719 份文稿中,仅 10 份披露了模型得出结论的推理过程,另有 42% 的证明未完成形式化处理。

一项由剑桥大学和伦敦国王学院数学研究人员完成的新论文还指出,OpenAI 针对一个由纳维-斯托克斯方程衍生问题给出的解答中,自然语言证明与形式化代码之间至少存在两处差异。这些差异不一定意味着证明错误,但显示模型将文字推理转换为可验证代码时可能发生误译。

顾问小组此前要求实验室提供机器可读的关联信息,以对应自然语言证明和形式化结果,但 OpenAI 此次并未提供。

数学家认为,机器生成证明仍需接受与传统证明相同的同行审查。陶哲轩也指出,如果提示模型解题的人无法解释结果、参与报告或回应同行问题,相关成果便难以真正融入数学研究。哈佛大学数学教授梅拉妮 · 伍德表示,模型输出解答时,人类理解往往尚未形成,后续验证工作才刚刚开始。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

陶哲轩 人工智能 数学 伦敦国王学院
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论