OpenAI 数学解答未达学界标准,AGMAI 指南多项要求未落实
OpenAI 本周发布数百份高难数学题解答,但未完全达到普林斯顿高等研究院 AGMAI 顾问组提出的标准。719 份手稿中仅 10 份公开了模型的思维链,42% 的证明未经过形式化处理,AGMAI 要求的相关机器可读元数据也未提供。
OpenAI 本周发布数百份高难数学题解答,但未完全达到普林斯顿高等研究院 AGMAI 顾问组提出的标准。719 份手稿中仅 10 份公开了模型的思维链,42% 的证明未经过形式化处理,AGMAI 要求的相关机器可读元数据也未提供。
OpenAI 以公开 GitHub 仓库形式发布内部前沿模型的数学成果,包含 722 篇手稿、分为 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果消耗约 3 小时 ChatGPT Pro 思考算力,模型本身未发布。
推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解其规模、算力成本与学界争议。