OpenAI一次公开719份数学稿件:人类理解的速度跟不上了?
Lean
一种让电脑检查数学证明的语言和工具。
形式化
把证明写成电脑可以检查的形式。
AGMAI
独立讨论数学和人工智能的咨询小组。
发生了什么
OpenAI(开发ChatGPT的人工智能公司)在10月上旬公开了一大批数学材料。材料来自一个尚未发布的内部模型。它们放在GitHub(用来分享代码和研究文件的网站)上。目录现在有719份稿件,分成372个“家族”。一个家族可以包含主结果、相关论证、推论或另一种证明。内容覆盖组合、几何、数论、代数、拓扑、概率、统计物理和理论计算机科学。
这不是一篇论文解决一个问题,而是一次跨领域的大量发布。《The Verge》采访了30多位数学家。很多人既惊讶又期待,也担心没有足够时间读完。连目录和摘要都需要认真阅读。真正理解这些结果,可能要花几年。
为什么会有这次发布
OpenAI说,原有数学测试已经难以区分模型能力,所以扩大了测试。公开仓库写道,模型大约尝试了4000个问题。大多数结果平均使用约3小时的ChatGPT Pro推理计算。公司再把筛选后的输出整理成稿件和家族。
但数学研究不只是收集答案。研究者要理解证明为什么成立,要说明它和过去工作的关系,要正确引用前人的贡献,还要把想法讲给别人听。解释、讨论和提出新问题,都是把一个结果变成公共知识的过程。
为什么数量会造成影响
AI提出结果的速度,可能远远超过人类阅读的速度。于是工作的位置改变了。数学家要花更多时间分类、检查、改写和解释。这些不是简单的清理,而是发现错误、确认意义、让别人能够使用结果的关键步骤。
负担也可能分配不均。资深研究者也许有更多时间。博士生和刚入行的人,却可能看到自己准备多年的问题突然被提前处理。论文、经费申请和求职计划,都可能受到影响。问题是否正确、是否真的新颖,当时还没有答案。
目前可以确认什么
OpenAI的仓库明确说,结果处在不同的验证阶段,并非每份稿件都有Lean(一种让电脑检查证明的语言和工具)形式化版本。仓库显示,约42%的顶层结果已经形式化。形式化可以帮助电脑检查证明,但人仍要确认代码到底证明了什么。代码通过检查,也不等于它和文章里的每个说法完全对应。
发布后,材料已经发生变化。《The Verge》报道,仓库记录了多次修订,并因一个符号错误导致论证失效而删除了3份稿件。TechCrunch还介绍了一篇论文:作者在一个与纳维-斯托克斯方程有关的问题中,发现面向人的证明和Lean代码至少有两处不一致。这不自动证明两个结果都是错的,却说明独立检查不可省略。
仍然不知道什么
719份稿件中,哪些能通过同行评审,仍然未知。哪些想法真正新颖,哪些能帮助其他领域,也需要时间判断。前人工作的引用是否完整,模型怎样选题、尝试过哪些失败路线,外界也未必都能看见。
OpenAI说会继续补充形式化内容,也会继续进行数学工作。AGMAI(独立的数学与人工智能咨询小组)认为,AI实验室发布大量成果后,还要帮助人类建立理解。它还建议公开模型名称、使用的提示、耗时、成本和验证状态。
接下来要看什么
接下来要看的,不是又出现一个更大的数字,而是发布后的过程:修订记录、独立讲解、同行评审、清楚的引用,以及能否产生新的数学想法。如果数学家能解释这些结果,并在它们上面继续研究,这次发布才会真正有价值。否则,研究界得到的可能只是许多主张,却没有足够时间把它们变成大家都能使用的知识。
OpenAI公开719份数学稿件:人类还要慢慢检查
📰 完整报道: OpenAI一次公开719份数学稿件:人类理解的速度跟不上了?
AI写出了很多数学结果,但人还要确认它们是否正确。
形式化
把证明写成电脑可以检查的样子。
Lean
帮助电脑检查数学证明的工具。
OpenAI
开发ChatGPT的人工智能公司。
💡 一句话总结
- OpenAI公开了719份数学稿件。
- 稿件被分成372个相关家族。
- 很多内容还在等待人类检查。
OpenAI(开发ChatGPT的人工智能公司)公开了一批数学研究。材料来自一个没有公开的内部模型。文件放在GitHub(分享研究文件的网站)上。
这些稿件涉及数字、图形、概率和计算机科学。372个家族,不等于372个完全独立的发现。一个家族可以放主结果、相关证明和另一种证明。
为什么这件事重要?AI可以很快写出很多证明。人类读得慢得多。读者要问三个问题。证明真的成立吗?文章说的内容和代码一致吗?这个想法以前有人做过吗?
OpenAI说,结果处在不同的检查阶段。约42%的主要结果已经“形式化”。形式化就是把证明写成电脑可以检查的样子。Lean(检查数学证明的工具)可以帮忙。但电脑检查通过,也不能代替人的理解。
发布以后,仓库已经出现修订。报道说,有3份稿件因为符号错误被删除。这不表示所有结果都错了。这表示早期材料仍可能需要修理。
数学家还要解释证明,联系过去的研究,并找到新的问题。这个过程需要时间。AGMAI(独立的数学与人工智能咨询小组)认为,AI公司也应帮助人类理解这些成果。
接下来要看的是独立检查。哪些结果正确,哪些真正新,哪些能帮助别人,仍要慢慢判断。
AI送来了一大堆数学作业
📰 完整报道: OpenAI一次公开719份数学稿件:人类理解的速度跟不上了?
人们要慢慢看看,这些答案是不是对的。
OpenAI
制作ChatGPT的人工智能公司。
Lean
帮助电脑检查数学答案的工具。
AI
可以帮助人做事的电脑系统。
OpenAI(制作ChatGPT的人工智能公司)让电脑做了很多数学题。 它公开了719份数学稿子。 这些稿子分成372组。 一组里有相近的稿子。
电脑可以很快写答案。 人要慢慢看答案。 所以,人还要做检查。
Lean(帮电脑检查数学答案的工具)也来帮忙。 但它不是会说“全对”的老师。 人还要看清楚它检查了什么。
公开以后,有些稿子被改了。 3份稿子因为符号写错,被拿掉了。 这不表示所有稿子都错。 这表示有些答案还要修。
AI可以找出很多想法。 人要选出真的好想法。 人还要把它们讲给别人听。 这样,数学才会变成大家能用的东西。
现在要等人们继续检查。