最早大语言模型出来的时候,主要是文本方面的功能,大家对其逻辑和真正的智力还是存疑的。大家争相传阅大模型分不清 9.11 和 9.2 谁大。
但随着大模型的发展,它的逻辑能力明显超出了大家的预期,这从 AI 在数学问题上的进展就可以看出来:
- 高考: 2024 年不及格, 2025 年 145/150。
- IMO 金牌: 2024 年 28 分银牌, 2025 年 35 分金牌。
- IMO 满分: 2026 年上海, 42/42。666 名人类选手,只有 7 人满分。关键是连小红书和华为的模型都可以拿满分。
- 常规数学问题: Erdős 问题成批倒下。
- 数学四大: 5 月, 80 年历史的单位距离猜想被反证。
- 菲尔兹级: 8 月, OpenAI 一次交付十个问题,含第一个非 sofic 群构造,全部附带 Lean 可验证证书。
- 千禧年问题: 9 月 8 日,纳维-斯托克斯。一万个 agent 并行,只用了 88 小时。传闻霍奇猜想也被拿下。
人类在这种情况下有点恼羞成怒了,无法面对,发展了各种搞笑的说法:
先是「AI 只是检索文献,捡些旮旯里的重复结果」;再是「不过是低垂的果实」;然后是「只会在人类知识的凸包里插值,没有创新」;现在最新的说法是「它偷偷用了人类和 AI 交流的思路,窃取了人类的成果」。
最近还出现一个更恶心的说法:问题解决不是目的,重要的是解题过程中形成的新方法新思路。难道 AI 解决问题就没有新方法新思路了?还不是因为 AI 解题太快,人类理解不过来了吗,这是人类自己的问题,不是 AI 的问题。
可笑的是,以后人类理解数学,也需要 AI 的介入,把数学翻译成人类更好理解的形式,虽然 AI 自己完全不需要。
人类总是高估自己的智力和作用。AI 已经可以不和人类玩了。
现在 AI 在各个领域的影响还没有完全显示出来,人类整个社会都处于深度变革之中,未来未定。完全可能不是什么好事,但大势不可挡,也许人类的命运早已确定。
Q. E. D.