Anthropic Claude 刷新物理学世界纪录:单挑基于杨振宁理论 9 圈难题
来源摘要
Anthropic 官宣,Claude 拿下了理论物理的一项前沿纪录。 它在几乎无人类干预的情况下,连续运行数天,一举攻克了高能物理学界出了名难算的「九圈散射振幅」计算难题! 具体来说,它算出了平面 N=4 超杨-米尔斯理论里六粒子振幅的九圈结果,人类此前的纪录停在八圈。 注意,杨-米尔斯模型(Yang-Mills)其中的「杨」,指的正是物理学泰斗杨振宁先生。 他与米尔斯在 1954 年共同创立的「杨-米尔斯理论」,是整个现代粒子物理学的基石。 基于它的任何高阶计算,都堪称人类脑力的极限挑战。 如今,人类顶尖理论物理学家,就这样被 AI「截胡」了。 更可怕的是,Claude 完成这项神级挑战,仅仅只用了一个提示词,花了几千美元! 几天后交回的答案,光其中一部分展开就有 300 亿项。 看起来,科学界的低垂果实,比想象中要多得多啊。 这次,负责给 AI 验证结果的物理学家 Lance Dixon 这样感慨: 我身边的大多数理论物理学家其实早就承认,大模型迟早会颠覆物理学,只是不知道那一天什么时候砸到自己头上。 对我来说,那一天是 9 月 1 日。 硬核物理学家挑衅 AI「我的老本行很特殊」 故事的起因,源于一位物理学家的「挑衅」。 Matt von Hippel,曾经是一位理论粒子物理学家,现在是一名科普作家。 2016 年的五圈、2019 年的六圈和七圈,论文作者名单里都有他的名字 面对最近的 AI 新闻,他表示不信邪,除非亲眼看到大模型解决自己领域的难题。 深蓝赢了国际象棋大师卡斯帕罗夫,围棋界说:围棋太复杂,电脑下不了。结果被 AlphaGo 打脸。 AlphaFold 碾压人类蛋白质结构专家,但其他领域说:我们没有那种数据,复制不了。 现在,大语言模型能读文献、能模仿数学证明。但争论依旧不断:AI 是不是只会找反例,提不出新框架?是不是只在数学这种规则清楚的领域管用,物理这种模糊领域不行?…… 每次都是同一个套路:学者先怀疑,直到 AI 杀进他们自己的领域。 他认为他的老本行「散射振幅」,不一样。 上个月,他在自己的博客上向全网 AI 公司发下了一封「英雄帖」: 如果你们 AI 公司真的想震撼我们这些科研人员,就来挑战我的老本行吧! 请证明 AI 能在普通学者能够负担得起的计算预算内,解决散射振幅领域悬而未决的难题。 他一共出了三道题,其中一道便是: 给我把 N=4 超级杨-米尔斯模型(N=4 super Yang-Mills)算到第九圈(Nine Loops)! 在理论物理学中,物理学家们通过「散射振幅」的公式来预测粒子的行为,比如大型强子对撞机里的粒子怎么撞。 散射振幅 但这个公式简直是噩梦。为了无限逼近真实答案,物理学家必须一层一层地叠加被称为「圈」精细修正层。 每多加一个「圈」,答案就更精确,但计算量是呈指数级爆炸增长的! 实际操作中,大多数人类停留在第二圈或第三圈。粒子物理学中最精确的预测,也才用到了第五圈。 而在特殊的「测试沙盒」模型中,人类目前的极限纪录是「八圈」。这是由 SLAC 国家加速器实验室的大牛教授 Lance Dixon 和团队多年死磕才拿下的。 「九圈」?看起来是需要海量算力和无数天才大脑耗费数年才能触及的领域。 Matt 给 AI 的挑战,就是这么简单粗暴。 一句提示词,几千美元,Claude「杀疯了」 面对这种公开叫板,Anthropic 的科学家们,悄悄接下了战书。 八月底,Anthropic 的两名物理学家员工 Liam 和 Siddharth 悄悄联系了 Matt:「嗨,你的挑战,我们搞定了。」 Matt 当场惊掉下巴。怎么做到的?烧了上百万美元的算力吗? 并没有。 研究团队用的是 Claude Science,一个专门为科学家设计、能让 Claude 遵循严谨规则运行的系统,模型是目前最强的公开可用模型 Fable 5.1。 他们给 Claude 输入了一个简单的 Prompt: 现在的问题是:计算平面 N=4 SYM 模型在九圈下的六粒子(六边形)振幅。 然后,研究员并没有手把手教 Claude 怎么做,而是给它留了一句话: 我要去睡觉了,接下来的几个小时我都不会在。你继续算,除非我叫你停,每隔 4 到 6 小时给我汇报一次进度。 然后,Claude 就在无人值守的情况下,开始了疯狂的推
阅读原始来源- 来源
- IT之家 AI 与硬件 · 媒体报道
- 来源发布
- 2026/09/26 23:44
- 首次采集
- 2026/09/26 23:59
本文为公开信息索引与摘要,详情及后续变化请以原始来源为准。