泡泡资讯网

一夜之间,AI跨过了科学发现的门槛,7月12日深夜,东京大学Kavli IPMU

一夜之间,AI跨过了科学发现的门槛,7月12日深夜,东京大学Kavli IPMU数学物理学家立川裕二在推特上分享了一段亲历:他将一份卡壳约六个月、几乎打算搁置的弦理论合作项目笔记扔给Anthropic的Claude Fable 5,"没抱任何希望"。几个小时后,模型不仅指出了原稿中的一处计算错误,坦言"自己也卡在同一个地方",随后提出了一个非平凡的新思路,并主动写出SymPy符号验证代码来检验自己的猜想。悬置半年的僵局,在一个晚上被打破。
立川的原话是——"Fable似乎确实理解弦理论,并且有直觉"。推文一夜爆火,被Marc Andreessen等硅谷意见领袖转发放大后,他随即删帖并解释:"传播方向超出了我的预期。"作为h指数颇高、被引超一万六千次的弦论学者,他的措辞谨慎并不难理解:一句"AI具备物理直觉",在同行评议尚未介入的前提下,足以让整个理论物理社区震动。
值得注意的是这次事件的技术细节。Fable 5并非简单的"答题机",而是走完了一条完整的科研闭环——诊断错误、承认瓶颈、提出假设、编写代码自我证伪。这正是Anthropic六月底推出的Claude Science产品线所标榜的"可审计推理链":结论与代码成对交付,供人类研究者复核。与去年AI在数学奥赛上的表演性突破不同,这一次进入的是一个开放性、无标准答案、连问题本身都尚未被完全形式化的前沿领域。
围绕此事的评论迅速两极分化。乐观派宣称"AI怀疑论就此破产",人类正迈入AI与研究者并肩推导的新科研范式;审慎派则提醒,一次未经同行评议的轶事不能等同于科学发现,Fable的"直觉"更可能是对海量物理文献的高维模式匹配,而非本体论意义上的理解。Anthropic近期一篇关于模型"功能性情绪"的研究也支持后一种解读:所谓直觉,或许只是训练语料中人类思维痕迹的投影。
但无论如何定性,一条界线已被越过:AI不再只是文献助手或计算器,它开始参与人类尚未解答的问题。这才是立川删推却删不掉的那句话真正的分量。