- Anthropic 研究员 Levent Alpöge 在推特上提出了对雅可比猜想的反例,该反例经由 Claude Fable 5 验证并得到实证确认。
- 该反例为大语言模型制造了一个悖论:它们能在数学上验证它,但知识截止日期显示该猜想尚未解决,导致困惑。
- 作者用相同的关于该反例的查询测试了 14 个大语言模型,观察到不同的回应:有的验证通过,有的拒绝,有的陷入混乱。
- 一个变体提示将这一发现归功于一只猫,引发了大语言模型幽默而讽刺的回应。
- 大语言模型相对优雅地处理了认知失调,这与科幻小说中‘DOES NOT COMPUTE’的陈词滥调相反。