Hasty Briefsbeta

双语

LLMs break down in funny ways when told the Jacobian Conjecture counterargument

17 hours ago
  • Anthropic 研究员 Levent Alpöge 在推特上提出了对雅可比猜想的反例,该反例经由 Claude Fable 5 验证并得到实证确认。
  • 该反例为大语言模型制造了一个悖论:它们能在数学上验证它,但知识截止日期显示该猜想尚未解决,导致困惑。
  • 作者用相同的关于该反例的查询测试了 14 个大语言模型,观察到不同的回应:有的验证通过,有的拒绝,有的陷入混乱。
  • 一个变体提示将这一发现归功于一只猫,引发了大语言模型幽默而讽刺的回应。
  • 大语言模型相对优雅地处理了认知失调,这与科幻小说中‘DOES NOT COMPUTE’的陈词滥调相反。