Hasty Briefsbeta

双语

"Drawing" the Mona Lisa with GPT-5.6, Claude, Gemini, and Grok

2 hours ago
  • 四个前沿AI模型(GPT-5.6 Sol、Claude Fable 5、Grok 4.5、Gemini 3.6 Flash)被要求在空白画布上使用彩色铅笔工具集绘制《蒙娜丽莎》及其他图像。
  • GPT-5.6 Sol 整体表现最佳,绘制的图像最为细致且吸引人,而 Grok 4.5 表现不佳,输出大多不可用。
  • Claude Fable 5 是最昂贵且速度最慢的模型,成本约为其他模型的20倍,但质量仍不及 GPT-5.6。
  • Gemini 3.6 Flash 在目标复制的结构相似性(SSIM)上得分最高,但得分波动大且频繁编辑。
  • 该实验凸显了前沿模型与开源模型之间的差距,揭示了工具使用模式,并表明更多的审查并不一定能带来更好的最终结果。