8 hours ago
- 小型AI模型现在与之前的旗舰模型一样智能,为优先考虑速度和成本而非原始智能的代理分析带来了新策略。
- OpenAI的GPT 5.6 Luna降价80%,在SQL基准测试中达到99.8%的准确率,价格比Gemini-3-Flash低5倍,甚至因模型缓存改进在语义建模基准测试中便宜10倍。
- Luna占据了价格/性能曲线的新区间,为不需要最大智能的任务(如SQL生成)提供速度和成本效益。
- 实际步骤包括:对低智能任务切换到Luna的max effort模式,并提出更多问题(杰文斯悖论)以利用该技术改进后的性能。