Hasty Briefsbeta

双语

Gemini last models: temperature, top_p, and top_k are deprecated and ignored

5 hours ago
  • Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 现已正式可用(GA),可用于生产环境。
  • Gemini 3.6 Flash 在复杂的智能体和多模态任务上提供更强的性能,且价格更低(输入每百万 tokens 1.50美元,输出每百万 tokens 7.50美元)。
  • Gemini 3.5 Flash-Lite 是 3.5 系列中速度最快、成本最低的模型(输入每百万 tokens 0.30美元,输出每百万 tokens 2.50美元)。
  • 两个模型均支持 100万 tokens 的上下文窗口、最大 64k tokens 的输出、思考功能以及计算机使用(Computer Use)。
  • 3.6 Flash 的主要改进包括 token 减少、更好的代码生成、指令遵循以及多模态推理。
  • 3.5 Flash-Lite 的主要改进包括降低延迟、增强推理、子智能体编排以及文档理解。
  • API 变更:采样参数(temperature、top_p、top_k)已弃用;不再允许预填充模型轮次(prefilled model turns)。