Hasty Briefsbeta

双语

DeepSeek 4.1 Flash

5 days ago
  • 介绍了新架构家族中最小模型,具备原生视觉理解能力,提供更强的性能、更快的推理速度、更高的吞吐量和可扩展性。
  • 采用非对称因果编码器-解码器架构,参数规模552B(MoE),仅需8B活跃参数处理输入、16B处理输出,有效降低成本。
  • 通过全新预训练方法和大规模强化学习后训练,在基准测试中取得超越DeepSeek-V4-Pro等旗舰模型的结果。
  • KV缓存显著缩小:HBM用量仅为1/4,SSD存储为1/8,大幅降低对智能体工作负载至关重要的缓存命中成本。
  • V4.1-Flash已在DeepSeek API上线,支持原生多模态功能;旧版V4-Flash和V4-Flash-Vision-Exp已退役,路由至该新模型。
  • V4-Pro正逐步淘汰;自2026年9月14日起,所有deepseek-v4-pro请求将按V4.1-Flash费率路由至该模型,直至V4.1-Pro发布。
  • 官方合作伙伴WorkBuddy (CodeBuddy) 和 OpenCode 全面支持V4.1-Flash。
  • 更低的API定价,采用峰谷定价(低谷时段费率为高峰的50%),自2026年9月10日起生效。
  • 正在探索开源社区的推理支持和额外部署方案,包括2000块GPU的大规模部署。