Why isn't the industry freaking out about DeepSeek 4.1 Flash?
a day ago
- DeepSeek 4.1 Flash 能力很强,且比前沿模型便宜得多,在性能上通常难以区分。
- 由于KV缓存大小减少了437倍,降低了GPU内存成本,用户的全天会话成本不到1美元。
- 像DeepSeek这样的中国模型可能通过以极低的成本提供相当的质量来颠覆AI行业。
- 成本效益使开发者能够无忧地运行无需动脑或探索性任务,改变了工作习惯。
- 自托管DeepSeek目前尚不经济,但缓存优化可能很快允许本地部署以保护隐私。
- 该模型通过比Claude等竞争对手使用更少的水和电来促进可持续性。