DeepSeek-AI/DeepSeek-V4-Flash-0731
4 hours ago
- DeepSeek-V4-Flash-0731 可以通过 pipeline 或直接加载模型的方式与 Transformers 一起使用,并提供了代码示例。
- 也可以使用 vLLM(通过 pip 安装或 Docker)进行部署,并通过特定标志启用 DSpark 推测解码。
- SGLang 通过 pip 或 Docker 提供模型服务,并提供了 Docker 模型运行器命令。
- 基准测试结果显示,DeepSeek-V4-Flash-0731 的性能优于之前的版本,并且与 Opus-4.8 等专有模型相比具有竞争力。
- 该模型使用带有专用编码文件夹的自定义聊天模板,并支持三种推理努力级别:低、高、最大。
- 本地部署建议包括采样参数(对于代理任务,temperature=1.0,top_p=0.95)和最大输出长度 384K tokens。
- 该模型根据 MIT 许可证授权,并提供了引用信息。