DeepSeek-V4.1-Flash 多模态高效模型
DeepSeek 于 2026 年 9 月 10 日正式发布:新架构家族中最小的成员,原生多模态,凭更小的 KV 缓存降低 API 价格,官方称全面超越旗舰 V4-Pro
模型概览
规格、访问方式与定价见下方
功能特点
- ✓ 新预训练方法 + 更大规模 RL 后训练,官方称基准成绩超越包括 V4-Pro 在内的旗舰模型
- ✓ 原生多模态视觉理解,采用非对称架构,KV 缓存更小、服务成本更低,从而降低 API 价格
- ✓ API 模型名设为 deepseek-flash 即可使用;deepseek-v4-flash 等旧名会临时路由至 V4.1-Flash
- ✓ 自 2026 年 9 月 14 日 04:00 UTC 起,所有 deepseek-v4-pro 请求路由至 V4.1-Flash 并按 V4.1-Flash 价格计费,直至 V4.1-Pro 发布
- ✓ 官方在 Hugging Face 发布模型与《DeepSeek_V41_Tech_Report》技术报告,并称将与开源社区合作推进推理支持;WorkBuddy(含 CodeBuddy)与 OpenCode 已全面支持
使用步骤
- 在 DeepSeek 开放平台获取 API Key
- 把请求的 model 设为 deepseek-flash(旧的 deepseek-v4-flash 会临时路由过来)
- 提交文本或图片任务,使用原生多模态能力
- 如需自部署,从 Hugging Face 获取模型与官方技术报告;并关注后续 V4.1-Pro 的发布
常见问题
DeepSeek-V4.1-Flash 是什么?
DeepSeek 于 2026 年 9 月 10 日正式发布的模型,是其新架构家族中最小的成员,原生支持多模态视觉理解,官方称其在性能、成本、速度与总运行时长上都全面超越 V4-Pro。
和 V4-Pro 相比如何?
官方称多家测试显示 V4.1-Flash 在性能、成本、速度与总运行时长上均领先于 V4-Pro,因此 DeepSeek 计划有序下线 V4-Pro。
调用方式有变化吗?
把模型名设为 deepseek-flash 即可;为兼容旧代码,deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 会临时路由到 V4.1-Flash。
旧的 V4-Pro 请求会怎样?
自 2026 年 9 月 14 日 04:00 UTC 起,所有 deepseek-v4-pro 请求会路由到 V4.1-Flash,并按 V4.1-Flash 的价格计费,直至 V4.1-Pro 发布。
会开放权重吗?
官方称将与开源社区合作推进 V4.1-Flash 的推理支持并探索更多部署方式,模型与《DeepSeek_V41_Tech_Report》技术报告已在 Hugging Face 发布。
有哪些官方合作伙伴已支持?
官方列出 WorkBuddy(含 CodeBuddy)与 OpenCode 已全面支持 V4.1-Flash。