发布概况
DeepSeek 正式发布多模态模型 DeepSeek-V4.1-Flash。该模型是全新模型结构系列中尺寸最小的一款,官方说明新结构的设计目标是提高能力上限、加快推理速度、提升吞吐,并可在此基础上扩展到更大参数规模的模型。模型已同步上线开放平台,开发者把调用模型名改为 deepseek-flash 即可使用。
原生多模态与能力表现
与此前以独立视觉扩展方式提供图像能力不同,V4.1-Flash 在同一个模型内同时处理图像与文本,属于原生多模态视觉理解,适用于图文混合输入、图表理解与多模态智能体等场景。官方公布的部分评测结果包括 GPQA Diamond 90.9、Codeforces 评分 3471、Terminal-Bench 2.1 90.6、DeepSWE v1.1 74.2、NL2Repo-Bench 65.4、CyberGym 88.1、SEC-Bench Pro 62.8、Chartography 工具辅助 78.9;其中 HLE 的 36.8 分仅在纯文本子集上测得,工具辅助场景为 63.9。上述数值为官方公布的评测成绩,实际使用效果会随任务类型与提示方式不同而变化。
对现有用户的影响
- 模型名变更:新模型统一使用 deepseek-flash 调用,接口地址与调用方式保持不变。
- 旧型号下线:此前的 V4 Flash 与 V4 Flash Vision Exp 已下线。出于兼容考虑,旧模型名 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 的请求会暂时路由到 V4.1-Flash,并按 Flash 档价格计费,使用旧模型名的项目无需立即改造即可维持调用。
- V4 Pro 继续提供:官方决定在 2026 年 9 月 14 日之后继续提供 V4 Pro 的接口调用服务,计费方式保持不变。
调用价格调整
随着 V4.1-Flash 上线,开放平台的调用价格同步下调。平台按输入与输出的总 token 数计费,并继续沿用分时定价:空闲时段价格约为高峰时段的一半,高峰时段为北京时间周一至周五的 9:00 至 12:00 与 14:00 至 18:00,其余时段按空闲价格计算。开发者可据此把批量推理任务安排在空闲时段,以降低调用开销。
升级建议
依赖旧 Flash 型号构建的应用,短期内仍可用旧模型名继续调用,但实际由新模型提供服务,输出风格与能力表现可能随模型换代发生变化,建议升级前重新验证关键用例与评测集。需要多模态输入的场景可直接用同一模型处理文本与图像,不必再组合独立的视觉模型与文本模型;对稳定性要求较高的生产环境,可先用小流量灰度再全量切换。