DeepSeek V4 系列
BLUF 摘要(点开查看)
DeepSeek V4 当前重点是 deepseek-v4-flash(已上线正式版公测,支持 Responses API)和 deepseek-v4-pro(仍为预览版):两者均支持 1M 上下文、最高 384K 输出、思考/非思考双模式、OpenAI/Anthropic 兼容接口。deepseek-chat 和 deepseek-reasoner 旧别名已于 2026-07-24 15:59 UTC 完全退役。
评分维度详解
官方定位 V4 Pro 为面向 Agent 编码、世界知识、数学/STEM/代码推理的旗舰开源模型;Flash 更偏快速和高性价比。
Flash 参数规模更小,适合实时对话和高频任务;Pro 更适合高难推理和长上下文任务。
官方按人民币/百万 token 计费,V4 Flash 缓存命中 ¥0.02/百万输入、未命中 ¥1/百万输入、输出 ¥2/百万;V4 Pro 为 ¥0.025、¥3、¥6。
高峰期算力紧张,Pro 可能变慢或排队。建议做好重试和备用方案。
优缺点分析
- ✓官方 V4 模型名为 deepseek-v4-flash 和 deepseek-v4-pro,新项目应优先使用这两个模型名
- ✓V4 Pro:1.6T 总参数、49B 激活参数,官方定位为性能接近世界顶级闭源模型
- ✓V4 Flash:284B 总参数、13B 激活参数,参数更小、响应更快、API 成本更低
- ✓100 万 token 上下文:Pro 和 Flash 均支持,最大输出可到 384K,适合长文档和代码库任务
- ✓两款模型均支持思考/非思考双模式,deepseek-chat / deepseek-reasoner 旧别名已于 2026-07-24 退役
- ✓OpenAI 兼容接口:迁移成本低,可接入 Claude Code、Agent 等开发工具和主流客户端
- ✓国内直连:无需代理,支持支付宝/微信充值
- ✓开源可商用:模型权重开放,适合本地部署和二次开发
- !deepseek-chat / deepseek-reasoner 已于 2026-07-24 15:59 UTC 退役,未迁移的旧项目必须改用 deepseek-v4-flash / deepseek-v4-pro
- !高峰期算力紧张:热门时段 Pro 响应可能变慢或需排队
- !审美与前端偏弱:能写好逻辑代码,但生成的网页界面不美观,需人工润色
- !暂无原生多模态:纯文本模型,不能直接识别图片和视频(可配合外部工具)
- !中文写作美感:在极难的文学性创作上,Claude Opus 5 仍稍强
定价方案
| 型号 | 输入价格 | 输出价格 |
|---|---|---|
| deepseek-v4-flash | 缓存命中 ¥0.02/百万;缓存未命中 ¥1/百万 | ¥2/百万;并发 2500 |
| deepseek-v4-pro | 缓存命中 ¥0.025/百万;缓存未命中 ¥3/百万 | ¥6/百万;并发 500 |
| 兼容别名 | deepseek-chat / deepseek-reasoner | 已于 2026-07-24 15:59 UTC 退役 |
适用场景与建议
- 选 Pro:复杂数学/科研推理、大型工程代码、分析整本书或全量代码仓库等深度任务
- 选 Flash:学生和上班族的写作辅助、查资料、简单代码帮助、实时对话和自动回复
- 开发者工具链:作为 Claude Code、Agent 框架和自动化脚本的高性价比后端模型
- 预算敏感生产:在成本约束下追求接近世界顶级的模型能力
- 不适合:需原生多模态识别、极致文学创作美感、或极高 SLA 的企业关键链路
总结
DeepSeek V4 的更新重点是低价、1M 长上下文、384K 最大输出和兼容接口。日常办公和代码助手优先试 V4 Flash;复杂推理、长文档和高质量代码任务再上 V4 Pro。注意官方并发限制(Flash 2500、Pro 500),以及 deepseek-chat / deepseek-reasoner 已于 2026-07-24 15:59 UTC 退役。
- ✓选 Pro:复杂数学/科研推理、大型工程代码、分析整本书或全量代码仓库等深度任务
- ✓选 Flash:学生和上班族的写作辅助、查资料、简单代码帮助、实时对话和自动回复
- ✓开发者工具链:作为 Claude Code、Agent 框架和自动化脚本的高性价比后端模型
- !预算敏感生产:在成本约束下追求接近世界顶级的模型能力
- !不适合:需原生多模态识别、极致文学创作美感、或极高 SLA 的企业关键链路
使用前准备
常见问题
DeepSeek V4 系列 的性价比怎么样?
官方按人民币/百万 token 计费,V4 Flash 缓存命中 ¥0.02/百万输入、未命中 ¥1/百万输入、输出 ¥2/百万;V4 Pro 为 ¥0.025、¥3、¥6。
新手适合用 DeepSeek V4 系列 吗?
不适合:需原生多模态识别、极致文学创作美感、或极高 SLA 的企业关键链路
DeepSeek V4 系列 和其他 API 怎么选?
建议先明确你的任务类型,然后查看场景推荐页面。最靠谱的方法是用同一个样本测试 2-3 个 API,对比质量、速度和成本。