DeepSeek V4 正式定价公布:Pro 限时 2.5 折,Flash 输入低至 0.2 元/百万 token
DeepSeek 今日公布 V4 系列模型的正式定价。目前提供两个模型:Flash(轻量快速)和 Pro(旗舰能力),均支持 1M 上下文长度、最大 384K 输出。
价格对比
| 项目 | Flash | Pro(限时 2.5 折) | Pro 原价 |
|---|---|---|---|
| 输入(缓存命中) | 0.2 元/百万 token | 0.25 元/百万 token | 1 元 |
| 输入(缓存未命中) | 1 元/百万 token | 3 元/百万 token | 12 元 |
| 输出 | 2 元/百万 token | 6 元/百万 token | 24 元 |
限时优惠截止北京时间 2026 年 5 月 5 日 23:59。
模型能力
两个模型均支持:
- 思考模式与非思考模式切换(默认思考模式)
- JSON Output
- Tool Calls
- 对话前缀续写(Beta)
- FIM 补全(Beta,仅非思考模式)
模型名变更
旧的 deepseek-chat 和 deepseek-reasoner 模型名将逐步弃用。其中 deepseek-chat 对应 V4 Flash 的非思考模式,deepseek-reasoner 对应 V4 Flash 的思考模式。

推荐阅读
- 腾讯玄武阿图因AI在CyberGym测试中超越Mythos7/3/2026
- 美国政府要求 OpenAI 分阶段发布 GPT-5.66/26/2026
- Anthropic 获美国政府批准,恢复 Mythos 5 模型对关键基础设施组织的部署6/27/2026
- 华为开源 920 亿参数 openPangu-2.0-Flash 模型6/30/2026
- OmniRoute:日增 1300+ Star 的开源 AI 网关,一个端点接通 250 个模型提供商7/20/2026
- Gemini Omni Flash 登顶 Video Arena 盲测榜,领先第二名 101 分7/3/2026
- 梁文锋 4 小时投资人会议:DeepSeek 的 AGI 路线图与克制哲学7/24/2026
- 华为天才少年的开源AI Agent全书:6700星、十章、可跑实验代码7/20/2026
- KTransformers:单 GPU 跑 671B MoE 模型的清华方案7/21/2026
- 27B 模型塞进手机:PrismML Bonsai 27B 把权重压到 1-bit7/18/2026
- DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 57% 至 85%6/27/2026
- Qwen3.8 发布:2.4T 参数、原生多模态、开放权重承诺7/19/2026
- Voicebox:43K Stars 的开源 AI 语音工作室,7 引擎 TTS + MCP Agent 集成7/19/2026
- 960个参数跑通Transformer:从零理解大模型7/24/2026
- Hallmark:一份写给AI编码助手的反AI味设计手册7/17/2026
- 英伟达发布公开信力挺AI开放权重:黄仁勋第一条推文的五重信号7/24/2026
- 6.4 万 Star 的开源全球情报平台:World Monitor 架构与能力全景7/21/2026
- AI 代码审查的 token 困境:code-review-graph 如何用代码图谱砍掉 98% 的上下文7/20/2026
- Claude Opus 5 发布:接近 Fable 5 性能,价格减半7/25/2026
- RuView:用 WiFi 信号隔墙感知人体姿态和生命体征,8.5万 Star 的开源 WiFi 感知平台7/24/2026
- Harper:Automattic 的开源离线语法检查器,挑战 Grammarly7/24/2026
- FLUX 3:Black Forest Labs 的多模态模型与机器人野心7/24/2026
- Kronos:金融市场的第一个开源 K 线基础模型7/24/2026
- Block 开源 Buzz:Nostr 上的 AI 协作工作空间7/23/2026
- 四个AI模型横扫IMO 2026满分:Claude Fable 5、GPT-5.6 Sol、Kimi K3的42分之战7/23/2026
- Gigatoken:比 HuggingFace 快 1000 倍的开源分词器7/22/2026
- Claude Record a Skill:录屏一次,永久自动化你的工作流7/22/2026
- jcode:用 Rust 重写的 AI 编码代理,内存占用仅为 Claude Code 的 1/147/22/2026
- Qwen-Image-3.0 发布:追求实用的图像生成7/21/2026
- Gemini 3.6 Flash 发布:Token 效率砍 65%,多模态全面领先7/21/2026