DeepSeek-V4预览版发布:百万Token上下文成标配,Pro版性能对标顶级闭源模型
AIAI Summary (BLUF)
DeepSeek-V4预览版正式发布,包括Pro和Flash两个版本。Pro版拥有1.6T总参数量(49B激活),性能媲美顶级闭源模型;Flash版284B总参数量(13B激活),兼顾速度与成本。两个版本均支持1M上下文长度,并且采用了创新的Token压缩和DSA稀疏注意力机制。API已更新,旧模型将于2026年7月24日后退役。
核心洞察
先说结论:这次 DeepSeek V4 预览版最让人意外的是那把 100 万 token 的上下文窗口直接做成了标配,而且两个模型都支持。跟之前 V3 相比,这次不仅参数规模涨了,注意力机制也彻底改了,稀疏加压缩,长文本的计算压力明显降下来。如果你在找能跑长文档推理的开源模型,这可能是目前性价比最高的选择。
DeepSeek-V4-ProDeepSeek-V4的大模型版本,总参数量1.6T,激活参数49B,性能强大,在多个基准测试中领先开源模型。:1.6T 总参量,49B 激活参数。 性能对标世界顶级闭源模型。
DeepSeek-V4-FlashDeepSeek-V4的轻量级版本,总参数量284B,激活参数13B,速度快、成本低,推理能力接近Pro版本。:284B 总参量,13B 激活参数。 速度快、成本低,日常用更划算。
两个模型已经可以在 chat.deepseek.com 上通过 Expert Mode 或 Instant Mode 体验。API 今天同步更新,直接换模型名就能用。
技术报告:https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf
开源权重:https://huggingface.co/collections/deepseek-ai/deepseek-v4
核心结论
- DeepSeek V4 Pro(总参量1.6T,激活49B)和Flash(总参量284B,激活13B)均默认支持100万token上下文窗口,采用基于token压缩与稀疏注意力的新机制,显著降低长文本计算和内存开销。
- DeepSeek V4 Pro在Agentic Coding基准测试中排名开源第一,世界知识仅次于Gemini 3.1 Pro,数学/STEM/编程能力超越现有开源模型,对齐顶级闭源模型。
- DeepSeek V4 Flash激活参数仅13B,推理能力接近Pro版,在简单智能体任务上表现相当,响应更快且API定价性价比更高。
- API已同步更新,只需将模型名改为
deepseek-v4-pro或deepseek-v4-flash即可使用,原有deepseek-chat和deepseek-reasoner将于2026年7月24日15:59 UTC完全下线,目前已自动路由到V4 Flash的对应模式。
DeepSeek-V4-Pro
智能体能力在开源模型里当前是 SOTA,Agentic Coding 基准测试排第一。
世界知识方面,跑在所有开源模型前面,只比 Gemini 3.1 Pro 差一点。
推理能力更强,数学 / STEM / 编程都超过现有开源模型,跟顶级闭源模型不相上下。
(基准测试图见下方)
DeepSeek-V4-Flash
推理能力接近 Pro 版。
简单智能体任务上跟 Pro 版表现差不多。
参数量小,响应更快,API 定价性价比高。
(基准测试图见下方)
结构创新与超长上下文效率
新注意力机制:基于 token 的压缩加上 DeepSeek 稀疏注意力。
长上下文效果全球领先,计算和内存开销大幅降低。
100 万上下文现在成了 DeepSeek 所有官方服务的默认配置。
(效率对比图见下方)
针对智能体能力的专门优化
V4 原生支持 Claude Code、OpenClaw、OpenCode 这类主流智能体工具。
DeepSeek 内部已经在用它做智能体编程。
下图是一份由 V4-Pro 生成的 PDF 样稿。
API 今天就能用
base_url 不用改,模型名换成 deepseek-v4-pro 或 deepseek-v4-flash 就行。
兼容 OpenAI ChatCompletions 和 Anthropic API。
两个模型都支持 100 万上下文和双模式(思考 / 非思考)。
注意:deepseek-chat 和 deepseek-reasoner 会在 2026 年 7 月 24 日 15:59 UTC 完全下线,目前它们已经路由到 deepseek-v4-flash 的非思考/思考模式。
一些提醒
最近消息比较多,官方消息请以 DeepSeek 官方账号为准,其他渠道的说法不代表我们观点。
感谢大家的持续信任,我们会继续坚持长期主义,向着 AGI 目标一步步走。
常见问题(FAQ)
DeepSeek-V4预览版有哪些版本?各版本有什么特点?
DeepSeek-V4预览版包括Pro和Flash两个版本。Pro版1.6T总参数(49B激活),性能对标顶级闭源模型;Flash版284B总参数(13B激活),速度快、成本低。两者均支持1M上下文和双模式。
DeepSeek-V4新模型如何通过API使用?需要修改什么?
API已更新,base_url无需改动,只需将模型名改为deepseek-v4-pro或deepseek-v4-flash。兼容OpenAI和Anthropic API,同时支持思考/非思考模式。
旧模型deepseek-chat和deepseek-reasoner什么时候停止服务?
旧模型deepseek-chat和deepseek-reasoner将于2026年7月24日15:59 UTC完全下线。目前它们已路由到deepseek-v4-flash的非思考/思考模式,建议尽快切换。
版权与免责声明:本文仅用于信息分享与交流,不构成任何形式的法律、投资、医疗或其他专业建议,也不构成对任何结果的承诺或保证。
文中提及的商标、品牌、Logo、产品名称及相关图片/素材,其权利归各自合法权利人所有。本站内容可能基于公开资料整理,亦可能使用 AI 辅助生成或润色;我们尽力确保准确与合规,但不保证完整性、时效性与适用性,请读者自行甄别并以官方信息为准。
若本文内容或素材涉嫌侵权、隐私不当或存在错误,请相关权利人/当事人联系本站,我们将及时核实并采取删除、修正或下架等处理措施。也请勿在评论或联系信息中提交身份证号、手机号、住址等个人敏感信息。



