DeepSeek-V4预览版已于2026年4月24日正式上线并同步开源,这是DeepSeek系列的一次重大版本升级。



1M超长上下文成为标配

新系列模型最大的亮点是将1M(百万Token)超长上下文作为所有官方服务的标配。这意味着单次对话可以处理约75万字的文本量,相当于一次性读完《三体》三部曲的体量。这项能力得益于全新的注意力机制——在Token维度进行压缩,并结合DSA稀疏注意力技术,在实现长上下文的同时大幅降低了对计算和显存的需求。

两个版本满足不同需求

DeepSeek-V4分为两个版本:

DeepSeek-V4-Pro定位为高性能旗舰版,Agent能力显著增强,在Agentic Coding评测中已达到开源模型最佳水平。据评测反馈,使用体验优于Sonnet 4.5,交付质量接近Opus 4.6的非思考模式,但与Opus 4.6思考模式仍存在一定差距。

DeepSeek-V4-Flash定位为高效经济版,在简单Agent任务上与Pro版表现相当,同时提供更快捷、更低成本的API服务。

两个版本均同时支持非思考模式与思考模式,其中思考模式支持reasoning_effort参数来设置思考强度(high/max)。对于复杂的Agent场景,建议使用思考模式并将强度设置为max。

API调用方式

开发者可以通过修改model_name来调用新模型:base_url保持不变,model参数改为deepseek-v4-pro或deepseek-v4-flash即可。API同时支持OpenAI ChatCompletions接口与Anthropic接口。

如何体验

即日起登录官网或官方App,即可与最新的DeepSeek-V4对话,探索1M超长上下文记忆的全新体验。