← All posts

DeepSeek V4来了

而且选了一个很有意思的时间点

今天,2026年4月24日。

DeepSeek发布了V4系列的预览版,推出V4 Flash和V4 Pro两个版本,在编程基准测试中声称达到顶级水准,并在推理和智能体任务上取得重大进展。 

然后大家发现,OpenAI同一天发布了GPT-5.5。 

DeepSeek没有回避,直接撞上了。

先说这次发布是什么。

两个模型,定位截然不同。V4-Pro是一个1.6万亿参数的MoE模型,每次推理激活490亿参数,在330亿token上预训练。V4-Flash则轻得多,2840亿总参数,130亿激活,同样训练在320亿token上。 

MoE架构的核心逻辑是:模型很大,但每次只用其中一小部分。V4-Pro在1M上下文场景下,只需要DeepSeek-V3.2单token推理浮点运算的27%,KV缓存只需要10%。 这才是真正的杀手锏。不只是能接受100万token,而是接受了还不会让运营成本崩掉。

两个版本共同的基本配置:上下文窗口100万token,最大输出38.4万token,支持思考模式和非思考模式,支持JSON输出、工具调用。 

跑分怎么样?

不做过度解读,只说几个有意思的数字。

在软件工程真实任务基准SWE-Verified上,V4-Pro得分80.6,与Claude Opus 4.6(80.8)几乎并列,和Gemini 3.1 Pro(80.6)持平。 

竞技编程方面,V4-Pro-Max的Codeforces评级达到3206,超过GPT-5.4的3168和Gemini 3.1 Pro的3052。 这是闭源模型历来领先的领域。

但也有明显的短板。在HLE(人类最后考试)基准上,V4-Pro得37.7,落后于GPT-5.4的39.8、Claude的40.0,与Gemini的44.4差距更大。在常识性世界知识检索上,Gemini依然领先。 

DeepSeek没有掩盖这些差距,直接写进了发布公告里。这点倒是难得。

DeepSeek特别强调V4已针对主流Agent产品做了专项优化,包括Claude Code和CodeBuddy等。模型开放了API里的reasoning_effort参数,让用户根据任务复杂度调节思考强度。 

DeepSeek发布V4之前,没有向英伟达或AMD开放早期访问权限,而是把早期接入机会给了国内供应商,包括华为。 华为当天也确认,其最新AI计算集群可以支持DeepSeek V4模型的运行。 

发布还是预览版,正式版的时间未定。

DeepSeek表示V4-Pro”仅略逊于”GPT-5.4和Gemini 3.1-Pro,并称其”发展轨迹落后最前沿闭源模型约3至6个月”。 

数据来源:DeepSeek官方Hugging Face发布页、Bloomberg、CNBC、Al Jazeera,均为2026年4月24日报道。

Follow my WeChatWeChat 公众号 QR codeScan to follow