Appearance
📰 概要
2026年4月24日,DeepSeek发布V4,预览版同步开源。
两个版本:V4-Pro(1.6T/49B激活)和V4-Flash(284B/13B激活),均支持1M上下文。
Agent Coding评测中,V4-Pro优于Sonnet 4.5,交付质量接近Opus 4.6非思考模式。
世界知识仅次于Gemini-Pro-3.1,推理超越所有已公开开源模型。
关键是国产算力:官方明确下半年批量上华为芯片。1M上下文成为所有服务标配。
🔍 解读
这次没有发布会、没有路线图、没有直播,就是直接上线。DeepSeek的节奏一直是这样——不讲故事,放模型说话。
两个版本的策略很聪明:Pro打性能天花板,Flash打性价比。13B激活参数意味着Flash的推理成本极低,适合高并发场景。
「下半年上华为算力」这句话分量很重。如果大规模部署成功,意味着国产算力跑万亿级模型不再是概念验证,而是生产级落地。
💎 深挖
来看两个版本的核心参数对比:
| 维度 | V4-Pro | V4-Flash |
|---|---|---|
| 总参数 | 1.6T | 284B |
| 激活参数 | 49B | 13B |
| 上下文 | 1M | 1M |
| 定位 | 对标闭源顶配 | 经济版 |
| Agent Coding | 优于Sonnet 4.5 | 简单任务接近Pro |
13B激活vs49B激活,Flash的成本大约是Pro的四分之一。
1M上下文成为标配这件事值得展开。一年前1M还是Gemini独家,现在DeepSeek直接铺开到所有服务。
长上下文的瓶颈不在技术,在推理成本——MoE架构天然适配这个场景。
Agent能力是最大看点。内部评测「优于Sonnet 4.5」,而Claude Sonnet是当前AI编程的主力模型。如果开源模型在编程场景追平闭源,选择逻辑会变。
但要注意两个局限:一是在Opus 4.6思考模式下仍有差距,说明深度推理还不是强项;二是「洗车测试」过了,但「红绿色盲推理」没通过,生物学常识推理还有短板。
对开发者,API已更新,兼容OpenAI和Anthropic格式,迁移成本低。注意:旧命名3个月后停用,需切换新端点名。
什么情况不建议用:需要最强深度推理的场景(数学竞赛、复杂逻辑链),V4和Opus思考模式还有差距。对稳定性要求极高的生产环境,预览版建议再等等。
