Skip to content
DeepSeek V4:国产大模型的天花板又被捅了
DeepSeek 这两年的速度太离谱了。
V3 刚让人惊叹「开源也能这么强」,R1 又证明了「推理也能开源」,现在 V4 直接把综合能力拉到了 GPT-5 同一档位。
V4 的核心升级
MoE 架构进化
V4 延续了 MoE 路线,但专家数量和路由策略都做了大改。
结果是:总参数量暴涨,但推理时激活的参数反而更少。速度快了,能力还强了。
原生多模态
V3 只支持文本。V4 加入了图像理解,而且效果不错。
拍一张手写的数学解题过程让它检查,能准确指出哪一步推导有问题。这个能力之前只有 GPT-4o 和 Gemini 有。
推理能力
R1 的推理能力被直接整合进了 V4。不需要单独调用推理模型了——V4 自动判断是否需要深度推理。
和 GPT-5 的「推理融合」思路一样,但 DeepSeek 做到了开源。
性能对比
| 维度 | DeepSeek V4 | GPT-5 | Claude 4 |
|---|---|---|---|
| 代码生成 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 数学推理 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 中文能力 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 多模态 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 开源可用 | ✅ | ❌ | ❌ |
| 价格 | 极低 | 贵 | 中等 |
中文场景下,DeepSeek V4 可能是目前最好的选择。
API 价格
DeepSeek 一如既往的便宜。V4 的 API 价格大约是 GPT-5 的十分之一。
对学生来说,DeepSeek 的免费额度 + 极低的 API 价格,基本不用花什么钱。
本地部署
V4 的蒸馏版可以用 Ollama 跑。8B 版本在消费级显卡上流畅运行,质量远超同体量的其他模型。
一点感慨
两年前第一次试 DeepSeek 的时候,感觉还是个「能用但粗糙」的国产模型。
现在它在多个维度上和 GPT-5 打得有来有回。开源、低价、性能强——这条路走对了。
