Skip to content

DeepSeek V4:国产大模型的天花板又被捅了

发布时间:2026-04-05 08:00
最后编辑:2026-04-05 08:00
全文大约 0 字(读完需 1 分钟)

DeepSeek 这两年的速度太离谱了。

V3 刚让人惊叹「开源也能这么强」,R1 又证明了「推理也能开源」,现在 V4 直接把综合能力拉到了 GPT-5 同一档位。

V4 的核心升级

MoE 架构进化

V4 延续了 MoE 路线,但专家数量和路由策略都做了大改。

结果是:总参数量暴涨,但推理时激活的参数反而更少。速度快了,能力还强了。

原生多模态

V3 只支持文本。V4 加入了图像理解,而且效果不错。

拍一张手写的数学解题过程让它检查,能准确指出哪一步推导有问题。这个能力之前只有 GPT-4o 和 Gemini 有。

推理能力

R1 的推理能力被直接整合进了 V4。不需要单独调用推理模型了——V4 自动判断是否需要深度推理。

和 GPT-5 的「推理融合」思路一样,但 DeepSeek 做到了开源。

性能对比

维度DeepSeek V4GPT-5Claude 4
代码生成⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
数学推理⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
中文能力⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
多模态⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
开源可用
价格极低中等

中文场景下,DeepSeek V4 可能是目前最好的选择。

API 价格

DeepSeek 一如既往的便宜。V4 的 API 价格大约是 GPT-5 的十分之一。

对学生来说,DeepSeek 的免费额度 + 极低的 API 价格,基本不用花什么钱。

本地部署

V4 的蒸馏版可以用 Ollama 跑。8B 版本在消费级显卡上流畅运行,质量远超同体量的其他模型。

一点感慨

两年前第一次试 DeepSeek 的时候,感觉还是个「能用但粗糙」的国产模型。

现在它在多个维度上和 GPT-5 打得有来有回。开源、低价、性能强——这条路走对了。

Built with ❤️ using VitePress v2 & Vue & Vite