Skip to content

Claude 4:Anthropic 的 Agent 路线越走越稳

发布时间:2026-04-20 08:00
最后编辑:2026-04-20 08:00
全文大约 0 字(读完需 1 分钟)

去年写过一篇 Claude 3.5 Sonnet 的评测,结论是「代码能力最强」。

一年过去了,Anthropic 出了好几个版本。Claude 4 也发布了。聊聊这一年的变化。

Claude 4 的核心升级

不是简单的「更聪明了」。

最大的变化是工具使用能力。Claude 4 可以调用外部工具、执行代码、操作文件系统。从一个问答机器人变成了一个能干活的 Agent。

用它来做项目的代码审查——把整个仓库扔给它,让它逐文件看一遍,给出修改建议。以前要自己一个个文件检查,现在真的能省不少时间。

代码能力

依然是第一梯队。

和 GPT-4o 对比,Claude 在理解复杂代码库方面更强。特别是读别人的代码时,它的解释更准确、更有条理。

生成代码的质量也更高——变量命名合理,注释到位,不会写出一坨能跑但看不懂的东西。

中文

以前 Claude 的中文有点「翻译腔」,现在好多了。日常对话基本感觉不到外国人学中文的痕迹。

写中文博客让它帮忙润色,效果比去年强了一大截。

价格

Claude 4 API 价格比 Claude 3.5 Opus 便宜不少,性能反而更强。性价比在往好的方向走。

网页版 Claude Pro 还是 20 刀/月。对学生来说有点贵,但如果你是重度用户,确实值。

总结

Anthropic 这一年的策略很清晰:不追求参数规模的暴力增长,而是提升可靠性和实际应用能力。

Claude 4 不一定是「最聪明」的模型,但可能是「最好用」的。

Built with ❤️ using VitePress v2 & Vue & Vite