Skip to content
Claude 4:Anthropic 的 Agent 路线越走越稳
去年写过一篇 Claude 3.5 Sonnet 的评测,结论是「代码能力最强」。
一年过去了,Anthropic 出了好几个版本。Claude 4 也发布了。聊聊这一年的变化。
Claude 4 的核心升级
不是简单的「更聪明了」。
最大的变化是工具使用能力。Claude 4 可以调用外部工具、执行代码、操作文件系统。从一个问答机器人变成了一个能干活的 Agent。
用它来做项目的代码审查——把整个仓库扔给它,让它逐文件看一遍,给出修改建议。以前要自己一个个文件检查,现在真的能省不少时间。
代码能力
依然是第一梯队。
和 GPT-4o 对比,Claude 在理解复杂代码库方面更强。特别是读别人的代码时,它的解释更准确、更有条理。
生成代码的质量也更高——变量命名合理,注释到位,不会写出一坨能跑但看不懂的东西。
中文
以前 Claude 的中文有点「翻译腔」,现在好多了。日常对话基本感觉不到外国人学中文的痕迹。
写中文博客让它帮忙润色,效果比去年强了一大截。
价格
Claude 4 API 价格比 Claude 3.5 Opus 便宜不少,性能反而更强。性价比在往好的方向走。
网页版 Claude Pro 还是 20 刀/月。对学生来说有点贵,但如果你是重度用户,确实值。
总结
Anthropic 这一年的策略很清晰:不追求参数规模的暴力增长,而是提升可靠性和实际应用能力。
Claude 4 不一定是「最聪明」的模型,但可能是「最好用」的。
