Skip to content
GPT-5 来了:这次的升级,是质变
去年四月写过一篇「GPT-5 会是什么样」的预测。
现在 GPT-5 真的来了,翻出来对对账。
预测 vs 现实
| 当时的预测 | 实际情况 |
|---|---|
| 推理能力大幅提升 | ✅ 原生融合 o 系列推理链 |
| 多模态原生支持 | ✅ 视觉、音频、视频全支持 |
| 更长的上下文 | ✅ 上下文窗口到了 100 万 |
| Agent 能力 | ✅ 原生工具调用 + 多步任务 |
| 价格下降 | ❌ 贵了。API 价格比 GPT-4o 还高 |
预测中了大半,但价格那条完全猜错了。
最大的变化:推理融合
GPT-5 不再区分「普通模式」和「推理模式」。
以前你得自己判断用 GPT-4o 还是 o1。现在 GPT-5 自动决定要不要「深度思考」——简单问题秒回,遇到需要推理的问题自动启动思维链。
这个体验很自然。你不用再纠结选哪个模型了。
代码能力
又上了一个台阶。
让它写一个完整的 CRUD 后端(Express + Prisma + PostgreSQL),一次性给出了:项目结构、数据库 schema、API 路由、错误处理、输入验证。
以前需要来回沟通好几轮才能搞定的事,现在一轮就差不多了。
不过还是老问题:能跑不代表写得好。AI 生成的代码需要审阅。
Agent 能力
GPT-5 可以连续执行多步操作:搜索网页 → 阅读内容 → 总结要点 → 写成报告。
拿来做课程论文的文献综述前期工作,节省了大量时间。当然,最终内容还是得自己把关。
对学生的影响
Plus 订阅涨到 30 美元/月了。贵了。
但能力提升确实明显。如果你是重度用户,这 30 美元省下来的时间远超它的价值。
不想花钱的话,免费版也有有限的 GPT-5 额度。或者用 DeepSeek、Gemini 的免费方案作为替代。
和其他模型的关系
现在的格局越来越清晰:
- GPT-5:综合能力最强,但贵
- Claude 3.5:代码和长文本最佳,性价比高
- Gemini 2.5:长上下文 + 多模态,免费额度大
- DeepSeek R1:开源推理,本地可跑
- Llama 4:开源全能,完全免费
没有「一个模型打天下」的时代了。学会按需选择,才是正确的使用姿势。
