12个月前,Claude Opus 4.1 Thinking、Gemini 2.5 Pro和GPT-5 High被视作当时最强的模型。放在今天回看,这个组合仍然能说明很多问题。

一年前的模型格局

打开网易新闻 查看精彩图片

这三款模型分别来自不同团队,各自代表了当时的技术路线。Claude Opus 4.1 Thinking侧重推理与思考过程,Gemini 2.5 Pro在综合能力上表现突出,GPT-5 High则把高性能模式作为主打方向。它们共同构成了那个时间点上的第一梯队。

12个月里的能力跃升

如果回到一年前,用当时的模型能做的事情其实已经不少。但过去12个月里,模型能力经历了明显的飞跃。原文提到“incredible leaps”,强调的正是这种跨越式的进步。从推理深度到响应速度,从多模态理解到复杂任务处理,变化幅度相当可观。

这种对比本身就是一个观察窗口:一年前的最强模型,放到现在可能已经不再是天花板。技术迭代的速度,让“最强”这个标签的有效期变得越来越短。

回看的意义

把时间线拉回到2025年8月底,这三款模型的存在提醒我们,行业基准线一直在快速上移。当时被认为顶尖的能力,如今可能只是入门水平。对于开发者来说,这意味着工具选择需要不断重新评估;对于使用者来说,则意味着同样的任务,现在可能用更低的成本就能完成。

原文没有给出具体的数据对比,但“12个月”这个时间跨度本身就是一个足够清晰的坐标。它标记了一段技术加速期,也让人对接下来12个月的变化保持期待。