我有机会在Opus 5正式发布前进行了试用。整体来看,这是一个不错但性格略显古怪的模型。

在处理简短任务时,它展现出了相当强的实力——性能可以媲美甚至超越Fable。这让它在需要快速响应、指令明确的小型场景里很有竞争力。

打开网易新闻 查看精彩图片

但当任务链条拉长,情况就变了。Opus 5似乎不那么有“野心”,在复杂、长程的推理任务上表现得相对保守,没能延续它在短任务中的锐利感。

打开网易新闻 查看精彩图片

这种“善短不善长”的特性,让它目前的定位有些微妙。对于特定场景,它可能是个高性价比选项;但对于追求深度理解的任务,或许还需要给它留出一些进化时间。