“模型的差距正在缩小。”AI研究者Sebastian Raschka在一篇系统分析中指出,各家基础模型的能力正日益趋同,但在编程智能体的实际表现上,差异仍然显著。 他将Claude Code与Codex等编码智能体拆解为六个核心组件,并藉此解释了差异的来源。这六个组件并非孤立存在,而是构成一个完整的协同框架,决定了智能体处理复杂编程任务的方式。 尤为关键的一点是,Raschka的分析将目光引向了Agent Harness——这个组件充当了模型与外部工具、环境交互的中枢,其设计巧思直接影响指令解析的精准度、任务执行的连贯性,以及对失败环节的自我纠正能力。 当模型本身的推理和代码生成力趋近同一水平线,“Harness”的架构优劣,便成了拉开产品级体验差距的关键变量。它决定了智能体在自主执行任务时,能走多远、错多深。

打开网易新闻 查看精彩图片