写东西的人都有过这种时刻:让AI起草一段文字,读两行就认出来了。不是内容不对,是标点太有辨识度——破折号一个接一个,分号排得整整齐齐。这种"AI味"正在被针对性地削掉。

@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试发现,相比 Opus 5,Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。

打开网易新闻 查看精彩图片

12项指标,10项变了

这次分析的对象是 2026 年 8 月和 9 月的 Text Arena 高推理回复。在 12 项写作指标中,有 10 项朝 Arena 认定的改善方向变化。破折号的变化幅度最大,也是最直观的一项。

分号同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号,Opus 5.5 降至 1.64 个,降幅 73%。两类标点都属于容易被识别的模式,减少使用意味着模型在主动规避这些特征。

句子更短,篇幅反而更长

句长也在变。Opus 5.5 的平均句长为 10.03 个单词,Opus 5 为 12.14 个单词。新模型输出的长句更少,整体措辞更简洁。

但总字数没有跟着缩水。Opus 5 的平均回答长度为 453 个单词,Opus 5.5 增至 481 个单词,成为对比中平均写作篇幅最长的 Opus 模型。

句子更短、篇幅更长,说明变化的方向不是"少写",而是把同样的内容拆得更碎。对需要读大段文字的人来说,这个组合通常意味着更好读。

标点习惯是识别AI写作最省事的线索之一。当破折号和分号这两个高频特征被压下去,靠标点判断文字来源的办法就没那么好用了。