Arena.ai总结了Claude系列模型不同版本之间的回答变化规律Opus 5 的回答最啰嗦/最长,平均每个回答约 510 个词;句子也最长,平均 12.22 个词;从句频率最高,说明它更常写复杂句,比如带 because、if、while 之类结构。它的回答整体更展开、更长、更有层次。
“长内容词”比例最高的是 Opus 4.5。它更偏向使用较长、较不常见的实词;Opus 5 反而最低,40.1%。Opus 5 是“长篇、句子复杂”,但未必用词最难。
Fable 5 最爱“表扬和认可”,比如 “great question” 这类话,出现率最高,3.11% 的回答会有这种模式。Opus 5 在“固定短语”上最高,比如图里举的 “load-bearing” 这类 stock phrase,每 1000 词 0.22 次,说明它更容易有一些固定表达习惯。
Opus 4.5 最爱用“模糊/谨慎表达”和“抽象名词”。比如 perhaps、arguably 这类 hedges,它最高;complexity、evaluation 这类抽象名词,它也最高。换句话说,Opus 4.5 的风格更学术、更抽象、更保守。

