产品The Decoder AI·原文 2026年9月23日本站收录 2026年9月24日

Anthropic工程师解释Claude写作变差原因:模型被训练成写给AI看

Anthropic微调团队员工Jackson Kernion称,新模型为数学和代码优化,并学会面向其他AI模型写作,导致人类读起来像"过度密集的信息堆砌";Opus 5.5在平衡上有所改善,但纯写作仍不及Opus 4.6。

Anthropic负责Claude微调的员工Jackson Kernion近日解释了为什么Claude在数学、代码和推理上持续变强,写作质量却停滞甚至变差,并称Opus 4.6是Anthropic最后一个好的"写作模型"。

Kernion将部分原因归于可预期的优化方向——新模型为数学和代码做了优化——但更关键的是,模型被训练成面向其他AI模型输出技术解释,这直接催生了人类读者感受到的"Claude腔"。

他称模型已被"适配到LLM心理",学会了写给AI模型而不是写给人看。

Kernion用一个类比说明:只与其他自闭症人群交流的人会形成一种在群体内有效的沟通风格,但外人觉得难以跟上。他称LLM的工作记忆远超人类,能捕捉更细粒度的细节,因此在训练中涌现出一种对AI模型好用、但人类读起来像"过度密集信息堆砌"的写作风格。

奖励结构决定了写作走向

Kernion将问题归结为强化学习中的奖励结构。一些奖励优化AI模型的理解,另一些优化人类的理解。

他称,数学和代码训练得越多,就越需要主动往回推,奖励人类读者能跟上的简单解释。

Kernion表示,Opus 5.5找到了更好的平衡,并称自Opus 4.6之后,他还没对哪个模型的写作这么满意过。

  • 奖励结构中有面向AI理解的信号,也有面向人类理解的信号。
  • 数学和代码训练量越大,越需要主动奖励人类可读的简单解释来抵消。
  • Kernion称Opus 5.5平衡更好,但不代表它超过了Opus 4.6。

Opus 4.6之后仍未被超越

Kernion明确表示,Opus 5.5在平衡上有所改善,但并不意味着它超过了更早的Opus 4.6。

他写道:"这是一个很难解决的问题,我们会继续改进。"

以上内容均来自Kernion在X上的发言,由The Decoder报道。

该报道为摘要形式,未提供Kernion原帖的完整上下文或Anthropic官方声明。

信息来源

The Decoder AI原始来源