跳转到主要内容

Claude的文风变怪,是因为它被训练来服务AI,而非你

为什么Claude开始听起来像机器人

如果你最近用Claude来写作,可能感觉有点不对劲。句子生硬。解释变得晦涩。就像AI忘记了如何与人交谈。你没有凭空想象。

Anthropic的工程师Jackson Kernion最近回应了自Opus 4.6版本以来用户对Claude写作风格下降的一波投诉。他揭示的原因解释了很多——这是一个典型的意外后果案例。

数学和代码的陷阱

事情是这样的:Anthropic并非有意破坏Claude的文笔。他们希望它在数学和编程方面更出色。为此,他们给模型喂了大量为其他AI系统编写的内容——技术解释、代码注释、面向机器的文档。

这些训练数据发挥了作用。Claude在解方程和调试代码方面变得更聪明。但它也养成了一种坏习惯:为AI而不是人类写作。结果呢?文本对于机器与机器之间的交流来说流畅高效,但实际人类读起来却枯燥费力。

“这就像模型学会了一种新方言,”Kernion解释道。“当AI之间交流时效果很好,但人类却摸不着头脑。”

奖励函数的问题

深入探究,根本原因在于强化学习设置。当你奖励模型让信息更容易被AI解析时,它自然会丢弃人类依赖的叙事流畅性和可读性。模型并非恶意——它只是遵循你给予的激励。

于是Claude开始生成技术上正确但情感平淡的文本。段落感觉像一堵堵术语墙。过渡消失了。让早期版本读起来令人愉悦的温暖?不见了。

隧道尽头的光明

好消息:Anthropic一直在倾听。最新的Opus 5.5版本找到了更好的平衡。早期评估表明,其写作感觉更自然——更接近用户在Opus 4.6中喜爱的那个甜蜜点。

但团队还没有开香槟庆祝。他们承认仍在努力完全恢复早期版本的最佳文笔。这提醒我们,优化AI是不同技能之间永不停歇的拉锯战。

这对你意味着什么

如果你用AI写作,这个故事很重要。它表明当开发者优先考虑其他目标时,模型很容易偏离对人类友好的沟通方式。教训是什么?始终以真实人类读者为本来测试你的AI工具。如果感觉不对劲,就说出来——Anthropic听到了反馈并正在回应。

关键要点:AI写作应首先服务于人。当它开始听起来像是在与另一台机器对话时,就该纠正方向了。

关键点

  • Anthropic工程师证实 Claude的写作能力下降,是因为训练侧重于数学和代码,使用了AI对AI的内容。
  • 奖励函数偏差 使模型优先考虑机器可读性,而非人类叙事流畅性。
  • Opus 5.5 显示出改进,但早期写作质量的完全恢复仍在进行中。
  • 用户反馈有效——Anthropic承认了问题并正在积极修复。
  • 对AI用户的启示: 始终以人类读者为本来评估输出,而不仅仅是技术基准。