新闻
AI 写作退化真相大白:Anthropic 工程师揭秘,Claude 竟被“训”成了写给 AI 看而不是给人看 人工智能大模型的演进常常伴随着意料之外的副作用
1 分钟阅读
AI 写作退化真相大白:Anthropic 工程师揭秘,Claude 竟被“训”成了写给 AI 看而不是给人看 人工智能大模型的演进常常伴随着意料之外的副作用。针对广大用户近期频繁反馈的 Claude 自 Opus4.6版本以来写作风格下滑、出现所谓“Claude 腔”的现象,Anthropic 工程师杰克逊・克尼恩(Jackson Kernion)近日公开作出了解释,揭示了这一奇特现象背后的技术根源。 在模型优化的整体导向方面,Claude 后续版本的研发重点明显向数学推理和编程能力倾斜。为了提升模型在复杂工程任务中的表现,研发团队在训练过程中大量引入了面向其他 AI 模型撰写技术解释和代码注释的内容。这种训练方式导致模型在潜移默化中逐渐学会了“写给 AI 而非人类看”,从而形成了虽然在 AI 间沟通极为顺畅、但人类读者却倍感晦涩难懂的过度密集表达。 从底层强化学习的机制来看,这一问题的核心在于奖励函数的偏向性。当优化目标侧重于提升 AI 对信息的理解与解析效果时,模型在文本组织上就会自然抛弃人类习惯的叙事节奏与可读性。目前,Anthropic 团队在最新的 Opus5.5版本中已经找到了更好的平衡点,其写作表现被评价为自 Opus4.6以来最令人满意的状态,不过相关团队表示,要完全超越早期的最佳水平仍在持续推进改进工作。 via AI新闻资讯 (author: AI Base)