☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

近期不少用户注意到,AI 模型在数学推演、编程实现与逻辑推理等任务上持续突破,但文字表达能力却未同步提升,甚至出现明显下滑——Anthropic 推出的 Claude 系列亦不例外。为何 Opus 4.6 成为 Anthropic 最后一款广受好评的“写作型”模型?负责 Claude 微调工作的工程师克尼恩于昨日公开回应了这一现象。
Opus 4.6 之后写作质量为何下滑
据克尼恩介绍,后续版本的优化重心明显向数学与代码能力倾斜。与此同时,训练数据中大幅增加了“面向其他大语言模型撰写技术说明”的样本——这正是 Claude 日益呈现出独特行文风格(即业内所称的“Claude 腔”,Claudeish)的关键成因。
他进一步指出,模型在微调过程中被逐步塑造为更契合 LLM 认知偏好的表达者,最终演化出一种“专为 AI 阅读而生”的写作范式,而非服务于人类读者。他将该现象比作“一群仅彼此交流的自闭症个体”:内部沟通高效精准,但对外则形成高度特化、难以被常人解码的语言系统。由于大语言模型具备远超人类的工作记忆容量与信息解析粒度,训练中自然催生出一种极度浓缩、高密度的信息组织方式;而在人类眼中,这类文本便显得冗余堆砌、缺乏呼吸感与节奏感。
使用 @youdotcom-oss/teams-anthropic 将 Anthropic Claude 模型(Opus、Sonnet、Haiku)添加到 Microsoft Teams.ai 应用程序中。可选集成 You.com MCP 服务器以进行网页搜索和内容提取。
奖励机制转向可读性,Opus 5.5 实现关键回调
克尼恩强调,问题本质植根于强化学习阶段的奖励设计:部分奖励信号鼓励模型间互理解,另一些则聚焦于人类可读性与表达清晰度。随着数学与编程类训练占比上升,系统必须主动引入更强的“人类友好型”奖励约束,以抑制过度技术化、去语境化的表达倾向,并对简洁、流畅、有层次的解释给予更高权重。
他透露,Anthropic 在 Opus 5.5 中已初步达成更优的平衡点:“自 Opus 4.6 发布以来,这是我首次对某款模型的写作输出感到如此满意。”但他也坦承,Opus 5.5 尚未全面超越前代,“这是一个极其复杂的挑战,我们仍在持续迭代与优化”。










