驱动之家 昨天
Claude写作能力退化了!工程师解释:模型被训成写给AI看而非给人看
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

快科技 9 月 24 日消息,大家有没有发现,AI 模型在数学、编程和推理能力上进步迅速,但写作水平却有些停滞不前,甚至还有所退步,而 Anthropic 的 Claude 同样也存在这一问题。

为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?

据媒体报道,昨日,负责 Claude 微调的 Anthropic 工程师克尼恩解释称:" 后续模型的优化重点更多放在数学和代码能力上。"

这些模型还接受了大量面向其他 AI 模型撰写技术解释的训练,而这正是 Claude 逐渐形成奇特表达方式,也就是所谓 "Claude 腔 "(Claudeish)的主要原因。

克尼恩解释,模型被调整得适应 LLM 心理,最终学会了写给 AI 模型看,而不是写给人看。

他还把这种现象类比作 " 只与其他自闭症人士交流的人 ",此类群体会逐渐形成一套在群体内部沟通顺畅、外人却难以理解的表达方式。

而 LLM 拥有远超人类的工作记忆,也能捕捉更细微的信息,因此在训练中会逐渐形成一种非常适合 AI 模型理解的写法,但在人类读者眼中,这种表达就成了过度密集的信息堆砌。

克尼恩认为,问题的根源在于强化学习的奖励机制,有些奖励机制着重提升 AI 模型的理解效果,有些则着重让人类更容易理解。

数学和代码方面的训练越多,就越需要主动抵消这种倾向,对简洁、容易让人读懂的解释给予更多奖励。

克尼恩称,Anthropic 在 Opus 5.5 上找到了更好的平衡,自 Opus 4.6 以来,我还没有对一款模型的写作表现这么满意过。

" 当然这样也并不代表 Opus 5.5 已经超越 Opus 4.6,这是一个很难解决的问题,我们会继续改进。"

【本文结束】如需转载请务必注明出处:快科技

责任编辑:哈尔

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 工程师 数学 哈尔 效果
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论