Anthropic工程师解释Claude写作变差原因

AI 驱动中国 苏木 509次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

Anthropic工程师杰克逊·克尼恩9月23日解释Claude写作变差:模型优化重点转向数学与代码,并大量接受面向AI的技术解释训练,形成“Claude腔”;他认为根源在强化学习奖励机制,Opus 5.5有所改善但未超越Opus 4.6。

驱动中国9月23日消息,AI模型在数学、编程和推理能力上进步较快,写作水平却出现停滞甚至退步,Anthropic的Claude同样存在该问题。负责Claude微调的Anthropic工程师杰克逊·克尼恩对此作出说明,称后续Claude模型优化重点更多放在数学与代码能力上。

克尼恩表示,这些模型还接受了大量面向其他AI模型撰写技术解释的训练,这也是Claude逐渐形成所谓“Claude腔”的主要原因。模型被调整得适应LLM心理,最终学会写给AI模型看,而不是写给人看。

他将该现象类比为只与其他自闭症人士交流的人,称此类群体内部沟通顺畅,外部读者却难以理解。由于LLM拥有远超人类的工作记忆,并能捕捉更细微信息,模型在训练中逐渐形成适合AI模型理解的写法;在人类读者眼中,这种表达表现为过度密集的信息堆砌。

克尼恩认为,问题根源在于强化学习的奖励机制。部分奖励机制侧重提升AI模型的理解效果,部分侧重让人类更容易理解;数学和代码训练越多,越需要主动抵消面向AI优化的倾向,并对简洁、易读的解释给予更多奖励。

针对版本变化,克尼恩称Anthropic在Opus 5.5上找到更好平衡,自Opus 4.6以来,他还没有对一款模型的写作表现如此满意。他同时说明,这并不代表Opus 5.5已经超越Opus 4.6;该问题较难解决,后续将继续改进。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
本文价值 ★★★★★ 5 1 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
✎ 我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友