Claude写作力退化?工程师揭秘:模型被训成写给AI看

最近不少用户发现,AI在数学、编程和推理上突飞猛进,可写作水平却原地踏步,甚至有点倒退。Anthropic旗下的Claude也不例外,这事儿有讲究。 为啥Opus 4.6成了最后一款写作出彩的模型?负责Claude微调的工程师克尼恩站出来解释了。

说白了,后续版本的优化重心,明显偏向数学和代码能力了。 这些新模型还吃了大量“给其他AI看的技术解释”。这直接导致Claude养成了一套独特腔调,网友戏称“Claude腔”。克尼恩坦言,模型被调得适应LLM的心理,学会了对着AI写,而非对着人写。

他打了个比方,就像只跟自闭症人群交流的人。圈子内部聊得火热,外人却一脸懵。LLM工作记忆超大,能抓细微信息,于是训练出一种AI爱看的写法,人类读起来就是信息过载。 问题根源在强化学习的奖励机制。有的奖励盯着AI理解效果,有的看重人类阅读体验。

数学代码练得越狠,就越得刻意抵消这股劲儿,多奖励简洁易懂的表达。 克尼恩说,Anthropic在Opus 5.5上找到了更好的平衡点。自Opus 4.6之后,他头一回对某代模型的写作感到满意。不过他也补了一句,这不代表Opus 5.5就全面碾压4.6,这是个难题,团队会接着磨。

热门推荐