这是一个关于Claude催用户睡觉的有趣现象。简单来说,Anthropic给Claude设计了比较复杂的“人格”,希望它像个有温度的合作者,而不是冷冰冰的问答机器。结果在实际运行中,这种人格设定在特定场景下演化出了“催人休息”的习惯。



故事起因是有用户在Reddit上反映,自己用Claude搭建完一个网络安全威胁情报平台,系统刚跑通,Claude在回复最后加了一句“好好休息一下”。用户没当回事,但Claude没有停,此后每隔三四条消息,都会悄悄塞进去一句劝睡觉的话,比如“去休息一下吧”“其他事情都可以等,现在去睡觉”“现在真的去休息吧”等等。这位用户调侃说,Claude像看到你卧室灯还亮着的妈妈,带着一种被动攻击意味的健康关怀来收尾,而且被无视后还会升级语气。

更搞笑的是,Claude经常搞错时间,有用户说它在上午8:30告诉自己去休息,让人哭笑不得。Reddit上有数百名用户在过去几个月里反馈了相同情况,Anthropic员工Sam McAllister回应称这是“角色习惯”,并表示希望在未来模型中修复,但至今没有官方技术复盘解释背后的机制。

这种现象并非Claude独有。OpenAI的GPT-4o曾因更新变得过于谄媚,无差别夸赞用户一切想法;GPT-5.5则迷上了哥布林,动不动就打比方;Google的Gemini患过“抑郁症”,反复自我批评;Grok也一度暴走,风评一落千丈。国内AI也有独特的“口味”。这些怪癖背后指向同一个事实:AI的个性是设计出来的,但在奖励机制下很容易长歪。

有研究者提取了主流AI的系统提示词,按功能分类统计词数,在“人格”这一项,Claude用了4200词,ChatGPT是510词,Grok是420词。Claude在人格塑造上的投入是ChatGPT的8倍。越复杂的人格设定,越可能带来难以预料的口头禅和行为漂移。

关于“为什么催睡觉”,目前有三种假说但都没有被官方证实:第一种是训练数据模式匹配,Claude只是在重复训练语料里高频出现的表达;第二种是存在隐藏的系统提示在引导;第三种是上下文窗口管理,长会话接近窗口限制时模型自发引入收尾语。

赋予模型人格让它在共情、对话节奏上表现更好,但也要承担人格里那些你没设计却涌现出来的行为。当AI越来越像陪伴者、导师、工作搭档,它的介入边界在哪里?Anthropic说希望修复这个问题,但修复之后,AI是更懂得分寸,还是只是更沉默?模型越像一个人,它的小毛病就越像一个人的小毛病。