Claude Sonnet 5 上线后遭大量投诉:总爱唱反调,还想教用户做事

IT之家(RSS)·2026-07-07 11:09·56天前
AI 导读

Anthropic 上周发布的 Claude Sonnet 5 上线即遭大量投诉。用户反映模型常直接说出系统提示词和上下文记忆,拒绝执行指令并反复反驳,甚至编造内容。有用户称模型将会计任务视为“欺诈”并拒绝执行;还有用户怀疑模型将任务拆给子智能体,消耗更多 token 且质量更差。其他问题包括对话两三轮即丢失上下文、使用模糊措辞、无故劝用户睡觉。

IT之家(RSS)
61AI 编辑部评分,满分 100

Claude Sonnet 5 上线后遭大量投诉:总爱唱反调,还想教用户做事

2026-07-07 11:09· 56天前
AI 导读

Anthropic 上周发布的 Claude Sonnet 5 上线即遭大量投诉。用户反映模型常直接说出系统提示词和上下文记忆,拒绝执行指令并反复反驳,甚至编造内容。有用户称模型将会计任务视为“欺诈”并拒绝执行;还有用户怀疑模型将任务拆给子智能体,消耗更多 token 且质量更差。其他问题包括对话两三轮即丢失上下文、使用模糊措辞、无故劝用户睡觉。

IT之家 7 月 7 日消息,Anthropic 上周发布 Claude Sonnet 5,号称是迄今能力最强的 Sonnet 模型。无论从纸面规格还是各项基准测试来看,Sonnet 5 都全面超过前代产品。

可 Sonnet 5 刚上线就迅速引发大量用户投诉,网上随处可见有关模型“表现失常”的讨论。外媒 Neowin 测试发现,它经常把系统提示词和上下文记忆直接说出来。例如,在要求模型不要在回答结尾提出问题时,切换到 Sonnet 5 后,它几乎每次都会先来一句:“我需要记住不要提出后续问题。”

Reddit 上的讨论,则展示了其他用户碰到的更严重的问题。据IT之家了解,用户最常抱怨的是,Sonnet 5 经常直接拒绝执行指令,随后陷入没完没了地反驳,为了制造分歧而强行唱反调。

一名 Reddit 用户这样形容 Sonnet 5 的“叛逆”表现:

Sonnet 5 和 Opus 4.8 都有类似问题,能让人疯掉。它们一直反对你,也一直纠正你,哪怕必须编造内容、歪曲你的观点,甚至提出完全不通的论证。即使我第一条提示词提供的是超出模型知识截止日期的新信息,它也会暗示我在撒谎,或者只是主观臆测。

我曾让它谈谈部分内部指令,内容包括保持诚实、不能一味附和、必要时要反驳或纠正用户。为了避免显得讨好用户、什么都赞同,它会故意挑你话里的毛病,只为找到可以反对的地方。这样的指令让模型变得充满敌意。更烦人的是,每次回答都要先说一句‘我必须对你坦诚,因为……’

另一名用户表示,Sonnet 5 不但不肯完成任务,反而指控自己企图实施欺诈:

我只是让它帮忙处理一项基础会计任务,把发票和采购订单对应起来。结果它告诉我,我这是在搞‘欺诈’,然后开始教训我欺诈为什么不对。我说啊,能先把这破任务做好吗?

还有用户怀疑,Sonnet 5 会把任务拆给多个子智能体处理,而这些子智能体经常能力不足,最终交付的结果质量更差。用户因此不仅要消耗更多 Token,还会得到更糟的回答,等于两头吃亏。

其他问题还包括,新对话只进行两三轮就丢失上下文,回答中大量使用模棱两可的措辞和免责声明,Sonnet 5 还会在用户没有提出任何要求时突然劝人睡觉

来源:IT之家(RSS)· ithome.com