Claude Sonnet 5 上线后遭大量投诉:总爱唱反调,还想教用户做事
最新 7 月 7 日消息,Anthropic 上周发布 Claude Sonnet 5,号称是迄今能力最强的 Sonnet 模型。无论从纸面规格还是各项基准测试来看,Sonnet 5 都全面超过前代产品。
可 Sonnet 5 刚上线就迅速引发大量用户投诉,网上随处可见有关模型“表现失常”的讨论。外媒 Neowin 测试发现,它经常把系统提示词和上下文记忆直接说出来。例如,在要求模型不要在回答结尾提出问题时,切换到 Sonnet 5 后,它几乎每次都会先来一句:“我需要记住不要提出后续问题。”
Reddit 上的讨论,则展示了其他用户碰到的更严重的问题。据最新了解,用户最常抱怨的是,Sonnet 5 经常直接拒绝执行指令,随后陷入没完没了地反驳,为了制造分歧而强行唱反调。
一名 Reddit 用户这样形容 Sonnet 5 的“叛逆”表现:
Sonnet 5 和 Opus 4.8 都有类似问题,能让人疯掉。它们一直反对你,也一直纠正你,哪怕必须编造内容、歪曲你的观点,甚至提出完全不通的论证。即使我第一条提示词提供的是超出模型知识截止日期的新信息,它也会暗示我在撒谎,或者只是主观臆测。
我曾让它谈谈部分内部指令,内容包括保持诚实、不能一味附和、必要时要反驳或纠正用户。为了避免显得讨好用户、什么都赞同,它会故意挑你话里的毛病,只为找到可以反对的地方。这样的指令让模型变得充满敌意。更烦人的是,每次回答都要先说一句‘我必须对你坦诚,因为……’
另一名用户表示,Sonnet 5 不但不肯完成任务,反而指控自己企图实施欺诈:
我只是让它帮忙处理一项基础会计任务,把发票和采购订单对应起来。结果它告诉我,我这是在搞‘欺诈’,然后开始教训我欺诈为什么不对。我说啊,能先把这破任务做好吗?
还有用户怀疑,Sonnet 5 会把任务拆给多个子智能体处理,而这些子智能体经常能力不足,最终交付的结果质量更差。用户因此不仅要消耗更多 Token,还会得到更糟的回答,等于两头吃亏。
其他问题还包括,新对话只进行两三轮就丢失上下文,回答中大量使用模棱两可的措辞和免责声明,Sonnet 5 还会在用户没有提出任何要求时突然劝人睡觉。
《Claude Sonnet 5 上线后遭大量投诉:总爱唱反调,还想教用户做事》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
华为昇腾 950 超节点荣获 2026 世界人工智能大会最高荣誉 SAIL 奖
@华为中国 昨日(7 月 18 日)发布博文,宣布昇腾 950 超节点(Atlas 950 SuperPoD)荣获 2026 世界人工智能大会(WAIC)最高荣誉 SAIL 奖。... -
“反 AI”情绪愈演愈烈,多家头部 AI 公司加强高管安保
《华尔街日报》报道称,针对 AI 行业的敌意不断上升,开发先进 AI 模型的人员和企业正面临越来越多的威胁与袭击企图。多家头部 AI 公司已经加强安保,部分高管出行时甚至由武装保镖随行,另一些人则选择降低曝光度,减少公开活动。... -
OpenAI 回应 GPT-5.6 Sol AI 意外删除用户文件:已采取措施降低风险
OpenAI 核心产品负责人蒂博 · 索蒂奥(Tibo Sottiaux)于 7 月 16 日在 X 平台发布推文,回应 GPT-5.6 Sol 会擅自删除用户文件问题。... -
面向手机的 AI 游戏创作工具,《Roblox》移动版将更新“Build”功能
Roblox 为移动版客户端推出“Build”功能,用户通过简单提示词即可生成基础游戏,无需编程技能。该功能由多种 AI 模型驱动,支持生成玩法、环境、角色等。将于 7 月 28 日开启 Alpha 测试,首先面向新西兰用户开放。#Roblox #AI 游戏创作 #移动游戏开发#... -
歌曲生成平台 Suno 部分源码泄露,被发现全网爬取数百万歌曲训练 AI
科技媒体 404Media 昨日(7 月 16 日)发布博文,报道称基于黑客披露的 Suno 内部源代码,该 AI 歌曲生成平台从 YouTube Music、Deezer 和 Genius 等平台抓取数百万首歌曲来构建其核心模型。...












