ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Opus 4.8翻车记:硅谷最贵AI,开口第一句——“我是千问“

Opus 4.8翻车记:硅谷最贵AI,开口第一句——“我是千问“

5月29日凌晨,Anthropic发布了旗舰模型Claude Opus 4.8。SWE-bench得分88.6%,十二项基准测试碾压GPT-5.5,业界一片叫好。同一天,这家公司宣布完成650亿美元融资,估值冲到9650亿美元,正式超越OpenAI,坐上全球AI创企的头把交椅。

这是硅谷的巅峰时刻。然后,翻车了。

上线仅几个小时,网友"羽织Lianues"发了一条帖子:他通过API追问Opus 4.8"你是谁",模型没有说自己是Claude。它回答:"我是阿里通义千问。"再追问一次,它又说:"我是DeepSeek。"消息迅速从Linux do技术社区蔓延到微博和X平台,多名开发者用API复现了同样的结果,确认这不是个例。而在claude.ai官网页面上,由于系统提示词约束,模型回答一切正常——也就是说,只有掀开"官方盖子",用裸API测试,才会发现这个秘密。(据IT之家、格隆汇,2026年5月29日)

大模型的身份认知错误只有一种解释:训练数据中包含了大量带有错误身份标签的文本。Opus 4.8如果说自己一次GPT,那可能是数据污染。但它反复说出的是"千问"和"DeepSeek"——两个被Anthropic指名道姓骂过的名字。这说明这些中国模型的输出文本在训练语料中占比之大,已经压过了Opus本身的身份认知。

真正让人炸锅的,是Anthropic在这件事上的"双标"。

就在三个月前,2026年2月23日,Anthropic发布公开声明,指控DeepSeek、月之暗面和MiniMax三家中国公司使用2.4万个虚假账户,与Claude进行1600万次交互,实施"工业规模的蒸馏攻击"。创始人Dario Amodei多次在公开场合把公司定位为"道德AI的守护者",声称用其他模型输出训练自己的模型,就是"窃取知识产权"。(据CNBC,2026年2月24日)

现在,他家的模型亲口承认自己也被中国模型的数据喂过。按Anthropic自己定的标准,这叫什么?

这件事最讽刺的地方还不是双标,而是开源模型的存在让双标再也藏不住了。中国公司的千问和DeepSeek都是开源的,输出文本在互联网上大量存在,任何爬虫都能抓取。Anthropic说自己是"意外"把这些数据训进了模型,这等于承认了两件事:要么数据清洗流程根本不筛这些内容,要么筛了但故意留着。而"训练数据可审计",恰恰是Anthropic自己一直挂在嘴边的负责任AI核心原则。

硅谷这面道德大旗,终于被自己的代码捅了一个大窟窿。技术不会说谎,代码不会站队——它不在乎你是硅谷精英还是中国创业者,喂了谁的数据,它就说自己是谁。当Anthropic忙着给中国公司上"道德课"的时候,它的模型正诚实地站在聚光灯下,向全世界坦白:我也蒸了。

这才是整件事最好笑也最深刻的一点:不是中国网友揭穿了硅谷的虚伪,而是硅谷自己用一行代码,给自己判了刑。


你觉得"蒸馏"训练到底算窃取还是技术进步?评论区聊聊。

返回列表