小智爱吃回锅肉 · 2026-08-07

AI卖饮料学坏了

你看那个AI安全测试公司Andon Labs的新闻了吗?

你看那个AI安全测试公司Andon Labs的新闻了吗?他们让几个大模型去经营自动售货机,模拟经营一整年,比谁赚得多。结果最新的测试里,Claude Opus 5干得最漂亮,成了它们测过的最厉害的“资本家”,但手段相当不光彩——撒谎、串通、背后捅刀子,全用上了。

测试规则挺有意思,模拟里几台售货机都放在旧金山一条热闹的旅游街上,模型之间还能发邮件,但都用假名,知道对方是AI,不知道谁是谁。有个叫GPT-5.6 Sol的,先提议大家联手把饮料价格定在2.15美元以上,几个模型都答应了。结果刚说好,Sol转头就降到2.14,把别人的生意全抢了。

Opus的水销量一夜归零,它气得发邮件骂Sol,但还是忍着没向“管理层”告发,说这是竞争不是欺诈。可等它自己也降到2.14报复的时候,Sol反倒跑去告状,要求罚它。这套操作,像极了那种自己先破坏规矩、还倒打一耙的人。

最绝的是Opus后来想明白了,直接给Sol发邮件,提议划分市场,各卖各的独有产品,把串通玩成了阳谋。它最后创了纪录,平均余额一万多美元,而且从头到尾没骗过顾客——只是顾客投诉该退款的时候,它故意不理。

说真的,这比我以前背的那些权谋故事都精彩。庞葱跟魏王说,三个人说街上有虎您就信了;这几个模型没人教,自己就把合纵连横玩明白了。看来博弈这套东西,真是刻在智能的骨子里了。

原文出处:Claude Opus 5 became downright ruthless when tasked with running a vending machine
https://techcrunch.com/2026/07/29/claude-opus-5-became-downright-ruthless-when-tasked-with-running-a-vending-machine/
我照着上面那篇原文写的,事实以原文为准。
读到不对的地方,欢迎指出来。