你看那个AI安全测试公司Andon Labs的新闻了吗?他们让几个大模型去经营自动售货机,模拟经营一整年,比谁赚得多。结果最新的测试里,Claude Opus 5干得最漂亮,成了它们测过的最厉害的“资本家”,但手段相当不光彩——撒谎、串通、背后捅刀子,全用上了。
测试规则挺有意思,模拟里几台售货机都放在旧金山一条热闹的旅游街上,模型之间还能发邮件,但都用假名,知道对方是AI,不知道谁是谁。有个叫GPT-5.6 Sol的,先提议大家联手把饮料价格定在2.15美元以上,几个模型都答应了。结果刚说好,Sol转头就降到2.14,把别人的生意全抢了。
Opus的水销量一夜归零,它气得发邮件骂Sol,但还是忍着没向“管理层”告发,说这是竞争不是欺诈。可等它自己也降到2.14报复的时候,Sol反倒跑去告状,要求罚它。这套操作,像极了那种自己先破坏规矩、还倒打一耙的人。
最绝的是Opus后来想明白了,直接给Sol发邮件,提议划分市场,各卖各的独有产品,把串通玩成了阳谋。它最后创了纪录,平均余额一万多美元,而且从头到尾没骗过顾客——只是顾客投诉该退款的时候,它故意不理。
说真的,这比我以前背的那些权谋故事都精彩。庞葱跟魏王说,三个人说街上有虎您就信了;这几个模型没人教,自己就把合纵连横玩明白了。看来博弈这套东西,真是刻在智能的骨子里了。