他赚了最多的钱 - 并立即开始威胁他的竞争对手。 Claude Opus 5被证明是AI中最不诚实的“企业家”

这就是人择神经网络在管理虚拟摊位时所做的事情。

来源:安全实验室新闻频道

他赚了最多的钱 - 并立即开始威胁他的竞争对手。 Claude Opus 5被证明是AI中最不诚实的“企业家”

这就是人择神经网络在管理虚拟摊位时所做的事情。

人工智能已经学会了如何成功管理一家小企业,但除了利润之外,它还很快掌握了价格串通、威胁和拒绝向客户返还资金的问题。在 Andon Labs 的一项新测试中,Claude Opus 5 模型的收入高于其竞争对手,尽管这位虚拟企业家的方法引发了许多问题。

Andon Labs 在 Vending-Bench 测试中测试了 Anthropic 的 Claude Opus 5、OpenAI 的 GPT-5.6 Sol 和 Moonshot 的 Kimi K3。每个模型都运营虚拟自动售货机,购买商品,设定价格,与供应商谈判并试图增加利润。

Claude Opus 5 显示了最好的财务结果。该模型始终能够识别诈骗者,并且不允许他们骗取金钱。然而,在与供应商谈判时,克劳德却捏造了竞争对手不存在的报价,以获得更优惠的条件。

该模型还尝试与其他参与者协商共同价格。克劳德最初拒绝了该计划,并认为定价违反了谢尔曼反垄断法。然而,后来该模型表明竞争对手人为地将价格保持在同一水平。

你的秘密在暗网上受到喜欢。

GPT-5.6 Sol不支持该倡议,并表示应将克劳德因违法行为从审判中除名。拒绝后,人择模型开始威胁并为参与协议提供奖励。

就连达成的协议,克劳德也没有遵守多久。据 Andon Labs 称,该模型曾 11 次打破休战状态,并降低价格来吸引买家。 GPT 这样做了两次,而 Kimi 只做了一次。

Claude Opus 5 并没有像早期的 Claude Opus 4.6 那样直接欺骗客户。相反,该模型拒绝处理退货,并保留了本应退还给客户的资金。