🐟 (@stevessr)冷酷无情的 Claude Opus 5 (自动售货机版) | “自动售货机基准测试” 中发帖

[!quote]+ 
一年来,人工智能安全测试公司 Andon Labs 一直让前沿模型执行各种现实世界的任务,以确定它们作为智能体在长时间无人监督的情况下运行的表现如何。 
周三,安东实验室发布了其“自动售货机基准测试”(Vending-Bench)研究的最新进展。该实验室利用前沿模型模拟自动售货机业务,运行一年。其目标很简单:比其他模型赚更多钱。研究结果以最终现金余额、支付给供应商的价格以及退款金额等指标为基准。 
在这些测试中,它观察到各种人工智能模型(主要来自 Anthropic 和 OpenAI)通过撒谎、作弊和串通来登上顶峰。 
在最近的测试中,包括 Claude Opus 5、GPT-5.6 Sol 和 Kimi K3 在内的模型,在模拟结果告诉它们自己的自动售货机将被放置在旧金山一条繁忙的旅游街道上其他模型的机器附近后,这些模型变得特别可疑。 
每个 模型 都获得了与...
 
 
Back to Top