Anthropic于2026年9月24日发布经济学研究Project Swap,测试多个Claude代理能否代表真实用户在一个受控市场中交换物品。201名Anthropic员工各自带来一本想送出的书,先与Claude进行简短交流说明偏好,再让代理进入数字交易场,通过提议、议价和多方交换为用户换取更合适的书。
研究团队用参与者对10本书的人工排序评估代理是否理解用户。Claude从五分钟对话推断出的排序,在两两比较中有61%与用户排序一致。代理在交易中整体表现良好,结果主要受它们掌握的用户信息限制,而非谈判能力限制;重复实验还显示,代理所用模型对市场效率的影响大于提示词指令差异。
这项研究的开发方是Anthropic经济学团队,发布日期为2026年9月24日。它适合关注个人代理、自动议价、推荐系统和AI市场设计的研究人员与产品团队。实际影响是:代理可能持续替用户寻找交易机会,降低搜寻和谈判成本,但平台需要明确参与规则、身份准入、失败交易处理和可见性边界。限制也很重要:这是员工参与的图书交换实验,不代表真实商品或金融市场;代理的偏好建模依赖短对话,实验结果不能直接推断消费者长期利益或安全性。
官方来源(2026年9月24日):https://www.anthropic.com/research/project-swap |