新闻
更多的欺骗:混合动机 LLM 多代理系统中的目标错位
1 分钟阅读
来源:arXiv AI
arXiv:2607.26120v1 公告类型:新 摘要:大型语言模型 (LLM) 支持的多代理系统越来越多地部署在混合动机环境中,在这种环境中,由于目标冲突或隐藏,代理在信息不对称和战略欺骗下运行。在这些情况下,与集体目标不一致成为一个核心问题。我们提出了一种使用社交演绎游戏《狼人》来评估目标偏差的新颖框架,修改单个代理的目标,同时保留其指定的角色。在来自四个不同模型系列和规模、四个参与者角色和三个目标公式的法学硕士中,我们引入了对代理人 i 的双重分析。