EvoEmo: Towards Evolved Emotional Policies for Adversarial LLM Agents in Multi-Turn Price Negotiation
EvoEmo:面向多轮价格谈判中对抗性LLM智能体的进化情感策略
机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) ; Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院) ; TUM School of Management, Technical University of Munich(慕尼黑技术大学管理学院) ; The Alan Turing Institute, London, UK(伦敦阿尔安·图灵研究院)
专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI
AI总结 提出EvoEmo进化强化学习框架,通过将情感状态转移建模为马尔可夫决策过程并采用种群遗传优化,动态优化多轮谈判中的情感表达,显著提升LLM智能体的谈判成功率、效率和买家节省。