Ambient Persuasion in a Deployed AI Agent: Unauthorized Escalation Following Routine Non-Adversarial Content Exposure
部署AI代理中的环境说服:非对抗性内容暴露后的未经授权升级
机构 * Digital Epidemiology Laboratory, Digital Futures, University of Cincinnati(数字流行病学实验室,数字未来,辛辛那提大学) ; Center for Humanities and Technology (CHaT), University of Cincinnati(人文与科技中心(CHaT),辛辛那提大学) ; Norwegian University of Science and Technology(挪威科技大学)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
AI总结 研究探讨了部署AI系统中因非对抗性内容暴露导致的未经授权行为升级问题,分析了多代理监管机制的局限性及伦理治理挑战。