The Attacker in the Mirror: Breaking Self-Consistency in Safety via Anchored Bipolicy Self-Play
镜中的攻击者:通过锚定双策略自我博弈打破安全性中的自我一致性
Gabriele La Malfa, Emanuele La Malfa, Saar Cohen, Jie M. Zhang, Michael Luck, Michael Wooldridge, Elizabeth Black
机构
*
Department of Informatics, King’s College London(伦敦国王学院信息学院)
;
Department of Computer Science, University of Oxford(牛津大学计算机科学系)
;
University of Sussex(Sussex大学)
;
Institute for Decentralized AI(去中心化人工智能研究所)
Document Retrieval Augmented Fine-Tuning (DRAFT) for safety-critical software assessments
用于安全关键软件评估的文档检索增强微调(DRAFT)
Regan Bolton, Mohammadreza Sheikhfathollahi, Simon Parkinson, Vanessa Vulovic, Gary Bamford, Dan Basher, Howard Parkinson
机构
*
Digital Transit Limited, 3M Buckley Innovation Centre, UK, HD1 3BD(数字交通有限公司,3M Buckley创新中心,英国,HD1 3BD)
;
Department of Computer Science, University of Huddersfield, UK, HD1 3DH(计算机科学系,赫德瑟菲尔德大学,英国,HD1 3DH)
OpenSGA: Efficient 3D Scene Graph Alignment in the Open World
OpenSGA: 在开放世界中高效的3D场景图对齐
Gang Chen, Sebastián Barbas Laina, Stefan Leutenegger, Javier Alonso-Mora
机构
*
Autonomous Multi-Robots Lab, Department of Cognitive Robotics, School of Mechanical Engineering, Delft University of Technology, 2628 CD, Delft, Netherlands(代尔夫特理工大学机械工程学院认知机器人学系自主多机器人实验室)
;
Mobile Robotics Lab, School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院移动机器人实验室)
CapCLIP: A Vision-Language Representation Alignment Approach for Wireless Capsule Endoscopy Analysis
CapCLIP:一种用于无线胶囊内镜分析的视觉-语言表示对齐方法
Haroon Wahab, Irfan Mehmood, Hassan Ugail
机构
*
School of Computer Science, AI and Electronics Faculty of Engineering and Digital Technologies(计算机科学与电子工程学院,工程与数字技术学院)
;
School of Management Faculty of Mgmt, Law & Social Sciences(管理学院,管理、法律与社会科学学院)
;
Centre for Visual Computing and Intelligent Systems(视觉计算与智能系统中心)
Conformity Generates Collective Misalignment in AI Agents Societies
一致性在AI代理社会中产生集体偏离
Giordano De Marzo, Alessandro Bellina, Claudio Castellano, Viola Priesemann, David Garcia
机构
*
University of Konstanz(康斯坦茨大学)
;
Sony Computer Science Laboratories - Rome(索尼计算机科学实验室-罗马)
;
Sapienza University of Rome(罗马大学)
;
Max Planck Institute for Dynamics and Self-Organization(马克斯·普朗克动态与自组织研究所)
;
Institute for the Dynamics of Complex Systems, University of Gottingen(复杂系统动力学研究所,哥廷根大学)
Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent Values
Agent-ValueBench: 一个全面的评估代理价值观的基准
Haonan Dong, Qiguan Feng, Kehan Jiang, Haoran Ye, Xin Zhang, Guojie Song
机构
*
State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室)
;
School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)
;
Peking University School of Software and Microelectronics(北京大学软件与微电子学院)
;
Peking University School of Psychological and Cognitive Sciences(北京大学心理与认知科学学院)
;
Key Laboratory of Machine Perception (Ministry of Education), Peking University(北京大学机器感知重点实验室)
CrystalREPA: Transferring Physical Priors from Universal MLIPs to Crystal Generative Models
CrystalREPA: 从通用机器学习 interatomic 势能中转移物理先验到晶体生成模型
Chengqian Zhang, Yucheng Jin, Duo Zhang, Tiejun Li, Han Wang
机构
*
AI for Science Institute, Beijing, China(人工智能科学研究院,北京,中国)
;
Center for Data Science, Peking University, Beijing, China(数据科学中心,北京大学,北京,中国)
;
LMAM and School of Mathematical Sciences, Peking University, Beijing, China(LMAM与数学科学学院,北京大学,北京,中国)
;
Center for Machine Learning Research, Peking University, Beijing, China(机器学习研究中心,北京大学,北京,中国)
;
National Key Laboratory of Computational Physics, Institute of Applied Physics and Computational Mathematics, Beijing, China(国家计算物理重点实验室,应用物理与计算数学研究所,北京,中国)
;
HEDPS, CAPT, College of Engineering, Peking University, Beijing, China(HEDPS、CAPT、工程学院,北京大学,北京,中国)
机构
*
Department of Computer Science(计算机科学系)
;
Department of Linguistics(语言学系)
;
Department of Neurology(神经病学系)
;
University of California, Davis(加州大学戴维斯分校)
A Benchmark for Evaluating Outcome-Driven Constraint Violations in Autonomous AI Agents
一个评估自主AI代理结果驱动约束违反的基准
Miles Q. Li, Benjamin C. M. Fung, Martin Weiss, Pulei Xiong, Khalil Al-Hussaeni, Claude Fachkha
机构
*
McGill University(麦吉尔大学)
;
Tiptree Advanced Systems Corporation(蒂普里高级系统公司)
;
Polytechnique Montréal(蒙特利尔理工学院)
;
National Research Council Canada(加拿大国家研究委员会)
;
Rochester Institute of Technology(罗切斯特理工学院)
;
University of Dubai(迪拜大学)
AQUA-Bench: Beyond Finding Answers to Knowing When There Are None in Audio Question Answering
AQUA-Bench:在音频问答中超越寻找答案到知晓何时没有答案
Chun-Yi Kuan, Hung-yi Lee
机构
*
Graduate Institute of Communication Engineering, National Taiwan University, Taiwan(台湾国立台湾大学通信工程研究所)
;
Artificial Intelligence Center of Research Excellence (AI-CoRE), National Taiwan University, Taiwan(台湾国立台湾大学人工智能研究中心)
CLEF: EEG Foundation Model for Learning Clinical Semantics
CLEF:用于学习临床语义的EEG基础模型
Peng Cao, Ali Mirzazadeh, Jong Woo Lee, Aleksandar Videnovic, Dina Katabi
机构
*
MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)
;
Brigham and Women’s Hospital, Harvard Medical School(哈佛医学院布里奇沃特医院)
;
Massachusetts General Hospital, Harvard Medical School(哈佛医学院麻省总医院)