Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
安全对齐作为持续学习:通过正交梯度投影缓解对齐税
Guanglong Sun, Siyuan Zhang, Liyuan Wang, Jun Zhu, Hang Su, Yi Zhong
机构
*
School of Life Sciences, IDG/McGovern Institute for Brain Research(生命科学学院,IDG/麦戈文脑科学研究所)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center(计算机科学与技术系,人工智能研究所,清华大学-博世联合机器学习中心,THBI实验室,BNRist中心)
;
Tsinghua University, Beijing, China(清华大学,北京,中国)
Dong-Yang Li, Wang Zhao, Yuxin Chen, Wenbo Hu, Meng-Hao Guo, Fang-Lue Zhang, Ying Shan, Shi-Min Hu
机构
*
BNRist, Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系BNRist)
;
Tencent ARC Lab(腾讯ARC实验室)
;
Victoria University of Wellington(惠灵顿维多利亚大学)
RoboMemArena: A Comprehensive and Challenging Robotic Memory Benchmark
RoboMemArena:一个全面且具有挑战性的机器人记忆基准
Huashuo Lei, Wenxuan Song, Huarui Zhang, Jieyuan Pei, Jiayi Chen, Haodong Yan, Han Zhao, Pengxiang Ding, Zhipeng Zhang, Lida Huang, Donglin Wang, Yan Wang, Haoang Li
机构
*
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Zhejiang University(浙江大学)
;
Westlake University(西湖大学)
;
Tsinghua University(清华大学)
;
Zhejiang University of Technology(浙江工业大学)
;
Shanghai Jiao Tong University(上海交通大学)
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
The Chinese University of Hong Kong(香港中文大学)
;
Fudan University(复旦大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Zhejiang University(浙江大学)
;
Nanyang Technological University(南洋理工大学)
C-CoT: Counterfactual Chain-of-Thought with Vision-Language Models for Safe Autonomous Driving
C-CoT:基于视觉-语言模型的反事实链式推理用于安全自动驾驶
Kefei Tian, Yuansheng Lian, Kai Yang, Xiangdong Chen, Shen Li
机构
*
College of Transportation, Tongji University(同济大学交通运输学院)
;
Department of Civil Engineering, Tsinghua University(清华大学土木工程系)
;
School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)
;
Department of Civil and Environmental Engineering, National University of Singapore(新加坡国立大学土木与环境工程系)
WorldReasonBench: Human-Aligned Stress Testing of Video Generators as Future World-State Predictors
WorldReasonBench: 视频生成器作为未来世界状态预测器的人类对齐压力测试
Keming Wu, Yijing Cui, Wenhan Xue, Qijie Wang, Xuan Luo, Zhiyuan Feng, Zuhao Yang, Sudong Wang, Sicong Jiang, Haowei Zhu, Zihan Wang, Ping Nie, Wenhu Chen, Bin Wang
机构
*
Tsinghua University(清华大学)
;
Nanyang Technological University(南洋理工大学)
;
University of Waterloo(滑铁卢大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
Position: Life-Logging Video Streams Make the Privacy-Utility Trade-off Inevitable
位置:生命记录视频流使隐私与效用的权衡不可避免
Tianyuan Zou, Liang Yue, Yang Liu, Ya-Qin Zhang, Sijie Cheng
机构
*
Institute for AI Industry Research, Tsinghua University, Beijing, China(清华大学人工智能产业研究院)
;
RayNeo.AI, Shenzhen, China(深圳RayNeo.AI)
;
Department of Computer Science and Technology, Tsinghua University, Beijing, China(清华大学计算机科学与技术系)
BGG: Bridging the Geometric Gap between Cross-View images by Vision Foundation Model Adaptation for Geo-Localization
BGG: 通过基于视觉基础模型的适应方法弥合跨视角图像间的几何差距以实现地理定位
Wei Wang, Dou Quan, Ning Huyan, Shuang Wang, Yi Li, Pei He, Licheng Jiao
机构
*
Key Laboratory of Intelligent Perception and Image Understanding of Ministry of Education of China, Xidian University(中国教育部智能感知与图像理解重点实验室,西安电子科技大学)
;
School of Telecommunications, Xidian University(西安电子科技大学电信学院)
;
Department of Automation, Tsinghua University(清华大学自动化系)
机构
*
EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室)
;
Tsinghua University(清华大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Fudan University(复旦大学)
机构
*
Tsinghua University(清华大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Northwestern Polytechnical University(西北工业大学)
;
ETH Zurich(苏黎世联邦理工学院)
机构
*
State Key Laboratory of Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
;
School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)
;
AMAP, Alibaba Group(阿里集团AMAP)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
Tsinghua University(清华大学)
机构
*
Tsinghua University(清华大学)
;
International Digital Economy Academy(国际数字经济学院)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Nanyang Technological University(南洋理工大学)
Joint sparse coding and temporal dynamics support context reconfiguration
联合稀疏编码与时间动态支持情境重构
Qianqian Shi, Yue Che, Faqiang Liu, Hongyi Li, Mingkun Xu, Sandra Reinert, Pieter M. Goltstein, Rong Zhao, Luping Shi
机构
*
Center for Brain-Inspired Computing Research (CBICR), Department of Precision Instrument, Tsinghua University, Beijing, China(脑启发计算研究中心(CBICR)、精密仪器系、清华大学、北京、中国)
;
Optical Memory National Engineering Research Center, Tsinghua University, Beijing, China(光学存储国家级工程研究中心、清华大学、北京、中国)
;
IDG/McGovern Institute for Brain Research, Tsinghua University, Beijing, China(IDG/麦戈文脑研究 institute、清华大学、北京、中国)
;
Guangdong Institute of Intelligence Science and Technology, Hengqin, China(广东智能科学与技术研究院、横琴、中国)
;
Sainsbury Wellcome Centre, University College London, London, UK(桑斯伯里·惠康中心、伦敦大学学院、伦敦、英国)
;
Max Planck Institute for Biological Intelligence, Martinsried, Germany(马克斯·普朗克生物智能研究所、马尔特里德、德国)
Response-G1: Explicit Scene Graph Modeling for Proactive Streaming Video Understanding
响应-G1:面向前瞻性流视频理解的显式场景图建模
Ke Ma, Jiaqi Tang, Bin Guo, Xueting Han, Ruonan Xu, Qingfeng He, Ziheng Wang, Xu Wang, Qifeng Chen, Zhiwen Yu, Yunhao Liu
机构
*
Northwestern Polytechnical University(北华大学)
;
Tsinghua University(清华大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Harbin Engineering University(哈尔滨工程大学)
MePo: Meta Post-Refinement for Rehearsal-Free General Continual Learning
MePo:无回放的通用持续学习的元后细化
Guanglong Sun, Hongwei Yan, Liyuan Wang, Zhiqi Kang, Shuang Cui, Hang Su, Jun Zhu, Yi Zhong
机构
*
School of Life Sciences, IDG/McGovern Institute for Brain Research, Tsinghua University, Beijing, China(生命科学学院,IDG/麦克戈维脑研究 institute,清华大学,北京,中国)
;
Tsinghua-Peking Center for Life Sciences(清华-北京大学生命科学中心)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究所,清华-博世联合机器学习中心,THBI实验室,BNRist中心,清华大学,北京,中国)
;
Department of Psychological and Cognitive Sciences, Tsinghua University, Beijing, China(心理学与认知科学系,清华大学,北京,中国)
;
Univ. Grenoble Alpes, Inria, CNRS, Grenoble INP, LJK, Grenoble, France(格勒诺布尔阿尔卑斯大学,Inria,CNRS,格勒诺布尔INP,LJK,格勒诺布尔,法国)
;
Institute of Software Chinese Academy of Sciences, Beijing, China(软件研究所,中国科学院,北京,中国)
TetraJet-v2: Accurate NVFP4 Training for Large Language Models with Oscillation Suppression and Outlier Control
TetraJet-v2:用于大语言模型的准确NVFP4训练方法,具有振荡抑制和异常值控制
Yuxiang Chen, Yifan Liu, Xiaoming Xu, Pengle Zhang, Michael Beyer, Martin Rapp, Jun Zhu, Jianfei Chen
机构
*
Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(计算机科学与技术系,人工智能研究所,BNRist中心,THBI实验室,清华-博世联合机器学习中心,清华大学)
;
Zhili College, Tsinghua University(紫荆学院,清华大学)
;
Bosch AI Research, Renningen, Germany(博世人工智能研究,德国Renningen)
Alignment-Sensitive Minimax Rates for Spectral Algorithms with Learned Kernels
对具有学习核的谱算法的对齐敏感最小最大率
Dongming Huang, Zhifan Li, Yicheng Li, Qian Lin
机构
*
Department of Statistics and Data Science, National University of Singapore, Singapore(新加坡国立大学统计与数据科学系)
;
School of Statistics and Mathematics, Zhongnan University of Economics and Law, Wuhan, China(中南财经政法大学统计与数学学院)
;
Department of Statistics and Data Science, Tsinghua University, Beijing, China(清华大学统计与数据科学系)
机构
*
Beijing Institute of Technology(北京理工大学)
;
Xidian University(西安电子科技大学)
;
Northeastern University at Qinhuangdao(秦皇岛东北大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Department of Automation, Tsinghua University(清华大学自动化系)
Speech-based Psychological Crisis Assessment using LLMs
基于语音的心理危机评估使用大语言模型
Terumi Chiba, Yang Luo, Ziyun Cui, Yongsheng Tong, Chao Zhang
机构
*
Tsinghua University(清华大学)
;
Peking University Huilongguan Clinical Medical School(北京大学回龙guan临床医学院)
;
WHO Collaborating Centre for Research and Training in Suicide Prevention(世界卫生组织自杀预防研究与培训协作中心)