Vero: Can AI Agents Build Formally Verified Software Repositories?
Vero:AI智能体能否构建形式化验证的软件仓库?
Zhe Ye, Hantao Lou, Yuechun Sun, Peiyang Song, Zhengxu Yan, Timothe Kasriel, Qingyang Zhang, Kaiyu Yang, Soonho Kong, Jingxuan He, Dawn Song
机构
*
University of Chicago(芝加哥大学)
;
California Institute of Technology(加州理工学院)
;
Stanford University(斯坦福大学)
;
UC Berkeley(加州大学伯克利分校)
;
Amazon Web Services(亚马逊云计算服务)
;
Apodex
Online Correlation Clustering: Simultaneously Optimizing All $\ell_p$-norms
Sami Davies, Benjamin Moseley, Heather Newman
机构
*
Department of EECS at UC Berkeley(伯克利大学电子工程与计算机科学系)
;
RelationalAI
;
Tepper School of Business, Carnegie Mellon University(卡内基梅隆大学泰珀商学院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Department of Computer Science, Vassar College(瓦萨学院计算机科学系)
机构
*
Tsinghua University(清华大学)
;
Zhongguancun Academy(中关村学院)
;
Infinigence AI
;
Peking University(北京大学)
;
UC Berkeley(加州大学伯克利分校)
;
Harbin Institute of Technology(哈尔滨工程学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
CommentsAccepted to RSS 2026. This is the technical report of the RLinf Team, focusing on the algorithm side. For the system-level design, please refer to arXiv:2509.15965. The open-sourced code link: https://github.com/RLinf/RLinf
SteeringSafety: Benchmarking Representation Steering in LLMs Across Safety Perspectives
SteeringSafety:针对大语言模型在多安全视角下的表征引导基准测试
Vincent Siu, Nicholas Crispino, David Park, Nathan W. Henry, Zhun Wang, Yang Liu, Dawn Song, Chenguang Wang
机构
*
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Washington University in St. Louis(华盛顿大学圣路易斯分校)
;
University of California, Berkeley(加州大学伯克利分校)
Infra-Bayesian Reinforcement Learning Agents Outperform Classical RL For Worst-Case Robustness
Infra-Bayesian 强化学习智能体在最坏情况鲁棒性上优于经典强化学习
Manish Aryal, Faiyaz Azam, Agnivo Banerjee, Syed Mahir Ahamed, Sai Sidhanth Manoharan Jayanthi, Allegra Laro, Clément Legentilhomme, Andrew Lin, Florian Lorkowski, Marina Pérez del Valle, Radman Rakhshandehroo, Patric Rommel, Emanuel Ruzak, Nathan Theng, Paul Yushin Rapoport
机构
*
Purdue University(普渡大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
WorldQuant University(WorldQuant大学)
;
UC Berkeley(加州大学伯克利分校)
;
Aix-Marseille University(阿维尼翁-马赛大学)
;
MIT(麻省理工学院)
;
University of Zurich(苏黎世大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
University of Stuttgart(斯图加特大学)
;
University of Buenos Aires(布宜诺斯艾利斯大学)
;
California State University, Fresno(弗雷斯诺加州州立大学)
;
University of Chicago(芝加哥大学)
Improving Generalization Robustness of Multimodal RLVR
提升多模态RLVR的泛化鲁棒性
Pengfei Zhou, Zhiwei Tang, Xiaopeng Peng, Chenrui Zhou, Lama Moukheiber, Yixing Ma, Bin Xu, Jiajun Song, Zhenglin Wan, Wangbo Zhao, Jiasheng Tang, Bohan Zhuang, Fan Wang, Yang You
机构
*
National University of Singapore(新加坡国立大学)
;
DAMO Academy Alibaba Group(阿里巴巴达摩院)
;
Hupan Lab(湖畔实验室)
;
Zhejiang University(浙江大学)
;
University of California Berkeley(加州大学伯克利分校)
;
Rochester Institute of Technology(罗切斯特理工学院)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Renmin University of China(中国人民大学)
;
Hong Kong University of Science and Technology(香港科技大学)
Learning Physical Interaction: A Survey of Tactile- and Force-aware Robot Learning
学习物理交互:触觉与力感知机器人学习综述
Shilin Shan, Chuhao Zhou, Ruize Wang, Xinyan Chen, Xiangyu Chen, Xinyu Zhou, Boyu Ma, Iris Yuxuan Hu, Jingliang Li, Celeste Yuxuan Hu, Geng Li, Guohao Chen, Tianrui Zhu, Zhe Li, Yanjie Ze, Haoran Geng, Zhiyang Dou, Jianxin Bi, Yuejiang Liu, Jianshu Zhou, Jiachen Li, Paul Liang, Tatsuya Harada, Robert Katzschmann, Harold Soh, Na Li, Edward Johns, Danica Kragic, Jan Peters, Wojciech Matusik, Masayoshi Tomizuka, Jitendra Malik, Jianfei Yang
机构
*
Nanyang Technological University(南洋理工大学)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加利福尼亚大学伯克利分校)
;
Massachusetts Institute of Technology(麻省理工学院)
;
National University of Singapore(新加坡国立大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
The University of Tokyo(东京大学)
;
ETH Zurich(苏黎世联邦理工学院)
;
Harvard University(哈佛大学)
;
Imperial College London(伦敦帝国学院)
;
KTH Royal Institute of Technology(瑞典皇家理工学院)
;
Technical University of Darmstadt(达姆施塔特工业大学)
The Moving Target: A Longitudinal Audit of Trust-Benchmark Score Drift Across Open-Source Chat LLM Release Lines
移动目标:对开源聊天语言模型十二个检查点的可信度漂移进行纵向审计
Zhichao Fan, Yanhang Li, Zexin Zhuang, Xian Sun, Yingshuo Wang
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Southern Methodist University(南方 Methodist 大学)
;
University of California, Berkeley(加州大学伯克利分校)
David Bonet, Marçal Comajoan Cara, Alvaro Calafell, Daniel Mas Montserrat, Alexander G. Ioannidis
机构
*
Stanford University(斯坦福大学)
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
University of California, Berkeley(加州大学伯克利分校)
;
École Polytechnique(巴黎高等理工学院)
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR))
;
Berkeley Artificial Intelligence Research (BAIR), University of California, Berkeley(加州大学伯克利分校伯克利人工智能研究院(BAIR))