arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Carnegie Mellon University(卡内基梅隆大学)

2026-03-31 至 2026-03-31 共收录 24
2603.28718 2026-03-31 cs.LG cs.AI cs.CV

Stepwise Credit Assignment for GRPO on Flow-Matching Models

分步信用分配用于流匹配模型中的GRPO

Yash Savani, Branislav Kveton, Yuchen Liu, Yilin Wang, Jing Shi, Subhojyoti Mukherjee, Nikos Vlassis, Krishna Kumar Singh

机构 * Carnegie Mellon University(卡内基梅隆大学) Adobe Research(Adobe研究院)

AI总结 本文提出分步流GRPO,通过分步奖励改进提升样本效率和收敛速度,引入DDIM启发的SDE提升奖励质量。

Comments Accepted to the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026 Project page: https://stepwiseflowgrpo.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07732 2026-03-31 cs.RO cs.AI cs.CL cs.CV cs.LG

ViPRA: Video Prediction for Robot Actions

ViPRA:用于机器人动作的视频预测

Sandeep Routray, Hengkai Pan, Unnat Jain, Shikhar Bahl, Deepak Pathak

机构 * Carnegie Mellon University(卡内基梅隆大学) Skild AI University of California, Irvine(加州大学尔湾分校)

AI总结 ViPRA通过预训练和微调框架,从无标注视频中学习连续机器人控制,利用视频语言模型预测视觉观察和运动中心潜在动作,支持跨机器人形态的泛化和高频率连续控制。

Comments In ICLR 2026. Website: https://vipra-project.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28135 2026-03-31 cs.AI

CoT2-Meta: Budgeted Metacognitive Control for Test-Time Reasoning

CoT2-Meta:预算化的元认知控制用于测试时推理

Siyuan Ma, Bo Gao, Zikai Xiao, Hailong Wang, Xinlei Yu, Rui Qian, Jiayu Qian, Luqi Gong, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) Carnegie Mellon University(卡内基梅隆大学) Zhejiang University(浙江大学) Sun Yat-Sen University(中山大学) National University of Singapore(新加坡国立大学) Fudan University(复旦大学) City University of Hong Kong (Dongguan)(香港城市大学(东莞)) Zhejiang Lab(之江实验室)

AI总结 CoT2-Meta通过元认知控制优化测试时推理,提升多个基准测试的性能,包括MATH、GSM8K等,相比基线方法有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28079 2026-03-31 cs.RO

Control Without Control: Defining Implicit Interaction Paradigms for Autonomous Assistive Robots

无需控制:为自主助行机器人定义隐式交互范式

Janavi Gupta, Kavya Puthuveetil, Dimitra Tsakona, Akhil Padmanabha, Yiannis Demiris, Zackory Erickson

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Imperial College London(伦敦帝国理工学院)

AI总结 本文探讨隐式控制范式,通过两个设计案例展示如何通过自然行为线索调整机器人行为,减少用户感知负荷并保持控制感,提出隐式交互设计指南。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28038 2026-03-31 cs.AI cs.LG

Beyond the Answer: Decoding the Behavior of LLMs as Scientific Reasoners

超越答案:解码LLM作为科学推理者的行为

Rohan Pandey, Eric Ye, Michael Li

机构 * University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文通过定制遗传Pareto算法优化提示,研究提示对科学推理行为的影响,揭示模型特定的局部逻辑,并探讨其可迁移性和脆弱性。

Comments Accepted at the Post-AGI Science and Society Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27806 2026-03-31 cs.CL cs.CY

Understanding Teacher Revisions of Large Language Model-Generated Feedback

理解大型语言模型生成反馈的教师修订

Conrad Borchers, Luiz Rodrigues, Newarney Torrezão da Costa, Cleon Xavier, Rafael Ferreira Mello

机构 * Carnegie Mellon University(卡内基梅隆大学) Federal Technological University of Paraná – UTFPR(巴拉那联邦理工大学) Instituto Federal Goiano – IF Goiano(戈亚斯联邦学院) Federal Rural University of Pernambuco – UFRPE(伯南布哥联邦农村大学)

AI总结 研究探讨教师如何修订AI生成的反馈,发现80%的反馈未修改,编辑反馈通常更长且被缩短,机器学习模型能预测修订决策,修订常简化反馈内容,使其更简洁纠正性。

Comments Accepted as full paper to the 27th International Conference on Artificial Intelligence in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22601 2026-03-31 cs.LG cs.CV

$ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models

$ϕ$-DPO:面向大多模态模型持续学习的公平性直接偏好优化方法

Thanh-Dat Truong, Huu-Thien Tran, Jackson Cothren, Bhiksha Raj, Khoa Luu

机构 * CVIU Lab, University of Arkansas(阿肯色大学 CVIU 实验室) Dep. of Geosciences, University of Arkansas(阿肯色大学地球科学系) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出$ϕ$-DPO框架,通过直接偏好优化缓解持续学习中的灾难性遗忘问题,并解决数据不平衡导致的公平性问题,实验表明其在多个基准上表现优异。

Comments Accepted to CVPR'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19413 2026-03-31 cs.LG cs.AI cs.CV

UniGame: Turning a Unified Multimodal Model Into Its Own Adversary

UniGame: 将统一多模态模型转变为自身对手

Zhaolong Su, Wang Lu, Hao Chen, Sharon Li, Jindong Wang

机构 * William & Mary(威廉与玛丽学院) Independent(独立研究者) Carnegie Mellon University(卡内基梅隆大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

AI总结 UniGame通过自对抗框架提升多模态模型的一致性与鲁棒性,显著增强理解、生成和对抗鲁棒性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18174 2026-03-31 cs.CV

Unified Spherical Frontend: Learning Rotation-Equivariant Representations of Spherical Images from Any Camera

统一球面前端:从任何相机学习旋转等变的球面图像表示

Mukai Yu, Mosam Dabhi, Liuyue Xie, Sebastian Scherer, László A. Jeni

机构 * Carnegie Mellon University, Robotics Institute(卡内基梅隆大学机器人研究所)

AI总结 本文提出USF框架,通过射线方向对应将任意相机图像映射到单位球面,实现旋转等变的球面卷积,提升宽视场图像处理性能。

Comments Accepted to CVPR 2026. Camera-ready version. Added computation benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13044 2026-03-31 cs.CV cs.AI

SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion

SceneAdapt: 人类运动扩散的场景感知适应

Jungbin Cho, Minsu Kim, Jisoo Kim, Ce Zheng, Laszlo A. Jeni, Ming-Hsuan Yang, Youngjae Yu, Seonjoo Kim

机构 * Yonsei University(延世大学) Carnegie Mellon University(卡内基梅隆大学) UC Merced(加州大学默塞德分校) Google DeepMind(谷歌DeepMind) Seoul National University(首尔国立大学)

AI总结 本文提出SceneAdapt框架,通过运动插值和场景感知插值生成语义丰富的场景感知人类运动,无需大规模配对文本-场景-运动数据。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11334 2026-03-31 cs.CV

Dual Band Thermal Videography: Separating Time-Varying Reflection and Emission Near Ambient Conditions

双频热成像:在近环境条件下分离时间变化的反射和发射

Sriram Narayanan, Mani Ramanagopal, Srinivasa G. Narasimhan

机构 * Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出双频热成像方法,通过光谱和时间线索分离近环境条件下物体和背景的温度,解决热成像中反射和发射信号分离难题。

Comments CVPR 2026. Project Page: https://dual-band-thermal.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05689 2026-03-31 cs.LG math.OC math.PR

Unichain and Aperiodicity are Sufficient for Asymptotic Optimality of Average-Reward Restless Bandits

Unichain 和 非周期性是平均奖励疲软带机问题渐进最优性的充分条件

Yige Hong, Qiaomin Xie, Yudong Chen, Weina Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

AI总结 本文提出了一种新政策,通过逐步将更多臂推向最优分布,证明在Unichain和非周期性假设下,该政策具有O(1/√N)的渐进最优性。

Comments 68 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27725 2026-03-31 cs.RO

TerraSkipper: A Centimeter-Scale Robot for Multi-Terrain Skipping and Crawling

TerraSkipper: 一种用于多地形跳跃和爬行的厘米级机器人

Shashwat Singh, Sheri Zhang, Spencer Matonis, Zeynep Temel

机构 * Carnegie Mellon University(卡内基梅隆大学) Edulis Therapeutics

AI总结 受泥蛙启发,设计了一种厘米级多地形跳跃和爬行机器人,通过侧鳍和旋转弹簧尾实现多种地形移动,实验表明跳跃在黏性及颗粒介质中速度更优。

Comments 8 pages, 9 figures, Accepted - IEEE International Conference on Robotics & Automation (ICRA), Vienna, Austria, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27693 2026-03-31 cs.CV cs.AI cs.LG cs.MA cs.MM

LVRPO: Language-Visual Alignment with GRPO for Multimodal Understanding and Generation

LVRPO:基于GRPO的语言-视觉对齐用于多模态理解和生成

Shentong Mo, Sukmin Yun

机构 * Department of Machine Learning, CMU, USA(卡内基梅隆大学机器学习系,美国) Department of Machine Learning, MBZUAI, UAE(穆罕默德·本·扎耶德人工智能大学机器学习系,阿联酋) Department of Artificial Intelligence, Hanyang University ERICA, South Korea(汉阳大学ERICA校区人工智能系,韩国)

AI总结 本文提出LVRPO框架,通过GRPO显式对齐语言和视觉表示,提升多模态理解和生成性能,无需辅助编码器或人工目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27651 2026-03-31 cs.CL

Budget-Xfer: Budget-Constrained Source Language Selection for Cross-Lingual Transfer to African Languages

Budget-Xfer: 为非洲语言的跨语言迁移进行预算约束的源语言选择

Tewodros Kederalah Idris, Roald Eiselen, Prasenjit Mitra

机构 * Carnegie Mellon University Africa(卡内基梅隆大学非洲校区) North-West University(西北大学)

AI总结 本文提出Budget-Xfer框架,通过预算约束资源分配问题优化多源跨语言迁移,验证多源迁移在命名实体识别和情感分析中的优越性,揭示嵌入相似性在不同任务中的表现差异。

Comments 5 pages, 5 tables. Submitted to SIGIR 2026 Short Paper track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27520 2026-03-31 cs.CV

TokenDial: Continuous Attribute Control in Text-to-Video via Spatiotemporal Token Offsets

TokenDial: 通过时空token偏移实现文本到视频的连续属性控制

Zhixuan Liu, Peter Schaldenbrand, Yijun Li, Long Mai, Aniruddha Mahapatra, Cusuh Ham, Jean Oh, Jui-Hsien Wang

机构 * Adobe Research(Adobe研究院) Carnegie Mellon University(卡内基梅隆大学)

AI总结 TokenDial通过在中间时空视觉patch-token空间中添加偏移实现文本到视频生成模型的连续属性控制,通过调整偏移量实现外观和运动动态的可预测编辑,优于现有基线。

Comments Project page: https://tokendial.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20957 2026-03-31 cs.CL cs.AI cs.CY

Alignment Whack-a-Mole : Finetuning Activates Verbatim Recall of Copyrighted Books in Large Language Models

对齐的打砖块:微调激活大型语言模型对版权书籍的原文回忆

Xinyue Liu, Niloofar Mireshghallah, Jane C. Ginsburg, Tuhin Chakrabarty

机构 * Stony Brook University(石溪大学) Carnegie Mellon University(卡内基梅隆大学) Columbia Law School(哥伦比亚法学院)

AI总结 研究显示微调可绕过安全对齐策略,使GPT-4o等模型能回忆85-90%的版权书籍,揭示模型权重存储版权作品的漏洞。

Comments Preprint Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14575 2026-03-31 cs.LG cs.CL stat.ML

CausalEvolve: Towards Open-Ended Discovery with Causal Scratchpad

CausalEvolve:迈向开放性发现的因果草稿

Yongqiang Chen, Chenxi Liu, Zhenhao Chen, Tongliang Liu, Bo Han, Kun Zhang

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Carnegie Mellon University(卡内基梅隆大学) TMLR Group, Hong Kong Baptist University(香港浸会大学TMLR实验室) SAIC Centre, The University of Sydney(悉尼大学SAIC中心)

AI总结 CausalEvolve通过因果草稿机制提升进化效率,在四个开放性科学任务中发现更优解,解决传统进化代理在指导和知识利用上的不足。

Comments Preprint of ongoing work; Yongqiang and Chenxi contributed equally;

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11321 2026-03-31 cs.RO

ExtremControl: Low-Latency Humanoid Teleoperation with Direct Extremity Control

ExtremControl:低延迟的人形机器人远程操控与直接末端控制

Ziyan Xiong, Lixing Fang, Junyun Huang, Kashu Yamazaki, Hao Zhang, Chuang Gan

机构 * UMass Amherst(马萨诸塞大学阿默斯特分校) Carnegie Mellon University(卡内基梅隆大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

AI总结 本文提出ExtremControl框架,通过直接操作SE(3)姿态、Cartesian空间映射和速度前馈控制,实现低延迟的人形机器人远程操控,实验表明其在模拟和现实环境中均优于传统方法。

Comments Project website: https://extremcontrol.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12812 2026-03-31 cs.CL cs.AI

Does Tone Change the Answer? Evaluating Prompt Politeness Effects on Modern LLMs: GPT, Gemini, and LLaMA

语调会改变答案吗?评估提示礼貌性对现代LLMs的影响:GPT、Gemini和LLaMA

Hanyu Cai, Binqi Shen, Lier Jin, Lan Hu, Xiaojing Fan

机构 * Northwestern University(西北大学) Duke University(杜克大学) Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学)

AI总结 本文通过MMMLU基准测试,评估了不同语调提示对GPT、Gemini和LLaMA模型在STEM和人文领域任务中的准确性影响,发现礼貌性提示在部分人文任务中显著提升性能,但整体上现代LLMs对语调变化具有鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10950 2026-03-31 cs.CV

E-RayZer: Self-supervised 3D Reconstruction as Spatial Visual Pre-training

E-RayZer:基于空间视觉预训练的自监督3D重建

Qitao Zhao, Hao Tan, Qianqian Wang, Sai Bi, Kai Zhang, Kalyan Sunkavalli, Shubham Tulsiani, Hanwen Jiang

机构 * Carnegie Mellon University(卡内基梅隆大学) Adobe Research(Adobe研究院) Harvard University(哈佛大学)

AI总结 本文提出E-RayZer,一种通过未标注图像直接学习几何基础表示的自监督3D视觉模型,通过显式几何实现3D重建,优于现有方法。

Comments CVPR 2026 Camera-ready. Project website: https://qitaozhao.github.io/E-RayZer

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21545 2026-03-31 cs.CV cs.LG

Corruption-Aware Training of Latent Video Diffusion Models for Robust Text-to-Video Generation

面向鲁棒文本到视频生成的潜变量视频扩散模型腐蚀感知训练

Chika Maduabuchi, Hao Chen, Yujin Han, Jindong Wang

机构 * William & Mary(威廉与玛丽学院) Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学)

AI总结 本文提出CAT-LVDM框架,通过结构化噪声注入提升视频扩散模型的鲁棒性,实验显示其在多个数据集上优于传统方法,且能扩展至自回归生成和多模态视频理解模型。

Comments ICLR 2026 ReALM-GEN

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26687 2026-03-31 cs.RO cs.AI

Learning Energy-Efficient Air--Ground Actuation for Hybrid Robots on Stair-Like Terrain

学习能效空气-地面作动器用于阶梯地形上的混合机器人

Jiaxing Li, Wen Tian, Xinhang Xu, Junbin Yuan, Sebastian Scherer, Muqing Cao

机构 * Carnegie Mellon University(卡内基梅隆大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出一种能量感知强化学习框架,通过协调螺旋桨、轮子和倾斜伺服器实现高效混合作动,降低能耗并提升地形适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20507 2026-03-31 cs.LG stat.ML

Distributed Gradient Clustering: Convergence and the Effect of Initialization

分布式梯度聚类:收敛性及初始化的影响

Aleksandar Armacki, Himkant Sharma, Dragana Bajović, Dušan Jakovetić, Mrityunjoy Chakraborty, Soummya Kar

机构 * Carnegie Mellon University(卡内基梅隆大学) Indian Institute of Technology Kharagpur(印度理工学院克勒格布尔分校) Faculty of Technical Sciences, University of Novi Sad(诺维萨德大学技术科学学院) Faculty of Sciences, University of Novi Sad(诺维萨德大学理学院)

AI总结 研究了中心初始化对分布式梯度聚类算法性能的影响,提出改进的分布式中心初始化方案,提升算法鲁棒性与性能。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏