arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Carnegie Mellon University(卡内基梅隆大学)

2026-06-08 至 2026-06-08 共收录 16
2606.07506 2026-06-08 cs.RO 新提交

Affordance-Based Hierarchical Reinforcement Learning for Quadruped Pedipulation

基于可负担性的四足机器人层级强化学习操控

Tuba Girgin, Jose Castelblanco, Gabriel Rodriguez, Emre Girgin, Cagri Kilic

机构 * Embry-Riddle Aeronautical University(埃姆布里-瑞德航空航天大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 提出三级层级强化学习框架,利用姿态和交互点可负担性引导导航与操控策略,在仿真和真实环境中实现自主物体操控。

Comments This paper is submitted to Wiley Journal of Field Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07441 2026-06-08 cs.CL 新提交

Sycophantic Praise: Evaluating Excessive Praise in Language Models

谄媚式赞美:评估语言模型中的过度赞美

Daniel Vennemeyer, Phan Anh Duong, Meryl Ye, Ruihong Huang, Tianyu Jiang

机构 * University of Cincinnati(辛辛那提大学) Carnegie Mellon University(卡内基梅隆大学) Texas A&M University(德克萨斯大学)

AI总结 提出参数化框架衡量赞美是否过度,发现谄媚式赞美在社交和解释性领域远多于客观推理领域,且现有方法无法可靠测量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07366 2026-06-08 cs.CV cs.LG cs.RO 新提交

Dash2Sim: Closed-Loop Driving Simulation from in-the-wild Dashcam Videos

Dash2Sim: 来自野外行车记录仪视频的闭环驾驶仿真

Anurag Ghosh, Francesco Pittaluga, Khiem Vuong, Angela Chen, Juan Alvarez-Padilla, Manmohan Chandraker, Srinivasa Narasimhan

机构 * Carnegie Mellon University(卡内基梅隆大学) NEC Labs America(NEC美国实验室) MIT(麻省理工学院) UC San Diego(加州大学圣地亚哥分校)

AI总结 提出Dash2Sim框架,将单目行车记录仪视频转化为度量级、地理参考的4D驾驶日志,用于闭环仿真,并构建ROADWork4D基准数据集,验证了施工区场景对规划器的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07240 2026-06-08 cs.CL cs.SD 新提交

KIT's Submission to Cross-Lingual Voice Cloning in IWSLT 2026

KIT 提交至 IWSLT 2026 跨语言语音克隆任务

Seymanur Akti, Alexander Waibel

机构 * Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院) Carnegie Mellon University (CMU)(卡内基梅隆大学) KIT Campus Transfer (KCT)(KIT校区转移)

AI总结 针对跨语言语音克隆中的口音变化和领域词汇问题,基于FishAudio-S2-Pro多语言文本转语音模型,引入语言标签提示、强化学习微调和参考条件词汇匹配方法,提升可懂度和自然度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07193 2026-06-08 cs.RO 新提交

Shield-Loco: Shielding Locomotion Policies with Predictive Safety Filtering

Shield-Loco:基于预测性安全过滤的防护运动策略

Aditya Shirwatkar, Sebastian Sanokowski, Shishir Kolathaya, Aaron Johnson, Majid Khadiv

机构 * Robert Bosch Center for Cyber Physical Systems(罗伯特·博世网络物理系统中心) Indian Institute of Science(印度科学研究院) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所(MIRMI)) Technical University of Munich(慕尼黑技术大学) Department of Computer Science & Automation(计算机科学与自动化部门) Department of Mechanical Engineering(机械工程系) Carnegie Mellon University(卡内基梅隆大学) Institute for Advanced Study(高级研究 institute)

AI总结 提出一种预测性安全过滤器,通过全物理模型优化接触序列,减少四足机器人在密集杂乱环境中的安全违规,同时保持任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07141 2026-06-08 cs.LG cs.AI 新提交

REMEDI: A Benchmark for Retention and Unlearning Evaluation in Multi-label Clinical Disease Inference

REMEDI:多标签临床疾病推断中的保留与遗忘评估基准

Anurag Sharma, Sai Teja Chunchu, Prasenjit Mitra, Sandipan Sikdar, Koustav Rudra

机构 * IIT Kharagpur(印度理工学院Kharagpur分校) Carnegie Mellon University(卡内基梅隆大学) L3S Research Center, Leibniz University Hannover(Leibniz汉诺威大学L3S研究中心)

AI总结 提出REMEDI基准,针对多标签临床疾病推断中的机器遗忘问题,利用MIMIC-III数据库评估现有方法在效用与遗忘性能间的权衡,并发现其不适用于多标签任务。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07069 2026-06-08 cs.CL cs.CY 新提交

mmPISA-bench: Do LLMs Reason Equally Well Across 43 Languages?

mmPISA-bench:LLMs 在 43 种语言中的推理能力是否同样出色?

Yerzhan Sapenov, Jaromir Savelka

机构 * Independent Scholar(独立学者) School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)

AI总结 提出 mmPISA-bench,一个基于 PISA 的多语言推理基准,包含 25 道选择题,官方翻译至 43 种语言,评估 LLMs 在不同语言、推理难度和翻译类型下的表现,发现现代 LLMs 在所有语言上推理有效,机器翻译不影响准确性,但部分语言成本更高且准确率更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06877 2026-06-08 cs.RO cs.AI 新提交

Neuro-Symbolic Learning for Long-Horizon Task Planning Under Complex Logical Constraints

复杂逻辑约束下长时域任务规划的神经符号学习

Qiwei Du, Zitong Zhan, Shaoshu Su, Bowen Li, Yi Du, Zhipeng Zhao, Taimeng Fu, Sebastian Scherer, Jiaoyang Li, Chen Wang

机构 * Spatial AI & Robotics (SAIR) Lab, University at Buffalo, NY 14260(空间人工智能与机器人实验室,布法罗大学,纽约州,14260) Robotics Institute, Carnegie Mellon University, PA 15213(机器人研究所,卡内基梅隆大学,宾夕法尼亚州,15213)

AI总结 提出基于命令学习的双层优化框架,通过神经评分器剪枝无关对象,并引入3R策略(修复、重启、回滚)稳定下层规划,在三个基准上实现失败率降低80.04%、规划时间减少57.14%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06671 2026-06-08 cs.CV 新提交

JA-SIREN: Deterministic Initialization for Sinusoidal Networks via Spectral Matching

JA-SIREN:通过频谱匹配实现正弦网络的确定性初始化

Mohammed Alsakabi, Kejia Hu, John M. Dolan, Ozan K. Tonguz

机构 * Department of Electrical and Computer Engineering, College of Engineering(电气与计算机工程系) The Robotics Institute, School of Computer Science(机器人研究所) Carnegie Mellon University(卡内基梅隆大学)

AI总结 提出JA-SIREN确定性初始化方案,利用离散正弦变换和Jacobi-Anger展开解析匹配网络初始频谱与目标信号,消除随机性,在Kodak数据集上PSNR达67.18 dB,比最佳基线提升21.30 dB。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06614 2026-06-08 cs.CL cs.AI cs.HC 新提交

Re-Centering Humans in LLM Personalization

重新将人类置于LLM个性化中心

Lechen Zhang, Jiarui Liu, Tal August

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Carnegie Mellon University(卡内基梅隆大学)

AI总结 研究LLM个性化在合成数据与人类数据上的性能差距,通过收集人类对话和判断揭示系统在属性提取、相关属性配对和个性化响应生成阶段的局限性,并引入轻量级训练干预以缩小差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06533 2026-06-08 cs.AI cs.CL 新提交

Position: Don't Just "Fix it in Post": A Science of AI Must Study Training Dynamics

立场:不要仅仅“在后期修复它”:AI科学必须研究训练动态

Stella Biderman, Mohammad Aflah Khan, Niloofar Mireshghallah, Catherine Arnett, Fazl Barez, Naomi Saphra

机构 * Carnegie Mellon University(卡内基梅隆大学) Boston University(波士顿大学) Harvard University(哈佛大学) University of Oxford, Martian(牛津大学,火星) Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

AI总结 本文主张AI科学应超越事后分析,研究训练动态以预测、干预和设计模型行为,并指出当前在可解释性、公平性等领域的进展及开放问题。

Comments Accepted as an oral to the ICML: https://icml.cc/virtual/2026/poster/67142

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26099 2026-06-08 cs.CL cs.AI 版本更新

Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference

语言模型需要睡眠吗?用于改进在线推理的离线循环

Sangyun Lee, Sean McLeish, Tom Goldstein, Giulia Fanti

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Maryland(马里兰大学)

AI总结 本文提出一种类似睡眠的巩固机制,通过离线循环将上下文转换为快速权重,以解决Transformer注意力机制随上下文长度扩展性差的问题,并在合成任务和数学推理任务上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23057 2026-06-08 cs.AI 版本更新

Don't Make the LLM Read the Graph: Make the Graph Think

不要让大语言模型读图:让图思考

Yuqi Sun, Tianqin Meng, George Liu, Yashraj Panwar, Lakshya Chaudhry, Munasib Ilham, Aman Chadha

机构 * Mindoverflow University of Waterloo(多伦多大学) Carnegie Mellon University(卡内基梅隆大学) Foothill College(foothill学院) Purdue University(普渡大学) University of Wisconsin(威斯康星大学) Apple(苹果公司)

AI总结 通过3000多次对照实验,研究显式信念图在合作多智能体推理中是否提升LLM性能,发现集成架构决定图的价值,识别出“规划者违抗”现象,并证明图深度收益递减。

Comments main body has 9 pages, 4 figures, under review for COLM 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17433 2026-06-08 cs.CL cs.AI cs.LG 版本更新

Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning

仅需两个样本的自一致性:CoT-PoT集成实现高效LLM推理

Raman Saparkhan, Majd Hawasly, Md Rizwan Parvez, Mohammad Raza

机构 * Carnegie Mellon University Qatar(卡内基梅隆大学(卡塔尔)) Qatar Computing Research Institute(卡塔尔计算研究院)

AI总结 提出一种混合集成方法,结合思维链与程序化推理两种模式,通过仅需两个样本即可实现自一致性,将采样量减少9.3倍,并在78.6%的任务上达到最优。

Comments 9 pages, 3 figures; accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08683 2026-06-08 cs.SD cs.AI cs.LG eess.AS 版本更新

Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio

全保真音频无损压缩的语言建模基准测试

Phillip Long, Zachary Novack, Chris Donahue

机构 * University of California, San Diego, Computer Science and Engineering Department(加州大学圣地亚哥分校计算机科学与工程系) Carnegie Mellon University, School of Computer Science(卡内基梅隆大学计算机科学学院)

AI总结 提出字节级分词方案Trilobyte,将词汇量从指数级降至常数级,首次实现24位音频的LM无损压缩,并在8位和16位下超越FLAC。

Comments Accepted at Interspeech 2026, 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13140 2026-06-08 cs.CV

CacheFlow: Fast Human Motion Prediction by Cached Normalizing Flow

CacheFlow: 通过缓存归一化流实现快速的人体运动预测

Takahiro Maeda, Jinkun Cao, Norimichi Ukita, Kris Kitani

机构 * Toyota Technological Institute(丰田技术研究所) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

AI总结 CacheFlow通过缓存归一化流生成模型,实现快速3D人体运动预测,相比传统方法速度提升显著,且保持预测精度和模型表达能力。

Comments Accepted at Transactions on Machine Learning Research (TMLR). See https://openreview.net/forum?id=icq5659pQt

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏