arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Carnegie Mellon University(卡内基梅隆大学)

共收录 2349
2506.02178 2025-06-04 cs.SD cs.CL

Cocktail-Party Audio-Visual Speech Recognition

Thai-Binh Nguyen, Ngoc-Quan Pham, Alexander Waibel

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Carnegie Mellon University(卡内基梅隆大学)

Comments Accepted at Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02177 2025-06-04 cs.AI cs.LG

Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts

Haizhong Zheng, Yang Zhou, Brian R. Bartoldson, Bhavya Kailkhura, Fan Lai, Jiawei Zhao, Beidi Chen

机构 * Carnegie Mellon University(卡内基梅隆大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Meta AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01704 2025-06-04 cs.AI cs.CL

Generate, Not Recommend: Personalized Multimodal Content Generation

Jiongnan Liu, Zhicheng Dou, Ning Hu, Chenyan Xiong

机构 * School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学agate智能学院) Serendipity One Inc.(Serendipity One公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00694 2025-06-04 cs.CL cs.AI cs.LG

Measuring Faithfulness and Abstention: An Automated Pipeline for Evaluating LLM-Generated 3-ply Case-Based Legal Arguments

Li Zhang, Morgan Gray, Jaromir Savelka, Kevin D. Ashley

机构 * Intelligent Systems Program, University of Pittsburgh(匹兹堡大学智能系统项目) School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)

Comments 11 pages, 7th Workshop on Automated Semantic Analysis of Information in Legal Text @ ICAIL 2025, 16 June 2025, Chicago, IL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00422 2025-06-04 cs.CL cs.SD eess.AS

DYNAC: Dynamic Vocabulary based Non-Autoregressive Contextualization for Speech Recognition

Yui Sudo, Yosuke Fukumoto, Muhammad Shakeel, Yifan Peng, Chyi-Jiunn Lin, Shinji Watanabe

机构 * Honda Research Institute Japan(本田研究院日本) Carnegie Mellon University(卡内基梅隆大学)

Comments Accepted to Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24200 2025-06-04 cs.SD cs.CL eess.AS

Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC

Qingzheng Wang, Jiancheng Sun, Yifan Peng, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16311 2025-06-04 cs.LG cs.AI cs.IR

HybGRAG: Hybrid Retrieval-Augmented Generation on Textual and Relational Knowledge Bases

Meng-Chieh Lee, Qi Zhu, Costas Mavromatis, Zhen Han, Soji Adeshina, Vassilis N. Ioannidis, Huzefa Rangwala, Christos Faloutsos

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon(亚马逊)

Comments Accepted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14321 2025-06-04 cs.RO

Continual Learning and Lifting of Koopman Dynamics for Linear Control of Legged Robots

Feihan Li, Abulikemu Abuduweili, Yifan Sun, Rui Chen, Weiye Zhao, Changliu Liu

机构 * Robotics Institute, Carnegie Mellon University(机器人研究所、卡内基梅隆大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03730 2025-06-04 cs.LG cs.CR cs.CV

NeurIPS 2023 Competition: Privacy Preserving Federated Learning Document VQA

Marlon Tobaben, Mohamed Ali Souibgui, Rubèn Tito, Khanh Nguyen, Raouf Kerkouche, Kangsoo Jung, Joonas Jälkö, Lei Kang, Andrey Barsky, Vincent Poulain d'Andecy, Aurélie Joseph, Aashiq Muhamed, Kevin Kuo, Virginia Smith, Yusuke Yamasaki, Takumi Fukami, Kenta Niwa, Iifan Tyou, Hiro Ishii, Rio Yokota, Ragul N, Rintu Kutum, Josep Llados, Ernest Valveny, Antti Honkela, Mario Fritz, Dimosthenis Karatzas

机构 * University of Helsinki(赫尔辛基大学) Computer Vision Center, Universitat Autònoma de Barcelona(巴塞罗那自治大学计算机视觉中心) CISPA Helmholtz Center for Information Security(信息安全赫尔姆霍茨中心) INRIA(法国国家信息与自动化技术研究所) Yooz Carnegie Mellon University(卡内基梅隆大学) NTT(日本NTT公司) Institute of Science Tokyo(东京科学研究所) Department of Computer Science(计算机科学系) Mphasis AI & Applied Tech Lab at Ashoka, Ashoka University(阿什oka大学人工智能与应用技术实验室) Koita Centre for Digital Health - Ashoka (KCDH-A)(阿什oka数字健康中心(KCDH-A)) Trivedi School of Biosciences, Ashoka University(阿什oka大学Trivedi生物科学学院)

Comments 33 pages, 7 figures; published in TMLR 06/2025 https://openreview.net/forum?id=3HKNwejEEq

Journal ref Transactions on Machine Learning Research, ISSN 2835-8856, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02528 2025-06-04 cs.CL

What Goes Into a LM Acceptability Judgment? Rethinking the Impact of Frequency and Length

Lindia Tjuatja, Graham Neubig, Tal Linzen, Sophie Hao

机构 * Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学)

Comments Accepted to NAACL 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13570 2025-06-04 cs.CV

Robust 6DoF Pose Estimation Against Depth Noise and a Comprehensive Evaluation on a Mobile Dataset

Zixun Huang, Keling Yao, Seth Z. Zhao, Chuanyu Pan, Allen Y. Yang

机构 * UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学) UCLA(加州大学洛杉矶分校)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01845 2025-06-03 eess.AS cs.LG cs.SD

On-device Streaming Discrete Speech Units

Kwanghee Choi, Masao Someki, Emma Strubell, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) Language Technologies Institute(语言技术研究所)

Comments Accepted to Interspeech 2025, source code at https://github.com/Masao-Someki/StreamingDSU

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01689 2025-06-03 cs.AI cs.CL

Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents

Shuting Wang, Yunqi Liu, Zixin Yang, Ning Hu, Zhicheng Dou, Chenyan Xiong

机构 * School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Serendipity One Inc.(Serendipity One公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01611 2025-06-03 eess.AS cs.SD eess.SP

Lessons Learned from the URGENT 2024 Speech Enhancement Challenge

Wangyou Zhang, Kohei Saijo, Samuele Cornell, Robin Scheibler, Chenda Li, Zhaoheng Ni, Anurag Kumar, Marvin Sach, Wei Wang, Yihui Fu, Shinji Watanabe, Tim Fingscheidt, Yanmin Qian

机构 * Shanghai Jiao Tong University(上海交通大学) Waseda University(早稻田大学) Carnegie Mellon University(卡内基梅隆大学) Google DeepMind(谷歌DeepMind) Meta

Comments 5 pages, 4 figures, 1 table. Accepted by Interspeech 2025. Code available at https://github.com/urgent-challenge/urgent2024_analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01194 2025-06-03 cs.LG cs.DC

FedRPCA: Enhancing Federated LoRA Aggregation Using Robust PCA

Divyansh Jhunjhunwala, Arian Raje, Madan Ravi Ganesh, Chaithanya Kumar Mummadi, Chaoqun Dong, Jiawei Zhou, Wan-Yi Lin, Gauri Joshi, Zhenzhen Li

机构 * Carnegie Mellon University(卡内基梅隆大学) Bosch Center for AI(博世人工智能中心) Stony Brook University(石溪大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01079 2025-06-03 cs.CG cs.AI

Unfolding Boxes with Local Constraints

Long Qian, Eric Wang, Bernardo Subercaseaux, Marijn J. H. Heule

机构 * Carnegie Mellon University(卡内基梅隆大学)

Comments Accepted at CADE30 (2025). 17 figures. Code at https://github.com/LongQianQL/CADE30-BoxUnfoldings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00722 2025-06-03 cs.CL cs.SD eess.AS

Chain-of-Thought Training for Open E2E Spoken Dialogue Systems

Siddhant Arora, Jinchuan Tian, Hayato Futami, Jee-weon Jung, Jiatong Shi, Yosuke Kashiwagi, Emiru Tsunoo, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) Sony Group Corporation(索尼集团)

Comments Accepted at INTERSPEECH 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00718 2025-06-03 cs.CV cs.AI

From Local Cues to Global Percepts: Emergent Gestalt Organization in Self-Supervised Vision Models

Tianqin Li, Ziqi Wen, Leiran Song, Jun Liu, Zhi Jing, Tai Sing Lee

机构 * Carnegie Mellon University(卡内基梅隆大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00688 2025-06-03 cs.LG cs.AI cs.CL

Existing Large Language Model Unlearning Evaluations Are Inconclusive

Zhili Feng, Yixuan Even Xu, Alexander Robey, Robert Kirk, Xander Davies, Yarin Gal, Avi Schwarzschild, J. Zico Kolter

机构 * Carnegie Mellon University(卡内基梅隆大学) UK AI Security Institute(英国人工智能安全研究所) University of Oxford(牛津大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18792 2025-06-03 cs.HC cs.AI cs.CL cs.CY

REALM: A Dataset of Real-World LLM Use Cases

Jingwen Cheng, Kshitish Ghate, Wenyue Hua, William Yang Wang, Hong Shen, Fei Fang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California(加州大学)

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17358 2025-06-03 cs.CV cs.AI cs.LG

DIS-CO: Discovering Copyrighted Content in VLMs Training Data

André V. Duarte, Xuandong Zhao, Arlindo L. Oliveira, Lei Li

机构 * Carnegie Mellon University(卡内基梅隆大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11767 2025-06-03 cs.LG cs.CL

From Selection to Generation: A Survey of LLM-based Active Learning

Yu Xia, Subhojyoti Mukherjee, Zhouhang Xie, Junda Wu, Xintong Li, Ryan Aponte, Hanjia Lyu, Joe Barrow, Hongjie Chen, Franck Dernoncourt, Branislav Kveton, Tong Yu, Ruiyi Zhang, Jiuxiang Gu, Nesreen K. Ahmed, Yu Wang, Xiang Chen, Hanieh Deilamsalehy, Sungchul Kim, Zhengmian Hu, Yue Zhao, Nedim Lipka, Seunghyun Yoon, Ting-Hao Kenneth Huang, Zichao Wang, Puneet Mathur, Soumyabrata Pal, Koyel Mukherjee, Zhehao Zhang, Namyong Park, Thien Huu Nguyen, Jiebo Luo, Ryan A. Rossi, Julian McAuley

机构 * University of California San Diego(加州大学圣地亚哥分校) University of Wisconsin Madison(威斯康星大学麦迪逊分校) Carnegie Mellon University(卡内基梅隆大学) University of Rochester(罗切斯特大学) Adobe Research(Adobe研究) Dolby Labs(杜比实验室) Cisco AI Research(思科人工智能研究) University of Oregon(俄勒冈大学) University of Southern California(南加州大学) Pennsylvania State University(宾夕法尼亚州立大学) Dartmouth College(达特茅斯学院)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18367 2025-06-03 cs.CL

Towards Global AI Inclusivity: A Large-Scale Multilingual Terminology Dataset (GIST)

Jiarui Liu, Iman Ouzzani, Wenkai Li, Lechen Zhang, Tianyue Ou, Houda Bouamor, Zhijing Jin, Mona Diab

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Michigan(密歇根大学) University of Toronto(多伦多大学) Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) Vector Institute(向量研究所)

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05488 2025-06-03 cs.CV cs.LG eess.IV

Enhancing Sample Generation of Diffusion Models using Noise Level Correction

Abulikemu Abuduweili, Chenyang Yuan, Changliu Liu, Frank Permenter

机构 * Carnegie Mellon University(卡内基梅隆大学) Toyota Research Institute(丰田研究院)

Journal ref Transactions on Machine Learning Research, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18359 2025-06-03 cs.CL

Improving Model Factuality with Fine-grained Critique-based Evaluator

Yiqing Xie, Wenxuan Zhou, Pradyot Prakash, Di Jin, Yuning Mao, Quintin Fettes, Arya Talebzadeh, Sinong Wang, Han Fang, Carolyn Rose, Daniel Fried, Hejia Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta GenAI(Meta 生成式人工智能)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08711 2025-06-03 eess.AS cs.AI

Text-To-Speech Synthesis In The Wild

Jee-weon Jung, Wangyou Zhang, Soumi Maiti, Yihan Wu, Xin Wang, Ji-Hoon Kim, Yuta Matsunaga, Seyun Um, Jinchuan Tian, Hye-jin Shim, Nicholas Evans, Joon Son Chung, Shinnosuke Takamichi, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学) Meta Renmin University of China(中国人民大学) National Institute of Informatics(日本国立信息机构) Korea Advanced Institute of Science and Technology(韩国科学技术院) University of Tokyo(东京大学) Yonsei University(yonsei大学) EURECOM Keio University(庆应大学)

Comments 5 pages, Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00338 2025-06-03 cs.CL cs.SD eess.AS

OWSM v4: Improving Open Whisper-Style Speech Models via Data Scaling and Cleaning

Yifan Peng, Shakeel Muhammad, Yui Sudo, William Chen, Jinchuan Tian, Chyi-Jiunn Lin, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) Honda Research Institute(本田研究机构)

Comments Accepted at INTERSPEECH 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00242 2025-06-03 cs.AI cs.CL

Whispers of Many Shores: Cultural Alignment through Collaborative Cultural Expertise

Shuai Feng, Wei-Chuang Chan, Srishti Chouhan, Junior Francisco Garcia Ayala, Srujananjali Medicherla, Kyle Clark, Mingwei Shi

机构 * Arizona State University(亚利桑那州立大学) National Taiwan University(台湾国立大学) Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学) Indian Institute of Technology Hyderabad(印度海得拉巴理工学院) Minitab(Minitab公司) Trinity College Dublin(都柏林圣三一学院)

Comments 14 main pages;8 page appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22499 2025-06-03 cs.CL

Anticipating Future with Large Language Model for Simultaneous Machine Translation

Siqi Ouyang, Oleksii Hrinchuk, Zhehuai Chen, Vitaly Lavrukhin, Jagadeesh Balam, Lei Li, Boris Ginsburg

机构 * Carnegie Mellon University(卡内基梅隆大学) NVIDIA(英伟达)

Comments NAACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05613 2025-06-03 cs.CL

Stereotype or Personalization? User Identity Biases Chatbot Recommendations

Anjali Kantharuban, Jeremiah Milbauer, Maarten Sap, Emma Strubell, Graham Neubig

机构 * Carnegie Mellon University(卡内基梅隆大学)

详情

展开后加载摘要…

URL PDF HTML 收藏