arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Carnegie Mellon University(卡内基梅隆大学)

2026-02-27 至 2026-02-27 共收录 7
2602.23206 2026-02-27 cs.RO

Grasp, Slide, Roll: Comparative Analysis of Contact Modes for Tactile-Based Shape Reconstruction

抓取、滑动、滚动:基于触觉的形状重建接触模式比较分析

Chung Hee Kim, Shivani Kamtikar, Tye Brady, Taskin Padir, Joshua Migdal

机构 * Amazon Fulfillment Technologies & Robotics(亚马逊履行技术与机器人) Robotics Institute at Carnegie Mellon University(卡内基梅隆大学机器人研究所) Siebel School of Computing and Data Science, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院)

AI总结 本文提出基于触觉的形状重建方法,通过比较抓取、滑动和滚动三种接触模式,提升触觉数据采集效率,实现更快速准确的物体形状重建。

Comments 8 pages, 11 figures, Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22938 2026-02-27 cs.CV cs.AI cs.LG

pMoE: Prompting Diverse Experts Together Wins More in Visual Adaptation

pMoE:协同提示不同专家以赢得更多视觉适应

Shentong Mo, Xufang Luo, Dongsheng Li

机构 * Carnegie Mellon University(卡内基梅隆大学) Microsoft Research(微软研究院)

AI总结 pMoE通过整合多个领域专家的知识,提升视觉适应任务的性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22523 2026-02-27 cs.AI cs.CL q-bio.NC

Cognitive Models and AI Algorithms Provide Templates for Designing Language Agents

认知模型和AI算法为设计语言代理提供模板

Ryan Liu, Dilip Arumugam, Cedegao E. Zhang, Sean Escola, Xaq Pitkow, Thomas L. Griffiths

机构 * Department of Computer Science, Princeton University(普林斯顿大学计算机科学系) Department of Brain and Cognitive Sciences, Massachusetts Institute of Technology(麻省理工学院脑科学与认知科学系) Zuckerman Mind Brain Behavior Institute(祖克曼心智大脑行为研究所) Department of Psychiatry, Columbia University(哥伦比亚大学精神医学系) Neuroscience Institute(神经科学研究所) Department of Machine Learning, Carnegie Mellon University(卡内基梅隆大学机器学习系) Department of Psychology, Princeton University(普林斯顿大学心理学系)

AI总结 本文提出利用认知模型和AI算法设计语言代理的模板,旨在开发更有效且可解释的语言代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22426 2026-02-27 cs.CV cs.LG

SimpleOCR: Rendering Visualized Questions to Teach MLLMs to Read

SimpleOCR: 将可视化问题呈现以教导大语言模型阅读

Yibo Peng, Peng Xia, Ding Zhong, Kaide Zeng, Siwei Han, Yiyang Zhou, Jiaqi Liu, Ruiyi Zhang, Huaxiu Yao

机构 * UNC-Chapel Hill(北卡罗来纳大学教堂山分校) Carnegie Mellon University(卡内基梅隆大学) University of Michigan(密歇根大学) Adobe Research(Adobe研究)

AI总结 SimpleOCR通过强制模型视觉参与,解决多模态大语言模型在图像中阅读文本的性能问题,提升模型的视觉文本提取能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25369 2026-02-27 cs.CL cs.AI cs.LG

Generative Value Conflicts Reveal LLM Priorities

生成价值冲突揭示大语言模型优先级

Andy Liu, Kshitish Ghate, Mona Diab, Daniel Fried, Atoosa Kasirzadeh, Max Kleiman-Weiner

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Washington(华盛顿大学)

AI总结 生成价值冲突揭示大语言模型优先级,通过ConflictScope评估模型在价值冲突中的优先级,发现模型在开放式设置中更支持个人价值,系统提示能提高对齐效果14%。

Comments Accepted to ICLR 2026 (the 14th International Conference on Learning Representations)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19680 2026-02-27 cs.HC cs.AI

PolicyPad: Collaborative Prototyping of LLM Policies

PolicyPad: LLM策略协同原型设计

K. J. Kevin Feng, Tzu-Sheng Kuo, Quan Ze Chen, Inyoung Cheong, Kenneth Holstein, Amy X. Zhang

机构 * University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学) Princeton University(普林斯顿大学)

AI总结 PolicyPad通过结合用户体验原型设计方法,为LLM策略协作设计提供交互式支持,提升政策制定的协作效率与反馈质量。

Comments CHI 2026 paper. Supplementary materials: https://docs.google.com/document/d/1jBmKXusoWmCHfwpmNhSTJtbwZ5fwVWLNppKeqqd_-pY/edit?usp=sharing

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17937 2026-02-27 cs.SD cs.AI cs.CL eess.AS

Bob's Confetti: Phonetic Memorization Attacks in Music and Video Generation

Bob的彩纸:音乐和视频生成中的语音记忆攻击

Jaechul Roh, Zachary Novack, Yuefeng Peng, Niloofar Mireshghallah, Taylor Berg-Kirkpatrick, Amir Houmansadr

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of California San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学)

AI总结 研究揭示了生成音乐和视频AI系统中语音记忆攻击的漏洞,通过同音替代词绕过版权过滤,展示语音结构对跨模态检索的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏