arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

共收录 1835
2607.06565 2026-07-08 cs.CV cs.AI cs.LG 新提交

ELSA3D: Elastic Semantic Anchoring for Unified 3D Understanding and Generation

ELSA3D:用于统一3D理解与生成的弹性语义锚定

Tianjiao Yu, Xinzhuo Li, Yifan Shen, Onkar Susladkar, Yuanzhe Liu, Xiaona Zhou, Ismini Lourentzou

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究统一3D基础模型文本-3D交互隐式问题,提出ELSA3D模型,通过弹性语义锚定联合构建语言和几何推理,用尺度感知八叉树令牌化器和锚定令牌表示几何,轻量级路由器使计算和推理弹性化,性能领先且减少计算量和延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06196 2026-07-08 cs.CL cs.CY 新提交

Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability

Pluralis v0.1:迈向用于人工智能风险与可靠性的多元文化、多模态、多语言基准测试

Alicia Parrish, Rajat Shinde, Sanket Badhe, Xinyi Bai, Sree Bhargavi Balija, Hua-Rong Chu, Emilio Ferrara, Armstrong Foundjem, Rajat Ghosh, Aakash Gupta, Xuanli He, Ong Chen Hui, Minji Jung, Madhangi Karimanal, Faiza Khan Khattak, Boryoung Kim, Eugenia Kim, Liliya Lavitas, Seok Min Lim, Victor Lu, Jim Moirangthem, Dhivya Nagasubramanian, Deepak Pandita, Sita Rajagopal, Geetha Raju, Evgeniia Razumovskaia, Aravind Reddy, Federico Ricciuti, Nobin Sarwar, Sungpil Shin, Sunayana Sitaram, Snehal Thorat, Tharindu Cyril Weerasooriya, Jasmijn Bastings, Joachim Baumann, Kongtao Chen, Murali Emani, Mariya Hendriksen, Jiho Jin, Jun Seong Kim, Younghoon Ko, Alicja Kwasniewska, Minjae Lee, Tom Wei-cyuan Lin Kashyap Ramanandula Manjusha, Junho Myung, Junyeong Park, Roma Patel, Shyam Ratan, Sudarsun Santhiappan, Priyanka Suresh, Tuesday, Ksheeraj Sai Vepuri Laura Amortegui-Ordonez, Claire Dennis, Minsuk Kahng, Chris Knotz, Alice Oh, Balaraman Ravindran, Soojung Ryu William Bartholomew, Hiwot Tesfaye, Lora Aroyo

机构 * Google DeepMind(谷歌DeepMind) University of Alabama in Huntsville(阿拉巴马大学亨茨维尔分校) Google(谷歌) University of Missouri Columbia(密苏里大学哥伦比亚分校) Chunghwa Telecom Laboratories(春木电信实验室) University of Southern California(南加州大学) Polytechnique Montreal(蒙特利尔理工学院) Nutanix ThinkEvolve Labs(ThinkEvolve实验室) UCL(伦敦大学学院) Infocomm Media Development Authority(信息通信媒体发展局) Monark Health(Monark健康) Seoul National University(首尔国立大学) Microsoft(微软) Centre for Responsible AI (CeRAI), Wadhwani School of Data Science and AI (WSAI), Indian Institute of Technology Madras(负责任人工智能中心(CeRAI)、瓦达威人工智能学校(WSAI)、印度理工学院马德拉斯分校) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校) Microsoft Research India(微软印度研究院) Stanford University(斯坦福大学) Argonne National Laboratory(阿贡国家实验室) University of Oxford(牛津大学) KAIST(韩国科学技术院) Yonsei University(延世大学) Amazon(亚马逊) UIUC(伊利诺伊大学香槟分校) Rochester Institute of Technology(罗切斯特理工学院) Xenoscube Inc.(Xenoscube公司) Korea AI Safety Institute (K-AISI)(韩国人工智能安全研究所(K-AISI)) MLCommons CommonGround Artifex Labs(Artifex实验室)

AI总结 研究针对现有AI安全评估框架忽视文化差异问题,构建多语言多模态数据集Pluralis v0.1,从文化优先视角引入新评估范式,提出Judge - Pluralis集成,揭示特定地区失败模式,为多语言多元文化评估提供基础和创新起点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05910 2026-07-08 cs.CV cs.AI cs.CL 新提交

PolicyShiftGuard: Benchmarking and Improving Policy-Adaptive Image Guardrails

PolicyShiftGuard:基准测试与改进策略自适应图像护栏

Mingyang Song, Luxin Xu, Haoyu Sun, Minzhou Pan, Yu Cheng, Bo Li

机构 * Fudan University(复旦大学) Tongji University(同济大学) Virtue AI(美德人工智能公司) The Chinese University of Hong Kong(香港中文大学) University of Chicago(芝加哥大学) University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究策略自适应图像护栏问题,提出PolicyShiftGuard方法,结合随机策略SFT和边界对策略适应进行两阶段训练,在PolicyShiftBench基准测试中显著提升性能,消融实验验证关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05613 2026-07-08 cs.LG 新提交

SafeImpute: Reliable Clinical Data Imputation via Conformal Selection

SafeImpute:通过共形选择实现可靠的临床数据插补

Xinrui He, Mengting Ai, Junting Wang, Curtiss B. Cook, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Mayo Clinic(梅奥诊所)

AI总结 研究临床数据插补问题,提出SafeImpute框架,通过构建事件图、利用双关系GNN和自适应融合学习插补,并结合共形选择控制不可接受误差,实验证明该方法在插补准确性和可靠误差控制上优于基线。

Comments Accepted at KDD 2026. Author accepted manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05571 2026-07-08 cs.AI cs.HC 新提交

CSTutorBench: Benchmarking Small Language Models as Tutors for Block-Based Programming

CSTutorBench:将小型语言模型作为基于块的编程导师进行基准测试

H. Chad Lane, Bryson Kageler

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究针对K-12环境中部署语言模型的问题,引入CSTutorBench基准评估VEX VR中语言模型作导师的表现。通过对11个模型测试发现其在深层教学行为有困难,模型家族和指令调整方法对辅导质量预测性更好,特定提示修订可提分,凸显此类基准的价值。

Journal ref SLM4ED'26: The 1st Workshop of Small Language Models for Education (SLM4ED). AIED 2026. Seoul, Republic of Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23826 2026-07-08 cs.CV cs.CL 版本更新

Decomposing Queries into Tool Calls for Long-Video Keyframe Retrieval

将查询分解为工具调用以进行长视频关键帧检索

Michal Shlapentokh-Rothman, Prachi Garg, Yu-Xiong Wang, Derek Hoiem

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出ToolMerge方法,通过LLM规划器将查询分解为工具调用并使用布尔运算符合并排名,实现长视频关键帧检索,在字幕检索任务上优于其他方法5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19216 2026-07-08 cs.CV cs.AI cs.LG 版本更新

DreamPartGen: Semantically Grounded Part-Level 3D Generation via Collaborative Latent Denoising

DreamPartGen: 通过协作潜在去噪实现语义引导的部件级3D生成

Tianjiao Yu, Xinzhuo Li, Muntasir Wahed, Jerry Xiong, Yifan Shen, Ying Shen, Ismini Lourentzou

机构 * University of Illinois Urbana - Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 DreamPartGen通过协作潜在去噪实现语义引导的部件级3D生成,引入双部件潜在和关系语义潜在,提升几何和语义一致性,实现高质量文本对齐的3D合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02929 2026-07-07 q-bio.NC cs.AI cs.CV cs.HC 新提交

Modeling the Impact of Visual Brand Language on Attention, Object Recognition, and Memory Retrieval

视觉品牌语言对注意力、物体识别与记忆提取的影响建模

Rachel F. Heaton, John E. Hummel

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本研究探究视觉品牌语言对物体功能身份识别的影响,基于JIM物体识别模型与LISA类比推理模型构建框架开展仿真,发现品牌信息会捕获注意力、拖慢物体功能类别识别,品牌强度越高效应越强。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05120 2026-07-07 cs.CR cs.AI 新提交

Agent Data Injection Attacks are Realistic Threats to AI Agents

智能体数据注入攻击对人工智能智能体构成现实威胁

Woohyuk Choi, Juhee Kim, Taehyun Kang, Jihyeon Jeong, Luyi Xing, Byoungyoung Lee

机构 * Seoul National University(首尔国立大学) Largosoft University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 介绍智能体数据注入攻击(ADI)这一新型间接提示注入,其伪装可信数据注入恶意数据使智能体执行意外操作,研究发现现实智能体漏洞及ADI在多种模型和智能体设置中有效,揭示智能体安全关键差距。

Comments 19 pages, 19 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04367 2026-07-07 cs.RO 新提交

A Perception-Manipulation Robotics System for Food Cutting

一种用于食品切割的感知-操作机器人系统

Xinyuan Luo, Wenzhen Yuan

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究烹饪机器人切割任务,核心方法是用初步固定试验切割的力数据选刀,再用强化学习自适应切割,贡献是选刀模块成功率达100%,性能与人类相当。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02807 2026-07-07 cs.AI 新提交

SwarmResearch: Orchestrating Coding Agents for Open-Ended Discovery

群体研究:编排编码智能体以进行开放式发现

Yuvraj Virk, Zack Edds, Chunqiu Steven Xia, Lingming Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究长期运行的编码智能体存在的问题,假设两个设计选择导致该问题,介绍SwarmResearch,一种编排器-子智能体架构,在开放式优化任务中表现良好,其编排器引导扩展能发现更好方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02593 2026-07-07 cs.CV cs.CL 新提交

Token-level Response-visual Attention Guidance for Multimodal LLMs Knowledge Distillation

多模态大语言模型知识蒸馏的令牌级响应视觉注意力引导

Jaehyun Jang, Eunseop Yoon, Hee Suk Yoon, SooHwan Eom, Mark A. Hasegawa-Johnson, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究多模态大语言模型知识蒸馏,挑战传统依赖,发现下游性能与响应视觉注意力相似度强相关。提出令牌级响应视觉注意力引导方法,通过自适应加权散度,有效引导学生模型,实验证明其性能优于基线。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01012 2026-07-07 cs.LG 新提交

Generative Model Proposal based Particle Filtering for Data Assimilation

基于生成模型提议的数据同化粒子滤波

Chandni Nagda, Mayank Shrivastava, Gudrun Thorkelsdottir, Gan Zhang, Morteza Mardani, Arindam Banerjee

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) NVIDIA(英伟达)

AI总结 提出流提议粒子滤波(FPPF),通过学习条件生成模型作为提议分布,逼近方差最小化最优提议,结合贝叶斯更新和局部化策略,在非线性、非高斯和高维系统中优于统计基线和生成方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00597 2026-07-07 cs.CL cs.IR 新提交

Multi-Turn Agentic Scientific Literature Search via Workflow Induction

通过工作流归纳实现多轮智能科学文献搜索

Jisen Li, Bingxuan Li, Nanyi Jiang, Xuying Ning, Xiyao Wang, Yifan Shen, Heng Wang, Yuqing Jian, Xiaoxia Wu, Ben Athiwaratkun, Pan Lu, Jiaxuan You, Bingxin Zhao

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Together AI University of Pennsylvania(宾夕法尼亚大学) Stanford University(斯坦福大学)

AI总结 提出PaperPilot,通过构建可执行DAG工作流进行多轮文献搜索,利用用户反馈优化查询和工作流,显著提升搜索性能并消除执行错误。

Comments 17 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18218 2026-07-07 math.PR cs.LG cs.SY eess.SY math.OC stat.ML 新提交

Finite-Time Queue Peak Laws in Stochastic Networks: Logarithmic Scaling After Geometric Thresholds

随机网络中的有限时间队列峰值律:几何阈值后的对数缩放

Hao Liang, Cheng Tang, Yunzong Xu

机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究广义交换机中有限时间队列峰值,证明在均匀内部松弛条件下,漂移最小化调度策略的峰值包络从平方根律转变为对数律,并给出匹配下界和几何阈值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16926 2026-07-07 cs.LG cs.AI eess.SP 版本更新

Test-Time Adaptation for EEG Foundation Models: A Systematic Study under Real-World Distribution Shifts

EEG基础模型的测试时间适应:在现实世界分布偏移下的系统研究

Gabriel Jason Lee, Jathurshan Pradeepkumar, Jimeng Sun

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文系统研究了EEG基础模型在现实分布偏移下的测试时间适应方法,发现标准方法效果不稳定且易退化,而无优化方法更稳定可靠。

Comments Accepted to MLHC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10062 2026-07-07 cs.LG 版本更新

When Can You Poison Rewards? A Tight Characterization of Reward Poisoning in Linear MDPs

在什么情况下可以污染奖励?线性MDP中奖励污染攻击的紧致刻画

Jose Efraim Aguilar Escamilla, Haoyang Hong, Jiawei Li, Haoyu Zhao, Xuezhou Zhang, Sanghyun Hong, Huazheng Wang

机构 * School of Electrical Engineering and Computer Science, Oregon State University, Corvallis, Oregon, USA(电子工程与计算机科学学院,俄勒冈州立大学,俄勒冈州科瓦利斯) Department of Electrical and Computer Engineering, University of Illinois Urbana-Champaign, Urbana, Illinois, USA(电气与计算机工程系,伊利诺伊大学厄巴纳-香槟分校,伊利诺伊州厄巴纳) Princeton University, Princeton, New Jersey, USA(普林斯顿大学,新泽西州普林斯顿) Faculty of Computing and Data Sciences, Boston University, Boston, Massachusetts, USA(计算与数据科学学院,波士顿大学,马萨诸塞州波士顿)

AI总结 本文研究了强化学习中奖励污染攻击,通过约束预算操控奖励迫使目标智能体采用符合攻击者目标的策略。研究首次给出了线性MDP中攻击可行性的精确必要和充分条件,区分了易受攻击和固有鲁棒的RL实例。理论框架扩展至深度RL环境,证明其在理论和实践上的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07376 2026-07-07 cs.AI cs.DC 版本更新

OpenTinker: Separating Concerns in Agentic Reinforcement Learning

OpenTinker:在智能体强化学习中分离关注点

Siqi Zhu, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 介绍OpenTinker,一种用于训练大型语言模型智能体的开放基础设施。通过共享执行资源和多LoRA策略,围绕策略生命周期运行,支持SFT和RL,实现多用户等共享基础模型并隔离更新等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04805 2026-07-07 cs.LG cs.AI 版本更新

PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference

PuzzleMoE:通过稀疏专家合并和位打包推理对大型专家混合模型进行高效压缩

Yushu Zhao, Zheng Wang, Minjia Zhang

机构 * Tsinghua University(清华大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究针对专家混合模型内存开销大难题,提出PuzzleMoE方法。通过识别权重冗余与专业化进行稀疏专家合并,用双掩码捕获参数,引入位打包编码避免存储开销,实现高效推理,大幅压缩模型且保持精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20666 2026-07-07 cs.HC cs.CL 版本更新

TAMA: A Human-AI Collaborative Thematic Analysis Framework Using Multi-Agent LLMs for Clinical Interviews

TAMA:一种使用多智能体大语言模型进行临床访谈的人机协作主题分析框架

Huimin Xu, Seungjun Yi, Terence Lim, Jiawei Xu, Andrew Well, Carlos Mery, Aidong Zhang, Yuji Zhang, Heng Ji, Keshav Pingali, Yan Leng, Ying Ding

机构 * School of Information, University of Texas at Austin(信息学院,德克萨斯大学奥斯汀分校) Department of Biomedical Engineering, University of Texas at Austin(生物医学工程系,德克萨斯大学奥斯汀分校) College of Natural Sciences, University of Texas at Austin(自然科学院,德克萨斯大学奥斯汀分校) Graphen, Inc.(Graphen公司) Department of Cardiac Surgery, Division of Pediatric Cardiac Surgery, Vanderbilt University School of Medicine(心脏外科系,范德比尔特大学医学中心) Pediatric Heart Institute, Monroe Carell Jr. Children’s Hospital at Vanderbilt(儿童心脏研究所,范德比尔特儿童医院) Department of Computer Science, University of Virginia(计算机科学系,弗吉尼亚大学) Department of Computer Science, University of Illinois at Urbana-Champaign(计算机科学系,伊利诺伊大学厄巴纳-香槟分校) Department of Computer Science, University of Texas at Austin(计算机科学系,德克萨斯大学奥斯汀分校) McCombs School of Business, University of Texas at Austin(麦克阿瑟商学院,德克萨斯大学奥斯汀分校) Dell Medical School, University of Texas at Austin(德克萨斯大学奥斯汀分校德莱尔医学院)

AI总结 提出人机协作主题分析框架TAMA,利用多智能体系统结构化对话及心脏专家专业知识,用于临床访谈分析,在罕见病访谈转录本分析中性能优于单智能体方法。

Comments Manuscript accepted to ACM Transactions on Computing for Healthcare

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02509 2026-07-03 cs.AI 新提交

ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning

ReContext: 递归证据重放作为大语言模型的长上下文推理工具

Yanjun Zhao, Ruizhong Qiu, Tianxin Wei, Yuanchen Bei, Zhining Liu, Lingjie Chen, Ismini Lourentzou, Hanghang Tong, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出一种免训练推理方法ReContext,通过模型内部相关性信号构建查询条件证据池并在最终生成前重放,以提升长上下文推理中的证据利用,无需外部记忆或上下文剪枝。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02461 2026-07-03 cs.CV cs.AI cs.LG 新提交

OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers

OrbitQuant: 图像和视频扩散Transformer的数据无关量化

Donghyun Lee, Jitesh Chavan, Duy Nguyen, Sam Huang, Liming Jiang, Priyadarshini Panda, Timo Mertens, Saurabh Shukla

机构 * Cantina Labs(Cantina实验室) University of Southern California(南加州大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出数据无关量化方法OrbitQuant,通过归一化旋转基和Lloyd-Max码本,无需校准数据即可对扩散Transformer的权重和激活进行低比特量化,在多个模型和模态上达到最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01383 2026-07-03 cs.CV 新提交

MIBE: Multi-subject Interaction Benchmark and Evaluator for Personalized Image Generation

MIBE:面向个性化图像生成的多主体交互基准与评估器

Zhihan Chen, Yuhuan Zhao, Yijie Zhu, Xinyu Yao, Mengcong Ren, Suwen Wang, Qiuyang Yin, Yuchen Sun, Qin Wang, Lu Xin

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of Southern California(南加州大学) DeerLab LLC(DeerLab有限责任公司) Carnegie Mellon University(卡内基梅隆大学) Clemson University(克莱姆森大学) Google(谷歌) San Jose State University(圣何塞州立大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出MIBE框架,包含多主体交互基准(MIB)和评估器(MIE),通过解耦数据体制和双头排序诊断目标,解决多主体个性化图像生成中主体遗漏、外观失配和交互错误问题,在黄金集上达到0.922成对准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01238 2026-07-03 cs.CL cs.AI cs.SD eess.AS 新提交

SPARCLE: SPeaker-aware Aligned Representations via Contrastive Language Embeddings

SPARCLE: 通过对比语言嵌入实现说话人感知的对齐表示

Priyam Mazumdar, Yurii Halychanskyi, Steven Guo, Mark Hasegawa-Johnson, Volodymyr Kindratenko

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) National Center for Supercomputing Applications(国家超级计算应用中心)

AI总结 提出SPARCLE模型,通过对比学习将字素与Wav2Vec2声学表示对齐并融入说话人身份,替代G2P系统,在低资源TTS中将词错误率降低一半。

Comments 5 Pages, 1 Figure, 2 Tables, Interspeech

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11357 2026-07-03 cs.DC cs.AI cs.AR cs.PF 新提交

TileFuse: A Fused Mixed-Precision Kernel Library for Efficient Quantized LLM Inference on AMD NPUs

TileFuse:用于AMD NPU上高效量化LLM推理的融合混合精度内核库

Wesley Pang, Gregory Hyegang Jun, Feiyang Liu, Deming Chen

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Department of Electrical and Computer Engineering(电气与计算机工程系)

AI总结 针对边缘NPU上量化LLM部署困难,提出TileFuse库,通过融合解包、反量化与GEMM/GEMV内核,并设计交错预分块布局与数据流,在XDNA2上实现AWQ格式原生支持,性能提升最高281%,能耗降低64.6%。

Comments 13 pages excluding reference, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03042 2026-07-03 cs.CV cs.AI 版本更新

PPTArena: A Benchmark for PowerPoint Editing

PPTArena: 一个用于PowerPoint编辑的基准测试

Michael Ofengenden, Yunze Man, Ziqi Pang, Liang-Yan Gui, Yu-Xiong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, Berkeley(加州大学伯克利分校)

AI总结 提出PPTArena基准,包含2125张幻灯片的1300+人工编辑任务,并设计PPTPilot智能体通过结构感知的规划-编辑-验证循环,在复合、布局敏感和跨幻灯片编辑上超越强基线10个百分点以上。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00641 2026-07-02 cs.CY cs.LG 新提交

What's a Credit Worth? A Market Framework for Attribution-Aware Compensation in Generative Music

信用值多少钱?生成音乐中归因感知补偿的市场框架

Luyang Zhang, Xirui Jiang, Junwei Deng, Beibei Li, Jiaqi W. Ma, Chris Donahue

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 针对生成式AI音乐训练中创作者补偿问题,提出基于数据归因评分的支付框架,考虑目录级归因和信噪比,分析福利最优合同形式,实验表明噪声归因降低福利。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00272 2026-07-02 cs.RO cs.AI cs.MA 新提交

ASPIRE: Agentic /Skills Discovery for Robotics

ASPIRE: 面向机器人的智能体技能发现

Runyu Lu, Yubo Wu, Ethan Kou, Letian Fu, Wenli Xiao, Ajay Mandlekar, Yinzhen Xu, Guanya Shi, Ken Goldberg, Ang Chen, Mosharaf Chowdhury, Yuke Zhu, Linxi "Jim" Fan, Guanzhi Wang

机构 * NVIDIA(英伟达) UMich(密歇根大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学)

AI总结 提出ASPIRE系统,通过闭环执行、技能库积累和进化搜索,自主编写和优化机器人控制程序,在扰动、多机器人协作和长时域任务上显著超越现有方法,并实现零样本泛化与仿真到现实的技能迁移。

Comments 43 pages, 12 figures, 9 tables. Project page: https://research.nvidia.com/labs/gear/aspire/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00152 2026-07-02 cs.LG cs.AI cs.CL stat.ML 新提交

GRPO, Dr. GRPO, and DAPO Are Three Operations on One Number: The Group-Standard-Deviation Identity

GRPO, Dr. GRPO 和 DAPO 是对同一个数的三种操作:组标准差恒等式

Yong Yi Bay, Kathleen A. Yearick

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文证明三种流行的语言模型推理训练方法(GRPO、Dr. GRPO、DAPO)本质上是对组标准差的不同操作,并揭示了标准差在训练更新中的核心作用。

Comments 18 pages, 10 figures, 4 tables. Code and data: https://github.com/bay-yearick-lab/grpo-standard-deviation-identity

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29686 2026-07-02 cs.CV 版本更新

PoseShield: Neural Collision Fields for Human Self-Collision Resolution

PoseShield: 用于人体自碰撞解析的神经碰撞场

Zhengyuan Li, Zeyun Deng, Yifan Shen, Liangyan Gui, Miaolan Xie, Joseph Campbell, Xifeng Gao, Kui Wu, Zherong Pan, Aniket Bera

机构 * Purdue University(普渡大学) LightSpeed Studios(LightSpeed工作室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 针对SMPL人体姿态估计中的自碰撞问题,提出在姿态空间直接定义神经碰撞约束,通过Eikonal正则化优化求解,实现95.8%的碰撞修复成功率。

Comments ECCV 2026. Code: https://github.com/lzhyu/PoseShield

详情

展开后加载摘要…

URL PDF HTML 收藏