arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

共收录 71
2603.16798 2026-07-15 cs.LG cs.DS math.ST stat.ML stat.TH 版本更新

High-Dimensional Gaussian Mean Estimation under Realizable Contamination

高维高斯均值估计在可实现污染下的研究

Ilias Diakonikolas, Daniel M. Kane, Thanasis Pittas

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of California, San Diego(加州大学圣迭戈分校)

AI总结 研究在可实现ε污染模型下高斯分布均值估计问题,提出信息-计算差距,显示算法需更多样本或指数时间,同时给出近似匹配下界的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01241 2026-07-15 cs.CY cs.AI 版本更新

First, do NOHARM: a medical safety benchmark and randomized study of physician and AI teaming on clinical consultations

首先,不伤害:迈向临床安全的大语言模型

David Wu, Fateme Nateghi Haredasht, Saloni Kumar Maharaj, Priyank Jain, Jessica Tran, Matthew Gwiazdon, Arjun Rustagi, Jenelle Jindal, Jacob M. Koshy, Vinay Kadiyala, Anup Agarwal, Bassman Tappuni, Brianna French, Sirus Jesudasen, Christopher V. Cosgriff, Rebanta Chakraborty, Jillian Caldwell, Susan Ziolkowski, David J. Iberri, Robert Diep, Rahul S. Dalal, Kira L. Newman, Kristin Galetta, J. Carl Pallais, Nancy Wei, Kathleen M. Buchheit, David I. Hong, Vartan Pahalyants, Ernest Y. Lee, Allen Shih, Tamara B. Kaplan, Vishnu Ravi, Sarita Khemani, Thomas A. Buckley, April S. Liang, Daniel Shirvani, Advait Patil, Nicholas Marshall, Kanav Chopra, Joel Koh, Adi Badhwar, Anastasia Perez, Austin J. Schoeffler, Mahbuba Tusty, Chase M. Walton, Liam G. McCoy, David J. H. Wu, Yingjie Weng, Sumant Ranji, Kevin Schulman, Nigam H. Shah, Jason Hom, Arnold Milstein, Arjun K. Manrai, Adam Rodman, Jonathan H. Chen, Ethan Goh

机构 * Harvard Combined Dermatology Program(哈佛联合皮肤科项目) Department of Dermatology, Mass General Brigham(麻省总医院皮肤科) Harvard Medical School(哈佛医学院) Stanford Center for Biomedical Informatics Research(斯坦福生物医学信息学研究中心) Stanford University(斯坦福大学) Division of Hospital Medicine, Department of Medicine, Stanford University School of Medicine(斯坦福大学医学院医院医学科) Department of Medicine, Cambridge Health Alliance(剑桥健康联盟医学科) Beth Israel Deaconess Hospital–Plymouth(贝塞斯达德acons医院-普利茅斯) Department of Medicine, University of California, San Francisco(加州大学旧金山分校医学科) Department of Neurology, Stanford University School of Medicine(斯坦福大学医学院神经科) Department of Medicine, Beth Israel Deaconess Medical Center(贝塞斯达德acons医学中心医学科) Division of Cardiology, Department of Medicine, Cambridge Health Alliance(剑桥健康联盟心脏病科) Department of Cardiovascular Medicine, Summa Health System(Summa健康系统心血管医学科) Division of Allergy, Pulmonary, and Critical Care Medicine, Department of Medicine, University of Wisconsin-Madison(威斯康星大学麦迪逊分校医学科过敏、呼吸科和危重医学科) Division of Pulmonary and Critical Care Medicine, Department of Medicine, Massachusetts General Hospital(麻省总医院呼吸科和危重医学科) Center for Immunology and Inflammatory Diseases, Department of Medicine, Massachusetts General Hospital(麻省总医院免疫和炎症疾病中心) Broad Institute of MIT and Harvard(MIT和哈佛Broad研究所) Division of Pulmonary, Critical Care, and Sleep Medicine, Cambridge Health Alliance(剑桥健康联盟呼吸科、危重医学科和睡眠医学科)

AI总结 提出NOHARM基准,包含1100个初级到专科咨询案例,评估28个LLM的医疗建议安全性,发现高达22.6%的案例存在严重危害风险,其中遗漏错误占80%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19242 2026-07-15 cs.DS cs.LG math.ST stat.ML stat.TH 版本更新

Linear Regression under Missing or Corrupted Coordinates

坐标缺失或损坏情况下的线性回归

Ilias Diakonikolas, Jelena Diakonikolas, Daniel M. Kane, Jasper C. H. Lee, Thanasis Pittas

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of California, San Diego(加州大学圣地亚哥分校) University of California, Davis(加州大学戴维斯分校)

AI总结 研究高斯协变量下多变量线性回归在数据可能被擦除或损坏时的情况,通过建立新信息论下界刻画误差,得出缺失数据与损坏数据设置中最优误差匹配,知道损坏位置无普遍优势的结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31779 2026-07-14 cs.LG cs.CL 版本更新

Bridging the Gap Between Latent and Explicit Reasoning with Looped Transformers

弥合潜在推理与显式推理之间的差距:循环Transformer

Ying Fan, Anej Svete, Kangwook Lee

机构 * UW-Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) ETH Zürich(苏黎世联邦理工学院) KRAFTON(魁匠团) Ludo Robotics

AI总结 提出LOTUS方法,利用循环Transformer在潜在空间进行多步推理,通过并行监督潜在块上的CoT令牌,首次在3B规模弥合与显式CoT的差距,并将推理延迟降低2.5-6.9倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15353 2026-07-14 stat.AP cs.LG stat.ML 版本更新

Reinforcement Learning in the Real World: A Survey of Statistical Challenges and Future Directions

现实世界中的强化学习:统计挑战与未来方向综述

Asim H. Gazi, Yongyi Guo, Daiqi Gao, Ziping Xu, Kelly W. Zhang, Susan A. Murphy

机构 * Department of Computer Science, Harvard University(哈佛大学计算机科学系) Department of Statistics, University of Wisconsin–Madison(威斯康星大学麦迪逊分校统计学系) Department of Statistics, Harvard University(哈佛大学统计学系) School of Data Science and Society, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校数据科学与社会学院) Department of Mathematics, Imperial College London(伦敦帝国理工学院数学系)

AI总结 本文综述现实世界强化学习应用,指出其研究与部署存在差距及两大挑战。将应用框架化为三部分过程,回顾应对统计挑战的进展,涵盖在线、离线方法及持续改进设计,还概述受应用启发的未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14817 2026-07-13 cs.CL cs.AI 版本更新

Evaluating Retrieval-Augmented Generation vs. Long-Context Input for Clinical Reasoning over EHRs

评估检索增强生成与长上下文输入用于电子健康记录临床推理的效果

Skatje Myers, Dmitriy Dligach, Timothy A. Miller, Samantha Barr, James Landefeld, Yanjun Gao, Matthew Churpek, Anoop Mayampurath, Majid Afshar

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Loyola University Chicago(芝加哥洛约拉大学) Boston Children’s Hospital Harvard Medical School(波士顿儿童医院哈佛医学院) University of Colorado-Anschutz(科罗拉多大学安舒茨分校)

AI总结 研究评估检索增强生成(RAG)用于电子健康记录临床推理的效果,定义三个基于EHR的任务,用真实住院临床记录评估三种大语言模型,发现RAG在成像程序和抗生素时间线任务中令牌效率高,诊断生成任务较具挑战性,RAG是临床任务的有效方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11936 2026-07-13 physics.flu-dyn cond-mat.mtrl-sci cs.LG 版本更新

Transformer-Based Inverse Microrheology for Experimental Mechanics at Ultra-High Strain Rates

基于Transformer的超高应变率下实验力学的逆微流变学

Lehu Bu, Zhaohan Yu, Danila Frolkin, Junyoung Kim, Qihang Shi, Jan N. Fuhg, Shaoting Lin, Jin Yang

机构 * Materials Science Graduate Program, Texas Materials Institute, The University of Texas at Austin(材料科学研究生项目,德克萨斯材料研究所,德克萨斯大学奥斯汀分校) Department of Mechanical Engineering, Michigan State University(机械工程系,密歇根州立大学) Department of Aerospace Engineering and Engineering Mechanics, The University of Texas at Austin(航空航天工程与工程力学系,德克萨斯大学奥斯汀分校) The Oden Institute of Computational Science and Engineering, University of Texas at Austin(奥登计算科学与工程研究所,德克萨斯大学奥斯汀分校) Department of Mechanical Engineering, University of Wisconsin-Madison(机械工程系,威斯康星大学麦迪逊分校)

AI总结 研究针对传统流变工具在超高应变率下表征软材料的局限,提出基于Transformer的气泡动力学框架BDT,集成物理模拟与神经网络,从气泡动力学快速逆表征软材料粘弹性,无需迭代优化,加速参数推断并能表征多种材料行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05894 2026-07-09 cs.CL 版本更新

EMBER: Efficient Memory via Budgeted Evidence Retention for Long-Horizon Agents

EMBER: 通过预算化证据保留实现高效记忆的长时程智能体

Yilong Li, Suman Banerjee, Tong Che

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) NVIDIA Research(NVIDIA研究)

AI总结 针对长时程智能体在固定预算下保留证据的问题,提出EMBER学习型保留策略,通过存储证据胶囊(含原文摘录、检索键和更新元数据)并利用查询后反馈训练,在LongMemEval-RR上显著提升F1、保留召回和读取召回。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27000 2026-07-09 cs.CL cs.AI 版本更新

Cast a Wider Net: Coordinated Pass@K Policy Optimization for Code Reasoning

撒更宽的网:面向代码推理的协调 Pass@K 策略优化

Yilong Li, Suman Banerjee, Tong Che

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) NVIDIA Research(英伟达研究)

AI总结 提出协调 Pass@K 策略优化 (CPPO),通过规划器生成多种策略并协调求解器尝试,以解决代码生成中重复采样导致冗余推理路径的问题,在多个基准上显著提升 pass@4。

Comments Code reasoning; pass@K optimization; coordinated planning; verifiable rewards; strategy diversity

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02915 2026-07-09 cs.CV 版本更新

GP-4DGS: Probabilistic 4D Gaussian Splatting from Monocular Video via Variational Gaussian Processes

GP-4DGS:通过变分高斯过程从单目视频中进行概率性4D高斯点溅射

Mijeong Kim, Jungtaek Kim, Bohyung Han

机构 * IPAI, Seoul National University(首尔大学IPAI) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

AI总结 本文提出GP-4DGS框架,结合高斯过程与4D高斯点溅射,实现动态场景的概率建模。通过引入不确定性量化、运动估计和时间外推,提升重建质量与预测可靠性。

Comments CVPR 2026, Page: https://cv.snu.ac.kr/research/GP4DGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06521 2026-07-08 cs.CV cs.CL 版本更新

BabyVision: Visual Reasoning Beyond Language

BabyVision:超越语言的视觉推理

Liang Chen, Weichu Xie, Yiyan Liang, Hongfeng He, Hans Zhao, Zhibo Yang, Zhiqi Huang, Haoning Wu, Haoyu Lu, Y. charles, Yiping Bao, Yuantao Fan, Guopeng Li, Haiyang Shen, Xuanzhong Chen, Wendong Xu, Shuzheng Si, Zefan Cai, Wenhao Chai, Ziqi Huang, Fangfu Liu, Tianyu Liu, Baobao Chang, Ming Wu, Xiaobo Hu, Kaiyuan Chen, Yixin Ren, Yang Liu, Yuan Gong, Kuan Li

机构 * UniPat AI xbench Alibaba Group(阿里巴巴集团) MoonShot AI StepFun Peking University(北京大学) Tsinghua University(清华大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Princeton University(普林斯顿大学) Nanyang Technological University(南洋理工大学) G Labs Equal Core Contributors(0G Labs 等核心贡献者)

AI总结 研究发现当代多模态语言模型依赖语言先验,在基本视觉任务上表现差。为此引入BabyVision基准评估其核心视觉能力,涵盖多任务。结果显示模型缺乏基本视觉原语,BabyVision的进展迈向人类水平视觉能力,还探索了用生成模型解决视觉推理的方法。

Comments 26 pages, Homepage at https://unipat.ai/blog/BabyVision

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04209 2026-07-07 cs.CR cs.AI cs.LG 版本更新

Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions

模型参数中的不可检测后门:在高维空间中隐藏稀疏秘密

Sarthak Choudhary, Atharv Singh Patlan, Nils Palumbo, Ashish Hooda, Kassem Fawaz, Somesh Jha

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Princeton University(普林斯顿大学)

AI总结 提出Sparse Backdoor供应链攻击,通过注入带高斯抖动的结构化稀疏扰动在预训练图像分类器中植入可证不可检测后门,其检测难度等价于Sparse PCA,可抵御白盒区分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21534 2026-07-07 cs.AI 版本更新

ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning

ARLArena:用于稳定智能体强化学习的统一框架

Xiaoxuan Wang, Han Zhang, Haixin Wang, Yidan Shi, Ruoyan Li, Kaiqiao Han, Chenyi Tong, Haoran Deng, Renliang Sun, Alexander Taylor, Yanqiao Zhu, Jason Cong, Yizhou Sun, Wei Wang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

AI总结 研究针对智能体强化学习不稳定问题,提出ARLArena框架。先构建测试平台,将策略梯度分解为四个维度分析,据此提出稳定的智能体策略优化方法SAMPO,实现稳定训练与良好性能。

Comments To appear at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18157 2026-07-07 cs.CV cs.LG 版本更新

Agentic Very Long Video Understanding

智能体超长视频理解

Aniket Rege, Arka Sadhu, Yuliang Li, Kejie Li, Ramya Korlakai Vinayak, Yuning Chai, Yong Jae Lee, Hyo Jin Kim

机构 * Reality Labs Research at Meta(Meta 实验室) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 针对智能眼镜等设备带来的长视频理解需求,以实体场景图为核心构建增强智能体框架EGAgent,实现结构化搜索、推理及跨模态能力,在相关数据集实验中取得较好表现。

Comments 29 pages, 8 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02932 2026-07-07 cs.LG 版本更新

PLoRA: Efficient Concurrent LoRA Training for Large Language Models

PLoRA:用于大语言模型的高效并发LoRA训练

Minghao Yan, Zhuang Wang, Zhen Jia, Shivaram Venkataraman, Yida Wang

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 研究发现当前LoRA训练范式不能有效利用硬件资源,提出PLoRA,在给定硬件和模型约束下自动编排并发LoRA微调作业并开发高性能内核,提升训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00296 2026-07-07 cs.LG cs.CR 版本更新

VLMGuard: Bootstrapping Malicious Prompt Detectors from Unlabeled Vision-Language Prompts in the Wild

VLMGuard:从野生未标记视觉语言提示中引导恶意提示检测器

Junlin Fang, Wenyu Chen, Reshmi Ghosh, Robert Sim, Ahmed Salem, Vitor R. Carvalho, Emily Lawton, Sharon Li, Jack W. Stokes, Sean Du

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学) School of Physical and Mathematical Sciences(物理与数学科学学院) Microsoft Corp.(微软公司) Department of Computer Sciences(计算机科学系) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 研究针对视觉语言模型易受恶意输入影响的问题,提出VLMGuard框架,利用野生未标记用户提示,通过自动恶意估计分数区分良性和恶意样本,训练二进制提示分类器,无需额外人工标注,效果优于现有方法。

Comments Accepted to Transactions on Machine Learning Research (07/2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03497 2026-07-03 cs.RO cs.AI cs.CV 版本更新

Sim2Real-AD: A Modular Sim-to-Real Framework for Deploying VLM-Guided Reinforcement Learning in Real-World Autonomous Driving

Sim2Real-AD:一种模块化的仿真到现实框架,用于在现实世界自动驾驶中部署基于VLM的强化学习

Zilin Huang, Zhengyang Wan, Zihao Sheng, Boyue Wang, Junwei You, Sikai Chen

机构 * Department of Civil and Environmental Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校土木与环境工程系) Google(谷歌)

AI总结 本文提出Sim2Real-AD框架,实现无需真实世界强化学习数据将CARLA训练的VLM引导强化学习策略零样本迁移到全尺寸车辆。框架包含几何观察桥、物理感知动作映射、两阶段渐进训练和实时部署流水线。

Comments 33 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18315 2026-07-03 cs.RO cs.AI cs.CV 版本更新

DriveVLM-RL: Neuroscience-Inspired Reinforcement Learning with Vision-Language Models for Safe and Deployable Autonomous Driving

DriveVLM-RL:受神经科学启发的强化学习与视觉语言模型用于安全可部署的自动驾驶

Zilin Huang, Zihao Sheng, Zhengyang Wan, Yansong Qu, Junwei You, Sicong Jiang, Sikai Chen

机构 * Department of Civil and Environmental Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校土木与环境工程系) Lyles School of Civil and Construction Engineering, Purdue University(普渡大学莱尔斯土木与建设工程学院) Department of Civil Engineering, McGill University(麦吉尔大学土木工程系)

AI总结 提出DriveVLM-RL框架,通过双通路架构将VLM集成到RL中,实现安全可部署的自动驾驶,在CARLA中显著优于基线。

Comments 33 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09951 2026-07-02 math.OC cs.LG stat.ML 版本更新

Towards Weaker Variance Assumptions for Stochastic Optimization

面向随机优化的更弱方差假设

Ahmet Alacaoglu, Yura Malitsky, Stephen J. Wright

机构 * University of British Columbia(不列颠哥伦比亚大学) University of Vienna(维也纳大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

AI总结 本文重新审视随机梯度算法分析中的经典方差假设,允许随机次梯度平方范数随优化变量平方范数增长,并建立与Halpern迭代的联系,为凸非光滑随机优化提供无界可行集下的最优性度量收敛率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17936 2026-07-01 cs.CR cs.CV 版本更新

Stealthy Multi-Task Adversarial Attacks

隐蔽的多任务对抗攻击

Jiacheng Guo, Tianyun Zhang, Lei Li, Haochen Yang, Hongkai Yu, Minghai Qin

机构 * Cleveland State University(克利夫兰州立大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Western Digital Research(西部数据研究院)

AI总结 提出SMTA²框架,通过约束多目标优化和自动损失权重调整,实现对多任务模型中特定任务的隐蔽攻击,同时保持非目标任务性能不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03704 2026-06-29 cs.CV 版本更新

QuantV2X: A Fully Quantized Multi-Agent System for Cooperative Perception

QuantV2X:一种用于协同感知的全量化多智能体系统

Seth Z. Zhao, Huizhi Zhang, Zhaowei Li, Juntong Peng, Anthony Chui, Zewei Zhou, Zonglin Meng, Hao Xiang, Zhiyu Huang, Fujia Wang, Ran Tian, Chenfeng Xu, Bolei Zhou, Jiaqi Ma

机构 * UCLA(加州大学洛杉矶分校) UW-Madison(威斯康星大学麦迪逊分校) NCSU(北卡罗来纳州立大学) Purdue University(普渡大学) UC Berkeley(加州大学伯克利分校) UT Austin(德克萨斯大学奥斯汀分校)

AI总结 提出首个全量化多智能体系统QuantV2X,通过端到端量化策略同时降低计算负载和传输带宽,在低比特约束下达到与全精度相当的精度,并显著降低延迟、提升mAP30。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11299 2026-06-29 stat.CO cs.CG cs.LG 版本更新

Efficient and Stable Multi-Dimensional Kolmogorov-Smirnov Distance

高效且稳定的多维Kolmogorov-Smirnov距离

Peter Matthew Jacobs, Foad Namjoo, Jeff M. Phillips

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of Utah(犹他大学)

AI总结 提出一种基于正交支配矩形区域的多维KS距离,证明其收敛性并给出误差界,在4维及以下可高效计算,并用于两样本假设检验。

Comments 25 pages, 7 figures, 1 table, 3 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13731 2026-06-25 cs.CV 版本更新

GeoRanker: Distance-Aware Ranking for Worldwide Image Geolocalization

GeoRanker:面向全球图像地理定位的距离感知排序

Pengyue Jia, Seongheon Park, Song Gao, Xiangyu Zhao, Sharon Li

机构 * Department of Data Science, City University of Hong Kong(城市大学数据科学系) Department of Computer Sciences, University of Wisconsin-Madison(威斯康星大学麦迪逊分校计算机科学系) Department of Geography, University of Wisconsin-Madison(威斯康星大学麦迪逊分校地理系)

AI总结 提出GeoRanker框架,利用大视觉语言模型联合编码查询-候选交互并预测地理邻近性,引入多阶距离损失以建模结构化空间关系,在IM2GPS3K和YFCC4K基准上达到最优。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04767 2026-06-24 cs.LG 版本更新

ParallelBench: Understanding the Trade-offs of Parallel Decoding in Diffusion LLMs

ParallelBench: 理解扩散大语言模型中并行解码的权衡

Wonjun Kang, Kevin Galim, Seunghyuk Oh, Minjae Lee, Yuchen Zeng, Shuibai Zhang, Coleman Hooper, Yuezhou Hu, Hyung Il Koo, Nam Ik Cho, Kangwook Lee

机构 * FuriosaAI UW-Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) UC Berkeley(加州大学伯克利分校) Seoul National University(首尔国立大学) KRAFTON Ludo Robotics Project(Ludo机器人项目)

AI总结 针对扩散LLM并行解码导致生成质量下降的问题,通过信息论分析和合成实验揭示其根本限制,并提出首个专门基准ParallelBench,系统评估发现并行解码在现实任务中质量损失严重,且现有策略无法根据任务难度调整并行度。

Comments Accepted at ICLR 2026. Project Page: https://parallelbench.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02607 2026-06-23 stat.ML cs.DS cs.LG math.OC 版本更新

Combinatorial Sparse PCA Beyond the Spiked Identity Model

超越尖峰恒等模型的组合稀疏PCA

Syamantak Kumar, Purnamrita Sarkar, Kevin Tian, Peiyuan Zhang

机构 * UT Austin(德克萨斯大学奥斯汀分校) UW Madison(威斯康星大学麦迪逊分校)

AI总结 针对稀疏PCA问题,提出首个在一般协方差矩阵下可证明成功的组合方法,基于截断幂方法的变体,使用s^2·polylog(d)样本和d^2·poly(s,log(d))时间,并推广到稀疏主导特征空间恢复。

Comments 36 pages, 6 figures; accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09609 2026-06-19 cs.LG math.AG 版本更新

Minimal Filling Architectures of Polynomial Neural Networks: Counterexamples, Frontier Search, and Defects

多项式神经网络的最小填充架构:反例、前沿搜索与缺陷

Kevin Dao, Jose Israel Rodriguez

机构 * Department of Mathematics, University of Wisconsin-Madison, Wisconsin, USA(威斯康星大学麦迪逊分校数学系)

AI总结 本文通过前沿搜索和符号计算验证了多项式神经网络的最小单峰猜想反例,揭示了部分子架构存在较大缺陷,与以往小缺陷现象形成对比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01565 2026-06-19 cs.LG cs.DC 版本更新

TetriServe: Efficiently Serving Mixed DiT Workloads

TetriServe: 高效服务混合DiT工作负载

Runyu Lu, Shiqi He, Wenxuan Tan, Shenggui Li, Ruofan Wu, Jeff J. Ma, Ang Chen, Mosharaf Chowdhury

机构 * University of Michigan(密歇根大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Nanyang Technological University(南洋理工大学)

AI总结 针对混合分辨率与截止时间的异构DiT工作负载,提出基于步骤级序列并行的TetriServe系统,通过轮次调度与自适应并行度,在保证图像质量下将SLO达成率提升32%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06367 2026-06-18 cs.CR cs.AI cs.LG 版本更新

WebSP-Eval: Evaluating Web Agents on Website Security and Privacy Tasks

WebSP-Eval:在网站安全与隐私任务上评估网络代理

Guruprasad Viswanathan Ramesh, Asmit Nayak, Basieem Siddique, Kassem Fawaz

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 提出WebSP-Eval框架,通过200个任务实例和自动化评估器,测试多模态大模型在网站安全与隐私任务上的表现,发现状态UI元素(如开关)导致超过45%的任务失败。

Comments Accepted at PETS 2026. Project Page: https://wiscprivacy.com/webspeval/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21954 2026-06-18 cs.CV cs.AI 版本更新

Revisiting Active Speaker Detection: An In-the-Wild Benchmark for Generalization and Robustness

重新审视主动说话人检测:面向泛化性和鲁棒性的野外基准

Le Thien Phuc Nguyen, Zhuoran Yu, Khoa Quang Nhat Cao, Yuwei Guo, Tu Ho Manh Pham, Tuan Tai Nguyen, Toan Ngo Duc Vo, Lucas Poon, Tuan Khai Nguyen, Soochahn Lee, Yong Jae Lee

机构 * University of Wisconsin - Madison(威斯康星大学麦迪逊分校) Oregon State University(俄勒冈州立大学) University of Sydney(悉尼大学) Kookmin University(韩国成均馆大学)

AI总结 提出UniTalk数据集,涵盖多语言、嘈杂背景和拥挤场景等挑战性真实条件,评估显示现有模型在野外环境下性能不足,而UniTalk训练模型泛化性更好,为主动说话人检测建立新基准。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01904 2026-06-17 cs.CR cs.AI 版本更新

Combating Data Laundering in LLM Training

对抗LLM训练中的数据清洗

Muxing Li, Zesheng Ye, Sharon Li, Feng Liu

机构 * University of Melbourne(墨尔本大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 针对数据清洗(通过变换风格隐藏数据来源)导致传统检测失效的问题,提出基于辅助LLM推断变换目标并合成查询的SDR方法,显著增强数据滥用检测能力。

Comments 29 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏