arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

2026-06-18 至 2026-06-18 共收录 7
2606.18531 2026-06-18 stat.ML cs.LG 新提交

When Does Trajectory-Level Supervision Permit Efficient Offline Reinforcement Learning?

轨迹级监督何时允许高效的离线强化学习?

Xuanfei Ren, Tengyang Xie

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 本文研究离线强化学习中仅使用轨迹级结果(如累积回报或偏好)进行策略优化的统计理论,提出OPAC算法并证明其样本复杂度,同时揭示在非线性聚合目标下存在的统计障碍。

Comments 69 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18520 2026-06-18 stat.ML cs.CG cs.CL cs.DS cs.IR cs.LG 新提交

Compact Geometric Representations of Hierarchies

层次结构的紧凑几何表示

Prashant Gokhale, Piotr Indyk, Yuhao Liu, Sandeep Silwal, Tony Chang Wang, Haike Xu

机构 * UW-Madison(威斯康星大学麦迪逊分校) MIT(麻省理工学院)

AI总结 研究如何用低维几何嵌入表示有向无环图中的祖先-后代关系,提出基于树宽等结构参数的维度上界和下界,并在真实数据集上验证了紧凑性。

Comments Published at the 39th Annual Conference on Learning Theory (COLT) 2026. 22 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18702 2026-06-18 cs.CV 新提交

UniTemp: Unlocking Video Generation in Any Temporal Order via Bidirectional Distillation

UniTemp: 通过双向蒸馏实现任意时间顺序的视频生成

Lin Zhang, Sicheng Mo, Zefan Cai, Jinhong Lin, Zihao Lin, Jiuxiang Gu, Krishna Kumar Singh, Yuheng Li, Yin Li

机构 * University of Wisconsin Madison(威斯康星大学麦迪逊分校) Adobe Research(Adobe 研究院) University of California Los Angeles(加利福尼亚大学洛杉矶分校) University of California Davis(加利福尼亚大学戴维斯分校)

AI总结 提出UniTemp框架,通过双向蒸馏训练单个自回归模型,支持任意时间方向(前向、后向、中间插值)的视频生成,解决因果3D VAE在后向生成中的不连续性,提升可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18466 2026-06-18 cs.CL 新提交

Montreal Forced Aligner and the state of speech-to-text alignment in 2026

Montreal Forced Aligner 与 2026 年语音到文本对齐的现状

Michael McAuliffe, Kaylynn Gunter, Michael Wagner, Morgan Sonderegger

机构 * University of Wisconsin--Madison(威斯康星大学麦迪逊分校) McGill University(麦吉尔大学) Centre for Brain, Language, and Music(大脑、语言与音乐中心) University of Oregon(俄勒冈大学)

AI总结 本文介绍 MFA 3.0 自 1.0 版本以来的发展,并在英语、日语和韩语上评估其性能,在四个基准数据集上达到平均边界误差低于 15 ms 的最优或接近最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02370 2026-06-18 cs.CV

Uncertainty-Aware Image Classification In Biomedical Imaging Using Spectral-normalized Neural Gaussian Processes

利用谱归一化神经高斯过程进行生物医学影像中的不确定性感知图像分类

Uma Meleti, Jeffrey J. Nirschl

机构 * Department of Pathology(病理学部) Lab Medicine, University of Wisconsin-Madison(实验室医学,威斯康星大学麦迪逊分校)

AI总结 本文提出SNGP模型,通过谱归一化和高斯过程层改进单模型不确定性估计与异常检测,在三个生物医学分类任务中表现优异。

Comments Published at the IEEE International Symposium on Biomedical Imaging (ISBI) 2026

Journal ref Proc. 2026 IEEE 23rd International Symposium on Biomedical Imaging (ISBI),London, United Kingdom, Apr. 8-11, 2026, pp. [1-4], 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06367 2026-06-18 cs.CR cs.AI cs.LG 版本更新

WebSP-Eval: Evaluating Web Agents on Website Security and Privacy Tasks

WebSP-Eval:在网站安全与隐私任务上评估网络代理

Guruprasad Viswanathan Ramesh, Asmit Nayak, Basieem Siddique, Kassem Fawaz

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 提出WebSP-Eval框架,通过200个任务实例和自动化评估器,测试多模态大模型在网站安全与隐私任务上的表现,发现状态UI元素(如开关)导致超过45%的任务失败。

Comments Accepted at PETS 2026. Project Page: https://wiscprivacy.com/webspeval/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21954 2026-06-18 cs.CV cs.AI 版本更新

Revisiting Active Speaker Detection: An In-the-Wild Benchmark for Generalization and Robustness

重新审视主动说话人检测:面向泛化性和鲁棒性的野外基准

Le Thien Phuc Nguyen, Zhuoran Yu, Khoa Quang Nhat Cao, Yuwei Guo, Tu Ho Manh Pham, Tuan Tai Nguyen, Toan Ngo Duc Vo, Lucas Poon, Tuan Khai Nguyen, Soochahn Lee, Yong Jae Lee

机构 * University of Wisconsin - Madison(威斯康星大学麦迪逊分校) Oregon State University(俄勒冈州立大学) University of Sydney(悉尼大学) Kookmin University(韩国成均馆大学)

AI总结 提出UniTalk数据集,涵盖多语言、嘈杂背景和拥挤场景等挑战性真实条件,评估显示现有模型在野外环境下性能不足,而UniTalk训练模型泛化性更好,为主动说话人检测建立新基准。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏