arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Michigan(密歇根大学安娜堡分校)

2026-07-21 至 2026-07-21 共收录 8
2607.18114 2026-07-21 cs.CL cs.AI cs.LG 新提交

How Does Alignment Tuning Shape Representations of Sycophancy and Related Cue-Induced Biases in LLMs?

对齐调整如何塑造大语言模型中谄媚及相关线索诱导偏差的表征?

Prakhar Gupta, Terry Jingchen Zhang, Florent Draye, Bernhard Schölkopf, Zhijing Jin

机构 * University of Michigan(密歇根大学) Jinesis Lab, University of Toronto & Vector Institute(多伦多大学Jinesis实验室和向量研究所) Max-Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所)

AI总结 研究大语言模型中谄媚及相关线索诱导偏差的位置,通过从隐藏状态提取偏差方向并经探测等三种方法三角测量,发现易感性由对齐调整而非预训练导致,还能适度去偏,偏差是对齐调整安装的不同因果活性方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17454 2026-07-21 cs.RO 新提交

Test-Time Scaling for World Action Models via Zero-Shot Geometric Evaluation

通过零样本几何评估实现世界行动模型的测试时缩放

Zesen Zhao, Minkyoung Cho, Hui shen, Boyuan Zheng, Kunxiao Gao, Yulong Cao, Z. Morley Mao

机构 * University of Michigan(密歇根大学) NVIDIA(英伟达)

AI总结 研究针对世界行动模型,提出无需训练的选择性测试时缩放框架\methodgated,基于预测未来的跨视图深度重投影一致性排序,经实验验证该方法能提高任务成功率,同时减少额外采样决策点,还识别出相关失败模式。

Comments Extened version of CVPR 2026 EAI workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16288 2026-07-21 cs.CV 新提交

A Synthetic 3D Gear Dataset for Manufacturing Quality Inspection (MFGNet-Gear)

用于制造质量检测的合成3D齿轮数据集(MFGNet-Gear)

Ruo-Syuan Mei, Chenhui Shao

机构 * University of Michigan(密歇根大学)

AI总结 研究针对智能制造中基于深度学习的零件质量检测数据难题,提出构建MFGNet-Gear合成3D数据集,通过参数化生成齿轮几何形状与缺陷,涵盖多种设计和质量等级,提供标注数据,助力相关检测、学习及基准测试,推动3D计量学发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08015 2026-07-21 cs.RO 版本更新

Q-VGM: Q-Value-Gradient Matching for Off-Policy Reinforcement Learning of Flow-Matching VLA

Q-VGM: 基于Q引导的值梯度匹配的流匹配VLA策略

Ziqian Wang, Yitian Liu, Xingjian Mao, Minqian Wang, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校) University of Electronic Science and Technology of China(电子科技大学)

AI总结 提出Q-VGM离线强化学习方法,通过将值梯度转化为去噪时间上的值梯度场,避免反向传播去噪链,高效微调流匹配VLA策略,在LIBERO等任务上显著提升成功率。

Comments 13 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21600 2026-07-21 cs.CR cs.LG

Robust Spectral Watermark for Synthetic Tabular Data

稳健的频域水印用于合成表格数据

Yizhou Zhao, Xiang Li, Peter Song, Qi Long, Weijie Su

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Michigan(密歇根大学)

AI总结 本文提出TAB-DRW水印方案,通过频域嵌入和秩基伪随机生成提升合成表格数据的鲁棒性和效率,实验显示其在抗后处理攻击和保持数据保真度方面表现优异。

Comments Accepted to Statistical Learning and Data Science

Journal ref Statistical Learning and Data Science (2026), Article 100001

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17068 2026-07-21 cs.CV cs.RO 版本更新

TrackDeform3D: Markerless and Autonomous 3D Keypoint Tracking and Dataset Collection for Deformable Objects

TrackDeform3D: 无标记和自主的3D关键点跟踪及变形物体数据集采集

Yeheng Zong, Yizhou Chen, Alexander Bowler, Chia-Tung Yang, Ram Vasudevan

机构 * Department of Robotics at the University of Michigan(密歇根大学机器人系)

AI总结 本文提出了一种低成本自主框架,利用RGB-D相机采集变形物体的3D数据集,通过3D关键点跟踪和运动一致性约束提升几何和跟踪精度,构建了包含6种变形物体的高质量大规模数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04384 2026-07-21 cs.RO cs.SY eess.SY 版本更新

Rapid and Safe Trajectory Planning over Diverse Scenes through Diffusion Composition

通过扩散合成在多样场景中进行快速且安全的轨迹规划

Wule Mao, Zhouheng Li, Yunhao Luo, Fangguo Zhao, Lei Xie

机构 * College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) University of Michigan(密歇根大学) MIT(麻省理工学院)

AI总结 针对动态环境规划难题,提出能量参数化扩散规划框架,结合轻量级安全过滤器和场景无关的数据生成管道,实现多样场景下快速安全规划,仿真与真实实验验证了其有效性、鲁棒性和适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03066 2026-07-21 cs.LG stat.ML 版本更新

Sign-SZPO: Provable Preference-based Reinforcement Learning with an Unknown Link Function

Sign-SZPO:具有未知链接函数的基于可证明偏好的强化学习

Qining Zhang, Lei Ying

机构 * University of Michigan(密歇根大学)

AI总结 研究具有未知链接函数的基于偏好的强化学习问题,提出Sign-SZPO零阶策略优化算法,该算法仅估计价值函数差的符号来构建更新方向,可证明收敛到平稳策略,实证显示其在链接函数错误指定下具有鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏