arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, San Diego(加州大学圣迭戈分校)

2026-05-14 至 2026-05-14 共收录 9
2605.13399 2026-05-14 cs.LG cs.IT math.IT

The Diffusion Encoder

扩散编码器

Akhil Premkumar, Sarah Lucioni

机构 * Department of Physics(物理系) University of California San Diego(加州大学圣地亚哥分校) Independent Researcher(独立研究者)

AI总结 本文提出一种新型编码器,利用扩散模型的表达能力,通过交替训练方案解决解码器与编码器之间的同步问题,保持了标准扩散模型的简单高效训练目标。

Comments 22 pages + references, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20239 2026-05-14 cs.RO

TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance

TouchGuide: 通过触觉引导在推理时操控视觉-触觉策略

Zhemeng Zhang, Jiahua Ma, Xincheng Yang, Xin Wen, Yuzhi Zhang, Boyan Li, Yiran Qin, Jin Liu, Can Zhao, Li Kang, Haoqin Hong, Zhenfei Yin, Philip Torr, Hao Su, Ruimao Zhang, Daolin Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Xense Robotics(Xense机器人公司) Sun Yat-sen University(中山大学) Oxford(牛津大学) Shanghai AI Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) UCSD(加州大学圣地亚哥分校)

AI总结 本文提出TouchGuide,一种新的跨策略视觉-触觉融合方法,通过触觉引导在推理时优化预训练的视觉-触觉策略,提升机器人精细接触操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13044 2026-05-14 cs.CR cs.AI

No Attack Required: Semantic Fuzzing for Specification Violations in Agent Skills

无需攻击:用于代理技能规范违规的语义模糊测试

Ying Li, Hongbo Wen, Yanju Chen, Hanzhi Liu, Yuan Tian, Yu Feng

机构 * University of California, San Diego(加州大学圣迭戈分校)

AI总结 本文提出Sefz框架,通过语义模糊测试发现代理技能中的规范违规问题,揭示了安全规则漏洞对用户信任的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12995 2026-05-14 cs.LG

F-GRPO: Factorized Group-Relative Policy Optimization for Unified Candidate Generation and Ranking

F-GRPO:基于统一候选生成与排序的因子化组相对策略优化

Rohan Surana, Gagan Mundada, Junda Wu, Xintong Li, Yizhu Jiao, Bowen Jin, Sizhe Zhou, Tong Yu, Ritwik Sinha, Jiawei Han, Jingbo Shang, Julian McAuley

机构 * UC San Diego(南加州大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Adobe Research(Adobe研究院)

AI总结 本文提出F-GRPO,通过因子化组相对策略优化统一完成候选生成与排序,解决传统方法中因反馈滞后导致的优化不稳定问题,提升推荐系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12857 2026-05-14 cs.MA cs.AI cs.AR cs.LG

ChipMATE: Multi-Agent Training via Reinforcement Learning for Enhanced RTL Generation

ChipMATE: 通过强化学习进行多智能体训练以提升RTL生成

Zhongkai Yu, Yichen Lin, Chenyang Zhou, Yuwei Zhang, Kun Zhou, Junxia Cui, Haotian Ye, Zhengding Hu, Zaifeng Pan, Ruiyi Wang, Yujie Zhao, Hejia Zhang, Jingbo Shang, Jishen Zhao, Yufei Ding

机构 * UCSD(加州大学圣迭戈分校) Columbia University(哥伦比亚大学)

AI总结 ChipMATE是首个自训练多智能体RTL生成框架,通过相互验证的智能体和混合数据生成框架提升生成质量,实现75.0%和80.1%的VerilogEval V2通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12741 2026-05-14 cs.LG

Learning with Rare Success but Rich Feedback via Reflection-Enhanced Self-Distillation

通过反思增强的自我蒸馏实现稀有成功但丰富的反馈学习

Yuwei Zhang, Sha Li, Changlong Yu, Qin Lu, Shuowei Jin, Chengyu Dong, Haoran Liu, Ilgee Hong, Xintong Li, Zhenyu Shi, Bing Yin, Jingbo Shang

机构 * UC San Diego(UC圣地亚哥大学) Amazon(亚马逊) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本文提出反思增强的自我蒸馏框架,通过将失败反馈转化为主动监督信号,提升在稀有成功场景下的持续学习能力,实验表明其在多个连续学习任务中优于传统方法。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12733 2026-05-14 cs.LG cs.AI stat.ML

From Generalist to Specialist Representation

从通用到专业表征

Yujia Zheng, Fan Feng, Yuke Li, Shaoan Xie, Kevin Murphy, Kun Zhang

机构 * CMU(卡内基梅隆大学) UIUC(伊利诺伊大学香槟分校) UCSD(加州大学圣地亚哥分校) MBZUAI(穆斯林人工智能研究所) UMD(马里兰大学) UBC(不列颠哥伦比亚大学)

AI总结 研究在非参数设置下如何通过非监督方式识别时间步间任务结构,并利用稀疏正则化分离任务相关潜在表征,为从通用到专业模型的理论保障提供新思路。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09423 2026-05-14 cs.AI

SimWorld Studio: Automatic Environment Generation with Evolving Coding Agent for Embodied Agent Learning

SimWorld Studio:基于进化编码代理的自动环境生成用于具身学习

Haoqiang Kang, Xiaokang Ye, Yuhan Liu, Siddhant Hitesh Mantri, Lingjun Mao, James Fleming, Drishti Regmi, Lianhui Qin

机构 * UC San Diego(加州大学圣迭戈分校) New York University(纽约大学)

AI总结 本文提出SimWorld Studio平台,通过进化编码代理生成动态3D环境,提升具身学习性能。环境生成与学习相互促进,使代理在未见基准上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04152 2026-05-14 cs.CL cs.CY cs.HC

SocialLM: Social Signal Processing of Patient-Provider Communication using LLMs and Contextual Aggregation

SocialLM:利用LLMs和上下文聚合进行患者-提供者沟通的社会信号处理

Manas Satish Bedmutha, Feng Chen, Andrea Hartzler, Trevor Cohen, Nadir Weibel

机构 * University of Washington(华盛顿大学) UC San Diego(圣地亚哥大学)

AI总结 本文探讨了LLMs在无需微调的情况下能否有效跟踪临床转录中的20种社会行为,并通过群体一致性模式提升检测准确性与稳定性。

Comments To be presented at CHIL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏