arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Xi'an Jiaotong University(西安交通大学)

2026-04-08 至 2026-04-08 共收录 4
2604.06067 2026-04-08 cs.RO

HiPolicy: Hierarchical Multi-Frequency Action Chunking for Policy Learning

HiPolicy:分层多频动作分块用于策略学习

Jiyao Zhang, Zimu Han, Junhan Wang, Xionghao Wu, Shihong Lin, Jinzhou Li, Hongwei Fan, Ruihai Wu, Dongjiang Li, Hao Dong

机构 * CFCS, School of CS, PKU(北京大学计算机学院计算与金融研究中心) National Key Laboratory for Multimedia Information Processing, School of CS, PKU(北京大学计算机学院多媒体信息处理国家重点实验室) XJTU(西安交通大学) THU(清华大学) BUAA(北京航空航天大学) Jingdong Technology Information Technology Co., Ltd(京东科技信息技术有限公司)

AI总结 HiPolicy通过分层多频动作分块框架,联合预测不同频率的动作序列,以捕捉粗粒度高层次计划和精确的反应动作,提升策略学习的性能和执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05526 2026-04-08 cs.SD cs.AI

Controllable Singing Style Conversion with Boundary-Aware Information Bottleneck

可控的歌唱风格转换与边界感知信息瓶颈

Zhetao Hu, Yiquan Zhou, Wenyu Wang, Zhiyu Wu, Xin Gao, Jihua Zhu

机构 * School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) Fudan University(复旦大学) Division of Music and Audio Union Wheatland Culture and Media Ltd.(音乐与音频联合Wheatland文化传媒有限公司)

AI总结 本文提出了一种新颖的歌唱风格转换系统,通过边界感知信息瓶颈、帧级技术矩阵和高频带补全策略,解决风格泄漏、动态渲染和高保真生成问题,实现高质量的风格转换。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05397 2026-04-08 cs.CL

Confidence Should Be Calibrated More Than One Turn Deep

置信度应比单轮更深入地校准

Zhaohan Zhang, Chengzhengxu Li, Xiaoming Liu, Chao Shen, Ziquan Liu, Ioannis Patras

机构 * Queen Mary University of London(伦敦玛丽女王大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出多轮校准任务,解决多轮对话中置信度动态校准问题,通过MTCal和ConfChat提升模型在多轮交互中的事实性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05297 2026-04-08 cs.AI

Breakthrough the Suboptimal Stable Point in Value-Factorization-Based Multi-Agent Reinforcement Learning

突破基于价值因子化的多智能体强化学习中的次优稳定点

Lesong Tao, Yifei Wang, Haodong Jing, Jingwen Fu, Miao Kang, Shitao Chen, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi'an Jiaotong University(西安交通大学人工智能与机器人研究所,人机混合增强智能国家重点实验室) Zhongguancun Academy(中关村学院)

AI总结 本文提出多轮价值因子化框架MRVF,通过迭代过滤次优动作以实现全局最优,揭示了非最优稳定点对性能的影响,实验验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏