arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-08-12 至 2026-08-12 共收录 6
2607.21106 2026-08-12 cs.AI 版本更新

AttriMem: Attribution-Guided Process Feedback for Agent Memory Construction

AttriMem:用于智能体记忆学习的归因引导过程反馈

Qinfeng Li, Yuntai Bao, Xinyan Yu, Hongze Chen, Yanming Liu, Huifeng Zhu, Yier Jin, Jintao Chen, Wenqi Zhang, Xuhong Zhang

机构 * Zhejiang University(浙江大学)

AI总结 研究针对LLM智能体有效构建记忆难的问题,提出AttriMem框架,通过用token级对最终答案贡献的局部奖励增强全局结果奖励,以学习记忆构建策略,实验表明该框架性能优于多种基线,具有泛化性且稳定了RL优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14498 2026-08-12 physics.chem-ph cs.AI 版本更新

A Fixed-Point Neural Operator for Size- and Functional-Transferable Hamiltonian Prediction

用于尺寸和功能可迁移哈密顿量预测的定点神经算子

Yunhong Lou, Xihang Yue, Xinran Wei, Tianqi Deng, Linchao Zhu

机构 * Zhejiang University(浙江大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)

AI总结 提出HamEvo神经算子,将自洽场迭代的收敛哈密顿量作为不动点学习,结合密度矩阵监督,在分子性质预测中达到化学精度,并实现尺寸迁移和加速。

Comments 30 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19748 2026-08-12 cs.AI cs.MA 版本更新

Memory-Augmented Reinforcement Learning Agent for CAD Generation

具有记忆增强的强化学习代理的CAD生成

Yin Xiaolong, Liu Yu, Shen Jiahang, Lu Xingyu, Ni Jingzhe, Fan Fengxiao, Sang Fan

机构 * Zhejiang University(浙江大学)

AI总结 本文提出了一种记忆增强的强化学习框架,用于生成CAD模型,通过引入强化学习进行检索和策略优化,有效避免了检索陷阱,提高了复杂CAD模型生成的成功率和几何一致性。

Comments We are withdrawing this manuscript because we have identified issues in the current analysis that require substantial revision. Until these issues are resolved, we do not consider the present version suitable for citation

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15497 2026-08-12 cs.CV cs.GR 版本更新

AnyAct: Towards Human Reenactment of Character Motion From Video

AnyAct: 向视频中非人类角色动作的重新演绎迈进

Liuhan Chen, Lei Zhong, Jiawei Wang, Qing Shuai, Li Yuan, Leidong Fan, Qing Li, Kanglin Liu

机构 * Peking University(北京大学) Nankai University(南开大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Pengcheng Laboratory(鹏城实验室)

AI总结 本文研究如何从单目视频中直接推导出人类动作的初始重新演绎,其目标是将非人类角色的动作重新诠释为可编辑的人类表演,以供后续动画创作使用。核心方法是利用稀疏局部关节运动线索在结构差异大的情况下保持本质动态,提出AnyAct模型以实现基于可转移稀疏局部2D关节运动的条件人类运动生成。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01687 2026-08-12 cs.AI 版本更新

CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification

CoEvoSkills: 通过共进化验证实现自进化代理技能

Hanrong Zhang, Shicheng Fan, Henry Peng Zou, Yankai Chen, Zhenting Wang, Jiayu Zhou, Chengze Li, Wei-Chieh Huang, Yifei Yao, Kening Zheng, Xue, Liu, Xiaoxiao Li, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) MBZUAI(穆罕默德·本·扎耶德人工智能大学) McGill University(麦吉尔大学) Columbia University(哥伦比亚大学) Zhejiang University(浙江大学) University of British Columbia(不列颠哥伦比亚大学)

AI总结 本文提出CoEvoSkills框架,使代理能自主生成复杂技能包,通过共进化验证提供反馈,实现在SkillsBench上最高通过率和强泛化能力。

Comments COLM accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00818 2026-08-12 stat.ML cs.LG 版本更新

Generalized Linear Markov Decision Process

广义线性马尔可夫决策过程

Sinian Zhang, Kaicheng Zhang, Ziping Xu, Zongqi Xia, Jue Hou, Tianxi Cai, Doudou Zhou

机构 * Division of Biostatistics and Health Data Science, University of Minnesota, USA(明尼苏达大学生物统计与健康数据科学系) School of Mathematical Sciences, Zhejiang University, China(浙江大学数学科学学院) Department of Statistics, Harvard University, USA(哈佛大学统计系) Department of Biostatistics, Harvard T.H. Chan School of Public Health, USA(哈佛T.H. Chan公共卫生学院生物统计学系) Department of Statistics and Data Science, National University of Singapore, Singapore(新加坡国立大学统计与数据科学系)

AI总结 针对离线强化学习在纵向研究中面临的奖励与转移观测问题,提出GRASP-MDP框架,通过奖励-转移分离的贝尔曼分解,利用仅转移观测提升估计性能,在模拟和真实电子健康数据中验证了有效性。

Comments 111 pages

详情

展开后加载摘要…

URL PDF HTML 收藏