arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-07-28 至 2026-07-28 共收录 6
2607.24720 2026-07-28 cs.CL cs.AI cs.LG 新提交

The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation

多轮长期规划的物理学:通过单教师和多教师策略蒸馏从预训练到训练后

Tianyi Men, Zhuoran Jin, Kang Liu, Jun Zhao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 研究多轮长期规划问题,通过引入统一可控环境,利用预训练、GRPO、OPD及MOPD等方法,研究规划能力在不同阶段的获取、塑造与整合,展示了多教师策略蒸馏对跨环境能力整合的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24280 2026-07-28 cs.AI 新提交

From Proprietary to Open-Source: Bridging the Distribution Gap via Multi-Agent Protocol Distillation in Agentic Search

从专有模型到开源模型:通过智能体搜索中的多智能体协议蒸馏弥合分布差距

Junlin Liu, Jiangwang Chen, Zixin Song, Shuaiyu Zhou, Chunji Lv, Hank Wu, Kailin Jiang, Jinyang Wu, Bohan Yu, Chenxi Zhou

机构 * Beijing Institute of Technology(北京理工大学) East China Normal University(华东师范大学) University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 研究旨在弥合专有与开源模型分布差距,提出多智能体协议蒸馏(MAPD)框架,利用结构化协议作中间表示,结合蒸馏与强化学习,在问答基准测试中表现出色,有效减轻学生策略问题,优于其他竞争方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24097 2026-07-28 cs.AI 新提交

MemChain: Learning Interpretable Memory Traces for Memory-Augmented LLM Agents

MemChain:为内存增强型大语言模型智能体学习可解释的内存痕迹

Yiwen Ma, Songjun Tu, Qichao Zhang, Dong Li, Linjing Li, Dongbin Zhao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学交叉科学学院) Memorax AI(Memorax人工智能公司) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 研究针对内存增强型大语言模型智能体检索内存回答查询存在的问题,提出MemChain可训练检索后内存策略,经两阶段学习框架训练,能生成有效证据上下文,实验证明其在多种模型上性能领先且减少内存上下文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23835 2026-07-28 cs.CV 新提交

Consistent Evidence, Robust Recognition: Faithful Attribution Regularization under Geometric Transformations

一致证据,稳健识别:几何变换下的忠实归因正则化

Xianghao Jiao, Ruoyu Chen, Wei Wang, Jiazi Hu, Jiawei Liang, Shangquan Sun, Shiming Liu, Qunli Zhang, Xiaochun Cao

机构 * School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区网络科学与技术学院) University of Chinese Academy of Sciences(中国科学院大学) School of Automation, Nanjing University of Information Science and Technology(南京信息工程大学自动化学院) Department of Mechanical Engineering, Imperial College London(伦敦帝国理工学院机械工程系) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 研究针对归因方法在几何变换下的不足,提出基于图像区域子模搜索的无注释归因正则化框架,通过子模排序损失正则化归因及证据选择过程,实验表明该方法能提升归因稳定性且性能损失小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23524 2026-07-28 cs.AI 新提交

Delegation Intelligence in Deep Search: A Controllable Framework for Disentangled Capability Diagnosis

深度搜索中的委托智能:一种用于解缠能力诊断的可控框架

Xinhao Yao, Yuanzhuo Liu, Changhao Wang, Yunfei Yu, Haoran Tan, Yuyao Zhang, Ruifeng Ren, Minlong Peng, Yong Liu

机构 * UCAS(中国科学院大学) Renmin University of China(中国人民大学)

AI总结 研究深度搜索中委托智能,将其分解为搜索决策和信息合成与验证维度。通过开发可控合成管道构建DelegSearchBench及评估协议,实验证明仅用最终答案准确性不能充分表征深度搜索能力。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23235 2026-07-28 cs.CV 新提交

A Reconstruction-Based Framework for Caption Evaluation Beyond Reference Captions

一种基于重构的、超越参考字幕的字幕评估框架

Zhijiang Tang, Jiaxin Qi, Kaihua Tang, Yuhua Zheng, Jianqiang Huang

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) Tongji University(同济大学)

AI总结 研究不依赖参考字幕评估图像字幕对语义的忠实度问题,提出基于重构的评估原则,通过测试重构在下游视觉-语言任务中与原图匹配度得无参考字幕分数,还刻画局限性并引入CTTD替代方案。

Comments 22 pages. Code: https://github.com/ZhijiangTang/Caption-Turing-Test

详情

展开后加载摘要…

URL PDF HTML 收藏