arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-05-04 至 2026-05-04 共收录 5
2601.21214 2026-05-04 cs.CL cs.LG

Scaling Reasoning Hop Exposes Weaknesses: Demystifying and Improving Hop Generalization in Large Language Models

推理步扩展揭示弱点:解密和改进大语言模型中的推理泛化

Zhaoyi Li, Jiatong Li, Gangwei Jiang, Linqi Song, Defu Lian, Ying Wei

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Zhejiang University(浙江大学) City University of Hong Kong, Shenzhen Research Institute(香港城市大学深圳研究院)

AI总结 本文通过多领域任务研究发现,推理错误集中在少数关键错误类型的位置,而非均匀分布。提出在推理过程中动态识别并禁用错误处理头,从而提升推理步泛化能力。

Comments 52 pages, accepted by ICLR 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00702 2026-05-04 cs.CL

Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory

学习如何和记忆什么:受认知启发的两阶段优化用于进化记忆

Derong Xu, Shuochen Liu, Pengfei Luo, Pengyue Jia, Yingyi Zhang, Yi Wen, Yimin Deng, Wenlin Zhang, Enhong Chen, Xiangyu Zhao, Tong Xu

机构 * University of Science and Technology of China & State Key Laboratory of Cognitive Intelligence(中国科学技术大学 & 认知智能国家重点实验室) City University of Hong Kong(香港城市大学) Dalian University of Technology(大连理工大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出MemCoE框架,通过两阶段优化学习记忆组织方式和更新内容,提升长期个性化记忆的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00500 2026-05-04 cs.LG

Scaling Federated Linear Contextual Bandits via Sketching

通过降维实现联邦线性上下文老虎机的扩展

Hantao Yang, Hong Xie, Xutong Liu, Defu Lian

机构 * University of Science and Technology of China(中国科学技术大学) University of Washington Tacoma(华盛顿大学塔可姆分校)

AI总结 本文提出FSCLB算法,通过SVD和双降维策略降低联邦线性上下文老虎机的计算和通信开销,理论分析证明其在降维后仍能保持最优 regret 绑定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00342 2026-05-04 cs.CL

Making Every Verified Token Count: Adaptive Verification for MoE Speculative Decoding

让每个验证的标记都值得:MoE推测解码的自适应验证

Lehan Pan, Ziyang Tao, Ruoyu Pang, Xiao Wang, Jianjun Zhao, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Tianyijiaotong Technology Ltd.(天翼教育科技有限公司)

AI总结 本文提出EVICT方法,通过截断草案树和保留成本有效的前缀,提升MoE推测解码效率,实验表明其在速度和减少专家激活方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26848 2026-05-04 cs.RO

STARRY: Spatial-Temporal Action-Centric World Modeling for Robotic Manipulation

STARRY:面向机器人操作的时空动作中心世界建模

Yuxuan Tian, Yurun Jin, Bin Yu, Yukun Shi, Hao Wu, Chi Harold Liu, Kai Chen, Cong Huang

机构 * Beijing Institute of Technology(北京理工大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学) East China Normal University(华东师范大学) DeepCybo

AI总结 STARRY通过统一扩散过程联合去噪未来时空潜在表示和动作,提升机器人操作中时空协调的精度与成功率。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏