arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Intel(英特尔)

2026-06-09 至 2026-06-09 共收录 2
2606.08446 2026-06-09 cs.LG cs.AI 新提交

Sparrow: Sparse Rollout for Stable and Efficient Long-context RL of Large Language Models

Sparrow: 用于大语言模型稳定高效长上下文强化学习的稀疏 rollout

Yang Zhou, Ranajoy Sadhukhan, Zhaofeng Sun, Zhuoming Chen, Souvik Kundu, Saket Dingliwal, Sai Muralidhar Jayanthi, Aram Galstyan, Haizhong Zheng, Beidi Chen

机构 * Carnegie Mellon University(卡内基梅隆大学) Cornell University(康奈尔大学) Intel(英特尔) Amazon AGI(亚马逊AGI)

AI总结 针对RLVR中长上下文rollout计算昂贵的问题,提出Sparrow方法,通过动态稀疏度调度保持token级策略失配的下尾统计量稳定,在Qwen3系列模型上实现2.0-2.4倍加速,并推广到更大模型和编程领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19330 2026-06-09 cs.LG 版本更新

CTS-Bench: Benchmarking Graph Coarsening Trade-offs for GNNs in Clock Tree Synthesis

CTS-Bench: 面向时钟树综合中GNN的图粗化权衡基准测试

Barsat Khadka, Kawsher Roxy, Md Rubel Ahmed

机构 * The University of Southern Mississippi(密苏里州南方大学) Intel Corporation(英特尔公司) Louisiana Tech University(路易斯安那理工大学)

AI总结 提出CTS-Bench基准套件,系统评估图粗化对GNN在时钟树综合中预测精度与计算效率的权衡,发现粗化虽降低内存和加速训练,但会移除关键结构信息导致零样本评估下R²为负。

Comments Accepted to ML Bench'26 ASPLOS

详情

展开后加载摘要…

URL PDF HTML 收藏