Sparse-RL: Breaking the Memory Wall in LLM Reinforcement Learning via Stable Sparse Rollouts
稀疏强化学习:通过稳定稀疏回放突破大语言模型强化学习的内存瓶颈
Sijia Luo, Xiaokang Zhang, Yuxuan Hu, Bohan Zhang, Ke Wang, Jinbo Su, Mengshu Sun, Lei Liang, Jing Zhang
机构
*
School of Information, Renmin University of China(中国人民大学信息学院)
;
Key Laboratory of Data Engineering and Knowledge Engineering(数据工程与知识工程重点实验室)
;
Ant Group(蚂蚁集团)
Codebase-Memory: Tree-Sitter-Based Knowledge Graphs for LLM Code Exploration via MCP
基于MCP的代码库记忆:通过Tree-Sitter构建的知识图谱用于LLM代码探索
Martin Vogel, Falk Meyer-Eschenbach, Severin Kohler, Elias Grünewald, Felix Balzer
机构
*
Independent Researcher, Berlin, Germany(独立研究者,柏林,德国)
;
Institute of Medical Informatics, Charité – Universitätsmedizin Berlin, Berlin, Germany(柏林夏里特医学院医学信息学研究所,柏林,德国)
;
Clinical Study Center, Berlin Institute of Health, Berlin, Germany(柏林健康研究所临床研究中心,柏林,德国)
;
Institute of Informatics, Humboldt University, Berlin, Germany(柏林洪堡大学信息学研究所,柏林,德国)
;
Institute of Informatics, Freie Universität Berlin, Berlin, Germany(柏林自由大学信息学研究所,柏林,德国)
;
Health Data Science Unit, University Hospital Heidelberg, Heidelberg, Germany(海德堡大学医院健康数据科学部,海德堡,德国)