Holistic Data Scheduler for LLM Pre-training via Multi-Objective Reinforcement Learning
基于多目标强化学习的LLM预训练整体数据调度器
Chenhao Dang, Jing Ma, Mingjie Liao
机构
*
China Electronics Technology Group Corporation 15th Research Institute(中国电子科技集团公司第十五研究所)
;
Renmin University of China(中国人民大学)
;
Alibaba Group(阿里巴巴集团)
专题命中
预训练与数据
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Scalable Physics-Inspired Transformers for Spin Glasses
可扩展的物理启发式Transformer用于自旋玻璃
Lu Zhong, Wenli Duan, Jing Liu, Pan Zhang, Ying Tang
机构
*
Institute of Fundamental and Frontier Sciences, University of Electronic Science and Technology of China(基础与前沿科学研究院,电子科技大学)
;
School of Physical Science and Technology, Beijing University of Posts and Telecommunications(物理科学与技术学院,北京邮电大学)
;
Institute of Theoretical Physics, Chinese Academy of Sciences(理论物理研究所,中国科学院)
;
School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS(基础物理与数学科学学院,杭州先进研究院,UCAS)
;
School of Physics, University of Electronic Science and Technology of China(物理学院,电子科技大学)
;
Key Laboratory of Quantum Physics and Photonic Quantum Information, Ministry of Education, University of Electronic Science and Technology of China(量子物理与光量子信息重点实验室,教育部,电子科技大学)
;
Non-classical Information Science Basic Discipline Research Center of Sichuan Province, University of Electronic Science and Technology of China(四川省非经典信息科学基础学科研究中心,电子科技大学)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.LG
Breaking Shortcut Learning for Cross-Trial EEG-Guided Target Speech Extraction via Two-Stage Training
通过两阶段训练打破跨试验EEG引导目标语音提取中的捷径学习
Wonchul Shin, Inyong Choi, Kyogu Lee
机构
*
Department of Intelligence and Information(智能信息系)
;
Seoul National University(首尔国立大学)
;
Department of Communication Sciences and Disorders(沟通科学与障碍系)
;
University of Iowa(爱荷华大学)
;
Interdisciplinary Program in Artificial Intelligence(人工智能交叉学科项目)
;
Artificial Intelligence Institute(人工智能研究所)
OpenThoughts-Agent: Data Recipes for Agentic Models
OpenThoughts-Agent: 智能体模型的数据配方
Negin Raoof, Richard Zhuang, Marianna Nezhurina, Etash Guha, Atula Tejaswi, Ryan Marten, Charlie F. Ruan, Tyler Griggs, Alexander Glenn Shaw, Hritik Bansal, E. Kelly Buchanan, Artem Gazizov, Reinhard Heckel, Chinmay Hegde, Sankalp Jajee, Daanish Khazi, Emmanouil Koukoumidis, Xiangyi Li, Hange Liu, Shlok Natarajan, Harsh Raj, Nicholas Roberts, Ethan Shen, Nishad Singhi, Michael Siu, Ashima Suvarna, Hanwen Xing, Patrick Yubeaton, Robert Zhang, Leon Liangyu Chen, Xiaokun Chen, Steven Dillmann, Saadia Gabriel, Xunyi Jiang, Anurag Kashyap, Boxuan Li, Yein Park, Minh Pham, Sujay Sanghavi, Lin Shi, Ke Sun, Yixin Wang, Zhiwei Xu, Erica Zhang, Siyan Zhao, Wanjia Zhao, Jenia Jitsev, Alex Dimakis, Benjamin Feuer, Ludwig Schmidt
机构
*
UC Berkeley(加州大学伯克利分校)
;
Stanford University(斯坦福大学)
;
JSC(于利希超级计算中心)
;
LAION
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Bespoke Labs
;
Laude Institute
;
UCLA(加州大学洛杉矶分校)
;
Harvard University & Harvard Medical School(哈佛大学与哈佛医学院)
;
TU Munich & Munich Center for Machine Learning(慕尼黑工业大学与慕尼黑机器学习中心)
;
New York University(纽约大学)
;
Medical University of South Carolina(南卡罗来纳医科大学)
;
The LLM Data Company
;
BenchFlow
;
Independent Researcher(独立研究员)
;
Northeastern University(东北大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
University of Washington(华盛顿大学)
;
TU Darmstadt(达姆施塔特工业大学)
;
University of Southern California(南加州大学)
;
UC San Diego(加州大学圣地亚哥分校)
;
Amazon(亚马逊)
;
Microsoft(微软)
;
Korea University(高丽大学)
;
Cornell Tech(康奈尔科技)
;
University of Michigan(密歇根大学)
Revealing Training Data Exposure in Vision Language Large Models via Parameter Gradients
揭示视觉语言大模型中的训练数据暴露:基于参数梯度的方法
Zhihao Zhu, Hongyi Tang, Yi Yang, Ahmed Abbasi
机构
*
Department of Information Systems, Business Statistics and Operations Management (ISOM), Hong Kong University of Science and Technology, Hong Kong, China(信息系统、商业统计与运营管理系(ISOM),香港科技大学,香港,中国)
;
Department of IT, Analytics, and Operations, University of Notre Dame, Notre Dame, Indiana, USA(信息技术、分析与运营系,诺丁汉大学,诺丁汉,印第安纳州,美国)
Advancing WordArt-Oriented Scene Text Recognition: Datasets and Methods
推进面向艺术字的场景文本识别:数据集与方法
Xingsong Ye, Yongkun Du, Jiaxin Zhang, Haojie Zhang, Chong Sun, Chen Li, Jing Lyu, Zhineng Chen
机构
*
Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究所)
;
Shanghai Key Laboratory of Multimodal Embodied AI, Fudan University(复旦大学上海市多模态具身人工智能重点实验室)
;
WeChat Vision, Tencent Inc.(腾讯微信视觉团队)
;
South China University of Technology(华南理工大学)
Beyond Trajectory Imitation: Strategy-Guided Policy Optimization for LLM Reasoning
超越轨迹模仿:策略引导的策略优化用于大语言模型推理
Tianyuan Shi, Canbin Huang, Bei Li, Xin Chen, Xiaojun Quan, Jingang Wang, Qifan Wang
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院)
;
Meituan, Inc., China(美团)
;
Shenzhen Loop Area Institute, China(深圳环区研究所)
;
Meta AI, USA(Meta AI)
机构
*
University of New South Wales(新南威尔士大学)
;
National University of Singapore(新加坡国立大学)
;
NVIDIA(英伟达)
;
Nanjing University(南京大学)
;
University of Technology Sydney(悉尼科技大学)
;
Australian National University(澳大利亚国立大学)
专题命中
指令微调
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
A Training-Free Mixture-of-Agents Framework for Multi-Document Summarization using LLMs and Knowledge Graphs
一种基于LLM和知识图谱的无训练混合智能体框架用于多文档摘要
Cuong Vuong Tuan, Trang Mai Xuan, Tien-Cuong Nguyen, Vu-Duc Ngo, Thien Van Luong
机构
*
Faculty of Artificial Intelligence and Data Science, Phenikaa University(人工智能与数据科学学院,泛尼克大学)
;
VNPT AI, VNPT Group(VNPT AI,VNPT集团)
;
MobiFone Research and Development Center, MobiFone Corporation(MobiFone研发与开发中心,MobiFone公司)
;
Business AI Lab, Faculty of Data Science and Artificial Intelligence, National Economics University, College of Technology(商业人工智能实验室,数据科学与人工智能学院,国家经济大学,技术学院)
专题命中
指令微调
:LLM(title_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI