Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods
重新思考大语言模型训练中的数据整理:在线重加权优于离线方法
Wanru Zhao, Yihong Chen, Yuzhi Tang, Wentao Ma, Shengchao Hu, Shell Xu Hu, Alex Iacob, Abhinav Mehrotra, Nicholas D. Lane
机构
*
University of Cambridge(剑桥大学)
;
OATML, University of Oxford(牛津大学OATML实验室)
;
University of Toronto(多伦多大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Samsung AI Center(三星人工智能中心)
专题命中
预训练与数据
:LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
DINORANKCLIP: DINOv3 Distillation and Injection for Vision-Language Pretraining with High-Order Ranking Consistency
DINORANKCLIP:基于DINOv3蒸馏与注入的视觉-语言预训练高阶排名一致性方法
Shuyang Jiang, Nan Yu, Yiming Zhang, Zenghui Ding, Zhenyu Wu
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
Aimaikj(阿米亚克j)
;
HFIPS, Chinese Academy of Sciences(中国科学院HFIPS)
;
University of Science and Technology of China(中国科学技术大学)
;
Chinese Academy of Sciences(中国科学院)
;
National University of Defense Technology(国防科技大学)
机构
*
National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)
;
School of Computer Science, Peking University(北京大学计算机科学学院)
;
LLM Department, Tencent(腾讯LLM部门)
How Much Is One Recurrence Worth? Iso-Depth Scaling Laws for Looped Language Models
循环一次值有多大?循环语言模型的等深度缩放定律
Kristian Schwethelm, Daniel Rueckert, Georgios Kaissis
机构
*
Chair for AI in Healthcare and Medicine, Technical University of Munich(慕尼黑技术大学人工智能在医疗和医学中的主任)
;
Department of Computing, Imperial College London(伦敦帝国理工学院计算机系)
;
Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心(MCML))
;
Hasso Plattner Institute for Digital Engineering, University of Potsdam, Germany(波茨坦大学数字工程霍普夫研究所)
Mind the Gap? A Distributional Comparison of Real and Synthetic Priors for Tabular Foundation Models
注意差距?对现实和合成先验的分布比较用于表格基础模型
Alex O. Davies, Telmo de Menezes e Silva Filho, Nirav Ajmeri
机构
*
School of Geographical Sciences University of Bristol, UK(布里斯托尔大学地理科学学院)
;
School of Engineering Mathematics and Technology University of Bristol, UK(布里斯托尔大学工程数学与技术学院)
;
School of Computer Science University of Bristol, UK(布里斯托尔大学计算机科学学院)
When and Why SignSGD Outperforms SGD: A Theoretical Study Based on $\ell_1$-norm Lower Bounds
何时以及为何SignSGD优于SGD:基于ℓ1范数下界的一个理论研究
Hongyi Tao, Dingzhi Yu, Lijun Zhang
机构
*
State Key Laboratory of Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
;
School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)
UniE2F: A Unified Diffusion Framework for Event-to-Frame Reconstruction with Video Foundation Models
UniE2F: 一种基于视频基础模型的统一扩散框架用于事件到帧重建
Gang Xu, Zhiyu Zhu, Junhui Hou
机构
*
Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))
;
Department of Computer Science, City University of Hong Kong (Dongguan)(香港城市大学(东莞)计算机科学系)
Laya: A LeJEPA Approach to EEG via Latent Prediction over Reconstruction
Laya: 一种基于联合嵌入预测架构的EEG方法
Saarang Panchavati, Uddhav Panchavati, Hiroki Nariai, Corey Arnold, William Speier
机构
*
Department of Medical Informatics(医学信息学系)
;
UCLA(美国加利福尼亚大学洛杉矶分校)
;
Department of Cognitive Science(认知科学系)
;
UCSD(美国圣地亚哥大学)
;
David Geffen School of Medicine(大卫·盖弗医学院)
;
Mattel Children’s Hospital(马特尔儿童医院)
Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization
通过控制最大化统一目标条件强化学习和无监督技能学习
Alireza Modirshanechi, Benjamin Eysenbach, Peter Dayan, Eric Schulz
机构
*
Helmholtz Munich(海德堡大学慕尼黑分校)
;
Max Planck Institute for Biological Cybernetics(生物 cybernetics 最大计划研究所)
;
Princeton University(普林斯顿大学)
;
University of Tübingen(图宾根大学)
Channel-Level Semantic Perturbations: Unlearnable Examples for Diverse Training Paradigms
通道级语义扰动:用于多样化训练范式的不可学习示例
Bo Wang, Jia Ni, Mengnan Zhao, Zhan Qin, Kui Ren
机构
*
School of Information and Communication Engineering, Dalian University of Technology(大连理工大学信息与通信工程学院)
;
School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院)
;
School of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
Optimal In-context Adaptivity and Distributional Robustness of Transformers
Transformer的最优上下文适应性与分布鲁棒性
Tianyi Ma, Tengyao Wang, Richard J. Samworth
机构
*
Statistical Laboratory, University of Cambridge(剑桥大学统计实验室)
;
Department of Statistics, London School of Economics and Political Science(伦敦政治经济学院统计系)
Beyond Semantic Similarity: Rethinking Retrieval for Agentic Search via Direct Corpus Interaction
超越语义相似性:通过直接语料交互重新思考代理搜索的检索
Zhuofeng Li, Haoxiang Zhang, Cong Wei, Pan Lu, Ping Nie, Yi Lu, Yuyang Bai, Shangbin Feng, Hangxiao Zhu, Ming Zhong, Yuyu Zhang, Jianwen Xie, Yejin Choi, James Zou, Jiawei Han, Wenhu Chen, Jimmy Lin, Dongfu Jiang, Yu Zhang
机构
*
Texas A&M University(德克萨斯A&M大学)
;
University of Waterloo(滑铁卢大学)
;
UC San Diego(圣地亚哥大学)
;
Stanford University(斯坦福大学)
;
University of Washington(华盛顿大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Verdent AI
;
Lambda