International Conference on Machine Learning · 会议 · Machine Learning
2026-06-01 至 2026-06-01 共收录 158 篇
2605.261212026-06-01cs.LGcs.AI
GEM: Geometric Entropy Mixing for Optimal LLM Data Curation
GEM: 用于最优LLM数据策展的几何熵混合
Yue Min, Ziyun Qiao, Ruining Chen, Yujun Li
机构
*
The Hong Kong University of Science and Technology, Hong Kong SAR, China(香港科学与技术大学)
;
Peking University, Beijing, China(北京大学)
;
University of Science and Technology of China, Hefei, China(中国科学技术大学)
Theoretical Analysis of Sparse Optimization with Reparameterization, Weight Decay, and Adaptive Learning Rate
重参数化、权重衰减和自适应学习率下稀疏优化的理论分析
Huangyu Xu, Jingqin Yang, Qianqian Xu, Jiaye Teng
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(人工智能安全国家重点实验室,计算技术研究所,中国科学院,北京,中国)
;
School of Computer Science and Technology, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学计算机科学与技术学院,北京,中国)
;
Beijing Academy of Artificial Intelligence (BAAI), Beijing, China(北京人工智能研究院(BAAI),北京,中国)
;
IIIS, Tsinghua University, Beijing, China(清华大学人工智能院,北京,中国)
;
School of Statistics and Management, Shanghai University of Finance and Economics, Shanghai, China(上海财经大学统计与管理学院,上海,中国)
;
Institute of Data Science and Statistics, Shanghai University of Finance and Economics, Shanghai, China(上海财经大学数据科学与统计研究所,上海,中国)
Cross-Chirality Generalization by Axial Vectors for Hetero-Chiral Protein-Peptide Interaction Design
通过轴向向量实现异手性蛋白质-肽相互作用设计的跨手性泛化
Ziyi Yang, Zitong Tian, Yinjun Jia, Tianyi Zhang, Jiqing Zheng, Hao Wang, Yubu Su, Juncai He, Lei Liu, Yanyan Lan
机构
*
Department of Chemistry, Tsinghua University, Beijing, China(清华大学化学系)
;
School of Life Sciences, Tsinghua University, Beijing, China(清华大学生命科学学院)
;
Anew Labs, Shanghai, China(Anew实验室)
;
Tsinghua-Peking Center for Life Sciences, Beijing, China(清华大学-北京大学生命科学中心)
;
Ministry of Education Key Laboratory of Bioorganic Phosphorus Chemistry and Chemical Biology, Tsinghua University, Beijing, China(教育部生物有机磷化学与化学生物学重点实验室)
;
Center for Synthetic and Systems Biology, Tsinghua University, Beijing, China(合成与系统生物学中心)
;
Beijing Frontier Research Center for Biological Structure, Tsinghua University, Beijing, China(北京生物结构前沿研究中心)
;
Qiuzhen College, Tsinghua University, Beijing, China(齐臻学院)
;
Yau Mathematical Sciences Center, Tsinghua University, Beijing, China(叶德平数学科学中心)
;
Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学)
;
AI Industry Research Innovation Center,Wuxi Research Institute for Applied Technologies, Tsinghua University(人工智能产业研究创新中心,无锡应用技术研究院,清华大学)
How does Bayesian Sampling help Membership Inference Attacks?
贝叶斯采样如何帮助成员推断攻击?
Zhenlong Liu, Wenyu Jiang, Feng Zhou, Hongxin Wei
机构
*
Department of Statistics and Data Science, Southern University of Science and Technology(统计与数据科学系,南方科技大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
School of Computer Science, Nanjing University(南京大学计算机科学系)
;
Center for Applied Statistics and School of Statistics, Renmin University of China(应用统计中心和统计学系,中国人民大学)
机构
*
University of Technology Sydney, Sydney, Australia(技术悉尼大学)
;
School of Cyber Science and Engineering, Southeast University, Nanjing, China(东南大学计算机科学与工程学院)
;
Xi'an Jiaotong University, Xi'an, China(西安交通大学)
Efficient Learning of Deep State Space Models via Importance Smoothing
通过重要性平滑高效学习深度状态空间模型
John-Joseph Brady, Nikolas Nusken, Yunpeng Li
机构
*
Centre for Oral, Clinical and Translational Sciences, King's College London, London, United Kingdom(口腔、临床与转化科学中心,伦敦国王学院,伦敦,英国)
;
Department of Mathematics, King's College London, London, United Kingdom(数学系,伦敦国王学院,伦敦,英国)
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
将搜索与训练解耦:通过模型合并实现大规模语言模型预训练的数据混合缩放
Shengrui Li, Fei Zhao, Kaiyan Zhao, Jieying Ye, Haifeng Liu, Fangcheng Shi, Zheyong Xie, Yao Hu, Shaosheng Cao
机构
*
NLP Team, Xiaohongshu Inc., Shanghai, China(小红书自然语言处理团队,小红书公司,上海,中国)
;
Tsinghua University, Beijing, China(清华大学,北京,中国)
;
The University of Tokyo, Tokyo, Japan(东京大学,东京,日本)
AI总结
提出DeMix框架,通过模型合并预测最优数据配比,在降低搜索成本的同时提升基准性能。
Comments18 pages, 5 figures, accepted at ICML 2026
LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries
LangForce: 通过潜在动作查询对视觉语言动作模型进行贝叶斯分解
Shijie Lian, Bin Yu, Xiaopeng Lin, Laurence T. Yang, Zhaolong Shen, Changti Wu, Yuzhuo Miao, Cong Huang, Kai Chen
机构
*
Huazhong University of Science and Technology(华中科技大学)
;
Beijing Zhongguancun Academy(北京中关村学院)
;
Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Zhengzhou University(郑州大学)
;
Beihang University(北航)
;
East China Normal University(东华大学)
;
DeepCybot Co., Ltd.(DeepCybot有限公司)
Spurious Correlation Learning in Preference Optimization: Mechanisms, Consequences, and Mitigation via Tie Training
偏好优化中的虚假相关学习:机制、后果及通过平局训练的缓解方法
Christian Moya, Alex Semendinger, Guang Lin, Elliott Thornley
机构
*
Department of Mathematics, Purdue University, West Lafayette IN, USA(普渡大学数学系)
;
School of Mechanical Engineering, Purdue University, West Lafayette IN, USA(普渡大学机械工程学院)
;
Massachusetts Institute of Technology, Cambridge MA, USA(麻省理工学院)
机构
*
Nanyang Technological University, Singapore(新加坡南洋理工大学)
;
BIFOLD, Berlin Institute for the Foundations of Learning(柏林学习与数据基础研究所)
;
University of Cambridge, Cambridge, UK(剑桥大学)
机构
*
Indian Institute of Technology Delhi, New Delhi, India(印度理工学院德里分校,新德里,印度)
;
Indian Institute of Technology Delhi, Abu Dhabi, UAE(印度理工学院德里分校,阿布扎比,阿联酋)
;
KDM Lab, Dhirubhai Ambani University Gandhinagar, Gujarat, India(KDM实验室,迪鲁布希阿姆巴尼大学冈丁加尔,古吉拉特邦,印度)
Multi-Objective Bayesian Optimization via Adaptive \varepsilon-Constraints Decomposition
基于自适应 ε-约束分解的多目标贝叶斯优化
Yaohong Yang, Sammie Katt, Samuel Kaski
机构
*
Department of Computer Science, Aalto University, Espoo, Finland(阿尔托大学计算机科学系,芬兰 Espoo)
;
ELLIS Institute Finland(芬兰 ELLIS 机构)
;
Department of Computer Science, University of Manchester, Manchester, United Kingdom(曼彻斯特大学计算机科学系,英国 Manchester)
Sharp description of local minima in the loss landscape of high-dimensional two-layer ReLU neural networks
高维两层ReLU神经网络损失景观中局部极小值的精确描述
Jie Huang, Bruno Loureiro, Stefano Sarao Mannelli
机构
*
Physics, Chalmers University of Technology
;
University of Gothenburg
;
Ecole Normale Superieure, PSL \& CNRS
;
Engineering, Chalmers University of Technology
;
School of Computer Science
;
Applied Mathematics, University of the Witwatersrand
机构
*
Department of Electrical and Computer Engineering, Virginia Tech, Blacksburg, VA, USA(弗吉尼亚理工学院计算机工程系)
;
Center for Advanced AI, Accenture(Accenture高级人工智能中心)
REAL: Regression-Aware Reinforcement Learning for LLM-as-a-Judge
REAL: 面向LLM评判的回归感知强化学习
Yasi Zhang, Tianyu Chen, Mingyuan Zhou, Oscar Leong, Ying Nian Wu, Michal Lukasik
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
The University of Texas at Austin(得克萨斯大学奥斯汀分校)
;
Google Research Now at Google DeepMind(谷歌研究 现在在谷歌深Mind)
What is Missing? Explaining Neurons Activated by Absent Concepts
缺失的是什么?解释被缺失概念激活的神经元
Robin Hesse, Simone Schaub-Meyer, Janina Hesse, Bernt Schiele, Stefan Roth
机构
*
Max Planck Institute for Informatics, SIC(马克斯·普朗克信息研究所,SIC)
;
Department of Computer Science, Technical University of Darmstadt(达姆施塔特技术大学计算机科学系)
;
Leibniz Institute for Resilience Research(莱比锡韧性研究所)
;
Institute for Quantitative and Computational Biosciences, Johannes Gutenberg University Mainz(美因茨雅各布·冯·特利尔大学定量与计算生物科学研究所)
;
University Medical Center Mainz(美因茨大学医学中心)