Pruning Long Chain-of-Thought of Large Reasoning Models via Small-Scale Preference Optimization
通过小规模偏好优化修剪大推理模型的长推理链
Bin Hong, Jiayu Liu, Kai Zhang, Jianwen Sun, Mengdi Zhang, Zhenya Huang
机构
*
State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)
;
University of Science and Technology of China(中国科学技术大学)
;
Institute of Artificial Intelligence(人工智能研究院)
;
Hefei Comprehensive National Science Center(合肥综合性国家科学中心)
;
Central China Normal University(中部师范大学)
;
Meituan(美团)
;
NeoShell
Fast training of accurate physics-informed neural networks without gradient descent
快速训练准确的物理信息神经网络而无需梯度下降
Chinmay Datar, Taniya Kapoor, Abhishek Chandra, Qing Sun, Erik Lien Bolager, Iryna Burak, Anna Veselovska, Massimo Fornasier, Felix Dietrich
机构
*
Technical University of Munich(慕尼黑技术大学)
;
TUM Institute for Advanced Study(TUM高级研究学院)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Wageningen University & Research(瓦赫宁根大学与研究中心)
;
KTH Royal Institute of Technology(皇家理工学院)
;
Munich Data Science Institute(慕尼黑数据科学研究所)
Binomial Gradient-Based Meta-Learning for Enhanced Meta-Gradient Estimation
二项式梯度基于元学习用于增强元梯度估计
Yilang Zhang, Abraham Jaeger Mountain, Bingcong Li, Georgios B. Giannakis
机构
*
Department of Electrical and Computer Engineering(电气与计算机工程系)
;
University of Minnesota(明尼苏达大学)
;
Department of Computer Science(计算机科学系)
;
ETH Zürich(苏黎世联邦理工学院)
Vishal Pramanik, Maisha Maliha, Nathaniel D. Bastian, Sumit Kumar Jha
机构
*
Department of Computer & Information Science & Engineering, University of Florida(佛罗里达大学计算机与信息科学与工程系)
;
School of Computer Science, University of Oklahoma(俄克拉荷马大学计算机科学学院)
;
Department of Electrical Engineering and Computer Science, United States Military Academy(美国军事学院电子工程与计算机科学系)
SPG: Sandwiched Policy Gradient for Masked Diffusion Language Models
SPG:用于遮蔽扩散语言模型的夹心策略梯度
Chenyu Wang, Paria Rashidinejad, DiJia Su, Song Jiang, Sid Wang, Siyan Zhao, Cai Zhou, Shannon Zejiang Shen, Feiyu Chen, Tommi Jaakkola, Yuandong Tian, Bo Liu
机构
*
School of Statistics, East China Normal University(华东师范大学统计学院)
;
Department of Statistics, University of California, Los Angeles(加州大学洛杉矶分校统计系)
;
Department of Industrial and Systems Engineering, University of Minnesota(明尼苏达大学工业与系统工程系)
;
School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院)
Rapid training of Hamiltonian graph networks using random features
利用随机特征快速训练哈密顿图网络
Atamert Rahma, Chinmay Datar, Ana Cukarska, Felix Dietrich
机构
*
Technical University of Munich(慕尼黑技术大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
TUM Institute for Advanced Study(技术大学高级研究学院)
;
Munich Data Science Institute(慕尼黑数据科学研究所)