Sinusoidal Initialization, Time for a New Start
正弦初始化,新的开始
机构 * OpenChip(OpenChip公司)
AI总结 本文提出正弦初始化方法,通过结构化权重矩阵提升深度学习模型的收敛速度、稳定性及准确率。
Journal ref NeurIPS (2025)
期刊&会议
Conference on Neural Information Processing Systems · 会议 · Machine Learning
正弦初始化,新的开始
机构 * OpenChip(OpenChip公司)
AI总结 本文提出正弦初始化方法,通过结构化权重矩阵提升深度学习模型的收敛速度、稳定性及准确率。
Journal ref NeurIPS (2025)
受约束的离散扩散
机构 * University of Virginia(弗吉尼亚大学) ; Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)
AI总结 受约束的离散扩散通过在扩散过程中直接施加约束,实现无训练的可控生成,优于现有方法。
Comments Published at the 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
在扩散模型中将文本对齐到图像比你想象的更容易
机构 * Kim Jaechul Graduate School of AI, KAIST(金佳哲人工智能研究生院,韩国科学技术院) ; Department of Bio and Brain Engineering, KAIST(生物与脑工程系,韩国科学技术院)
AI总结 本文提出SoftREPA方法,通过对比学习提升文本与图像表示的对齐效果,减少计算开销,增强语义一致性。
Comments NeurIPS 2025
有限样本分析鲁棒平均奖励强化学习中的策略评估
机构 * Purdue University(普渡大学) ; Indian Institute of Technology Kanpur(印度理工学院坎普尔)
AI总结 本文提出了一种基于多级蒙特卡洛技术的鲁棒策略评估方法,实现了最优样本复杂度,解决了鲁棒平均奖励强化学习中的样本复杂度问题。
Comments The 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
语言表示空间中的低维结构反映在脑响应中
机构 * UT Austin(德克萨斯大学) ; Intel Labs(英特尔实验室)
AI总结 研究揭示语言表示空间的低维结构,并通过fMRI验证其与大脑自然语言处理层次的关系。
Comments Accepted to the Advances in Neural Information Processing Systems 34 (2021) Revised to include voxel selection details
演示:生成式AI助力放疗计划制定与用户偏好
机构 * Digital Technology and Innovation, Siemens Healthineers(西门子医疗数字化技术与创新部) ; Varian Medical Systems, Siemens Healthineers(Varian医疗系统,西门子医疗)
AI总结 生成式AI通过用户自定义偏好提升放疗计划的灵活性与个性化,优于现有方法在适应性和计划质量上
Comments Best paper in GenAI4Health at NeurIPS 2025
3DID: 基于物理感知优化的直接三维逆向设计
机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) ; The State Key Lab of Brain-Machine Intelligence, Zhejiang University(浙江大学脑机智能状态关键实验室)
AI总结 3DID提出一种基于物理感知优化的直接三维逆向设计框架,通过连续潜在表示和两阶段优化策略生成高保真的三维几何结构,提升设计质量和灵活性。
Comments Accepted at NeurIPS 2025
金融指令遵循评估(FIFE)
AI总结 FIFE是一个用于评估语言模型在金融分析任务中指令遵循能力的高难度基准,通过88个人撰写的提示和可验证约束系统,评估53个模型的性能,揭示了不同模型在复杂金融指令任务中的表现差异。
Comments Accepted at NeurIPS 2025 Generative AI in Finance Workshop (GenAI Finance), San Diego. Camera-ready version. Code and data: https://github.com/gtfintechlab/FIFE/
EEG-Bench: 一个用于临床应用中EEG基础模型的基准测试
机构 * ETH Zurich(苏黎世联邦理工学院)
AI总结 EEG-Bench为临床应用中的EEG基础模型提供了一个统一的基准测试框架,评估了11个诊断任务,并展示了简单模型在临床分布偏移下的竞争力。
Comments Foundation Models for the Brain and Body (BrainBodyFM@NeurIPS)
具有对偶-actor-critic算法的平均奖励约束MDP的全局收敛性
机构 * Purdue University, USA(普渡大学,美国) ; Indian Institute of Science, Bengaluru, India(印度班加罗尔印度理工学院) ; Indian Institute of Technology Kanpur(印度理工学院坎普尔分校)
AI总结 本文提出了一种对偶-actor-critic算法,实现了平均奖励约束MDP的全局收敛性和约束违反率的理论最优解。
Comments NeurIPS 2025
开放聚合物挑战:赛后报告
机构 * University of Notre Dame(诺丁汉大学) ; University of Wisconsin–Madison(威斯康星大学麦迪逊分校) ; Kaggle
AI总结 开放聚合物挑战通过发布首个社区开发的聚合物基准数据集,推动多任务聚合物属性预测,促进分子AI在聚合物科学中的应用。
Comments The report for the competition: "NeurIPS - Open Polymer Prediction 2025". Kaggle Page: https://www.kaggle.com/competitions/neurips-open-polymer-prediction-2025. Website: https://open-polymer-challenge.github.io
TrackingWorld: 以世界为中心的单目3D像素跟踪
机构 * HKUST(香港科技大学) ; USTC(中国科学技术大学) ; CUHK(香港中文大学) ; HKU(香港大学) ; XMU(厦门大学) ; MUST(澳门科技大学)
AI总结 TrackingWorld提出了一种以世界为中心的单目3D像素跟踪方法,通过上采样器和优化框架实现对视频中几乎所有像素的密集3D跟踪。
Comments Accepted by NeurIPS 2025. Project Page: https://igl-hkust.github.io/TrackingWorld.github.io/
流形与模块:神经基础模型中函数如何发展
机构 * University of Tübingen(图宾根大学) ; School of Science & Technology(科学与技术学院) ; IE University(IE大学) ; The Kempner Institute for Natural and Artificial Intelligence(自然与人工智能研究所) ; Harvard University(哈佛大学) ; Department of Computer Science(计算机科学系) ; Yale University(耶鲁大学) ; Depts. of Computer Science and Biomedical Engineering(计算机科学与生物医学工程系) ; Wu Tsai Institute(吴士怀研究所)
AI总结 本文通过分析神经基础模型中不同处理阶段的流形结构,揭示其在生物相关性方面的贡献。
Comments 25 pages, 10 figures, accepted at Data on the Brain & Mind Findings, NeurIPS 2025
利用LLM代理自动化高能物理数据分析
机构 * Department of Physics, University of California, Berkeley, Berkeley, CA 94720, USA(加州大学伯克利分校物理系) ; Physics Division, Lawrence Berkeley National Laboratory, Berkeley, CA 94720, USA(伯克利国家实验室物理部)
AI总结 本研究利用LLM代理自动化高能物理数据分析,通过混合系统结合LLM和Snakemake工作流管理器,评估代理在多阶段工作流中的性能。
Comments 16 pages, 6 figures, 2 tables, the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) - Machine Learning and the Physical Sciences (ML4PS) workshop (poster)
小型变换器模型的分解
机构 * Independent(独立研究者)
AI总结 本文提出将随机参数分解扩展到变换器模型,通过改进的因果重要性函数和新损失函数,成功分解玩具模型并揭示GPT-2-small中可解释的子组件。
Comments Accepted at Neurips 2025 Workshop on Mechanistic Interpretability
阐明的滚动扩散模型用于复杂动态的概率预报
机构 * UC San Diego(斯克利普斯海洋研究所(圣地亚哥)) ; NVIDIA(英伟达)
AI总结 ERDM通过整合滚动预测结构与EDM设计,有效提升复杂动态的概率预报性能。
Comments NeurIPS 2025
Journal ref Advances in Neural Information Processing Systems (NeurIPS), 2025
贝塞尔点绘用于快速且可微的向量图形渲染
机构 * Clemson University(克莱姆森大学) ; Adobe Research(Adobe研究院)
AI总结 本文提出贝塞尔点绘方法,通过高效光栅化实现快速且高保真的向量图形渲染,同时支持SVG格式转换,显著提升渲染质量和优化效率。
Comments NeurIPS 2025. Project page: https://xiliu8006.github.io/Bezier_splatting_project/
GSPN-2:高效的并行序列建模
机构 * NVIDIA ; The University of Hong Kong(香港大学) ; University of California, San Diego(加州大学圣地亚哥分校)
AI总结 GSPN-2通过结构化矩阵变换和GPU优化实现,提升视觉应用中全局空间上下文建模的效率。
Comments NeurIPS 2025
面向PPG心率估计模型知识蒸馏的特性分析
机构 * University of Washington(华盛顿大学)
AI总结 本文研究了PPG心率估计模型的知识蒸馏特性,评估了四种蒸馏策略,揭示了模型大小与性能的缩放规律,为边缘设备部署提供了理论支持。
Comments 5 pages, 3 figures, 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: Learning from Time Series for Health
度量公平提示:对待相似样本同样
机构 * NLM(国家医学图书馆) ; Stevens Institute of Technology(史蒂文斯理工学院) ; AWS AI(亚马逊人工智能) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
AI总结 度量公平提示通过促进个体公平性,提高LLM在高风险临床多选问题上的准确性。
Journal ref NeurIPS 2025 Workshop on Socially Responsible and Trustworthy Foundation Models
在线分割三维物体作为实例跟踪
机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), CASIA(多模态人工智能系统国家重点实验室(MAIS),中国科学院自动化所) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab) ; Anyverse Intelligence ; Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京超智能多模态信息安全重点实验室) ; School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)
AI总结 将在线3D分割重新定义为实例跟踪问题,通过时间信息传播和空间一致性学习提升具身智能体对环境的理解能力。
Comments NeurIPS 2025, Code is at https://github.com/AutoLab-SAI-SJTU/AutoSeg3D
SPACE:噪声对比估计稳定了大语言模型的自我对战微调
机构 * National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家实验室,南京大学) ; School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) ; Alibaba International Digital Commerce(阿里巴巴国际数字商业) ; Pazhou Laboratory (Huangpu)(琶洲实验室(黄埔))
AI总结 SPACE通过噪声对比估计稳定大语言模型的自我对战微调,提升下游任务性能
Comments NeurIPS 2025
JEPA作为一种神经令牌化器:利用密度自适应注意力学习鲁棒的语音表示
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Amazon GenAI(亚马逊生成人工智能) ; James Silberrad Brown Center for Artificial Intelligence(詹姆斯·西伯拉德·布朗人工智能中心) ; University of Bristol(布里斯托大学) ; Stanford University(斯坦福大学) ; Northeastern University(东北大学) ; New York University(纽约大学)
AI总结 本文提出了一种结合JEPA和密度自适应注意力机制的两阶段自监督框架,用于高效学习鲁棒的语音表示,通过令牌化和高保真重建实现高效压缩。
Comments UniReps: Unifying Representations in Neural Models (NeurIPS 2025 Workshop)
用于宇宙学领域的视觉变换器:应用于弱引力透镜质量图
AI总结 本文研究了基于视觉变换器的弱引力透镜质量图分析方法,发现Swin变换器在有限数据下优于普通ViTs,且在现实噪声条件下与CNNs的宇宙学性能相当。
Comments Accepted to NeurIPS 2025 AI4Physics
VideoVLA: 视频生成器可以成为通用的机器人操作器
机构 * IAIR, Xi’an Jiaotong University(人工智能研究院、西安交通大学) ; Microsoft Research Asia(微软亚洲研究院) ; Fudan University(复旦大学)
AI总结 VideoVLA通过将视频生成模型转化为机器人VLA操作器,实现了动作与视觉后果的双预测,提升机器人操作的泛化能力。
Comments Project page: https://videovla-nips2025.github.io
Journal ref The Thirty-ninth Annual Conference on Neural Information Processing Systems(NeurIPS2025)
QiMeng-SALV:面向Verilog代码生成的信号感知学习
机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院) ; University of Chinese Academy of Sciences(中国科学院大学) ; University of Science and Technology of China(中国科学技术大学)
AI总结 QiMeng-SALV通过信号感知学习提升Verilog代码生成的准确性与性能,采用信号级优化解决功能奖励不足问题。
Comments Accepted to NeurIPS 2025
多头变压器通过梯度下降证明能够学习符号多步推理
AI总结 多头变压器通过梯度下降机制学习符号多步推理,证明其能有效解决复杂任务。
Comments NeurIPS 2025
DP-LLM:基于动态层间精度分配的运行时模型适应
机构 * Seoul National University(首尔国立大学)
AI总结 DP-LLM通过动态分配各层精度,优化设备端大语言模型的运行时性能与延迟权衡。
Comments NeurIPS 2025
一个样本足以使符合预测鲁棒
AI总结 本研究提出了一种单样本鲁棒符合预测方法,通过验证符合过程本身,实现更小的鲁棒预测集,适用于分类和回归任务。
Comments Accepted in NeurIPS 2025 Conference
学习率步长任意性:一种统一的学习率调度方案用于预算迭代训练
机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能通用基础研究国家重点实验室,智能科学与技术学院,北京大学) ; ByteDance Seed(字节跳动种子) ; Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) ; Pazhou Laboratory (Huangpu), Guangzhou, Guangdong, China(琶洲实验室(黄埔),广州,广东,中国)
AI总结 本文提出了一种理论基础的学习率调度方案UBA,通过统一的预算感知框架,优化不同网络和任务下的训练效率,提升了在预算限制下的学习性能。
Journal ref NeurIPS 2025