arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Massachusetts Institute of Technology(麻省理工学院)

共收录 210
2605.16813 2026-07-02 cs.GR cs.CV 版本更新

QuadLink: Autoregressive Quad-Dominant Mesh Generation via Point-Relation Learning

QuadLink: 通过点关系学习的自回归四边形主导网格生成

Yiheng Zhang, Zhe Zhu, Tingrui Shen, Zhuojiang Cai, Tianxiao Li, Zixing Zhao, Qiujie Dong, Zhiyang Dou, Jiepeng Wang, Le Wan, Yuwang Wang, Wenping Wang, Yuan Liu, Cheng Lin

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent VISVISE(腾讯VISVISE) Peking University(北京大学) Technical University of Munich(慕尼黑技术大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) Massachusetts Institute of Technology(麻省理工学院) Texas A&M University(德克萨斯大学) Macau University of Science and Technology(澳门科技大学)

AI总结 提出QuadLink框架,通过将点云链接成结构化面片,以自回归方式生成各向异性的四边形主导网格,实现高几何保真度和拓扑质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20467 2026-07-02 stat.ME cs.LG math.DS 版本更新

Goal-oriented learning of stochastic differential equations using error bounds on path-space observables

基于路径空间观测误差界限的随机微分方程目标导向学习

Joanna Zou, Han Cheng Lie, Youssef Marzouk

机构 * Center for Computational Science & Engineering, Massachusetts Institute of Technology(麻省理工学院计算科学与工程中心) Department of Mathematics, University of Potsdam(波茨坦大学数学系)

AI总结 提出一种针对路径空间观测的误差界限,并作为新的变分损失函数用于随机微分方程漂移函数的目标导向学习,在首次命中时间等观测上取得更优精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08001 2026-07-02 cs.LG stat.ML 版本更新

Amortized Maximum Inner Product Search with Learned Support Functions

通过学习支持函数摊销最大内积搜索

Theo X. Olausson, João Monteiro, Michal Klein, Marco Cuturi

机构 * Apple(苹果公司) MIT(麻省理工学院)

AI总结 提出基于回归的摊销MIPS方法,通过训练神经网络直接预测最优键,利用支持函数的凸性加速搜索,在BEIR基准上显著提升IVF匹配率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03821 2026-07-01 cs.LG 版本更新

Finding Needles in the Haystack: Transductive Active Labeling in Ecology

在干草堆中寻找针:生态学中的转导式主动标注

Rupa Kurinchi-Vendhan, Sara Beery

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出转导式主动标注方法,通过发现稀有类样本解决生态数据长尾分布问题,并设计混合停止准则提升稀有类恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00970 2026-07-01 cs.AI cs.LG econ.TH 版本更新

Prospect-Theory Behavior from Bellman Optimality in MDPs with Catastrophic States

具有灾难性状态的MDP中贝尔曼最优性产生的前景理论行为

Yujiao Chen

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 研究具有吸收灾难状态的马尔可夫决策过程中的风险中性控制,发现标准贝尔曼最优性产生前景理论特征:S形值函数、内生损失敏感系数和反射效应策略反转,并推导出渐近损失厌恶平台的闭式表达式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22027 2026-07-01 cs.CL cs.AI cs.LG 版本更新

Shared Lexical Task Representations Explain Behavioral Variability In LLMs

共享的词汇任务表示解释了大语言模型中的行为变异

Zhuonan Yang, Jacob Xiaochen Li, Francisco Piedrahita Velez, Eric Todd, David Bau, Michael L. Littman, Stephen H. Bach, Ellie Pavlick

机构 * Brown University(布朗大学) MIT(麻省理工学院) Northeastern University(东北大学)

AI总结 研究通过比较指令式和示例式提示发现,大语言模型在不同提示下行为差异可由共享的词汇任务表示解释,揭示了任务特定注意力头在不同提示风格中的共同机制。

Comments Accepted to ICML 2026. Updated to the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23461 2026-07-01 cs.LG 版本更新

End-to-End Efficient RL for Linear Bellman Complete MDPs with Deterministic Transitions

具有确定性转移的线性Bellman完备MDP的端到端高效强化学习

Zakaria Mhammedi, Alexander Rakhlin, Nneka Okolo

机构 * Google Research, NYC(谷歌研究院纽约) MIT(麻省理工学院)

AI总结 针对线性Bellman完备MDP,提出一种在确定性转移下计算高效的算法,对有限动作空间端到端高效,对无限动作空间仅需标准argmax oracle,实现多项式样本与计算复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07939 2026-07-01 cs.RO physics.flu-dyn 版本更新

Unified Structural-Hydrodynamic Modeling of Underwater Underactuated Mechanisms and Soft Robots

水下欠驱动机构与软体机器人的统一结构-水动力学建模

Chenrui Zhang, Yiyuan Zhang, Yunfei Ye, Junkai Chen, Haozhe Wang, Cecilia Laschi

机构 * Department of Mechanical Engineering and Advanced Robotics Centre, National University of Singapore(新加坡国立大学机械工程系与先进机器人中心) Singapore-MIT Alliance for Research and Technology (SMART) Centre(新加坡-麻省理工学院研究与技术联盟中心)

AI总结 提出一种轨迹驱动的全局优化框架,基于CMA-ES同时识别弹性、阻尼和分布式水动力学参数,实现水下欠驱动机构和软体机器人的高保真建模,仅需单段视频。

Comments The first two listed authors contributed equally. Yiyuan Zhang is the corresponding author. This paper has been accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18778 2026-07-01 cs.LG cs.CL 版本更新

Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability

教模型自学:在可学习性边缘推理

Shobhita Sundaram, John Quan, Ariel Kwiatkowski, Kartik Ahuja, Yann Ollivier, Julia Kempe

机构 * MIT(麻省理工学院) Meta FAIR New York University(纽约大学)

AI总结 提出SOAR非对称自对弈框架,通过元强化学习生成自动课程,解决低初始成功率数据集上的推理模型扩展问题,发现基于学生进步的奖励优于内在可学习性奖励,且问题结构比答案正确性更重要。

Comments ICML 2026. Blog post: https://ssundaram21.github.io/soar/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15845 2026-07-01 cs.CL cs.AI 版本更新

Verify when Uncertain: Beyond Self-Consistency in Black Box Hallucination Detection

不确定时验证:超越黑盒幻觉检测中的自一致性

Yihao Xue, Kristjan Greenewald, Youssef Mroueh, Baharan Mirzasoleiman

机构 * MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) IBM Research(IBM研究院)

AI总结 提出两阶段检测算法,结合自一致性与交叉一致性,在保持高检测性能的同时降低计算成本,并通过核均值嵌入提供理论解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10938 2026-06-29 cs.CL cs.AI cs.LG 版本更新

ELF: Embedded Language Flows

ELF:嵌入式语言流

Keya Hu, Linlu Qiu, Yiyang Lu, Hanhong Zhao, Tianhong Li, Yoon Kim, Jacob Andreas, Kaiming He

机构 * MIT(麻省理工学院)

AI总结 本文提出ELF,一种基于连续时间流匹配的连续嵌入空间扩散模型,通过最小调整即可在离散领域有效工作,实验显示其在生成质量与采样步骤上优于现有模型。

Comments Tech report. arXiv v2: add distillation results in Appendix B. https://linlu-qiu.github.io/assets/html/elf_pd.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22160 2026-06-29 cs.CV cs.AI 版本更新

GenMatter: Perceiving Physical Objects with Generative Matter Models

GenMatter:基于生成物质模型的物理物体感知

Eric Li, Arijit Dasgupta, Yoni Friedman, Mathieu Huot, Vikash Mansinghka, Thomas O'Connell, William T. Freeman, Joshua B. Tenenbaum

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) MIT BCS(麻省理工学院生物学与计算机科学)

AI总结 本文提出一种生成物质模型,通过分层聚类低级运动线索和高级外观特征,实现对不同输入的统一感知框架,验证了其在随机点运动、伪装旋转物体和自然视频中的有效性。

Comments 25 pages, 12 figures, CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08648 2026-06-29 astro-ph.HE astro-ph.IM cs.LG hep-ph 版本更新

High-dimensional inference for the $γ$-ray sky with differentiable programming

高维推断用于γ射线天空的不同可微编程

Siddharth Mishra-Sharma, Tracy R. Slatyer, Yitian Sun, Yuqing Wu

机构 * Faculty of Computing Data Sciences, Boston University, Boston, MA 02215, USA The NSF AI Institute for Artificial Intelligence Center for Theoretical Physics -- a Leinweber Institute, Massachusetts Institute of Technology, Cambridge, MA 02139, USA Department of Physics, Harvard University, Cambridge, MA 02138, USA Center for Theoretical Physics, Massachusetts Institute of Technology, Cambridge, MA 02139, USA Trottier Space Institute \& Department of Physics, McGill University, Montreal, QC H3A 2T8, Canada Department of Physics, Cornell University, Ithaca, NY 14853, USA

AI总结 本文利用可微概率编程技术解决银河系中心γ射线异常问题,通过GPU加速和向量化方法构建可微前向模型和似然函数,实现对多种空间形态的灵活推断。

Comments 20 pages, 16 figures. Code available at https://github.com/smsharma/fermi-prob-prog. V2: Updated with a more complete set of coverge tests

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01447 2026-06-26 cs.LG cs.GT 版本更新

Decentralized Best-Response-Based Learning in Two-Player Zero-Sum Stochastic Games: A Finite-Sample Analysis

两人零和随机博弈中基于最优响应的去中心化学习:有限样本分析

Zaiwei Chen, Kaiqing Zhang, Eric Mazumdar, Asuman Ozdaglar, Adam Wierman

机构 * Purdue University(普渡大学) University of Maryland, College Park(马里兰大学学院公园分校) Caltech(加州理工学院) MIT(麻省理工学院)

AI总结 本文对两人零和矩阵博弈和随机博弈中的去中心化学习进行有限样本分析,提出基于最优响应的学习算法,并证明其样本复杂度。

Comments A preliminary version [arXiv:2303.03100] of this paper, with a subset of the results that are presented here, was presented at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12024 2026-06-25 cs.RO 版本更新

Adaptive-Horizon Conflict-Based Search for Closed-Loop Multi-Agent Path Finding

自适应视界冲突搜索用于闭环多智能体路径规划

Jiarui Li, Federico Pecora, Runyu Zhang, Gioele Zardini

机构 * Laboratory for Information and Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院) Schwarzman College of Computing(施瓦茨曼计算学院)

AI总结 提出ACCBS算法,通过动态调整规划视界和重用约束树,在有限计算预算下快速生成高质量可行解,兼具渐近最优性和扰动适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06566 2026-06-25 cs.CV cs.AI cs.CL 版本更新

SPARC: Separating Perception And Reasoning Circuits for Test-time Scaling of VLMs

SPARC: 分离感知与推理回路以实现VLM的测试时扩展

Niccolo Avogaro, Nayanika Debnath, Li Mi, Thomas Frick, Junling Wang, Zexue He, Hang Hua, Konrad Schindler, Mattia Rigotti

机构 * ETH Zürich(苏黎世联邦理工学院) IBM Research(IBM研究院) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)

AI总结 提出SPARC框架,通过显式分离视觉感知与推理,实现测试时动态扩展和不对称计算分配,在视觉推理任务中优于基线方法。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02193 2026-06-25 cs.LG cs.DS stat.ML 版本更新

Learning with Monotone Adversarial Corruptions

单调对抗性损坏下的学习

Kasper Green Larsen, Chirag Pabbaraju, Abhishek Shetty

机构 * Aarhus University(奥胡斯大学) Stanford University(斯坦福大学) MIT(麻省理工学院)

AI总结 研究单调对抗性损坏模型下标准机器学习算法的局限性,发现最优分类算法在该设置下表现次优,而基于一致收敛的算法保持性能。

Comments added a few references in related work

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05933 2026-06-25 cs.CL cs.AI 版本更新

Reinforcement Learning Improves Traversal of Parametric Knowledge in LLMs

强化学习改善LLM中参数化知识的遍历

Renfei Zhang, Manasa Kaniselvan, Rylan Schaeffer abd Niloofar Mireshghallah

机构 * Carnegie Mellon University(卡内基梅隆大学) MIT(麻省理工学院) Stanford University(斯坦福大学)

AI总结 本文发现强化学习提升LLM知识回忆能力,原因在于改进了模型对参数化知识层次结构的遍历技能,而非获取新知识。

Comments `

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15373 2026-06-25 eess.SY cs.AI cs.LG cs.SY math.OC nlin.AO 版本更新

Safe Learning Control with Optimality and Stability Guarantees

具有最优性和稳定性保证的安全学习控制

Xinyang Wang, Hongwei Zhang, Shimin Wang, Wei Xiao, Martin Guay

机构 * Shenzhen Key Lab for Advanced Motion Control and Modern Automation Equipments, School of Intelligence Science and Engineering, Harbin Institute of Technology, Shenzhen, Guangdong 518055, China(深圳先进 motion 控制与现代自动化装备重点实验室,智能科学与工程学院,哈尔滨工业大学,深圳,广东 518055,中国) School of Data Science, Lingnan University, Hong Kong(数据科学学院,岭南大学,香港) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电气与电子工程学院,南洋理工大学,新加坡) MIT CSAIL

AI总结 针对非线性系统在高相对度状态约束和未知扰动下的强化学习控制,提出高阶倒数型控制障碍函数处理约束,并通过梯度相似性概念和自适应机制在保证安全的同时提升性能。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23967 2026-06-24 q-bio.NC cond-mat.mtrl-sci cs.AI physics.app-ph 版本更新

Sensing Intelligence as a Trainable Metamaterial Property

感知智能作为可训练的元材料属性

Kyungmi Na, Yifei Li, Xinyi Yang, Bolei Deng

机构 * Daniel Guggenheim School of Aerospace Engineering, Georgia Institute of Technology(德鲁·福金斯航空航天工程学院,佐治亚理工学院) Computer Science and Artificial Intelligence Laboratory, Massachusetts Institute of Technology(计算机科学与人工智能实验室,麻省理工学院)

AI总结 本文提出将感知智能作为可训练的元材料属性,通过可微仿真优化元材料几何结构,使神经网络能够训练其身体进行感知,从而显著提升感知精度或减少电子传感器数量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01558 2026-06-24 cs.CV cs.GR cs.LG eess.IV physics.optics 版本更新

Configurable Holography: Towards Display and Scene Adaptation

可配置全息术:面向显示与场景自适应

Yicheng Zhan, Liang Shi, Wojciech Matusik, Qi Sun, Kaan Akşit

机构 * University College London(伦敦大学学院) Massachusetts Institute of Technology(麻省理工学院) New York University(纽约大学)

AI总结 提出可配置全息框架,通过显式条件化使单一模型适应多种显示-场景参数,无需重新训练,实现与现有方法相当的重建质量并提升速度。

Comments 27 pages, 29 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31201 2026-06-23 cs.CL 版本更新

Point-in-Time Financial RAG with Frozen LLMs and Market-Feedback Adaptive Retrieval

学习信任谁:事件驱动金融RAG中冻结大语言模型的市场反馈自适应检索

Zijie Zhao, Roy E. Welsch

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 针对事件驱动金融RAG,提出通过外部贝叶斯源记忆更新检索层,利用市场反馈自适应选择证据源,在冻结LLM情况下提升预测和投资组合表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31189 2026-06-23 cs.LG 版本更新

FlagGAM: Rule-Basis Generalized Additive Models for Explainable Tabular Prediction

FlagGAM:基于规则的可解释表格预测广义加性模型

Zijie Zhao, Roy E. Welsch

机构 * EECS Department, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院电子工程与计算机科学系) Sloan School of Management, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院斯隆管理学院)

AI总结 提出FlagGAM框架,通过规则定义的基函数分离特征级规则构建与预测,在保持可解释性的同时提升对不完美输入的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14141 2026-06-23 cs.AI 版本更新

Distribution-Aware Algorithm Design with LLM Agents

具有LLM代理的分布感知算法设计

Saharsh Koganti, Priyadarsi Mishra, Pierfrancesco Beneventano, Tomer Galanti

机构 * Texas A&M University(德克萨斯大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文研究了学习可执行求解器代码而非预测器的场景,提出求解器提示抽象,并证明其在正确性和运行时间上的泛化能力,通过LLM代码代理在多个组合优化问题上验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14615 2026-06-23 cs.AI 版本更新

An AI Co-Data-Scientist for Prioritizing Candidate Biomarkers from Wearable Sensor Data

AI协同数据科学家:从可穿戴传感器数据中优先筛选候选生物标志物

Yubin Kim, Salman Rahman, Samuel Schmidgall, Chunjong Park, A. Ali Heydari, Ahmed A. Metwally, Hong Yu, Xin Liu, Xuhai Xu, Yuzhe Yang, Hyeonhoon Lee, Hyewon Jeong, Kyungho Lim, MingYu Lu, Dongjae Lee, Theodora Pappa, Hanseul Cho, Maxwell A. Xu, Zhihan Zhang, Cynthia Breazeal, Tim Althoff, Petar Sirkovic, Ivor Rendulic, Annalisa Pawlosky, Nicolas Stroppa, Juraj Gottweis, Elahe Vedadi, Alan Karthikesalingam, Pushmeet Kohli, Mark Malhotra, Shwetak Patel, Samir Tulebaev, Hae Won Park, Vivek Natarajan, Hamid Palangi, Daniel McDuff

机构 * Google Research(谷歌研究) Massachusetts Institute of Technology(麻省理工学院) Google DeepMind(谷歌DeepMind) Seoul National University Hospital(首尔国立大学医院) Yonsei University College of Medicine(延世大学医学院) University of Washington(华盛顿大学) Korea University Guro Hospital(韩国大学Guro医院) Mass General Brigham(麻省总医院) Brigham and Women’s Hospital(哈佛医学院布莱尔妇女医院) Google Cloud AI(谷歌云AI)

AI总结 提出CoDaS系统,集成多智能体假设生成、统计分析和对抗验证,从可穿戴数据中优先筛选心理健康和代谢终点相关候选生物标志物,经临床验证与专家判断一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20179 2026-06-23 hep-ex cs.AI cs.LG 版本更新

AI Agents Can Already Autonomously Perform Experimental High Energy Physics

AI智能体已能自主执行实验高能物理研究

Eric A. Moreno, Samuel Bright-Thonney, Andrzej Novak, Dolores Garcia, Philip Harris

机构 * Massachusetts Institute of Technology(麻省理工学院) NSF AI Institute for Artificial Intelligence and Fundamental Interactions(国家科学基金会人工智能与基本相互作用研究所) CERN(欧洲核子研究中心)

AI总结 基于大语言模型的AI智能体自主执行高能物理分析全流程,提出JFC框架整合文献检索与多智能体审查,在ALEPH、DELPHI和CMS开放数据上验证,首次由AI自主产生新颖物理结果,旨在减轻技术负担而非取代物理学家。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21478 2026-06-23 cs.CL cs.LG eess.AS 版本更新

TaigiSpeech: A Low-Resource Real-World Speech Intent Dataset and Preliminary Results with Scalable Data Mining In-the-Wild

TaigiSpeech: 一个低资源真实世界语音意图数据集及基于可扩展野外数据挖掘的初步结果

Kai-Wei Chang, Yi-Cheng Lin, Huang-Cheng Chou, Wenze Ren, Yu-Han Huang, Yun-Shao Tsai, Chien-Cheng Chen, Yu Tsao, Yuan-Fu Liao, Shrikanth Narayanan, James Glass, Hung-yi Lee

机构 * Massachusetts Institute of Technology, USA(麻省理工学院) National Taiwan University, Taipei, Taiwan(国立台湾大学) National Taiwan University Artificial Intelligence Center of Research Excellence, Taipei, Taiwan(国立台湾大学人工智能研究中心) Academia Sinica, Taiwan(台湾“中央”研究院) National Yang Ming Chiao Tung University, Taiwan(阳明交通大学) Signal Analysis and Interpretation Laboratory (SAIL), University of Southern California, USA(信号分析与解释实验室(SAIL),南加州大学)

AI总结 针对低资源台语,构建包含21位老年人3000条话语的语音意图数据集,并探索关键词匹配与LLM伪标注、音视频框架两种数据挖掘策略,以解决标注数据稀缺问题。

Comments Interspeech 2026 long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00180 2026-06-23 cs.LG cs.AI 版本更新

NNiT: Width-Agnostic Neural Network Generation with Structurally Aligned Weight Spaces

NNiT:具有结构对齐权重空间的宽度无关神经网络生成

Jiwoo Kim, Swarajh Mehta, Hao-Lun Hsu, Hyunwoo Ryu, Yudong Liu, Miroslav Pajic

机构 * Department of Electrical Computer Engineering, Duke University, NC, USA Department of Computer Science, Duke University, NC, USA Computer Science \& Artificial Intelligence Laboratory, Massachusetts Institute of Technology, MA, USA

AI总结 提出NNiT,通过将权重矩阵分块并建模为局部结构场,实现宽度无关的神经网络参数生成,在ManiSkill3任务上对未见架构拓扑达到>85%成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15136 2026-06-23 stat.ML cs.LG 版本更新

Universal priors: solving empirical Bayes via Bayesian inference and pretraining

通用先验:通过贝叶斯推断和预训练解决经验贝叶斯问题

Nick Cannella, Anzo Teh, Yanjun Han, Yury Polyanskiy

机构 * Courant Institute of Mathematical Sciences, NYU(纽约大学Courant数学科学研究所) Center for Data Science, NYU(纽约大学数据科学中心) Department of EECS, MIT(麻省理工学院电子工程与计算机科学系)

AI总结 本文从理论上证明,在合成数据上预训练的Transformer能通过后验收缩自适应未知测试分布,实现经验贝叶斯问题的近最优遗憾界。

Comments To appear at COLT 2026. 43 pages, 5 figures. Code release at https://github.com/Anzoteh96/eb-transformers

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02056 2026-06-23 cs.AR cs.LG cs.SY eess.SY stat.ML 版本更新

Ultrafast On-Chip Online Learning via Spline Locality in Kolmogorov-Arnold Networks

基于Kolmogorov-Arnold网络中样条局部性的超快片上在线学习

Duc Hoang, Aarush Gupta, Philip Harris

机构 * MIT(麻省理工学院)

AI总结 针对量子计算和核聚变控制等高频系统对亚微秒级在线学习的需求,提出利用Kolmogorov-Arnold网络的B样条局部性实现稀疏更新和固定点量化鲁棒性,在FPGA上实现比MLP更高效、更具表达力的超快在线学习。

Comments Forty-Third International Conference on Machine Learning (ICML'26)

详情

展开后加载摘要…

URL PDF HTML 收藏