arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Massachusetts Institute of Technology(麻省理工学院)

共收录 2219
2603.29871 2026-04-01 cs.AI

ShapE-GRPO: Shapley-Enhanced Reward Allocation for Multi-Candidate LLM Training

ShapE-GRPO:基于多候选LLM训练的Shapley增强奖励分配

Rui Ai, Yu Pan, David Simchi-Levi, Chonghuan Wang

机构 * MIT(麻省理工学院) University of Sydney(悉尼大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

AI总结 针对多候选LLM训练中奖励分配噪声问题,提出ShapE-GRPO方法,通过Shapley值理论分解集级奖励,提升训练效率与收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29224 2026-04-01 cs.LG cs.AI

Derived Fields Preserve Fine-Scale Detail in Budgeted Neural Simulators

导出场在预算神经模拟器中保留细尺度细节

Wenshuo Wang, Fan Zhang

机构 * School of Future Technology, South China University of Technology(华南理工大学未来技术学院) State Key Laboratory of Ocean Sensing & Ocean College, Zhejiang University(浙江大学海洋传感与海洋学院国家重点实验室) Kavli Institute for Astrophysics and Space Research, Massachusetts Institute of Technology(麻省理工学院卡弗里天体物理与空间研究所)

AI总结 本文提出DerivOpt框架,通过优化携带状态的设计,在预算限制下提升神经模拟器的细尺度精度,且在输入阶段即可观察到性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29121 2026-04-01 econ.GN cs.AI cs.CY q-fin.EC

Economics of Human and AI Collaboration: When is Partial Automation More Attractive than Full Automation?

人力与AI协作的经济学:部分自动化何时比完全自动化更具吸引力?

Wensu Li, Atin Aboutorabi, Harry Lyu, Kaizhi Qian, Martin Fleming, Brian C. Goehring, Neil Thompson

机构 * Massachusetts Institute of Technology(麻省理工学院) École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院) IBM Research(IBM研究院) IBM’s Institute for Business Value(IBM商业价值研究院)

AI总结 本文构建了评估任务自动化最优程度的统一框架,通过连续选择而非二元决策,分析企业在AI准确性水平上的成本最小化选择,揭示部分自动化在人力保留任务下的经济优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29005 2026-04-01 cs.RO

Gleanmer: A 6 mW SoC for Real-Time 3D Gaussian Occupancy Mapping

Gleanmer:一种6毫瓦的SoC用于实时3D高斯占用映射

Zih-Sing Fu, Peter Zhi Xuan Li, Sertac Karaman, Vivienne Sze

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 Gleanmer通过算法与硬件协同优化,实现低功耗实时3D高斯占用映射,其在地图构建和查询中分别降低能耗63%和81%。

Comments Accepted to IEEE Symposium on VLSI Technology & Circuits (VLSI), 2026. To appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14565 2026-04-01 cs.RO cs.AI

Masked IRL: LLM-Guided Reward Disambiguation from Demonstrations and Language

掩码逆强化学习:从演示和语言引导的奖励消歧

Minyoung Hwang, Alexandra Forsey-Smerek, Nathaniel Dennler, Andreea Bobu

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

AI总结 本文提出掩码逆强化学习框架,利用大语言模型结合演示和语言信息,提升机器人奖励学习的样本效率和泛化能力。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20114 2026-04-01 stat.ML cs.LG

Extracting Interpretable Models from Tree Ensembles: Computational and Statistical Perspectives

从树集成中提取可解释模型:计算和统计视角

Brian Liu, Rahul Mazumder, Peter Radchenko

机构 * MIT(麻省理工学院) University of Sydney(悉尼大学)

AI总结 本文提出一种提取树集成中简洁决策规则的估计器,通过灵活控制规则数量和交互深度提升准确性,并建立非渐近预测误差界,实验表明其优于现有规则提取算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20363 2026-04-01 nucl-th cs.LG

Global Framework for Emulation of Nuclear Calculations

核计算仿真的全球框架

Antoine Belley, Jose M. Munoz, Ronald F. Garcia Ruiz

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出一种结合微正则多体计算与贝叶斯神经网络的分层框架,用于同时预测同位素链的核性质,并在核图不同区域应用。通过氧同位素链验证,实现了地面态能和电荷半径的准确预测,并提供可靠的不确定性量化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28765 2026-03-31 cs.CL

Adaptive Block-Scaled Data Types

自适应块缩放数据类型

Jack Cook, Hyemin S. Lee, Kathryn Le, Junxian Guo, Giovanni Traverso, Anantha P. Chandrakasan, Song Han

机构 * Massachusetts Institute of Technology(麻省理工学院) NVIDIA(英伟达)

AI总结 本文提出自适应块缩放数据类型,通过动态选择整数和浮点表示以减少量化误差,在4位量化中实现更低的训练损失和更高的任务准确性。

Comments 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28732 2026-03-31 cs.RO cs.CV

Pandora: Articulated 3D Scene Graphs from Egocentric Vision

Pandora: 从第一人称视觉获取拟合3D场景图

Alan Yu, Yun Chang, Christopher Xie, Luca Carlone

机构 * Laboratory for Information and Decision Systems, Massachusetts Institute of Technology(麻省理工学院信息与决策系统实验室) Meta Reality Labs(Meta现实实验室)

AI总结 本文提出Pandora方法,利用人类自然探索场景时的单目数据,恢复拟合物体部件模型,并整合到3D场景图中,提升机器人移动操作能力。

Comments 14 pages, 5 figures. Presented at the 2025 British Machine Vision Conference (BMVC) in Sheffield, UK

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01349 2026-03-31 cs.LG stat.ML

To Augment or Not to Augment? Diagnosing Distributional Symmetry Breaking

增强还是不增强?诊断分布对称性破坏

Hannah Lawrence, Elyssa Hofgard, Vasco Portilheiro, Yuxuan Chen, Tess Smidt, Robin Walters

机构 * MIT(麻省理工学院) University College London(伦敦大学学院) Northeastern University(东北大学)

AI总结 本文提出了一种评估数据集对称性破坏的指标,揭示了点云数据集中的严重偏见问题,并展示了对称性破坏对模型性能的影响。

Comments Published as a conference paper at ICLR 2026. A short version of this paper appeared at the ICLR AI4Mat workshop in April 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13197 2026-03-31 cond-mat.mtrl-sci cs.AI

The Rise of Generative AI for Metal-Organic Framework Design and Synthesis

生成式AI在金属有机框架设计与合成中的崛起

Chenru Duan, Aditya Nandy, Shyam Chand Pal, Xin Yang, Wenhao Gao, Yuanqi Du, Hendrik Kraß, Yeonghun Kang, Varinia Bernales, Zuyang Ye, Tristan Pyle, Ray Yang, Zeqi Gu, Philippe Schwaller, Shengqian Ma, Shijing Sun, Alán Aspuru-Guzik, Seyed Mohamad Moosavi, Robert Wexler, Zhiling Zheng

机构 * Deep Principle, Inc.(Deep Principle公司) University of California, Los Angeles(加州大学洛杉矶分校) Washington University(华盛顿大学) Institute of Materials Science & Engineering, Washington University(华盛顿大学材料科学与工程研究所) Massachusetts Institute of Technology(麻省理工学院) Cornell University(康奈尔大学) University of Toronto(多伦多大学) Vector Institute for Artificial Intelligence(向量人工智能研究所) Acceleration Consortium, University of Toronto(多伦多大学加速联盟) University of Washington(华盛顿大学) University of North Texas(北德克萨斯大学) École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院) Canadian Institute for Advanced Research(加拿大高等研究院) NVIDIA(英伟达)

AI总结 生成式AI推动金属有机框架设计方法革新,通过自主提出并合成新型多孔结构,结合高通量计算筛选和自动化实验,形成加速发现闭环流程,提升清洁空气和能源应用材料性能。

Comments 10 pages, 5 figures

Journal ref Matter (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28052 2026-03-31 cs.AI

Meta-Harness: End-to-End Optimization of Model Harnesses

Meta-Harness:端到端优化模型Harness

Yoonho Lee, Roshen Nair, Qizheng Zhang, Kangwook Lee, Omar Khattab, Chelsea Finn

机构 * Stanford(斯坦福大学) KRAFTON MIT(麻省理工学院)

AI总结 本文提出Meta-Harness,通过自动搜索优化模型Harness代码,提升文本分类、数学推理和编程任务性能,减少上下文token使用量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27832 2026-03-31 cs.CV cs.LG

3-D Representations for Hyperspectral Flame Tomography

三维表示用于超光谱火焰断层扫描

Nicolas Tricard, Zituo Chen, Sili Deng

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文比较了基于体素网格的断层扫描方法与连续神经表示法,展示了体素网格结合全变分正则化在低内存和运行时间下对合成火焰的高精度重建。

Comments 7 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27797 2026-03-31 cs.RO

Which Reconstruction Model Should a Robot Use? Routing Image-to-3D Models for Cost-Aware Robotic Manipulation

机器人应使用哪种重建模型?为成本感知的机器人操作路由图像到3D模型

Akash Anand, Aditya Agarwal, Leslie Pack Kaelbling

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出SCOUT框架,通过分离重建评分的两个组件,为机器人操作选择适合的3D重建模型,支持动态调整和多维成本约束。

Comments 8 pages, 7 tables, 3 figures. Supplementary material included. Project page: https://scout-model-routing.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27773 2026-03-31 cs.CV

RINO: Rotation-Invariant Non-Rigid Correspondences

RINO:旋转不变非刚性对应

Maolin Gao, Shao Jie Hu-Chen, Congyue Deng, Riccardo Marin, Leonidas Guibas, Daniel Cremers

机构 * TUM(慕尼黑工业大学) Stanford University(斯坦福大学) MCML(慕尼黑机器学习中心) MIT(麻省理工学院)

AI总结 本文提出RINO框架,通过旋转不变的特征提取器实现非刚性形状匹配,无需预对齐或手工特征,提升非等距变形等任务的性能。

Comments 17 pages, 36 Figures, Computer Vision and Pattern Recognition (CVPR) 2026

Journal ref Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23562 2026-03-31 cs.LG cs.AI

Synthetic Mixed Training: Scaling Parametric Knowledge Acquisition Beyond RAG

合成混合训练:在RAG之上扩展参数化知识获取

Seungju Han, Konwoo Kim, Chanwoo Park, Benjamin Newman, Suhas Kotha, Jaehun Jung, James Zou, Yejin Choi

机构 * Stanford University(斯坦福大学) MIT(麻省理工学院) University of Washington(华盛顿大学)

AI总结 本文提出合成混合训练方法,结合合成问答和文档,通过互补训练信号提升模型性能,在QuaLITY基准上实现4.4%的相对提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22808 2026-03-31 cs.CR cs.LG

Combinatorial Privacy: Private Multi-Party Bitstream Grand Sum by Hiding in Birkhoff Polytopes

组合隐私:通过隐藏在Birkhoff多面体中实现私人的多客户端位流总和

Praneeth Vepakomma

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Massachusetts Institute of Technology (MIT)(麻省理工学院)

AI总结 PolyVeil通过将私有位编码为Birkhoff多面体中的排列矩阵,实现k个客户端的隐私布尔求和,其双层架构提供完美安全性,但完整与压缩变体在隐私保证与低维性间存在根本矛盾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22300 2026-03-31 cs.LG cs.AI

Scaling Attention via Feature Sparsity

通过特征稀疏性扩展注意力机制

Yan Xie, Tiansheng Wen, Tangda Huang, Bo Chen, Chenyu You, Stefanie Jegelka, Yifei Wang

机构 * School of Electronic Engineering, Xidian University(西安电子科技大学电子工程学院) Stony Brook University(石溪大学) TUM(慕尼黑工业大学) MIT(麻省理工学院) Amazon AGI SF Lab(亚马逊AGI旧金山实验室)

AI总结 本文提出Sparse Feature Attention (SFA),通过特征稀疏性降低注意力计算成本,提升处理超长上下文的能力,实验表明其在速度和资源消耗上优于现有方法。

Comments 26 pages, 11 figures; Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10127 2026-03-31 cs.LG

Meet Me at the Arm: The Cooperative Multi-Armed Bandits Problem with Shareable Arms

在臂上见我:具有可共享臂的协同多臂老虎机问题

Xinyi Hu, Aldo Pacchiano

机构 * Boston University(波士顿大学) Broad Institute of MIT and Harvard(布罗德研究所)

AI总结 本文研究了在无感知设置下多玩家多臂老虎机问题,提出A-CAPELLA算法,通过协议驱动协调实现对容量的感知,达到对数遗憾水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.00839 2026-03-31 cs.LG q-fin.RM stat.ML

Algorithmic Insurance

算法保险

Dimitris Bertsimas, Agni Orfanoudaki

机构 * Sloan School of Management, Massachusetts Institute of Technology(麻省理工学院斯隆管理学院) Saïd Business School, Oxford University(牛津大学赛德商学院)

AI总结 研究算法保险在AI致损中的风险定价与责任框架,提出基于CVaR的分类阈值优化方法,通过乳腺癌案例验证降低尾部风险并提升保险收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27448 2026-03-31 cs.LG cs.AI cs.CE

GIFT: Bootstrapping Image-to-CAD Program Synthesis via Geometric Feedback

GIFT: 通过几何反馈提升图像到CAD程序合成

Giorgio Giannone, Anna Clare Doris, Amin Heyrani Nobari, Kai Xu, Akash Srivastava, Faez Ahmed

机构 * DeCoDE Lab, MIT(麻省理工学院DeCoDE实验室) Core AI, IBM(IBM核心人工智能) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

AI总结 本文提出GIFT框架,通过几何反馈生成高质量训练样本,提升CAD程序生成的鲁棒性,无需额外标注。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27414 2026-03-31 math.ST cs.AI stat.TH

Multiple-Prediction-Powered Inference

多预测驱动推断

Charlie Cowen-Breen, Alekh Agarwal, Stephen Bates, William W. Cohen, Jacob Eisenstein, Amir Globerson, Adam Fisch

机构 * Massachusetts Institute of Technology(麻省理工学院) Google Research(谷歌研究院) Google DeepMind(谷歌DeepMind)

AI总结 本文提出多预测驱动推断框架,通过优化分配资源于不同数据源,实现统计高效估计。理论证明其最小最大最优性、有限样本性能和渐近正态性,并在三个大语言模型评估场景中验证了其优于现有基线的估计误差。

Comments ICLR 2026, 45 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27410 2026-03-31 q-bio.NC cs.AI cs.CV

Grounding Social Perception in Intuitive Physics

将社会感知 grounded 在直观物理学中

Lance Ying, Aydan Y. Huang, Aviv Netanyahu, Andrei Barbu, Boris Katz, Joshua B. Tenenbaum, Tianmin Shu

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学) Johns Hopkins University(约翰霍普金斯大学) Amazon(亚马逊)

AI总结 本文提出通过结合直观心理学与直观物理学的推理过程来解释社会感知,通过PHASE数据集和SIMPLE模型验证了物理基础的社会推理能力。

Comments 26 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27116 2026-03-31 cs.AI cs.IR cs.NE

The Price of Meaning: Why Every Semantic Memory System Forgets

意义的代价:为何每一个语义记忆系统都会遗忘

Sambartha Ray Barman, Andrey Starenky, Sofia Bodnar, Nikhil Narasimhan, Ashwin Gopinath

机构 * Sentra Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文研究了语义记忆系统中意义与遗忘的权衡,证明了语义连续核阈值记忆系统中干扰和遗忘不可避免,通过四个结果揭示了语义表示的有效秩、局部维度、记忆增长对保留的影响以及联想诱饵的虚假回忆无法消除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27070 2026-03-31 cs.CV

Structural Graph Probing of Vision-Language Models

视觉-语言模型的结构图谱探查

Haoyu He, Yue Zhuo, Yu Zheng, Qi R. Wang

机构 * Northeastern University(东北大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 研究通过神经拓扑分析视觉-语言模型的层间相关图谱,揭示群体结构对行为的意义、跨模态变化及因果影响,提出神经拓扑作为解释性中间尺度。

Comments IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27062 2026-03-31 cs.LG stat.ML

Conformalized Signal Temporal Logic Inference under Covariate Shift

符合性信号时间逻辑推理在协变量偏移下的应用

Yixuan Wang, Danyang Li, Matthew Cleaveland, Roberto Tron, Mingyu Cai

机构 * University of California, Riverside(加州大学河滨分校) Boston University(波士顿大学) MIT Lincoln Laboratory(麻省理工学院林肯实验室)

AI总结 本文提出一种符合性STL推理框架,解决训练与部署数据集间的协变量偏移问题,通过模板无关的可微STL推理方法和有限部署数据集优化,提升部署时的符号学习可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26993 2026-03-31 cs.MA cs.LG math.OC stat.ML

On the Reliability Limits of LLM-Based Multi-Agent Planning

基于大语言模型的多智能体规划的可靠性极限

Ruicheng Ao, Siyang Gao, David Simchi-Levi

机构 * MIT(麻省理工学院)

AI总结 本文研究了基于大语言模型的多智能体规划的可靠性极限,通过建模为有限无环决策网络,展示了在无新外部信号时,分布式网络在决策理论上被集中贝叶斯决策者主导,并分析了通信和信息压缩带来的损失。

Comments Technical note

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11321 2026-03-31 cs.RO

ExtremControl: Low-Latency Humanoid Teleoperation with Direct Extremity Control

ExtremControl:低延迟的人形机器人远程操控与直接末端控制

Ziyan Xiong, Lixing Fang, Junyun Huang, Kashu Yamazaki, Hao Zhang, Chuang Gan

机构 * UMass Amherst(马萨诸塞大学阿默斯特分校) Carnegie Mellon University(卡内基梅隆大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

AI总结 本文提出ExtremControl框架,通过直接操作SE(3)姿态、Cartesian空间映射和速度前馈控制,实现低延迟的人形机器人远程操控,实验表明其在模拟和现实环境中均优于传统方法。

Comments Project website: https://extremcontrol.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12378 2026-03-31 cs.CV

M4Human: A Large-Scale Multimodal mmWave Radar Benchmark for Human Mesh Reconstruction

M4Human: 一种大规模多模态毫米波雷达基准用于人体网格重建

Junqiao Fan, Yunjiao Zhou, Yizhuo Yang, Xinyuan Cui, Jiarui Zhang, Lihua Xie, Jianfei Yang, Chris Xiaoxuan Lu, Fangqiang Ding

机构 * NTU(南洋理工大学) University of Edinburgh(爱丁堡大学) UPenn(宾夕法尼亚大学) UCL(伦敦大学学院) MIT(麻省理工学院)

AI总结 本文提出M4Human,首个大规模多模态毫米波雷达基准,提供高分辨率雷达、RGB和深度数据,用于解决传统视觉传感的遮挡、光照和隐私问题,推动人体建模研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19467 2026-03-31 cs.CL cs.AI

BRIDGE: Benchmarking Large Language Models for Understanding Real-world Clinical Practice Text

BRIDGE:用于评估大语言模型理解现实世界临床实践文本的基准测试

Jiageng Wu, Bowen Gu, Ren Zhou, Kevin Xie, Doug Snyder, Yixing Jiang, Valentina Carducci, Richard Wyss, Rishi J Desai, Emily Alsentzer, Leo Anthony Celi, Adam Rodman, Sebastian Schneeweiss, Jonathan H. Chen, Santiago Romero-Brufau, Kueiyu Joshua Lin, Jie Yang

机构 * Brigham and Women's Hospital(布莱根妇女医院) Harvard Medical School(哈佛医学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Massachusetts Institute of Technology(麻省理工学院) Mayo Clinic(梅奥诊所) Harvard T.H. Chan School of Public Health(哈佛大学陈曾熙公共卫生学院) Harvard University(哈佛大学) Stanford University(斯坦福大学) Beth Israel Deaconess Medical Center(贝斯以色列女执事医疗中心) Kempner Institute for the Study of Natural and Artificial Intelligence(肯普纳自然与人工智能研究所) Broad Institute of MIT and Harvard(博德研究所) Harvard Data Science Initiative(哈佛数据科学计划)

AI总结 本文提出BRIDGE基准测试,涵盖9种语言的87项任务,涵盖患者护理全过程的六个临床阶段和20种应用,评估95种LLM在不同推理策略下的性能差异,展示开源模型与专业模型的性能对比。

详情

展开后加载摘要…

URL PDF HTML 收藏