arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Massachusetts Institute of Technology(麻省理工学院)

共收录 2206
2510.02524 2026-06-12 cs.CL cs.FL cs.LG 版本更新

Unraveling Syntax: Language Modeling and the Substructure of Grammars

解析句法:语言建模与语法的子结构

Laura Ying Schulz, Daniel Mitropolsky, Tomaso Poggio

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文研究语言模型在上下文无关语法子结构上的学习行为,证明损失函数在顶层子语法上线性递归,并发现参数化模型并行学习子语法,子语法预训练能提升小模型性能并改善内部表征。

Comments Equal contribution by LYS and DM. Accepted to the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16380 2026-06-12 cs.CL cs.AI cs.CY cs.HC cs.LG 版本更新

MoReBench: Evaluating Procedural and Pluralistic Moral Reasoning in Language Models, More than Outcomes

MoReBench:评估语言模型中的程序性和多元道德推理,超越结果

Yu Ying Chiu, Michael S. Lee, Rachel Calcott, Brandon Handoko, Paul de Font-Reaulx, Raphaël Millière, Paula Rodriguez, Chen Bo Calvin Zhang, Ziwen Han, Udari Madhushani Sehwag, Yash Maurya, Christina Q Knight, Harry R. Lloyd, Florence Bacus, Conor Downey, Mantas Mazeika, Bing Liu, Yejin Choi, Mitchell L Gordon, Sydney Levine

机构 * University of Washington(华盛顿大学) New York University(纽约大学) Scale AI Harvard University(哈佛大学) University of Michigan(密歇根大学) UNC Chapel Hill(北卡罗来纳大学教堂山分校) Center for AI Safety(人工智能安全中心) Stanford University(斯坦福大学) MIT(麻省理工学院) University of Oxford(牛津大学)

AI总结 提出MoReBench基准,包含1000个道德场景和超过2.3万条标准,用于评估语言模型在道德推理中的程序性推理能力,发现现有基准无法预测模型表现,且模型对特定道德框架存在偏好。

Comments 46 pages, 8 figures, 10 tables. Published in ICLR 2026. Accepted at CHAI workshop and SPP 2026 (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08610 2026-06-12 cs.GT cs.AI cs.CY 版本更新

Competition and Diversity in Generative AI

生成式人工智能中的竞争与多样性

Manish Raghavan

机构 * MIT Sloan School of Management & Department of Electrical Engineering and Computer Science(麻省理工学院斯隆管理学院及电气工程与计算机科学系)

AI总结 通过博弈论模型和Scattergories游戏实验,研究竞争如何促使生成式AI模型多样化,缓解同质化,并提升社会福利。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12407 2026-06-11 cs.CV 新提交

How Seemingly Inconsequential Design Choices Dictate Performance of LLMs in Pathology

看似无关紧要的设计选择如何决定病理学中LLM的性能

Kian R. Weihrauch, Thomas A. Buckley, William Lotter, Arjun K. Manrai

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard Medical School(哈佛医学院) Dana-Farber Cancer Institute(丹娜-法伯癌症研究所)

AI总结 通过系统因子分析发现,调整补丁大小、放大倍数等输入配置可使通用大语言模型在病理切片任务上性能大幅提升,缩小与专用模型的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12365 2026-06-11 cs.RO cs.AI 新提交

Ambient Diffusion Policy: Imitation Learning from Suboptimal Data in Robotics

环境扩散策略:从次优数据中进行机器人模仿学习

Adam Wei, Nicholas Pfaff, Thomas Cohn, Arif Kerem Dayı, Constantinos Daskalakis, Giannis Daras, Russ Tedrake

机构 * MIT(麻省理工学院)

AI总结 提出环境扩散策略,通过噪声依赖的数据使用从次优数据中提取有用特征,在六项任务上优于现有方法,最高提升33%。

Comments 14 pages (main body), 52 pages total. Project website: https://ambient-diffusion-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12279 2026-06-11 cs.NE cs.AI cs.LG 新提交

Mathematical perspective on genetic algorithms with optimization guided operators

遗传算法与优化引导算子的数学视角

Anna Brandenberger, Ilan Doron-Arad, Elchanan Mossel

机构 * Department of Mathematics, MIT(麻省理工学院数学系)

AI总结 本文从数学角度建模遗传算法,将优化问题转化为查询复杂度问题,并证明某些问题必须依赖生成、变异和重组算子,同时揭示了多样性在解池中的关键作用。

Comments 18 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11702 2026-06-11 cs.CV cs.AI cs.CL 新提交

MedCTA: A Benchmark for Clinical Tool Agents

MedCTA: 临床工具智能体基准

Tajamul Ashraf, Hyewon Jeong, Fida Mohammad Thoker, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) Massachusetts Institute of Technology (MIT)(麻省理工学院)

AI总结 提出MedCTA基准,基于放射影像、病理切片和报告等真实临床多模态输入,评估医疗AI智能体在工具检索、证据获取和集成方面的规划与执行能力。

Comments Project Page: https://ivul-kaust.github.io/MedCTA/ Code: https://github.com/IVUL-KAUST/MedCTA Data: https://huggingface.co/datasets/IVUL-KAUST/MedCTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11437 2026-06-11 cs.DS cs.AI cs.LG stat.ML 新提交

The Power of Test-Time Training for Approximate Sampling

测试时训练对近似采样的威力

Noah Golowich, Ankur Moitra, Dhruv Rohatgi

机构 * Microsoft Research NYC(微软研究院纽约分校) MIT(麻省理工学院)

AI总结 本文形式化测试时训练(TTT)为从已知分布类中采样的问题,证明查询复杂度的二次下界,并展示在分布类大小受限时可规避该下界,为TTT提供理论框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11386 2026-06-11 cs.CL cs.AI eess.AS 新提交

Overcoming State Inertia in Full-Duplex Spoken Language Models via Activation Steering

通过激活引导克服全双工口语语言模型中的状态惯性

Cheng-Kuang Chang, Kai-Wei Chang, Alexander H. Liu, James Glass

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

AI总结 针对全双工口语模型在用户打断时响应延迟的问题,提出基于感知向量的激活引导方法,无需微调即可显著提升中断理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11217 2026-06-11 cs.CY cs.AI cs.HC 新提交

Preregistration for Experiments with AI Agents

AI智能体实验的预注册

Michelle Vaccaro

机构 * MIT(麻省理工学院)

AI总结 针对AI智能体实验中的方法论漏洞,提出将预注册实践扩展至该领域,并设计专用模板以提升研究可信度。

Comments Accepted at ICML 2026 as a Spotlight (Top 5%) Position Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11415 2026-06-11 q-bio.NC cs.LG physics.data-an q-bio.QM 新提交

Spatially Masked Regression Reveals Local and Distributed Predictability in Electrophysiological Recordings

空间掩蔽回归揭示电生理记录中的局部和分布式可预测性

Maryam Ostadsharif Memar, Nima Dehghani

机构 * Department of Electrical and Computer Engineering, IUT(电气与计算机工程系) McGovern Institute for Brain Research, Massachusetts Institute of Technology (MIT)(脑科学研究所,麻省理工学院(MIT))

AI总结 提出空间掩蔽回归(SMR)框架,通过逐步增大掩蔽区域量化电极信号中局部与分布式信息的贡献,应用于颅内和头皮脑电数据,发现邻近电极贡献显著但非全部,表明信号同时包含局部冗余和全局结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10959 2026-06-11 econ.EM cs.LG math.ST stat.AP stat.ME stat.ML stat.TH 版本更新

Program Evaluation with Remotely Sensed Outcomes

利用遥感结果的程序评估

Ashesh Rambachan, Rahul Singh, Davide Viviano

机构 * MIT(麻省理工学院) Harvard(哈佛大学)

AI总结 本文研究了在实验和准实验中,由于遥感变量不完全测量经济结果而引起的因果推断问题,提出了一种非参数识别因果参数的方法,结合实验和观测数据进行n^{-1/2}推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21396 2026-06-11 cs.LG 版本更新

Mechanisms of Introspective Awareness

内省意识的机制

Uzay Macar, Li Yang, Atticus Wang, Peter Wallich, Emmanuel Ameisen, Jack Lindsey

机构 * Anthropic Fellows Program(Anthropic Fellow项目) MIT(麻省理工学院) Constellation Anthropic

AI总结 研究揭示了大语言模型在检测注入的转向向量时的内省意识机制,发现其行为稳健且源于训练后阶段,通过两阶段电路实现,且在不同层间机制存在差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12655 2026-06-11 cs.AI cs.MA 版本更新

Robust Instruction Compliance in Cooperative Multi-Agent Reinforcement Learning

鲁棒的指令遵从:合作多智能体强化学习

Wo Wei Lin, Ethan Rathbun, Enrico Marchesini, Xiang Zhi Tan

机构 * Department of Computer Sciences, Northeastern University(东北大学计算机科学系) Department of Computer Sciences, Massachusetts Institute of Technology(麻省理工学院计算机科学系)

AI总结 针对外部指令中断行为并冲突长期目标的问题,提出宏动作值修正方法(MAVIC),通过修正指令边界的Bellman备份实现一致值估计,在复杂合作环境中保持高指令遵从和基础任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14762 2026-06-11 math.OC cs.LG cs.SY eess.SY 版本更新

Online Learning for Supervisory Switching Control

在线学习用于监督切换控制

Haoyuan Sun, Ali Jadbabaie

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 研究在线学习在部分观测线性动态系统中监督切换控制的问题,提出非渐近分析方法,结合多臂老虎机算法,实现稳定控制器识别与系统辨识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13854 2026-06-11 cs.LO cs.AI cs.SC 版本更新

Power Term Polynomial Algebra for Boolean Logic

布尔逻辑的幂项多项式代数

Emanuele Sansone, Armando Solar-Lezama

机构 * CSAIL, MIT(MIT计算机科学与人工智能实验室) ESAT, KU Leuven(比利时鲁文大学ESAT研究所) KU Leuven(鲁文大学)

AI总结 提出幂项多项式代数,一种介于CNF和ANF之间的布尔公式表示语言,通过幂项和多项式直接编码CNF子句与单项式族,避免辅助变量和约束,支持代数运算与重写规则。

Comments Pragmatics of SAT

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19463 2026-06-11 cs.RO 版本更新

CU-Multi: A Dataset for Multi-Robot Collaborative Perception

CU-Multi:多机器人协同感知数据集

Doncey Albin, Daniel McGann, Miles Mena, Annika Thomas, Harel Biggie, Xuefei Sun, Steve McGuire, Jonathan P. How, Christoffer Heckman

机构 * Autonomous Robotics and Perception Group at the University of Colorado Boulder(科罗拉多大学波尔得分校自主机器人与感知组) Robot Perception Lab at Carnegie Mellon University(卡内基梅隆大学机器人感知实验室) Aerospace Controls Laboratory at Massachusetts Institute of Technology(麻省理工学院航空航天控制实验室) Computer Science and Artificial Intelligence Laboratory at Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室) Human-Aware Robotic Exploration Lab at University of California Santa Cruz(加州大学圣克ruz分校人感知机器人探索实验室)

AI总结 针对多机器人协同感知基准测试缺乏专用数据集的问题,提出CU-Multi数据集,包含多天采集的同步多机器人轨迹、RGB-D、RTK GPS、语义LiDAR及精确里程计,支持可重复评估。

Comments 8 pages, 11 figures. arXiv admin note: text overlap with arXiv:2505.17576

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10832 2026-06-10 cs.RO 新提交

GUIDE: Goal-Initialized Directional Understanding for End-to-End Visual Navigation

GUIDE: 目标初始化的定向理解用于端到端视觉导航

Liang Wang, Jin Jin, KanZhong Yao, YiBin Wu, Fangqiang Ding, Jin Wang, Jun Wu, Zhe Sun, Qiuguo Zhu

机构 * Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制科学与工程学院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院(TeleAI)) Oxford Robotics Institute, University of Oxford(牛津大学牛津机器人研究所) Center for Robotics, University of Bonn(波恩大学机器人中心) Department of Mechanical Engineering, Massachusetts Institute of Technology(麻省理工学院机械工程系)

AI总结 提出GUIDE框架,通过空间锚点预测器利用多频率本体感受历史提取自运动表示,结合深度流感知局部几何,实现无需后续目标更新的端到端四足机器人导航。

Comments https://guide-navigation.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10579 2026-06-10 cs.RO cs.SY eess.SY 新提交

LieIPM: Lie Group Interior Point Method for Direct Trajectory Optimization of Rigid Bodies

LieIPM:用于刚体直接轨迹优化的李群内点法

Sangli Teng, Ruiqi Zhang, Tzu-Yuan Lin, William A Clark, Mark Mueller, Ram Vasudevan, Maani Ghaffari, Koushil Sreenath

机构 * University of California, Berkeley(加州大学伯克利分校) MIT(麻省理工学院) Ohio University(俄亥俄大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

AI总结 提出一种基于李群结构的约束轨迹优化框架LieIPM,利用二阶刚体模型和变分积分器,实现无奇异、快速收敛的牛顿型更新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10364 2026-06-10 cs.CV 新提交

Benchmarking stereo reconstruction for 3D printable Martian terrain models

用于3D打印火星地形模型的立体重建基准测试

Josephine Wang

机构 * MIT Cambridge, MA, USA(麻省理工学院,马萨诸塞州剑桥,美国)

AI总结 针对火星图像低纹理、不规则和部分观测的特点,评估从NASA好奇号图像估计立体深度、补全几何并导出可打印网格的流程,发现基准精度不直接迁移到火星地形重建,几何补全存在局部保真度与全局连通性的权衡。

Comments 9 pages, 7 figures, CVPR End-to-End 3D Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10087 2026-06-10 cs.CL cs.LG 新提交

CodeAlchemy: Synthetic Code Rewriting at Scale

CodeAlchemy:大规模合成代码重写

Ankit Gupta, Aditya Prasad, Rameswar Panda

机构 * MIT-IBM Watson AI Lab, IBM Research(MIT-IBM沃森人工智能实验室,IBM研究院)

AI总结 提出CodeAlchemy框架,通过5种策略生成超过500B token的合成代码数据,引入DevEval和TraceEval基准,3B模型在多项任务上超越10倍大小的前沿模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09936 2026-06-10 cs.LG cs.AI 新提交

One Lens, Many Worlds : A Capability-Typed Interface for World-Model Interpretability

一个镜头,多个世界:面向世界模型可解释性的能力类型接口

Bhavith Chandra Challagundla, Sanskar Pandey, Param Thakkar, Rishikesh Mallagundla, Yugandhar Reddy Gogireddy, Wenhao Lu, Hindol Roy Choudhury, Shravani Challagundla, Mohamed Deraz Nasr, Spursh Deshpande

机构 * New York University(纽约大学) Independent Researcher(独立研究者) Veermata Jijabai Technological Institute(韦尔玛塔·吉贾拜技术学院) Mercity University of Southern California(南加州大学) Independent Researcher, MIT(麻省理工学院独立研究者) Independent Researcher, GITAM(GITAM独立研究者) Georgia Institute of Technology(佐治亚理工学院)

AI总结 提出WorldModelLens,通过能力类型适配器统一不同世界模型(如PlaNet、IRIS、I-JEPA)的可解释性分析,避免重复实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09809 2026-06-10 cs.AI 版本更新

Evaluation Cards: An Interpretive Layer for AI Evaluation Reporting

评估卡:AI评估报告的解释层

Avijit Ghosh, Anka Reuel, Jenny Chim, Wm. Matthew Kennedy, Srishti Yadav, Jennifer Mickel, Yanan Long, Andrew Tran, Anastassia Kornilova, Damian Stachura, Kevin Klyman, Felix Friedrich, Jeba Sania, Jan Batzner, Anoop Mishra, Eliya Habba, Yixiong Hao, Nathan Heath, Shalaleh Rismani, Usman Gohar, Andrea Loehr, David Manheim, Ruchira Dhar, Sree Harsha Nelaturu, Aarush Sinha, Leshem Choshen, Drishti Sharma, Ishan Khire, Amit Saha, Subramanyam Sahoo, Michael Hardy, Michael Alexander Riegler, Kabir Manghnani, Michelle Lin, Yanan Jiang, Yilin Huang, Asaf Yehudai, Jessica Ji, Aris Hofmann, Mubashara Akhtar, Max Lamparth, Nuno Moniz, Yacine Jernite, Stella Biderman, Zeerak Talat, Sanmi Koyejo, Mykel Kochenderfer, Irene Solaiman

机构 * Hugging Face Stanford University(斯坦福大学) Queen Mary University of London(伦敦玛丽女王大学) University of Copenhagen(哥本哈根大学) Trustible EleutherAI TU Darmstadt(达姆施塔特工业大学) Weizenbaum Institute & Technical University of Munich(魏森鲍姆研究所与慕尼黑工业大学) Harvard University(哈佛大学) The Hebrew University of Jerusalem(耶路撒冷希伯来大学) Iowa State University(爱荷华州立大学) IBM Research(IBM研究院) University of Chicago(芝加哥大学) Independent(独立) Berkeley AI Safety Institute (BASIS)(伯克利人工智能安全研究所) Simula University of Edinburgh(爱丁堡大学) ETH Zurich & ETH AI Center(苏黎世联邦理工学院与ETH AI中心) Oxford Internet Institute(牛津互联网研究所) Amherst College(阿默斯特学院) University of Nebraska(内布拉斯加大学) Syntony Research McGill University(麦吉尔大学) Evals Consensus Israel Institute of Technology(以色列理工学院) IOL.Learn & Zuse Institute Berlin(IOL.Learn与柏林祖泽研究所) Georgia Institute of Technology(佐治亚理工学院) Quebec AI Institute, Université de Montréal(魁北克人工智能研究所,蒙特利尔大学) University of Notre Dame(圣母大学) Georgetown University(乔治城大学) DHBW Stuttgart(斯图加特双元制大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 针对AI评估报告不一致的问题,提出EvalCards作为统一记录层,通过结构化模式、四种解释信号和监控工具,覆盖5816个模型和635个基准,揭示报告实践中的系统性差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05399 2026-06-10 cs.CV 版本更新

UniPixie: Unified and Probabilistic 3D Physics Learning via Flow Matching

UniPixie: 基于流匹配的统一概率三维物理学习

Qilin Huang, Quynh Anh Huynh, Long Le, Chen Wang, Chuhao Chen, Ryan Lucas, Eric Eaton, Lingjie Liu

机构 * University of Pennsylvania(宾夕法尼亚大学) Southern University of Science and Technology(南方科技大学) MIT(麻省理工学院)

AI总结 提出UniPixie框架,通过流匹配学习从单张视觉输入到连续可控材料属性分布的映射,实现多样物理场生成并降低杨氏模量预测误差超50%。

Comments Published at CVPR 2026 as a Highlight. Project page: https://unipixie.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04212 2026-06-10 cs.LG stat.ML 版本更新

Edge of Stability Selectively Shapes Learning Across the Data Distribution

稳定性边缘选择性地塑造数据分布上的学习

Shauna Kwag, Anakha Ganesh, Tomaso Poggio, Pierfrancesco Beneventano

机构 * MIT(麻省理工学院)

AI总结 本文发现优化中的稳定性边缘(EoS)具有选择性,通过分支干预因果证明了EoS在训练数据子集间重新分配学习,并识别了受益组需满足的两个条件:梯度与Hessian主特征向量对齐,以及梯度幅度持续非零。

Comments ICML HiLD 2026; 27 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25371 2026-06-10 cs.RO 版本更新

FOUND-IT: Foundation-model-first Task-driven 3D Scene Graphs with Granularity on Demand

FOUND-IT: 基于基础模型优先、按需粒度的任务驱动3D场景图

Dominic Maggio, Nicolas Gorlo, Kris Hauser, Luca Carlone

机构 * Laboratory for Information & Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院) Samsung Research America(三星美国研究院)

AI总结 提出首个基于未标定单目相机实时构建任意室内外环境分层任务驱动3D场景图的方法,通过几何基础模型和可调整粒度支持动态任务,并在ASHiTA SG3D基准上提升79%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12966 2026-06-10 cs.CL cs.SE 版本更新

ProbeLLM: Automating Principled Diagnosis of LLM Failures

ProbeLLM:自动化的大语言模型故障原则性诊断

Yue Huang, Zhengzhe Jiang, Yuchen Ma, Yu Jiang, Xiangqi Wang, Yujun Zhou, Yuexing Hao, Kehan Guo, Pin-Yu Chen, Stefan Feuerriegel, Xiangliang Zhang

机构 * University of Notre Dame(诺丁汉大学) LMU Munich(慕尼黑大学) Massachusetts Institute of Technology(麻省理工学院) IBM Research(IBM研究院)

AI总结 提出ProbeLLM框架,通过分层蒙特卡洛树搜索在全局探索与局部细化间分配预算,结合工具增强生成与验证,将故障发现从孤立案例提升为结构化故障模式,揭示更广泛、清晰、细粒度的故障景观。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12486 2026-06-10 cs.LG cs.CL

The Journey Matters: Average Parameter Count over Pre-training Unifies Sparse and Dense Scaling Laws

训练过程至关重要:平均预训练参数计数统一了稀疏和密集的扩展规律

Tian Jin, Ahmed Imtiaz Humayun, Utku Evci, Suvinay Subramanian, Amir Yazdanbakhsh, Dan Alistarh, Gintare Karolina Dziugaite

机构 * MIT CSAIL(MIT 计算科学与人工智能实验室) Rice University(稻大学) Google Research(谷歌研究) Google DeepMind(谷歌DeepMind) Google(谷歌) IST Austria(奥地利科学院)

AI总结 本文通过研究80种不同的剪枝计划,发现预训练过程中在25%和75%的计算量启动和结束剪枝可获得最佳评估损失,提出新的扩展规律统一了稀疏和密集预训练的扩展规律。

Comments 17 pages

Journal ref The Thirteenth International Conference on Learning Representations (ICLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16758 2026-06-10 physics.med-ph cs.CV 版本更新

Training Set Augmentation and Biology-Aware Harmonization Improve Radiomic Models for Lung Cancer Prediction in Indeterminate Nodules

训练集增强与生物学感知的谐波化改善不确定肺结节中肺癌预测的影像组学模型

Claire Huchthausen, Menglin Shi, Gabriel L. A. de Sousa, James Larner, Einsley Janowski, Jonathan Colen, Krishni Wijesooriya

机构 * Department of Radiation Oncology, University of Virginia School of Medicine(弗吉尼亚大学医学院放射肿瘤学系) Department of Physics, University of Virginia(弗吉尼亚大学物理系) Department of Physics, Massachusetts Institute of Technology(麻省理工学院物理系) Department of Biomedical Engineering, Northwestern University(西北大学生物医学工程系) Department of Radiation Oncology, University of Virginia(弗吉尼亚大学放射肿瘤学系) Old Dominion University(旧 Dominion 大学)

AI总结 针对早期肺结节恶性率低和图像采集差异问题,通过加入后期结节扩充训练集,并采用生物学感知的谐波化方法校正采集效应,显著提升了影像组学模型的预测性能(ROC-AUC 0.74)。

Comments 22 pages, 5 figures, plus supplemental material; updated with the accepted version of the manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04680 2026-06-10 cs.CL cs.AI cs.LG

The Cost of Down-Scaling Language Models: Fact Recall Deteriorates before In-Context Learning

大语言模型降维的成本:事实回忆在内省学习之前恶化

Tian Jin, Nolan Clement, Xin Dong, Vaishnavh Nagarajan, Michael Carbin, Jonathan Ragan-Kelley, Gintare Karolina Dziugaite

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) MIT Harvard University(麻省理工学院哈佛大学) Google Research(谷歌研究) Google DeepMind(谷歌DeepMind)

AI总结 研究探讨了大语言模型参数数量缩放对核心能力的影响,发现模型规模缩减会显著降低事实回忆能力,但对内省信息处理影响较小。

Journal ref The Twelfth International Conference on Learning Representations (ICLR), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏