Comments34 pages. Major reconstruction and retitling of the withdrawn previous version. The incorrect non-completability theorem and all dependent claims have been removed. The present version replaces the earlier operator-first development with an analysis of neural-architecture individuation and architecture under composition. Submitted to JMLR
机构
*
Department of Mechanical Engineering, University of Michigan, Ann Arbor, Michigan, USA(机械工程系,密歇根大学,安阿伯,密歇根州,美国)
;
Max-Planck-Institute for Sustainable Materials, Materials Informatics, Düsseldorf, Germany(可持续材料研究所,材料信息学,杜塞尔多夫,德国)
;
Mechanical Engineering, University of Michigan, Ann Arbor, Michigan, USA(机械工程,密歇根大学,安阿伯,密歇根州,美国)
机构
*
School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院)
;
Department of Civil and Environmental Engineering, University of Michigan(密歇根大学土木与环境工程系)
机构
*
University of Oklahoma(俄克拉荷马大学)
;
Imperial College London(伦敦帝国学院)
;
University of Michigan(密歇根大学)
;
Tencent(腾讯)
;
University of Edinburgh(爱丁堡大学)
;
University of Southern California(南加州大学)
;
Beijing Normal University(北京师范大学)
;
Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院)
Skill-RAG: Failure-State-Aware Retrieval Augmentation via Hidden-State Probing and Skill Routing
Skill-RAG: 通过隐藏状态探测与技能路由实现故障状态感知的检索增强
Kai Wei, Raymond Li, Xi Zhu, Zhaoqian Xue, Jiaojiao Han, Jingcheng Niu, Fan Yang
机构
*
University of Michigan(密歇根大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Rutgers University(罗格斯大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
New Jersey Institute of Technology(新泽西理工学院)
;
TU Darmstadt(图腾斯大学)
;
Wake Forest University(威克森林大学)
机构
*
Trustworthy Autonomous Systems Laboratory at the University of California, Riverside(加州大学河滨分校可信自主系统实验室)
;
University of Michigan(密歇根大学)
;
Workday
;
University of Southern California(南加州大学)
;
Texas A&M University(德克萨斯A&M大学)
;
Lehigh University(莱斯大学)
When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation
当AI基准测试达到平台期:基准饱和的系统性研究
Mubashara Akhtar, Anka Reuel, Prajna Soni, Sanchit Ahuja, Pawan Sasanka Ammanamanchi, Ruchit Rawal, Vilém Zouhar, Srishti Yadav, Chenxi Whitehouse, Dayeon Ki, Jennifer Mickel, Leshem Choshen, Marek Šuppa, Jan Batzner, Jenny Chim, Jeba Sania, Yanan Long, Hossein A. Rahmani, Christina Knight, Yiyang Nan, Jyoutir Raj, Yu Fan, Shubham Singh, Subramanyam Sahoo, Eliya Habba, Usman Gohar, Siddhesh Pawar, Robert Scholz, Arjun Subramonian, Jingwei Ni, Mykel Kochenderfer, Sanmi Koyejo, Mrinmaya Sachan, Stella Biderman, Zeerak Talat, Avijit Ghosh, Irene Solaiman
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
University of Toronto(多伦多大学)
;
University of Washington(华盛顿大学)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Michigan(密歇根大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
LiveXiv -- A Multi-Modal Live Benchmark Based on Arxiv Papers Content
LiveXiv —— 基于 arXiv 论文内容的多模态实时基准测试集
Nimrod Shabtay, Felipe Maia Polo, Sivan Doveh, Wei Lin, M. Jehanzeb Mirza, Leshem Choshen, Mikhail Yurochkin, Yuekai Sun, Assaf Arbelle, Leonid Karlinsky, Raja Giryes
机构
*
Faculty of Engineering Tel-Aviv University(特拉维夫大学工程学院)
;
IBM Research(IBM研究院)
;
Department of Statistics, University of Michigan(密歇根大学统计学系)
;
JKU Linz, Austria(林茨大学,奥地利)
;
MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)
;
MIT-IBM(麻省理工学院-IBM)
Prescribed-Basis Coefficient-to-Coefficient Neural Operator for Partial Differential Equations
通过固定基空间中的系数映射学习算子
Chuqi Chen, Yang Xiang, Weihong Zhang
机构
*
Department of Mathematics(数学系)
;
University of Michigan(密歇根大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Algorithms of Machine Learning and Autonomous Driving Research Lab(机器学习与自动驾驶算法研究实验室)
;
HKUST Shenzhen-Hong Kong Collaborative Innovation Research Institute(香港科技大学深圳-香港协同创新研究机构)
Generative AI floods and dilutes the market for books
生成式人工智能充斥并稀释了图书市场
Tuhin Chakrabarty, Xinyue Liu, Jane C. Ginsburg, Paramveer Dhillon
机构
*
Stony Brook University(纽约州立大学石溪分校)
;
Columbia Law School(哥伦比亚法学院)
;
University of Michigan(密歇根大学)
;
MIT Initiative on the Digital Economy(麻省理工学院数字经济倡议)
Why Does Grounding Hurt Medical VQA? Benchmarking, Diagnosis, and Fine-Tuning of Vision-Language Models
对前沿视觉-语言模型进行审计以实现可信的医学视觉问答:定位失败、格式崩溃和领域适应
Xupeng Chen, Binbin Shi, Chenqian Le, Qifu Yin, Lang Lin, Haowei Ni, Ran Gong, Panfeng Li
机构
*
New York University, New York, USA(纽约大学)
;
Tsinghua University, Beijing, China(清华大学)
;
Columbia University, New York, USA(哥伦比亚大学)
;
University of Michigan, Ann Arbor, USA(密歇根大学)
PRIMA: Pre-Training with Risk-Integrated Image--Metadata Alignment for Medical Diagnosis with LLM-Based Feature Aggregation
PRIMA:通过大语言模型进行风险集成图像-元数据对齐的医学诊断预训练
Yiqing Wang, Chunming He, Ziyun Yang, Maria Woodward, Ming-Chen Lu, Mercy Pawar, Leslie Niziol, Sina Farsiu
机构
*
Department of Biomedical Engineering, Duke University(杜克大学生物医学工程系)
;
Department of Ophthalmology and Visual Sciences, University of Michigan(密歇根大学眼科与视觉科学系)
COMPOL: A Unified Neural Operator Framework for Scalable Multi-Physics Simulations
COMPOL:用于可扩展多物理场模拟的统一神经算子框架
Junqi Qu, Tao Wang, Yushun Dong, Hewei Tang, Shibo Li
机构
*
School of Information, University of Michigan–Ann Arbor(信息学院,密歇根大学安娜堡分校)
;
Hildebrand Department of Petroleum and Geosystems Engineering, The University of Texas at Austin(石油与地质系统工程系,德克萨斯大学奥斯汀分校)
;
Department of Computer Science, Florida State University(计算机科学系,佛罗里达州立大学)
When Ethics and Payoffs Diverge: LLM Agents in Morally Charged Social Dilemmas
当伦理与收益相悖时:道德两难情境下的大语言模型智能体
Steffen Backmann, David Guzman Piedrahita, Terry Jingchen Zhang, Emanuel Tewolde, Rada Mihalcea, Bernhard Schölkopf, Zhijing Jin
机构
*
ETH Zürich(苏黎世联邦理工学院)
;
University of Zurich(苏黎世大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Michigan(密歇根大学)
;
Max Planck Institute for Intelligent Systems, Tübingen(图宾根人工智能研究所)
;
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
In-span learning: adapting reduced-order models using their own predictions
跨度内学习:利用自身预测调整降阶模型
Amirpasha Hedayat, Laura Balzano, Karthik Duraisamy
机构
*
Department of Aerospace Engineering(航空航天工程系)
;
Department of Electrical Engineering and Computer Science(电气工程与计算机科学系)
;
Michigan Institute for Computational Discovery and Engineering, University of Michigan, Ann Arbor, MI, USA(美国密歇根大学安娜堡分校计算发现与工程研究所)
XCOMPS: A Multilingual Benchmark of Conceptual Minimal Pairs
XCOMPS:概念最小对的多语言基准测试
Linyang He, Ercong Nie, Sukru Samet Dindar, Arsalan Firoozi, Adrian Florea, Van Nguyen, Corentin Puffay, Riki Shimizu, Haotian Ye, Jonathan Brennan, Helmut Schmid, Hinrich Schütze, Nima Mesgarani
机构
*
Columbia University(哥伦比亚大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
LMU Munich(慕尼黑大学)
;
University of Michigan(密歇根大学)
;
KU Leuven(根特大学)
Q-VGM: Q-Value-Gradient Matching for Off-Policy Reinforcement Learning of Flow-Matching VLA
Q-VGM: 基于Q引导的值梯度匹配的流匹配VLA策略
Ziqian Wang, Yitian Liu, Xingjian Mao, Minqian Wang, Yao Mu
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
University of Michigan, Ann Arbor(密歇根大学安娜堡分校)
;
University of Electronic Science and Technology of China(电子科技大学)