arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-03 至 2026-03-03 共收录 51 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 51 篇

2603.00076 2026-03-03 cs.CY cs.AI cs.LG 90%

The Value Sensitivity Gap: How Clinical Large Language Models Respond to Patient Preference Statements in Shared Decision-Making

价值敏感度缺口:临床大语言模型在共享决策中的患者偏好响应

Sanjay Basu

机构 * Waymark University of California, San Francisco(加州大学旧金山分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了临床大语言模型在共享决策中对患者偏好声明的响应,发现不同模型在价值敏感度和一致性上存在差异,通过实验验证了模型对患者价值的识别能力。

Comments 38 pages, 4 figures, supplementary appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13474 2026-03-03 cs.CL cs.AI cs.LG 87%

Language Agents for Hypothesis-driven Clinical Decision Making with Reinforcement Learning

用于强化学习的假设驱动临床决策制定语言代理

David Bani-Harouni, Chantal Pellegrini, Ege Özsoy, Nassir Navab, Matthias Keicher

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 领域大模型 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于强化学习的假设驱动语言代理LA-CDM,用于提升临床诊断的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20095 2026-03-03 cs.CV cs.CL cs.LG 86%

BioCAP: Exploiting Synthetic Captions Beyond Labels in Biological Foundation Models

BioCAP: 利用合成描述性注释超越标签在生物基础模型中的应用

Ziheng Zhang, Xinyue Ma, Arpita Chowdhury, Elizabeth G. Campolongo, Matthew J. Thompson, Net Zhang, Samuel Stevens, Hilmar Lapp, Tanya Berger-Wolf, Yu Su, Wei-Lun Chao, Jianyang Gu

机构 * The Ohio State University(俄亥俄州立大学) Duke University(杜克大学) Boston University(波士顿大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 BioCAP通过生成合成描述性注释提升生物基础模型的性能,实现物种分类和文本-图像检索的高准确率。

Comments ICLR 2026; Project page: https://imageomics.github.io/biocap/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00451 2026-03-03 cs.AI cs.CL 86%

Confusion-Aware Rubric Optimization for LLM-based Automated Grading

面向混淆的评分标准优化:基于大语言模型的自动评分系统

Yucheng Chu, Hang Li, Kaiqi Yang, Yasemin Copur-Gencturk, Joseph Krajcik, Namsoo Shin, Jiliang Tang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 CARO通过结构化分离错误信号,提升大语言模型自动评分系统的准确性和效率,有效解决评分逻辑冲突问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01557 2026-03-03 cs.AI 85%

Benchmarking LLM Summaries of Multimodal Clinical Time Series for Remote Monitoring

对多模态临床时间序列远程监测的LLM摘要进行基准测试

Aditya Shukla, Yining Yuan, Ben Tamo, Yifei Wang, Micky Nnamdi, Shaun Tan, Jieru Li, Benoit Marteau, Brad Willingham, May Wang

机构 * Georgia Institute of Technology(佐治亚理工学院) Shepherd Center(Shepherd中心)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出基于事件的评估框架,评估多模态临床时间序列摘要的可靠性,发现视觉方法在事件对齐上表现最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00426 2026-03-03 cs.CL cs.CV 85%

LLM-Bootstrapped Targeted Finding Guidance for Factual MLLM-based Medical Report Generation

基于大语言模型的引导式目标发现指导:用于基于事实的多模态大语言模型医疗报告生成

Cunyuan Yang, Dejuan Song, Xiaotao Pang, Qianqian Shen, Wenjie Nie, Yifan Huang, Lei Wu, Wei Han, Haishuai Wang, Jiajun Bu

机构 * Zhejiang University(浙江大学) The Second Affiliated Hospital Zhejiang University School of Medicine(浙江大学医学院附属第二医院) Hangzhou Pu Jian Medical Technology Co., Ltd.(杭州普健医疗科技有限公司)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出Fact-Flow框架,通过引导大语言模型生成事实准确的医疗报告,利用LLM自动生成标注数据集,提升医疗报告生成的事实准确性。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10066 2026-03-03 cs.SE cs.AI cs.PL 85%

OBsmith: LLM-Powered JavaScript Obfuscator Testing

OBsmith: 基于大语言模型的JavaScript混淆器测试

Shan Jiang, Chenguang Zhu, Sarfraz Khurshid

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OBsmith利用大语言模型系统测试JavaScript混淆器,发现11个正确性错误,凸显其在混淆诱导误操作方面的有效性。

Comments Accepted, to appear in OOPSLA 2026

Journal ref Proc. ACM Program. Lang. 10, OOPSLA1, Article 96 (April 2026), 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12565 2026-03-03 cs.AI cs.CL cs.LG q-bio.QM 85%

mCLM: A Modular Chemical Language Model that Generates Functional and Makeable Molecules

mCLM:一种模块化化学语言模型,能够生成功能性强且可制造的分子

Carl Edwards, Chi Han, Gawon Lee, Thao Nguyen, Sara Szymkuć, Chetan Kumar Prasad, Bowen Jin, Jiawei Han, Ying Diao, Ge Liu, Hao Peng, Bartosz A. Grzybowski, Martin D. Burke, Heng Ji

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Department of Chemistry, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校化学系) Allchemy Inc.(Allchemy公司) Department of Chemical and Biomolecular Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校化学与生物分子工程系) Ulsan National Institute of Science and Technology(乌山国立科学技术研究院) Institute of Organic Chemistry, Polish Academy of Sciences(波兰科学院有机化学研究所)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 mCLM是一种模块化化学语言模型,通过功能构建模块生成具有功能性和可制造性的分子,提升合成可行性和药物研发效率。

Comments Accepted to ICLR 2026 (Oral). Code: https://github.com/blender-nlp/mCLM Data and Model: https://huggingface.co/collections/language-plus-molecules/mclm

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01780 2026-03-03 cs.LG q-bio.GN 83%

D3LM: A Discrete DNA Diffusion Language Model for Bidirectional DNA Understanding and Generation

D3LM:一种用于双向DNA理解和生成的离散DNA扩散语言模型

Zhao Yang, Hengchang Liu, Chuan Cao, Bing Su

机构 * Gaoling School of Artificial Intelligence(人工智能学院)

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.LG

AI总结 D3LM通过掩码扩散统一双向DNA理解和生成,实现优于现有模型的性能。

Comments Accepted as a workshop paper at MLGenX 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01124 2026-03-03 cs.CV cs.AI 83%

ClinCoT: Clinical-Aware Visual Chain-of-Thought for Medical Vision Language Models

ClinCoT:面向医学视觉语言模型的临床感知视觉推理链

Xiwei Liu, Yulong Li, Xinlin Zhuang, Xuhui Li, Jianxu Chen, Haolin Yang, Imran Razzak, Yutong Xie

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) East China Normal University(东华大学)

专题命中 领域大模型 :language model(title,abstract);preference optimization(abstract);分类 cs.AI

AI总结 ClinCoT通过引入临床感知的视觉推理链框架,提升医学视觉语言模型在临床决策中的事实性支撑与多模态推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03906 2026-03-03 cs.AI 83%

Toward Clinically Explainable AI for Medical Diagnosis: A Foundation Model with Human-Compatible Reasoning via Reinforcement Learning

迈向临床可解释的AI:通过强化学习实现人友好的推理基础模型

Qika Lin, Yifan Zhu, Bin Pu, Ling Huang, Haoran Luo, Jingying Ma, Feng Wu, Kai He, Jiaxing Xu, Zhen Peng, Tianzhe Zhao, Fangzhi Xu, Jian Zhang, Zhonghong Ou, Erik Cambria, Swapnil Mishra, Mengling Feng

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 DeepMedix-R1通过强化学习实现临床可解释的AI,生成透明推理过程,优于现有模型,提升医学诊断的可解释性和实用性。

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00355 2026-03-03 cs.LG cs.SD eess.AS 83%

StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks

StethoLM:用于跨临床任务的心肺分析的音频语言模型

Yishan Wang, Tsai-Ning Wang, Mathias Funk, Aaqib Saeed

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 领域大模型 :language model(title,abstract);preference optimization(abstract);分类 cs.LG

AI总结 StethoLM是首个用于心肺听诊的音频语言模型,能执行多种临床任务,通过多阶段训练提升性能和鲁棒性,为临床听诊提供新的AI解决方案。

Comments To be published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12282 2026-03-03 cs.AI cs.LG 82%

AISSISTANT: Human-AI Collaborative Review and Perspective Research Workflows in Data Science

AIssistant: 人机协作的数据科学科研与视角研究工作流

Sasi Kiran Gaddipati, Farhana Keya, Gollam Rabby, Sören Auer

机构 * TIB Leibniz Information Centre for Science and Technology(图灵信息科学与技术研究所) L3S Research Center(L3S研究中心)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 AIssistant通过人机协作框架提升数据科学科研与视角研究的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00675 2026-03-03 cs.CV 82%

Specializing Foundation Models via Mixture of Low-Rank Experts for Comprehensive Head CT Analysis

通过混合低秩专家专门化基础模型以实现全面头部CT分析

Youngjin Yoo, Han Liu, Bogdan Georgescu, Yanbo Zhang, Sasa Grbic, Michael Baumgartner, Thomas J. Re, Jyotipriya Das, Poikavila Ullaskrishnan, Eva Eibenberger, Andrei Chekkoury, Uttam K. Bodanapally, Savvas Nicolaou, Pina C. Sanelli, Thomas J. Schroeppel, Yvonne W. Lui, Eli Gibson

机构 * Digital Technology and Innovation, Siemens Healthineers, Princeton, NJ USA(西门子医疗数字化技术与创新部) Department of Computed Tomography, Siemens Healthineers, Forchheim, Germany(西门子医疗计算机断层扫描部) Department of Radiology, New York University, New York, NY USA(纽约大学放射科部) Department of Radiology, University of Maryland Medical Center, Baltimore, MD USA(马里兰大学医学中心放射科部) Department of Radiology, Vancouver General Hospital, Vancouver, BC Canada(温哥华总医院放射科部) Department of Radiology, Northwell Health, New York, NY USA(北well医疗放射科部) Department of Surgery, UCHealth Memorial Hospital, Colorado Springs, CO USA(UCHealth纪念医院外科部)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract)

AI总结 本文提出MoLRE框架,通过混合低秩专家提升基础模型在头部CT分析中的性能,实验显示在不同模型上均取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20677 2026-03-03 cs.LG cs.AI 81%

UrbanFM: Scaling Urban Spatio-Temporal Foundation Models

UrbanFM: 扩展城市时空基础模型

Wei Chen, Yuqian Wu, Junle Chen, Xiaofang Zhou, Yuxuan Liang

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 UrbanFM通过扩展城市时空数据和模型架构,实现大规模城市时空基础模型的初步突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00054 2026-03-03 cs.LG cs.AI 81%

Expert Divergence Learning for MoE-based Language Models

专家分歧学习用于基于混合专家的语言模型

Jiaang Li, Haibin Chen, Langming Liu, Yujin Yuan, Yadao Wang, Yizhen Zhang, Chengting Yu, Xin Tong, Weidong Zhang, Shilei Liu, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 专家分歧学习通过促进专家功能专业化,提升MoE模型的语言建模能力及下游任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19661 2026-03-03 cs.LG 79%

PaReGTA: An LLM-based EHR Data Encoding Approach to Capture Temporal Information

PaReGTA:基于LLM的EHR数据编码方法以捕捉时间信息

Kihyuk Yoon, Lingchao Mao, Catherine Chong, Todd J. Schwedt, Chia-Chun Chiang, Jing Li

机构 * Georgia Institute of Technology(佐治亚理工学院) Meta Mayo Clinic(梅奥诊所)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.LG

AI总结 PaReGTA是一种基于LLM的EHR数据编码方法,通过模板文本生成、轻量级对比微调和混合时间池化,有效捕捉时间信息,提升偏头痛分类性能。

Comments 26 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00842 2026-03-03 cs.CL 79%

MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine

MedGPT-oss: 为生物医学训练一个通用的视觉-语言模型

Kai Zhang, Zhengqing Yuan, Cheng Peng, Songlin Zhao, Mengxian Lyu, Ziyi Chen, Yanfang Ye, Wei Liu, Ying Zhang, Kaleb E Smith, Lifang He, Lichao Sun, Yonghui Wu

机构 * Department of Computer Science and Engineering, Lehigh University(莱斯大学计算机科学与工程系) Department of Computer Science and Engineering, University of Notre Dame(圣母大学计算机科学与工程系) Department of Health Outcomes & Biomedical Informatics, University of Florida(佛罗里达大学健康结果与生物医学信息学系) Department of Radiation Oncology, Mayo Clinic(梅奥诊所放射肿瘤科) Research Computing, University of Florida(佛罗里达大学研究计算中心) AI Technology Center, NVIDIA(NVIDIA人工智能技术中心)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL

AI总结 MEDGPT-oss是一款开放式权重的200亿参数视觉-语言模型,通过优化训练课程实现多模态和文本推理能力,适用于隐私保护的临床AI研究。

Comments Technical report, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00618 2026-03-03 cs.LG 79%

Multi-Domain Riemannian Graph Gluing for Building Graph Foundation Models

多领域黎曼图粘合用于构建图基础模型

Li Sun, Zhenhao Huang, Silei Chen, Lanxu Yang, Junda Ye, Sen Su, Philip S. Yu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) North China Electric Power University(华北电力大学) University of Illinois Chicago(伊利诺伊大学香槟分校)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 GraphGlue通过黎曼几何视角整合多领域图数据,构建统一流形以提升模型可转移性与性能。

Comments Accepted by ICLR'26, 41 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00350 2026-03-03 cs.AI 79%

Monotropic Artificial Intelligence: Toward a Cognitive Taxonomy of Domain-Specialized Language Models

单调人工智能:面向领域专用语言模型的认知分类

Antonio de Sousa Leitão Filho, Allan Kardec Duailibe Barros Filho, Fabrício Saul Lima, Selby Mykael Lima dos Santos, Rejani Bandeira Vieira Sousa

机构 * Aia Context Federal University of Maranhão(马那瓜联邦大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 单调人工智能通过牺牲通用性实现领域内高精度,挑战通用智能主导的AI研究范式,提出专门化与通用系统互补共存的认知生态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01252 2026-03-03 cs.CL cs.AI 79%

Linking Knowledge to Care: Knowledge Graph-Augmented Medical Follow-Up Question Generation

将知识与关怀联系起来:知识图谱增强的医疗随访问题生成

Liwen Sun, Xiang Yu, Ming Tan, Zhuohao Chen, Anqi Cheng, Ashutosh Joshi, Chenyan Xiong

机构 * Carnegie Mellon university(卡内基梅隆大学) Amazon Health AI(亚马逊健康AI)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出KG-Followup方法,通过知识图谱增强LLM,提升医疗随访问题生成的准确性和效率。

Comments Short paper published in the Findings of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21396 2026-03-03 cs.CL cs.AI cs.CY cs.HC 79%

Augmenting Research Ideation with Data: An Empirical Investigation in Social Science

用数据增强研究构想:社会科学领域的实证研究

Xiao Liu, Xinyi Dong, Xinyang Gao, Yansong Feng, Xun Pang

机构 * Wangxuan Institute of Computer Technology(王轩计算机技术研究所) Yuanpei College(元培学院) School of Government(政府学院) School of International Studies(国际研究学院) Institute for Carbon Neutrality(碳中和研究所) Analytics Lab for Global Risk Politics(全球风险政治分析实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文通过实证研究探讨了在社会科学领域利用数据增强LLM生成的研究构想,发现元数据和自动化验证显著提升了构想的可行性和质量。

Comments AI4Science Workshop at Neurips 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01345 2026-03-03 cs.SE 78%

PymooLab: An Open-Source Visual Analytics Framework for Multi-Objective Optimization using LLM-Based Code Generation and MCDM

PymooLab: 一个基于LLM代码生成和MCDM的多目标优化开源可视化分析框架

Thiago Santos, Sebastiao Xavier, Luiz Gustavo de Oliveira Carneiro, Gustavo de Souza

专题命中 领域大模型 :LLM(title,abstract)

AI总结 PymooLab通过LLM辅助代码生成和MCDM工具,为多目标优化提供可视化分析框架,提升领域专家的可操作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00148 2026-03-03 cs.CV 78%

Mechanistically Guided LoRA Improves Paraphrase Consistency in Medical Vision-Language Models

基于机制的LoRA改进医学视觉-语言模型的同义词一致性

Binesh Sadanandan, Vahid Behzadan

机构 * University of New Haven(新罕布什尔大学)

专题命中 领域大模型 :language model(title,abstract)

AI总结 基于机制的LoRA改进医学视觉-语言模型的同义词一致性,通过结合损失平衡一致性与准确性,降低翻转率并提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00501 2026-03-03 cs.NI cs.AI eess.SP 77%

WirelessAgent++: Automated Agentic Workflow Design and Benchmarking for Wireless Networks

WirelessAgent++: 无线网络中自主代理工作流设计与基准测试

Jingwen Tong, Zijian Li, Fang Liu, Wei Guo, Jun Zhang

机构 * College of Electronics and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港理工大学电子与计算机工程系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

AI总结 WirelessAgent++通过自动化设计无线任务代理工作流,结合MCTS算法和WirelessBench基准测试,实现了高效且稳健的无线网络代理生成。

Comments This manuscript has submitted to a possible Journal for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00460 2026-03-03 cs.AI 77%

MED-COPILOT: A Medical Assistant Powered by GraphRAG and Similar Patient Case Retrieval

MED-COPILOT:一种基于图RAG和相似患者案例检索的医疗助手

Shuheng Chen, Namratha Patil, Haonan Pan, Angel Hsing-Chi Hwang, Yao Du, Ruishan Liu, Jieyu Zhao

机构 * University of Southern California(南加州大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MED-COPILOT通过结合图RAG和相似患者案例检索,提升临床决策支持系统的证据整合与推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26144 2026-03-03 cs.AI 77%

The FM Agent

FM代理

Annan Li, Chufan Wu, Zengle Ge, Yee Hin Chong, Zhinan Hou, Lizhe Cao, Cheng Ju, Jianmin Wu, Huaiming Li, Haobo Zhang, Shenghao Feng, Mo Zhao, Fengzhi Qiu, Rui Yang, Mengmeng Zhang, Wenyi Zhu, Yingying Sun, Quan Sun, Shunhao Yan, Danyu Liu, Dawei Yin, Dou Shen

机构 * Baidu AI Cloud(百度AI云)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 FM代理是一种利用LLM推理和进化搜索的通用多代理框架,能够自主解决复杂问题并达到先进水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00629 2026-03-03 cs.LG 74%

Adapt Data to Model: Adaptive Transformation Optimization for Domain-shared Time Series Foundation Models

适应数据到模型:面向领域共享时间序列基础模型的自适应转换优化

Yunzhong Qiu, Zhiyao Cen, Zhongyi Pei, Chen Wang, Jianmin Wang

机构 * School of Software, BNRist, Tsinghua University(软件学院、BNRist、清华大学)

专题命中 领域大模型 :foundation model(title);分类 cs.LG

AI总结 TATO通过自适应转换优化提升领域适应的预测性能,显著降低MSE并提高效率。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25678 2026-03-03 cs.LG 74%

Massively Multimodal Foundation Models: A Framework for Capturing Interactions with Specialized Mixture-of-Experts

大规模多模态基础模型:一种捕捉交互的专用专家混合框架

Xing Han, Hsing-Huan Chung, Joydeep Ghosh, Paul Pu Liang, Suchi Saria

机构 * Johns Hopkins University(约翰霍普金斯大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 领域大模型 :foundation model(title);分类 cs.LG

AI总结 本文提出了一种大规模多模态基础模型框架,通过量化模态间的时间依赖性,改进混合专家路由机制,提升跨模态交互处理能力。

Comments Published at International Conference on Learning Representations (ICLR) 2026 as a conference paper. 28 pages, 16 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16145 2026-03-03 cs.AI cs.CL 73%

SpiroLLM: Finetuning Pretrained LLMs to Understand Spirogram Time Series with Clinical Validation in COPD Reporting

SpiroLLM:通过临床验证在COPD报告中微调预训练大语言模型以理解肺功能时间序列

Shuhao Mei, Yongchao Long, Xiaoyu Xiao, Shan Cao, Xiaobo Han, Shijia Geng, Jinbo Sun, Yuxi Zhou, Shenda Hong

机构 * Guangzhou Institute of Technology, Xidian University, Xi’an, China(广州科技研究院,西安电子科技大学,中国) Department of Computer Science, Tianjin University of Technology, Tianjin, China(天津理工大学计算机学院,天津,中国) Department of Respiratory, The Second Hospital of Tianjin Medical University, China(天津医科大学第二医院呼吸科,中国) College of Pulmonary and Critical Care Medicine, Chinese PLA General Hospital, Beijing, China(中国人民解放军总医院呼吸与危重症医学科,北京,中国) HeartVoice Medical Technology, Hefei, China(合肥心声医疗技术有限公司,中国) School of Life Science and Technology, Xidian University, Xi’an, China(西安电子科技大学生命科学与技术学院,中国) National Institute of Health Data Science, Peking University, Beijing, China(北京大学国家健康数据科学研究院,北京,中国) Institute for Artificial Intelligence, Peking University, Beijing, China(北京大学人工智能研究院,北京,中国)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 SpiroLLM通过融合生理信号与大语言模型,实现对肺功能时间序列的解读,并在COPD诊断中展现出高准确性和稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏