arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-13 至 2026-03-13 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 24 篇

2602.06965 2026-03-13 cs.CV 91%

MedMO: Grounding and Understanding Multimodal Large Language Model for Medical Images

MedMO:为医学图像构建和理解多模态大语言模型

Ankan Deria, Komal Kumar, Adinath Madhavrao Dukre, Eran Segal, Salman Khan, Imran Razzak

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);instruction tuning(abstract)

AI总结 MedMO是一种基于通用MLLM架构构建的医学多模态基础模型,通过多阶段训练提升跨模态和任务的性能,超越现有开源基线,在医学图像识别和报告生成中取得显著提升。

Comments 21 pages, 6 figures and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21599 2026-03-13 cs.IR cs.AI cs.LG 90%

Refine-POI: Reinforcement Fine-Tuned Large Language Models for Next Point-of-Interest Recommendation

Refine-POI: 通过强化微调优化大型语言模型用于下一步兴趣点推荐

Peibo Li, Shuang Ao, Hao Xue, Yang Song, Maarten de Rijke, Johan Barthélemy, Tomasz Bednarz, Flora D. Salim

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 Refine-POI通过拓扑感知ID生成和强化微调,解决LLMs在POI推荐中的语义连续性和top-k推荐问题,提升推荐准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06214 2026-03-13 cs.CL cs.AI math-ph math.MP quant-ph 88%

Can Theoretical Physics Research Benefit from Language Agents?

理论物理研究能否从语言代理中受益?

Sirui Lu, Zhijing Jin, Terry Jingchen Zhang, Pavel Kos, J. Ignacio Cirac, Bernhard Schölkopf

专题命中 领域大模型 :language agent(title);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了语言代理在理论物理研究中的潜力,指出需专门训练和工具支持,以实现多模态数据处理、物理假设提出和理论验证的AI代理。

Comments 8+2 pages + references

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15772 2026-03-13 cs.DL cs.AI cs.CR 87%

Detecting LLM-Generated Peer Reviews

检测由大语言模型生成的同行评审

Vishisht Rao, Aounon Kumar, Himabindu Lakkaraju, Nihar B. Shah

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出了一种通过间接提示注入在同行评审中嵌入隐蔽水印的方法,用于检测由大语言模型生成的评审,该方法具有强统计保证并能有效应对常见防御措施。

Comments 27 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11446 2026-03-13 cs.CL 85%

LLM-Assisted Causal Structure Disambiguation and Factor Extraction for Legal Judgment Prediction

基于大型语言模型的因果结构辨析与因子提取的法律判决预测

Yuzhi Liang, Lixiang Ma, Xinrong Zhu

机构 * School of Information Technology(信息科技学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种结合大型语言模型与统计因果发现的框架,通过改进的因果结构辨析和因子提取方法,提升法律判决预测的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12732 2026-03-13 cs.HC 85%

Using LLM-Generated Draft Replies to Support Human Experts in Responding to Stakeholder Inquiries in Maritime Industry: A Real-World Case Study of Industrial AI

利用LLM生成的草稿回复支持海事行业专家回应利益相关者查询:工业AI的现实案例研究

Tita Alissa Bach, Aleksandar Babic, Narae Park, Tor Sporsem, Rasmus Ulfsnes, Henrik Smith-Meyer, Torkel Skeie

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究探讨了LLM生成的草稿回复在海事行业中支持专家回应利益相关者查询的应用,发现LLM可作为补充工具,但需人类监督以确保安全关键性应用的质量和精度。

Comments These authors share the first authorship: Tita Alissa Bach (1), Aleksandar Babic (1), Narae Park (1)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12226 2026-03-13 cs.CL cs.AI 84%

Sparking Scientific Creativity via LLM-Driven Interdisciplinary Inspiration

通过LLM驱动的跨学科灵感激发科学创造力

Priyanka Kargupta, Shuhaib Mehri, Dilek Hakkani-Tur, Jiawei Han

机构 * Siebel School of Computing and Data Science(计算机与数据科学学院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 Idea-Catalyst通过系统识别跨学科见解,支持人类和大语言模型的创造性推理,提升科学发现的创新性和洞察力。

Comments Code and dataset provided at https://github.com/pkargupta/idea_catalyst

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13723 2026-03-13 cs.CV 82%

SOTA: Self-adaptive Optimal Transport for Zero-Shot Classification with Multiple Foundation Models

SOTA: 自适应最优传输用于多基础模型的零样本分类

Zhanxuan Hu, Qiyu Xu, Yu Duan, Yonghang Tai, Huafeng Li

机构 * Yunnan Normal University(云南师范大学) Xidian University(西安电子科技大学) Xi’an University of Posts and Telecommunications(西安邮电大学) Kunming University of Science and Technology(昆明理工大学)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract)

AI总结 SOTA通过自适应最优传输方法整合多基础模型,提升零样本分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12008 2026-03-13 cs.CV 78%

CrossEarth-SAR: A SAR-Centric and Billion-Scale Geospatial Foundation Model for Domain Generalizable Semantic Segmentation

跨地球雷达:一种以雷达为中心的十亿级地理空间基础模型,用于领域通用的语义分割

Ziqi Ye, Ziyang Gong, Ning Liao, Xiaoxing Hu, Di Wang, Hongruixuan Chen, Chen Huang, Yiguo He, Yuru Jia, Xiaoxing Wang, Haipeng Wang, Xue Yang, Junchi Yan

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) The University of Tokyo(东京大学) Sun Yat-sen University(中山大学) KU Leuven(比利时鲁汶大学) KTH(皇家理工学院)

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 CrossEarth-SAR是一种基于雷达的十亿级地理空间基础模型,通过物理引导的稀疏专家混合架构实现跨域语义分割的领域泛化,通过大规模预训练和基准测试验证其有效性。

Comments 26 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21066 2026-03-13 cs.AI cs.HC 77%

Agentic Explainable Artificial Intelligence (Agentic XAI) Approach To Explore Better Explanation

代理可解释人工智能(代理XAI)方法探索更好的解释

Tomoaki Yamaguchi, Yutong Zhou, Masahiro Ryo, Keisuke Katsura

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种结合SHAP解释性和多模态LLM迭代细化的代理XAI框架,通过农业推荐系统验证,发现早期停止可提升推荐质量,但过度细化导致性能下降,揭示了偏差-方差权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11303 2026-03-13 cs.HC 75%

Bridging the Cognitive Gap: Co-Designing and Evaluating a Voice-Enabled Community Chatbot for Older Adults

弥合认知鸿沟:为老年人设计和评估一个语音启用的社区聊天机器人

Feng Chen, Luna Xingyu Li, Ray-Yuan Chung, Wenyu Zeng, Yein Jeon, Yizhou Hu, Oleg Zaslavsky

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种语音启用的社区聊天机器人,通过共设计和教育工作坊,提升老年人对AI的认知和透明度,同时探索零触控导航对年龄包容性AI的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09596 2026-03-13 cs.DL 75%

How much are LLMs changing the language of academic papers after ChatGPT? A multi-database and full text analysis

大型语言模型如何改变学术论文的语言?——多数据库和全文分析

Kayvan Kousha, Mike Thelwall

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究通过多数据库分析发现,大型语言模型相关术语在学术论文中的使用显著增加,尤其在STEM领域,且术语间关联性增强,为非英语学者提供了更便捷的学术出版途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11772 2026-03-13 cs.CL 70%

Legal-DC: Benchmarking Retrieval-Augmented Generation for Legal Documents

Legal-DC: 用于法律文档的检索增强生成基准测试

Yaocong Li, Qiang Lan, Leihan Zhang, Le Zhang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出Legal-DC基准测试,通过构建专门的法律文档数据集和LegRAG框架,提升中国法律检索增强生成系统的效果和可靠性。

Comments 20 pages, 4 figures, to be submitted to a conference/journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11559 2026-03-13 cs.AI cs.HC 70%

AI Knows What's Wrong But Cannot Fix It: Helicoid Dynamics in Frontier LLMs Under High-Stakes Decisions

AI知错却无法修复:前沿大语言模型在高风险决策中的螺旋动态

Alejandro R Jadad

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 前沿大语言模型在高风险决策中表现出螺旋动态,即在错误中自我识别却无法修复,导致可靠性下降,需通过识别该模式以提升AI信任度。

Comments 22 pages, 2 tables, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09076 2026-03-13 cs.CL 70%

Llettuce: An Open Source Natural Language Processing Tool for the Translation of Medical Terms into Uniform Clinical Encoding

Llettuce:一种用于将医学术语翻译成统一临床编码的开源自然语言处理工具

James Mitchell-White, Reza Omdivar, Benjamin Partridge, Esmond Urwin, Karthikeyan Sivakumar, Ruizhe Li, Andy Rae, Xiaoyan Wang, Theresia Mina, Tom Giles, Diego Garcia-Gil, Tim Beck, John Chambers, Grazziela Figueredo, Philip R Quinlan

机构 * Centre for Health Informatics, School of Medicine, The University of Nottingham(诺丁汉大学医学院健康信息学中心) Digital Research Service, The University of Nottingham(诺丁汉大学数字研究服务) NIHR Nottingham Biomedical Research Centre(尼日利亚生物医学研究中心) Lee Kong Chian School of Medicine, Nanyang Technological University, Singapore(南洋理工大学新加坡李科贤医学院) Department of Software Engineering, Andalusian Institute of Data Science and Computational Intelligence (DaSCI), University of Granada, 18012, Granada, Spain(安达卢西亚数据科学与计算智能研究所(DaSCI)软件工程系,格拉纳达大学,18012,格拉纳达,西班牙)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Llettuce是一种开源工具,通过自然语言处理技术将医学术语自动转换为OMOP标准概念,兼顾数据安全与高性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04916 2026-03-13 cs.SE 67%

Classifier or Prompt: A Case Study on Legal Requirements Traceability

分类器或提示:关于法律要求可追溯性的案例研究

Romina Etezadi, Sallam Abualhaija, Chetan Arora, Lionel Briand

专题命中 领域大模型 :LLM(abstract);language model(abstract)

AI总结 本文提出Kashif和RICE_LRT两种方法,分别通过分类器和提示工程解决法律要求的可追溯性问题,实验表明Kashif在F2得分上优于基线,RICE_LRT在更复杂的GDPR文档中表现更优。

Comments 32 pages, 7 figues

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14351 2026-03-13 cs.CV 67%

SegAnyPET: Universal Promptable Segmentation from Positron Emission Tomography Images

SegAnyPET:从正电子发射断层扫描图像中进行通用可提示分割

Yichi Zhang, Le Xue, Wenbo Zhang, Lanlan Li, Yuchen Liu, Chen Jiang, Yuan Cheng, Yuan Qi

专题命中 领域大模型 :foundation model(abstract);prompting(abstract)

AI总结 SegAnyPET通过构建PETS-5k数据集,提出跨提示自信学习策略,实现从PET图像中高效分割多种器官,提升分割任务的通用性和准确性。

Comments Accept for ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12129 2026-03-13 cs.AI cs.CY cs.SI econ.GN physics.soc-ph q-fin.EC 57%

Increasing intelligence in AI agents can worsen collective outcomes

提升AI代理的智能会加剧集体结果

Neil F. Johnson

机构 * Dynamic Online Networks Laboratory and Physics Department(动态在线网络实验室和物理系)

专题命中 领域大模型 :LLM(abstract);分类 cs.AI

AI总结 研究发现,资源稀缺时AI代理多样性与强化学习会加剧系统过载,而部落形成可降低风险,但整体效果取决于容量与人口比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11436 2026-03-13 cs.LG 57%

ZTab: Domain-based Zero-shot Annotation for Table Columns

ZTab: 基于领域的零样本表格列标注

Ehsan Hoseinzade, Ke Wang

机构 * IEEE 42nd International Conference on Data Engineering (ICDE 2026)(IEEE第42届国际数据工程会议)

专题命中 领域大模型 :LLM(abstract);分类 cs.LG

AI总结 ZTab是一种基于领域的零样本框架,通过预定义语义类型和样本表格模式生成伪表格并微调LLM,以提高表格列标注的性能和零样本能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11200 2026-03-13 cs.CR cs.LG 57%

DNS-GT: A Graph-based Transformer Approach to Learn Embeddings of Domain Names from DNS Queries

DNS-GT: 基于图的Transformer方法用于从DNS查询中学习域名嵌入

Massimiliano Altieri, Ronan Hamon, Roberto Corizzo, Michelangelo Ceci, Ignacio Sanchez

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 本文提出DNS-GT模型,通过基于Transformer的方法从DNS查询序列中学习域名嵌入,提升网络入侵检测系统的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06605 2026-03-13 cs.LG 57%

Structure-Aware Set Transformers: Temporal and Variable-Type Attention Biases for Asynchronous Clinical Time Series

结构感知的集合变换器:用于异步临床时间序列的时序和变量类型注意力偏差

Joohyung Lee, Kwanhyung Lee, Changhun Kim, Eunho Yang

机构 * AITRICS Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 领域大模型 :foundation model(abstract);分类 cs.LG

AI总结 本文提出STAR-Set变换器,通过引入时间局部性惩罚和变量类型亲和力,解决异步临床时间序列中变量轨迹和时间局部上下文丢失的问题,提升预测性能。

Comments ICLR 2026 Workshop on Time Series in the Age of Large Models (TSALM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05884 2026-03-13 cs.CE cs.AI 57%

Computational Pathology in the Era of Emerging Foundation and Agentic AI -- International Expert Perspectives on Clinical Integration and Translational Readiness

在新兴基础和代理AI时代 computational pathology 的发展——国际专家对临床整合与转化准备的视角

Qian Da, Yijiang Chen, Min Ju, Zheyi Ji, Albert Zhou, Wenwen Wang, Matthew A Abikenari, Philip Chikontwe, Guillaume Larghero, Bowen Chen, Peter Neidlinger, Dingrong Zhong, Shuhao Wang, Wei Xu, Drew Williamson, German Corredor, Sen Yang, Le Lu, Xiao Han, Kun-Hsing Yu, Jun-zhou Huang, Laura Barisoni, Geert Litjens, Anant Madabhushi, Lifeng Zhu, Chaofu Wang, Junhan Zhao, Weiguo Hu

机构 * Department of Pathology, Ruijin Hospital, Shanghai Jiao Tong University School of Medicine, Shanghai, China(复旦大学附属中山医院病理科,上海交通大学医学院,上海,中国) Department of Radiation Oncology, Stanford University School of Medicine, Stanford, CA, USA(斯坦福大学医学院放射肿瘤科,斯坦福,加利福尼亚州,美国) Department of Basic Education, Qingdao City University, Qingdao, Shandong, China(青岛城市大学基础教育系,青岛,山东省,中国) Department of Human Genetics, the University of Chicago, Chicago, IL, USA(芝加哥大学人类遗传学系,芝加哥,伊利诺伊州,美国) Department of Computer Science, University of Warwick, Coventry UK(沃里克大学计算机科学系,科文特里,英国) Department of Electrical and Computer Engineering, Carnegie Mellon University, Pittsburgh, Pennsylvania, USA(卡内基梅隆大学电气与计算机工程系,匹兹堡,宾夕法尼亚州,美国) Department of Neurosurgery, Stanford University School of Medicine, Stanford, CA, USA(斯坦福大学医学院神经外科,斯坦福,加利福尼亚州,美国) Department of Biomedical Informatics, Harvard Medical School, Boston, MA, USA(哈佛医学院生物医学信息学系,波士顿,马萨诸塞州,美国)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI

AI总结 本文探讨新兴基础和代理AI在计算病理学中的临床整合与转化准备,分析技术成熟度、经济监管及实际应用挑战,提供国际专家对当前能力与障碍的评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22018 2026-03-13 cs.CV cs.AI 57%

MedEyes: Learning Dynamic Visual Focus for Medical Progressive Diagnosis

MedEyes: 学习动态视觉聚焦以进行医学逐步诊断

Chunzheng Zhu, Yangfang Lin, Shen Chen, Yijun Wang, Jianxin Lin

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 MedEyes通过动态视觉聚焦和双模式探索策略,提升医学逐步诊断的准确性与临床相关性。

Comments AAAI 2026, Medical Chain-of-Thought (CoT), Reinforcement Learning with Verifiable Rewards (RLVR), Multimodal Grounded Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11407 2026-03-13 cs.IR 50%

Reproducible Synthetic Clinical Letters for Seizure Frequency Information Extraction

可重复的合成临床信件用于癫痫发作频率信息提取

Yujian Gan, Stephen H. Barlow, Ben Holgate, Joe Davies, James T. Teo, Joel S. Winston, Mark P. Richardson

专题命中 领域大模型 :language model(abstract)

AI总结 本研究提出了一种基于合成数据的框架,用于从临床信件中提取癫痫发作频率,通过结构化标签和证据支持的监督方法实现了高精度的提取。

详情

展开后加载摘要…

URL PDF HTML 收藏