arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-10 至 2026-04-10 共收录 22 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 22 篇

2604.07963 2026-04-10 cs.CL cs.AI cs.LG 90%

Rethinking Data Mixing from the Perspective of Large Language Models

从大语言模型视角重新思考数据混合

Yuanjian Xu, Tianze Sun, Changwei Xu, XinLong Zhao, Jianing Hao, Ran Chen, Yang Liu, Ruijie Xu, Stephen Chen, Guang Zhang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) OpenCSG Harbin Institute of Technology(哈尔滨工业大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文从理论角度探讨数据混合策略对大语言模型训练的影响,提出DoGraph框架,通过图约束优化提升模型泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08333 2026-04-10 cs.CV cs.AI cs.LG 90%

Lost in the Hype: Revealing and Dissecting the Performance Degradation of Medical Multimodal Large Language Models in Image Classification

迷失在喧嚣中:揭示并剖析医学多模态大语言模型在图像分类中的性能退化

Xun Zhu, Fanbin Mo, Xi Chen, Kaili Zheng, Shaoshuai Yang, Yiming Shi, Jian Gao, Miao Li, Ji Wu

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了医学多模态大语言模型在图像分类中的性能退化问题,通过实验和特征探查揭示了四个失败模式,并提出了量化评分用于评估特征演变的健康状况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08126 2026-04-10 cs.CL 85%

LLM-Based Data Generation and Clinical Skills Evaluation for Low-Resource French OSCEs

基于大语言模型的数据生成与低资源法语OSCEs临床技能评估

Tian Huang, Tom Bourgeade, Irina Illina

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出利用大语言模型生成和评估法语OSCE对话,通过合成数据缓解资源限制,展示中等规模模型在医疗教育中的可行性。

Comments 11 pages, 2 figures, to be published in LREC 2026 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07584 2026-04-10 cs.AI 85%

From Papers to Property Tables: A Priority-Based LLM Workflow for Materials Data Extraction

从论文到属性表:一种基于优先级的LLM工作流用于材料数据提取

Koushik Rameshbabu, Jing Luo, Ali Shargh, Khalid A. El-Awady, Jaafar A. El-Awady

机构 * Department of Applied Mathematics and Statistics, Johns Hopkins University(约翰霍普金斯大学应用数学与统计系) Department of Mechanical Engineering, Johns Hopkins University(约翰霍普金斯大学机械工程系)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于优先级的LLM工作流,用于从科研论文中自动提取和重建结构化材料实验数据,通过整合文本、表格、图表和物理推导信息,以合金劈裂强度为案例,实现了高精度的数据提取与验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07565 2026-04-10 cs.DL 85%

Have LLM-associated terms increased in article full texts in all fields?

在所有领域中,与大语言模型相关的术语是否在文章全文中增加?

Mike Thelwall, Kayvan Kousha

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究通过分析MDPI数据库中2021-2025年间125万篇科学文章的全文,探讨了与大语言模型相关的术语在科学写作中的普及情况,发现术语使用呈上升趋势,但不同领域存在差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08326 2026-04-10 cs.AI 83%

ProMedical: Hierarchical Fine-Grained Criteria Modeling for Medical LLM Alignment via Explicit Injection

ProMedical:通过显式注入实现医疗大语言模型对齐的分层细粒度标准建模

He Geng, Yangmin Huang, Lixian Lai, Qianyun Du, Hui Chu, Zhiyang He, Jiaxue Hu, Xiaodong Tao

机构 * Xunfei Healthcare Technology Co., Ltd.(讯飞医疗科技有限公司)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出ProMedical框架,通过显式注入细粒度临床标准,提升医疗大语言模型对齐效果,实验表明在安全性和准确性上均优于现有模型。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05086 2026-04-10 cs.CL cs.AI 81%

A systematic framework for generating novel experimental hypotheses from language models

从语言模型生成新颖实验假设的系统框架

Kanishka Misra, Najoung Kim

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出一个系统框架,利用语言模型模拟未在文献中存在的实验结果,针对儿童语言发展中的代词动词习得和跨结构泛化问题,生成新颖未测试的假设,并设计可实验室测试的实验。

Comments Revised version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08605 2026-04-10 cs.CL cs.CY cs.HC cs.MA cs.MM 79%

Mina: A Multilingual LLM-Powered Legal Assistant Agent for Bangladesh for Empowering Access to Justice

Mina:一种多语言大语言模型驱动的法律助理代理,用于孟加拉国,以促进获得正义

Azmine Toushik Wasi, Wahid Faisal, Mst Rafia Islam, Md Rizwan Parvez

专题命中 领域大模型 :LLM(title,abstract);分类 cs.CL

AI总结 Mina通过多语言嵌入和基于RAG的工具链框架,为孟加拉国提供多语言法律助理服务,实现法律文书、引文和通俗解释的生成,经评估在法律考试中表现优异,成本显著降低。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21840 2026-04-10 eess.IV cs.CV 79%

Vision Language Models versus Machine Learning Models Performance on Polyp Detection and Classification in Colonoscopy Images

视觉语言模型与机器学习模型在结肠镜图像息肉检测与分类中的性能对比

Mohammad Amin Khalafi, Seyed Amir Ahmad Safavi-Naini, Ameneh Salehi, Nariman Naderi, Dorsa Alijanzadeh, Pardis Ketabi Moghadam, Kaveh Kavosi, Negar Golestani, Shabnam Shahrokh, Soltanali Fallah, Jamil S Samaan, Nicholas P. Tatonetti, Nicholas Hoerter, Girish Nadkarni, Hamid Asadzadeh Aghdaei, Ali Soroush

专题命中 领域大模型 :language model(title,abstract);LLM(comments)

AI总结 本文对比了视觉语言模型与传统机器学习模型在结肠镜图像息肉检测和分类任务中的性能,发现ResNet50在检测任务中表现最佳,而BiomedCLIP和GPT-4在特定情况下也表现出色。

Comments Code is available at: https://github.com/aminkhalafi/CML-vs-LLM-on-Polyp-Detection. CoI: AlSo serves on the advisory board and holds equity in Virgo Surgical Solutions. The other authors declare no conflicts of interest. Data

Journal ref Scientific Reports 15, 45484 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02978 2026-04-10 cs.LG 74%

On the Robustness of Tabular Foundation Models: Test-Time Attacks and In-Context Defenses

表格基础模型的鲁棒性:测试时攻击与上下文防御

Mohamed Djilani, Thibault Simonetto, Karim Tit, Florian Tambon, Salah Ghamizi, Maxime Cordy, Mike Papadakis

机构 * Luxembourg Institute of Health(卢森堡健康研究所) SnT / University of Luxembourg(卢森堡大学SnT中心)

专题命中 领域大模型 :foundation model(title);分类 cs.LG

AI总结 研究探讨了表格基础模型在测试时对抗攻击的脆弱性及上下文防御方法,发现微小结构扰动可显著降低预测精度,并提出通过对抗性微调和上下文学习提升鲁棒性。

Comments This work has been accepted for publication at the IEEE Conference on Secure and Trustworthy Machine Learning (SaTML). The final version will be available on IEEE Xplore. To IEEE SaTML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07817 2026-04-10 cs.AI cs.LG cs.SE 73%

Automatic Generation of Executable BPMN Models from Medical Guidelines

从医疗指南自动生成可执行的BPMN模型

Praveen Kumar Menaka Sekar, Ion Matei, Maksym Zhenirovskyy, Hon Yung Wong, Sayuri Kohmura, Shinji Hotta, Akihiro Inomata

机构 * University of Maryland(马里兰大学) Fujitsu Research of America(富士通美国研究院) Fujitsu Limited(富士通株式会社)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种端到端的流程,利用大语言模型将医疗政策文档转换为可执行的数据感知BPMN模型,通过模拟评估政策效果。主要贡献包括语法自动纠正、可执行增强、KPI仪器化和基于熵的不确定性检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08296 2026-04-10 cs.AI 70%

Towards a Science of Scaling Agent Systems

迈向代理系统的科学:扩展性研究

Yubin Kim, Ken Gu, Chanwoo Park, Chunjong Park, Samuel Schmidgall, A. Ali Heydari, Yao Yan, Zhihan Zhang, Yuchen Zhuang, Yun Liu, Mark Malhotra, Paul Pu Liang, Hae Won Park, Yuzhe Yang, Xuhai Xu, Yilun Du, Shwetak Patel, Tim Althoff, Daniel McDuff, Xin Liu

机构 * Google Research(谷歌研究院) Massachusetts Institute of Technology(麻省理工学院) Google DeepMind(谷歌DeepMind)

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过260种配置评估六种代理基准,探讨代理系统在扩展维度上的性能变化规律,揭示协调、模型能力与任务结构之间的关系,发现协作成功取决于协调与任务结构的匹配程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06925 2026-04-10 cs.MM 67%

LungCURE: Benchmarking Multimodal Real-World Clinical Reasoning for Precision Lung Cancer Diagnosis and Treatment

LungCURE:多模态真实世界临床推理基准测试用于精准肺癌诊断与治疗

Fangyu Hao, Jiayu Yang, Yifan Zhu, Zijun Yu, Qicen Wu, Wang Yunlong, Jiawei Li, Yulin Liu, Xu Zeng, Guanting Chen, Shihao Li, Zhonghong Ou, Meina Song, Mengyang Sun, Haoran Luo, Yu Shi, Yingyi Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文提出LungCURE基准测试,通过1000个真实世界病例评估多模态模型在肺癌TNM分期、治疗推荐和临床决策支持中的性能,并引入LCAgent框架提升模型在复杂医疗场景中的推理能力。

Comments 20 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26100 2026-04-10 cs.IR 67%

Rethinking Recommendation Paradigms: From Pipelines to Agentic Recommender Systems

重新思考推荐范式:从流水线到代理推荐系统

Jinxin Hu, Hao Deng, Lingyu Mu, Hao Zhang, Shizhun Wang, Yu Zhang, Xiaoyi Zeng

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文提出基于代理的推荐系统,通过将关键模块转化为代理,实现动态进化,解决传统多阶段和单模型设计的静态问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14997 2026-04-10 cs.CL cs.AI cs.IR 62%

OrgForge: A Multi-Agent Simulation Framework for Verifiable Synthetic Corporate Corpora

OrgForge:一种用于可验证合成企业语料的多智能体仿真框架

Jeffrey Flynt

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 OrgForge通过多智能体仿真框架生成一致且可追溯的合成企业语料,解决现有语料在法律约束和幻觉问题上的不足,提升AI系统评估的准确性。

Comments v2: Major revision. Recenters the paper on the simulation framework as the primary contribution. System Architecture substantially expanded (CRM state machine, Knowledge Recovery Arc, multi-pathway knowledge gap detection, embedding-based ticket assignment). Introduction restructured for broader framing. RAG retrieval baselines replaced by cross-document consistency evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20223 2026-04-10 cs.LG cs.AI 62%

MultiModalPFN: Extending Prior-Data Fitted Networks for Multimodal Tabular Learning

多模态PFN:扩展先验数据拟合网络以进行多模态表格学习

Wall Kim, Chaeyoung Song, Hanul Kim

机构 * Samsung Electronics(三星电子) Seoul National University of Science and Technology(首尔科学技术大学)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出MMPFN,通过引入多头门控MLP和跨注意力池化器,扩展TabPFN以处理表格和非表格模态,实验证明其在医疗和通用多模态数据集上优于现有方法。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16282 2026-04-10 cs.CL cs.AI 62%

Generating Literature-Driven Scientific Theories at Scale

大规模生成文献驱动的科学理论

Peter Jansen, Peter Clark, Doug Downey, Daniel S. Weld

机构 * Allen Institute for Artificial Intelligence(艾伦人工智能研究所) University of Arizona(亚利桑那大学) University of Washington(华盛顿大学)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究通过大规模文献数据生成科学理论,比较文献基础与参数知识生成对理论质量和预测能力的影响。

Comments 9 pages plus appendix, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08203 2026-04-10 cs.CV cs.AI 57%

MedVR: Annotation-Free Medical Visual Reasoning via Agentic Reinforcement Learning

MedVR:通过代理强化学习实现无标注的医学视觉推理

Zheng Jiang, Heng Guo, Chengyu Fang, Changchen Xiao, Xinyang Hu, Lifeng Sun, Minfeng Xu

机构 * Tsinghua University(清华大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院) Hupan Lab(湖畔实验室) Key Laboratory of Pervasive Computing, Ministry of Education(教育部普适计算重点实验室) Zhejiang University(浙江大学)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 MedVR通过代理强化学习实现无标注的医学视觉推理,利用熵引导的视觉重定位和基于共识的信用分配机制,在多个公开医学VQA基准上取得最佳性能,提升医疗AI的鲁棒性和透明度。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07895 2026-04-10 cs.AI 57%

DialBGM: A Benchmark for Background Music Recommendation from Everyday Multi-Turn Dialogues

DialBGM:从日常多轮对话中推荐背景音乐的基准测试

Joonhyeok Shin, Jaehoon Kang, Yujun Lee, Hannah Lee, Yejin Lee, Yoonji Park, Kyuhong Shim

机构 * Sungkyunkwan University(成均馆大学)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 本文提出DialBGM基准测试,通过1200个日常对话数据,评估模型在无音乐描述的多轮对话中推荐非侵入性背景音乐的能力,发现现有模型在Hit@1指标上远低于人类判断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05702 2026-04-10 cs.CL cs.HC 57%

Dialogue Act Patterns in GenAI-Mediated L2 Oral Practice: A Sequential Analysis of Learner-Chatbot Interactions

对话行为模式在生成式人工智能中介的第二语言口语练习中的研究:学习者与聊天机器人互动的序列分析

Liqun He, Shijun, Chen, Mutlu Cukurova, Manolis Mavrikis

机构 * University College London(伦敦大学学院) University of Hong Kong(香港大学)

专题命中 领域大模型 :prompting(abstract);分类 cs.CL

AI总结 研究探讨了生成式人工智能中介的第二语言口语练习中学习者与聊天机器人互动的对话行为模式,通过分析12名学生10周内的70次互动,发现高进展会话中学习者提问更多,低进展会话中澄清寻求更频繁,反馈类型和时机对有效互动有重要影响。

Comments Accepted for publication as a full paper (Main Track) at the 27th International Conference on Artificial Intelligence in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03317 2026-04-10 cs.CV 50%

Gaze to Insight: A Scalable AI Approach for Detecting Gaze Behaviours in Face-to-Face Collaborative Learning

目光到洞察:一种可扩展的AI方法用于检测面对面协作学习中的目光行为

Junyuan Liang, Qi Zhou, Sahan Bulathwela, Mutlu Cukurova

机构 * UCL Knowledge Lab, University College London(伦敦大学学院UCL知识实验室) UCL Center for Artificial Intelligence, University College London(伦敦大学学院UCL人工智能中心)

专题命中 领域大模型 :foundation model(abstract)

AI总结 本文提出一种可扩展的AI方法,利用预训练模型自动检测面对面协作学习中的目光行为,无需人工标注数据,实现高F1分数和跨配置鲁棒性。

Comments 15 pages, 6 figures, 2 tables, accepted by the 27th International Conference on Artificial Intelligence in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08167 2026-04-10 cs.CV 50%

T-Gated Adapter: A Lightweight Temporal Adapter for Vision-Language Medical Segmentation

T-Gated Adapter:一种轻量级时间适配器用于视觉-语言医学分割

Pranjal Khadka

机构 * Independent Researcher(独立研究员)

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出T-Gated Adapter,通过注入相邻切片上下文提升医学图像分割的连续性,实验表明在FLARE22、BTCV和AMOS22数据集上均取得显著提升,且在跨模态任务中表现优于传统3D模型。

Comments Accepted at the PHAROS-AIF-MIH Workshop at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏