arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-20 至 2026-04-20 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 19 篇

2604.15937 2026-04-20 cs.SI cs.AI cs.CL cs.CY cs.MA 92%

Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation

默认极化:在基于LLM的内容编排中审计推荐偏见

Nicolò Pagan, Christopher Barrie, Chris Andrew Bail, Petter Törnberg

机构 * University of Zurich, Department of Informatics(苏黎世大学信息学院) New York University, Department of Sociology(纽约大学社会学系) University of Oxford, Department of Sociology(牛津大学社会学系) Duke University, Department of Sociology, Computer Science, Political Science, and Public Policy(杜克大学社会学系、计算机科学、政治学和公共政策系) University of Amsterdam, Institute for Logic, Language and Computation (ILLC)(阿姆斯特丹大学逻辑、语言与计算研究所(ILLC))

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究通过模拟实验揭示LLM在内容选择中的偏见差异,发现极化效应普遍存在,不同提示策略对偏见影响显著,且政治倾向偏见在Twitter/X上表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06708 2026-04-20 cs.SE cs.AI 92%

AISysRev -- LLM-based Tool for Title-abstract Screening

AISysRev -- 基于 LLM 的标题-摘要筛选工具

Aleksi Huotala, Miikka Kuutila, Olli-Pekka Turtio, Simo Sipilä, Mika Mäntylä

机构 * University of Helsinki(赫尔辛基大学) LUT University(拉赫蒂理工大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 AISysRev 是一个基于大语言模型的标题-摘要筛选工具,通过容器化Web应用实现自动化筛选,支持多种LLM模型,减少文献评估负担,但需人类干预处理边界情况。

Comments 4 pages + references. Accepted for publication in the Companion Proceedings of the 34th ACM Symposium on the Foundations of Software Engineering (FSE '26), June 5--9, 2026, Montreal, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04847 2026-04-20 cs.SD cs.AI 89%

Language Models as Semantic Teachers: Post-Training Alignment for Medical Audio Understanding

语言模型作为语义教师:面向医学音频理解的后训练对齐

Tsai-Ning Wang, Lin-Lin Chen, Neil Zeghidour, Aaqib Saeed

机构 * Eindhoven University of Technology, The Netherlands(埃因霍温理工大学,荷兰) Kyutai, France(Kyutai公司,法国) Eindhoven Artificial Intelligence Systems Institute, The Netherlands(埃因霍温人工智能系统研究所,荷兰)

专题命中 领域大模型 :language model(title,abstract);post-training(title,abstract);large language model(abstract);分类 cs.AI

AI总结 本文提出AcuLa框架,通过将音频编码器与医学语言模型对齐,提升医学音频的语义理解能力,在18个心血管任务中取得最佳性能,显著提升诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04497 2026-04-20 cs.CL cs.AI 88%

Opportunities and Challenges of Large Language Models for Low-Resource Languages in Humanities Research

大型语言模型在人文学科研究中低资源语言的机会与挑战

Tianyang Zhong, Zhenyuan Yang, Zhengliang Liu, Ruidong Zhang, Weihang You, Yiheng Liu, Haiyang Sun, Yi Pan, Yiwei Li, Yifan Zhou, Hanqi Jiang, Junhao Chen, Xiang Li, Tianming Liu

机构 * School of Computing, The University of Georgia(佐治亚大学计算机学院) Department of Mathematical and Statistical Sciences, University of Alberta(阿尔伯塔大学数学与统计科学系) University of California, Los Angeles(加州大学洛杉矶分校) Department of Radiology, Massachusetts General Hospital and Harvard Medical School(麻省总医院放射科和哈佛医学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了大型语言模型在低资源语言研究中的应用,分析了数据获取、模型适应性和文化敏感性等挑战,并强调了跨学科合作与定制模型的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21950 2026-04-20 cs.CL 88%

MEDSYN: Benchmarking Multi-EviDence SYNthesis in Complex Clinical Cases for Multimodal Large Language Models

MEDSYN:多证据合成在复杂临床病例中的基准测试用于多模态大语言模型

Boqi Chen, Xudong Liu, Jiachuan Peng, Marianne Frey-Marti, Bang Zheng, Kyle Lam, Lin Li, Jianing Qiu

机构 * ETH Zurich(苏黎世联邦理工学院) MBZUAI(马克斯·普朗克人工智能研究所) Amazon(亚马逊) University of Oxford(牛津大学) University of Bern(伯尔尼大学) Imperial College London(伦敦帝国理工学院) Peking University(北京大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 MEDSYN是一个多语言、多模态的复杂临床病例基准测试,用于评估多模态大语言模型在差分诊断和最终诊断中的表现,揭示模型在异质临床证据合成中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12858 2026-04-20 cs.LG cs.AI 88%

Information-Consistent Language Model Recommendations through Group Relative Policy Optimization

通过群体相对策略优化实现信息一致的语言模型推荐

Sonal Prabhune, Balaji Padmanabhan, Kaushik Dutta

专题命中 领域大模型 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于群体相对策略优化的强化学习框架,旨在提升语言模型在等效提示下的信息一致性,通过熵基帮助性和稳定性奖励优化模型稳定性。

Journal ref 2026 IEEE Conference on Artificial Intelligence (CAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15593 2026-04-20 cs.CL cs.AI 84%

DALM: A Domain-Algebraic Language Model via Three-Phase Structured Generation

DALM:通过三阶段结构生成的领域代数语言模型

Chao Li

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 DALM通过三阶段结构生成框架,利用领域格子进行约束生成,解决领域不确定性、关系不确定性和概念不确定性,实现跨领域污染控制和多视角回答空间生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16258 2026-04-20 cs.AI 83%

Characterising LLM-Generated Competency Questions: a Cross-Domain Empirical Study using Open and Closed Models

表征大语言模型生成的能力问题:使用开放和封闭模型的跨领域实证研究

Reham Alharbi, Valentina Tamma, Terry R. Payne, Jacopo de Berardinis

机构 * Taibah University, Madinah, Saudi Arabia(塔伊卜大学,麦地那,沙特阿拉伯) University of Liverpool, Liverpool, UK(利物浦大学,利物浦,英国)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 本文通过跨领域分析,系统比较了不同大语言模型生成的能力问题在可读性、相关性和结构复杂性方面的特性。

Comments arXiv admin note: text overlap with arXiv:2507.02989

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16727 2026-04-20 cs.AI 83%

Deliberative Searcher: Improving LLM Reliability via Reinforcement Learning with constraints

反思搜索器:通过带有约束的强化学习提高大语言模型的可靠性

Zhenyun Yin, Shujie Wang, Xuhong Wang, Xingjun Ma, Yinchun Wang

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出反思搜索器框架,结合置信度校准与基于检索的搜索,通过强化学习优化准确性,提升模型输出的可靠性。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18142 2026-04-20 cs.HC cs.CY cs.IR 80%

Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation

镜像用户:构建基于用户反馈的偏好对齐用户模拟器

Tianjun Wei, Huizhong Guo, Yingpeng Du, Zhu Sun, Huang Chen, Dongxia Wang, Jie Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种基于用户反馈的用户模拟器构建框架,通过生成高质量模拟数据提升推荐系统与用户偏好的对齐能力,并通过实验验证其有效性。

Comments ACL 2026 Main. Github: https://github.com/Joinn99/UserMirrorer

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15341 2026-04-20 cs.HC cs.AI 79%

MRGEN: A Conceptual Framework for LLM-Powered Mixed Reality Authoring Tools for Education

MRGEN:一种基于大语言模型的混合现实教育作者工具的概念框架

Mohammed Oussama Seddini, Mohamed Ez-Zaouia, Ngoc Luyen Le, Iza Marfisi

机构 * LIUM, Le Mans Université(里摩斯大学) IRISA, Université de Rennes(里莫斯大学)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出MRGEN框架,利用大语言模型帮助教师创建适用于移动设备的混合现实学习活动,实验显示AI辅助显著缩短任务时间,90%以上参与者认为AI支持有助于构思和对齐学习目标。

Journal ref The Mobile Learning 2026 International Conference, Mar 2026, Zagreb, Croatia

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15717 2026-04-20 cs.CR 78%

Into the Gray Zone: Domain Contexts Can Blur LLM Safety Boundaries

进入灰色区域:领域上下文可以模糊大语言模型安全边界

Ki Sen Hung, Xi Yang, Chang Liu, Haoran Li, Kejiang Chen, Changxuan Fan, Tsun On Kwok, Weiming Zhang, Xiaomeng Li, Yangqiu Song

专题命中 领域大模型 :LLM(title,abstract)

AI总结 研究探讨了领域上下文如何模糊大语言模型的安全边界,提出Jargon框架通过多轮对抗交互提升攻击成功率,通过激活空间分析揭示灰色区域的不可靠性,并设计政策引导的防护策略以减少攻击成功率。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16117 2026-04-20 cs.LG cs.AI 73%

SCRIPT: Implementing an Intelligent Tutoring System for Programming in a German University Context

SCRIPT: 实现一个面向德国大学的智能编程辅导系统

Alina Deriyeva, Jesper Dannath, Benjamin Paassen

机构 * Faculty of Technology, Bielefeld University(比勒菲尔德大学技术学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个适应性强的Python编程智能辅导系统,结合大语言模型提供提示机制,并符合德国数据保护法规和AI伦理框架。

Comments In: Cristea, A.I., Walker, E., Lu, Y., Santos, O.C., Isotani, S. (eds) Artificial Intelligence in Education. Posters and Late Breaking Results, Workshops and Tutorials, Industry and Innovation Tracks, Practitioners, Doctoral Consortium, Blue Sky, and WideAIED. AIED 2025. Communications in Computer and Information Science, vol 2590 . Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15646 2026-04-20 cs.CL 70%

FD-NL2SQL: Feedback-Driven Clinical NL2SQL that Improves with Use

FD-NL2SQL:基于反馈的临床自然语言到SQL转换系统,使用越越好

Suparno Roy Chowdhury, Tejas Anvekar, Manan Roy Choudhury, Muhammad Ali Khan, Kaneez Zahra Rubab Khakwani, Mohamad Bassam Sonbol, Irbaz Bin Riaz, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学) Mayo Clinic(梅奥诊所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出FD-NL2SQL,一种基于反馈的临床自然语言到SQL转换系统,通过用户反馈不断优化查询生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15327 2026-04-20 cs.HC cs.AI 70%

Eco-Bee: A Personalised Multi-Modal Agent for Advancing Student Climate Awareness and Sustainable Behaviour in Campus Ecosystems

Eco-Bee:一种面向校园生态系统的个性化多模态代理,用于提升学生气候意识和可持续行为

Caleb Adu, Neil Kapadia, Binhe Liu, Jonathan Randall, Sruthi Viswanathan

机构 * University of Hull(赫尔大学) The Spaceship Academy(太空学院) City St George’s, University of London(伦敦大学城市学院) King’s College London(伦敦国王学院) Lancaster University(兰卡斯特大学) University of Oxford(牛津大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Eco-Bee通过整合大语言模型、行星边界框架(Eco-Score)和对话代理,为学生提供个性化反馈和行为激励,推动校园可持续发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23304 2026-04-20 cs.CV cs.AI 70%

MedGemma vs GPT-4: Open-Source and Proprietary Zero-shot Medical Disease Classification from Images

MedGemma vs GPT-4:开源与专有零样本医学疾病图像分类

Md. Sazzadul Islam Prottasha, Nabil Walid Rafi

机构 * Department of Information and Communication Technology, Bangladesh University of Professionals(信息与通信技术系,孟加拉国专业大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文比较了开源MedGemma与专有GPT-4在医学图像零样本疾病分类中的性能,MedGemma通过LoRA微调在准确率和敏感性上均表现更优,凸显了领域特定微调对临床应用的重要性。

Comments Accepted for publication in the Journal of Machine Learning and Deep Learning (JMLDL). 9 pages, 9 figures, 10 tables

Journal ref Journal of Machine Learning and Deep Learning, Vol. 2, No. 2, pp. 1-9, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16175 2026-04-20 cs.AI cs.CV 57%

MARCH: Multi-Agent Radiology Clinical Hierarchy for CT Report Generation

MARCH:多智能体放射科临床层级用于CT报告生成

Yi Lin, Yihao Ding, Yonghui Wu, Yifan Peng

机构 * Weill Cornell Medicine(韦尔·科恩医学中心) University of Western Australia(西澳大学) University of Florida(佛罗里达大学)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 MARCH通过模拟放射科专业层级,采用多智能体框架提升CT报告生成的临床准确性和语言准确性。

Comments Accepted by ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15821 2026-04-20 cs.DC cs.LG 57%

Breaking the Training Barrier of Billion-Parameter Universal Machine Learning Interatomic Potentials

突破十亿参数通用机器学习互原子势的训练障碍

Yuanchang Zhou, Hongyu Wang, Yiming Du, Yan Wang, Mingzhen Li, Siyu Hu, Xiangyu Zhang, Weijian Liu, Chen Wang, Zhuoqiang Guo, Long Wang, Jingde Bu, Yutong Lu, Guangming Tan, Weile Jia

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所 processors 国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Independent Researcher(独立研究者) Sun Yat-Sen University(中山大学)

专题命中 领域大模型 :foundation model(abstract);分类 cs.LG

AI总结 本文提出MatRIS-MoE和Janus框架,解决十亿参数uMLIP训练中的高维分布式训练与计算效率问题,将训练时间从周缩短至小时,为AI4S基础模型树立新标杆。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13590 2026-04-20 eess.IV cs.AI cs.CV 57%

Intelligent Healthcare Imaging Platform: A VLM-Based Framework for Automated Medical Image Analysis and Clinical Report Generation

智能医疗影像平台:基于视觉语言模型的自动化医学图像分析与临床报告生成框架

Samer Al-Hamadani

机构 * Automated Manufacturing Department/Al-Khwarizmi College of Engineering/ University of Baghdad/Gilgamesh University(自动化制造部门/阿尔·卡瓦尔齐米工程学院/巴格达大学/吉尔伽美什大学)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 本文提出基于视觉语言模型的智能多模态框架,用于自动化医学图像分析和临床报告生成,结合视觉特征提取与自然语言处理,实现上下文图像解释,并通过多层可视化技术提升临床信心。

Comments 32 pages, 14 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏