arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12565 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12565 篇

2601.20316 2026-01-29 cs.IR cs.LG 85%

Less is More: Benchmarking LLM Based Recommendation Agents

少即是多:基于大语言模型的推荐代理基准测试

Kargi Chauhan, Mahalakshmi Venkateswarlu

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文通过基准测试挑战了“更多上下文更好”的假设,发现较短上下文能有效降低推理成本而不影响推荐质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15058 2026-01-27 cs.CR cs.LG cs.SE 85%

LibLMFuzz: LLM-Augmented Fuzz Target Generation for Black-box Libraries

LibLMFuzz: 用于黑盒库的LLM增强模糊目标生成

Ian Hardgrove, John D. Hastings

机构 * The Beacom College of Computer and Cyber Sciences(计算机与网络科学学院) Dakota State University(达科他州立大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 LibLMFuzz通过结合LLM和轻量级工具链,实现对闭源库的自动模糊测试,生成正确驱动程序并提高覆盖率。

Comments 6 pages, 2 figures, 1 table, 2 listings

Journal ref 2025 IEEE Cyber Awareness and Research Symposium (CARS'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15306 2026-01-23 cs.AI 85%

Uncovering Latent Bias in LLM-Based Emergency Department Triage Through Proxy Variables

通过代理变量揭示基于LLM的急诊科分诊中的潜在偏见

Ethan Zhang

机构 * Palo Alto High School(帕洛阿尔托高中)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究通过代理变量揭示基于LLM的急诊科分诊中的潜在偏见,发现LLMs在输入上下文中会修改对患者严重程度的感知,表明AI系统仍需改进以确保临床应用的安全性。

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06111 2026-01-22 cs.AI cs.CY 85%

LLM Powered Social Digital Twins: A Framework for Simulating Population Behavioral Response to Policy Interventions

由大型语言模型驱动的社会数字孪生:一种用于模拟人口对政策干预反应的框架

Fatima Koaik, Aayush Gupta, Farahan Raza Sheikh

机构 * PwC(普华永道)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种由大型语言模型驱动的社会数字孪生框架,用于模拟人群对政策干预的反应,通过校准层实现对真实数据的验证,并在疫情期间展示了20.7%的预测误差改进。

Comments 13 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15091 2026-01-22 cs.IR cs.AI 85%

ThinkRec: Thinking-based recommendation via LLM

ThinkRec: 基于思考的推荐方法

Qihang Yu, Kairui Fu, Zheqi Lv, Shengyu Zhang, Xinhui Wu, Chen Lin, Feng Wei, Bo Zheng, Fei Wu

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ThinkRec通过引入思考激活机制和实例级专家融合机制,提升推荐系统的准确性和可解释性。

Comments Published on WWW'26: In Proceedings of the ACM Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14154 2026-01-21 cs.CV cs.AI 85%

LLM Augmented Intervenable Multimodal Adaptor for Post-operative Complication Prediction in Lung Cancer Surgery

基于大语言模型的可干预多模态适配器用于肺癌手术后并发症预测

Shubham Pandey, Bhavin Jawade, Srirangaraj Setlur, Venu Govindaraju, Kenneth Seastedt

机构 * University at Buffalo(布法罗大学) Roswell Park Comprehensive Cancer Center(罗斯威尔帕克综合癌症中心)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MIRACLE通过整合术前临床和放射学数据,利用超球面嵌入空间和干预式深度学习模块,实现肺癌手术后并发症风险的预测与可解释性管理。

Comments Accepted to P2P-CV @ WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08710 2026-01-21 cs.CL 85%

Thinking Longer, Not Always Smarter: Evaluating LLM Capabilities in Hierarchical Legal Reasoning

深入思考,而非总是更聪明:评估大语言模型在分层法律推理中的能力

Li Zhang, Matthias Grabmair, Morgan Gray, Kevin Ashley

机构 * University of Pittsburgh(匹兹堡大学) Technical University of Munich(慕尼黑技术大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一个框架评估大语言模型在分层法律推理中的能力,发现模型在表面推理准确但分层推理表现下降,揭示了模型在复杂领域中的局限性。

Comments 15 pages, 7 figures, Proceedings of the 2026 Symposium on Computer Science and Law (CSLAW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11124 2026-01-19 cs.IR cs.AI 85%

Learn Before Represent: Bridging Generative and Contrastive Learning for Domain-Specific LLM Embeddings

在表示之前学习:连接生成学习与对比学习以构建领域特定的LLM嵌入

Xiaoyu Liang, Yuchen Peng, Jiale Luo, Wenhao Wang, Haoji Hu, Xincheng Zhou

机构 * Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LBR框架,通过生成学习和对比学习结合,在垂直领域中提升LLM嵌入的准确性和鲁棒性。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08858 2026-01-15 cs.SE cs.AI cs.CY 85%

Adaptive Trust Metrics for Multi-LLM Systems: Enhancing Reliability in Regulated Industries

多LLM系统的自适应信任度量:在受监管行业中的可靠性增强

Tejaswini Bollikonda

机构 * Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种用于多LLM系统的自适应信任度量框架,通过分析系统行为和不确定性评估,提升受监管行业中的AI可靠性与安全性。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05547 2026-01-09 cs.CV cs.AI 85%

Automated Invoice Data Extraction: Using LLM and OCR

自动化发票数据提取:利用大语言模型和OCR

Khushi Khanchandani, Advait Thakur, Akshita Shetty, Chaitravi Reddy, Ritisa Behera

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一个结合OCR、深度学习、LLMs和图分析的AI平台,以提高发票数据提取的质量和一致性。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02511 2026-01-07 cs.LG 85%

LLM-Enhanced Reinforcement Learning for Time Series Anomaly Detection

基于大语言模型的强化学习用于时间序列异常检测

Bahareh Golchin, Banafsheh Rekabdar, Danielle Justo

机构 * dept. Computer Science Portland State University(计算机科学系波特兰州立大学) dept. Computer Science Smith College(计算机科学系史密斯学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出结合大语言模型与强化学习的统一框架,通过奖励塑造、动态奖励缩放和主动学习提升时间序列异常检测的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01609 2026-01-06 cs.AI 85%

Structured Decomposition for LLM Reasoning: Cross-Domain Validation and Semantic Web Integration

结构分解用于LLM推理:跨领域验证与语义网集成

Albert Sadowski, Jarosław A. Chudziak

机构 * Warsaw University of Technology(华沙技术大学)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出结构分解框架,结合LLM与符号推理,通过本体填充和符号验证提升跨领域推理的准确性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01357 2026-01-06 cs.LG physics.flu-dyn 85%

Towards LLM-enabled autonomous combustion research: A literature-aware agent for self-corrective modeling workflows

迈向基于大语言模型的自主燃烧研究:一种文献感知的代理用于自修正建模工作流

Ke Xiao, Haoze Zhang, Runze Mao, Han Li, Zhi X. Chen

机构 * State Key Laboratory of Turbulence and Complex Systems, School of Mechanics and Engineering Science, Peking University(湍流与复杂系统国家重点实验室,力学与工程科学学院,北京大学) AI for Science Institute (AISI)(人工智能科学研究院(AISI))

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 FlamePilot是一种基于大语言模型的代理,通过自动化和自修正的CFD工作流提升燃烧建模研究效率,实现高可执行性和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01118 2026-01-06 cs.IR cs.AI cs.DL 85%

ScienceDB AI: An LLM-Driven Agentic Recommender System for Large-Scale Scientific Data Sharing Services

ScienceDB AI: 基于大语言模型的代理推荐系统用于大规模科学数据共享服务

Qingqing Long, Haotian Chen, Chenyang Zhao, Xiaolei Du, Xuezhi Wang, Pengyao Wang, Chengzan Li, Yuanchun Zhou, Hengshu Zhu

机构 * Computer Network Information Center, Chinese Academy of Sciences, Beijing, China(中国科学院计算机网络信息中心)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ScienceDB AI 是首个基于大语言模型的对话推荐系统,专为大规模科学数据共享服务设计,通过自然语言对话和深度推理实现精准的数据集推荐。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22396 2025-12-30 cs.AI cond-mat.mtrl-sci cs.IR 85%

HalluMat: Detecting Hallucinations in LLM-Generated Materials Science Content Through Multi-Stage Verification

HalluMat: 通过多阶段验证检测LLM生成的材料科学内容中的幻觉

Bhanu Prakash Vangala, Sajid Mahmud, Pawan Neupane, Joel Selvaraj, Jianlin Cheng

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 HalluMat通过多阶段验证框架检测LLM生成的材料科学内容中的幻觉,减少30%的幻觉率并引入PHCS量化响应不一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21526 2025-12-29 cs.IR cs.AI 85%

Selective LLM-Guided Regularization for Enhancing Recommendation Models

选择性LLM引导的正则化以增强推荐模型

Shanglin Yang, Zhan Shi

机构 * SCU(四川大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出选择性LLM引导正则化方法,通过离线方式利用LLM的排序能力,提升推荐模型在冷启动和长尾场景中的表现。

Journal ref WSDM 2026 Workshop on Generative AI for Recommender Systems and Personalization

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12817 2025-12-22 cs.LG 85%

Assessing Automated Fact-Checking for Medical LLM Responses with Knowledge Graphs

利用知识图谱评估医疗大语言模型响应的自动事实核查

Shasha Zhou, Mingyu Huang, Jack Cole, Charles Britton, Ming Yin, Jan Wolber, Ke Li

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出FAITH框架,利用医学知识图谱评估医疗大语言模型响应的事实性,证明其在医疗领域具有较高的可靠性与实用性。

Comments Accepted as a conference paper at AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17913 2025-12-22 cs.MA cs.AI cs.CY 85%

TACLA: An LLM-Based Multi-Agent Tool for Transactional Analysis Training in Education

TACLA: 基于LLM的多智能体工具用于教育中的交易分析训练

Monika Zamojska, Jarosław A. Chudziak

机构 * Faculty of Electronics and Information Technology(电子与信息技术学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TACLA是一种基于LLM的多智能体工具,通过整合交易分析原理,实现教育场景中真实的情感状态转变和冲突模拟,提升AI在教育中的应用效果。

Comments Accepted for publication in the proceedings of ICTAI 2025

Journal ref IEEE 37th International Conference on Tools with Artificial Intelligence (ICTAI), Athens, Greece, 2025, pp. 313-320

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11661 2025-12-15 cs.HC cs.AI 85%

From Verification Burden to Trusted Collaboration: Design Goals for LLM-Assisted Literature Reviews

从验证负担到可信协作:LLM辅助文献综述的设计目标

Brenda Nogueira, Werner Geyer, Andrew Anderson, Toby Jia-Jun Li, Dongwhi Kim, Nuno Moniz, Nitesh V. Chawla

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文针对LLM辅助文献综述中的信任和协作问题,提出六个设计目标和框架,通过可视化、验证和反馈对齐提升可信度与协作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17918 2025-12-11 cs.LG 85%

LLM Meeting Decision Trees on Tabular Data

基于逻辑决策树的表格数据LLM决策树

Hangting Ye, Jinmeng Li, He Zhao, Dandan Guo, Yi Chang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) CSIRO’s Data61(CSIRO数据61) Monash University(墨尔本大学) International Center of Future Science, Jilin University(吉林大学未来科学国际中心) Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, MOE, China(知识驱动人机智能工程研究中心,教育部,中国)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出DeLTa方法,通过逻辑决策树规则中介将LLM整合到表格数据中,避免数据序列化,实现全数据学习,提升表格预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03737 2025-12-04 cs.CL cs.IR 85%

AR-Med: Automated Relevance Enhancement in Medical Search via LLM-Driven Information Augmentation

AR-Med: 通过LLM驱动的信息增强实现医疗搜索的自动化相关性增强

Chuyue Wang, Jie Feng, Yuxi Wu, Hang Zhang, Zhiguo Fan, Bing Cheng, Wei Lin

机构 * Meituan Inc.(美团公司) Tsinghua University(清华大学) Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AR-Med通过LLM驱动的信息增强,实现医疗搜索的自动化相关性提升,提高了准确性和用户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02058 2025-12-03 cs.CY cs.CL 85%

Misalignment of LLM-Generated Personas with Human Perceptions in Low-Resource Settings

在低资源环境下,LLM生成的人设与人类感知的错位

Tabia Tanzin Prama, Christopher M. Danforth, Peter Sheridan Dodds

机构 * Computational Story Lab(计算故事实验室) Vermont Complex Systems Institute(佛罗里达复杂系统研究所) Vermont Advanced Computing Center(佛罗里达高级计算中心) Department of Mathematics and Statistics(数学与统计学系) Department of Computer Science University of Vermont(佛罗里达大学计算机科学系) Santa Fe Institute(圣菲研究所)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究发现,在低资源环境中,LLM生成的人设在共情和可信度方面显著劣于人类,需通过现实数据验证以确保其可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21920 2025-12-01 cs.SE cs.AI 85%

Toward Automated and Trustworthy Scientific Analysis and Visualization with LLM-Generated Code

迈向基于LLM生成代码的自动化和可信的科学分析与可视化

Apu Kumar Chakroborti, Yi Ding, Lipeng Wan

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了LLM生成代码在科学分析与可视化中的可信度与自动化潜力,提出三种策略提升代码执行成功率与质量,强调需进一步优化以构建更可靠的AI辅助研究工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20942 2025-11-27 cs.AI 85%

Improving Procedural Skill Explanations via Constrained Generation: A Symbolic-LLM Hybrid Architecture

通过约束生成改进程序技能解释:一种符号-大语言模型混合架构

Rahul Dass, Thomas Bowlin, Zebing Li, Xiao Jin, Ashok Goel

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Ivy通过结合符号TMK模型与约束生成层,改进程序技能解释的结构和逻辑性,提升智能辅导系统的教育价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15974 2025-11-27 cs.AI 85%

KRAL: Knowledge and Reasoning Augmented Learning for LLM-assisted Clinical Antimicrobial Therapy

KRAL: 用于LLM辅助临床抗菌治疗的知识与推理增强学习

Zhe Li, Yehan Qiu, Yujie Chen, Xiang Zhou

机构 * Information Center, State Key Laboratory of Complex Severe and Rare Diseases, Peking Union Medical College Hospital(信息中心、复杂严重罕见疾病国家重点实验室、北京友谊医院) Department of Critical Care Medicine, State Key Laboratory of Complex Severe and Rare Diseases, Peking Union Medical College Hospital, Peking Union Medical College and Chinese Academy of Medical Sciences(重症医学科、复杂严重罕见疾病国家重点实验室、北京友谊医院、北京友谊医院和中国医学科学院) Medical Intensive Care Unit, State Key Laboratory of Complex Severe and Rare Diseases, Peking Union Medical College Hospital, Peking Union Medical College and Chinese Academy of Medical Sciences(医疗重症病房、复杂严重罕见疾病国家重点实验室、北京友谊医院、北京友谊医院和中国医学科学院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 KRAL通过知识与推理增强学习提升LLM在临床抗菌治疗中的诊断能力,以低成本高效方式优化医疗决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19083 2025-11-25 cs.CL 85%

A Multi-Agent LLM Framework for Multi-Domain Low-Resource In-Context NER via Knowledge Retrieval, Disambiguation and Reflective Analysis

面向多领域低资源情境命名实体识别的多智能体LLM框架:通过知识检索、消歧和反思分析

Wenxuan Mu, Jinzhong Ning, Di Zhao, Yijia Zhang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 KDR-Agent通过知识检索、消歧和反思分析,提升多领域低资源情境下命名实体识别的性能

Comments This paper has been accepted by AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15456 2025-11-20 cs.AI q-fin.GN 85%

Know Your Intent: An Autonomous Multi-Perspective LLM Agent Framework for DeFi User Transaction Intent Mining

了解您的意图:一种自主多视角大语言模型代理框架用于DeFi用户交易意图挖掘

Qian'ang Mao, Yuxuan Zhang, Jiaman Chen, Wenjun Zhou, Jiaqi Yan

机构 * Nanjing University(南京大学) The University of Tennessee, Knoxville(田纳西大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出TIM框架,通过多视角LLM代理系统挖掘DeFi用户交易意图,提升意图推断的准确性和可验证性。

Comments Written in 2025 Q1

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14221 2025-11-19 cs.IR cs.AI 85%

LLM-Aligned Geographic Item Tokenization for Local-Life Recommendation

Hao Jiang, Guoquan Wang, Donglin Zhou, Sheng Yu, Yang Zeng, Wencong Zeng, Kun Gai, Guorui Zhou

机构 * Kuaishou Technology(快手科技)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03758 2025-11-19 physics.soc-ph cs.AI cs.CY cs.MA cs.SI 85%

Leveraging LLM-based agents for social science research: insights from citation network simulations

Jiarui Ji, Runlin Lei, Xuchen Pan, Zhewei Wei, Hao Sun, Yankai Lin, Xu Chen, Yongzheng Yang, Yaliang Li, Bolin Ding, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence(北京中国人民大学人工智能学院) School of Public Administration and Policy(公共行政与政策学院) Alibaba Group(阿里巴巴集团)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments accepted by HSSCOMMS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03661 2025-11-18 cs.AI astro-ph.HE astro-ph.IM gr-qc 85%

Automated Algorithmic Discovery for Scientific Computing through LLM-Guided Evolutionary Search: A Case Study in Gravitational-Wave Detection

He Wang, Liang Zeng

机构 * International Centre for Theoretical Physics Asia-Pacific(国际理论物理中心亚太中心) University of Chinese Academy of Sciences(中国科学院大学) Taiji Laboratory for Gravitational Wave Universe(引力波宇宙Taiji实验室) Tsinghua University(清华大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 76 pages (28 main), with 6+6 figures and 2 tables, substantially revised with improved structure and clarity

详情

展开后加载摘要…

URL PDF HTML 收藏