arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 840 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 840 篇

2608.13369 2026-08-14 cs.CY 新提交 67%

Credible, Not Always Correct: How Reddit Users Verify AI-Generated Legal Advice

可信,未必正确:Reddit用户如何验证AI生成的法律建议

Rebecca Owens, Yusuf Mücahit Çetinkaya, Stergios Aidinlis, Dhyey Mehta, Tuğrulcan Elmas

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文通过分析Reddit平台的用户叙事与社区反应,揭示AI生成法律建议的可信度源于社会建构而非准确性,多数用户仅凭其形式与情感安慰就采纳,少数采用分布式法律咨询的验证方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13122 2026-08-14 cs.DC 新提交 67%

Validation-Centric AI-Assisted GPU Porting of a 250,000+ Line Legacy Weather Simulation Code

面向验证的25万行以上遗留气象模拟代码的AI辅助GPU移植

Tetsuya Hoshino, Masaya Kato, Kazuhisa Tsuboki, Daichi Mukunoki, Takahiro Katagiri, Toshihiro Hanawa

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文以遗留Fortran气象模拟代码CReSS为例,提出面向验证的AI辅助GPU移植工作流,为162个内核生成经数值验证的GPU实现,获5.1倍应用级加速,还检测到5个内核的数值不一致。

Comments 11 pages, 1 figure, 3 tables. Submitted to AgenticAI4HPC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11090 2026-08-12 cs.CY 新提交 67%

Who Uses Open-Weight Models? China and the Shifting Geography of AI in Science

谁在使用开放权重模型?中国与科学领域AI的地理格局变迁

Zackary Okun Dunivin

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 该研究分析2100万篇论文发现,GPT系列主导AI研究,开放权重模型使用量升至2026年的44.0%,中国机构研究人员采用率是其他机构的2.23倍,推动了开放权重模型的采用,反映AI模型生态的地缘文化重组。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10175 2026-08-12 cs.MA q-fin.PM 新提交 67%

Beyond Cash Flows: A Multi-Agent AI Framework for Valuing Clinical-Stage, Cross-Border Biotechnology

超越现金流:用于临床阶段跨境生物技术估值的多智能体AI框架

Yuhan Fang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文针对临床阶段生物技术估值的现金流假设失效问题,提出多智能体AI框架,其含估值层、跨市场协调层与冲突融合机制,基于作者过往实践确立智能体投资系统设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08844 2026-08-11 cs.CV 新提交 67%

Toward Mask Annotation-Free Surgical Instrument Segmentation from Endoscopic Images Using Text-Prompted Segment Anything Model 3 (SAM3)

基于文本提示的Segment Anything Model 3(SAM3)实现无掩码标注的内镜图像手术器械分割

Nakul Poudel, Richard Simon, Cristian A. Linte

机构 * Rochester Institute of Technology(罗切斯特理工学院)

专题命中 领域大模型 :language model(abstract);prompting(abstract)

AI总结 本文提出基于SAM3与微调Qwen的两阶段框架,无需标注即可实现内镜图像的手术器械实例级分割,在EndoVis数据集上性能优于直接使用SAM3,为无标注分割提供了新方向。

Comments Accepted at the Medical Image Understanding and Analysis (MIUA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08417 2026-08-11 cs.IR 新提交 67%

Personalized Communication Skills for Agentic Recommender Systems

面向智能体推荐系统的个性化沟通技能

Zongwei Wang, Min Gao, Guangyu Hu, Xinyi Gao, Junliang Yu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 针对现有智能体推荐系统用户智能体视角狭窄的问题,提出AgentCom个性化沟通技能框架,通过「为什么-是什么-如何-谁」技能库及两种机制提升推荐性能,在三类推荐器中均有效。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07407 2026-08-10 math.OC 新提交 67%

A Domain-Specific Harness for End-to-End Automation of Optimization Research

面向优化研究端到端自动化的领域专用工具链

Heechang Kim, Ernest K. Ryu, Shuvomoy Das Gupta

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出AutoOPT工具链,将优化研究自动化分为四阶段,通过两个案例研究验证其可发现新型加速梯度方法ITEM-f的解析描述,且相关定理已在Lean 4中形式化验证。

Comments 66 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05691 2026-08-07 cs.CV 新提交 67%

SciQNet: Two-Stage Multimodal Adaptation for Scientific Image Quality Assessment

SciQNet:面向科学图像质量评估的两阶段多模态适配框架

Yin-Loon Khor, Yi-Jie Wong, Jing Jie Tan, Ming Jie Lee

机构 * Universiti Malaya(马来亚大学) Universiti Tunku Abdul Rahman(拉曼大学) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :instruction tuning(abstract);pretraining(abstract)

AI总结 本研究提出SciQNet两阶段多模态适配框架,在ICME 2026科学图像质量评估挑战赛评分赛道获第2,模型在SIQA-S、SIQA-U等指标表现优异,证实预训练数据相关性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03272 2026-08-05 cs.IR cs.CR cs.MA cs.SI 新提交 67%

Attacking and Defending Multi-Agent Collaborative Filtering Systems Through Connectivity

通过连通性对多智能体协同过滤系统发起攻击与防御

Anjun Hu, Hanting Xie, Saranya Govindan, Jas Kandola, Kurt Cutajar

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 本研究将MAS的攻击与防御方法适配到AgentCF框架下的智能体CF场景,表征连通性对攻防结果的影响,还探索了流行病启发指标用于CF配置的健壮性评估。

Comments 10 pages, 10 figures, 20th ACM Conference on Recommender Systems (RecSys '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01846 2026-08-04 cs.IR 新提交 67%

HyperAgent4POI: Dynamic Semantic Message Passing on Multi-Agent Hypergraphs for Missing-Modality Recommendation

HyperAgent4POI:面向缺失模态推荐的多智能体超图上的动态语义消息传递

Jinze Wang, Yuze Liu, Tiehua Zhang, Jiong Jin, Zhu Sun

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 HyperAgent4POI通过动态语义消息传递在多智能体超图中补全缺失模态,在三个LBSN数据集上较15个基线实现排序提升,60%模态缺失率下NDCG@20平均提升8.2%,且推理效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01346 2026-08-04 cs.CY 新提交 67%

Hybrid AI for Explainable and Accurate Conversational Agents in eGovernment

用于电子政务中可解释且准确的对话智能体的混合人工智能

Ilias Chalkidis, Vlad Paul Cosma, Søren Debois, Daniel Hershcovich, Thomas Hildebrandt, Hugo A. Lòpez, Amogh Raina, Konstantinos Varvoutas, Tilman Zuckmantel

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出对话式混合人工智能(CHAI)架构,结合大型语言模型与基于规则的控制器,采用DCR图作为建模语言,构建电子政务领域可解释且准确的对话智能体,已在新冠聊天机器人及残疾学生助学金案件管理中应用。

Comments Presented at AIDA2J Workshop at ICAIL 2026, SMU, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27298 2026-07-31 cs.LO 新提交 67%

From Lecture Notes to Lean: Formalizing a Textbook on Probability Theory

从讲义到Lean:形式化一本概率论教材

Shuo Deng, Kenneth W. Shum

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文开展Lean形式化工作,对一本14章的概率论教材进行形式化,生成机器可验证配套资料,复用Mathlib结果并引入接口引理,为AI辅助数学构建形式化基础。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26526 2026-07-30 cs.HC 新提交 67%

A Design Study on Voice-based Interaction for Immersive Network Visualization and Analysis

面向沉浸式网络可视化与分析的基于语音交互的设计研究

Sam Yu-Te Lee, Hsin-Ai Chen, Sarah Yuniar, David Bauer, Kwan-Liu Ma

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究通过研究驱动设计,设计了依托大语言模型的沉浸式网络可视化语音交互系统,经用户研究表明其可提升感知可用性、降低认知负荷,为沉浸式可视化提供设计启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25901 2026-07-29 cs.IR 新提交 67%

RecoReward: Recommender-Guided Multimodal Description Generation for Recommendation

RecoReward:用于推荐的推荐器引导多模态描述生成

Guohong Mu, Yueyang Liu, Jiangxia Cao, Changxin Lao, Zijie Zhuang, Yuhui Zhang, Jiaqi Feng, Ruochen Yang, Shuang Yang, Zhaojie Liu, Qibin Hou

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究针对多模态推荐中传统方法不足,提出RecoReward,训练时用行为衍生奖励,保留仅内容推理。在直播推荐中利用用户历史等估计亲和力,通过推荐器亲和力分数提供反馈,实验表明该方法能提升MLLM性能,利于下游推荐且保留内容服务。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23130 2026-07-28 stat.ME stat.ML 新提交 67%

Identification and Learning of Semantic Observation Kernels: Partial Observation, Uniform Recovery, & Minimax Limits

语义观察核的识别与学习:部分观察、一致恢复与极小极大极限

Matthew Francis Dixon

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 探讨可观察语言法则何时支持状态可重现后验概率,提出语义映射方法,保持语言法则非参数性且不使用隐藏模型量。理论上推导多项条件和率等,实证上通过模拟和研究验证相关指标,明确语言概率提供可审计状态测量的条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22606 2026-07-28 cs.CY 新提交 67%

Auditing Institutional Heterogeneity for Generative AI in Patient Education: A Large-Scale Study of 102 US Transplant Handbooks

审核患者教育中生成式人工智能的机构异质性:对102本美国移植手册的大规模研究

Yubo Li, Rema Padman, Ramayya Krishnan

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究针对美国23个移植中心的102本手册及相关患者问题,用结构化输出大语言模型评判器审核。发现机构编辑风格超越器官类型界限,信息差距在特定主题突出,分歧主题聚类,且可由问题框架预测分歧,探讨了对移植护理中部署生成式人工智能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21605 2026-07-27 cs.HC 新提交 67%

Natural Language Processing in Health Professions Education: A Scoping Review

卫生职业教育中的自然语言处理:一项范围综述

Javad Mohammad Alizadeh, Pegah Saebi, Mukesh Kumar Patel, Huanmei Wu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该范围综述遵循特定框架和指南,综合64项研究,梳理NLP和AI在卫生职业教育中的应用,确定七个主题领域,发现有技术前景但也有挑战,强调公共卫生教育是证据空白区及未来研究投资重点。

Comments This manuscript has been accepted at the 14th IEEE International Conference on Healthcare Informatics (ICHI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21513 2026-07-24 cs.HC cs.IR 新提交 67%

Transparent by Design, Usable in Practice? A Formative Usability Study of a Conversational Product Advisor

设计透明,实践可用?对话式产品顾问的形成性可用性研究

Kevin Schott, Dagmar Kern, Daniel Hienert

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究对话式产品顾问的可用性,通过对含受限自然语言生成等功能的笔记本搜索聊天机器人进行研究,发现设计透明不保证理解,排名解释有严重问题,参与者虽看重省力但希望有更多直接操作控件,贡献了可用性问题及设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18519 2026-07-22 cs.AR 新提交 67%

A Progressive Approach to Synthesizable RTL Design Generation Using LLMs

一种使用大语言模型生成可综合 RTL 设计的渐进式方法

Xiangfei Kong, Tasnim Tabassum, Marwan Abdelwahab, Hao Zheng

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究利用大语言模型从自然语言规范生成RTL设计时的问题,提出VeriRefine方法,将规范细化为明确描述并审核,生成代码后分类修复模拟失败,提升功能正确性,使可合成性成为结构属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17251 2026-07-21 cs.CV 新提交 67%

VecFontLLM: Anchor-Guided Direct Synthesis of Chinese Vector Fonts

VecFontLLM:基于锚点引导的中文矢量字体直接合成

Hao Yuan, Yuxuan Luo, Xing Chen, Zhouhui Lian

机构 * Fuzhou University(福州大学) Peking University(北京大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究旨在解决直接生成中文矢量字体的难题,提出VecFontLLM这一基于锚点引导的多模态大语言模型,通过锚点预测、细化及贝塞尔控制点完成来合成矢量字形,实现高质量少样本合成,实验显示其相比现有方法有显著优势。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16708 2026-07-21 cs.SE 新提交 67%

Model-Driven Discipline for Multi-Agent LLMs: Requirement-to-Verification Generation of Traceable System Models

多智能体大语言模型的模型驱动规范:可追溯系统模型的需求到验证生成

Ran Wei, Le Zhu, Haochi Wang, Ruizhe Yang, Jiapeng Guan, Siyuan Ji, Yuchen Hu, Zhe Jiang, Xiangyang Ji

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 针对软件复杂性问题,提出RADIANT方法,结合MDE与多智能体LLMs用于系统开发。能从需求模型自动生成异构模型及可追溯链接,进行变更影响分析和形式验证。评估显示可提高语法有效性和可执行性,减少开发时间并可跨领域应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14082 2026-07-16 quant-ph 新提交 67%

Building Shor's Algorithm in Lean: An Agentic Formalization of Quantum Attacks on RSA-2048 and P-256

在Lean中构建肖尔算法:对RSA - 2048和P - 256的量子攻击的智能形式化

Lei Zhang, Yusheng Zhao, Hongshun Yao, Xin Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究在Lean中对肖尔算法及其变体进行形式化,采用智能形式化方法让软件代理分析、编写代码及修复证明,建立数学基础用于分析RSA - 2048和P - 256加密设置下的量子攻击,为量子密码分析及算法设计验证助力。

Comments 21 pages, including appendix; 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13533 2026-07-16 astro-ph.IM astro-ph.SR 新提交 67%

Scientific-Intention Driven Embodied Intelligent Solar Telescope: Conceptual Design

科学意图驱动的具身智能太阳望远镜:概念设计

Lin Jiaben, Tong Liyue, Wang Hui, Shao Mingfu, Yang Chen

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文提出科学意图驱动的具身智能太阳望远镜(SIDEST)概念系统,通过三个核心层实现三种智能科学研究闭环,构建最小原型系统验证其核心原理及技术路径可行性,以前沿AI方法重新定义望远镜。

Comments 39 pages, 14 figures

Journal ref Laser & Optoelectronics Progress, 2026, 63(8): 0839014

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09771 2026-07-14 cs.DL cs.SI physics.soc-ph 新提交 67%

The backbone of science: analysis of citation networks between papers and their sources

科学的支柱:论文与其来源之间的引用网络分析

Wonhee Jeong, Dimitri Marinelli, Satyaki Sikdar, Gaurang Singh Yadav, Santo Fortunato

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究分析论文与其来源间的引用网络,借助大语言模型提取来源,用两种提示发现生成的骨干网络有相似特征,入度分布异质性高,多数高被引论文相同,作者引用排名稳定,完整引用网络能可靠反映论文和作者相对引用影响力。

Comments 26 pages, 8 figures, and 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08698 2026-07-10 cs.HC 新提交 67%

How YouTube Frames ChatGPT Use in Education: An Epistemic Network Analysis with Supporting Multimodal Metadata

YouTube如何构建教育领域中ChatGPT的使用:基于支持多模态元数据的认知网络分析

Shayla Sharmin, Mohammad Al-Ratrout, Mohammad Fahim Abrar, Roghayeh Leila Barmaki

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究通过多模态元数据分析教育类YouTube视频中ChatGPT的使用,识别出三个话语组,发现不同组在构建方式、观众反应和平台影响力上有差异,揭示了自主AI学习中优先快速输出与促进深度参与内容的差距及相关问题。

Comments This paper has been accepted in ICMI 2026 and will be presented in October

Journal ref In Proceedings of the 28th ACM International Conference on Multimodal Interaction (ICMI '26), Napoli, Italy, October 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20995 2026-07-09 cs.CY 新提交 67%

From inference to prediction: how machine learning is reconfiguring science

从推理到预测:机器学习如何重构科学(1990-2025)

Malena Mendez Isla, Vincent Lariviere, Diego Kozlowski

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 通过分析490万篇论文,揭示机器学习从物理科学向健康科学扩散,预测技术取代推理方法,引发两波认知不透明性浪潮。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05537 2026-07-08 stat.AP 新提交 67%

Prompt engineering using order-of-addition experiments: An application to generating two-level fractional factorial designs

使用加法顺序实验的提示工程:在生成二级部分因子设计中的应用

Duoduo Danny Ying, Alan R. Vazquez, Hongquan Xu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 针对大语言模型的顺序依赖问题,引入用加法顺序实验量化提示元素排序效应及确定最佳位置的方法,通过构建二级部分因子设计证明该方法可阐明顺序依赖,助力确定高质量提示配置。

Comments Main manuscript: 35 pages, 6 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01456 2026-07-03 cs.SE 新提交 67%

From Anatomy to Smells: An Empirical Study of SKILL.md in Agent Skills

从解剖到气味:Agent技能中SKILL.md的实证研究

David Boram Hong, Aaron Imani, Iftekhar Ahmed

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 对238个真实Agent技能的SKILL.md文件进行定性分析,构建语义组件分类法,通过多源文献综述识别最佳实践并定义技能气味,开发自动检测器发现超过99%的文件存在气味且难以消除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01244 2026-07-03 cs.IR cs.CY 新提交 67%

Retrieval-Augmented Generation to Support Railways Engineering Tasks: A Case Study

检索增强生成支持铁路工程任务:案例研究

Andrea Gerardo Russo, Federico Ruggeri, Ivan Tomarchio, Davide Bombini, Nicolò Donati, Gianmarco Pappacoda, Paolo Torroni, Giuseppe-Emiliano La Cara

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 本文通过案例研究,展示了从设计到部署构建检索增强生成系统,用于铁路领域复杂技术法规的咨询,平衡技术能力与领域专业知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01214 2026-07-02 cs.HC 新提交 67%

Touching and Feeling the Data: A Reusable Software Pipeline for Tactile Statistical Graphs in Accessible Education

触摸与感受数据:面向无障碍教育的触觉统计图可复用软件流水线

Lawrence Obiuwevwi, Krzysztof J. Rechowicz, Jessica M. Johnson, Erika Frydenlund, Vikas Ashok, Sachin Shetty, Sampath Jayarathna

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出一种三层可复用软件流水线,在约1500行JavaScript中自动生成触觉统计图,支持盲人和低视力学生通过触觉交互学习数据分析,生成打印文件耗时低于250毫秒。

Journal ref IEEE IRI'2026

详情

展开后加载摘要…

URL PDF HTML 收藏