arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-20 至 2026-08-20 共收录 20 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 20 篇

2608.18398 2026-08-20 cs.HC cs.AI 新提交 90%

LEDGER: Claim-to-Evidence Trace Graphs for Auditing LLM Agents

LEDGER:用于审计大语言模型智能体的从主张到证据的追踪图

Daehong Kim, Haichao Miao, Shusen Liu

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对LLM智能体输出审计瓶颈,提出LEDGER系统构建分层追踪图,通过分组节点、添加语义边等实现以证据为中心的审计,揭示工作流决策等关键信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18473 2026-08-20 cs.MA 新提交 89%

A Locally Deployable Tool-Grounded LLM Multi-agent Framework for Automating Methane Emission Analysis and Reporting

一种可本地部署的基于工具的大语言模型多智能体框架,用于自动化甲烷排放分析与报告

Yang Yan, Zifan Zhou, Xuan Wang, Erum Hassan, Bilguunzaya Mijiddorj, Jie Cao, Bin Li, Binbin Weng

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究开发了一种可本地部署的基于工具的LLM多智能体框架,用于自动化甲烷排放分析与报告,在多类真实场景测试中表现优异,能缩短工作流时间、降低人力需求并提升数据安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06641 2026-08-20 cs.CR cs.SE 版本更新 89%

From Documentation to Zero-day Vulnerabilities: LLM-Driven Fuzzing of JavaScript Engines in PDF Readers

从文档到零日漏洞:基于大语言模型的PDF阅读器JavaScript引擎模糊测试

Suyue Guo, Stijn Pletinckx, Tianle Yu, Yigitcan Kaya, Saad Ullah, Wenbo Guo, Christopher Kruegel, Giovanni Vigna

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 针对现有PDF阅读器模糊测试工具的局限,提出基于LLM的PDFuzzer,生成复杂API调用序列,在三款主流阅读器上覆盖率提升48%,识别31个零日漏洞并获厂商漏洞赏金。

Comments 16 pages, 2 figures, accepted by ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18292 2026-08-20 cs.RO cs.CV 新提交 86%

GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs

GuideFetch:用于辅助机器狗并发导航与物体检索的任务协调框架

Qian Yin, Ruiping Liu, Kunyu Peng, Jianxiang Man, Isik Baran Sandan, Junwei Zheng, Yufan Chen, Di Wen, Kailun Yang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Hunan University(湖南大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对异构辅助机器狗的导航与物体检索并发任务,提出GuideFetch协调框架,通过LLM规划与状态验证提升执行效率,并行执行可缩短41.3%平均总完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17178 2026-08-20 cs.CR cs.AI cs.AR 版本更新 83%

TrojanGYM: A Detector-in-the-Loop LLM for Adaptive RTL Hardware Trojan Insertion

TrojanGYM:一种检测器在环的大语言模型用于自适应RTL硬件木马插入

Saideep Sreekumar, Zeng Wang, Akashdeep Saha, Weihua Xiao, Minghao Shao, Muhammad Shafique, Ozgur Sinanoglu, Ramesh Karri, Johann Knechtel

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi(纽约大学阿布扎克分校)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 提出TrojanGYM框架,利用大语言模型智能体自动生成多样化的硬件木马,暴露基于GNN的检测器盲点,并设计鲁棒检测器Robust-GNN4TJ,在生成的基准上将检测率从0%提升至60%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06114 2026-08-20 cs.CL cs.AI 版本更新 82%

Making Implicit Premises Explicit in Logical Understanding of Enthymemes

在演绎推理中显式化隐含前提

Xuyao Feng, Anthony Hunter

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种整合大型语言模型和神经符号推理器的管道,用于将隐含前提显式化并解码逻辑蕴含。

Comments Accepted at the 17th International Conference on Scalable Uncertainty Management (SUM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18309 2026-08-20 cs.CV 新提交 82%

XRF-to-Optical Field-of-View Localization with Vision Language Models

基于视觉语言模型的X射线荧光(XRF)与光学显微镜视场(FOV)定位

Xiangyu Yin, Tatjana Paunesku, Letonia Copeland-Hardin, Martina Ralle, Zichao Wendy Di, Si Chen, Gayle E. Woloschak, Barry Lai, Mathew J. Cherukara, Stefan Vogt

机构 * Northwestern University(西北大学) University of Chicago(芝加哥大学) Oregon Health and Science University(俄勒冈健康与科学大学) Argonne National Laboratory(阿贡国家实验室)

专题命中 其他LLM :language model(title,abstract);prompting(abstract)

AI总结 本文针对跨模态显微图像的视场定位难题,提出结合视觉语言模型(VLM)的候选生成-验证工作流,在低对应度的相邻切片成像数据中实现了有效定位,为关联XRF与光学显微测量提供了支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18846 2026-08-20 cs.AI 新提交 81%

ORBITER: Conflict-Aware Decision-Making for Agentic Last-Mile Delivery

ORBITER:面向智能体的最后一公里配送的冲突感知决策方法

Mingzhao Li, Chenxi Liu, Yan Zhao, Hao Miao

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文针对最后一公里配送决策的可解释性与可靠性问题,提出ORBITER框架,结合LLM与结构化决策机制,在四城市数据上较最优基线平均提升9.2%,验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18545 2026-08-20 cs.CL 新提交 81%

Shared Circuits for Shared Grammar: Tracing Subject-Verb Agreement Across Languages

共享语法的共享电路:跨语言追踪主谓一致

Isabella Gidi, Antonio Almudévar, Core Francisco Park, Naomi Saphra, Ricard Marxer

机构 * Harvard University(哈佛大学) University of Zaragoza(萨拉戈萨大学) Boston University(波士顿大学) Univ Toulon(土伦大学) Aix Marseille Univ(艾克斯-马赛大学) CNRS(法国国家科学研究中心) LIS(信息科学实验室) ILLS(语言与语言科学研究所)

专题命中 其他LLM :large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.CL

AI总结 本文研究多语言大语言模型的跨语言共享机制,以主谓一致为对象,通过29种语言的实验发现其复用部分共享计算结构,且与屈折语言的电路更相似。

Comments 25 pages including appendices, 16 figures. Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16934 2026-08-20 cs.AR cs.CL 版本更新 81%

SeqFeed: Improving Agentic RTL Code Generation with Sequential Behavior Feedback

SeqFeed:通过顺序行为反馈改进智能体RTL代码生成

Yuxin Du, Juxin Niu, Tao Hu, Xi Wang, Zhe Jiang, Nan Guan

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对智能体RTL代码生成的时序信息传递难题,本研究提出含SeQuery和SeGraph机制的SeqFeed,通过满足三项反馈要求提升LLM的RTL代码生成通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18409 2026-08-20 cs.AI 新提交 79%

Improving Natural-Language Combinatorial-Optimization Accuracy in Resource-Constrained Language Models via Formal Abstractions

通过形式化抽象提升资源受限语言模型的自然语言组合优化准确率

Shrenil Shaun Sharma, Avi Sharma

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 针对资源受限语言模型在自然语言组合调度中可行性不足的问题,提出神经符号框架SDDL,其在300实例调度子集上大幅提升小模型的可行调度准确率,逼近大模型性能

Comments 17 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18083 2026-08-20 cs.CL 新提交 79%

Entity tracking emerges in sub-billion parameter language models and exceeds human performance in naturalistic narratives

实体追踪在亚十亿参数规模的语言模型中出现,且在自然叙事中超越人类表现

Karolina Drożdż, Micha Heilbron

机构 * IDEAS Research Institute(IDEAS研究所) Max Planck Institute for Psycholinguistics(马克斯·普朗克心理语言学研究所) University of Amsterdam(阿姆斯特丹大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本研究发现4.1亿参数的语言模型已具备人类水平的实体追踪能力,且随规模提升而改善,远超人类表现,该能力在远小于预期的模型规模时出现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02259 2026-08-20 cs.CL 版本更新 70%

An Information-theoretic Propagation Denoising and Fusion Framework for Fake News Detection

用于假新闻检测的信息论传播去噪与融合框架

Mengyang Chen, Lingwei Wei, Wei Zhou, Songlin Hu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对假新闻检测中合成传播数据不可靠的问题,提出InfoPDF框架,通过互信息学习真实与合成传播的有效表示,在多个数据集上实现更优检测性能。

Comments Camera-ready version for IJCAI-ECAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19083 2026-08-20 cs.HC cs.CL 新提交 70%

When Readability and Source Retention Diverge: An Evaluability Gap in AI Translation

当可读性与源保留产生分歧:AI翻译中的可评估性差距

Chenchen Mao, Hanjing Shi, Haiyan Jia, Emily Wegrzyn, Dominic DiFranzo

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究针对AI翻译中可读性与源保留分歧导致的可评估性差距,通过TransLingo开展2×2对比实验,揭示了源文本条件与输出呈现方式对感知质量等的影响,明确了任务绩效信任与披露意愿的关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18482 2026-08-20 cs.AR cs.AI 新提交 70%

Coverage-Driven RTL Assertion Generation with Formal Exploration and Neuro-Symbolic Refinement

基于形式化探索与神经符号优化的覆盖率驱动RTL断言生成

Zhiyuan Yan, Ziyue Zheng, Hongce Zhang

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出NeuroAssertion框架,结合形式化迹生成、SyGuS与智能体启发优化,实现覆盖率驱动的RTL断言生成,断言数量与突变覆盖率均约为传统方法的2倍。

Comments Accepted at MLCAD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18167 2026-08-20 cs.AI cs.SE 新提交 57%

Adversarial Review: Structured Disagreement for Grounded Agentic Code Review

对抗评审:基于结构化分歧的 grounded 智能体代码评审

Eric S. Qiu, Joyce Gill

机构 * Cornell University(康奈尔大学) Stanford University(斯坦福大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出对抗评审(AR)协议,仅用3个智能体实现结构化分歧的协作代码评审,在LiveCodeBench、SWE-PRBench等基准上优于多智能体基线,证明无需大量智能体即可完成高效代码评审。

Comments Accepted to ICML 2026 Workshop on DL4C

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18623 2026-08-20 physics.chem-ph 新提交 50%

UBio-MolFM: Enabling Biomolecular Dynamics at DFT Accuracy and $10^5$ Atoms with One Untuned Potential

UBio-MolFM:使用一个未调谐的势实现DFT精度下10^5个原子的生物分子动力学模拟

Lin Huang, Frank Peng, JiaJun Cheng, Zion Wang, Hao Yin, Hao Li, Ji Zhang, Jack Jia, Junping Zhao, Arthur Jiang, Jia Zhang

专题命中 其他LLM :foundation model(abstract)

AI总结 UBio-MolFM是经1.6亿量子化学标签训练的基础模型,可在单GPU上以近线性成本实现DFT精度的10^5原子生物分子动力学模拟,突破了第一性原理模拟的原子数限制,能重现关键生物过程的结构与能量特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17803 2026-08-20 cs.CV 版本更新 50%

Scale Matters: Adaptive Granularity Selection for Cross-Species 3D Plant Organ Segmentation

尺度重要:跨物种三维植物器官分割的自适应粒度选择

Carla Salazar, Lazaros Nalpantidis

机构 * Technical University of Denmark (DTU)(丹麦技术大学(DTU)) Pioneer Centre for Artificial Intelligence(人工智能先锋中心)

专题命中 其他LLM :foundation model(abstract)

AI总结 针对跨物种三维植物器官分割中固定空间粒度泛化能力差的问题,提出结合冻结Utonia基础模型与自适应粒度选择的小样本方法AGS-PlantSeg,在三个数据集上实现88.9%平均mIoU,性能优于固定粒度基线且与全监督架构相当。

Comments Accepted at the Computer Vision in Plant Phenotyping and Agriculture (CVPPA) Workshop at the European Conference on Computer Vision (ECCV) 2026. Project page: this https URL (https://dtu-pas.github.io/ags-plantseg/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17453 2026-08-20 cs.RO 版本更新 50%

EATR-Stereo: Embodiment-Aware Token Routing of Paired Stereo Evidence for Humanoid Vision-Language-Action Control

EATR-Stereo:面向人形机器人视觉-语言-动作控制的具身感知配对立体证据路由

Songwei Wu, Rui Zhao, Fan Yang, Zhongqiang Nie, Zhiduo Jiang, Wandong Sun, Yuwei Li, Jian Hu, Yang Liu, Hong Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他LLM :language model(abstract)

AI总结 EATR-Stereo是具身感知的令牌路由框架,在冻结预训练VLA模型的前提下,通过选择性路由配对立体证据,提升了人形机器人长时程视觉-语言-动作控制的任务成功率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17458 2026-08-20 cs.CR 版本更新 50%

The CTI Echo Chamber: Fragmentation, Overlap, and Vendor Specificity in Twenty Years of Cyber Threat Reporting

CTI 回声室:二十年来网络威胁报告中的碎片化、重叠与供应商特定性

Manuel Suarez-Roman, Francesco Marchiori, Mauro Conti, Juan Tapiador

专题命中 其他LLM :LLM(abstract)

AI总结 本文研究了二十年来网络威胁报告中的碎片化、重叠和供应商特定性问题,通过大规模自动化分析揭示了CTI信息密度和专业性的演变,识别了CTI行业中的碎片化生态系统和供应商的地理和行业偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏