arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-10 至 2026-08-10 共收录 22 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 22 篇

2608.06992 2026-08-10 cs.CL cs.AI cs.DB 新提交 90%

GPTKB 2.0: Browsing, Querying, and Auditing a Disambiguated LLM-Derived Knowledge Base

GPTKB 2.0:浏览、查询与审计经消歧的大语言模型衍生知识库

Yujia Hu, Tuan-Phong Nguyen, Simon Razniewski

机构 * ScaDS.AI Dresden/Leipzig(ScaDS.AI德累斯顿/莱比锡) TU Dresden(德累斯顿工业大学) Institute for AI, VNU University of Engineering and Technology(越南国家大学工程技术学院人工智能研究所)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究推出了可浏览、查询、审计的GPTKB 2.0系统,其为经上下文引导消歧的LLM衍生知识库,规模达3840万条三元组,支持多种查询及实体链接功能,且提供网络演示与离线下载。

Comments 7 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05204 2026-08-10 cs.AI cs.LG 版本更新 90%

SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse

SkillTrace:面向LLM智能体技能复用的多溯源审计

Jialuo Chen, Minghe Wang, Lingqi Jiang, Jianan Ma, Xinhao Deng, Xiaohu Du, Ruixiao Lin, Yunhao Feng, Linkang Du, Jingyi Wang

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 本文提出SKILLTRACE框架,通过提取三种溯源审计LLM智能体技能复用,在SKILLTRACE-BENCH上取得高指标,野外审计显示其能生成更具操作性的复用审查队列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06830 2026-08-10 cs.RO cs.CR 新提交 89%

When Coordination Becomes a Threat: Communication Attacks in LLM-Controlled Multi-Robot Systems

当协调成为威胁:大语言模型控制的多机器人系统中的通信攻击

Zhen Huang, Zhihuang Liu, Weijia Shi, Yifan Yang, Weishang Wu, Zhiping Cai

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) School of Informatics, Xiamen University(厦门大学信息学院)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究针对LLM控制的多机器人系统,提出两种通信攻击并在三种架构下验证其风险,引入CPV门可降低违规率,为相关安全问题提供了应对方案。

Comments 17 pages, 8 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06641 2026-08-10 cs.CR cs.SE 新提交 89%

From Documentation to Zero-day Vulnerabilities: LLM-Driven Fuzzing of JavaScript Engines in PDF Readers

从文档到零日漏洞:基于大语言模型的PDF阅读器JavaScript引擎模糊测试

Suyue Guo, Stijn Pletinckx, Tianle Yu, Yigitcan Kaya, Saad Ullah, Wenbo Guo, Christopher Kruegel, Giovanni Vigna

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 针对现有PDF阅读器模糊测试工具的局限,提出基于LLM的PDFuzzer,生成复杂API调用序列,在三款主流阅读器上覆盖率提升48%,识别31个零日漏洞并获厂商漏洞赏金。

Comments 16 pages, 2 figures, accepted by ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07023 2026-08-10 cs.CL cs.AI 新提交 87%

An Agentic Hybrid Top-Down and Bottom-Up Approach to Knowledge Graph Generation

一种用于知识图谱生成的智能体式混合自顶向下与自底向上方法

Emma Jouffroy, Warren Jouanneau, Marc Palyart

机构 * Malt

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对HR平台的多语言非标准化技能声明问题,提出结合LLM与Wikidata KG的智能体式混合KG生成流水线,可生成可扩展可解释的技能KG。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06750 2026-08-10 cs.CL cs.AI 新提交 82%

Progressive Content Refinement with Decaying Reward Joint LinUCB

结合衰减奖励的渐进式内容优化与联合LinUCB

Shion Ishikawa, Pablo Loyola, Young-joo Chung, Yun Ching Liu

机构 * Rakuten Group, Inc.(乐天集团)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对现有迭代优化方法忽略奖励衰减导致过度利用的问题,提出结合奖励衰减建模与EM算法的联合LinUCB算法,在Sentiment Reversal和GSM8K基准上显著优于强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10267 2026-08-10 cs.LG 81%

In-Context Source and Channel Coding

上下文源码与信道编码

Ziqiong Wang, Tianqi Ren, Rongpeng Li, Zhifeng Zhao, Honggang Zhang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(信息科学与电子工程学院,浙江大学) Zhejiang Lab(浙江实验室) Macau University of Science and Technology, China(澳门科学理工学院,中国)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种接收端上下文解码框架,通过改进SSCC的鲁棒性,在不修改发射端的情况下提升低信噪比下的传输性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06634 2026-08-10 cs.SD 新提交 78%

From Prompting to Describing: A Cross-Cultural Study of Language for AI-Generated Music

从提示到描述:针对AI生成音乐语言的跨文化研究

Sangheon Park, Claire Arthur

专题命中 其他LLM :prompting(title,abstract)

AI总结 该研究对比了TTM系统提示与音乐描述的语言差异,构建了音乐提示词汇分类法,发现提示与感知存在结构不对称,且不同文化背景的描述特征存在差异,引发对现有TTM系统文化适应性的思考。

Comments Accepted to the 27th International Society for Music Information Retrieval (ISMIR) Conference, 2026

Journal ref ISMIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06733 2026-08-10 physics.soc-ph 新提交 75%

Estimating GHG Emissions from AI Use: Framework for Corporate-Level Measurement

估算AI使用产生的温室气体排放:企业级测量框架

John Bistline, Shaena Ulissi, Steven J. Davis, Jonathan Glidden, James Joyce, Mo Li, Jackson Mohsenin, Sangwon Suh

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对企业AI排放核算缺乏公认方法的问题,提出标准化企业级AI排放核算框架,以支撑减排目标设定与脱碳决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06779 2026-08-10 q-bio.QM cs.AI cs.CL 新提交 73%

Genotypic Triggers: Exposing Pharmacogenomic Blind Spots via Host-Specific Backdoors in Generative Antimicrobial Peptide Models

基因型触发器:通过生成抗菌肽模型中宿主特定后门暴露药物基因组学盲区

Doniyorkhon Obidov, Xiaolong Guo, Yonghui Li, Kaichen Yang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出基因型触发器后门攻击,操控抗菌肽生成模型使其针对特定HLA等位基因携带者生成高免疫原性风险肽,同时保留抗菌效力与低毒性,以暴露药物基因组学盲区。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07283 2026-08-10 cs.CL 新提交 70%

Grammar Engineering Meets LLMs: Development of Cantonese and Irish ParGram Treebanks

语法工程与大语言模型(LLMs)的结合:粤语与爱尔兰语平行语法(ParGram)树库的开发

Chit-Fung Lam, Elaine Uí Dhonnchadha

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究开发了粤语与爱尔兰语ParGram树库,探究多语言LLMs在语法工程中的应用,发现其翻译表现差、跨语言抽象任务效果不佳,但可提供参考,凸显其潜力与专家分析的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09222 2026-08-10 cs.SD cs.AI 版本更新 70%

GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking

GRM:通过梯度比掩码实现音频大语言模型的效用感知越权攻击

Yunqiang Wang, Hengyuan Na, Di Wu, Miao Hu, Guocong Quan

机构 * Sun Yat-Sen University(中山大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出GRM框架,通过频率选择性扰动在音频大语言模型中实现效用感知的越权攻击,实验表明其在攻击成功率与效用平衡方面优于基线方法。

Comments Accpeted by MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19037 2026-08-10 cs.SD cs.CL cs.MM eess.AS 70%

MLLM-based Speech Recognition: When and How is Multimodality Beneficial?

Yiwen Guan, Viet Anh Trinh, Vivek Voleti, Jacob Whitehill

机构 * Worcester Polytechnic Institute(沃斯特理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref IEEE Transactions on Multimedia, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08029 2026-08-10 cs.CL cs.CY 版本更新 70%

Better Together: Quantifying the Benefits of AI-Assisted Recruitment

携手共进:量化AI辅助招聘的益处

Ada Aka, Emil Palikot, Ali Ansari, Nima Yazdani

机构 * Stanford University(斯坦福大学) University of Southern California(南加州大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究通过两项实地实验发现,AI辅助招聘可提升候选人最终面试通过率,在简历信息不足的初级候选人中效果更显著,但存在75%的候选人未完成面试的问题,其将筛选成本从企业转移至申请人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07396 2026-08-10 math.FA 新提交 67%

Banach lattices and phase retrieval: A case study for the use of AI in mathematics

巴拿赫格与相位检索:AI在数学中应用的案例研究

Jaume de Dios Pont, Lukas Liehr, David Muñoz-Lahoz, Mitchell A. Taylor, Pedro Tradacete

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文以巴拿赫格与相位检索领域为例,研究大型语言模型辅助数学研究时,结合Lean验证可形成更团结的学术共同体、加深领域理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06631 2026-08-10 cs.LG cs.AI 新提交 62%

Cryptanalytic Extraction of Isolated Bias-Free GLU Feed-Forward Blocks by Antipodal Separation

通过对极分离的密码分析提取孤立无偏GLU前馈块

Chunhui Shi, Xinwen Fu

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对现有密码分析提取方法无法恢复现代语言模型的无偏GLU前馈块的问题,提出多阶段前向查询恢复原语,在多种模型上实现亚百分位或低误差,且明确其非端到端攻击的性质。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13491 2026-08-10 cs.LG cs.AI 版本更新 62%

DeepLoop: Depth Scaling for Looped Transformers

DeepLoop:循环变换器的深度缩放

Shuzhen Li, Yifan Zhang, Jiacheng Guo, Quanquan Gu, Mengdi Wang

机构 * Princeton University(普林斯顿大学) University of California Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 研究循环变换器中深度缩放问题,提出DeepLoop方法,通过控制访问对齐系数形式化绑定深度效应,保持特定架构并设置参数,在不同规模GPT风格模型上实验,结果显示稳定循环深度需考虑参数访问的残差缩放规则。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06968 2026-08-10 physics.soc-ph cs.AI cs.CY 新提交 57%

Same physical state, different collective dynamics: state encodings select synchronization outcomes in language-model agents

相同物理状态,不同集体动力学:状态编码选择语言模型智能体的同步结果

Takahiro Ezaki, Naoto Imura, Katsuhiro Nishinari

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究通过循环同步实验发现,状态编码(低阶循环矩vs直方图)会影响语言模型智能体的同步结果,且效应因模型而异,状态编码是依赖模型的有效交互法则的组成部分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05675 2026-08-10 cs.LG 版本更新 57%

Consistency Has a Computable Blind Spot: A Commutation Theory of Label-Free Reliability for Vision-Language Figure Reading

一致性存在可计算的盲区:视觉-语言图表阅读的无标签可靠性交换理论

Rasul Khanbayov, Hasan Kurban

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 该研究提出视觉-语言图表阅读的无标签可靠性交换理论,构建无标签、无需训练的检测器,发布REND-EQUIV数据集,揭示一致性盲区可计算,循环重标记可提升性能,解释排序反转现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03902 2026-08-10 cs.LG 57%

A phase transition between positional and semantic learning in a solvable model of dot-product attention

Hugo Cui, Freya Behrens, Florent Krzakala, Lenka Zdeborová

专题命中 其他LLM :language model(abstract);分类 cs.LG

Journal ref Advances in Neural Information Processing Systems 37 (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06913 2026-08-10 cs.CV 新提交 50%

MuST-VAD: Mutual Structured Learning for Video Anomaly Detection

MuST-VAD:用于视频异常检测的互结构化学习

Satoshi Hashimoto, Hitoshi Nishimura, Mori Kurokawa

专题命中 其他LLM :language model(abstract)

AI总结 MuST-VAD是用于弱监督视频异常检测的互结构化学习框架,通过检测器与LVLM的双向知识交换,在UCF-Crime数据集上显著提升了检测精度,AP优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08260 2026-08-10 cs.CV 版本更新 50%

TIDE: Task-Isolated Diffusion for Unified Video Editing and Generation

TIDE: 任务隔离扩散模型用于统一视频编辑与生成

Qi Liu, Gang Yue, Mingyu Yin, Lisai Zhang, Yidi Wu, Yaole Wang, Yaohui Wang, Chang Yao, Jingyuan Chen, Lin Ma

机构 * Zhejiang University(浙江大学) Bilibili Inc.(哔哩哔哩股份有限公司)

专题命中 其他LLM :language model(abstract)

AI总结 提出TIDE统一框架,通过逐token任务嵌入和双路径条件机制,实现指令编辑、参考编辑和多参考生成,在多任务渐进训练下达到SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏