arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-26 至 2026-06-26 共收录 270 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 12 篇

2606.26474 2026-06-26 cs.LG cs.AI 新提交 73%

Localizing RL-Induced Tool Use to a Single Crosscoder Feature

将RL诱导的工具使用定位到单个交叉编码器特征

Andrii Shportko, Shubham Bhokare, Ahmed Zeyad A Alzahrani, Bowen Cheng, Gustavo Mercier, Jessica Hullman

专题命中 知识编辑与模型理解 :LLM(abstract_cn);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出专用特征交叉编码器(DFC)隔离强化学习引入的紧凑特征集,通过编码-解码重建提升工具调用正确率31.1个百分点,并实现能力溢出至冻结基模型。

Comments Accepted as a spotlight at the ICML 2026 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26874 2026-06-26 cs.AI 新提交 70%

TAVR-VLM: Risk-Conditioned Causal Grounding for Hallucination-Resistant Report Generation

TAVR-VLM:面向抗幻觉报告生成的风险条件因果基础

Zhixiang Lu, Xiwei Liu, Sifan Song, Changkai Ji, Anh Nguyen, Jionglong Su, Imran Razzak, Jinfeng Wang

机构 * Xi’an Jiaotong-Liverpool University(西交利物浦大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Shanghai Jiao Tong University(上海交通大学) University of Liverpool(利物浦大学) Kunming University of Science and Technology(昆明理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出TAVR-VLM框架,通过风险条件因果注意力(R-CGA)建立“风险→区域→词”的结构化基础路径,在TAVR规划中减少诊断幻觉,实现新最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01849 2026-06-26 cs.CL 版本更新 70%

From Guessing to Placeholding: A Cost-Theoretic Framework for Uncertainty-Aware Code Completion

从猜测到占位:一种基于代价理论的不确定性感知代码补全框架

Liang Zhu, Haolin Chen, Lidong Zhao, Xian Wu

机构 * Tencent, Shenzhen, China(腾讯深圳公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对硬补全范式在不确定上下文中生成错误代码的问题,提出自适应占位补全框架,在高熵位置输出占位符,理论证明其期望代价低于硬补全,实验显示编辑代价降低19%-50%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20381 2026-06-26 cs.RO 版本更新 67%

STORM: Slot-based Task-aware Object-centric Representation for robotic Manipulation

STORM:基于槽的任务感知面向对象的机器人操作表示

Alexandre Chapin, Emmanuel Dellandréa, Liming Chen

机构 * Ecole Centrale de Lyon, LIRIS(里尔森中央理工大学,LIRIS实验室)

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract)

AI总结 提出STORM模块,通过多阶段训练策略将冻结的视觉基础模型与语义感知槽结合,生成面向对象的任务感知表示,提升机器人操作在视觉干扰下的泛化性和控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14814 2026-06-26 cs.LG cs.CL 版本更新 62%

Learning State-Tracking from Code Using Linear RNNs

利用线性RNN从代码中学习状态追踪

Julien Siems, Riccardo Grazzi, Korbinian Pöppel, Kirill Kalinin, Hitesh Ballani, Babak Rahmani

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.LG

AI总结 通过将置换组合任务转换为带状态揭示的代码,研究线性RNN在状态追踪中的表现,发现其优于Transformer,但在部分可观测状态下不如非线性RNN。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18714 2026-06-26 cs.CV cs.AI 版本更新 57%

Semantic Generative Tuning for Unified Multimodal Models

语义生成微调用于统一多模态模型

Songsong Yu, Yuxin Chen, Ying Shan, Yanwei Li

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent ARCLab(腾讯ARCLab)

专题命中 知识编辑与模型理解 :post-training(abstract);分类 cs.AI

AI总结 本文提出语义生成微调(SGT)方法,通过将高阶语义任务作为生成代理,统一多模态模型的感知与生成能力,提升多模态理解和生成质量。

Comments 14 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15347 2026-06-26 eess.IV cs.MM 版本更新 50%

Symmetric Entropy-Constrained Video Coding for Machines

面向机器的对称熵约束视频编码

Yuxiao Sun, Meiqin Liu, Chao Yao, Qi Tang, Jian Jin, Weisi Lin, Frederic Dufaux, Yao Zhao

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 提出SEC-VCM框架,通过双向熵约束机制对称对齐视频编解码器与视觉骨干网络,保留语义并丢弃无关信息,结合语义-像素双路径融合提升机器视觉任务性能,在多项任务上显著优于H.266/VVC。

Comments Accepted by IEEE Transactions on Image Processing. This is the author's accepted manuscript (AAM)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 23 篇

2404.08948 2026-06-26 cs.SE 版本更新 92%

Large Language Models for Mobile GUI Text Input Generation: An Empirical Study

大型语言模型用于移动GUI文本输入生成:一项实证研究

Chenhui Cui, Tao Li, Junjie Wang, Chunyang Chen, Dave Towey, Rubing Huang

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);prompting(abstract)

AI总结 本研究评估九种LLM在115个真实应用中的GUI文本输入生成,比较三种UI上下文提示设置,发现提取文本和XML达到71%的页面通过率,视觉输入成本更高;反馈增强协议提升缺陷检测率至64.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27287 2026-06-26 cs.AI 新提交 92%

Prompt Injection in Automated Résumé Screening with Large Language Models: Single and Multi-Injection Settings

大型语言模型在自动化简历筛选中的提示注入:单注入与多注入设置

Preet Baxi, Jiannan Xu, Jane Yi Jiang, Stefanus Jasin

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究LLM在简历筛选中的提示注入攻击,发现当简历质量同质且注入者少时有效,但随注入者增多效果消失;质量异质时虽平均效果减弱,但偶尔让低质量候选人超越高质量,引发公平问题。

Journal ref Findings of the Association for Computational Linguistics: ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13670 2026-06-26 cs.AI 新提交 92%

Automated reproducibility assessments in the social and behavioral sciences using large language models

使用大型语言模型自动评估社会与行为科学的可重复性

Tobias Holtdirk, Pietro Marcolongo, Anna Steinberg Schulten, Felix Henninger, Stefan Rose, Sarah Ball, Bolei Ma, Frauke Kreuter, Markus Weinmann, Stefan Feuerriegel

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Cologne(科隆大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究利用大型语言模型(LLMs)自动评估社会与行为科学研究的可重复性,在76项研究中,LLM在41%的研究中恢复了原始效应量,在96%的案例中得出了与原始研究相同的定性结论,优于人类再分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26106 2026-06-26 cs.CL cs.AI 新提交 91%

Reducing Conversational Escalation in Large Language Model Dialogue with Nonviolent Communication Constraints

使用非暴力沟通约束减少大语言模型对话中的对话升级

Zhixing Sun, Shenghe Xu, Tao Li

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) City University of Hong Kong(香港城市大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 本研究通过非暴力沟通原则的轻量级提示约束,引导大语言模型在冲突对话中减少升级行为,实验表明该方法能稳定与高度抵抗用户的交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26505 2026-06-26 cs.SE cs.HC 新提交 91%

Same Scrutiny, More Time: Eye Tracking Insights into Reviewing LLM-Labelled Code

同样审查,更多时间:眼动追踪洞察审查LLM标记代码

Ranim Khojah, Francisco Gomes de Oliveira Neto, Mazen Mohamad, Julian Frattini, Philipp Leitner

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 通过Wizard-of-Oz实验和眼动追踪,发现开发者审查LLM标记代码时更专注但策略调整,提示需重新审视AI政策。

Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06401 2026-06-26 cs.SE 版本更新 91%

LLMCFG-TGen: Using LLM-Generated Control Flow Graphs to Automatically Create Test Cases from Use Cases

LLMCFG-TGen:利用LLM生成的控制流图从用例自动创建测试用例

Zhenzhen Yang, Chenhui Cui, Tao Li, Rubing Huang, Nan Niu, Dave Towey, Shikai Guo

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出LLMCFG-TGen方法,通过LLM将自然语言用例转化为控制流图,提取执行路径并生成测试用例,解决现有方法覆盖不全和逻辑遗漏问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26924 2026-06-26 cs.SE cs.AI cs.CR 新提交 90%

A Deterministic Control Plane for LLM Coding Agents

LLM编码代理的确定性控制平面

Padmaraj Madatha

机构 * Happiest Minds Technologies (AIP Centre of Excellence)(happiest minds technologies(aip中心卓越机构))

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 针对LLM编码代理配置缺乏管理的问题,提出确定性控制平面Rel(AI)Build,通过内容寻址、分层权限、阶段状态机等机制确保配置安全与一致性。

Comments 45 pages, 9 figures, 13 tables. Dataset and reproduction scripts: Zenodo DOI 10.5281/zenodo.20780913. Ancillary files include report.json, organizations.txt, and figure-reproduction scripts

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26203 2026-06-26 cs.AI cs.CY cs.MA cs.SI 新提交 90%

Agentic Analysis for Agentic Infrastructure: An LLM-Powered Pipeline for Comparative Governance of DAO and Corporate AI Protocols

面向代理基础设施的代理分析:基于LLM的DAO与企业AI协议比较治理管道

Yutian Wang, Luyao Zhang

机构 * Duke Kunshan University(昆山杜克大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出LLM驱动的比较分析管道,结合自动标注、神经主题建模和多层网络分析,研究DAO与企业AI协议的治理结构,发现开放治理促进主题收敛但参与不平等普遍存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27136 2026-06-26 cs.AI 新提交 89%

Joint Learning of Experiential Rules and Policies for Large Language Model Agents

大型语言模型智能体的经验规则与策略联合学习

Shicheng Ye, Chao Yu

机构 * Sun Yat-sen University(中山大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 提出JERP框架,通过联合更新经验规则库和策略,使规则与演化策略对齐,在AlfWorld和WebShop上提升复杂交互任务的决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26593 2026-06-26 cs.AI 新提交 89%

Content-Based Smart E-Mail Dispatcher Using Large Language Models

基于内容的大型语言模型智能电子邮件分发器

K. Paramesha, K R Sriram, Sujan Shetty, Shamanth Kishore, R. Tejaswini

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 提出利用大型语言模型自动分析邮件内容并分派至相关WhatsApp群组,无需标注数据,提升效率并降低认知负荷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00570 2026-06-26 cs.HC 版本更新 87%

User Perceptions of an LLM-Based Chatbot for Cognitive Reappraisal of Stress: Feasibility Study

用户对基于LLM的认知重评压力聊天机器人的感知:可行性研究

Ananya Bhattacharjee, Jina Suh, Mohit Chandra, Javier Hernandez

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究基于GPT-4o的聊天机器人在工作场所压力认知重评中的可行性,通过100名员工实验发现其能显著降低压力强度并改善压力心态,但存在脚本化、交互长度和AI共情等设计张力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26918 2026-06-26 cs.AI 新提交 83%

Diagnosing Task Insensitivity in Language Agents

诊断语言智能体中的任务不敏感性

Jingyu Liu, Xiaopeng Wu, Kehan Chen, Chuan Yu, Yong Liu

机构 * Gaoling School of Artificial Intelligence Renmin University of China(中国人民大学高瓴人工智能学院) Taobao & Tmall Group of Alibaba(阿里巴巴淘天集团) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京市大模型与智能治理重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部新一代智能搜索与推荐工程研究中心)

专题命中 其他LLM :language agent(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文发现大语言模型在长程任务中因过度依赖训练模式而忽略任务指令,导致分布外泛化失败,并提出任务扰动负对数似然优化(Task-Perturbed NLL Optimization)来增强任务敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26383 2026-06-26 cs.LG cs.AI cs.AR cs.MA cs.PF 新提交 82%

SOLAR: AI-Powered Speed-of-Light Performance Analysis

SOLAR: AI驱动的光速性能分析

Qijing Huang, Sana Damani, Zhifan Ye, Athinagoras Skiadopoulos, Siva Kumar Sastry Hari, Jason Clemons, Sahil Modi, Jingquan Wang, Aditya Kane, Edward C Lin, Humphrey Shi, Christos Kozyrakis

机构 * NVIDIA(英伟达)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 提出SOLAR框架,自动从PyTorch和JAX代码推导理论最小执行时间(光速界限),通过LLM前端和确定性分析实现无违反界限的多保真度性能分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22259 2026-06-26 cs.LG cs.AI 版本更新 79%

Rotary Position Encodings for Graphs

图的旋转位置编码

Isaac Reid, Arijit Sehanobish, Cederik Höfs, Bruno Mlodozeniec, Leonhard Vulpius, Federico Barbero, Adrian Weller, Krzysztof Choromanski, Richard E. Turner, Petar Veličković

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旋转位置编码(RoPE)在图结构数据上的应用,提出基于图拉普拉斯谱的旋转方法(WIRE),提升图学习性能,并具有理论性质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26626 2026-06-26 cs.HC 新提交 78%

Reviving Reflection-in-Action: Instilling Designerly Thinking in AI-Supported Ideation through Multimodal Prompting

复兴反思行动:通过多模态提示在AI支持的构思中注入设计思维

Samangi Wadinambiarachchi, Jenny Waycott, Greg Wadley

专题命中 其他LLM :prompting(title,abstract)

AI总结 针对当前AI创造力支持工具主要依赖文本提示的局限,提出SketchifAI原型,通过多模态输入(文本、草图、草图加标签)增强设计学生的表达意图、创造力支持和发散思维,发现草图模态提升流畅性但用户偏好文本,探讨如何通过草图反思保留设计技能。

Comments ACM Creativity and Cognition 2026 conference (C&C'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18364 2026-06-26 cs.IT cs.LG math.IT quant-ph stat.ML 版本更新 77%

Quantum Maximum Likelihood Prediction via Hilbert Space Embeddings

通过希尔伯特空间嵌入的量子最大似然预测

Sreejith Sreekumar, Nir Weinberger

机构 * L2S, CNRS, CentraleSupélec, University of Paris-Saclay, France(L2S、CNRS、CentraleSupélec、巴黎-萨克雷大学、法国)

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究量子最大似然预测任务,通过将经验概率分布嵌入量子态并最小化量子相对熵,提出统一框架,给出非渐近性能保证。

Comments 38+4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26641 2026-06-26 cs.HC 新提交 67%

Invisible Impact of Empathy on Behavioral Change: Isolating the Effect of Empathy in Long-term Physical Activity Coaching Chatbot Interactions

共情对行为改变的隐形影响:在长期身体活动教练聊天机器人交互中隔离共情效应

Li Siyan, Kai-Hui Liang, Shopnil Shahriar, Yilin Ye, Shiyoh Goetsu, Wei-Wei Du, Masahiro Yoshida, Tsunayuki Ohwa, Xuhai Xu, Zhou Yu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过构建仅共情水平不同的三个聊天机器人进行六周实验,发现用户难以区分共情程度,但高共情版本仍能增加步数并改善遵循意图,表明共情通过外围路径影响动机和信任。

Comments Shortened version of paper accepted into CUI Short paper and WIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08518 2026-06-26 physics.optics cond-mat.quant-gas physics.atom-ph 版本更新 67%

Fresnel zone plates for reconfigurable atomic waveguides

用于可重构原子波导的菲涅耳波带片

A. M. Pike, A. Dorne, L. Pickering, M. Jamieson, I. T. MacCuish, E. Riis, M. Y. H. Johnson, V. A. Henderson, P. F. Griffin, A. S. Arnold

专题命中 其他LLM :SLM(abstract,abstract_cn)

AI总结 提出一种结合菲涅耳波带片与空间光调制器优势的新型波带片,可生成大面积环形光场,用于超冷原子萨格纳克干涉测量。

Comments 10 pages, 5 figures, to appear in Optics Express

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20919 2026-06-26 cs.LG cs.AI cs.PL 版本更新 62%

Sutra: Tensor-Op RNNs as a Compilation Target for Vector Symbolic Architectures

Sutra: 以张量操作RNN作为向量符号架构的编译目标

Emma Leonhart

机构 * Emma Leonhart

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 Sutra是一种纯函数式编程语言,通过编译将整个程序降级为融合张量操作图,同时支持符号推理和神经网络训练,实现逻辑程序与可训练网络的统一。

Comments Modified NeurIPS submission, see AI declaration and replication materials at end of paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23816 2026-06-26 cs.LG cs.AI 版本更新 62%

Improved Bounds for Private and Robust Alignment

私有和鲁棒对齐的改进界

Wenqian Weng, Yi He, Xingyu Zhou

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文从理论角度研究语言模型的私有和鲁棒对齐,通过建立离线与在线设置下的次优性差距上界,分析隐私与对抗性腐败的两种交互模式,并给出改进的界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26423 2026-06-26 cs.RO cs.AI 新提交 57%

CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation

CoStream: 组合简单行为实现可泛化的复杂操作

Haonan Chen, Yuxiang Ma, Stephen Tian, Xiaoshen Han, Wenlong Huang, Feiyang Wu, Yunzhu Li, Jiajun Wu, Edward H. Adelson, Yilun Du

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 提出CoStream框架,通过组合语义、预测和反应三种简单行为,在共享SE(3)接口上实现高精度、可泛化的复杂操作,在8个真实任务中验证了其有效性。

Comments Website: https://costream-simple.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26361 2026-06-26 cs.LG physics.ao-ph 新提交 57%

Does Aurora Encode Atmospheric Structure? Latent Regime Analysis and Attribution

Aurora 是否编码了大气结构?潜在状态分析及归因

Emma Kasteleyn, Ana Lucic

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 本文通过空间池化PCA和逐层相关性传播分析Aurora模型的内部表征,发现其潜在空间主要按季节周期组织,且模型关注与三维垂直结构一致的特征,表明模型无需显式指令即可学习气象一致性和垂直结构。

Comments Accepted at the FM4Science and Sci4DL workshops at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27111 2026-06-26 cs.HC cs.SI 新提交 50%

Behind the Mask: A Taxonomic Analysis of Activities in Online Social Networks

面具背后:在线社交网络中活动的分类学分析

Debora F De Souza, Gabriela Beltrao, Berta Chulvi, Sergio Dantonio, Mehmet Gokay Ozerim, Javier Torregrosa, Adrian Giron, Angel Panizo, Pablo Miralles Gonzalez, Helena Liz, Javier Huertas Tato, Sonia Sousa, Alejandro Martin, Monika Maciuliene, David Camacho

专题命中 其他LLM :prompting(abstract)

AI总结 通过专家协作和文献综述设计分类法,分析恶意行为者的特征与活动,并以反移民话语案例研究验证其帮助识别虚假信息传播的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏