arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2607.28285 2026-07-31 cs.CV 新提交 67%

Beyond Visual Ambiguity: Guiding Robust Monocular Depth Estimation in Challenging Scenarios via Detailed Long Captions

超越视觉歧义:通过详细长文本引导具有挑战性场景下的鲁棒单目深度估计

Junrui Zhang, Jiaqi Li, Yiran Wang, Liao Shen, Zhiguo Cao

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院)

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 该研究针对单目深度估计的视觉歧义问题,提出CapDepth框架,通过详细长文本引导,在非朗伯表面和恶劣天气下的深度误差较现有最优方法分别降低25.0%和22.0%。

Comments Accepted to ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25019 2026-07-29 econ.TH cs.GT cs.MA 新提交 67%

Interactive Alignment

交互式对齐

Sylvain Chassang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究交互式主体与人类福祉的长期对齐问题,采用人工智能主体模拟和进化博弈论框架两种方法,结果显示进化博弈论可近似宪法主体经济动态,实用规范执行能更有效维持长期对齐。

Comments 53 pages, 18 Figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24194 2026-07-28 cs.CV 新提交 67%

Face Age Verification Vulnerabilities Under Simple Appearance Manipulations

简单外观操纵下的面部年龄验证漏洞

Ioannis Sarridis, Ioannis Kompatsiaris, Symeon Papadopoulos

机构 * Information Technologies Institute, Centre for Research and Technology Hellas(信息技术研究所,希腊研究与技术中心)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究简单外观操纵下面部年龄验证的漏洞,评估七个模型在三个数据集及四种操纵类型下的情况,发现胡茬操纵影响大,不同人口统计特征受影响有差异,还探索了用偏差缓解方法减轻偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21967 2026-07-27 stat.AP 新提交 67%

When Machines Lie Differently: Detecting AI vs Human Fake News

当机器说谎方式不同时:检测人工智能与人类制造的假新闻

Canliv Ibenye, Aya-Vera Jimenez, Samuel Jaeger, Dhrubajyoti Ghosh

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究通过两个二元分类任务,用词汇、可读性等特征及多种机器学习模型,区分真实新闻与人类及人工智能生成的假新闻,发现检测人工智能生成的假新闻准确率高,而人类撰写的较难区分,揭示了错误信息检测的不对称性。

Comments Accepted at ICMLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22406 2026-07-27 cs.SE 新提交 67%

Vibe Coding: An Experiment with Test-Driven Development

Vibe编码:一项测试驱动开发的实验

Moritz Mock, Barbara Russo

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究探索人类与CLLMs通过vibe编码对等协作,设计四个交互模型并实现相应TDD工作流程。通过实验发现交互模型选择取决于开发目标,智能工作流程利于快速开发但有复杂性,协作工作流程产生更高质量测试套件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21769 2026-07-27 cs.HC 新提交 67%

From Grasping to Speaking: Generative AI-Based Environment-Grounded VR Communication Training for Autistic Individuals

从抓握到说话:基于生成式人工智能的自闭症个体环境基础VR沟通训练

Ziming Li, Roshan L. Peiris

专题命中 其他LLM :LLM(abstract);prompting(abstract)

AI总结 研究探索基于生成式人工智能的VR沟通训练对自闭症个体的作用,通过9名受训者和7名教练参与的三种模式实验发现,C+O+G模式更受青睐,可用性和工作量相当,有助于沟通实践融入任务执行,还讨论了相关设计考量。

Comments 14 pages, ASSETS2026

Journal ref The 28th International ACM SIGACCESS Conference on Computers and Accessibility (ASSETS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17005 2026-07-21 cs.AR cs.DS 新提交 67%

Provably Good Prim-Dijkstra Revisited: New Theory and a Practical Algorithm for a Classical VLSI Routing Problem with LLMs

重温可证明良好的Prim-Dijkstra算法:针对经典VLSI路由问题的新理论及基于大语言模型的实用算法

Keren Zhu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 针对经典VLSI路由问题,通过Prim-Dijkstra算法,证明弱NP完全性,推导成本-半径权衡,构建多模式求解器HP-RCRST,在开发实例上表现出色,重新开启被忽视问题,展现大语言模型对算法研究的推动作用。

Comments 23 pages, 6 figures. Code and reproducibility materials: https://github.com/CODA-Team/hp-rcrst

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13443 2026-07-16 cs.CY cs.DC 新提交 67%

The Environmental Cost of Digital Sovereignty: Water, Energy, and Emissions Impacts of Sovereign AI Infrastructure in the Global South

数字主权的环境成本:全球南方主权人工智能基础设施的水、能源和排放影响

Muntaser Syed, Marius C. Silaghi, Sheikh Abujar, Sharun Akter Khushbu, Amal El Ahmad

专题命中 其他LLM :language model(abstract);small language model(abstract)

AI总结 研究全球南方主权人工智能基础设施的环境成本,通过对四个案例分析,模拟其水、能源消耗及碳排放,发现存在主权-可持续性困境,进而提出对环境负责的主权人工智能设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11859 2026-07-14 cs.CY cs.AR cs.MA 新提交 67%

Can LLMs Perform Deep Technical Comprehension of Computer Architecture Papers?

大语言模型能否对计算机体系结构论文进行深度技术理解?

Nishant Aggarwal, Ayushi Dubal, Sreeraj Kannakarankodi, Ian McDougall, Adarsh Mittal, Vishnu Ramadas, Noah Scott, Ranganath Selagamsetty, Weichu Yang, Karthikeyan Sankaralingam

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究大语言模型对计算机体系结构论文的深度理解,通过开源管道Gauntlet进行分析,经与人类分析对比及消融实验,发现其多智能体结构有优势,尤其合成阶段,还将相关资源作为社区资源发布。

Comments 4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09766 2026-07-14 cs.AI cs.CL cs.LG cs.MA 新提交 67%

Norm Enforcement for AI Agents: Robustly Shaping Behavior in Multi-Agent Systems

人工智能代理的规范执行:在多智能体系统中稳健塑造行为

Yaowen Ye, Jacob Steinhardt

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究多智能体系统中语言模型代理的规范执行机制,针对简单机制易被利用的问题,确定估计代理可靠性及加重惩罚更新估计这两个关键要素,所构建机制可抵御利用且低成本惩罚违规,是塑造智能体行为的可扩展手段。

Comments ICML2026 Trustworthy AI for Good Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06654 2026-07-13 quant-ph physics.atom-ph 新提交 67%

Localized control of large ion crystals in a Penning trap using a spatial light modulator

使用空间光调制器对彭宁阱中的大离子晶体进行局部控制

Allison L. Carter, Jennifer F. Lilieholm, Bryce B. Bullock, Kurt Thompson, Diep Nguyen, John J. Bollinger

专题命中 其他LLM :SLM(abstract,abstract_cn)

AI总结 研究利用空间光调制器对彭宁阱中大离子晶体进行局部控制,通过施加可编程交流斯塔克位移图案实现,验证了该技术并为彭宁阱中单个离子寻址提供途径。

Comments Main text: 5 pages, 3 figures; End matter: 2 pages, 2 figures; Supplemental material: 10 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07007 2026-07-09 cs.CR cs.SE 新提交 67%

Thinking More, Harnessing Better: State Machine Guided Harness Automatic Generation with Project Digestion and Workflow Decomposition

思考更多,利用更好:通过项目剖析和工作流分解实现状态机引导的测试 harness 自动生成

Xing Zhang, Zikang Huang, Gang Yang, CongChong Wang, Lu Liu, Bin Yin, Mingyi Wang, Ziquan Zhao, Min Li, Zhenyu Chen, Bo Wu, Lingyun Ying

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究针对现有大语言模型单轮生成模糊测试 harness 的局限,提出 SynapseFlow,通过数据流感知函数聚合和分阶段回滚算法,经四阶段过程合成 harness,在 25 个开源项目上评估,效果超现有工具,还发现多个未报告错误。

Comments 20 pages, accepted by CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05149 2026-07-07 cs.SE 新提交 67%

Intent-Based Mutation Testing: From Naturally Written Programming Intents to Mutants

基于意图的变异测试:从自然编写的编程意图到变异体

Asma Hamidi, Ahmed Khanfir, Mike Papadakis

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出基于意图的变异测试,通过改变被测程序实现的编程意图来生成变异体,与传统测试不同,能捕获不同类型故障,用大语言模型实现并评估,可补充传统变异测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01760 2026-07-03 cs.SE 新提交 67%

Refploit: Facilitating Exploit Construction via Code-Agent Trajectory Repair

Refploit: 通过代码代理轨迹修复促进漏洞利用构建

Zirui Chen, Zhipeng Xue, Jiayuan Zhou, Xing Hu, Xin Xia, Xiaohu Yang

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出Refploit框架,利用大语言模型修复代码代理生成的失败轨迹,通过差分执行验证和约束引导恢复,在Java漏洞数据集上实现80.2%的复现率,相对初始轨迹提升64.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01742 2026-07-03 cs.CR cs.SE 新提交 67%

Knowledge Over Parameters: Evolving Smart Contract Vulnerability Detection

知识超越参数:演化智能合约漏洞检测

Yuqiang Sun, Han Liu, Ying Li, Yiran Zhang, Zong Cao, Ziyun Guo, Yang Liu

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出EvoVuln框架,将漏洞检测转化为程序性知识演化问题,通过运行时反转控制架构和两阶段演化流水线,仅用少量标注样本自动合成并优化检测逻辑,在五种真实漏洞类型上实现71%宏平均F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26979 2026-07-03 cs.SE 新提交 67%

How Much Static Structure Do Code Agents Need? A Study of Deterministic Anchoring

代码智能体需要多少静态结构?关于确定性锚定的研究

Zhihao Lin, Mingyi Zhou, Yizhuo Yang, Li Li

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 研究轻量级静态分析(如调用图、继承层次)作为确定性锚定,通过注入结构注释提高代码智能体导航的可复现性和稳定性,发现锚定效果依赖粒度与仓库特性。

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026). 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00083 2026-07-02 cs.CL cs.AI cs.LG 新提交 67%

Harnessing the Latent Space: From Steering Vectors to Model Calibrators for Control and Trust

利用潜在空间:从引导向量到模型校准器以实现控制与信任

Nishant Subramani

机构 * Carnegie Mellon University, Language Technologies Institute(卡内基梅隆大学语言技术研究所)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用潜在空间中的引导向量控制语言模型行为,并开发基于潜在空间的模型校准器评估输出可信度,从而增强模型的可控性与可靠性。

Comments ACL 2026 (BigPicture Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25189 2026-07-02 cs.OS 新提交 67%

ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses

ActPlane:面向代理框架的可编程操作系统级策略执行

Yusheng Zheng, Tianyuan Wu, Quanzhi Fu, Tong Yu, Wenan Mao, Tao Ma, Dan Williams, Wei Wang, Andi Quinn

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出ActPlane,一种在操作系统内核中执行代理策略的引擎,通过eBPF实现信息流控制,弥补语义鸿沟,覆盖工具层无法观察的间接执行路径,开销1.9%-8.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28081 2026-06-29 cs.HC cs.IR 新提交 67%

Context-Aware Explanations for Spatialized Document Layouts

空间化文档布局的上下文感知解释

Wei Liu, John Wenskovitch, Chris North, Rebecca Faust

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出CAPE框架,结合文档语义和布局空间上下文,通过识别空间模式并构建多级上下文表示,生成自然语言解释,支持AI引导概览和用户驱动探索,实验表明空间解释比纯内容基线更有助于理解布局空间组织。

Comments 10 pages, 4 figures, accepted to Graphics Interface 2026 (GI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26641 2026-06-26 cs.HC 新提交 67%

Invisible Impact of Empathy on Behavioral Change: Isolating the Effect of Empathy in Long-term Physical Activity Coaching Chatbot Interactions

共情对行为改变的隐形影响:在长期身体活动教练聊天机器人交互中隔离共情效应

Li Siyan, Kai-Hui Liang, Shopnil Shahriar, Yilin Ye, Shiyoh Goetsu, Wei-Wei Du, Masahiro Yoshida, Tsunayuki Ohwa, Xuhai Xu, Zhou Yu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过构建仅共情水平不同的三个聊天机器人进行六周实验,发现用户难以区分共情程度,但高共情版本仍能增加步数并改善遵循意图,表明共情通过外围路径影响动机和信任。

Comments Shortened version of paper accepted into CUI Short paper and WIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24870 2026-06-24 cs.HC 新提交 67%

"Zooming In" on Agentic Web Browsers as Assistive Technologies: A Case Study with a Low-Vision Technology Expert

“放大”代理型网络浏览器作为辅助技术:一项低视力技术专家的案例研究

Laura Colazzo, Giuseppe Anzillotti

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过低视力专家案例研究,探讨基于大语言模型的代理型网络浏览器如何以对话方式辅助视障用户导航网页,发现其虽有限制但体验流畅灵活,有望提升无障碍性并减少交互障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23464 2026-06-23 cs.SE cs.CR 新提交 67%

An Automated Framework for Input Alphabet Construction in Stateful Protocol Implementation Learning

有状态协议实现学习中的输入字母表自动构建框架

JiongHan Wang, WenChao Huang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出利用大语言模型自动解析协议消息布局并生成候选输入符号,结合小批量增量学习策略重用已学自动机,以解决手工构建输入字母表导致的探索不完整和语义缺陷问题。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19216 2026-06-18 cs.SE cs.HC 新提交 67%

No Two Developers Think Alike: How Problem-Solving Styles and Experience Shape Needs in Conversational Interaction with Copilot

没有两个开发者想法相同:问题解决风格和经验如何塑造与 Copilot 对话交互中的需求

Jonan Richards, Bruno Alves de Oliveira, Iury Oliveira, Igor Wiese, Mairieli Wessel

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 通过混合方法出声思考研究,识别出5种交互模式和10种需求,并建立概念模型,揭示认知多样性如何影响开发者与GitHub Copilot的交互。

Comments Accepted at the International Conference on Software Maintenance and Evolution (ICSME), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14049 2026-06-15 cs.SD cs.CV 新提交 67%

FoleyGenEx: Unified Video-to-Audio Generation with Multi-Modal Control, Temporal Alignment, and Semantic Precision

FoleyGenEx: 统一视频到音频生成,具备多模态控制、时间对齐与语义精度

Shiyao Wang, Xijuan Zeng, Hui Wang, Shiwan Zhao, Feng Deng, Chen Zhang, Yong Qin

机构 * Academy for Advanced Interdisciplinary Studies, Nankai University(南开大学前沿交叉学科研究院) Kling Team, Kuaishou Technology(快手科技Kling团队)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出FoleyGenEx统一框架,通过条件注入、多模态动态掩码和副词数据增强,实现视频到音频生成中多模态控制、帧级时间对齐与细粒度语义的同步合成。

Comments Accepted by INTERSPEECH 2026

Journal ref INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11822 2026-08-13 cs.CL cs.LG 新提交 62%

Located but Not Releasable: Silent Gate Inversion and Bounded Linear Release

已定位但不可释放:静默门控反转与有界线性释放

Xining Xun

机构 * Tsingjiao Information Science (Beijing) Co., Ltd.(清教信息科学(北京)有限公司)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究在2570万参数的因果证据判别Transformer模型上,测试了检测、定位与释放潜在结构的流程,发现定位成功但门控反转、线性释放有界,两种失效可分离且未推翻定位结果。

Comments 16 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10424 2026-08-12 cs.AI cs.LG 新提交 62%

Recovering Wasted Compute in Autoresearch Agents

恢复自动研究智能体中浪费的计算资源

Au Kwok Chun, Abhigyan Acherjee, Amrutha Rao, Zaiqian Chen, Kazem Meidani, C. Bayan Bruss, Micah Goldblum

机构 * Columbia University(哥伦比亚大学) Georgetown University(乔治城大学) Capital One(第一资本金融公司)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文针对自动研究智能体应用于表格数据集时的四类计算资源浪费问题,提出针对性干预措施,仅通过优化智能体设计即可大幅提升其性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06631 2026-08-10 cs.LG cs.AI 新提交 62%

Cryptanalytic Extraction of Isolated Bias-Free GLU Feed-Forward Blocks by Antipodal Separation

通过对极分离的密码分析提取孤立无偏GLU前馈块

Chunhui Shi, Xinwen Fu

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对现有密码分析提取方法无法恢复现代语言模型的无偏GLU前馈块的问题,提出多阶段前向查询恢复原语,在多种模型上实现亚百分位或低误差,且明确其非端到端攻击的性质。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05949 2026-08-07 cs.AI cs.CV cs.LG 新提交 62%

VLMs for Videogame Data Annotation

用于视频游戏数据标注的视觉语言模型(VLMs)

Katrin Schmid, Iuri Frosio

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对VLMs在视频游戏应用受限的问题,探究其用于游戏帧序列奖励信号标注的可行性,分析其在游戏问答中的不足并提出应对措施,还研究了输入参数对标注质量的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03507 2026-08-05 cs.CL cs.AI 新提交 62%

ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels

ChronoLens:测量跨时间、语言和语言层面的语言变化

Gagan Bhatia, Julian Schlenker, Simone Paolo Ponzetto, Steffen Eger

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 ChronoLens框架结合多语言模型等技术,分析1803-2026年五议会传统的海量文本,揭示同语言内各语言层面变化幅度相当、不同语言变化轨迹有差异,为跨语言历史语言变化研究提供方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01436 2026-08-04 cs.CY cs.AI cs.CL cs.HC 新提交 62%

Same violence, different answer: how AI responds to coercive control against women across languages

相同的暴力,不同的回应:人工智能如何对不同语言中针对女性的胁迫控制做出反应

Lyu Chang, Sònia Estradé Albiol, Núria Vergés Bosch

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究分析7种语言模型对9种语言下女性受伴侣胁迫控制场景的回应,发现非英语开发者系统在母语中易失效,前沿系统可实现统一保护,主张为各语言设定AI保护的最低标准。

Comments 16 pages, 1 figure, 2 tables. Supplementary methods, coding manual, and data workbook included as ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏