arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-03 至 2026-07-03 共收录 21 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 21 篇

2607.01600 2026-07-03 cs.LG cs.CL 新提交 92%

BOUNDARY_SYNC: Measuring Communication-Induced Representational Coupling in Multi-Agent LLM Systems

BOUNDARY_SYNC: 测量多智能体LLM系统中通信引起的表征耦合

Zewen Liu

机构 * Qilu Institute of Technology(齐鲁理工学院)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 提出BOUNDARY_SYNC协议,通过耦合放大因子(CAF)测量多智能体LLM系统中通信导致的表征耦合,发现文本通信导致显著同质化,图像通信也有类似效应,且组大小调节耦合方向。

Comments 18 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05536 2026-07-03 q-bio.NC cs.AI cs.LG eess.SP 版本更新 92%

Gravity-Awareness: Deep Learning Models and LLM Simulation of Human Awareness in Altered Gravity

重力感知:变重力环境下人类意识的深度学习模型与LLM模拟

Bakytzhan Alibekov, Alina Gutoreva, Elisa Raffaella-Ferre

机构 * School of IT & Engineering, Kazakh-British Technical University(信息技术与工程学院,哈萨克-英国技术大学) School of Psychological Sciences, Birkbeck University of London(心理学科学学院,伦敦伯贝克大学)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出一个计算框架,结合轻量级MLP神经网络(CorticalG)和高斯过程模型(PhysioG)预测变重力下的脑电与生理反应,并用LLM模拟主观体验,为航天任务中的人类适应提供预测工具。

Comments 60 pages, 5 figures, 2 datasets, 1 protocol

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01867 2026-07-03 cs.SE cs.AI 新提交 90%

An Exploratory Study on LLM-Generated Code and Comments in Code Repositories

关于LLM生成的代码和注释在代码仓库中的探索性研究

Yongyi Ji, Jiaji Wang, Yi Zhou, Fuxiang Chen, Hongji Yang

机构 * School of Computing and Mathematical Sciences, University of Leicester(利兹大学计算与数学科学学院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 本研究通过检测工具分析2021-2025年公司和社区维护的仓库,发现LLM生成的代码随时间减少且多出现在测试用例中,注释则相对稳定;公司仓库中LLM生成内容比例更高,且仅少数人工标记的bug与LLM生成代码相关。

Comments Accepted to The Journal of Systems & Software (JSS) on 1 July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02121 2026-07-03 cs.CR cs.AI 新提交 86%

Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring

拒绝背后:通过行为监控确定护栏激活

William Hackett, Peter Garraghan

机构 * Mindgard Lancaster University(兰卡斯特大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。

Comments 19 pages, 13 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12198 2026-07-03 physics.comp-ph cond-mat.mtrl-sci cs.AI 版本更新 86%

Grounded autonomous scrutiny at scale: emergent critique from reproduction of published computational physics papers

迈向有根的自主研究:一个端到端的LLM微型研究循环在已发表的计算物理学中的应用

Haonan Huang

机构 * Department of Physics, Princeton University(普林斯顿大学物理系)

专题命中 其他LLM :LLM(title_cn,summary_cn);分类 cs.AI

AI总结 本文提出一个端到端的LLM微型研究循环,用于在已发表的计算物理学中进行自主研究,通过大规模和深度测试展示其在复现、批评和扩展研究中的能力。

Comments v2: camera-ready version, accepted at ICML 2026 AI for Science Workshop. Corrects the phase-classification statistics and adds a coding-sensitivity analysis (Methods M6); the agent-produced six-page Comment is reproduced as-is in the final appendix. 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22063 2026-07-03 cs.SE cs.AI 版本更新 86%

RedCoder: Automated Multi-Turn Red Teaming for Code LLMs

RedCoder: 面向代码大语言模型的自动化多轮红队测试

Wenjie Jacky Mo, Qin Liu, Xiaofei Wen, Dongwon Jung, Hadi Askari, Wenxuan Zhou, Zhe Zhao, Muhao Chen

机构 * University of California, Davis(加州大学戴维斯分校) University of Southern California(南加州大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出RedCoder,一个通过多轮对话诱导代码大模型生成漏洞代码的自动化红队测试智能体,采用多智能体博弈生成原型对话和攻击策略库,并微调LLM作为骨干,实验表明其优于现有单轮和多轮方法。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02057 2026-07-03 cs.SE cs.AI 新提交 81%

Prompt Coverage Adequacy

提示覆盖充分性

Florian Tambon, Michael Konstantinou, Cedric Richter, Charles Chenouard, Mark Harman, Mike Papadakis

机构 * SnT, University of Luxembourg(斯蒂尔夫研究所,卢森堡大学) University College London(伦敦大学学院) University of Luxembourg(卢森堡大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出提示覆盖充分性标准,通过注意力机制衡量测试套件对提示需求的覆盖,相比传统代码覆盖能多检测30%以上缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00007 2026-07-03 cs.IR cs.AI 新提交 81%

BaRA: Budget-constrained and Reliable Web Data Collection Agent

BaRA: 基于BFS与反思的网络数据收集代理

Soojeong Lee, Joseph Lee, Yongseong Cho, Sunjae Kim, Youngwoo Moon, Kyungwoo Song

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出BaRA框架,结合有界广度优先搜索和历史自反思,在固定交互预算下高效收集网站级数据,在链接发现和可下载多模态提取上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04390 2026-07-03 cs.AI cs.SE 版本更新 77%

A Dual-Helix Governance Approach Towards Reliable Agentic Artificial Intelligence for WebGIS Development

面向可靠WebGIS开发的代理人工智能双螺旋治理方法

Boyuan Guan, Wencong Cui, Levente Juhasz

机构 * Geographic Information Systems Center, Florida International University(佛罗里达国际大学地理信息系统中心) Geospatial Analytics, Technology and Open Research Lab, University of Florida(佛罗里达大学地理空间分析、技术与开放研究实验室)

专题命中 其他LLM :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.AI

AI总结 针对代理AI在WebGIS开发中的不可靠问题,提出双螺旋治理框架,通过知识-行为-技能三轨架构和持久知识图谱外化事实与协议,实验证明能降低代码复杂度、减少输出方差并防止制图错误。

Comments Paper submitted to and under review in Transactions in GIS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27130 2026-07-03 cs.SE 版本更新 75%

A Large-Scale Comprehensive Measurement of AI-Generated Code in Real-World Repositories

对现实仓库中AI生成代码的大型实证研究

Tianhao Mao, Dongfang Zhao, Haixu Tang, Xiaofeng Wang, Hang Zhang

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文通过大规模实证研究分析现实仓库中AI生成代码的特性,探讨AI辅助开发与传统人类开发的差异,为理解AI在软件开发中的实际影响提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01859 2026-07-03 cs.AI cs.CL 新提交 73%

Safety Targeted Embedding Exploit via Refinement

通过精炼的安全目标嵌入利用

Joshua Adrian Cahyono

机构 * Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出STEER方法,通过梯度引导攻击识别并翻译关键词语到低资源语言,抑制大语言模型拒绝行为,在多个模型上实现高达96.7%的攻击成功率,揭示安全机制在多语言输入下的泛化缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27241 2026-07-03 cs.CL 70%

Identifying the Periodicity of Information in Natural Language

识别自然语言中的信息周期性

Yulin Ou, Yu Wang, Yang Xu, Hendrik Buschmeier

机构 * CLCS Lab, Department of Computer Science and Engineering, Southern University of Science and Technology(计算机科学与工程系,南方科技大学计算机语言实验室) Digital Linguistics Lab, Department of Linguistics, Bielefeld University(语言学系,比勒菲尔德大学数字语言学实验室)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出APS方法识别自然语言信息序列中的周期性,发现大量语言存在强周期性,且发现超出典型结构单位的新周期,并通过谐波回归验证。

Comments Accepted at ACL 2026 (main)

Journal ref Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers, ACL 2026), pp. 1161-1175

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24747 2026-07-03 cs.AI cs.MA 版本更新 70%

Formal Semantics for Agentic Tool Protocols: A Process Calculus Approach

智能体工具协议的形式语义:一种进程演算方法

Andreas Schlapbach

机构 * Swiss Federal Railways (SBB)(瑞士联邦铁路公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过进程演算形式化两种智能体工具协议(SGD和MCP),证明它们在映射Phi下结构互模拟,但反向映射有损,进而提出MCP+扩展实现完全等价。

Comments Logical flaw in Theorem 21

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01760 2026-07-03 cs.SE 新提交 67%

Refploit: Facilitating Exploit Construction via Code-Agent Trajectory Repair

Refploit: 通过代码代理轨迹修复促进漏洞利用构建

Zirui Chen, Zhipeng Xue, Jiayuan Zhou, Xing Hu, Xin Xia, Xiaohu Yang

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出Refploit框架,利用大语言模型修复代码代理生成的失败轨迹,通过差分执行验证和约束引导恢复,在Java漏洞数据集上实现80.2%的复现率,相对初始轨迹提升64.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01742 2026-07-03 cs.CR cs.SE 新提交 67%

Knowledge Over Parameters: Evolving Smart Contract Vulnerability Detection

知识超越参数:演化智能合约漏洞检测

Yuqiang Sun, Han Liu, Ying Li, Yiran Zhang, Zong Cao, Ziyun Guo, Yang Liu

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出EvoVuln框架,将漏洞检测转化为程序性知识演化问题,通过运行时反转控制架构和两阶段演化流水线,仅用少量标注样本自动合成并优化检测逻辑,在五种真实漏洞类型上实现71%宏平均F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26979 2026-07-03 cs.SE 新提交 67%

How Much Static Structure Do Code Agents Need? A Study of Deterministic Anchoring

代码智能体需要多少静态结构?关于确定性锚定的研究

Zhihao Lin, Mingyi Zhou, Yizhuo Yang, Li Li

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 研究轻量级静态分析(如调用图、继承层次)作为确定性锚定,通过注入结构注释提高代码智能体导航的可复现性和稳定性,发现锚定效果依赖粒度与仓库特性。

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026). 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20619 2026-07-03 cs.SE 版本更新 67%

Generating Project-Specific Test Cases with Requirement Validation Intention

生成具有需求验证意图的项目特定测试用例

Binhang Qi, Yun Lin, Xinyi Weng, Yuhuan Huang, Chenyan Liu, Hailong Sun, Zhi Jin, Jin Song Dong

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出IntentionTest方法,通过检索-编辑方式,根据验证意图描述生成项目特定测试,相比基线方法杀死更多突变体并提高测试通过率。

Comments Accepted at ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01339 2026-07-03 hep-ph astro-ph.HE hep-ex hep-th 新提交 50%

Electron stability constrains neutrino time delays

电子稳定性限制中微子时间延迟

Mauricio Bustamante, José Manuel Carmona, José Luis Cortés, Ardit Gkioni, Maykoll A. Reyes

专题命中 其他LLM :prompting(abstract)

AI总结 通过分析电子稳定性,约束洛伦兹不变性破缺(LIV)对中微子时间延迟的解释,排除亚光速LIV解释高能宇宙中微子延迟的可能性。

Comments 6 pages, 2 figures, plus appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31363 2026-07-03 cs.CV 新提交 50%

Language-Assisted Super-Resolution from Real-World Low-Resolution Patches

语言辅助的真实世界低分辨率图像超分辨率

Joonkyu Park, Kyoung Mu Lee

机构 * IPAI, Seoul National University(首尔大学IPAI)

专题命中 其他LLM :language model(abstract)

AI总结 提出LA-SR框架,利用视觉语言模型在语言空间中对齐LR和HR图像,通过语言内容损失和语言质量损失实现无配对真实LR图像的超分辨率。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12937 2026-07-03 cs.CV 版本更新 50%

SGMatch: Semantic-Guided Non-Rigid Shape Matching with Flow Regularization

SGMatch: 基于语义引导与流正则化的非刚性形状匹配

Tianwei Ye, Xiaoguang Mei, Yifan Xia, Fan Fan, Jun Huang, Jiayi Ma

机构 * Wuhan University(武汉大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 提出SGMatch框架,通过融合视觉基础模型的语义特征和条件流匹配正则化,解决非等距变形和拓扑噪声下的非刚性3D形状匹配问题。

Comments 29 pages, 13 figures, 17 tables. Project Page: https://yetianwei.github.io/SGMatch/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18368 2026-07-03 cs.RO 版本更新 50%

Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation

学习多任务机器人操作的语义原子技能

Yihang Zhu, Weiqing Wang, Shijie Wu, Ye Shi, Jingya Wang

机构 * ShanghaiTech University(上海科技大学)

专题命中 其他LLM :language model(abstract)

AI总结 提出AtomSkill框架,通过语义对比对齐和关键姿态想象,从演示中学习可重用原子技能,实现多任务机器人操作,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏