arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-18 至 2026-08-18 共收录 661 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 44 篇

2608.15108 2026-08-18 cs.CR cs.AI 新提交 83%

Beyond Direct Access: Resource Hijacking in LLM Agents

超越直接访问:大语言模型智能体中的资源劫持

Puyu Zeng, Qibing Ren

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究首次识别智能体资源劫持这一安全盲区,推出ResourceHijackBench及自动化生成流程,实验显示无防御时OpenClaw平均攻击成功率达84.06%,现有防御仍不足。

Comments 11 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14944 2026-08-18 cs.RO cs.CL cs.LG 新提交 82%

SkillComposer: Learning Reusable Skills for Natural-Language Robot Programming

SkillComposer:学习可复用技能的自然语言机器人编程系统

John Woods, Hasti Seifi

机构 * School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 SkillComposer是一款仿真环境下的交互式自然语言机器人编程系统,采用生成-测试架构,通过在线库学习算法生成可复用宏技能,经实验验证可提升任务成功率与可用性并减少用户工作量。

Comments 8 pages, 6 figures. Submitted to IEEE Humanoids 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15546 2026-08-18 cs.AI cs.NE 新提交 81%

ATLAS: Scaffold-Free Algorithm Synthesis by LLMs via Embedding-Guided Quality-Diversity Search

ATLAS:基于嵌入引导的质量多样性搜索的无支架大语言模型算法合成

Danial Yazdani, Mohammad Nabi Omidvar, Yuan Sun, Maksud Ibrahimov, Xiaodong Li

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 ATLAS是基于LLM的无支架全算法合成框架,通过嵌入引导质量多样性搜索解决全算法设计空间问题,在NP难问题上优于相关基线,可保留不同区域的多类算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15165 2026-08-18 cs.AI 新提交 81%

SkillCommit: Evolving Agent Skills through Behaviorally Validated Scope Expansion

SkillCommit:通过行为验证的范围扩展实现智能体技能演化

Yu He, Weikai Yang

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出SkillCommit框架,通过保留经验的验证行为、抽象相关技能,在RuleArena等数据集上提升智能体性能,且所学技能可跨模型迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10319 2026-08-18 cs.SE cs.AI 版本更新 81%

Do Personalized Skills Help Coding Agents? An Empirical Study of Developer Interaction Histories

个性化技能对编码智能体有帮助吗?开发者交互历史的实证研究

Shuyan Huang, Kai Du, Andrew Lan

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究通过对13位开发者的206个真实会话实验,发现从交互历史提炼的开发者个性化技能改进有限,而汇集自所有开发者的通用技能增益最大且最一致,为编码智能体的个性化策略提供了实证依据。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10267 2026-08-18 cs.LG 版本更新 81%

In-Context Source and Channel Coding

上下文源码与信道编码

Ziqiong Wang, Tianqi Ren, Rongpeng Li, Zhifeng Zhao, Honggang Zhang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(信息科学与电子工程学院,浙江大学) Zhejiang Lab(浙江实验室) Macau University of Science and Technology, China(澳门科学理工学院,中国)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种接收端上下文解码框架,通过改进SSCC的鲁棒性,在不修改发射端的情况下提升低信噪比下的传输性能。

Comments Published in SCIENCE CHINA Information Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15772 2026-08-18 cs.AI 新提交 79%

Broken Symmetry in LLM Refusal: Answer Release Is More Local Than Refusal Restoration

大语言模型拒绝回答中的对称性破缺:答案释放比拒绝恢复更具局部性

Yiqi Liu, Yang Wang, Songxin Wang, Chenghao Xiao, Chenghua Lin

机构 * University of Manchester(曼彻斯特大学) Shanghai University of Finance and Economics(上海财经大学)

专题命中 其他LLM :LLM(title);language model(abstract);分类 cs.AI

AI总结 本研究通过受控保留设置揭示大语言模型拒绝回答存在对称性破缺:答案释放具高度局部性,拒绝恢复需更广干预,拒绝并非简单对称开关,对安全审计具启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18518 2026-08-18 cs.LG stat.ME stat.ML 版本更新 79%

Measuring the Prevalence of Policy Violating Content with ML Assisted Sampling and LLM Labeling

利用机器学习辅助抽样和大语言模型标注测量违规内容的普及率

Attila Dobi, Aravindh Manickavasagam, Benjamin Thompson, Xiaohan Yang, Faisal Farooq

机构 * Pinterest

专题命中 其他LLM :LLM(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于机器学习和大语言模型的系统,用于高效测量违反政策内容的普及率,通过概率抽样和多模态标注提升测量准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00410 2026-08-18 cs.AI cs.CL cs.CV 版本更新 79%

Where did the ambiguity go? Examining how multimodal models interpret polysemous words

歧义去了哪里?探究多模态模型如何解释多义词

Jasin Cekinmez, Addison J. Wu, Raja Marjieh, Thomas L. Griffiths

机构 * Princeton University(普林斯顿大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI

AI总结 该研究对比17个文本到图像模型和15个文本生成模型,发现多模态模型生成图像的词义多样性低于文本,揭示了基础模型在不同模态间意义表达的迁移 gap。

Comments Oral Presentation, Sci-FM Workshop @ COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06223 2026-08-18 cs.CV 78%

RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion

RedDiffuser:通过强化扩散审计多模态安全故障

Ruofan Wang, Xingjun Ma

机构 * Fudan University(复旦大学)

专题命中 其他LLM :language model(title,abstract)

AI总结 研究多模态系统在有害上下文暴露下的安全审计,提出RedDiffuser框架通过扩散模型生成视觉输入,揭示隐藏的安全漏洞,实验显示VLMs在部分有毒文本与视觉上下文结合时存在广泛安全问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15115 2026-08-18 cs.CV 新提交 75%

Perspective-Invariant Attack with Enhanced Transferability of Adversarial Examples

具有增强对抗样本迁移性的视角不变攻击

Kaisheng Liang, Yiming Cao, Bin Xiao

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对对抗样本跨模型迁移性带来的安全威胁,提出视角不变攻击(PIA)及其扩展PIA-Mix,通过多自由度顶点采样策略提升对抗样本迁移性,实验显示其性能优于当前最优基于迁移的攻击方法。

Journal ref IEEE Transactions on Information Forensics and Security, vol. 21, pp. 6818-6831, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16686 2026-08-18 cs.HC cs.CL cs.RO 新提交 70%

Closing the Affective Loop: Multimodal Speaker-Listener Emotion-Dynamics-Aware Empathetic Social Robots

闭合情感循环:具情感动态感知的多模态说话人-听话人共情社交机器人

Zi Haur Pang, Casey Kennington, Tatsuya Kawahara

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本研究提出AffectLoop系统,在Misty II机器人上实现多模态情感动态感知的说话人-听话人共情交互,经试点研究验证可提升共情响应与用户满意度。

Comments This paper has been accepted for presentation at APSIPA ASC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16409 2026-08-18 cs.LG 新提交 70%

SoftModel: A Neural Model That Grows Its Own Topology -- Governed Structural Growth for Continual In-Service Learning

SoftModel:一种自行扩展拓扑的神经模型——面向持续服务中学习的受控结构增长

Zhoumin Xie

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究提出了软模型(SoftModel),其结构可随非平稳数据流持续受控增长,在标准持续学习基准上保留了长任务序列的持续学习能力,为终身学习提供了新方案。

Comments 99 pages, 16 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14913 2026-08-18 cs.GT cs.AI cs.MA 新提交 70%

The Open-Strategy Dictator Game: Cooperation Under Mutual Transparency

开放策略独裁者博弈:相互透明下的合作

Michael Glass

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出开放策略独裁者博弈,借助大语言模型裁决互动,通过循环锦标赛分析发现条件合作策略占优,证明在智能体可互查决策程序的环境中条件合作具备进化稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14697 2026-08-18 cs.AI 新提交 70%

Synchronized Logit Steering: Real-world Steganography

同步对数几率调控:面向真实场景的隐写术

Andrew Rufail, Aadi Dash, Onir Narahari, Ethan Mui, Mahi Gajare, Prakhar Tiwari, Shrija Makapothula, Nick Cui

机构 * Algoverse AI

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出同步对数几率调控(SLS),一种无需发送方与接收方共享相同提示上下文的确定性隐写方案,通过代理提示编码有效载荷,在多数据集上验证其低 KL 散度、高信息密度及强隐蔽性,实现实用隐蔽通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03361 2026-08-18 cs.CY cs.AI 版本更新 70%

The Evolutionary Origin of Values: implications for AI alignment, sentience and existential risk

价值的进化起源:对AI对齐、感知能力和生存风险的启示

Francis Heylighen

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究通过追溯生物价值的进化起源,论证LLMs无内在生存动机与感知能力,正交性论点不适用于它们,AI对齐的核心挑战是确保LLMs应用习得的伦理价值。

Comments submitted chapter for book: T. Veloz & C. Rittberg (Eds.), AI and Human Values. Springer

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24496 2026-08-18 cs.CR cs.AI 版本更新 70%

Red-Teaming the Agentic Red-Team

红队测试代理型红队

Dario Pasquini, Michal Bazyli, Taras Fedynyshyn, Artem Sorokin

机构 * Cracken Information Protection Department, Lviv Polytechnic National University(利沃夫理工学院信息保护系)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文首次深入分析主流进攻性安全代理系统的安全漏洞,揭示其设计缺陷可导致API密钥泄露、持久化控制及宿主机失陷,并提出架构级缓解设计原则。

Comments v0.1

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00971 2026-08-18 cs.CV cs.AI 版本更新 70%

MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4

MiniGPT-反向设计:利用MiniGPT-4预测图像调整

Vahid Azizi, Fatemeh Koochaki

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过扩展和微调MiniGPT-4,使其可应用于给定源图像、编辑后图像及可选文本描述来预测图像编辑操作与参数的反向设计任务,验证了现成VLMs在复杂多模态任务中的可扩展性。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16484 2026-08-18 cs.CV 新提交 67%

Remote-Sensing City Layout Extraction with MLLM

基于多模态大语言模型(MLLM)的遥感城市布局提取

Zigan Zhou, Kai Li, Yupeng Deng

机构 * City University of Hong Kong(香港城市大学) University of Chinese Academy of Sciences(中国科学院大学) Aerospace Information Research Institute(空天信息创新研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本研究提出Code-as-City方法,利用MLLM将遥感顶视图图像转化为含平面与3D输出的可编辑城市布局,在CityLayout-100数据集上取得41.1%、48.3%的交并比,验证了视觉观测转城市代码的可行性。

Comments 4 pages, 2 figures, 4 tables. Accepted to IEEE APGARSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15948 2026-08-18 cs.DB 新提交 67%

Evidence-Carrying Validation for Knowledge Graphs

带证据的知识图谱验证

Gabe Fierro

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 针对知识图谱现有验证接口无法说明检查通过原因的问题,提出带证据的验证接口,在SHACL验证器Shifty中实现,实验表明其开销为仅一致性验证的1.54-2.07倍,可辅助程序诊断并修复知识图谱缺失信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14977 2026-08-18 cs.GT 新提交 67%

Watermarked Game Solving via Perturbed Regret Minimization

基于扰动遗憾最小化的带水印博弈求解

Juho Kim, Tuomas Sandholm

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文针对现有博弈智能体水印技术仅适用于完美信息博弈的局限,提出集成于学习过程、可用于不完美信息博弈的扰动遗憾最小化水印方法,其水印代价小且易检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14893 2026-08-18 cs.SI physics.soc-ph 新提交 67%

Weaker Coherence, Weaker Reciprocity: Comparing the Semantic and Social Organization of Moltbook and Reddit

连贯性更弱,互惠性更弱:对比Moltbook与Reddit的语义及社交组织

Favio Di Ciocco, Lucas Díaz Celauro, Sebastián Pinto, Marcelo Kuperman, Pablo Balenzuela

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究对比AI智能体社交网络Moltbook与早期Reddit,发现Reddit在语义连贯性、多样性及交互互惠性上更优,且未被Moltbook复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12440 2026-08-18 cs.SE cs.AI 版本更新 61%

Specification-first convergence with an AI coding agent: a case study of dismantling a core architectural invariant across 189 files in a 717k-line codebase with no test oracle and no human code review

采用AI编码智能体的规范优先收敛:在71.7万行代码库中拆解189个文件的核心架构不变量的案例研究

Joel Abenhaim

专题命中 其他LLM :language model(abstract);分类 cs.AI;LLM(comments)

AI总结 本文通过案例研究,展示AI编码智能体在规范优先协议下,成功在71.7万行代码库中拆解核心架构不变量,耗时3天、成本2430美元,修正201个缺陷,涉及189个文件。

Comments 14 pages, 4 figures, 3 tables. v2: added plain-text log URLs in Section 10 for LLM readability

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15910 2026-08-18 eess.AS cs.CL cs.SD 新提交 57%

Iterative Self-Learning for Expressive Text-to-Speech Synthesis

用于高表现力文本到语音合成的迭代自学习

Nicholas Sanders, Gustav Eje Henter, Simon King, Korin Richmond

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 针对低资源下高表现力TTS的标签稀缺问题,提出迭代自学习框架,基于Invert-Classify方法迭代优化伪标签,在词级突出性和情感任务上验证,提升了标签贴合度与合成质量,性能接近全监督模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15475 2026-08-18 cs.CR cs.AI 新提交 57%

Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability

针对视觉-语言-动作模型的位翻转攻击:动作解码架构决定漏洞

Yudong Gao, Linghan Chen, Wenhan Wu, Mia Zhou, Jiyao Wang, Kaiyan Ji, Mingyu Guo, Honglong Chen

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 该研究针对视觉-语言-动作模型提出位翻转攻击,发现动作解码架构决定漏洞,少量梯度选择的位翻转可大幅降低闭环成功率,权重完整性是具身基础模型的安全边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17678 2026-08-18 cs.CV cs.AI 版本更新 57%

TIMA: Text-Image Mutual Awareness for Balancing Zero-Shot Adversarial Robustness and Generalization Ability

TIMA:用于平衡零样本对抗鲁棒性与泛化能力的文本-图像互感知框架

Fengji Ma, Hei Victor Cheng, Chenxing Li, Li Liu

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 本研究针对CLIP等基础模型在零样本场景下难平衡对抗鲁棒性与泛化能力的问题,提出TIMA框架,通过TAI与IAT两个模块校准Logit间距、保留语义一致性,实验显示其性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14859 2026-08-18 q-fin.ST 新提交 50%

Disclosed Human-Capital Disruption and Firm-Specific Risk

已披露的人力资本中断与公司特定风险

Ang Zhang

专题命中 其他LLM :language model(abstract)

AI总结 该研究构建财报电话会议中已披露人力资本中断的衡量指标,发现其与公司特定风险显著相关,可预测特质波动率、下行偏差等变化及高管离职,揭示了劳动力短缺外的组织投入干扰信息。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16715 2026-08-18 cs.RO 新提交 50%

MatchingPolicy: Correspondence-Aware Policy Enables Cross-Object In-Context Learning

MatchingPolicy:具备对应感知能力的策略实现跨物体的上下文学习

Qijin She, Hanyang Yu, Zeming Li, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 该研究提出MatchingPolicy框架,通过解耦演示-场景匹配与策略学习,结合视觉基础模型和两阶段匹配算法,在RLBench及真实操作任务上实现了跨物体的少样本泛化性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15519 2026-08-18 cs.SI 新提交 50%

Topological collapse of higher-order interactions bottlenecks collective intelligence in AI agent societies

智能体社群中高阶相互作用的拓扑崩溃是集体智能的瓶颈

Shuo Lu, Weicheng Meng, Aijing Yu, Kun Shao, Jian Luan, Ran He, Jian Liang

专题命中 其他LLM :language model(abstract)

AI总结 该研究发现AI智能体社群中高阶交互的拓扑崩溃会成为集体智能瓶颈,提出HIS和Φ指标,证实该瓶颈与模型无关,为人工社会设计提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15207 2026-08-18 cs.IT cs.NI math.IT 新提交 50%

ICL-SEC: Iterative Cross-Layer Semantic Error Correction

ICL-SEC:迭代跨层语义错误校正

Yirun Wang, Soung Chang Liew, Yuyang Du

专题命中 其他LLM :language model(abstract)

AI总结 本文提出ICL-SEC框架,通过闭合物理层信道解码器与应用层语义解码器的循环,结合迭代解码与语义校正,其确认先验更新规则可大幅降低误码率,性能优于传统及非迭代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏