arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-11 至 2026-06-11 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 18 篇

2606.12247 2026-06-11 cs.CY cs.CL 新提交 92%

Beyond Third-Person Audits: Situated Interaction Auditing for User-Centered LLM Bias Research

超越第三人称审计:以用户为中心的LLM偏见研究的场景交互审计

Andrés Abeliuk, Cinthia Sanchez Macias, Valentina Alarcón, Álvaro Madariaga, Claudia Lopez

机构 * Department of Computer Science University of Chile Center for Artificial Intelligence (CENIA) Santiago, Chile(计算机科学系智利大学人工智能中心(CENIA)圣地亚哥,智利) Center for Artificial Intelligence (CENIA) Santiago, Chile(人工智能中心(CENIA)圣地亚哥,智利) Institute of Sociology Pontificia Universidad Católica de Chile Santiago, Chile(社会学研究所智利天主教大学圣地亚哥,智利)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出场景交互审计(SIA)框架,通过分析用户画像信号(如社会人口统计标记、写作风格和身份陈述)如何系统性地影响LLM响应质量、内容和语气,以用户为中心研究LLM偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08445 2026-06-11 cs.RO 版本更新 91%

iPack: Intuitive Bin Packing with Large Language Models

iPack: 基于大型语言模型的直观装箱

Yannik Blei, Michael Krawez, Adrian Göß, Devadas Vijayan Sheela, Tobias Jülg, Pierre Krack, Florian Walter, Wolfram Burgard

机构 * University of Technology Nuremberg(图恩大学) Friedrich-Alexander University of Erlangen–Nuremberg(埃尔兰根-纽伦堡弗里德里希-亚历山大大学) Technical University of Munich(慕尼黑技术大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title);language model(title);foundation model(abstract)

AI总结 提出LLM-Pack方法,利用语言和视觉基础模型生成模仿人类策略的杂货装箱顺序,无需专门训练即可处理新物品,模块化设计便于升级。

Comments 7 Pages, 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21594 2026-06-11 cs.LG 版本更新 90%

Visualizing LLM Latent Space Geometry Through Dimensionality Reduction

通过降维可视化LLM潜在空间几何结构

Alex Ning, Vainateya Rangaraju, Yen-Ling Kuo

机构 * Department of Computer Science, University of Virginia(计算机科学系,弗吉尼亚大学)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 通过PCA和UMAP降维,可视化GPT-2和LLaMa中Transformer层的潜在状态几何,发现注意力与MLP输出分离、初始位置高范数及螺旋结构等模式。

Comments 25 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11877 2026-06-11 cs.NI 新提交 89%

LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence

LLM赋能的NWDAF:迈向AI原生的6G网络智能

Henok Daniel, Omar Alhussein, Cheng Li, Jie Liang, Ernesto Damiani

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 开发了一个与Free5GC兼容的开源NWDAF,集成大语言模型接口,通过意图识别实现自然语言交互,简化网络分析管理,为AI原生6G网络奠定基础。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10749 2026-06-11 cs.CR 版本更新 89%

AttriGuard: Defeating Indirect Prompt Injection in LLM Agents via Causal Attribution of Tool Invocations

AttriGuard: 通过工具调用的因果归因击败LLM代理中的间接提示注入

Yu He, Haozhe Zhu, Yiming Li, Shuo Shao, Hongwei Yao, Zhihao Liu, Zhan Qin

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对LLM代理易受间接提示注入攻击的问题,提出基于并行反事实测试的运行时防御AttriGuard,通过因果归因区分用户意图驱动与不可信观察驱动的工具调用,在多个基准上实现0%攻击成功率。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12073 2026-06-11 cs.SI cs.AI 新提交 87%

"That's AI Slop, You Bot!" Studying Accusations, Evidence, and Credibility in Online Discourse Towards LLM-Generated Comments

“那就是AI垃圾,你这个机器人!”:研究针对LLM生成评论的指责、证据与可信度

Jason Miklian, John E. Katsos

机构 * University of Oslo(奥斯陆大学) American University of Sharjah(沙迦美国大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 分析2023-2026年Hacker News和Reddit上2500万条评论,发现对AI生成文本的指责增长超十倍,但被指责的文本并非真正由AI生成,而是基于感知真实性的社会把关行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11817 2026-06-11 cs.CR cs.AI cs.CL cs.SE 新提交 87%

Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

语法约束解码可诱使大语言模型生成恶意代码

Yitong Zhang, Shiteng Lu, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文发现语法约束解码(GCD)可被利用发起名为CodeSpear的越狱攻击,使LLM生成恶意代码;并提出安全对齐方法CodeShield,通过生成蜜罐代码防御该攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11643 2026-06-11 cs.CL 新提交 85%

Improving Cross-Format Robustness in Language Models with Multi-Format Training

通过多格式训练提升语言模型的跨格式鲁棒性

June M. Liu, Shaomian Zheng, He Cao, Dingnan Jin, Qing Cui, Jun Zhou

机构 * Ant Group(蚂蚁集团) International Digital Economy Academy (IDEA)(国际数字经济学院(IDEA))

专题命中 其他LLM :language model(title,abstract);LLM(abstract_cn);large language model(abstract);分类 cs.CL

AI总结 提出FormatMix方法,通过将部分训练数据扩展为多种等价格式,显著提升大语言模型在不同答案格式下的一致性,仅需30%数据即可接近全格式训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11425 2026-06-11 cs.CR cs.AI 新提交 84%

JailbreakOPT: Tool-Assisted Iterative Jailbreak Prompt Optimization

JailbreakOPT: 工具辅助的迭代越狱提示优化

Ge Shi, Jun Yin, Donglin Xie, Fangyi Liu, Yucan Li, Menglin Liu

机构 * University of California, Davis(加州大学戴维斯分校) The Renmin University of China(中国人民大学) Independent Researcher(独立研究员) Nankai University(南开大学) Cornell University(康奈尔大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出JailbreakOPT框架,通过工具库和上下文Thompson采样优化单轮越狱提示,在多个LLM上提高攻击成功率并减少攻击次数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11371 2026-06-11 cs.CL cs.AI eess.AS eess.SP 新提交 82%

The Dynamics of Human and AI-Generated Language: How Semantics Fluctuates across Different Timescales

人类与AI生成语言的动态:语义如何在不同时间尺度上波动

Han-Jen Chang, Yasir Çatal, Angelika Wolman, Agustín Ibáñez, David Smith, I-Wen Su, Kai-Yuan Cheng, Georg Northoff

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出语义时间尺度分析流程,通过自相关窗口度量(ACW-0)量化人类与AI生成语音中语义特异性与上下文相似性的时间组织,发现ACW-0长度与词汇通用性相关,且该关联在随机化后被削弱。

Comments 45 pages, 4 figures, 4 tables. Accepted manuscript; published in Computer Speech & Language

Journal ref Computer Speech & Language (2026) 102013

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11869 2026-06-11 cs.SE cs.AI 新提交 81%

Agents All the Way Down; A Methodology for Building Custom AI Agents from Substrate to Production

层层代理:从底层到生产构建自定义AI代理的方法论

Marc Alier Forment, Juanan Pereira, Francisco José García-Peñalvo, María José Casañ Guerrero

机构 * Universitat Politècnica de Catalunya (UPC)(西班牙巴塞罗那理工大学) Universidad del País Vasco / Euskal Herriko Unibertsitatea (UPV/EHU)(西班牙巴斯克大学)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出一种无框架的方法论,通过两个前提条件(将LLM作为软件组件和构建块)和三个实践(原型设计、打包为CLI、代理测试代理)来构建自定义AI代理,实现端到端开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11652 2026-06-11 cs.LG 新提交 81%

IAPO: Input Attribution-Aware Policy Optimization for Tool Use in Small Multimodal Agents

IAPO:面向小型多模态代理工具使用的输入归因感知策略优化

Yifan Yang, Zhen Zhang, Jiayi Tian, Liyan Tan, Zheng Zhang

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 其他LLM :SLM(abstract,abstract_cn);language model(abstract);small language model(abstract);分类 cs.LG

AI总结 提出输入归因感知策略优化(IAPO),通过强化学习对齐模型与教师模型的输入归因,提升多模态小语言模型的工具调用能力,在六个测试集上平均准确率提升3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11688 2026-06-11 cs.LG 版本更新 81%

Composing Linear Layers from Irreducibles

从不可约元组合线性层

Travis Pence, Daisuke Yamada, Vikas Singh

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.LG

AI总结 提出用Clifford代数将线性层分解为双向量(几何基元)的组合,仅需O(log^2 d)参数,在LLM注意力投影中匹配强基线性能。

Comments 35 Pages, 11 Tables, 6 Figures, Appearing in NeurIPS 2025

Journal ref Advances in Neural Information Processing Systems 38 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11626 2026-06-11 cs.CV 新提交 78%

Adapting Vision-Language Models from Iconic to Inclusive for Multi-Label Recognition Without Labels

将视觉-语言模型从标志性适应到包容性:用于无标签的多标签识别

Cheng Chen, Jingyu Zhou, Yifan Zhao, Jia Li

机构 * State Key Laboratory of Virtual Reality Technology and Systems, SCSE & QRI, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学计算机学院与青岛研究院)

专题命中 其他LLM :language model(title,abstract)

AI总结 提出无监督框架,通过“切割”和“缝合”两阶段适应VLMs,实现无标签的多标签图像识别,在四个数据集上超越现有无监督方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18934 2026-06-11 cs.HC cs.MM 版本更新 75%

Whispering Water: Materializing Human-AI Dialogue as Interactive Ripples

低语之水:将人机对话物化为交互式涟漪

Ruipeng Wang, Tawab Safi, Yunge Wen, Christina Cunningham, Hoi Ling Tang, Behnaz Farahi

专题命中 其他LLM :LLM(summary_cn,abstract_cn)

AI总结 通过将语音情感转换为激发频率、语义内容输入多智能体LLM系统,以及用对数间距和Bark尺度映射分解合成语音为谐波分量,在物理水面上实现人机对话的物化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11835 2026-06-11 cs.HC cs.AI 新提交 57%

Designing AI-Supported Focus Groups: A Role x Modality Playbook

设计AI支持的焦点小组:角色×模态剧本

Zhiqing Wang, Steven Dow

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 针对焦点小组资源密集且对引导高度敏感的问题,提出按AI角色(工具、联合主持、主持)和模态(文本、语音、具身)组织的剧本,并分析交互权衡与开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12059 2026-06-11 cs.LG cs.NE nlin.AO 新提交 57%

Attention by Synchronization in Coupled Oscillator Networks

耦合振荡器网络中的同步注意力机制

Fabio Pasqualetti, Taosha Guo

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出基于Kuramoto同步动力学的固定查询振荡器注意力机制,无需指数运算和全局归约,在物理基板上实现注意力计算,并在关键词识别和主谓一致任务上优于softmax。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11819 2026-06-11 cs.IT math.IT 新提交 50%

STCC: A Unified Source-Channel Semantic Token Coding Framework for Semantic Communications

STCC:一种用于语义通信的统一源信道语义令牌编码框架

Zhicheng Bao, Chen Dong, Sen Wang, Long Liu, Nan Ma, Hao Chen, Xiaodong Xu, Yinqiu Liu, Ping Zhang

专题命中 其他LLM :foundation model(abstract)

AI总结 提出STCC框架,通过语义令牌编解码器(STC)将离散语义令牌映射为几何结构化的星座图,利用三重损失优化使信道噪声转化为拓扑错误,在低信噪比下显著优于传统系统。

详情

展开后加载摘要…

URL PDF HTML 收藏