arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-12 至 2026-06-12 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 14 篇

2606.12474 2026-06-12 cs.MA cs.AI cs.CR 新提交 87%

SAIGuard: Communication-State Simulation for Proactive Defense of LLM Multi-Agent Systems

SAIGuard: 面向LLM多智能体系统主动防御的通信状态模拟

Ruxue Shi, Yili Wang, Mengnan Du, Qinggang Zhang, Rui Miao, Yixin Liu, Xin Wang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出SAIGuard主动防御框架,通过通信状态模拟检测并净化风险消息,降低攻击成功率并保持系统效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13280 2026-06-12 math.ST stat.TH 新提交 85%

Generalization Bounds for Transformer-Based Next-Token Prediction in a Language Model

基于Transformer的语言模型中下一个词预测的泛化界

Insung Kong, Niklas Dexheimer, Johannes Schmidt-Hieber

专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 针对文本数据特性,提出基于对数双线性语言模型扩展的数据分布,推导深度Transformer架构的泛化界,揭示其对网络结构、词汇量、文档数和文档长度的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01656 2026-06-12 cs.CL cs.AI cs.CY cs.HC physics.soc-ph 版本更新 82%

Authorship Attribution in Multilingual Machine-Generated Texts

多语言机器生成文本的作者归属

Lucio La Cava, Dominik Macko, Róbert Móro, Ivan Srba, Andrea Tagarelli

机构 * DIMES Department, University of Calabria(卡利博大学DIMES系) Kempelen Institute of Intelligent Technologies(智能技术研究所)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出多语言作者归属问题,研究单语言方法在18种语言和8个生成器上的跨语言迁移能力,发现显著局限。

Comments Accepted at ACL 2026 - Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12908 2026-06-12 cs.CL 新提交 79%

SENTINEL: Failure-Driven Reinforcement Learning for Training Tool-Using Language Model Agents

SENTINEL: 用于训练工具使用语言模型智能体的失败驱动强化学习

Ziyi Wang, Yuxuan Lu, Yimeng Zhang, Qun Liu, Chen Luo, Jiri Gesi, Hanqing Lu, Yisi Sang, Manling Li, Jing Huang, Dakuo Wang

机构 * Northeastern University(东北大学) Independent Researcher(独立研究员) Northwestern University(西北大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 提出SENTINEL框架,通过将智能体失败转化为针对性训练任务,在Tau2-Bench Retail上提升Qwen3-4B模型Pass@1从66.4到74.9,优于通用合成任务上的强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12609 2026-06-12 cs.LG q-bio.QM 新提交 79%

Viral Proteins Reveal Geometry of Protein Language Models

病毒蛋白质揭示蛋白质语言模型的几何结构

Arthur Bigot, Harmon Bhasin, Core Francisco Park, Eugene Shakhnovich, Dianzhuo Wang

机构 * University of Washington(华盛顿大学) DeepMind(深度思维)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 研究蛋白质语言模型在不平衡数据下对病毒蛋白的表示,发现嵌入空间中存在主导的“天然性”轴,该轴按模型困惑度排序序列,且缩放效果因病毒家族而异,但嵌入仍保留病毒特异性信号。

Comments Accepted at ICML 2026 GenBio Workshop and FM4LS Workshop. Code available at https://github.com/MisteFr/viral-proteins-plms

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13515 2026-06-12 cs.CV cs.LG cs.RO 新提交 74%

MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models

MaskWAM:统一掩码提示与预测的世界-动作模型

Hanyang Yu, Haitao Lin, Jingbo Zhang, Wenyao Zhang, Chenghao Gu, Heng Li, Ping Tan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Tencent Robotics X(腾讯机器人X实验室) Tsinghua University(清华大学)

专题命中 其他LLM :prompting(title);分类 cs.LG

AI总结 提出MaskWAM,通过统一掩码输入与预测的混合Transformer架构,解决世界-动作模型的空间瓶颈,提升策略泛化能力,在LIBERO等任务上显著优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12774 2026-06-12 eess.SY cs.AI cs.CL cs.SY 新提交 73%

Agentic MPC for Semantic Control System Resynthesis

用于语义控制系统再综合的智能体MPC

Yuya Miyaoka, Masaki Inoue

机构 * University of Tokyo(东京大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出智能体MPC框架,通过集成大语言模型智能体实现上下文感知的语义自适应控制综合,在自动驾驶场景中验证其根据个人偏好或社交情境(如避让应急车辆)调整控制的能力。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14295 2026-06-12 cs.AI cs.CL cs.CY 版本更新 73%

Epistemic Constitutionalism Or: how to avoid coherence bias

认知宪政主义:或如何避免一致性偏见

Michele Loi

机构 * University of Milan(米兰大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出AI应建立明确的认知宪法,通过规范源归因等元规范避免一致性偏见,并论证自由主义路径优于柏拉图式路径。

Comments 27 pages, 7 tables. Data: github.com/MicheleLoi/source-attribution-bias-data and github.com/MicheleLoi/source-attribution-bias-swiss-replication. Complete AI-assisted writing documentation: github.com/MicheleLoi/epistemic-constitutionalism-paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13256 2026-06-12 cs.RO cs.AI 新提交 70%

Humor Style Drives Laughter, Topic Shapes Acceptability: Evaluating Bilingual Personal and Political Robot-Delivered AI Jokes

幽默风格驱动笑声,话题塑造可接受性:评估双语个人与政治机器人交付的AI笑话

Anna-Maria Velentza, Anne-Gwenn Bosser

机构 * Univ Brest-Bretagne INP, COMMEDIA team, Lab-STICC CNRS UMR 6285(布列塔尼大学-INP,COMMEDIA团队,Lab-STICC CNRS UMR 6285)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究通过混合因素设计,评估机器人用双语讲AI生成笑话时,幽默类型(亲和、自我增强、攻击、自贬)和内容(个人vs政治)对趣味性和适当性的影响,发现幽默类型显著影响趣味性,内容影响适当性,语言偏好受内容及参与者流利度影响。

Comments Accepted in the 35th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN 2026), Kitakyushu, Fukuoka, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12708 2026-06-12 cs.CL cs.AI 新提交 62%

AfriSUD: A Dependency Treebank Collection for Evaluating Models on African Languages

AfriSUD:用于评估非洲语言模型的依存树库集合

Happy Buzaaba, Cheikh Mouhamadou Bamba Dione, David Ifeoluwa Adelani, Sylvain Kahane, Kim Gerdes, Bruno Guillaume, Kevin Guan, Aremu Anuoluwapo, Naome A. Etori, Shamsuddeen Hassan Muhammad, Utitofon Inyang, Peter Nabende, David Sabiiti Bamutura, Andiswa Bukula, Chinedu Uchechukwu, Rooweither Mabuya, Idris Akinade, Christiane Fellbaum

机构 * Princeton University(普林斯顿大学) Laboratory for Artificial Intelligence, Princeton University(普林斯顿大学人工智能实验室) Gaston Berger University(加斯顿·伯杰大学) Mila, McGill University(麦吉尔大学米拉研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能教席) Paris Nanterre University(巴黎南泰尔大学) Paris-Saclay University(巴黎-萨克雷大学) CNRS(法国国家科学研究中心) Inria(法国国家信息与自动化研究所) LORIA(洛林计算机科学实验室) Université de Lorraine(洛林大学) University of Trento(特伦托大学) University of Minnesota–Twin Cities(明尼苏达大学双城分校) Imperial College London(伦敦帝国学院) Binghamton University(宾汉姆顿大学) Makerere University(马凯雷雷大学) Penn State University(宾夕法尼亚州立大学) Mbarara University of Science and Technology(姆巴拉拉科技大学) Chalmers University of Technology(查尔姆斯理工大学) University of Ibadan(伊巴丹大学) Nnamdi Azikiwe University(纳姆迪·阿齐基韦大学) South African Centre for Digital Language Resources(南非数字语言资源中心)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 为弥补非洲语言在NLP资源上的不足,构建了首个大规模九种非洲语言句法标注树库AfriSUD,评估多种模型发现显著句法差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12478 2026-06-12 cs.LG cond-mat.stat-mech quant-ph 新提交 57%

Boltzmann Attention: Learnable Ising Couplings for Cooperative Attention

玻尔兹曼注意力:用于协同注意力的可学习伊辛耦合

Gilhan Kim, Daniel K. Park

机构 * Yonsei University(延世大学)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出玻尔兹曼注意力,通过可学习的伊辛耦合增强注意力机制中的位置间交互,在字符级语言建模和括号匹配任务中优于标准softmax注意力,并展示了量子退火训练的有效性。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09693 2026-06-12 cs.LG stat.ML 版本更新 57%

Contrastive Geometric Learning Unlocks Unified Structure- and Ligand-Based Drug Design

对比几何学习实现统一的结构与配体药物设计

Lisa Schneckenreiter, Sohvi Luukkonen, Lukas Friedrich, Daniel Kuhn, Günter Klambauer

机构 * DeepMind Ltd(DeepMind有限公司)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 提出对比几何模型ConGLUDe,统一结构与配体训练,实现虚拟筛选、靶标钓鱼和配体条件口袋预测,在多项基准测试中表现优异。

Comments Forty-Third International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13215 2026-06-12 eess.SY cs.CE cs.SY 新提交 50%

Mitigating business risks from renewable PPA power sourcing uncertainties for European green hydrogen production: Robust system design, regulatory adjustments and offtake flexibility

缓解可再生能源PPA电力采购不确定性对欧洲绿氢生产的商业风险:稳健系统设计、监管调整与承购灵活性

Jonathan Brandt, Astrid Bensmann, Richard Hanke-Rauschenbach

专题命中 其他LLM :prompting(abstract)

AI总结 针对欧洲绿氢生产因可再生能源电力采购规则(如附加性和时间相关性)导致的商业风险,本研究通过系统设计优化、监管调整和承购灵活性分析,提出缓解措施并评估成本影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12811 2026-06-12 cond-mat.mtrl-sci 新提交 50%

A wrong ground-state structure of HfO$_2$ predicted by machine-learning interatomic potentials based on the PBE functional

基于PBE泛函的机器学习原子间势预测的HfO$_2$错误基态结构

Shuqi Tang, Jinchen Wei, Kang Wang, Junjie Zhou, Yihan Zhang, Menglin Huang, Shiyou Chen

专题命中 其他LLM :foundation model(abstract)

AI总结 发现基于PBE泛函的机器学习势预测HfO2的I41/amd结构比已知基态P21/c更稳定,错误源于PBE泛函过度稳定含六配位Hf-O八面体的低密度结构。

详情

展开后加载摘要…

URL PDF HTML 收藏