arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-14 至 2026-04-14 共收录 39 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 39 篇

2310.07099 2026-04-14 cs.CY cs.AI cs.CR cs.SI 89%

ClausewitzGPT Framework: A New Frontier in Theoretical Large Language Model Enhanced Information Operations

ClausewitzGPT框架:理论大语言模型增强信息操作的新前沿

Benjamin Kereopa-Yorke

机构 * UNSW Canberra at the Australian Defence Force Academy(澳大利亚国防军学院新南威尔士大学堪培拉分校)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出ClausewitzGPT框架,旨在量化机器速运算风险并强调自主AI代理在信息操作中的关键作用,结合启蒙思想与克劳塞维茨原则,强调战略视野、伦理考量与全面理解的重要性。

Comments 14 pages, 14 figures

Journal ref Journal of Information Warfare, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03676 2026-04-14 cs.CL 89%

Different types of syntactic agreement recruit the same units within large language models

不同类型的句法一致要求大型语言模型中的相同单元

Daria Kryvosheieva, Andrea de Varda, Evelina Fedorenko, Greta Tuckute

机构 * Massachusetts Institute of Technology(麻省理工学院) Kempner Institute at Harvard University(哈佛大学肯普纳研究所)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 研究探讨了不同句法现象在大型语言模型中是否共享或独立激活单元,发现句法一致构成模型表征空间中的重要类别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11663 2026-04-14 cs.AI 88%

Why Do Large Language Models Generate Harmful Content?

为什么大语言模型会生成有害内容?

Rajesh Ganguli, Raha Moraffah

机构 * Worcester Polytechnic Institute(伍斯特理工学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究通过因果中介分析揭示大语言模型生成有害内容的深层原因,发现有害内容主要由MLP模块失效引起,且在模型后期层中通过特定神经元传播生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11309 2026-04-14 cs.CR cs.AI cs.CL cs.CV cs.LG 87%

The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems

切肉威胁:在LLM系统中利用累积风险

Yihao Zhang, Kai Wang, Jiangrong Wu, Haolin Wu, Yuxuan Zhou, Zeming Wei, Dongxian Wu, Xun Chen, Jun Sun, Meng Sun

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Sun Yat-sen University(中山大学) Wuhan University(武汉大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) ByteDance(字节跳动) Singapore Management University(新加坡管理大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Salami Slicing Risk,通过链式低风险输入累积有害意图,以触发高风险行为,提出Salami Attack框架并验证其有效性,同时提出防御策略以缓解多轮 jailbreak 风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11618 2026-04-14 cs.SI 85%

Identifying Disruptive Models in the Open-Source LLM Community

在开源大语言模型社区中识别颠覆性模型

Xiaoting Wei, Lele Kang, Xuelian Pan, Jiannan Yang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究通过构建大规模模型继承网络,提出模型颠覆指数(MDI),揭示开源LLM社区中大多数模型为巩固性而非颠覆性,强调大规模模型和微调策略更易产生颠覆性模型。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10545 2026-04-14 cs.HC 85%

Enhanced Self-Learning with Epistemologically-Informed LLM Dialogue

增强的基于知识论的LLM对话自学习

Yi-Fan Cao, Kento Shigyo, Yitong Gu, Xiyuan Wang, Weijia Liu, Yang Wang, David Gotz, Zhilan Zhou, Huamin Qu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出CausaDisco系统,通过整合亚里士多德的四因框架,提升LLM在自学习中的认知支持,通过实验表明其能促进更深入的学习互动和多维度视角。

Comments Submitted to IJHCI

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09586 2026-04-14 cs.HC 85%

Co-Disclosing the Computer: LLM-Mediated Computing through Reflective Conversation

揭示计算机:通过反思对话实现的LLM中介计算

Mattias Rost

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出LLM中介计算新范式,通过反思对话实现动态交互,引入后现象学视角分析人与LLM-计算机关系,并提出基于共揭示的计算模式。

Comments CHI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10627 2026-04-14 cs.CL cs.AI cs.CE 84%

Computational Lesions in Multilingual Language Models Separate Shared and Language-specific Brain Alignment

多语言语言模型中的计算病变分离共享和语言特定的脑对齐

Yang Cui, Jingyuan Sun, Yizheng Sun, Yifan Wang, Yunhao Zhang, Jixing Li, Shaonan Wang, Hongpeng Zhou, John Hale, Chengqing Zong, Goran Nenadic

机构 * The University of Manchester(曼彻斯特大学) City University of Hong Kong(香港城市大学) The Hong Kong Polytechnic University(香港理工大学) Institute of Automation, CAS(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过多语言大语言模型创建计算病变,揭示语言处理的共享与特定机制,发现共享核心减少整体脑编码相关性,而语言特定病变保持跨语言分离但削弱匹配母语的脑预测性。

Comments 23 pages, 5 figures, Journal format

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02340 2026-04-14 cs.LG cs.CL 81%

Not All Denoising Steps Are Equal: Model Scheduling for Faster Masked Diffusion Language Models

并非所有去噪步骤都同等重要:用于加快掩码扩散语言模型的模型调度

Ivan Sedykh, Nikita Sorokin, Valentin Malykh

机构 * ITMO University(ITMO大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 本文研究了掩码扩散语言模型的模型调度,通过在部分去噪步骤中替换较小模型,减少计算量并保持生成质量,实验表明中间步骤对替换最敏感,整体FLOPs减少17%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14968 2026-04-14 cs.CR cs.CL 79%

Rethinking LLM Watermark Detection in Black-Box Settings: A Non-Intrusive Third-Party Framework

重新思考黑盒环境下的LLM水印检测:一种非侵入性的第三方框架

Zhuoshang Wang, Yubing Ren, Yanan Cao, Fang Fang, Xiaoxue Li, Li Guo

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) National Computer Network Emergency Response Technical Team, Coordination Center of China (CNCERT/CC)(国家计算机网络应急技术处理协调中心)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 本文提出TTP-Detect框架,通过解耦检测与注入,实现非侵入性的第三方水印验证,提升检测性能和抗攻击能力。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22479 2026-04-14 math.OC cs.AI 79%

Cognitive Training for Language Models: Towards General Capabilities via Cross-Entropy Games

语言模型的认知训练:通过交叉熵游戏实现通用能力

Clément Hongler, Franck Gabriel, Valentin Hartmann, Arthur Renard, Andrew Emil

机构 * Xent Labs EPFL(瑞士联邦理工学院洛桑) Université Lyon 1(里昂第一大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 本文提出通过交叉熵游戏构建语言模型通用能力的框架,探讨了基于贪心优化算法的课程学习方法,并认为认知训练是发现相关技能的有效途径。

Comments 22 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10300 2026-04-14 cs.SE cs.AI 79%

From Helpful to Trustworthy: LLM Agents for Pair Programming

从有益到可信:用于配对编程的LLM代理

Ragib Shahariar Ayon

机构 * Texas State University(德克萨斯州立大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文研究多代理LLM配对编程,通过外部化意图和工具迭代验证,提升代码可靠性、可审计性和可维护性。

Comments Accepted in 34th ACM Joint European Software Engineering Conference and Symposium on the Foundations of Software Engineering (FSE Companion 26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11705 2026-04-14 cs.AI cs.CL cs.RO cs.SY eess.SY 79%

Agentic Driving Coach: Robustness and Determinism of Agentic AI-Powered Human-in-the-Loop Cyber-Physical Systems

代理驾驶教练:代理AI驱动的人机协同物理系统中的鲁棒性与确定性

Deeksha Prahlad, Daniel Fan, Hokeun Kim

机构 * Arizona State University(亚利桑那州立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于反应计算模型的框架,用于解决人机协同物理系统中代理AI的鲁棒性和确定性问题,通过驾驶教练案例验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10390 2026-04-14 cs.AR 78%

LLM-PRISM: Characterizing Silent Data Corruption from Permanent GPU Faults in LLM Training

LLM-PRISM:从永久GPU故障中表征LLM训练中的静默数据损坏

Abhishek Tyagi, Saurabh Hukerikar, Nirmal Saxena, Yanxiang Huang, Philip Shirvani, Chung-Hsuan Tung, Yuhao Zhu

专题命中 其他LLM :LLM(title,abstract)

AI总结 LLM-PRISM通过RTL级GPU故障模拟与嵌入在Megatron-LM中的随机注入引擎,分析不同故障类型、速率和数值格式对LLM预训练鲁棒性的影响,揭示静默数据损坏的硬件基础特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10530 2026-04-14 cs.SE cs.AI cs.HC 77%

Towards an Appropriate Level of Reliance on AI: A Preliminary Reliance-Control Framework for AI in Software Engineering

迈向适当的AI依赖水平:软件工程中AI的初步依赖控制框架

Samuel Ferino, Rashina Hoda, John Grundy, Christoph Treude

机构 * Monash University(莫纳什大学) Singapore Management University(新加坡管理大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过二十次访谈提出初步依赖控制框架,探讨软件开发者与AI工具的交互,分析过度依赖和不足依赖的影响,并为未来研究提供方向。

Comments Accepted for publication at the 2nd Workshop on Human-Centered AI for SE (HumanAISE) held at the 34th ACM International Conference on the Foundations of Software Engineering (FSE Companion '26), July 5-9, 2026, Montreal, Quebec, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09502 2026-04-14 cs.AI cs.GT cs.MA econ.TH 77%

Strategic Algorithmic Monoculture: Experimental Evidence from Coordination Games

战略算法单一性:协调博弈中的实验证据

Gonzalo Ballestero, Hadi Hosseini, Samarth Khanna, Ran I. Shorrer

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过实验设计区分算法单一性与战略算法单一性,发现LLM在协调任务中表现优异,但在奖励分歧时难以维持多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10343 2026-04-14 cs.LG 77%

WaterAdmin: Orchestrating Community Water Distribution Optimization via AI Agents

WaterAdmin: 通过AI代理协调社区供水优化

Jiaqi Wen, Pingbo Tang, Shaolei Ren, Jianyi Yang

机构 * University of Houston(休斯顿大学) Carnegie Mellon University(卡内基梅隆大学) University of California, Riverside(加州大学河滨分校)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出WaterAdmin框架,结合LLM进行社区上下文抽象与优化控制,以实现动态环境下供水系统的可靠性和节能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10575 2026-04-14 cs.HC 75%

NexusAI: Enabling Design Space Exploration of Ideas through Cognitive Abstraction and Functional Decomposition

NexusAI: 通过认知抽象和功能分解实现想法的设计空间探索

Anqi Wang, Bingqian Wang, Huiyang Chen, Keqing Jiao, Lei Han, Xin Tong, Pan Hui

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 NexusAI通过认知抽象和功能分解解决LLM生成想法的结构性不透明问题,提升设计空间探索效率和创造性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10222 2026-04-14 cs.CY 75%

Morally Programmed LLMs Reshape Human Morality

道德编程的大型语言模型重塑人类道德

Pengzhao Lyu, Yeun Joon Kim, Yingyue Luna Luan, Jungmin Choi

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究通过道德编程的LLM与人类交互,发现其能系统性地改变人类道德倾向,且影响持续两周,揭示了道德原则嵌入LLM的伦理困境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03989 2026-04-14 cs.LG cs.AI cs.NA math.NA 73%

A Mathematical Explanation of Transformers

Transformer的数学解释

Xue-Cheng Tai, Hao Liu, Lingfeng Li, Raymond H. Chan

机构 * NORCE Norwegian Research Centre(挪威研究中心) Department of Mathematics, Hong Kong Baptist University(香港浸会大学数学系) School of Data Science and Department of Operations and Risk Management, Lingnan University(岭南大学数据科学学院与运营及风险管理系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种连续框架,将Transformer架构解释为结构积分微分方程的离散化,揭示自注意力机制和归一化操作的数学本质,为理解Transformer的核心组件提供了统一的理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06607 2026-04-14 cs.AR 71%

CoverAssert: Iterative LLM Assertion Generation Driven by Functional Coverage via Syntax-Semantic Representations

CoverAssert: 通过语法-语义表示驱动的功能覆盖率迭代LLM断言生成

Yonghao Wang, Yang Yin, Hongqin Lyu, Jiaxin Zhou, Zhiteng Chao, Mingyu Shi, Wenchao Ding, Yunlin Du, Jing Ye, Tiancheng Wang, Huawei Li

专题命中 其他LLM :LLM(title)

AI总结 CoverAssert通过语法-语义表示驱动LLM生成断言,利用功能覆盖率反馈迭代优化,提升分支、语句和切换覆盖率。

Comments 3 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10884 2026-04-14 cs.SE cs.AI 70%

Ambiguity Detection and Elimination in Automated Executable Process Modeling

自动可执行过程建模中的歧义检测与消除

Ion Matei, Praveen Kumar Menaka Sekar, Maksym Zhenirovskyy, Hon Yung Wong, Sayuri Kohmura, Shinji Hotta, Akihiro Inomata

机构 * Fujitsu Research of America(富士通美国研究院) University of Maryland, College Park(马里兰大学帕克分校) Fujitsu Limited(富士通株式会社)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于诊断的框架,通过分析关键性能指标的分布检测行为不一致,定位逻辑分歧并修复文本,以减少生成模型行为的变异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10534 2026-04-14 cs.CR cs.AI cs.SE 70%

Machine Learning-Based Detection of MCP Attacks

基于机器学习的MCP攻击检测

Tobias Mattsson, Samuel Nyberg, Anton Borg, Ricardo Britto

机构 * Blekinge Institute of Technology(布莱金厄理工学院) Ericsson(爱立信)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了MCP攻击检测问题,提出并评估了多种监督机器学习方法,包括传统和深度学习模型,通过二分类和多分类任务验证了模型的有效性,展示了机器学习在区分恶意与良性数据中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01763 2026-04-14 cs.SE cs.AI 70%

Context-Guided Decompilation: A Step Towards Re-executability

基于上下文的反编译:迈向可重新执行性的一步

Xiaohan Wang, Yuxin Hu, Kevin Leach

机构 * Vanderbilt University(范德堡大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出ICL4Decomp框架,利用上下文学习指导LLM生成可重新执行的源代码,提升反编译的可执行性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17188 2026-04-14 cs.AI 70%

PosterGen: Aesthetic-Aware Multi-Modal Paper-to-Poster Generation via Multi-Agent LLMs

PosterGen:基于多智能体LLM的美观化论文到海报生成

Zhilin Zhang, Xiang Zhang, Jiaqi Wei, Yiwei Xu, Chenyu You

机构 * Stony Brook University(石溪大学) New York University(纽约大学) University of British Columbia(不列颠哥伦比亚大学) Zhejiang University(浙江大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PosterGen通过多智能体LLM实现论文到海报的美观化生成,包含四个协作专业代理,提升设计质量和视觉吸引力。

Comments Project Website: https://Y-Research-SBU.github.io/PosterGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09711 2026-04-14 cs.CV cs.CL 70%

Head-wise Modality Specialization within MLLMs for Robust Fake News Detection under Missing Modality

在多模态大语言模型中实现模态专精以在缺失模态下实现鲁棒的虚假新闻检测

Kai Qian, Weijie Shi, Jiaqi Wang, Mengze Li, Hao Chen, Yue Cui, Hanghui Guo, Ziyi Liu, Jia Zhu, Jiajie Xu

机构 * Soochow University(苏州大学) Hong Kong University of Science and Technology(香港科技大学) Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) The Hong Kong University of Science and Technology(香港科技大学) FiT, Tencent(腾讯FiT) Alibaba Group(阿里巴巴集团) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) School of Education, Zhejiang Normal University(浙江师范大学教育学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出在多模态大语言模型中通过头级专精机制提升鲁棒性,以应对缺失模态下的虚假新闻检测,通过保留模态专精能力与利用稀疏单模注释提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09627 2026-04-14 cs.CY 67%

Hidden Signals in Language: Inferring Sensitive Attributes from Reddit Comments Using Machine Learning

语言中的隐藏信号:利用机器学习从Reddit评论中推断敏感属性

Anay Agarwalla, Simeon Sayer

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究通过机器学习从Reddit评论中推断敏感属性,发现即使简单模型也能检测到与敏感属性相关的信号,且不同社区的预测性能差异显著。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10724 2026-04-14 cs.CL 57%

Expect the Unexpected? Testing the Surprisal of Salient Entities

意外之coming?检验显著实体的意外性

Jessica Lin, Amir Zeldes

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 本文研究了话语中实体整体显著性与意外性之间的关系,通过70000个手动标注的提及和新提出的最小配对提示方法,发现显著实体具有更高的意外性,并在不同体裁中表现出差异。

Comments Accepted to ACL 2026 (main, long); camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27195 2026-04-14 cs.AI 57%

AutoMS: Multi-Agent Evolutionary Search for Cross-Physics Inverse Microstructure Design

AutoMS:多智能体进化搜索用于跨物理逆微结构设计

Zhenyuan Zhao, Yu Xing, Tianyang Xue, Lingxin Cao, Xin Yan, Lin Lu

机构 * Shandong University(山东大学) The University of Hong Kong(香港大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出AutoMS,通过LLM驱动的进化搜索解决跨物理逆微结构设计问题,实现83.8%的成功率,优于传统算法和现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09995 2026-04-14 eess.SY cs.AI cs.SY 57%

Agentic Application in Power Grid Static Analysis: Automatic Code Generation and Error Correction

代理在电力网络静态分析中的应用:自动代码生成与错误修正

Qinjuan Wang, Shan Yang, Yongli Zhu

机构 * Sun Yat-sen University(中山大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出一个基于LLM的代理,通过将自然语言转换为MATLAB脚本实现电力网络静态分析自动化,采用三重纠错系统提升代码准确性,实验表明其在复杂任务中能有效消除幻觉。

Comments This paper has been accepted for presentation at the 9th International Conference on Energy, Electrical and Power Engineering (CEEPE 2026) in Nanjing, China, April 17-19, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏