arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-08 至 2026-04-08 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 16 篇

2603.19282 2026-04-08 cs.CL cs.AI 90%

Framing Effects in Independent-Agent Large Language Models: A Cross-Family Behavioral Analysis

独立代理大语言模型中的框架效应:跨家族行为分析

Zice Wang, Zhenyu Zhang

机构 * Northeastern University(东北大学) Beijing Institute of Technology(北京理工大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了在非交互多代理部署中,提示框架如何影响独立代理在阈值投票任务中的决策,发现框架效应显著影响选择分布,倾向于风险规避选项,揭示了非交互多代理部署中的重要偏差源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05481 2026-04-08 cs.SE cs.AI 85%

On the Role of Fault Localization Context for LLM-Based Program Repair

关于基于LLM的程序修复中故障定位上下文的作用

Melika Sepidband, Hung Viet Pham, Hadi Hemmati

机构 * York University(约克大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了LLM基于程序修复中故障定位上下文的影响,发现文件级上下文对修复性能提升显著,而元素级和行级上下文效果不一,LLM检索优于传统方法。

Comments 30 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19463 2026-04-08 cs.CY cs.AI cs.SI 85%

Hedging and Non-Affirmation: Quantifying LLM Alignment on Questions of Human Rights

对冲与非肯定:量化大语言模型在人权问题上的对齐

Rafiya Javed, Cassandra Parent, Jackie Kay, David Yanni, Abdullah Zaini, Anushe Sheikh, Maribeth Rauh, Walter Gerych, Ramona Comanescu, Iason Gabriel, Marzyeh Ghassemi, Laura Weidinger

机构 * Google Deepmind(谷歌DeepMind) Massachusetts Institute of Technology(麻省理工学院) Independent Researcher(独立研究员) Google(谷歌) AI Accountability Lab, Trinity College Dublin(都柏林圣三一学院人工智能问责实验室)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过系统框架量化LLM在不同群体身份上的对冲与非肯定行为,发现群体身份是主要影响因素,通过引导和正交化技术可有效缓解偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05943 2026-04-08 cs.AI 79%

MARL-GPT: Foundation Model for Multi-Agent Reinforcement Learning

MARL-GPT:多智能体强化学习的基础模型

Maria Nesterova, Mikhail Kolosov, Anton Andreychuk, Egor Cherepanov, Oleg Bulichev, Alexey Kovalev, Konstantin Yakovlev, Aleksandr Panov, Alexey Skrynnik

机构 * MIRAI \& Innopolis University Moscow Russia MIRAI \& Innopolis University

专题命中 其他LLM :foundation model(title);language model(abstract);分类 cs.AI

AI总结 本文提出MARL-GPT,一种基于Transformer的多任务模型,能通过离线强化学习在不同多智能体环境中高效学习,无需任务特定调优,实验证明其在多个挑战性任务中表现优异。

Comments Accepted at AAMAS 2026 (AAAI Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05382 2026-04-08 cs.HC 78%

SpeakSoftly: Scaffolding Nonviolent Communication in Intimate Relationships through LLM-Powered Just-In-Time Interventions

SpeakSoftly:通过LLM赋能的即时干预构建亲密关系中的非暴力沟通

Ka I Chan, Hongbo Lan, Jun Fang, Yuntao Wang, Yuanchun Shi

专题命中 其他LLM :LLM(title,abstract)

AI总结 SpeakSoftly通过LLM即时干预,帮助情侣在冲突中应用非暴力沟通原则,通过NVC-Prompt和NVC-Guide两种核心功能,提升沟通效果与自我认知,实验证明Empathetic Guide在行为和认知改变上效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04479 2026-04-08 cs.HC 78%

How can LLMs Support Policy Researchers? Evaluating an LLM-Assisted Workflow for Large-Scale Unstructured Data

大型语言模型如何支持政策研究?评估一个用于大规模非结构化数据的LLM辅助工作流

Yuhan Liu, Shuyao Zhou, Jakob Kaiser, Ella Colby, Jennifer Okwara, Maggie Wang, Varun Nagaraj Rao, Andrés Monroy-Hernández

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文评估了LLM辅助工作流在处理大规模非结构化数据中的应用,探讨了其在政策研究中的可行性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16044 2026-04-08 cs.SE 78%

From REST to MCP: An Empirical Study of API Wrapping and Automated Server Generation for LLM Agents

从REST到MCP:API封装和自动化服务器生成的实证研究

Meriem Mastouri, Emna Ksontini, Amine Barrak, Wael Kessentini

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文通过分析116个MCP服务器,探讨了其对REST的依赖及集成策略,评估了自动化生成和修复方法对正确性和复杂度的影响,揭示了MCP服务器的操作暴露模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05589 2026-04-08 cs.CR cs.AI 77%

Foundations for Agentic AI Investigations from the Forensic Analysis of OpenClaw

从OpenClaw的取证分析为基础的代理AI研究基础

Jan Gruber, Jan-Niclas Hilgert

机构 * KASTEL Security Research Labs, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院 KASTEL 安全研究实验室) Fraunhofer Institute for Communication, Information Processing and Ergonomics FKIE(弗劳恩霍夫通信、信息处理与人体工程学研究所 FKIE)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过分析OpenClaw的技术设计,提出了一种系统化的代理AI取证方法,揭示了代理执行带来的抽象层和非确定性挑战,为代理AI的系统研究提供了基础。

Comments Preprint. Code and experimental data available at: https://github.com/jgru/forensic-analysis-of-openclaw

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04756 2026-04-08 cs.LG cs.CL 76%

Darkness Visible: Reading the Exception Handler of a Language Model

黑暗可见:语言模型异常处理程序的解读

Peter Balogh

专题命中 其他LLM :language model(title);分类 cs.CL、cs.LG

AI总结 研究揭示GPT-2 Small最终MLP层存在可读的路由程序,通过分解神经元发现其异常处理机制及知识存储方式,实验显示知识神经元在路由中起作用而非存储事实。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24895 2026-04-08 cs.HC 75%

PII Shield: A Browser-Level Overlay for User-Controlled Personal Identifiable Information (PII) Management in AI Interactions

PII Shield:一种浏览器层面的叠加层,用于在AI交互中实现用户控制的个人可识别信息(PII)管理

Max Holschneider, Saetbyeol LeeYouk

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出PII Shield,通过企业级红actions管道,为用户提供直观的免费AI交互隐私保护体验,引入本地实体匿名化和干扰第三方分析的'烟雾'机制,以平衡用户数据使用与隐私保护。

Comments Accepted at the Proceedings of the CHI 2026 Workshop: Ethics at the Front-End

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09335 2026-04-08 cs.SE 75%

Can ChatGPT Generate Realistic Synthetic System Requirement Specifications? Results of a Case Study

ChatGPT能否生成逼真的合成系统需求规范?案例研究的结果

Alex R. Mattukat, Florian M. Braun, Horst Lichter

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了ChatGPT能否在不接触真实系统需求规范的情况下生成逼真的合成规范,通过系统方法生成300个跨10行业的规范,并发现62%的专家认为其合理,但存在矛盾陈述和缺陷,强调需结合专家评估。

Comments This is the accepted version of a paper that will appear in the proceedings of the 21st International Conference on Evaluation of Novel Approaches of Software Engineering (ENASE 2026). The final published version will be available from Science and Technology Publications (SCITEPRESS). 15 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10610 2026-04-08 cs.CR cs.AI 70%

LaSM: Layer-wise Scaling Mechanism for Defending Pop-up Attack on GUI Agents

LaSM:用于防御GUI代理中弹出攻击的分层缩放机制

Zihe Yan, Jiaping Gui, Zhuosheng Zhang, Gongshen Liu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LaSM机制,通过分层放大关键层的注意力和MLP模块,提升模型对任务相关区域的对齐性,有效防御弹出攻击,同时不影响模型整体能力。

Comments Accepted by CVPR-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04989 2026-04-08 cs.CR 67%

SkillAttack: Automated Red Teaming of Agent Skills through Attack Path Refinement

SkillAttack:通过攻击路径细化实现对代理技能的自动化红队测试

Zenghao Duan, Yuxin Tian, Zhiyi Yin, Liang Pang, Jingcheng Deng, Zihao Wei, Shicheng Xu, Yuyao Ge, Xueqi Cheng

专题命中 其他LLM :LLM(abstract);prompting(abstract)

AI总结 本文提出SkillAttack框架,通过对抗性提示动态验证技能漏洞可利用性,实验显示其在对抗性技能和真实场景中均显著优于基线方法,揭示了即使善意技能在实际代理交互中也存在严重安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04951 2026-04-08 cs.CR cs.AI 57%

Synthetic Trust Attacks: Modeling How Generative AI Manipulates Human Decisions in Social Engineering Fraud

合成信任攻击:生成式AI如何操纵人类在社会工程欺诈中的决策

Muhammad Tahir Ashraf

机构 * AAAI Pakistan Chapter(AAAI巴基斯坦分会) PureDesigners Ltd.(PureDesigners有限公司) IBM Watson

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出合成信任攻击(STA)作为正式威胁类别,引入STAM模型,涵盖从敌手侦察到事后利用的完整攻击链,探讨人类决策层的防御策略。

Comments 15 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05642 2026-04-08 cs.CR 50%

T2T: Captioning Smartphone Activities Using Mobile Traffic

T2T: 利用移动流量进行智能手机活动描述

Jiyu Liu, Yong Huang, Yanzhao Lu, Yun Tie, Wanqing Tu

专题命中 其他LLM :language model(abstract)

AI总结 本文提出T2T系统,通过加密移动流量生成智能手机活动描述,解决语义鸿沟和文本标注不足问题,实现高可读性文本生成。

Comments Accepted by IEEE International Joint Conference on Neural Networks 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07833 2026-04-08 cs.CV 50%

MIMIC: Multimodal Inversion for Model Interpretation and Conceptualization

MIMIC:多模态逆向用于模型解释与概念化

Animesh Jain, Alexandros Stergiou

机构 * University of Twente(特温特大学)

专题命中 其他LLM :language model(abstract)

AI总结 本文提出MIMIC框架,通过逆向处理多模态模型内部编码,提升模型可解释性与概念化能力,采用联合逆向与特征对齐目标,结合三种正则化器提升空间对齐、图像平滑与语义真实度。

Comments Accepted at CVPRw 2026 - How Do Vision Models Work? (HOW) Workshop, Project page: https://anaekin.github.io/MIMIC

详情

展开后加载摘要…

URL PDF HTML 收藏