2603.22869 2026-04-06 cs.AI 88% Chain-of-Authorization: Embedding authorization into large language models 授权链:将授权嵌入大型语言模型 Yang Li, Yule Liu, Xinlei He, Youjian Zhao, Qi Li, Ke Xu 专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI AI总结 本文提出授权链框架,通过重新设计输入输出格式和微调合成数据,使LLM在动态推理环境中内化访问边界,提升安全性和拒绝非授权请求的能力。 Comments 23 pages, 7 figures 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.02574 2026-04-06 cs.CR cs.AI cs.LG 87% Understanding the Effects of Safety Unalignment on Large Language Models 理解安全对齐偏差对大语言模型的影响 John T. Halloran 机构 * Leidos(Leidos公司) 纠错 专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG AI总结 研究通过JT和WO方法评估六种大模型在恶意和良性任务中的表现,发现WO方法使模型更易执行恶意活动,而JT方法则更易产生幻觉。通过监督微调有效限制WO带来的攻击能力。 Comments 12 pages, 2 figures, 5 tables 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2509.07274 2026-04-06 cs.CL cs.CY cs.LG 86% LLM Analysis of 150+ years of German Parliamentary Debates on Migration Reveals Shift from Post-War Solidarity to Anti-Solidarity in the Last Decade 基于150余年德国议会辩论的LLM分析揭示了从战后团结到反团结的转变 Aida Kostikova, Ole Pütz, Steffen Eger, Olga Sabelfeld, Benjamin Paassen 机构 * Bielefeld University(比勒费尔德大学) ; University of Technology Nuremberg(纽伦堡工业大学) 纠错 专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract) AI总结 本文利用LLM分析德国议会辩论中的迁移议题,发现战后时期团结程度较高,而2015年后反团结显著上升,提出需通过验证和统计修正来提升LLM在社会科学研究中的应用。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.02772 2026-04-06 cs.CL 79% Multiple-Debias: A Full-process Debiasing Method for Multilingual Pre-trained Language Models 多偏见:一种面向多语言预训练语言模型的全流程去偏方法 Haoyu Liang, Peijian Zeng, Wentao Huang, Aimin Yang, Dong Zhou 机构 * Guangdong University of Technology(广东工业大学) ; Guangdong University of Foreign Studies(广东外语外贸大学) 纠错 专题命中 指令微调 :language model(title,abstract);分类 cs.CL AI总结 本文提出Multiple-Debias方法,通过多语言反事实数据增强和多语言Self-Debias,结合参数高效微调,有效减少多语言预训练模型中性别、种族和宗教偏见。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.02770 2026-04-06 cs.AI 77% Improving Role Consistency in Multi-Agent Collaboration via Quantitative Role Clarity 通过量化角色清晰度提升多智能体协作中的角色一致性 Guoling Zhou, Wenpei Han, Fengqin Yang, Li Wang, Yingcong Zhou, Zhiguo Fu 专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI AI总结 本文提出量化角色清晰度以提升多智能体协作中的角色一致性,通过构建角色分配矩阵和角色清晰度矩阵,利用Frobenius范数量化角色描述与行为轨迹的一致性,并在轻量微调中作为正则化项提升任务性能。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2510.17586 2026-04-06 cs.DB 75% DeepEye-SQL: A Software-Engineering-Inspired Text-to-SQL Framework DeepEye-SQL: 一种受软件工程启发的文本到SQL框架 Boyan Li, Chong Chen, Zhujun Xue, Yinan Mei, Yuyu Luo 专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract) AI总结 DeepEye-SQL通过结构化协作提升文本到SQL的可靠性,采用软件开发生命周期指导,实现73.5%的BIRD-Dev准确率和89.8%的Spider-Test表现,优于现有方法。 Comments SIGMOD 2026 详情 DOI 10.1145/3802035 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.02795 2026-04-06 cs.CL cs.AI 73% Rubrics to Tokens: Bridging Response-level Rubrics and Token-level Rewards in Instruction Following Tasks 评分标准到标记:在指令遵循任务中连接响应级评分标准和标记级奖励 Tianze Xu, Yanzhao Zheng, Pengrui Lu, Lyumanshan Ye, Yong Wu, Zhentao Zhang, Yuanqiang Yu, Chao Ma, Jihuai Zhu, Pengfei Liu, Baohua Dong, Hangcheng Zhu, Ruohui Huang, Gang Yu 机构 * Shanghai Jiao Tong University(上海交通大学) ; Alibaba Group(阿里巴巴集团) ; Zhejiang University(浙江大学) ; Shanghai Innovation Institute(上海创新研究院) ; GAIR 纠错 专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI AI总结 本文提出RTT框架,通过引入标记级相关性判别器和RTT-GRPO方法,解决响应级奖励稀疏性和模糊性问题,提升指令遵循任务的准确率。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2509.07553 2026-04-06 cs.CL 70% VeriOS: Query-Driven Proactive Human-Agent-GUI Interaction for Trustworthy OS Agents VeriOS: 基于查询的人机GUI交互以实现可信操作系统代理 Zheng Wu, Heyuan Huang, Xingyu Lou, Xiangmou Qu, Pengzhou Cheng, Zongru Wu, Weiwen Liu, Weinan Zhang, Jun Wang, Zhaoxiang Wang, Zhuosheng Zhang 机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) 纠错 专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL AI总结 VeriOS通过引入查询驱动的人机GUI交互框架,提升操作系统代理在不可信环境中的任务完成能力,实验显示其在不可信场景中性能显著提升,同时保持正常场景下的稳定性。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2505.15656 2026-04-06 cs.CL 70% Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen! 在对开源大语言模型进行微调时要小心:你的微调数据可能被偷偷窃取! Zhexin Zhang, Yuhao Sun, Junxiao Yang, Shiyao Cui, Yuanchao Zhang, Hongning Wang, Minlie Huang 机构 * The Conversational AI (CoAI) group, DCST, Tsinghua University(清华大学计算机科学与技术系对话式人工智能组) ; The University of Melbourne(墨尔本大学) ; MYbank, Ant Group(蚂蚁集团网商银行) 纠错 专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL AI总结 研究揭示了在开源大语言模型上微调时,通过简单后门训练可能窃取私有微调数据的风险,实验表明提取成功率高达76.3%,并提出检测防御策略但发现其易被绕过。 Comments Accepted to ICLR 2026 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.02767 2026-04-06 cs.CR cs.AI cs.MA 57% SentinelAgent: Intent-Verified Delegation Chains for Securing Federal Multi-Agent AI Systems SentinelAgent:意图验证的委托链用于安全的联邦多智能体AI系统 KrishnaSaiReddy Patil 专题命中 指令微调 :LLM(abstract);分类 cs.AI AI总结 本文提出SentinelAgent框架,通过委托链计算和意图保留协议,实现联邦多智能体AI系统的安全委托验证,验证生命周期在DelegationBench v4上达到100%TPR且0%FPR。 Comments 12 pages, 2 figures, 9 tables. Includes TLA+ mechanical verification, DelegationBench v4 benchmark (516 scenarios), live LangChain agent integration, and independent red-team evaluation 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.02352 2026-04-06 cs.LG cs.AI cs.SE 54% An Initial Exploration of Contrastive Prompt Tuning to Generate Energy-Efficient Code 对比提示微调在生成节能代码中的初步探索 Sophie Weidmann, Fernando Castor 机构 * University of Twente(特温特大学) 纠错 专题命中 指令微调 :分类 cs.AI、cs.LG;large language model(comments);language model(comments) AI总结 本文探讨了通过对比提示微调优化大语言模型生成节能代码的方法,评估了其在Python、Java和C++编程任务中的效果,发现不同模型、语言和任务复杂度下效率提升不一致。 Comments Published at the Third International Workshop on Large Language Models for Code (LLM4Code 2026) 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2602.00683 2026-04-06 cs.CV 50% Video Understanding: Through A Temporal Lens 视频理解:通过时间视角 Thong Thanh Nguyen 机构 * Institute of Data Science(数据科学研究所) 纠错 专题命中 指令微调 :language model(abstract) AI总结 本文通过时间视角探讨如何利用视频元素间的时间关系提升视频理解,提出自动标注框架、参数高效微调策略、状态空间层整合、新型对比学习框架及对大视觉-语言模型的全面研究,揭示了视觉-语言接口对时间推理的瓶颈。 Comments PhD Thesis, NUS, 2025 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2511.08666 2026-04-06 cs.CV 50% Privacy Beyond Pixels: Latent Anonymization for Privacy-Preserving Video Understanding 隐私超越像素:用于隐私保护视频理解的潜在匿名化 Joseph Fioresi, Ishan Rajendrakumar Dave, Mubarak Shah 机构 * Institute of Artificial Intelligence, University of Central Florida(中佛罗里达大学人工智能研究所) ; Adobe 纠错 专题命中 指令微调 :foundation model(abstract) AI总结 本文提出了一种在潜在空间中操作的视频基础模型视觉隐私保护新方法,通过轻量级匿名化适配模块在保留任务实用性的同时去除隐私信息,显著降低隐私泄露,适用于多种下游任务。 Comments Accepted to ICLR 2026 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2010.16330 2026-04-06 math.SG math.GT 50% On symplectic fillings of spinal open book decompositions II: Holomorphic curves and classification 关于脊柱开书分解的辛填充 II:全纯曲线与分类 Samuel Lisi, Jeremy Van Horn-Morris, Chris Wendl 专题命中 指令微调 :SFT(abstract) AI总结 本文证明当接触3流形具有平面页的统一脊柱开书分解时,其(弱、强和/或精确)辛和Stein填充可由Lefschetz纤维化的微分同胚类分类。进一步结果包括新的ECH接触不变量和SFT中代数扭力消失准则,非定向圈 bundles的填充分类,以及关于四维实数中Stein结构变形类的 Comments 120 pages, 10 figures, sequel to arXiv:1810.12017; v2 (submitted version) contains a few minor updates to take account of more recent activity 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图