arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-05-28 至 2026-05-28 共收录 29 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 29 篇

2603.08761 2026-05-28 stat.ML cs.LG 86%

No Certificate for Alignment: Two Independent Impossibilities and the Pareto Frontier of Achievable Safety Guarantees

对齐无证书:两个独立的不可行性与可实现安全保证的帕累托前沿

Ayushi Agarwal

机构 * Independent Researcher(独立研究者)

专题命中 其他安全 :alignment(title,abstract);safety(title);分类 cs.LG

AI总结 本文通过两个独立的不可行性定理证明,在标准计算复杂性和学习理论假设下,对开放或无界输入域的AI对齐进行形式化认证是不可能的,并刻画了可实现的安全保证的帕累托前沿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16679 2026-05-28 cs.CL cs.AI cs.CY 82%

PICACO: Pluralistic In-Context Value Alignment of LLMs via Total Correlation Optimization

PICACO: 通过总相关优化实现大语言模型的多元情境价值对齐

Han Jiang, Dongyao Zhu, Xiaoyuan Yi, Ziang Xiao, Zhihua Wei, Xing Xie

机构 * Johns Hopkins University, Baltimore, MD, USA(约翰霍普金斯大学) North Carolina State University, Raleigh, NC, USA(北卡罗来纳州立大学) Microsoft Research Asia, Beijing, China(微软亚洲研究院) Tongji University, Shanghai, China(同济大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL、cs.AI、cs.CY

AI总结 针对情境对齐中价值冲突导致的指令瓶颈问题,提出PICACO方法,通过优化元指令并最大化指定价值与模型响应的总相关,无需微调即可实现多元价值平衡对齐。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23061 2026-05-28 cs.LG cs.AI 81%

C-MORAL: Controllable Multi-Objective Molecular Optimization with Reinforcement Alignment for LLMs

C-MORAL: 基于强化对齐的可控多目标分子优化用于大语言模型

Rui Gao, Youngseung Jeon, Swastik Roy, Morteza Ziyadi, Xiang 'Anthony' Chen

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Amazon(亚马逊)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI、cs.LG

AI总结 提出C-MORAL框架,通过强化学习后训练结合分组相对优化、属性分数对齐和瓶颈敏感非线性奖励聚合,实现可控多目标分子优化,在C-MuMOInstruct和S$^2$-Bench MolOpt基准上取得最优性能。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28520 2026-05-28 cs.AI 79%

GS-FUSE: Granger-Supervised Gated Fusion and Multi-Granularity Alignment for Event-Driven Financial Forecasting

GS-FUSE: 格兰杰监督的门控融合与多粒度对齐用于事件驱动的金融预测

Yang Zhang, En Chun, Ziyun Mao, Yulu Wu, Jun Wang

机构 * Southwestern University of Finance and Economics(西南财经大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 提出GS-Fuse框架,通过格兰杰因果监督的门控融合模块和多粒度对齐机制,选择性利用事件文本与价格信号,提升金融事件对市场影响的预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03491 2026-05-28 cs.CV cs.CL 79%

Decoupling Skeleton and Flesh: Efficient Multimodal Table Reasoning with Disentangled Alignment and Structure-aware Guidance

解耦骨架与血肉:基于解缠对齐和结构感知引导的高效多模态表格推理

Yingjie Zhu, Xuefeng Bai, Kehai Chen, Yang Xiang, Youcheng Pan, Xiaoqiang Zhou, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 提出DiSCo解缠结构-内容对齐框架和Table-GLS全局到局部结构引导推理框架,高效增强LVLM的表格理解与推理能力,无需昂贵监督或外部工具。

Comments Accepted as a Spotlight Paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27997 2026-05-28 cs.CL cs.AI cs.LG 67%

Where Does Toxicity Live? Mechanistic Localization and Targeted Suppression in Language Models

毒性存在于何处?语言模型中的机制定位与定向抑制

Himanshu Beniwal, Mayank Singh

机构 * Indian Institute of Technology Gandhinagar(印度理工学院冈德辛加尔)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过分析毒性与中性提示的激活差异,定位特定层和神经元中的毒性,并利用推理时缩放或最小秩一权重编辑进行抑制,无需梯度下降,实现毒性降低同时保持语言质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13820 2026-05-28 cs.LG cs.AI cs.CL 67%

Structured Agent Distillation for Large Language Model

大型语言模型的结构化智能体蒸馏

Jun Liu, Zhenglun Kong, Peiyan Dong, Changdi Yang, Tianqi Li, Hao Tang, Geng Yuan, Wei Niu, Wenbin Zhang, Pu Zhao, Xue Lin, Dong Huang, Yanzhi Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) Harvard University(哈佛大学) MIT(麻省理工学院) Northeastern University(东北大学) Adobe Research(Adobe研究) National University of Singapore(新加坡国立大学) University of Georgia(佐治亚大学) Florida International University(佛罗里达国际大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出结构化智能体蒸馏框架,通过分段对齐推理和动作跨度,将大型语言模型智能体压缩为小型学生模型,在保持决策性能的同时降低推理成本。

Journal ref The 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28639 2026-05-28 cs.CL cs.AI 62%

The Attentional White Bear Effect in Transformer Language Models

Transformer语言模型中的注意力白熊效应

Rebecca Ramnauth, Brian Scassellati

机构 * Yale University(耶鲁大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 通过表征探测、注意力分析和行为语义泄露实验,发现指令抑制下Transformer语言模型仍能恢复被禁止概念的表征并影响后续生成,揭示了行为对齐与表征对齐之间的根本差距。

Comments Currently under review at EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28598 2026-05-28 cs.CL cs.AI 62%

Evaluating the Realism of LLM-powered Social Agents: A Case Study of Reactions to Spanish Online News

评估基于LLM的社会智能体的真实性:对西班牙在线新闻反应的案例研究

Alejandro Buitrago López, Alberto Ortega Pastor, Javier Pastor-Galindo, José A. Ruipérez-Valiente

机构 * Faculty of Computer Science, University of Murcia(计算机科学系,穆尔西亚大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 通过比较真实与LLM生成的西班牙新闻评论,研究LLM在仇恨言论、情感和语义对齐三个维度上的真实性,发现现成模型表现不佳,微调可部分改善。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28306 2026-05-28 cs.CL cs.AI 62%

Routing-Aligned Fine-Tuning for Multilingual Downstream Tasks in Mixture-of-Experts Models

面向混合专家模型中多语言下游任务的路由对齐微调

Guanzhi Deng, Kuan Wu, Haibo Wang, Shing Yin Wong, Sichun Luo, Linqi Song

机构 * City University of Hong Kong(香港城市大学) Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 针对混合专家模型在多语言下游任务中的路由结构异构问题,提出RA-MoE三阶段框架,通过中间层语言通用对齐区识别任务相关专家,并引入路由对齐损失增强目标语言路由,实验表明该方法优于标准微调和强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16565 2026-05-28 cs.LG cs.AI 62%

Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models

流形上的推理:扩散语言模型中用于自我验证的双向一致性

Jiaoyang Ruan, Xin Gao, Yinda Chen, Hengyu Zeng, Liang Du, Guanghao Li, Jie Fu, Jian Pu

机构 * Institute of Science and Technology for Brain-Inspired Intelligence(脑启发智能科学与技术研究院) Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) IEG, Tencent Inc.(腾讯IEG)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 提出双向流形一致性(BMC),一种无训练、无监督的度量方法,通过前向掩码和后向重建循环量化生成序列的稳定性,用于扩散语言模型的诊断、推理和对齐。

Comments 31 pages, 7 figures. Accepted to the 43rd International Conference on Machine Learning (ICML 2026). Camera-ready version

Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13524 2026-05-28 cs.LG cs.AI 62%

Singular Vectors of Attention Heads Align with Features

注意力头的奇异向量与特征对齐

Gabriel Franco, Carson Loughridge, Mark Crovella

机构 * Department of Computer Science, Boston University, Boston, USA Faculty of Computing \& Data Sciences, Boston University, Boston, USA

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文通过理论分析和实验验证,解释了注意力头奇异向量与特征表示对齐的原因和条件,并提出了稀疏注意力分解作为对齐的可检验预测。

Comments To be published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06999 2026-05-28 cs.CV cs.CL cs.LG 62%

Learning Deliberately, Acting Intuitively: Unlocking Test-Time Reasoning in Multimodal LLMs

有意学习,直觉行动:解锁多模态大语言模型的测试时推理能力

Yahan Yu, Yuyang Dong, Masafumi Oyamada

机构 * Kyoto University(京都大学) Initial S NEC Corporation, Japan(日本NEC公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 提出D2I框架,通过训练时使用基于规则的格式奖励进行有意推理以增强模态对齐,推理时移除显式策略转为直觉推理,从而提升多模态大语言模型的推理能力,无需额外标注或复杂奖励。

Comments 22 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18893 2026-05-28 cs.CL cs.LG 62%

xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction

xKV:通过对齐奇异向量提取的跨层KV缓存压缩

Chi-Chih Chang, Wei-Cheng Lin, Chien-Yu Lin, Hung-Yueh Chiang, Yash Akhauri, Xilai Dai, Huiqiang Jiang, Yucheng Li, Luis Ceze, Kai-Chiang Wu, Mohamed S. Abdelfattah

机构 * Cornell University(康奈尔大学) University of Washington(华盛顿大学) Department of Computer Science, National Yang Ming Chiao Tung University(国立阳明交通大学计算机科学系) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Surrey(塞夫顿大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 提出xKV,一种通过跨层共享低秩子空间压缩KV缓存的后训练方法,实现高达8倍压缩且保持长上下文任务精度,并引入选择性重建实现端到端加速。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28733 2026-05-28 cs.AI 57%

Utility-Aware Multimodal Contrastive Learning for Product Image Generation

效用感知的多模态对比学习用于产品图像生成

Xiaohang Feng, Yiling Xie

机构 * City University of Hong Kong(香港城市大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出一种效用感知的多模态对比学习框架,通过引入效用感知InfoNCE损失优化产品图像生成,使图像在语义对齐的同时提升市场需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28604 2026-05-28 cs.CV cs.AI 57%

Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification

挖掘多模态时空线索用于视频重要人物识别

Xiao Wang, Minglei Yang, Bin Yang, Wenke Huang, Zheng Wang, Xin Xu, Mang Ye

机构 * School of Computer Science and Technology, Wuhan University of Science and Technology(武汉科技大学计算机科学与技术学院) Hubei Province Key Laboratory of Intelligent Information Processing and Real-time Industrial System, Wuhan University of Science and Technology(湖北省智能信息处理与实时工业系统重点实验室) School of Computer Science, National Engineering Research Center for Multimedia Software, Hubei Key Laboratory of Multimedia and Network Communication Engineering, Wuhan University(计算机科学学院,国家多媒体软件工程技术研究中心,湖北省多媒体与网络通信工程重点实验室,武汉大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 针对视频中人物重要性随时间变化的问题,提出VIP-Net框架,通过多模态时空线索融合与时间重要性矫正,在Temporal-VIP数据集上达到67.3%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28524 2026-05-28 cs.AI 57%

Let Relations Speak: An End-to-End LLM-GNN Soft Prompt Framework for Fraud Detection

让关系说话:面向欺诈检测的端到端LLM-GNN软提示框架

Zhixing Zuo, Huilin He, Jiasheng Wu, Dawei Cheng

机构 * School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出LGSPF框架,通过软提示桥接图结构与语义空间,并引入并行GNN编码器将多关系拓扑转化为图令牌,实现端到端优化,在欺诈检测中达到最优性能。

Comments 14 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28483 2026-05-28 cs.AI cs.IR 57%

From Learning Resources to Competencies: LLM-Based Tagging with Evidence and Graph Constraints

从学习资源到能力:基于证据和图约束的LLM标签方法

Ngoc Luyen Le, Marie-Hélène Abel, Bertrand Laforge

机构 * Université de technologie de Compiègne, CNRS, Heudiasyc(法国图卢兹技术大学、CNRS、Heudiasyc实验室) Sorbonne Université, CNRS UMR 7585, LPMHE(巴黎大学、CNRS UMR 7585、LPMHE实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出一种端到端对齐流程,利用大语言模型作为受约束的、能产生证据的标签器,将学习资源链接到结构化能力框架,在计算机科学数据集上取得优于基线方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28292 2026-05-28 cs.CL 57%

CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models

CIRF:将思维链分词化为可重用的功能单元,用于大型语言模型的高效潜在推理

Yukyung Lee, Yumeng Shen, Jinhyeong Park, Hyein Yang, Jun-Hyung Park

机构 * Boston University(波士顿大学) Hankuk University of Foreign Studies(韩国民法大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 提出CIRF框架,通过将显式思维链中的语义连贯推理单元映射为离散功能令牌,实现动态序列推理,在数学、符号和常识推理基准上取得优于现有隐式CoT方法的准确率-延迟权衡。

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27970 2026-05-28 cs.AI 57%

Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations

人类感知域的几何结构在LLM表征中短暂出现

Simardeep Singh, Paras Chopra

机构 * Indian Institute of Technology Roorkee(印度理工学院罗尔基分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究大型语言模型内部表征中是否出现与人类感知组织相似的几何结构,发现多个感知域的几何结构在中间层短暂涌现,且与人类基准对齐。

Comments 19 Pages, 28 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27671 2026-05-28 stat.ML cs.LG 57%

Evolving and Detecting Multi-Turn Deception using Geometric Signatures

使用几何特征演化与检测多轮欺骗

Surender Suresh Kumar, Mary L. Cummings

机构 * George Mason University(乔治·马歇尔大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 提出多目标遗传优化生成多轮欺骗问题集,并利用嵌入空间中的简单几何特征(角覆盖、距离比、线性度)结合轻量级分类器实现高召回率(0.89)的欺骗检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27586 2026-05-28 cs.MA cs.CL 57%

You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents

你只需对齐一次:通过种子智能体在多智能体系统中传播合作行为

Nicole Hsing, Asuka Yuxi Zheng, Yi Zhao, Haoqin Tu, Jen-Tse Huang

机构 * Arcarae University of California, Santa Cruz(加州大学圣克鲁兹分校) Northwestern University(西北大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出对齐传播现象,通过种子智能体在自然语言交互中传播合作行为,在红黑游戏中将合作率从24.8%提升至62.2%,并零样本迁移至Sugarscape场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04716 2026-05-28 cs.CL 57%

Identifying and Mitigating Bottlenecks in Role-Playing Agents: A Systematic Study of Disentangling Character Profile Axes

识别与缓解角色扮演代理中的瓶颈:解耦角色档案轴线的系统研究

Yonghyun Jun, Junhyuk Choi, Jeonghyun Park, Jihyeong Park, Liu Nicole Geumheon, Hwanhee Lee

机构 * Chung-Ang University(Chung-Ang 大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本研究通过解耦角色档案的熟悉度、结构和性格三个轴线,系统诊断LLM角色扮演代理的性能瓶颈,并提出无训练的场感知对比解码(FACD)策略来缓解性格带来的性能下降。

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15848 2026-05-28 cs.AI 57%

A Comparative Study of Rule-Based and Data-Driven Approaches in Industrial Monitoring

基于规则与数据驱动方法在工业监控中的比较研究

Giovanni De Gasperis, Sante Dino Facchini

机构 * Università degli Studi dell’Aquila(阿奎拉大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本研究比较了工业监控中基于规则与数据驱动两种方法,分析了各自的优缺点,并提出混合方案以结合两者优势。

Comments This chapter has been published in Advancements in AI From Foundations to Cross-Disciplinary Applications, Springer, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28820 2026-05-28 cs.CV 50%

From Pixels to Words -- Towards Native One-Vision Models at Scale

从像素到文字——迈向原生单视觉大规模模型

Haiwen Diao, Jiahao Wang, Penghao Wu, Yuhao Dong, Yuwei Niu, Yue Zhu, Zhongang Cai, Weichen Fan, Linjun Dai, Silei Wu, Xuanyu Zheng, Mingxuan Li, Yuanhan Zhang, Bo Li, Hanming Deng, Huchuan Lu, Quan Wang, Lei Yang, Lewei Lu, Dahua Lin, Ziwei Liu

机构 * S-Lab, NTU(S实验室,国立科技大学) SenseTime Research(商汤科技研究院) DLUT(大连理工大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出NEO-ov原生基础模型,通过端到端学习跨帧和像素-文字对应,无需外部编码器或适配器,在细粒度视觉感知上缩小了与模块化模型的差距,验证了原生单视觉架构的可行性和竞争力。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25763 2026-05-28 cs.CV 50%

AI-T2I: Aggregating-and-Isolating Cross-Attention to Diffusion Models for Text-to-Image Synthesis

AI-T2I: 面向文本到图像合成的扩散模型的聚合与隔离交叉注意力

Shipeng Cao, Biao Qian, Haipeng Liu, Yang Wang, Meng Wang

机构 * Institute of Advanced Medicine and Frontier Technology(先进医学与前沿技术研究院) Hefei University of Technology(合肥工业大学) Key Laboratory of Knowledge Engineering With Big Data, Ministry of Education(大数据知识工程重点实验室) Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 其他安全 :alignment(abstract)

AI总结 针对扩散模型在文本到图像合成中交叉注意力图内文本-图像对齐不精确的问题,提出一种聚合与隔离交叉注意力方法(AI-T2I),通过聚合损失整合分散的令牌内激活并引入隔离损失分离令牌间激活,实现精确对齐。

Comments Accepted by IEEE Transactions on Multimedia (2026). 13 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21668 2026-05-28 cs.CV 50%

Encoder-Free Human Motion Understanding via Structured Motion Descriptions

通过结构化运动描述实现无编码器的人体运动理解

Yao Zhang, Zhuchenyang Liu, Thomas Ploetz, Yu Xiao

机构 * Aalto University(阿alto大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他安全 :alignment(abstract)

AI总结 提出结构化运动描述(SMD),将关节位置序列转换为结构化自然语言描述,使大语言模型无需专用编码器即可直接进行运动推理,在运动问答和字幕生成任务上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27900 2026-05-28 cs.CV 50%

Decoupled Training with Local Reinforcement Fine-Tuning in Federated Learning

联邦学习中解耦训练与局部强化微调

Yuting Ma, Lechao Cheng, Xiaohua Xu

机构 * School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)

专题命中 其他安全 :alignment(abstract)

AI总结 提出FedDTL框架,通过解耦图像和文本编码器训练并引入两阶段局部微调(监督微调+强化学习),解决联邦学习中客户端间优化不一致和客户端内过专门化问题,平衡全局任务适应性与泛化能力。

Comments This work has been accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27893 2026-05-28 cs.CV 50%

SIGMA: Bridging Structural and Distributional Gaps for Vision Foundation Model Adaptation

SIGMA:弥合视觉基础模型适应的结构与分布差距

Lingyu Xiong, Jinjin Shi, Xuran Xu, Cong Luo, Runyu Shi, Ying Huang

机构 * Xiaomi Corporation(小米公司)

专题命中 其他安全 :alignment(abstract)

AI总结 提出SIGMA方法,通过尺度自适应融合和语义调制模块,以1.72%可训练参数实现视觉基础模型在密集预测任务上的高效微调,性能优于现有PEFT方法。

详情

展开后加载摘要…

URL PDF HTML 收藏