arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-09 至 2026-04-09 共收录 4 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 4 篇

2406.14966 2026-04-09 cs.CY cs.CR 79%

Towards trustworthy management of AIGC copyright: blockchain-enabled full lifecycle recording and multi-party auditing approach

面向可信的AIGC版权管理:基于区块链的全生命周期记录与多方审计方法

Jiajia Jiang, Moting Su, Fengshu Li, Xiangli Xiao, Yushu Zhang

专题命中 隐私与版权 :trustworthy(title,abstract);分类 cs.CY

AI总结 本文提出AIGC-Chain系统,通过区块链实现AIGC全生命周期数据记录与多方审计,解决现有解决方案在中间数据管理上的不足,提升版权确认与多方收益分配的可信度。

Journal ref Cybersecurity 9, 151 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06831 2026-04-09 cs.CR cs.AI 74%

Towards Privacy-Preserving Large Language Model: Text-free Inference Through Alignment and Adaptation

面向隐私保护的大语言模型:通过对齐与适应实现文本-free推理

Jeongho Yoon, Chanhee Park, Yongchan Chun, Hyeonseok Moon, Heuiseok Lim

机构 * Department of Computer Science and Engineering, Korea University(高丽大学计算机科学与工程系) Samsung Mobile eXperience Business(三星移动体验事业部)

专题命中 隐私与版权 :alignment(title);分类 cs.AI

AI总结 本文提出PPFT方法,通过客户端编码器与服务器投影模块的协同训练,实现无需传输原始文本的隐私保护推理,平衡隐私与模型效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06899 2026-04-09 cs.CR cs.LG cs.SE 57%

Data Leakage in Automotive Perception: Practitioners' Insights

自动驾驶感知中的数据泄露:从业者洞察

Md Abu Ahammed Babu, Sushant Kumar Pandey, Darko Durisic, Andras Balint, Miroslaw Staron

机构 * Volvo Cars(沃尔沃汽车) University of Gothenburg(哥德堡大学) Chalmers University of Technology(查尔姆斯理工大学) University of Groningen(格罗宁根大学)

专题命中 隐私与版权 :safety(abstract);分类 cs.LG

AI总结 研究通过访谈探讨自动驾驶感知领域从业者对数据泄露的认知、经验及应对策略,揭示其作为社会技术协调问题的特性,强调需建立共享定义和跨角色沟通以提升ML可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26167 2026-04-09 cs.CV cs.CR 50%

Gaussian Shannon: High-Precision Diffusion Model Watermarking Based on Communication

高斯香农:基于通信的高精度扩散模型水印技术

Yi Zhang, Hongbo Huang, Liang-Jie Zhang

专题命中 隐私与版权 :trustworthy(abstract)

AI总结 本文提出Gaussian Shannon水印框架,通过将扩散过程视为噪声通信信道,实现鲁棒追踪和精确位恢复,适用于无损元数据应用。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏