arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-25 至 2026-03-25 共收录 7 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 7 篇

2603.22690 2026-03-25 cs.CV cs.AI 79%

WiFi2Cap: Semantic Action Captioning from Wi-Fi CSI via Limb-Level Semantic Alignment

WiFi2Cap:从Wi-Fi CSI进行语义动作描述的肢体级语义对齐

Tzu-Ti Wei, Chu-Yu Huang, Yu-Chee Tseng, Jen-Jee Chen

专题命中 隐私与版权 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出WiFi2Cap框架,通过Wi-Fi CSI生成动作描述,引入镜像一致性损失解决方向敏感问题,并在基准数据集上验证了其在隐私保护语义感知中的有效性。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13698 2026-03-25 cs.LG cs.AI cs.IT math.IT stat.ML 62%

Does Privacy Always Harm Fairness? Data-Dependent Trade-offs via Chernoff Information Neural Estimation

隐私是否总是损害公平性?通过Chernoff信息神经估计的数据依赖性权衡

Arjun Nichani, Hsiang Hsu, Chun-Fu, Chen, Haewon Jeong

机构 * University of California Santa Barbara(加州大学圣芭芭拉分校) JP Morgan Chase Global Technology Applied Research(摩根大通全球技术应用研究)

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.LG

AI总结 本文通过Chernoff信息理论分析隐私与公平性之间的数据依赖性权衡,提出Chernoff差异及其噪声变体,并开发神经网络估计器CINE以实现实世界数据集的分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09442 2026-03-25 cs.CR cs.AI cs.CL 62%

Shadow in the Cache: Unveiling and Mitigating Privacy Risks of KV-cache in LLM Inference

缓存中的阴影:揭示和缓解LLM推理中KV缓存的隐私风险

Zhifan Luo, Shuo Shao, Su Zhang, Lijing Zhou, Yuke Hu, Chenxu Zhao, Zhihao Liu, Zhan Qin

机构 * State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Zhejiang University(浙江大学) Huawei Technology(华为技术) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.CL、cs.AI

AI总结 本文揭示了KV缓存中存在严重的隐私泄露问题,设计了三种攻击方法并提出KV-Cloak防御机制,有效缓解了隐私风险且不影响模型精度。

Comments This paper is accepted by Network and Distributed System Security Symposium (NDSS) 2026. Code: https://github.com/SiO-2/kvcloak

Journal ref Published in the Proceedings of the 33rd Network and Distributed System Security Symposium (NDSS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11191 2026-03-25 cs.AI cs.RO 57%

Multi-Modal Multi-Task (M3T) Federated Foundation Models for Embodied AI: Potentials and Challenges for Edge Integration

多模态多任务(M3T)联邦基础模型用于具身AI:边缘整合的潜力与挑战

Kasra Borazjani, Payam Abdisarabshali, Fardis Nadimi, Naji Khosravan, Minghui Liwang, Xianbin Wang, Yiguang Hong, Seyyedali Hosseinalipour

专题命中 隐私与版权 :safety(abstract);分类 cs.AI

AI总结 本文提出多模态多任务联邦基础模型(M3T-FFMs)用于具身AI,结合M3T-FMs的任务泛化能力和FL的隐私保护分布式训练,解决边缘部署中的异构具身、模态不平衡、带宽限制等挑战。

Comments Accepted for Publication in IEEE Internet of Things Magazine, 2025

Journal ref IEEE Internet of Things Magazine, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22363 2026-03-25 cs.SE cs.AI 57%

Early Discoveries of Algorithmist I: Promise of Provable Algorithm Synthesis at Scale

算法主义I:大规模可证明算法合成的前景

Janardhan Kulkarni

机构 * Microsoft(微软)

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI

AI总结 本文提出通过LLM生成可证明的算法,结合理论与实践,展示Algorithmist在隐私、近似和可解释性任务中的有效算法生成与验证。

Comments 75 pages, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22674 2026-03-25 cs.HC 50%

Designing a Meta-Reflective Dashboard for Instructor Insight into Student-AI Interactions

设计一个元反思仪表盘,以帮助教师了解学生与AI的互动

Boxuan Ma, Baofeng Ren, Huiyong Li, Gen Li, Li Chen, Atsushi Shimada, Shin'Ichi Konomi

专题命中 隐私与版权 :alignment(abstract)

AI总结 本文提出一个元反思仪表盘,通过结构化总结学生与AI的交互轨迹和潜在风险,帮助教师在不暴露原始聊天记录的情况下获取学生学习情况,同时减轻隐私担忧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06033 2026-03-25 cs.CR econ.GN q-fin.EC 50%

Sell Data to AI Algorithms Without Revealing It: Secure Data Valuation and Sharing via Homomorphic Encryption

将数据出售给AI算法而不揭露它:通过同态加密实现安全的数据估值与分享

Michael Yang, Ruijiang Gao, Zhiqiang Zheng

专题命中 隐私与版权 :trustworthy(abstract)

AI总结 本文提出Trustworthy Influence Protocol,利用同态加密和梯度影响函数,在不解密数据的情况下评估外部数据的效用,验证了其在医疗和生成AI领域的经济潜力,挑战了现有定价模型。

详情

展开后加载摘要…

URL PDF HTML 收藏