arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-10 至 2026-04-10 共收录 3 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 3 篇

2512.19253 2026-04-10 cs.LG cs.AI cs.CV 62%

Machine Unlearning in the Era of Quantum Machine Learning: An Empirical Study

量子机器学习时代的机器反学习:一项实证研究

Carla Crivoi, Radu Tudor Ionescu

机构 * University of Bucharest, Romania(布加勒斯特大学(罗马尼亚))

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了量子混合神经网络中机器反学习的行为,发现量子模型能有效支持反学习,但结果依赖于电路深度、纠缠结构和任务复杂性。

Comments Accepted at ICPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08352 2026-04-10 cs.SE cs.CR cs.HC 50%

Security Concerns in Generative AI Coding Assistants: Insights from Online Discussions on GitHub Copilot

生成式AI代码助手的安全问题:来自GitHub Copilot在线讨论的洞察

Nicolás E. Díaz Ferreyra, Monika Swetha Gurupathi, Zadia Codabux, Nalin Arachchilage, Riccardo Scandariato

专题命中 隐私与版权 :prompt injection(abstract)

AI总结 研究分析开发者在公共论坛中提出的安全问题,识别出数据泄露、代码授权、对抗攻击和不安全代码建议等四大安全关切,揭示生成式AI在软件工程中的局限性与权衡。

Comments Accepted for publication at EASE '26 Companion

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02711 2026-04-10 eess.SP 50%

Foundation Models Defining A New Era In Sensor-based Human Activity Recognition: A Survey And Outlook

基于传感器的人类活动识别的基石模型:一种综述与展望

Sizhen Bian, Mengxi Liu, Lala Shakti Swarup Ray, Bo Zhou, Bin Guo, Zhiwen Yu, Thomas Ploetz, Paul Lukowicz, Siyu Yuan, Vitor Fortes Rey

专题命中 隐私与版权 :alignment(abstract)

AI总结 本文综述了基于传感器的人类活动识别中的基石模型,分析了九种技术轴上的设计模式与权衡,并探讨了数据整理、多模态对齐、个性化、隐私和负责任部署等开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏