arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-10 至 2026-08-10 共收录 1 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 1 篇

2603.24735 2026-08-10 cs.HC 版本更新 50%

Examining the Effect of Explanations of AI Privacy Redaction in AI-mediated Interactions

考察AI隐私擦除解释在AI中介互动中的影响

Roshni Kaushik, Maarten Sap, Koichi Onoue

专题命中 隐私与版权 :trustworthy(abstract)

AI总结 研究探讨AI中介互动中解释擦除操作对用户信任的影响,发现解释能提升隐私保护效果,且情境因素和个体差异影响解释效果。

Comments Accepted at AIES 2026

详情

展开后加载摘要…

URL PDF HTML 收藏