arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-04 至 2026-08-04 共收录 4 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 4 篇

2608.01311 2026-08-04 cs.CL 新提交 83%

RH-RAG: Trustworthy Long-Form Generation for Privacy-Constrained Settings

RH-RAG:适用于隐私受限场景的可信长文本生成

Raj Shekhar Singh

机构 * Indian Institute of Technology, Roorkee(鲁尔基印度理工学院)

专题命中 隐私与版权 :trustworthy(title,abstract);alignment(abstract);分类 cs.CL

AI总结 该研究针对隐私受限场景下的长文本生成难题,提出基于本地语言模型的多智能体框架RH-RAG,通过三阶段协同生成与双层检索索引提升生成质量,且兼顾数据隐私。

Comments accepted in KDD 2026 SeT-LLM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21369 2026-08-04 cs.LG 版本更新 79%

Rethinking Federated Graph Foundation Models: A Graph-Language Alignment-based Approach

重新思考联邦图基础模型:基于图-语言对齐的方法

Yinlin Zhu, Di Wu, Xianzhi Zhang, Yuming Ai, Xunkai Li, Miao Hu, Guocong Quan

机构 * Sun Yat-sen University, Guangzhou, China(中山大学) Beijing Institute of Technology, Beijing, China(北京理工大学)

专题命中 隐私与版权 :alignment(title,abstract);分类 cs.LG

AI总结 FedGALA通过图-语言对齐解决联邦图基础模型中的语义-结构正交性问题,提升多任务适应性与效率

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00964 2026-08-04 cs.CY 新提交 57%

Copyright Is the Headline; Capability Is the Blind Spot: AI Technology in the Book-Publishing Trade Press, November 2025--August 2026

版权是头条,能力是盲区:2025年11月—2026年8月图书出版行业媒体中的人工智能技术

Fred Zimmerman

专题命中 隐私与版权 :prompt injection(abstract);分类 cs.CY

AI总结 本研究通过分析多国行业媒体的89篇文章,指出图书出版领域AI报道存在能力盲区,提出设立常设AI报道板块等改进建议。

Comments 7 pages, 2 figures. 15-page Supplemental Information, coded 89-item corpus, crosstabs, BibTeX database, and citation audit included as ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10754 2026-08-04 cs.CR cs.CY cs.HC 57%

Chatting with Confidants or Corporations? Privacy Management with AI Companions

与知己还是公司聊天?AI伴侣的隐私管理

Hsuen-Chi Chiu, Jeremy Foote

专题命中 隐私与版权 :safety(abstract);分类 cs.CY

AI总结 基于沟通隐私管理理论和水平-垂直隐私框架,通过访谈Replika和Character.AI用户,发现用户融合人际习惯与机构意识,采用分层策略管理隐私,但拟人化设计导致边界模糊和隐私动荡。

Journal ref Journal of Computer-Mediated Communication, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏