arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-24 至 2026-03-24 共收录 3 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 3 篇

2603.21656 2026-03-24 cs.LG cs.CY 76%

TrustFed: Enabling Trustworthy Medical AI under Data Privacy Constraints

TrustFed: 在数据隐私约束下实现可信的医疗AI

Vagish Kumar, Syed Bahauddin Alam, Souvik Chakraborty

机构 * Department of Applied Mechanics(应用力学系) Indian Institute of Technology Delhi(印度理工学院德里) Grainger College of Engineering(工程学院) Nuclear, Plasma & Radiological Engineering Department(核物理与辐射工程系) National Center for Supercomputing Applications(国家超级计算应用中心) Yardi School of Artificial Intelligence (ScAI)(Yardi人工智能学院(ScAI)) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 隐私与版权 :trustworthy(title);分类 cs.CY、cs.LG

AI总结 TrustFed通过联邦不确定性量化框架,在异构和不平衡医疗数据上提供分布无关的有限样本覆盖保证,无需集中访问,提升预测可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05027 2026-03-24 cs.AI 57%

S5-SHB Agent: Society 5.0 enabled Multi-model Agentic Blockchain Framework for Smart Home

S5-SHB代理:面向社会5.0的多模型代理区块链框架用于智能家居

Janani Rangila, Akila Siriweera, Incheon Paik, Keitaro Naruse, Isuru Jayanada, Vishmika Devindi

机构 * KD University(KD大学) University of Aizu(东亚大学)

专题命中 隐私与版权 :safety(abstract);分类 cs.AI

AI总结 本文提出S5-SHB代理框架,通过多代理协调和居民控制治理,解决智能家居中适应性共识、智能多代理协调和居民可控治理的问题。

Comments 15 pages, 15 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18415 2026-03-24 cs.HC 50%

AI-Wrapped: Participatory, Privacy-Preserving Measurement of Longitudinal LLM Use In-the-Wild

AI-Wrapped:参与式、隐私保护的长期LLM使用情况实地测量

Cathy Mengying Fang, Sheer Karny, Chayapatr Archiwaranguprok, Yasith Samaradivakara, Pat Pataranutaporn, Pattie Maes

专题命中 隐私与版权 :alignment(abstract)

AI总结 本文提出AI-Wrapped系统,通过隐私保护的方式收集真实LLM聊天使用数据,并分析用户使用模式及主题,揭示用户在日常场景中对LLM的使用特点及潜在问题。

详情

展开后加载摘要…

URL PDF HTML 收藏