arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-05-08 至 2026-05-08 共收录 4 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 4 篇

2410.01871 2026-05-08 cs.GT cs.AI cs.CY econ.GN q-fin.EC 62%

Auction-Based Regulation for Artificial Intelligence

基于拍卖的人工智能监管

Marco Bornstein, Zora Che, Suhas Julapalli, Abdirisak Mohamed, Amrit Singh Bedi, Furong Huang

机构 * Department of Computer Science, University of Maryland, College Park, MD, USA(马里兰大学计算机科学系,College Park, MD, USA) SAP Labs, LLC(SAP实验室) Department of Computer Science, University of Central Florida, FL, USA(佛罗里达大学计算机科学系,FL, USA)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文提出基于拍卖的AI监管机制,通过数学框架激励企业部署合规模型并参与监管,实验证明其在提升合规率和参与率方面优于传统方法。

Comments 26 pages, 7 figures, 3 tables. Accepted at ACM FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05706 2026-05-08 cs.AI q-bio.QM 57%

Resolving the bias-precision paradox with stochastic causal representation learning for personalized medicine

用随机因果表示学习解决偏差-精度悖论以实现个性化医疗

Peisong Zhang, Manqiang Peng, Yuxuan Wu, Pawit Phadungsaksawasdi, Wesley Yeung, Ye Zhang, Trang Nguyen, Qiang Zhang, Nan Liu, Meng Wang, Kee Yuan Ngiam, Yih-Chung Tham, Ching-Yu Cheng, Tianfan Fu, Qingyu Chen, Rosemary Ke, Chang Li, Wenzhuo Yang, Zhenghao Lu, Chunyou Lai, Yu Zhang, Sheng Zhong, Hao Deng, Dianbo Liu

机构 * Chengdu OrganoidMed Medical Laboratory(成都OrganoidMed医学实验室)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI

AI总结 本文提出基于sMMD的随机对齐策略,解决因果表示学习中的偏差-精度悖论,提升个性化医疗中分布偏移下的预测准确性,减少误差并提高高风险任务的召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05440 2026-05-08 cs.AI 57%

Authorization Propagation in Multi-Agent AI Systems: Identity Governance as Infrastructure

多智能体AI系统中的授权传播:身份治理作为基础设施

Krti Tallam

机构 * Kamiwaza AI

专题命中 AI治理与伦理 :prompt injection(abstract);分类 cs.AI

AI总结 本文探讨多智能体系统中授权传播问题,提出三个子问题和七项结构要求,强调身份治理应作为基础设施持续评估和设计。

Comments Security and systems paper, 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05830 2026-05-08 cs.CR 50%

Fairness in Token Delegation: Mitigating Voting Power Concentration in DAOs

代币委托中的公平性:缓解DAO中的投票权集中问题

Johnnatan Messias, Ayae Ide

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文研究DAO治理中委托机制的问题,通过分析14个DAO论坛的数据,发现委托常与持有者优先级不一致,提出引入兴趣匹配以缓解权力集中。

详情

展开后加载摘要…

URL PDF HTML 收藏