Copewell: A Multi-Agent Swarm Architecture for Equitable Mental Wellness Support
Copewell: 一种用于公平心理健康支持的多智能体群体架构
机构 * Copewell
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
AI总结 提出Copewell多智能体群体系统,通过多源评估、情感映射和双模式干预,扩大心理健康支持的可及性,并融入隐私优先和伦理监督设计。
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
Copewell: 一种用于公平心理健康支持的多智能体群体架构
机构 * Copewell
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
AI总结 提出Copewell多智能体群体系统,通过多源评估、情感映射和双模式干预,扩大心理健康支持的可及性,并融入隐私优先和伦理监督设计。
AgentBound: 自主AI智能体的可验证行为治理
机构 * eBay Inc.(eBay公司)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
AI总结 提出AgentBound框架,通过委托授权、行为宪法和站点行动合同三权独立评估,结合形式化决策模型实现AI智能体行为的可验证治理,并生成加密可验证的治理收据以支持独立重放验证。
一种实用的AI事件监控分类框架
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
AI总结 本文提出一种分类框架,用于分析AI事件随时间变化的趋势,通过结构化问题、分层估计过程和分类方案,提升AI治理的实用性。
前沿AI开发者应披露关于内部部署的哪些信息?
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
AI总结 本文探讨前沿AI开发者在内部部署高能力模型时应披露的信息,提出四个类别:能力、使用、安全措施和治理,并分析披露的利弊及风险缓解方法。
Comments 13 pages, 1 table. Accepted at Second Workshop on Technical AI Governance Research (TAIGR) at ICML 2026
CoPersona: 面向鲁棒LLM个性化的协作人格图
专题命中 AI治理与伦理 :alignment(abstract)
AI总结 针对用户历史稀疏和偏差导致的个性化脆弱问题,提出CoPersona框架,通过多面人格图从行为相似用户中借调信号,结合非参数检索与参数图推理的双分支架构,在多个领域和模型规模上超越强基线。
Comments Accepted at KDD '26. 12 pages, 5 figures, 8 tables