arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-07-10 至 2026-07-10 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 2 篇

2607.07760 2026-07-10 cs.AI cs.SI 新提交 57%

Adversarial Social Epistemology for Assemblies of Humans and Large Language Models

人类与大语言模型集合的对抗性社会认识论

Mihnea C. Moldoveanu, Joel A. C. Baum

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI

AI总结 研究人类与大语言模型集合在密集互动交流场景中的信息问题,提出对抗性社会认识论,借助语言、机制及基于认知网络的 machinery 来分析、破坏信任并审计纠正信任违规。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04728 2026-07-10 cs.HC 50%

A Multi-Agent Framework for Democratizing XR Content Creation in K-12 Classrooms

面向K-12教室的多智能体框架:民主化XR内容创作

Yuan Chang, Zhu Li, Jiaming Qu

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出多智能体XR创作框架,通过四个专业代理解决K-12教育中XR内容创作的技术障碍和生成AI的幻觉风险,实现教育内容的安全生成与教学增强。

详情

展开后加载摘要…

URL PDF HTML 收藏