arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-18 至 2026-03-18 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 2 篇

2603.15885 2026-03-18 cs.AI cs.RO 57%

Resilience Meets Autonomy: Governing Embodied AI in Critical Infrastructure

韧性与自主性:在关键基础设施中治理具身体验的人工智能

Puneet Sharma, Christer Henrik Pursiainen

机构 * Department of Automation and Process Engineering (IAP)(自动化与过程工程系) UiT The Arctic University of Norway(北极大学) Department of Technology and Safety (ITS)(技术与安全系)

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI

AI总结 本文探讨关键基础设施中具身体验AI的韧性与自主性治理,提出混合治理架构下的四种监管模式,结合欧盟AI法案和ISO标准,强调机器能力与人类判断的结构化分配。

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16558 2026-03-18 cs.CV cs.MM 50%

Segmentation-Based Attention Entropy: Detecting and Mitigating Object Hallucinations in Large Vision-Language Models

基于分割的注意力熵:在大视觉-语言模型中检测和缓解对象幻觉

Jiale Song, Jiaxin Luo, Xue-song Tang, Kuangrong Hao, Mingbo Zhao

机构 * School of Information and Intelligent Science, Donghua University, Shanghai, 201620, China(信息与智能科学学院,东华大学,上海,201620,中国)

专题命中 幻觉与事实性 :trustworthy(abstract)

AI总结 本文提出基于分割的注意力熵(SAE),通过语义分割量化视觉注意力不确定性,设计可靠性评分和注意力调整方法,有效缓解大视觉-语言模型中的对象幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏