arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-05-15 至 2026-05-15 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 2 篇

2605.14049 2026-05-15 cs.AI cs.CL cs.CY 67%

Bridging Legal Interpretation and Formal Logic: Faithfulness, Assumption, and the Future of AI Legal Reasoning

弥合法律解释与形式逻辑:忠实性、假设与AI法律推理的未来

Olivia Peiyu Wang, Leilani H. Gilpin

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.CY

AI总结 本文提出一种结合大语言模型与形式验证的神经符号方法,旨在提升AI辅助法律推理的可靠性与可信度,减少人工验证负担。

Comments 2 pages abstract accepted by Bloomberg LSLLAI 2026 Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23912 2026-05-15 cs.CL cs.AI 62%

LoVeC: Reinforcement Learning for Better Verbalized Confidence in Long-Form Generations

LoVeC:强化学习用于长文生成中的更可靠的 verbalized 自信度

Caiqi Zhang, Xiaochen Zhu, Chengzu Li, Nigel Collier, Andreas Vlachos

机构 * University of Cambridge(剑桥大学)

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LoVeC,一种基于强化学习的方法,通过在长文生成过程中实时附加数值自信度评分,提升事实性生成的可靠性。实验表明,该方法在多个长文问答数据集上实现了更好的校准和跨领域泛化能力,且效率显著高于传统自一致性方法。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏