arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

2026-07-28 至 2026-07-28 共收录 3
2603.01227 2026-07-28 cs.AI 版本更新

The Lattice Representation Hypothesis of Large Language Models

大语言模型的晶格表示假说

Bo Xiong

机构 * Stanford University(斯坦福大学)

AI总结 本文提出大语言模型的晶格表示假说,通过嵌入几何将概念层次和逻辑运算统一到线性表示中,实验表明LLM嵌入编码概念晶格及其逻辑结构。

Comments Published at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24411 2026-07-28 cs.AI cs.CL cs.CV cs.HC 版本更新

OS-Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows

OS-Sentinel: 通过现实工作流中的混合验证实现安全增强的移动GUI代理

Qiushi Sun, Mukai Li, Zhoumianze Liu, Zhihui Xie, Fangzhi Xu, Zhangyue Yin, Kanzhi Cheng, Zehao Li, Zichen Ding, Qi Liu, Zhiyong Wu, Zhuosheng Zhang, Ben Kao, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 OS-Sentinel通过结合形式验证器和VLM上下文判断者,提升移动GUI代理的安全性,实验显示在多个指标上优于现有方法。

Comments ACL 2026 (Oral) & Best Paper at AIWILD @ ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24770 2026-07-28 cs.LG 版本更新

Neural Message-Passing on Attention Graphs for Hallucination Detection

基于注意力图的神经消息传递用于幻觉检测

Fabrizio Frasca, Guy Bar-Shalom, Yftah Ziser, Haggai Maron

AI总结 研究大语言模型幻觉检测问题,提出CHARM方法,将其视为图学习任务,通过在属性图上应用图神经网络解决,实验证明该方法优于其他方法,揭示图结构作用,展现跨数据集转移的零样本性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏