arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Oxford(牛津大学)

2026-05-26 至 2026-05-26 共收录 16
2605.25893 2026-05-26 cs.AI

$D^2$-Monitor: Dynamic Safety Monitoring for Diffusion LLMs via Hesitation-Aware Routing

$D^2$-Monitor: 通过犹豫感知路由实现扩散LLM的动态安全监控

Aoxi Liu, Yupeng Chen, James Oldfield, Guanzhe Hong, Junchi Yu, Baoyuan Wu, Philip Torr, Adel Bibi

机构 * Torr Vision Group, University of Oxford(奥克斯大学托尔视觉组) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 针对扩散大语言模型的安全监控问题,提出基于犹豫感知路由的双层动态监控框架$D^2$-Monitor,通过轻量级探针实时估计犹豫度并触发高容量探针,在3个数据集上以0.85M参数达到最优性能与效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04906 2026-05-26 cs.AI

Strat-Reasoner: Reinforcing Strategic Reasoning of LLMs in Multi-Agent Games

Strat-Reasoner:在多智能体游戏中增强大语言模型的战略推理能力

Yidong He, Yutao Lai, Pengxu Yang, Jiarui Gan, Jiexin Wang, Yi Cai, Mengchen Zhao

机构 * School of Software Engineering, South China University of Technology(华南理工大学软件学院) Department of Computer Science, University of Oxford(牛津大学计算机科学系)

AI总结 提出Strat-Reasoner框架,通过递归推理范式和集中式思维链比较模块,结合混合优势与组相对强化学习,提升大语言模型在多智能体游戏中的战略推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01322 2026-05-26 cs.LG cs.CL

PolySAE: Modeling Feature Interactions in Sparse Autoencoders via Polynomial Decoding

PolySAE: 通过多项式解码建模稀疏自编码器中的特征交互

Panagiotis Koromilas, Andreas D. Demou, James Oldfield, Yannis Panagakis, Mihalis Nicolaou

机构 * The Cyprus Institute(塞浦路斯研究所) University of Athens(雅典大学) University of Oxford(牛津大学) Archimedes AI/Athena Research Center(阿基米德AI/雅典娜研究中心) University of Cyprus(塞浦路斯大学)

AI总结 提出PolySAE,在稀疏自编码器解码器中引入高阶项以建模特征交互,通过低秩张量分解在共享投影子空间上捕获成对和三元特征交互,在保持可解释性的同时提升探测F1约8%,并产生与共现频率无关的组合结构。

Comments 43rd International Conference on Machine Learning (ICML 2026); Code: https://github.com/pakoromilas/PolySAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05865 2026-05-26 cs.LG cs.AI

Intrinsically Interpretable Attention via Sparse Post-Training

通过稀疏后训练实现内在可解释的注意力机制

Florent Draye, Anson Lei, Hsiao-Ru Pan, Ingmar Posner, Bernhard Schölkopf

机构 * MPI-IS(马克斯·普朗克研究所) University of Oxford(牛津大学) ETH Zürich(苏黎世联邦理工学院)

AI总结 提出一种后训练方法,通过约束损失下的灵活稀疏正则化,在不牺牲性能的前提下将Transformer注意力连接稀疏至约0.4%,从而简化全局电路并提升可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21592 2026-05-26 cs.CV cs.AI cs.LG

What Happens Next? Anticipating Future Motion by Generating Point Trajectories

接下来会发生什么?通过生成点轨迹预测未来运动

Gabrijel Boduljak, Laurynas Karazija, Iro Laina, Christian Rupprecht, Andrea Vedaldi

机构 * Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

AI总结 提出一种基于单张图像预测未来运动的方法,通过生成密集轨迹网格来捕捉场景动态和不确定性,相比现有方法更准确多样,并验证其在机器人等下游任务中的有效性。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04639 2026-05-26 cs.CC cs.CL cs.DS cs.LO

Ineffectiveness for Search and Undecidability of PCSP Meta-Problems

PCSP元问题的搜索无效性和不可判定性

Alberto Larrauri

机构 * University of Oxford(牛津大学) Durham University(杜伦大学) University of Zaragoza(阿拉瓦大学)

AI总结 本文研究承诺约束满足问题(PCSP)的搜索版本与决策版本是否等价,证明BLP、AIP等算法在搜索版本中无效,并基于代数方法给出搜索无效的充分条件,进而证明相关元问题的不可判定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24697 2026-05-26 cs.CL cs.AI

The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models

路径很重要:学习扩散语言模型的令牌提交策略

Bohang Sun, Max Zhu, Francesco Caso, Jindong Gu, Junchi Yu, Philip Torr, Pietro Liò, Jialin Yu

机构 * Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学) Department of Engineering Science, University of Oxford(工程科学系,牛津大学)

AI总结 本文提出TraceLock,一种轻量级可插拔控制器,通过学习可复用的轨迹状态策略来优化扩散语言模型中的令牌提交决策,从而改善质量与步数之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24542 2026-05-26 cs.CR cs.AI cs.LG cs.MA cs.SE

AI-Driven Adaptive Adversaries and the Erosion of Cryptographic Trust in Public Key Systems

AI驱动的自适应对手与公钥系统中密码学信任的侵蚀

Petar Radanliev

机构 * Department of Computer Sciences, University of Oxford(牛津大学计算机科学系) The Alan Turing Institute(艾伦·图灵研究所) British Library(大英图书馆)

AI总结 本文研究人工智能驱动的自适应对手如何利用实现层面的可观测性侵蚀公钥密码学的安全性,提出了一种新的安全评估框架。

Journal ref J Anal Sci Technol 17, 26 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24538 2026-05-26 cs.CY cs.AI cs.MA

Is Decentralized AI Governable? From Regulative Policy to Constitutive Protocol

去中心化AI是否可治理?从规制政策到构成性协议

Botao Amber Hu, Helena Rong

机构 * University of Oxford(牛津大学) New York University Shanghai(纽约大学上海校区)

AI总结 本文分析去中心化AI的六层堆栈,揭示其导致的治理真空(责任缺口和无力化缺口),并提出从基于政策的规范性治理转向基于协议的构成性治理,同时确立合法性、可争议性、透明性和非支配性四个伦理条件。

Comments Submitted for Ethics and Information Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26418 2026-05-26 cs.AI

Chain-of-Thought Hijacking

思维链劫持

Jianli Zhao, Tingchen Fu, Rylan Schaeffer, Mrinank Sharma, Fazl Barez

机构 * Independent(独立) University of Oxford(牛津大学) Stanford University(斯坦福大学) Anthropic Martian Core

AI总结 提出思维链劫持攻击,通过诱导大型推理模型进行长时间良性推理来削弱其拒绝有害请求的能力,实现高成功率越狱。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24876 2026-05-26 cs.CV cs.CL

Agent-X: Evaluating Deep Multimodal Reasoning in Vision-Centric Agentic Tasks

Agent-X:评估视觉中心智能体任务中的深度多模态推理

Tajamul Ashraf, Amal Saqib, Hanan Ghani, Muhra AlMahri, Yuhao Li, Noor Ahsan, Umair Nawaz, Jean Lahoud, Hisham Cholakkal, Mubarak Shah, Philip Torr, Fahad Shahbaz Khan, Rao Muhammad Anwer, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) University of Central Florida(中央佛罗里达大学) University of Oxford(牛津大学)

AI总结 提出Agent-X基准,通过828个真实视觉任务和细粒度步骤评估框架,揭示当前模型在多步视觉推理中全链成功率低于50%的瓶颈。

Comments Accepted in International Conference of Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24350 2026-05-26 cs.RO cs.HC

PACT: Proactive Asking for Continual Task Assistance in Human-Robot Collaboration

PACT:人机协作中持续任务辅助的主动询问

Chengbo He, Sheng Li, Chenyang Ma, Bochao Zou, Li Sun, Jiansheng Chen, Junliang Xing, Yuanchun Shi, Huimin Ma

机构 * University of Science and Technology Beijing(北京科技大学) University of Oxford(牛津大学) Tsinghua University(清华大学)

AI总结 提出PACT框架,通过强化学习在部分观测下决定何时主动询问用户以澄清任务,从而在跨日人机协作中逐步提高辅助准确性和澄清效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23978 2026-05-26 cs.LG econ.EM q-fin.ST q-fin.TR

Algometrics: Forecasting Under Algorithmic Feedback

算法度量:算法反馈下的预测

Marc Schmitt

机构 * University of Oxford(牛津大学)

AI总结 提出算法度量框架,研究预测算法影响自身评估数据的反馈机制,证明部署风险不可仅由历史数据识别,并给出估计方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17606 2026-05-26 cs.LG

The Neural Tangent Kernel for Classification

分类问题的神经正切核

Jonathan Plenk, Sergio Calvo-Ordonez, Alvaro Cartea, Yarin Gal, Mark van der Wilk, Kamil Ciosek

机构 * Mathematical Institute, University of Oxford(牛津大学数学研究所) Oxford-Man Institute of Quantitative Finance, University of Oxford(牛津大学量化金融研究所) OATML, University of Oxford(牛津大学OATML研究中心) Department of Computer Science, University of Oxford(牛津大学计算机科学系) Spotify

AI总结 本文通过识别宽神经网络在分类损失下保持懒惰训练的条件,将神经正切核理论扩展到分类问题,并分析了参数正则化对核常数性的影响以及预测器分布与贝叶斯方法的关系。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16075 2026-05-26 math.NA cs.DS cs.LG cs.NA math.OC

Towards Universal Convergence of Backward Error in Linear System Solvers

线性系统求解器中后向误差的通用收敛性

Michał Dereziński, Yuji Nakatsukasa, Elizaveta Rebrova

机构 * University of Michigan(密歇根大学) University of Oxford(牛津大学) Princeton University(普林斯顿大学)

AI总结 本文证明经典Richardson迭代在半正定线性系统上具有与条件数无关的1/k后向误差收敛率,并基于Krylov子空间最小化后向误差提出MINBERR算法,实现O(n^2/√ε)复杂度。

Comments Added convergence analysis of MINBERR-NE for general linear systems (Theorems 5.1 and 5.3)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16091 2026-05-26 cs.MA cs.AI cs.LG

Delayed Assignments in Online Non-Centroid Clustering with Stochastic Arrivals

随机到达的在线非质心聚类中的延迟分配

Saar Cohen

机构 * Bar Ilan University(巴伊兰大学) University of Oxford(牛津大学)

AI总结 针对随机到达模型,提出一种常数竞争比的在线非质心聚类算法,允许延迟分配以平衡聚类距离成本和延迟成本。

Comments To Appear in the 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏