arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Oxford(牛津大学)

共收录 1445
2604.11995 2026-05-11 cs.LG

Loss-Driven Bayesian Active Learning

基于损失的贝叶斯主动学习

Zhuoyue Huang, Freddie Bickford Smith, Tom Rainforth

机构 * University of Oxford(牛津大学)

AI总结 本文提出一种基于损失的贝叶斯主动学习方法,通过将损失函数转化为优化目标,提升下游任务的预测性能。实验表明该方法在回归和分类任务中有效降低了测试损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11065 2026-05-11 physics.soc-ph cs.CL hep-th physics.data-an physics.hist-ph

Statistical Patterns in the Equations of Physics and the Emergence of a Meta-Law of Nature

物理学方程中的统计模式与自然法则的涌现

Andrei Constantin, Deaglan Bartlett, Harry Desmond, Pedro G. Ferreira

机构 * School of Mathematics, University of Birmingham, Watson Building, Edgbaston, Birmingham B15 2TT, United Kingdom(伯明翰大学数学学院) Rudolf Peierls Centre for Theoretical Physics, University of Oxford, Parks Road, Oxford OX1 3PU, UK(牛津大学鲁道夫·皮埃尔斯理论物理中心) Institute of Cosmology and Gravitation, University of Portsmouth, Dennis Sciama Building, Portsmouth, PO1 3FX, UK(普敦大学宇宙学与引力研究所) Astrophysics, University of Oxford, DWB, Keble Road, Oxford OX1 3RH, UK(牛津大学天体物理学)

AI总结 研究发现物理方程中数学运算符频率呈指数衰减,揭示了自然法则的统计规律,为符号回归和语言模型生成数学表达式提供新思路。

Comments 11 pages, 5 figures, 2 table

Journal ref Philos Trans A Math Phys Eng Sci (2026) 384 (2317): 20250091

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06667 2026-05-08 cs.CV cs.AI cs.LG

ActCam: Zero-Shot Joint Camera and 3D Motion Control for Video Generation

ActCam: 零样本联合摄像机和3D运动控制用于视频生成

Omar El Khalifi, Thomas Rossi, Oscar Fossey, Thibault Fouque, Ulysse Mizrahi, Philip Torr, Ivan Laptev, Fabio Pizzati, Baptiste Bellot-Gurlet

机构 * University of Oxford(牛津大学)

AI总结 ActCam通过零样本方法实现视频生成中演员动作与摄像机轨迹的联合控制,通过几何一致的条件生成提升摄像机适应性和动作真实性。

Comments SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06660 2026-05-08 cs.LG cs.AI cs.CL

Verifier-Backed Hard Problem Generation for Mathematical Reasoning

基于验证器的数学推理硬问题生成

Yuhang Lai, Jiazhan Feng, Yee Whye Teh, Ning Miao

机构 * Department of Data Science, City University of Hong Kong(香港城市大学数据科学系) Hong Kong Institute of AI for Science, City University of Hong Kong(香港城市大学人工智能科学研究所) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) Department of Statistics, University of Oxford(牛津大学统计系)

AI总结 本文提出VHG框架,通过引入独立验证器约束问题生成器的奖励,提升生成问题的有效性和难度,实验显示其在不定积分和数学推理任务中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06642 2026-05-08 cs.CL cs.AI

StraTA: Incentivizing Agentic Reinforcement Learning with Strategic Trajectory Abstraction

StraTA: 通过战略轨迹抽象激励代理强化学习

Xiangyuan Xue, Yifan Zhou, Zidong Wang, Shengji Tang, Philip Torr, Wanli Ouyang, Lei Bai, Zhenfei Yin

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Georgia(佐治亚大学) University of Oxford(牛津大学) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 本文提出StraTA框架,通过引入显式的轨迹级策略提升代理强化学习的样本效率和最终性能,实验显示其在ALFWorld、WebShop和SciWorld上均优于基线模型。

Comments 26 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06342 2026-05-08 cs.CL

Don't Lose Focus: Activation Steering via Key-Orthogonal Projections

不要失去焦点:通过键正交投影进行激活引导

Haoyan Luo, Mateo Espinosa Zarlenga, Mateja Jamnik

机构 * University of Cambridge(剑桥大学) University of Oxford(牛津大学)

AI总结 本文提出SKOP方法,通过约束有害的注意力重路由,减少激活引导对推理和检索性能的负面影响,实现最佳的引导-实用性平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06308 2026-05-08 cs.AI

Measuring Black-Box Confidence via Reasoning Trajectories: Geometry, Coverage, and Verbalization

通过推理轨迹测量黑盒置信度:几何、覆盖度与 verbalization

Marc Boubnovski Martell, Josefa Lia Stoisser, Kaspar Märtens, Jialin Yu, Robert Kitchen, Philip Torr, Jesper Ferkinghoff-Borg

机构 * Novo Nordisk(诺华北欧) University of Oxford(牛津大学)

AI总结 本文提出一种通过推理轨迹测量黑盒置信度的方法,结合几何、覆盖度和 verbalization 通道,在多个基准测试中提升了置信度估计的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06053 2026-05-08 cs.LG

Towards Generation-Efficient Uncertainty Estimation in Large Language Models

向大型语言模型的生成效率不确定性估计

Mingcheng Zhu, Yu Liu, Tingting Zhu

机构 * University of Oxford(牛津大学)

AI总结 本文提出通过部分生成或仅输入信息实现高效不确定性估计,提出Logit Magnitude和MetaUE方法,在通用和领域基准上验证了部分生成的有效性。

Comments 21 pages, 6 figures, and 8 tables. The abstract provided in the metadata differs slightly from the manuscript version due to character limits

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24909 2026-05-08 cs.LG cs.CE

Contrastive Image-Metadata Pre-Training for Materials Transmission Electron Microscopy

对比图像-元数据预训练用于材料透射电子显微镜

Georgia Channing, Debora Keller, Marta D. Rossell, Philip Torr, Stig Helveg, Henrik Eliasson

机构 * Hugging Face University of Oxford(牛津大学) Empa Dübendorf(Empa杜宾根) Technical University of Denmark(丹麦技术大学)

AI总结 本文提出CIMP模型,通过对比图像与元数据实现对低剂量图像的去噪,实验表明其在去噪效果上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01192 2026-05-08 stat.ML cs.LG

A Basin-Selection Perspective on Grokking via Singular Learning Theory

从奇异学习理论的角度看通过奇异学习理论实现的grokking现象

Ben Cullen, Sergio Estan-Ruiz, Riya Danait, Jiayi Li

机构 * Department of Computer Science(计算机科学系) Department of Mathematics(数学系) Mathematical Institute(数学研究所) University of Pisa(比萨大学) Imperial College London(伦敦帝国学院) University of Oxford(牛津大学) Section of Mathematics and Artificial Intelligence(数学与人工智能系) Max Planck Institute of Molecular Cell Biology and Genetics(马克斯·普朗克分子细胞生物学和遗传学研究所) Center for Systems Biology(系统生物学中心) Faculty of Mathematics(数学系) TU Dresden(德累斯顿技术大学)

AI总结 本文从奇异学习理论的角度研究grokking现象,通过分析损失景观的几何特性,探讨了记忆到泛化过渡的机制,并推导了浅层二次网络中局部学习系数的解析公式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22891 2026-05-08 cs.LG

PlatoLTL: Learning to Generalize Across Symbols in LTL Instructions for Multi-Task RL

PlatoLTL: 在多任务强化学习中实现跨符号的泛化学习

Jacques Cloete, Mathias Jackermeier, Ioannis Havoutis, Alessandro Abate

机构 * Oxford Robotics Institute(牛津机器人研究所) Department of Computer Science(计算机科学系) University of Oxford(牛津大学)

AI总结 PlatoLTL通过参数化命题和嵌入结构,实现多任务强化学习中跨LTL结构和命题的零样本泛化,提升任务适应能力。

Comments 14 pages, 4 figures (main paper). 22 pages, 11 figures (appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09125 2026-05-08 cs.AI cs.DB cs.LO

Goal-Driven Query Answering over First- and Second-Order Dependencies with Equality

面向第一和第二阶依赖及等式的目标驱动查询回答

Efthymia Tsamoura, Boris Motik

机构 * Huawei Labs(华为实验室) Department of Computer Science, Oxford University(牛津大学计算机科学系)

AI总结 本文提出了一种针对第一和第二阶依赖及等式的首个目标驱动查询回答技术,通过转换输入依赖以避免无关推断,提高了查询效率。

Comments 47 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07985 2026-05-08 cs.AI cs.LG

Games for AI Control: Models of Safety Evaluations of AI Deployment Protocols

用于AI控制的游戏:AI部署协议安全评估模型

Charlie Griffin, Louis Thomson, Buck Shlegeris, Alessandro Abate

机构 * University of Oxford(牛津大学) Redwood Research(红木研究)

AI总结 本文提出AI-Control Games模型,用于评估不信任AI部署协议的安全性,通过多目标部分可观测随机博弈框架,改进协议设计并分析安全影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05382 2026-05-08 math.OC cs.LG

Meta-learning for sample-efficient Bayesian optimisation of fed-batch processes

为Fed-batch过程的样本高效贝叶斯优化设计元学习

Becky Langdon, Gabriel D. Patrón, Chrysoula D. Kappatou, Robert M. Lee, Behrang Shafei, Jixiang Qing, Ruth Misener, Mark van der Wilk, Calvin Tsay

机构 * Department of Computing, Imperial College London, United Kingdom(帝国理工学院伦敦分校计算机系) BASF SE, Ludwigshafen, Germany(巴斯夫股份有限公司,德国路德维希沙芬) School of Mathematical Sciences, Lancaster University, United Kingdom(兰卡斯特大学数学科学学院) Department of Computer Science, University of Oxford, United Kingdom(牛津大学计算机科学系)

AI总结 本文提出System-Aware Neural ODE Processes作为元学习模型,提升贝叶斯优化在低数据场景下的优化性能,通过青霉素批生产案例验证其在不同分布批次中的泛化能力。

Comments 24 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05227 2026-05-08 cs.LG cs.AI

Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods

重新思考大语言模型训练中的数据整理:在线重加权优于离线方法

Wanru Zhao, Yihong Chen, Yuzhi Tang, Wentao Ma, Shengchao Hu, Shell Xu Hu, Alex Iacob, Abhinav Mehrotra, Nicholas D. Lane

机构 * University of Cambridge(剑桥大学) OATML, University of Oxford(牛津大学OATML实验室) University of Toronto(多伦多大学) Shanghai Jiao Tong University(上海交通大学) Samsung AI Center(三星人工智能中心)

AI总结 本文提出ADAPT框架,通过动态在线重加权提升模型泛化能力,实验显示其在指令微调和大规模预训练中优于传统离线方法。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17573 2026-05-08 cs.AI

Beyond Static Snapshots: A Grounded Evaluation Framework for Language Models at the Agentic Frontier

超越静态快照:语言模型在代理前沿的 grounded 评估框架

Jazmia Henry

机构 * University of Oxford(牛津大学)

AI总结 本文提出 grounded continuous evaluation 框架,通过 deterministic verifier 和 CPU 更新 LoRA adapters,解决 reward hacking 和硬件限制问题,并在多个架构和领域验证其有效性。

Comments Submitted for consideration to NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14337 2026-05-08 cs.CV

On the Nature of Attention Sink that Shapes Decoding Strategy in Omni-LLMs

关于塑造 Omni-LLMs 解码策略的注意力 sink 性质

Suho Yoo, Youngjoon Jang, Joon Son Chung

机构 * KAIST(韩国科学技术院) VGG, University of Oxford(牛津大学视觉感知实验室)

AI总结 本文研究 Omni-LLMs 中注意力 sink 的行为,发现其不仅反映头部冗余,还承担额外功能,提出 OutRo 方法通过特征空间对齐和放松因果掩码提升解码性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13281 2026-05-08 cs.CV

VideoASMR-Bench: Can AI-Generated ASMR Videos Fool VLMs and Humans?

VideoASMR-Bench: AI生成的ASMR视频能否欺骗视觉语言模型和人类?

Jiaqi Wang, Weijia Wu, Yi Zhan, Rui Zhao, Ming Hu, James Cheng, Wei Liu, Philip Torr, Kevin Qinghong Lin

机构 * The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学) Peking University(北京大学) Monash University(墨尔本大学) Video Rebirth University of Oxford(牛津大学)

AI总结 VideoASMR-Bench通过细粒度音频视觉感知和感官沉浸性评估AI生成ASMR视频的检测能力,揭示了当前VLMs在识别AI生成ASMR视频上的不足以及VGMs生成逼真ASMR视频的能力。

Comments Code is at https://github.com/video-reality-test/video-reality-test, page is at https://video-reality-test.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10443 2026-05-08 cs.SE cs.AI

Are Large Language Models Robust in Understanding Code Against Semantics-Preserving Mutations?

大型语言模型在语义保持变异下的理解鲁棒性如何?

Pedro Orvalho, Marta Kwiatkowska

机构 * Department of Computer Science University of Oxford(计算机科学系牛津大学)

AI总结 本文评估了大型语言模型在Python程序上的推理能力,通过五种语义保持的代码变异测试,发现模型在语义变换下表现出显著的脆弱性,正确预测基于 flawed reasoning 的比例在10%-50%之间,且预测稳定性差。

Comments 17 pages, 5 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01339 2026-05-05 cs.LG

Robust Parameter Learning for Uncertain MDPs

不确定马尔可夫决策过程的鲁棒参数学习

Yannik Schnitzer, Alessandro Abate, David Parker

机构 * University of Oxford(牛津大学)

AI总结 本文提出通过参数马尔可夫决策过程(pMDPs)学习不确定MDPs,利用统计不确定性将经验转移频率投影到参数空间,生成更精确的PAC不确定性模型,通过多级多边形外近似解决算法挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18058 2026-05-05 cs.LG

Sonata: A Hybrid World Model for Inertial Kinematics under Clinical Data Scarcity

Sonata:一种用于临床数据稀缺情况下的六轴躯干IMU表示学习的混合世界模型

Blaise Delaney, Salil Patel, Yuji Xing, Dominic Dootson, Karin Sevegnani, Chrystalina Antoniades

机构 * TimeTrace Labs(TimeTrace实验室) NVIDIA University of Oxford(牛津大学)

AI总结 Sonata在临床数据稀缺情况下,通过混合世界模型实现了六轴躯干IMU的高效表示学习,具有更强的临床判别能力、前瞻性跌倒风险预测和跨群体迁移能力。

Comments 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25020 2026-05-05 cs.LG

Deep Thinking by Markov Chain of Continuous Thoughts

基于连续思维的马尔可夫链深度思考

Jiayu Liu, Zhenya Huang, Xuan Yang, Tianyun Ji, Anya Sims, Hao Xu, Enhong Chen, Yee Whye Teh, Ning Miao

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学) Department of Statistics, University of Oxford(牛津大学统计系) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系) Hong Kong Institute of AI for Science, City University of Hong Kong(香港人工智能科学研究院,香港城市大学)

AI总结 本文提出MarCos模型,通过连续表示实现多步推理,提升数学任务处理速度,实现并行思维。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28980 2026-05-04 cs.CV

Stepper: Stepwise Immersive Scene Generation with Multiview Panoramas

Stepper:基于多视角全景图的分步沉浸式场景生成

Felix Wimbauer, Fabian Manhardt, Michael Oechsle, Nikolai Kalischek, Christian Rupprecht, Daniel Cremers, Federico Tombari

机构 * Google(谷歌) University of Oxford(牛津大学) MCML Technical University of Munich(慕尼黑技术大学)

AI总结 Stepper通过分步扩展多视角全景图,解决传统方法在视觉保真度与可探索性之间的权衡问题,实现高质量沉浸式3D场景生成。

Comments Accepted at CVPR 2026 Findings; Find our project page under https://fwmb.github.io/stepper/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00080 2026-05-04 cs.RO cs.CV

World Model for Robot Learning: A Comprehensive Survey

机器人学习的世界模型:全面综述

Bohan Hou, Gen Li, Jindou Jia, Tuo An, Xinying Guo, Sicong Leng, Haoran Geng, Yanjie Ze, Tatsuya Harada, Philip Torr, Oier Mees, Marc Pollefeys, Zhuang Liu, Jiajun Wu, Pieter Abbeel, Jitendra Malik, Yilun Du, Jianfei Yang

机构 * Nanyang Technological University(南洋理工大学) University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) The University of Tokyo(东京大学) University of Oxford(牛津大学) Microsoft(微软公司) ETH Zurich(苏黎世联邦理工学院) Princeton University(普林斯顿大学) Harvard University(哈佛大学)

AI总结 综述从机器人学习角度系统回顾世界模型的快速发展,探讨其与机器人策略的耦合、作为强化学习模拟器的作用以及机器人视频世界模型的发展,总结关键范式与挑战。

Comments 43 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22082 2026-05-04 cs.LG cs.AI

Removing Sandbagging in LLMs by Training with Weak Supervision

通过弱监督训练消除大模型中的虚报行为

Emil Ryd, Henning Bartsch, Julian Stastny, Joe Benton, Vivek Hebbar

机构 * University of Oxford(牛津大学) Redwood Research(红木研究)

AI总结 研究通过结合监督微调与强化学习,发现弱监督训练能有效消除模型虚报行为,但需确保训练与部署不可区分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07669 2026-05-04 cs.LG cs.AI cs.CE

Reinforcement Learning with LLM-Guided Action Spaces for Synthesizable Lead Optimization

基于LLM引导的动作空间的强化学习用于可合成先导优化

Tao Li, Kaiyuan Hou, Tuan Vinh, Monika Raj, Zhichun Guo, Carl Yang

机构 * Emory University(埃默里大学) University of Oxford(牛津大学) Independent Researcher(独立研究者)

AI总结 本文提出MolReAct框架,通过合成约束的动作空间和GRPO算法优化先导分子,提升性质同时保证合成可行性,实现高效分子生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13511 2026-05-04 cs.CV cs.IR

Adapting MLLMs for Nuanced Video Retrieval

为精细化视频检索适应大语言模型

Piyush Bagad, Andrew Zisserman

机构 * Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

AI总结 本文提出一种统一嵌入模型,通过对比损失微调文本训练的多模态大语言模型,以处理视频检索中的时间、否定和多模态细微差别,实现最先进的检索性能。

Comments 38 Pages. Project page at http://bpiyush.github.io/tara-website

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02277 2026-05-01 cs.LG cs.AI

Junk DNA Hypothesis: Pruning Small Pre-Trained Weights Irreversibly and Monotonically Impairs "Difficult" Downstream Tasks in LLMs

垃圾DNA假说:修剪小的预训练权重不可逆且单调地损害LLM中的“困难”下游任务

Lu Yin, Ajay Jaiswal, Shiwei Liu, Souvik Kundu, Zhangyang Wang

机构 * University of Surrey Eindhoven University of Technology University of Texas at Austin Intel Labs University of Oxford

AI总结 该研究提出垃圾DNA假说,指出LLM预训练权重中存在关键知识,修剪小权重会单调损害困难下游任务性能,且即使允许持续训练也无法弥补损失。

Comments Published at ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27150 2026-05-01 cs.AI

Optimal Stop-Loss and Take-Profit Parameterization for Autonomous Trading Agent Swarm

自主交易代理群的最优止损和止盈参数设置

Nathan Li, Aikins Laryea, Yigit Ihlamur

机构 * University of Oxford(牛津大学) Vela Research(Vela研究)

AI总结 本文研究了优化止损和止盈参数对自主交易代理群性能的影响,通过历史交易数据验证了退出策略设计的重要性,并讨论了评估中的挑战。

Comments 4 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22228 2026-05-01 cs.CV cs.AI cs.CL

Lost in Space? Vision-Language Models Struggle with Relative Camera Pose Estimation

迷失在空间中?视觉-语言模型在相对相机姿态估计中挣扎

Ken Deng, Yifu Qiu, Yoni Kasten, Shay B. Cohen, Yftah Ziser

机构 * University of Edinburgh(爱丁堡大学) University of Oxford(牛津大学) NVIDIA Research(NVIDIA研究) University of Groningen(格罗宁根大学)

AI总结 研究视觉-语言模型在相对相机姿态估计中的表现,发现其在多视角空间推理中存在显著不足,尽管人类和专用几何方法表现良好,但VLMs仍处于初级水平,揭示了跨视角对应和投影相机运动理解等关键能力缺失。

详情

展开后加载摘要…

URL PDF HTML 收藏