arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Oxford(牛津大学)

2026-07-07 至 2026-07-07 共收录 23
2605.05207 2026-07-07 cs.CV 版本更新

Syn4D: A Multiview Synthetic 4D Dataset

Syn4D:多视图合成4D数据集

Zeren Jiang, Yushi Lan, Yihang Luo, Yufan Deng, Zihang Lai, Edgar Sucar, Christian Rupprecht, Iro Laina, Diane Larlus, Chuanxia Zheng, Andrea Vedaldi

机构 * VGG University of Oxford(牛津大学) Nanyang Technological University(南洋理工大学) Naver Labs Europe(Naver欧洲实验室)

AI总结 针对动态场景稠密3D重建跟踪缺高质量标注数据集的问题,构建含多类真值标注的Syn4D数据集,支撑多下游任务,助力相关研究。

Comments 33 pages, 11 figures, project page: https://jzr99.github.io/Syn4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05392 2026-07-07 cs.CV 新提交

SynCity 3000: Bootstrapping Scene-Scale 3D Diffusion

SynCity 3000:引导式构建场景级3D扩散模型

Paul Engstler, Iro Laina, Christian Rupprecht, Andrea Vedaldi

机构 * Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

AI总结 针对3D场景训练数据稀缺问题,该框架将图像转3D生成器改造为卷积算子,依托新合成数据引擎微调,可生成全局连贯、支持细粒度布局控制的任意规模3D场景。

Comments Project Page: https://research.paulengstler.com/syncity-3k/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05230 2026-07-07 cs.LG 新提交

Video-based detection of cessation of breathing in pre-term infants using machine learning

基于机器学习的早产儿呼吸暂停视频检测方法研究

Dineo Serame, Lionel Tarassenko, Mauricio Villarroel

机构 * Institute of Biomedical Engineering, Department of Engineering Science, University of Oxford(牛津大学工程科学系生物医学工程研究所)

AI总结 针对NICU接触式呼吸监测易受干扰的问题,该研究用ResNet从视频提取胸壁运动信号检测呼吸暂停,融合常规生理信号将平衡准确率提至90.6%,提升了监测鲁棒性。

Comments Paper submitted to Computer Methods and Programs in Biomedicine (CMPB)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05090 2026-07-07 cs.CV 新提交

Be Indiscrete: The Benefits of Learning Continuous Spine Degeneration Severity Scores

保持离散:学习连续脊柱退变严重程度评分的益处

Maria Monzon, Andrew Zisserman, Robin Y. Park, Catherine R. Jutzeler, Amir Jamaludin

机构 * Biomedical Data Science Lab, Dept. D-HEST, ETH Zurich(生物医学数据科学实验室,D-HEST系,苏黎世联邦理工学院) Swiss Institute of Bioinformatics (SIB)(瑞士生物信息学研究所) Visual Geometry Group, Dept. of Engineering Science, University of Oxford(视觉几何组,工程科学系,牛津大学)

AI总结 研究将脊柱退变建模为连续严重程度排序问题,介绍SpineRankNet框架从腰椎MRI学习标量严重程度分数,与多类分类和序数回归对比,表明排序损失训练的模型可实现MRI扫描细粒度排序,分数能恢复分级且提升类间区分度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04846 2026-07-07 cs.LG cs.AI 新提交

Pretraining Curricula Enable Selective Fine-tuning

预训练课程实现选择性微调

Sebastian A. Bruijns, Jirko Rubruck, Mia H. Whitefield, Kai J. Sandbrink, Fazl Barez, Christopher Summerfield

机构 * University of Oxford(牛津大学)

AI总结 研究预训练课程如何影响学习、泛化和微调选择性,对比平衡与不平衡预训练方式,发现不平衡预训练促进上下文学习并提高拒绝微调选择性,还扩展到合成语言学习任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04820 2026-07-07 cs.LG 新提交

KinEMbed: Decoding Kinematics from Electromyography via Cross-Modal Contrastive Learning

KinEMbed:通过跨模态对比学习从肌电图中解码运动学

Sofia Gilardini, Chenfei Ma, Kianoush Nazarpour

机构 * Department of Statistics, University of Oxford(牛津大学统计学系) School of Informatics, University of Edinburgh(爱丁堡大学信息学院)

AI总结 研究从表面肌电图解码手部运动学这一挑战,提出跨模态对比学习框架KinEMbed训练双编码器,用于手部运动学回归,在NinaPro DB8数据集上优于基线方法。

Comments ICML 2026 Workshop on Structured Data for Health, Seoul, South Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04518 2026-07-07 cs.CV 新提交

A non-invasive video-based method for individual identification of wildlife using gait dynamics

一种基于视频的非侵入性野生动物个体识别方法:利用步态动力学

Muhammad Aamir, Matthew Wijers, Sangyun Shin, Andrew Loveridge, Andrew Markham

机构 * Department of Computer Science, University of Oxford(牛津大学计算机科学系) Wildlife Conservation Research Unit, Department of Biology, University of Oxford(牛津大学生物系野生动物保护研究组)

AI总结 研究针对野生动物个体识别难题,提出基于视频的全自动方法。用深度时空表征学习,结合SAM3、ResNet18和VideoPrism模型,经微调提取特征,以余弦相似度比较步态特征实现识别,多物种实验验证了方法有效性。

Comments This article is under review in "Methods in Ecology and Evalution"

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04293 2026-07-07 cs.CL cs.AI cs.LG stat.ML 新提交

CausalGame: Benchmarking Causal Thinking of LLM Agents in Games

因果游戏:在游戏中对大语言模型智能体的因果思维进行基准测试

Zhenhao Chen, Yongqiang Chen, Chenxi Liu, Junchi Yu, Xiangchen Song, Zijian Li, Jialin Li, Philip Torr, Bo Han, Kun Zhang

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Carnegie Mellon University(卡内基梅隆大学) Hong Kong Baptist University(香港浸会大学) University of Oxford(牛津大学) New York University, Abu Dhabi(纽约大学阿布扎比分校)

AI总结 研究旨在通过因果游戏基准测试大语言模型智能体的因果思维能力,让智能体设计实验、收集数据并给出解决方案。设计含多种挑战的场景,发现当前智能体因果思维能力欠佳,为评估提供了测试平台。

Comments Zhenhao, Yongqiang, and Chenxi contributed equally to the project. A short version is accepted at the Forty-Third International Conference on Machine Learning (ICML) 2026 as an Oral presentation. Project website https://causalgame.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03426 2026-07-07 cs.LG cs.AI 新提交

Amortising Bayesian Experimental Design for Sequential Information Gathering in LLMs

用于大语言模型中顺序信息收集的摊销贝叶斯实验设计

Jakob Hartmann, James Harvey, Jhonathan Navott, Erik Y. Wang, Luckeciano C. Melo, Flaviu Cipcigan, Cheng Zhang, Alessandro Abate

机构 * University of Oxford(牛津大学) Ellison Institute of Technology(埃里森理工学院)

AI总结 研究大语言模型在顺序决策中信息收集问题,提出摊销顺序信息收集方法,将贝叶斯实验设计融入模型策略,经实验验证该方法能有效提升成功率并降低推理成本。

Comments 20 pages, 7 figures. Accepted to FoGen 2026: Foundations of Deep Generative Models: Understanding Memorization, Generalization, and Reasoning, an ICML 2026 workshop (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02799 2026-07-07 cs.CV 新提交

Conversational Human Audio-visual Talking Dialogue Generation

对话式人类视听对话生成

Junhao Song, Lluis Guasch, Xilin He, Zhongyu Yang, Yingfang Yuan, Weicheng Xie, Linlin Shen, Haijun Lin, Shizhe Liu, Wei Pang, Siyang Song

机构 * Department of Computing, Imperial College London(伦敦帝国理工学院计算系) Department of Earth Science & Engineering, Imperial College London(伦敦帝国理工学院地球科学与工程系) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Department of Computer Science, Heriot-Watt University(赫瑞瓦特大学计算机科学系) School of Computer Science, Northumbria University(诺森比亚大学计算机科学学院) College of Computer Science & Software Engineering, Shenzhen University(深圳大学计算机科学与软件学院) School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院) Guangdong Provincial Key Laboratory of Intelligent Information Processing, Shenzhen University(深圳大学广东省智能信息处理重点实验室) School of Engineering and Design, Hunan Normal University(湖南师范大学工程与设计学院) Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Computer Science, University of Exeter(埃克塞特大学计算机科学系)

AI总结 提出CHAT框架,统一大语言模型和说话人脸模型,通过交互音频和面部行为细化模块,从单一文本提示生成多样、配对且相互响应的语音-面部对话片段,优于现有方法,合成数据集可作预训练数据。

Comments Accepted to ECCV 2026 as a main paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02711 2026-07-07 cs.CV 新提交

RayTun3R: Online Camera Adaptation in 3D Foundation Models

RayTun3R:3D基础模型中的在线相机适配

Daniil Sinitsyn, Nikita Araslanov, Daniel Cremers

机构 * TU Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Oxford(牛津大学)

AI总结 研究3D基础模型在鱼眼相机下表现不佳的问题,提出RayTun3R方法,通过学习参数高效的残差校正等,在保持预训练网络不变的情况下适配相机,减少旋转误差且参数少、无需多视图推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02692 2026-07-07 cs.CV 新提交

An Automated Multimodal Glaucoma Detection Framework Using ViT and a Stacking-Based Ensemble

使用ViT和基于堆叠的集成方法的自动多模态青光眼检测框架

Ishrat Jahan, Muhammad E. H Chowdhury, Murugappan Murugappan, Kanchon Kanti Podder, Tawsifur Rahman, Shrestha Datta, Md Sakib Abrar Hossain, Md Mosarrof Hossen, Yosra Magdi Salih Mekki, Sanjiban Sekhar Roy

机构 * Department of Computer Science and Engineering, Shahjalal University of Science and Technology(肖哈尔大学科学与技术学院计算机科学与工程系) Department of Electrical Engineering, Qatar University(卡塔尔大学电气工程系) Department of Electronics and Communication Engineering, Kuwait College of Science and Technology(科威特科学与技术学院电子与通信工程系) Department of Interdisciplinary Engineering, Kennesaw State University(肯尼斯州立大学跨学科工程系) Department of Biomedical Engineering, School of Medicine, Johns Hopkins University(约翰霍普金斯大学医学院生物医学工程系) Department of Biomedical Engineering, University of Oxford(牛津大学生物医学工程系) Department of Computer Science and Engineering, Vellore Institute of Technology(维洛雷理工学院计算机科学与工程系)

AI总结 研究在样本级和患者级设置下的青光眼检测,提出整合眼底图像与临床数据的自动多模态框架,用ViT提取特征,经典机器学习模型分类,堆叠集成优化性能,实验验证其高性能并部署为网络平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02539 2026-07-07 cs.SI cs.CL cs.LG 新提交

Beyond Satisfaction: Learning Associations Between Content, Reviews, and Well-Being

超越满意度:学习内容、评论与幸福感之间的关联

Aaron Marker, Joel Lehman, H. Andrew Schwartz

机构 * Vanderbilt University(范德比大学) University of Oxford(牛津大学) Cosmos Institute(宇宙研究所)

AI总结 研究常用满意度信号能否反映幸福感及何种内容与不同幸福感结果相关,以书籍消费为对象,发现评分等与幸福感关联松散,特定主题与不同幸福感相关,为内容推荐系统提供新目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30169 2026-07-07 cs.CY cs.AI cs.MA 版本更新

Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms

分离性身份:语言模型代理缺乏声誉机制的基础

Botao Amber Hu, Helena Rong, Max Van Kleek

机构 * University of Oxford(牛津大学) New York University Shanghai(纽约大学上海分校)

AI总结 本文指出语言模型代理因本体上的分离性(模块可替换、身份流动)而无法满足声誉机制所需的身份持续性、行为可预测性和制裁敏感性,从而提出转向基于可观察性、事前、构成性、协议的行为约束。

Comments Accepted by FaccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29563 2026-07-07 cs.AI cs.CV cs.RO 版本更新

Planning with the Views

通过场景自我探索进行视图规划

Kangrui Wang, Linjie Li, Zhengyuan Yang, Shiqi Chen, Zihan Wang, Li Fei-Fei, Jiajun Wu, Leonidas Guibas, Lijuan Wang, Manling Li

机构 * Northwestern University(西北大学) University of Washington(华盛顿大学) Microsoft(微软) University of Oxford(牛津大学) Stanford University(斯坦福大学)

AI总结 提出ViewSuite基准测试揭示VLM在多步视图规划中的不足,并设计迭代框架通过自我探索和视图图蒸馏将Qwen2.5-VL-7B的交互式视图规划准确率从2.5%提升至47.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06358 2026-07-07 cs.CL cs.AI 版本更新

SHINE: A Scalable In-Context Hypernetwork for Mapping Context to LoRA in a Single Pass

SHINE:一种可扩展的上下文超网络,用于在单次传递中将上下文映射到LoRA

Yewei Liu, Xiyuan Wang, Yansheng Mao, Yoav Gelbery, Haggai Maron, Muhan Zhang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Technion, NVIDIA(技术学院与NVIDIA) University of Oxford(牛津大学) School of Electronics Engineering(电子工程学院) Computer Science, Peking University(计算机科学,北京大学)

AI总结 本文提出SHINE,一种可扩展的上下文超网络,用于在单次传递中将多样且有意义的上下文映射到高质量的LoRA适配器,通过重用冻结LLM的自身参数和引入架构创新,克服了先前超网络的关键限制,以较少的参数实现了强大的表达能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03553 2026-07-07 cs.AI cs.CL cs.DL 版本更新

Chronos: The AI Co-Historian

迈向AI历史学家:从原始资料中进行代理信息提取

Lorenz Hufe, Niclas Griesshaber, Gavin Greif, Sebastian Oliver Eck, Philip Torr

机构 * Torr Vision Group, Department of Engineering Science, University of Oxford(牛津大学工程科学系托尔视觉组) Oxford Centre for Economic and Social History, University of Oxford(牛津大学牛津经济与社会史中心) Faculty of Music, University of Oxford(牛津大学音乐学院) Fraunhofer HHI(弗劳恩霍夫海因里希·赫兹研究所)

AI总结 本文介绍Chronos项目首个模块,通过自然语言交互将历史文献图像转化为数据,允许历史学家自定义流程、评估模型性能并迭代优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03695 2026-07-07 cs.RO 版本更新

TreeLoc++: Robust 6-DoF LiDAR Localization in Forests with a Compact Digital Forest Inventory

TreeLoc++:利用紧凑数字森林清单在森林中进行稳健的6自由度激光雷达定位

Minwoo Jung, Dongjae Lee, Nived Chebrolu, Haedam Oh, Maurice Fallon, Ayoung Kim

机构 * Department of Mechanical Engineering, Seoul National University, Seoul, South Korea(首尔国立大学机械工程系,韩国首尔) Department of Computer Science and Engineering, Indian Institute of Technology Bombay, India(印度班加罗尔印度理工学院计算机科学与工程系) Oxford Robotics Institute, Department of Engineering Science, University of Oxford, Oxford, UK(牛津大学奥克斯福德机器人研究所,英国牛津)

AI总结 研究提出TreeLoc++框架,直接基于数字森林清单定位,以紧凑几何属性编码树干。通过距离直方图等减少误匹配,优化估计姿态,不依赖密集点云数据,实现厘米级精度定位,具长期部署扩展性。

Comments 30 pages, 33 figures and 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22999 2026-07-07 stat.ML cs.AI cs.LG 版本更新

JADAI: Jointly Amortizing Adaptive Design and Bayesian Inference

JADAI:联合摊销自适应设计与贝叶斯推理

Niels Bracher, Lars Kühmichel, Desi R. Ivanova, Xavier Intes, Paul-Christian Bürkner, Stefan T. Radev

机构 * Rensselaer Polytechnic Institute(伦斯勒理工学院) TU Dortmund University(多特蒙德技术大学) University of Oxford(牛津大学)

AI总结 针对设计变量可优化以最大化信息增益的参数估计问题,引入JADAI框架,通过端到端训练策略、历史网络和推理网络联合摊销贝叶斯自适应设计与推理,在标准基准测试中性能优越。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14991 2026-07-07 cs.LG math.OC q-fin.PM 版本更新

Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes

用于扩散过程随机控制的自适应划分与学习

Hanqing Jin, Renyuan Xu, Yanzhao Yang

机构 * Mathematical Institute, University of Oxford(牛津大学数学研究所) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)

AI总结 研究无界连续状态空间等设定下扩散过程的强化学习,引入基于模型算法自适应划分联合状态-动作空间,平衡探索与近似,分析得出依赖多因素的遗憾界并验证方法有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07403 2026-07-07 cs.CV cs.AI cs.CL cs.LG 版本更新

SpatialThinker: Reinforcing Scene Graph-Grounded Spatial Reasoning via Dense Rewards

空间思考者:通过密集奖励强化场景图基础的空间推理

Hunar Batra, Haoqin Tu, Hardy Chen, Yuanze Lin, Cihang Xie, Ronald Clark

机构 * University of Oxford(牛津大学) University of California, Santa Cruz(加州大学圣克鲁兹分校)

AI总结 研究针对多模态大语言模型空间推理难题,提出SpatialThinker,通过在线强化学习统一场景图生成与视觉推理,构建心理场景图并借助密集奖励推理,贡献包括基于SGG推理、高质量训练数据集及密集奖励设计。

Comments Preprint. Accepted at NeurIPS 2025 Workshops on SPACE in Vision, Language, and Embodied AI (SpaVLE) as Oral, Embodied World Models for Decision Making (EWM), Aligning Reinforcement Learning Experimentalists and Theorists (ARLET), and Scaling Environments for Agents (SEA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15330 2026-07-07 cs.CV 版本更新

CoDoL: Conditional Domain Prompt Learning for Out-of-Distribution Generalization

CoDoL:用于分布外泛化的条件域提示学习

Min Zhang, Yuyin Wang, Zhongxiang Dai, Zhikang Chen, Jie Zhou, Miao Liu, Sen Cui

机构 * East China Normal University(东华师范大学) Xidian University(西安电子科技大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) The University of Oxford(牛津大学) Tsinghua University(清华大学)

AI总结 针对基于提示的CLIP方法存在的文本描述不准确、视觉语言嵌入对齐有限问题,提出CoDoL方法,利用域信息形成提示,还提出DMN生成输入条件令牌,实验验证其在分布外泛化的有效性。

Comments Accepted to TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10090 2026-07-07 cs.LG cs.AI cs.MA

JaxMARL: Multi-Agent RL Environments and Algorithms in JAX

JaxMARL: JAX中的多智能体强化学习环境与算法

Alexander Rutherford, Benjamin Ellis, Matteo Gallici, Jonathan Cook, Andrei Lupu, Gardar Ingvarsson, Timon Willi, Ravi Hammond, Akbir Khan, Christian Schroeder de Witt, Alexandra Souly, Saptarashmi Bandyopadhyay, Mikayel Samvelyan, Minqi Jiang, Robert Tjarko Lange, Shimon Whiteson, Bruno Lacerda, Nick Hawes, Tim Rocktaschel, Chris Lu, Jakob Nicolaus Foerster

机构 * University of Oxford(牛津大学) Universitat Politècnica de Catalunya(巴塞罗那理工大学) University College London(伦敦大学学院) University of Maryland(马里兰大学) Technical University Berlin(柏林技术大学)

AI总结 JaxMARL是首个基于Python的开源库,结合GPU效率支持大量常用多智能体强化学习环境和基线算法,实验显示其训练流程在时间上比现有方法快14倍,多轮训练时快12500倍,缓解了多智能体强化学习领域的评估危机。

详情

展开后加载摘要…

URL PDF HTML 收藏