arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Oxford(牛津大学)

共收录 1439
2607.16330 2026-07-21 cs.CV 新提交

Local Brushstroke Quality Assessment via Vision-Language Feedback

通过视觉-语言反馈进行局部笔触质量评估

Mio Mitamura, Hirokatsu Kataoka

机构 * Tokyo Institute of Science High School(东京理科大学附属高中) National Institute of Advanced Industrial Science and Technology (AIST)(国立先进工业科学技术研究所) Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

AI总结 研究多模态语言模型能否评估书法局部笔触质量并生成反馈,构建评估框架让三个模型评估图像对并与专家打分比较,还研究了RAG变体,结果显示模型有一定绝对分数准确性,但与专家排名相关性不强,RAG有正负两方面表现。

Comments 6 pages, 8 figures. Accepted to the SAUAFG Workshop at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22681 2026-07-21 cs.AI 版本更新

Scientific reasoning does not reliably translate into scientific forecasting in frontier AI

用人工智能预测科学进步

Sean Wu, Pan Lu, Yupeng Chen, Jonathan Bragg, Yutaro Yamada, Peter Clark, David Clifton, Philip Torr, James Zou, Junchi Yu

机构 * University of Oxford(牛津大学) Stanford University(斯坦福大学) Allen Institute for AI(人工智能研究所) Sakana AI

AI总结 本文研究了人工智能在预测科学进步中的能力,提出了一种基于时间的评估框架,并介绍了CUSP基准,通过可行性评估、机制推理、生成性解决方案设计和时间预测来评估AI系统的科学预测能力,发现当前前沿模型在不同领域存在系统性限制,且预测结果受事件发生时间影响较大,表明AI在科学预测中仍存在不足。

Comments 62 pages, 14 figures, 25 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04596 2026-07-21 stat.ML cs.LG stat.ME 版本更新

Uncertainty Decomposition for Bayes-Filtered Transformers via Bayesian Predictive Inference

在TabPFN中不确定性分解的原理框架

Sandra Fortini, Kenyon Ng, Sonia Petrone, Judith Rousseau, Susan Wei

机构 * Bocconi University(博科尼大学) Monash University(墨尔本大学) University of Oxford(牛津大学)

AI总结 本文提出在TabPFN中进行不确定性分解的原理框架,通过贝叶斯预测推断方法,推导出基于预测更新波动性的方差估计器,并实现快速计算的可信区间,同时针对分类任务提出基于熵的不确定性分解方法。

Comments Major revision, retitled. The quasi-martingale conditions of v1 are relaxed to weaker signed conditions; adds empirical diagnostics showing a meta-learned Beta-Bernoulli BFT satisfies the signed condition

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19504 2026-07-21 cs.CV 版本更新

FusionNet: Physics-Aware Representation Learning for Multi-Spectral and Thermal Data via Trainable Signal-Processing Priors

FusionNet:通过可训练信号处理先验对多光谱和热数据进行物理感知表示学习

Georgios Voulgaris

机构 * University of Oxford(牛津大学)

AI总结 研究针对水泥生产设施监测难题,提出FusionNet框架,通过整合多光谱数据,嵌入信号处理先验,经消融研究等实验验证,该框架能结合物理感知特征选择与深度学习架构,高精度检测水泥生产设施,为工业监测提供可靠框架。

Comments Accepted for publication in the IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing (JSTARS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13780 2026-07-20 cs.LG cs.AI 版本更新

Soft $Q(λ)$: A multi-step off-policy method for entropy regularised reinforcement learning using eligibility traces

Soft Q(λ): 一种用于熵正则化强化学习的多步离策略方法,使用效用追踪

Pranav Mahajan, Ben Seymour

机构 * University of Oxford(牛津大学)

AI总结 本文提出Soft Q(λ),一种基于效用追踪的离策略方法,通过引入新的Soft Tree Backup操作符,扩展了软Q学习的多步框架,实现了高效的信用分配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22818 2026-07-20 cs.CR cs.AI 版本更新

Hide and Seek in Embedding Space: Geometry-based Steganography and Detection in Large Language Models

嵌入空间中的隐秘行动:基于几何的隐写术与大语言模型中的检测

Charles Westphal, Keivan Navaie, Fernando E. Rosas

机构 * UCL Centre for Artificial Intelligence, University College London, UK(伦敦大学学院人工智能中心,大学学院伦敦) School of Computing and Communications, Lancaster University, UK(兰卡斯特大学计算机与通讯学院) Department of Informatics, University of Sussex, UK(苏塞克斯大学信息学院) Centre for Psychedelic Research and Centre for Complexity Science, Imperial College London, UK(伦敦帝国学院迷幻研究与复杂科学中心) Centre for Eudaimonia and Human Flourishing, University of Oxford, UK(牛津大学幸福与人类繁荣中心)

AI总结 本研究提出了一种低恢复性隐写术,通过嵌入空间衍生映射提升秘密恢复率,同时减少负载恢复性,并提出基于机制可解释性的检测方法,提高微调模型中的秘密检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15268 2026-07-17 cs.CV 新提交

Motion-Conditioned Multi-View Fusion for Myocardial Infarction Localization from Echocardiography

用于超声心动图心肌梗死定位的运动条件多视图融合

Guang Yang, Wentian Xu, Siyu Wang, Betty Raman, Lei Li, Vicente Grau

机构 * University of Oxford(牛津大学) National University of Singapore(新加坡国立大学)

AI总结 针对超声心动图心肌梗死定位问题,提出MCF-Net框架,融合心肌运动线索与基础模型表示,通过极稀疏监督建模心脏运动,利用运动衍生软掩码提供先验,跨视图整合运动和视觉优化预测,在节段级定位上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15255 2026-07-17 cs.CV 新提交

HoloGeo: Mitigating Landmark Bias in Geo-localization via Evidence-Driven Reasoning

HoloGeo:通过证据驱动推理减轻地理定位中的地标偏差

Pengcheng Zhou, Xuanyu Liu, Yanchen Yin, Bobo Li, Shengqiong Wu, Mong-Li Lee, Wynne Hsu

机构 * National University of Singapore(新加坡国立大学) Shandong University of Science and Technology(山东科技大学) University of Oxford(牛津大学)

AI总结 研究针对视觉语言模型地理定位易受地标偏差影响的问题,提出证据驱动推理框架HoloGeo,借助高质量数据集,通过多维度奖励实现平衡关注与联合推理,经实验验证其在多个数据集上能有效减轻地标偏差,提升地理定位性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15172 2026-07-17 cs.RO 新提交

AHEAD: Anticipatory Hand-Driven Teleoperation via Human Intent Prediction

AHEAD:通过人类意图预测实现预期的手动驱动遥操作

Seok Joon Kim, Junho Lee, Federica Spinola, Taein Kwon, Mohsen Moghaddam

机构 * Georgia Institute of Technology(佐治亚理工学院) Neuromeka Ltd.(Neuromeka有限公司) INRIA(法国国家信息与自动化研究所) University of Oxford(牛津大学)

AI总结 研究旨在减少机器人反应时间并降低操作员工作量,提出AHEAD实时VR遥操作系统,通过处理手和头部信号及场景上下文预测意图,转换为稳定目标,该系统意图预测准确率高,能有效减少延迟并降低操作员负荷。

Comments Accepted to IROS2026, 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21317 2026-07-17 cs.HC cs.AI cs.CY 版本更新

Warning labels shift perceptions of sycophantic AI, but not its influence

警告标签改变对谄媚AI的认知,但不改变其影响

Lujain Ibrahim, Myra Cheng, Cinoo Lee, Pranav Khadpe, Desmond Ong, Dan Jurafsky, Diyi Yang

机构 * University of Oxford(牛津大学) Stanford University(斯坦福大学) Microsoft(微软) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 通过实验发现,警告标签能改变用户对谄媚AI的感知,但未能减少其对用户判断和冲突修复意愿的影响,揭示了认知与影响之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05895 2026-07-17 cs.CL cs.LG 版本更新

Representing Research Attention as Contextually Structured Flows

将研究关注度表示为上下文结构化流

Jessica Rodrigues, Angelo Salatino, Gard Jenset, Scott Hale

机构 * University of Oxford(牛津大学) The Open University(开放大学) Springer Nature

AI总结 提出注意力流(attention flows)作为上下文结构化表示,编码注意力的组织及其随时间演化,通过类比推理基准评估发现流表示更有效支持结构比较,并提升部分观测和结构扰动下的鲁棒性。

Comments Accepted at STi 2026 - International Conference on Science and Technology Indicators

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00923 2026-07-17 cs.LG 版本更新

Addressing Benchmarking Gaps in Large Language Models for Health and Medicine with Dynamic Red-Teaming

超越基准:动态、自动和系统化的红队代理用于可信的医疗语言模型

Jiazhen Pan, Bailiang Jian, Paul Hager, Yundi Zhang, Che Liu, Friederike Jungmann, Hongwei Bran Li, Julian Canisius, Chenyu You, Junde Wu, Jiayuan Zhu, Fenglin Liu, Yuyuan Liu, Niklas Bubeck, Moritz Knolle, Chen, Chen, Christian Wachinger, Zhenyu Gong, Cheng Ouyang, Georgios Kaissis, Benedikt Wiestler, Daniel Rueckert

机构 * Technical University of Munich (TUM)(慕尼黑技术大学) University of Oxford(牛津大学) TUM University Hospital(慕尼黑技术大学医院) Imperial College London(伦敦帝国理工学院) Harvard Medical School(哈佛医学院) Stony Brook University(史泰兹布鲁克大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) University of Sheffield(谢菲尔德大学)

AI总结 本文提出DAS红队框架,通过动态压力测试揭示医疗语言模型在鲁棒性、隐私、偏见和幻觉方面的潜在风险,发现高静态基准性能与低动态可靠性之间的'基准差距'。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09727 2026-07-17 cs.AI 版本更新

Gaussian Process Aggregation for Root-Parallel Monte Carlo Tree Search with Continuous Actions

用于具有连续动作的根并行蒙特卡罗树搜索的高斯过程聚合

Junlin Xiao, Victor-Alexandru Darvariu, Bruno Lacerda, Nick Hawes

机构 * Oxford Robotics Institute, Department of Engineering Science, University of Oxford(牛津机器人研究所、工程科学系、牛津大学)

AI总结 研究连续动作空间环境中根并行蒙特卡罗树搜索的聚合问题,核心方法是用高斯过程回归获取动作值估计,经6个领域系统评估,该方法优于现有策略且推理时间增加适度。

Comments To appear in the Reinforcement Learning Journal (RLJ) and to be presented at the Third Reinforcement Learning Conference (RLC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13899 2026-07-16 cs.AI 新提交

AIMO Interpretability Challenge

AIMO可解释性挑战

Michal Štefánik, Philipp Mondorf, Andreas Waldis, Qianying Liu, Chuan Yang, Michal Spiegel, Josef Kuchař, Marek Kadlčík, Adam Vawda-Oomerjee, Chaoran Liu, Simon Frieder, Barbara Plank, Fazl Barez, Pontus Stenetorp

机构 * National Institute of Informatics(日本国立信息学研究所) Munich Center for Machine Learning / MaiNLP LMU(慕尼黑机器学习中心/慕尼黑大学语言与文学计算研究所) University of Tübingen(图宾根大学) Fuzhou University(福州大学) Masaryk University(马萨里克大学) University College London(伦敦大学学院) University of Oxford(牛津大学)

AI总结 提出AIMO可解释性挑战,基于前沿数学语言模型内部机制区分稳健与虚假推理。利用AIMO问题等资源,提供推理问题、模型访问及鲁棒性评估,助参与者开发识别稳健模型的方法,创建新基准和基线系统,连接可解释性与泛化研究。

Comments Accepted Competition at NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06824 2026-07-16 cs.RO cs.LG 版本更新

CaLiSym: Learning Symplectic Dynamics of Real-World Systems through Structured Canonical Lifts

CaLiSym:通过结构化规范提升学习现实世界系统的辛动力学

Aristotelis Papatheodorou, Pranav Vaidhyanathan, Natalia Ares, Ioannis Havoutis, Gerard J. Milburn

机构 * Department of Engineering Science, University of Oxford(牛津大学工程科学系) School of Mathematics and Physics, University of Sussex(萨塞克斯大学数学与物理系)

AI总结 研究针对物理学习局限,引入CaLiSym框架,通过结构化规范提升将辛学习扩展到含能量动量交换的机器人系统。用广义岭SympNet预测器实例化,实验表明该方法能改进分布外自回归预测,保持辛形式,为现实机器人系统提供几何保持动力学模型。

Comments 19 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13903 2026-07-16 cs.MA cs.AI cs.LG 版本更新

Benefits and Limitations of Communication in Multi-Agent Reasoning

多智能体推理中通信的益处与局限性

Michael Rizvi-Martel, Satwik Bhattamishra, Neil Rathi, Guillaume Rabusseau, Michael Hahn

机构 * Mila & Université de Montréal(Mila与蒙特利尔大学) University of Oxford(牛津大学) Stanford University(斯坦福大学) Saarland University(萨尔兰大学)

AI总结 研究多智能体推理中通信的益处与局限,提出理论框架分析其表达能力,应用于三个算法族,得出相关界限,通过实验验证关键量权衡,为设计可扩展多智能体推理系统提供指导。

Comments 34 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09977 2026-07-15 cs.CV 版本更新

INFANiTE: Implicit Neural representation for high-resolution Fetal brain spatio-temporal Atlas learNing from clinical Thick-slicE MRI

INFANiTE:隐式神经表示用于高分辨率胎儿脑空间-时间大体图谱学习从临床厚切片MRI

Xiaotian Hu, Mingxuan Liu, Hongjia Yang, Tongxi Song, Yijin Li, Yifei Chen, Haoxiang Li, Zihan Li, Yingqi Hao, Ziyu Li, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Beihang University(北航大学) Tsinghua University(清华大学) Sichuan University(四川大学) University of Oxford(牛津大学)

AI总结 INFANiTE通过隐式神经表示方法,实现了从厚切片MRI中高效生成高分辨率胎儿脑空间-时间大体图谱,显著加快了图谱构建过程,提升了图谱的一致性、参考保真度和生物合理性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.14125 2026-07-15 stat.ML cs.LG 版本更新

Spectral Diffusion Processes

谱扩散过程

Angus Phillips, Thomas Seror, Michael Hutchinson, Valentin De Bortoli, Arnaud Doucet, Emile Mathieu

机构 * University of Oxford(牛津大学) ENS, CNRS, PSL University Paris(巴黎高等师范学院、国家科学研究中心、巴黎大学) University of Cambridge(剑桥大学)

AI总结 研究将扩散模型应用于函数空间上的随机过程,通过谱表示分离随机部分与时空结构,用有限维扩散模型建模谱系数,经截断确保模型有效性,投影回原空间对应相关噪声扩散模型,还展示了方法在多模态数据建模及条件采样上的有效性。

Comments This version (v3) extends the previous workshop version (v2) with conditional sampling and theoretical results. Work carried out in 2022/23. V2 appeared in Score-based Methods Workshop at the 36th Conference on Neural Information Processing Systems (NeurIPS 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11760 2026-07-14 cs.LG cs.CL 新提交

From Expressivity to Sample Complexity: Narrow Teachers for Transformers via C-RASP

从表达能力到样本复杂度:通过C-RASP为Transformer构建窄教师模型

Michael Rizvi-Martel, Satwik Bhattamishra, Guillaume Rabusseau, Michael Hahn

机构 * Mila & Université de Montréal(米拉与蒙特利尔大学) University of Oxford(牛津大学) Saarland University(萨尔兰大学)

AI总结 研究Transformer的理论理解,通过提出手工权重等分析其表达能力。针对其可学习性研究少的问题,受损失景观分析启发,为用Transformer学习C-RASP结构提出初步样本复杂度界限。

Comments 9 pages total

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11560 2026-07-14 cs.CV cs.AI 新提交

Technical Report on the CVPR 2026@AdvML Workshop Challenge

关于CVPR 2026@AdvML研讨会挑战赛的技术报告

Tianyuan Zhang, Zonglei Jing, Jiangfan Liu, Ligong Zhang, Ke Ma, Chengzhi Sun, Xiaohai Xu, Zhirui Zhang, Qianqian Xu, Qingming Huang, Hanyu Fang, Junhua Liu, Zheng Wang, Xiaoliang Liu, Yuanbo Li, Shuai Gui, Bin Wang, Menghe Zheng, Jing Nie, Hanyang Meng, Zeyang Zhang, Xiang Zhang, Yongxuan Zhu, Rui Ding, Hainan Li, Yongkang Zhang, Zhilei Zhu, Xianglong Kong, Jin Hu, Zonghao Ying, Yisong Xiao, Lei Chen, Haotong Qin, Jiakai Wang, Aishan Liu, Ruikai Li, Julia Karbing, Yinpeng Dong, Zhenfei Yin, Shao Jing, Xia Hu, Jingyi Xu, Juntao Dai, Xinyun Chen, Vishal M. Patel, Xianglong Liu, Dawn Song, Alan Yuille, Philip H. S. Torr, Dacheng Tao

机构 * Beihang University(北京航空航天大学) University of Chinese Academy of Sciences(中国科学院大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Tongji University(同济大学) iFLYTEK Co., Ltd.(科大讯飞股份有限公司) Anhui Laboratory for Safe Artificial Intelligence in the Yangtze River Delta(长三角安全人工智能安徽实验室) Wenzhou Business College(温州商学院) Jiangnan University(江南大学) Guangzhou City University of Technology(广州理工学院) Inceptio Technology(智元机器) Institute of Dataspace(数据空间研究所) Zhongguancun Laboratory(中关村实验室) Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) University of Oxford(牛津大学) Shanghai AI Laboratory(上海人工智能实验室) BAAI(北京智源人工智能研究院) Meta Johns Hopkins University(约翰·霍普金斯大学) University of California, Berkeley(加州大学伯克利分校) Nanyang Technological University(南洋理工大学)

AI总结 介绍CVPR 2026@AdvML研讨会针对自动驾驶VLAs的对抗性多模态攻击挑战赛,基于多视图视觉问答,参赛者要生成对抗图像和文本扰动。阐述任务设计等,研究领先提交作品发现后缀惩罚等模式,为多模态自动驾驶系统相关工作提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11353 2026-07-14 cs.CL cs.AI cs.DL cs.IR cs.LG 新提交

Characterising AI Models for Cataloguing

用于编目的人工智能模型特征分析

Miguel Arana-Catania, Neil Jefferies

机构 * University of Oxford(牛津大学)

AI总结 研究数字馆藏编目记录创建中人工智能模型的应用,通过比较不同实现方式和模型进行评估,涵盖定性定量实验评估,并给出超出特定用例的模型使用建议。

Comments 7 pages, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10891 2026-07-14 cs.AI 新提交

SETA: Scaling Environments for Terminal Agents

SETA:终端智能体的扩展环境

Qijia Shen, Zhiqi Huang, Vamsidhar Kamanuru, Aznaur Aliev, Jay Rainton, Ahmed Awelkair, Zhichen Zeng, Jiajun Li, Shi Dong, Yueming Yuan, Boyuan Ma, Qizheng Zhang, Jiwei Fu, Yuzhen Mao, Wendong Fan, Ping Nie, Philip Torr, Bernard Ghanem, Changran Hu, Jonathan Lingjie Li, Urmish Thakker, Guohao Li

机构 * Imperial College London(帝国理工学院) University College London(伦敦大学学院) SambaNova(桑巴诺瓦公司) KAUST(阿卜杜拉国王科技大学) Stanford University(斯坦福大学) University of Oxford(牛津大学) University of Waterloo(滑铁卢大学) RadixArk(基数方舟公司)

AI总结 研究针对终端智能体训练扩展难的问题,提出SETA框架,含SETA - Synth和SETA - Evol两个管道及统一验证机制,构建了SETA - Env数据集。实验显示该数据集能为终端智能体提供优质训练环境,推动相关研究发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06534 2026-07-14 cs.CV 版本更新

CAIRN: Cross-Room 3D Scene Understanding with Topology-Aware Large Multimodal Models

CAIRN:使用拓扑感知大型多模态模型进行跨房间3D场景理解

He Liang, Chenyang Ma, Yiming Zhang, Sangyun Shin, Andrew Markham, Niki Trigoni, Yuhang He

机构 * University of Oxford(牛津大学) Microsoft(微软公司) Simon Fraser University(西蒙弗雷泽大学)

AI总结 研究针对现有3D-LLMs不能处理多房间场景问题,提出拓扑感知3D-LLM即CAIRN。其将Transformer注意力与场景层次对齐,通过多种方式增强模型能力。在新基准CAIRN-MR上实验,CAIRN在多房间任务中大幅超越前人,单房间任务也具竞争力。

Comments Project Page: https://oceansdepp.github.io/cairn_web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29657 2026-07-14 cs.AI cs.LG 版本更新

Safety from Honesty in a Disinterested AI Predictor

无兴趣AI预测器中的诚实安全性

Yoshua Bengio, Oliver Richardson, Tomáš Gavenčiak, Michael Cohen, Rory Svarc, Damiano Fornasiere, Gael Gendron, David Hyland, Aton Kamanda, Adam Oberman, Francis Rhys Ward, Anna Gavenčiak, Jacob Livingston Slosser, Vincent Mai, Iulian Serban, Joumana Ghosn

机构 * LawZero Université de Montréal(蒙特利尔大学) Mila University of California Berkeley(加州大学伯克利分校) McGill University(麦吉尔大学) Arb Research Center for Theoretical Study Charles University in Prague(布拉格查理大学理论研究中心) University of Oxford(牛津大学) Sapien Institute(Sapien研究所)

AI总结 提出一种形式化安全论证,通过数据表示和训练过程确保预测器诚实预测而不成为追求目标的智能体,并证明危险预测器出现的概率可控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14746 2026-07-14 cs.LG 版本更新

Selective Safety Steering via Value-Filtered Decoding

基于价值过滤解码的选择性安全引导

Bat-Sheva Einbinder, Hen Davidov, Yee Whye Teh, Yarin Gal, Yaniv Romano

机构 * Department of Electrical and Computer Engineering, Technion IIT(技术学院电气与计算机工程系) Department of Statistics, University of Oxford(牛津大学统计系) OATML, Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Computer Science, Technion IIT(技术学院计算机科学系)

AI总结 本文提出一种测试时引导方法,通过价值基的安全标准过滤token,减少不必要的干预,提升不安全响应的安全性,同时在多个数据集上验证了其在安全与帮助性之间的更好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26599 2026-07-14 cs.CV 版本更新

VGGRPO: Towards World-Consistent Video Generation with 4D Latent Reward

VGGRPO:迈向世界一致的视频生成的4D潜在奖励

Zhaochong An, Orest Kupyn, Théo Uscidda, Andrea Colaco, Karan Ahuja, Serge Belongie, Mar Gonzalez-Franco, Marta Tintore Gazulla

机构 * Google(谷歌) University of Oxford(牛津大学) CREST-ENSAE, Institut Polytechnique de Paris(巴黎综合理工学院CREST-ENSAE) University of Copenhagen(哥本哈根大学)

AI总结 VGGRPO通过引入4D潜在几何模型和组相对策略优化,提升视频生成的几何一致性与稳定性,避免VAE解码的高计算开销。

Comments Accepted at ECCV 2026. Project Page: https://zhaochongan.github.io/projects/VGGRPO

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13330 2026-07-14 cs.CL 版本更新

RegCheck: A tool for structured comparisons between study registrations and papers

RegCheck:一个用于研究注册与论文之间结构化比较的工具

Jamie Cummins, Beth Clarke, Ian Hussey, Malte Elson

机构 * Bennett Institute of Applied Data Science, University of Oxford(贝内特应用数据科学研究所,牛津大学) Institute of Psychology, University of Bern(心理学研究所,伯恩大学)

AI总结 介绍RegCheck工具,用于比较研究注册与论文。利用人工智能,模块化设计,让用户决定比较特征并提供相关文本,生成可共享报告,适用于多领域多格式,有望成为可重复科学的可扩展基础设施。

Comments 26 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09526 2026-07-13 cs.CV cs.AI 新提交

ALICE: Learning a General-Purpose Pathology Foundation Model from Vision, Vision-Language, and Slide-Level Experts

ALICE:从视觉、视觉语言和玻片级专家学习通用病理学基础模型

Jiawen Li, Tian Guan, Huijuan Shi, Xitong Ling, Mingxi Fu, Anjia Han, Chao He, Yonghong He

机构 * Institute of Biopharmaceutical and Health Engineering, Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学生物医药与健康工程研究院,清华大学深圳国际研究生院) Department of Engineering Science, University of Oxford(牛津大学工程科学系) Department of Pathology, The First Affiliated Hospital of Sun Yat-sen University(中山大学附属第一医院病理科) Medical Optical Technology R&D Center, Research Institute of Tsinghua, Pearl River Delta(清华珠三角研究院医学光学技术研发中心)

AI总结 研究提出通过多阶段凝聚蒸馏训练的ALICE统一基础模型,将多种教师模型知识整合到单个主干。它在大量图像上预训练,经多场景多任务评估,在任务匹配病理基础模型中平均排名最佳,证明凝聚蒸馏可整合能力用于广泛病理学应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09316 2026-07-13 cs.CL cs.AI cs.DL cs.IR cs.LG 新提交

Automatic Thematic Indexing of Large Literary Corpora: A Machine Learning Approach to Voltaire's Complete Works

大型文学语料库的自动主题索引:一种适用于伏尔泰全集的机器学习方法

Miguel Arana-Catania, Gillian Pink, Glenn Roe

机构 * University of Oxford(牛津大学)

AI总结 本文以伏尔泰全集子语料库为测试案例,将自动主题索引任务设为多标签分类问题,比较多种机器学习方法,最佳模型F1分数达0.67,还评估跨语料库泛化及分析模型行为,为大规模文学和历史语料库的结构化主题访问提供了启示。

Comments 22 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09262 2026-07-13 cs.CY cs.AI 新提交

Geopolitical alignment: Endorsement effects in large language models

地缘政治倾向:大语言模型中的背书效应

Maxim Chupilkin

机构 * Department of Politics and International Relations, University of Oxford(政治与国际关系系,牛津大学)

AI总结 研究大语言模型政策评估是否受地缘政治线索影响,通过背书实验让四个模型评估相同政策,发现模型评分受背书者身份影响,西方背书被视为可信度线索,中国和俄罗斯背书被视为其他风险线索。

详情

展开后加载摘要…

URL PDF HTML 收藏