arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Oxford(牛津大学)

2026-07-02 至 2026-07-02 共收录 7
2607.01212 2026-07-02 cs.RO cs.AI 新提交

FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model

FurnitureVLA: 使用视觉-语言-动作模型学习长时域双臂家具组装

Chenyang Ma, Yue Yang, Radu Corcodel, Siddarth Jain, Andrew Wu, Chiori Hori, Diego Romeres

机构 * Mitsubishi Electric Research Laboratories(三菱电机研究实验室) University of Oxford(牛津大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

AI总结 提出FurnitureVLA,首个使用视觉-语言-动作模型进行真实尺寸双臂家具组装的系统,通过进度增强VLA和设计因素研究,将平均模拟成功率从48%提升至80%。

Comments Project Page: https://dannymcy.github.io/furniturevla/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01082 2026-07-02 cs.LG 新提交

When Context Compensates for Sparse Event History: AlphaEarth for Spatio-Temporal Point-Process Forecasting

当上下文弥补稀疏事件历史:AlphaEarth用于时空点过程预测

Yahya Aalaila, Mouad Elhamdi, Gerrit Großmann, Daniel Jenson, Elizaveta Semenova, Sebastian Vollmer

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Université Mohammed VI Polytechnique(穆罕默德六世理工大学) University of Oxford(牛津大学) Imperial College London(帝国理工学院) Rhineland-Palatinate Technical University of Kaiserslautern-Landau (RPTU)(莱茵兰-普法尔茨凯泽斯劳滕-兰道工业大学)

AI总结 研究利用AlphaEarth嵌入作为空间上下文,在事件历史稀疏时提升时空点过程模型的跨区域预测性能,实验表明在短历史下预测误差降低2-6倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00969 2026-07-02 cs.HC cs.LG 新提交

Understanding How Humans Inject Knowledge into Machine Learning Workflows through Visual Analytics

理解人类如何通过可视化分析将知识注入机器学习工作流

Yiwen Xing, Philip Beaucamp, Joyraj Chakraborty, Afrah Farea, Yuanzhe Jin, Saiful Khan, Gennady Andrienko, Natalia Andrienko, Min Chen

机构 * University of Oxford(牛津大学) Istanbul Technical University(伊斯坦布尔理工大学) Science and Technology Facilities Council(科学技术设施委员会) Fraunhofer Institute IAIS(弗劳恩霍夫智能分析和信息系统研究所)

AI总结 本文调查了200多篇VIS4ML论文,通过编码分析从ML特性、可视化、交互和动作四个视角,揭示了人类通过交互可视化向ML工作流注入知识的多种路径,并基于概念模型和信息论成本效益分析解释了VIS4ML现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00865 2026-07-02 cs.LG 新提交

Constrained Bayesian Optimisation with Multiple Information Sources

多信息源约束贝叶斯优化

Hauke Maathuis, Roeland De Breuker, Saullo Castro, Maike Osborne

机构 * TU Delft(代尔夫特理工大学) University of Oxford(牛津大学)

AI总结 针对可行域小且存在辅助数据源的约束优化问题,提出多源框架扩展约束最大熵搜索,通过捕获源间相关性平衡成本与信息增益,在弱相关辅助数据下仍高效找到可行最优解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00804 2026-07-02 cs.CV 新提交

Spotted: Location-informed Reidentification of Hyenas and Leopards in Camera Trap Surveys

Spotted: 基于位置信息的相机陷阱调查中鬣狗和豹子的重新识别

Halil Sina Kelebek, Julia Hindel, Kobus Hoffman, Lauren Hoffman, Andrew Loveridge, Bob Mandinyenya, Kudakwashe Ncube, Justin Seymour-Smith, Andrea Sibanda, Abhinav Valada, Matthew Wijers, Daniele De Martini

机构 * Oxford Robotics Institute, University of Oxford(牛津大学牛津机器人研究所) Department of Computer Science, University of Freiburg(弗莱堡大学计算机科学系) Bubye Valley Conservancy(布比耶谷保护区) Wildlife Conservation Research Unit, Department of Biology, University of Oxford(牛津大学生物系野生动物保护研究组) Gonarezhou National Park(戈纳雷若国家公园) Oxford e-Research Centre, University of Oxford(牛津大学牛津电子研究中心)

AI总结 提出Spotted框架,结合视觉相似性与时空可行性先验,减少专家审核量,在三个数据集上Top-5准确率提升最高9pp,查询比较量减少69pp。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00296 2026-07-02 cs.CV cs.AI 新提交

Learning When to Listen: Gated Affect Fusion for Human Motion Prediction

学习何时倾听:用于人体运动预测的门控情感融合

Jingni Huang

机构 * University of Oxford(牛津大学)

AI总结 提出门控情感变换器(GAT)动态调节跨模态信息流,解决无约束视频中情感特征与姿态融合的噪声问题,证明面部情感仅在短中期(如30帧)提供有限预测线索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00464 2026-07-02 cs.LG cs.CL 新提交

MolSafeEval: A Benchmark for Uncovering Safety Risks in AI-Generated Molecules

MolSafeEval: 揭示AI生成分子安全风险的基准

Tong Xu, Xinzhe Cao, Zhihui Zhu, Keyan Ding, Huajun Chen

机构 * Zhejiang University(浙江大学) ZJU-Hangzhou Global Scientific and Technological Innovation Center(浙大-杭州全球科技创新中心) University of Oxford(牛津大学)

AI总结 提出MolSafeEval基准,通过构建分子安全知识图谱和基于大语言模型的推理,系统评估四类分子生成模型的安全风险,揭示当前方法的漏洞。

Comments Accepted by Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏