arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Toronto(多伦多大学)

共收录 1022
2510.23896 2026-03-09 cs.CL

AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages

AfriMTEB 和 AfriE5:为非洲语言构建和适应文本嵌入模型的基准测试

Kosei Uemura, Miaoran Zhang, David Ifeoluwa Adelani

机构 * University of Toronto(多伦多大学) Mila - Quebec AI Institute, McGill University(魁北克AI研究院,麦吉尔大学) Saarland University, Saarland Informatic Campus(萨尔兰大学,萨尔兰信息学院) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

AI总结 本文提出 AfriMTEB 和 AfriE5,为非洲语言构建和适应文本嵌入模型的基准测试,通过引入新任务和跨语言对比蒸馏方法,提升了模型性能。

Comments Accepted to EACL 2026 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08105 2026-03-09 cs.CL

MERLIN: Multi-Stage Curriculum Alignment for Multilingual Encoder-LLM Integration in Cross-Lingual Reasoning

MERLIN:多阶段课程对齐用于多语言编码器-大语言模型集成的跨语言推理

Kosei Uemura, David Guzmán, Quang Phuoc Nguyen, Jesujoba Oluwadara Alabi, En-shiun Annie Lee, David Ifeoluwa Adelani

机构 * University of Toronto(多伦多大学) Mila-Quebec AI Institute, McGill University(魁北克AI研究所,麦吉尔大学) OntarioTech University(安大略技术大学) Saarland University(萨尔兰州立大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

AI总结 MERLIN通过多阶段课程对齐方法提升多语言编码器-大语言模型在跨语言推理中的性能,特别是在低资源语言上表现突出。

Comments Accepted to EACL 2026 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20403 2026-03-09 cs.ET cs.AI cs.CR cs.LG quant-ph

Adversarial Robustness of Partitioned Quantum Classifiers

分区量子分类器的对抗鲁棒性

Pouya Kananian, Hans-Arno Jacobsen

机构 * Department of Electrical and Computer Engineering, University of Toronto(电气与计算机工程系,多伦多大学)

AI总结 研究分区量子分类器在对抗扰动下的鲁棒性,揭示扰动与中间层对抗门实现的联系,并从理论和实验角度探讨相关问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04464 2026-03-06 cs.LG cs.AI

Understanding the Dynamics of Demonstration Conflict in In-Context Learning

理解上下文学习中演示冲突的动力学

Difan Jiao, Di Wang, Lijie Hu

机构 * University of Toronto(多伦多大学) King Abdullah University of Science(卡布斯国王科学大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 本研究探讨了上下文学习中演示冲突的处理机制,发现模型在冲突证据下表现出两阶段计算结构,通过注意力头分析揭示了模型对腐败证据的敏感性,并验证了针对性消融对性能提升的显著影响。

Comments 19 pages,12 figures,4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24096 2026-03-06 cs.CV cs.AI cs.LG

DiffusionHarmonizer: Bridging Neural Reconstruction and Photorealistic Simulation with Online Diffusion Enhancer

DiffusionHarmonizer: 通过在线扩散增强器连接神经重建与逼真模拟

Yuxuan Zhang, Katarína Tóthová, Zian Wang, Kangxue Yin, Haithem Turki, Riccardo de Lutio, Yen-Yu Chang, Or Litany, Sanja Fidler, Zan Gojcic

机构 * NVIDIA University of Toronto(多伦多大学) Cornell University(康奈尔大学) Technion(技术学院)

AI总结 DiffusionHarmonizer通过在线扩散增强器提升神经重建与逼真模拟的结合,解决动态物体整合与伪影问题,提高模拟保真度。

Comments For more details and updates, please visit our project website: https://research.nvidia.com/labs/sil/projects/diffusion-harmonizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04305 2026-03-05 cs.RO

Perception-Aware Time-Optimal Planning for Quadrotor Waypoint Flight

四旋翼航点飞行的感知感知时间最优规划

Chao Qin, Jiaxu Xing, Rudolf Reiter, Angel Romero, Yifan Lin, Hugh H. -T. Liu, Davide Scaramuzza

机构 * University of Toronto Institute for Aerospace Studies (UTIAS)(多伦多大学航空航天研究所在加拿大) Robotics and Perception Group(机器人与感知组)

AI总结 本文提出了一种感知意识时间最优轨迹优化框架,结合动力学、视觉约束和环境几何,提升四旋翼飞行的感知可靠性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04217 2026-03-05 cs.CL

When Do Language Models Endorse Limitations on Human Rights Principles?

语言模型何时会支持人权原则的限制?

Keenan Samway, Nicole Miu Takagi, Rada Mihalcea, Bernhard Schölkopf, Ilias Chalkidis, Daniel Hershcovich, Zhijing Jin

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Jinesis AI Lab, University of Toronto & Vector Institute(Jinesis AI实验室,多伦多大学及向量研究所) University of Michigan(密歇根大学) University of Copenhagen(哥本哈根大学) EuroSafeAI

AI总结 本文研究了语言模型在人权原则限制上的偏见,发现模型在不同语言和提示下表现出系统性差异,揭示了AI在高风险互动中的伦理挑战。

Comments EACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11291 2026-03-05 cs.RO

H-WM: Robotic Task and Motion Planning Guided by Hierarchical World Model

H-WM:由分层世界模型引导的机器人任务和运动规划

Jinbang Huang, Wenyuan Chen, Zhiyuan Li, Oscar Pang, Xiao Hu, Lingfeng Zhang, Yuanzhao Hu, Zhanguang Zhang, Mark Coates, Tongtong Cao, Xingyue Quan, Yingxue Zhang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学) University of British Columbia(不列颠哥伦比亚大学) McGill University(麦吉尔大学)

AI总结 H-WM通过结合逻辑和视觉世界模型,实现机器人任务和运动规划中的鲁棒长视界推理与稳定引导。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19888 2026-03-05 cs.CV cs.LG

FlowCLAS: Enhancing Normalizing Flow Via Contrastive Learning For Anomaly Segmentation

通过对比学习增强归一化流用于异常分割

Chang Won Lee, Selina Leveugle, Svetlana Stolpner, Chris Langley, Paul Grouchy, Jonathan Kelly, Steven L. Waslander

机构 * University of Toronto(多伦多大学) MDA Space(MDA空间)

AI总结 FlowCLAS通过对比学习增强归一化流,有效提升异常分割性能,达到多个机器人异常分割基准的最先进水平。

Comments WACV 2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08184 2026-03-05 cs.CV

Scaling Laws For Diffusion Transformers

扩散变换器的扩展定律

Zhengyang Liang, Hao He, Ceyuan Yang, Bo Dai

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学)

AI总结 本文研究了扩散变换器的扩展定律,通过实验验证了模型大小、数据需求与计算预算之间的幂律关系,并展示了预训练损失与生成性能的一致性,为模型性能和数据质量评估提供了可预测的基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21150 2026-03-05 cs.LG

CAD-Tokenizer: Towards Text-based CAD Prototyping via Modality-Specific Tokenization

CAD-Tokenizer: 向基于文本的CAD原型设计迈进:通过模态特定的分词

Ruiyu Wang, Shizhao Sun, Weijian Ma, Jiang Bian

机构 * University of Toronto(多伦多大学) Microsoft Research Asia(微软亚洲研究院) Fudan University(复旦大学)

AI总结 CAD-Tokenizer通过模态特定的分词策略,提升文本引导的CAD原型设计效率与生成质量。

Comments ICLR2026 Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07275 2026-03-04 cs.LG cs.HC stat.AP

Tailored Behavior-Change Messaging for Physical Activity: Integrating Contextual Bandits and Large Language Models

针对体力活动的定制行为改变信息:整合上下文老虎机和大型语言模型

Haochen Song, Dominik Hofer, Rania Islambouli, Laura Hawkins, Ananya Bhattacharjee, Zahra Hassanzadeh, Jan Smeddinck, Meredith Franklin, Joseph Jay Williams

机构 * University of Toronto(多伦多大学) Ludwig Boltzmann Institute for Digital Health(卢德维希·玻尔兹曼数字健康与预防研究所) Stanford University(斯坦福大学)

AI总结 本文提出了一种结合上下文老虎机和大型语言模型的混合方法,用于个性化体力活动干预,通过动态上下文因素优化信息内容,提升干预效果和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02351 2026-03-04 cs.CV

MERG3R: A Divide-and-Conquer Approach to Large-Scale Neural Visual Geometry

MERG3R: 一种用于大规模神经视觉几何的分而治之方法

Leo Kaixuan Cheng, Abdus Shaikh, Ruofan Liang, Zhijie Wu, Yushi Guan, Nandita Vijaykumar

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 MERG3R通过分而治之的方法提升大规模神经视觉几何重建的准确性、内存效率和可扩展性。

Comments Project page: https://leochengkx.github.io/MERG3R/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02256 2026-03-04 cs.CV

CamDirector: Towards Long-Term Coherent Video Trajectory Editing

CamDirector: 向长期一致的视频轨迹编辑迈进

Zhihao Shi, Kejia Yin, Weilin Wan, Yuhongze Zhou, Yuanhao Yu, Xinxin Zuo, Qiang Sun, Juwei Lu

机构 * McMaster University(麦克 master 大学) University of Toronto(多伦多大学) The University of Hong Kong(香港大学) McGill University(麦吉尔大学) Concordia University(Concordia 大学) MBZUAI

AI总结 CamDirector通过混合变形方案和历史引导的自回归扩散模型,实现长期一致的视频轨迹编辑,并提出新的VTE基准iPhone-PTZ。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12463 2026-03-04 cs.RO

KILO-EKF: Koopman-Inspired Learned Observations Extended Kalman Filter

KILO-EKF:基于Koopman的学得观测扩展卡尔曼滤波器

Zi Cong Guo, James R. Forbes, Timothy D. Barfoot

机构 * University of Toronto Robotics Institute(多伦多大学机器人研究所) Department of Mechanical Engineering(机械工程系) McGill University(麦吉尔大学)

AI总结 KILO-EKF通过学习Koopman启发式测量模型,实现高效、准确的传感器校准与状态估计,适用于实时四旋翼定位任务。

Comments Submitted to IEEE/RSJ IROS. 8 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01948 2026-03-03 cs.CV

PreSight: Preoperative Outcome Prediction for Parkinson's Disease via Region-Prior Morphometry and Patient-Specific Weighting

PreSight:通过区域先验形态学和患者特异性加权进行帕金森病术前预后预测

Yand Wang, Chen Zhang, Lanyun Zhu, Yixin Chen, Qunbo Wang, Yutong Bai, Jurgen Germann, Yinghong Wen, Shuai Shao

机构 * Beijing Jiaotong University(北京交通大学) Nanyang Technological University(南洋理工大学) Institute of Medical Technology, Peking University(北京大学医学技术研究院) Beijing Tiantan Hospital, Capital Medical University(北京天坛医院) University Health Network, University of Toronto(多伦多大学健康网络) Suzhou Institute for Advanced Research, University of Science and Technology of China(中国科学技术大学苏州研究院)

AI总结 PreSight通过结合临床先验与区域自适应形态学,实现帕金森病术前预后预测,提升术后运动改善预测的准确性和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01485 2026-03-03 cs.CV

SCATR: Mitigating New Instance Suppression in LiDAR-based Tracking-by-Attention via Second Chance Assignment and Track Query Dropout

SCATR: 通过二次分配和轨迹查询丢弃缓解基于LiDAR的跟踪-注意力中的新实例抑制

Brian Cheong, Letian Wang, Sandro Papais, Steven L. Waslander

机构 * University of Toronto(多伦多大学)

AI总结 SCATR通过二次分配和轨迹查询丢弃缓解基于LiDAR的跟踪-注意力中的新实例抑制,实现性能提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01301 2026-03-03 cs.CV

When Does RL Help Medical VLMs? Disentangling Vision, SFT, and RL Gains

当RL帮助医疗VLMs时?解构视觉、SFT和RL增益

Ahmadreza Jeddi, Kimia Shaban, Negin Baghbanzadeh, Natasha Sharan, Abhishek Moturu, Elham Dolatabadi, Babak Taati

机构 * University of Toronto, Canada(多伦多大学) Vector Institute, Canada(向量研究所) KITE Research Institute, University Health Network, Canada(KITE研究机构) York University, Canada(约克大学)

AI总结 研究通过解构视觉、SFT和RL增益,发现RL在模型已有支持时最有效,SFT扩展支持使RL有效,提出边界意识的配方并实现强性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01160 2026-03-03 cs.AI cs.CL

Semantic XPath: Structured Agentic Memory Access for Conversational AI

语义XPath:面向对话AI的结构化代理内存访问

Yifan Simon Liu, Ruifan Wu, Liam Gallagher, Jiazhou Liang, Armin Toroghi, Scott Sanner

机构 * University of Toronto(多伦多大学) Vector Institute of Artificial Intelligence(人工智能向量研究所)

AI总结 本文提出语义XPath,一种基于树状结构的对话AI内存模块,通过提升性能和降低token消耗,为任务导向的对话系统提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22975 2026-03-03 cs.CV cs.GR cs.LG

VoMP: Predicting Volumetric Mechanical Property Fields

VoMP:预测体积机械属性场

Rishit Dagli, Donglai Xiang, Vismay Modi, Charles Loop, Clement Fuji Tsang, Anka He Chen, Anita Hu, Gavriel State, David I. W. Levin, Maria Shugrina

机构 * NVIDIA University of Toronto(多伦多大学)

AI总结 VoMP通过训练几何变换器预测3D物体的体积机械属性场,结合多视角特征和现实世界数据集,实现高精度和高速度的属性估计。

Comments Project Page and hi-res paper: https://research.nvidia.com/labs/sil/projects/vomp

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05132 2026-03-03 cs.CL cs.AI cs.LG

Training Large Language Models To Reason In Parallel With Global Forking Tokens

训练大型语言模型以并行推理与全局分叉标记

Sheng Jia, Xiao Wang, Shiva Prasad Kasiviswanathan

机构 * University of Toronto(多伦多大学) Amazon(亚马逊) Vector Institute(向量研究所)

AI总结 本文提出SSFT和GFPO方法,通过集合基于的损失和双射匹配,提升大型语言模型在并行推理中的多样性和准确性,从而在数学推理和代码生成任务中取得优于传统SFT的性能。

Comments Accepted at ICLR 2026

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026), https://openreview.net/forum?id=xBQvvkg4Wc

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00785 2026-03-03 quant-ph cs.AI

QANTIS: A Hardware-Validated Quantum Platform for POMDP Planning and Multi-Target Data Association

QANTIS:一种经过硬件验证的量子平台,用于POMDP规划和多目标数据关联

Bayram Yüksel Eker, Suayb S. Arslan, Özgür Nazlı, Mustafa Serhat Demirgil, Furkan Deligöz

机构 * Neura Parse Ltd.(Neura Parse有限公司) Department of Computer Engineering, Boğaziçi University(博耶奇大学计算机工程系) Faculty of Engineering, University of Toronto(多伦多大学工程学院) Istanbul Technical University(伊斯坦布尔技术大学)

AI总结 QANTIS通过量子算法和优化方法,实现了在超导硬件上对POMDP规划和多目标数据关联的高效解决,并验证了量子计算在实际应用中的可行性。

Comments 31 pages, 4 figures, 12 tables; 45-experiment hardware study on IBM Heron QPUs

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00492 2026-03-03 cs.CV cs.AI cs.GR cs.LG

ArtiFixer: Enhancing and Extending 3D Reconstruction with Auto-Regressive Diffusion Models

ArtiFixer:利用自回归扩散模型增强和扩展3D重建

Riccardo de Lutio, Tobias Fischer, Yen-Yu Chang, Yuxuan Zhang, Jay Zhangjie Wu, Xuanchi Ren, Tianchang Shen, Katarina Tothova, Zan Gojcic, Haithem Turki

机构 * NVIDIA NVIDIA Santa Clara USA(NVIDIA) NVIDIA Zurich Switzerland(NVIDIA) Cornell University(康奈尔大学) University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 ArtiFixer通过自回归扩散模型提升3D重建质量,解决现有方法在未观测区域的外推问题。

Comments Video results: https://artifixer2026.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00452 2026-03-03 cs.HC cs.AI

Texterial: A Text-as-Material Interaction Paradigm for LLM-Mediated Writing

Texterial: 一种基于文本作为材料的交互范式用于大语言模型辅助写作

Jocelyn Shen, Nicolai Marquardt, Hugo Romat, Ken Hinckley, Nathalie Riche, Fanny Chevalier

机构 * Microsoft Research(微软研究院) MIT Media Lab(麻省理工学院媒体实验室) University of Toronto(多伦多大学)

AI总结 Texterial提出一种将文本视为可塑材料的交互范式,通过手势塑形和植物生长的机制,提升大语言模型辅助写作的用户体验和操作灵活性。

Journal ref Proceedings of the 2026 ACM CHI Conference on Human Factors in Computing Systems (ACM CHI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00290 2026-03-03 cs.LG

Scalable Gaussian process modeling of parametrized spatio-temporal fields

可扩展的高斯过程建模:参数化时空场的数据驱动学习

Srinath Dama, Prasanth B. Nair

机构 * University of Toronto Institute for Aerospace Studies(多伦多大学航空航天研究所)

AI总结 本文提出了一种可扩展的高斯过程框架,结合深度乘积核,用于高精度参数化时空场的数据驱动学习,实现了高效的不确定性量化和高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08937 2026-03-03 cs.HC cs.AI cs.CY

When AI Gives Advice: Evaluating AI and Human Responses to Online Advice-Seeking for Well-Being

当AI提供建议:评估AI与人类对在线寻求幸福建议的反应

Harsh Kumar, Jasmine Chahal, Yinuo Zhao, Zeling Zhang, Annika Wei, Louis Tay, Ashton Anderson

机构 * University of Toronto(多伦多大学) Harvard University(哈佛大学) Purdue University(普渡大学)

AI总结 研究评估AI与人类在在线幸福建议寻求中的表现,发现LLMs在多项指标上优于人类,且人类建议可通过打磨与AI建议竞争。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23907 2026-03-02 cs.CV

Cora: Correspondence-aware image editing using few step diffusion

Cora: 基于对应关系的图像编辑使用少量步骤扩散

Amirhossein Alimohammadi, Aryan Mikaeili, Sauradip Nag, Negar Hassanpour, Andrea Tagliasacchi, Ali Mahdavi-Amiri

机构 * Simon Fraser University(西蒙弗雷泽大学) Huawei(华为) University of Toronto(多伦多大学) Google Deepmind(谷歌DeepMind)

AI总结 Cora通过引入对应关系感知的噪声校正和插值注意力图,实现了在少量步骤下精准的图像编辑,有效保持结构、纹理和身份,优于现有方法。

Comments Published in SIGGRAPH 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23391 2026-03-02 cs.LG

Detoxifying LLMs via Representation Erasure-Based Preference Optimization

通过基于表示擦除的偏好优化来净化大语言模型

Nazanin Mohammadi Sepahvand, Eleni Triantafillou, Hugo Larochelle, Doina Precup, Daniel M. Roy, Gintare Karolina Dziugaite

机构 * McGill University(麦吉尔大学) Mila Google DeepMind(谷歌DeepMind) University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 本文提出REPO方法,通过基于表示擦除的偏好优化,有效净化大语言模型,提升其对抗鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18612 2026-03-02 cs.LO cs.AI

Approximate SMT Counting Beyond Discrete Domains

超越离散域的近似SMT计数

Arijit Shaw, Kuldeep S. Meel

机构 * Chennai Mathematical Institute, India IAI, TCG CREST, Kolkata, India(钦奈数学研究所,印度 IAI,TCG CREST,科利尔,印度) Georgia Institute of Technology, USA University of Toronto, Canada(佐治亚理工学院,美国 蒙特利尔大学,加拿大)

AI总结 pact是一种用于混合公式的SMT模型计数器,通过哈希技术实现高效解计数,显著提升了性能。

Comments A preliminary version of this paper appears at the proceedings of Design Automation Conference (DAC) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23361 2026-02-27 cs.CV

VGG-T$^3$: Offline Feed-Forward 3D Reconstruction at Scale

VGG-T³:大规模离线前馈3D重建

Sven Elflein, Ruilong Li, Sérgio Agostinho, Zan Gojcic, Laura Leal-Taixé, Qunjie Zhou, Aljosa Osep

机构 * NVIDIA Vector Institute(向量研究所) University of Toronto(多伦多大学)

AI总结 VGG-T³通过测试时训练将变长键值空间蒸馏为固定大小的MLP,实现大规模离线前馈3D重建,速度比基线方法快11.6倍,并在重建精度和视觉定位能力上表现优异。

Comments CVPR 2026, Project page: https://research.nvidia.com/labs/dvl/projects/vgg-ttt

详情

展开后加载摘要…

URL PDF HTML 收藏