arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Toronto(多伦多大学)

共收录 1020
2607.20662 2026-07-28 cs.RO cond-mat.mtrl-sci 版本更新

Scalable Low-Cost Laboratory Automation: A Digital Twin-Integrated Robotic Platform for Autonomous Liquid Handling (RAINBOT)

可扩展的低成本实验室自动化:用于自主液体处理的数字孪生集成机器人平台(RAINBOTTM)

Mohamed Rami Ayeche, Souhil Sid, Ahyen Mostofa, Rehaan Hussain, Ali Shayesteh, Fadwa El Mellouhi

机构 * Acceleration Consortium, University of Toronto(多伦多大学加速联盟) AISCIA Informatics(AISCIA信息学公司) Hamad Bin Khalifa University (HBKU)(哈马德·本·哈利法大学)

AI总结 研究针对商业液体处理系统的局限,提出将消费级3D打印机改装为低成本液体处理机器人RAINBOTTM的方法,通过数字孪生实现远程监控,结合CEIDTM框架进行目标导向实验,成本低,建立了可访问的物理 - 虚拟实验室自动化框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08728 2026-07-28 cs.AI cs.CL cs.CV cs.LG 版本更新

Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery

人工智能数学推理:语言模型、神经符号系统与验证发现的综合综述

Syed Rifat Raiyan, Mohsinul Kabir, Hasan Mahmud, Md Kamrul Hasan, Sophia Ananiadou

机构 * University of California, Berkeley(加州大学伯克利分校) University of Cambridge(剑桥大学) University of Toronto(多伦多大学)

AI总结 本文综述了数学推理领域从早期规则系统到当代推理模型、多智能体系统及验证发现工作流的演变,沿非正式推理、形式推理、数学发现及推理技术四轴组织,并评估了基准测试、失败模式及未来方向。

Comments Under review, 47 pages, 14 figures, 22 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15357 2026-07-28 cs.CV cs.LG 版本更新

MaskAttn-SDXL: Controllable Region-Level Text-To-Image Generation

MaskAttn-SDXL:可控区域级文本到图像生成

Yu Chang, Jiahao Chen, Anzhe Cheng, Paul Bogdan

机构 * University of Southern California(南加州大学) University of Toronto(多伦多大学)

AI总结 本文提出MaskAttn-SDXL模块,通过在softmax前注入token条件空间门控,解决扩散模型在多物体生成中的全局协调和可靠性问题,无需改变SDXL流程。

Comments Published in the 2026 International Joint Conference on Neural Networks (IJCNN 2026)

Journal ref Proceedings of the 2026 International Joint Conference on Neural Networks (IJCNN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02458 2026-07-28 cs.CY cs.AI cs.ET 版本更新

Statistical realism is not evidence that LLMs can estimate treatment effects in social science experiments

当模拟看起来正确但因果效应出错:大型语言模型作为行为模拟器

Zonghan Li, Feng Ji

机构 * University of Toronto(多伦多大学)

AI总结 研究评估了大型语言模型在气候心理学干预中的行为模拟能力,发现描述性拟合不等于因果准确性,不同干预逻辑和结果类型导致误差差异,提示依赖描述性拟合可能误导干预效果结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28963 2026-07-28 cs.RO cs.AI cs.CV cs.LG 版本更新

AutoWorld: Learning Multi-Agent Traffic Simulation with Self-Supervised World Models

AutoWorld: 通过自监督世界模型扩展多智能体交通仿真

Mozhgan Pourkeshavarz, Tianran Liu, Nicholas Rhinehart

机构 * University of Toronto(多伦多大学)

AI总结 本文提出AutoWorld框架,利用未标记的LiDAR数据自监督学习世界模型,提升多智能体交通仿真的真实感与性能,实验表明未标记数据能有效提升仿真效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04260 2026-07-28 cs.HC cs.AI 版本更新

Steerable Chatbots: Exploring Personalization Control Interfaces via LLM Activation Steering

可控聊天机器人:通过大语言模型激活引导探索个性化控制界面

Jessica Y. Bo, Tianyu Xu, Ishan Chatterjee, Katrina Passarella-Ward, Achin Kulshrestha, D Shin

机构 * University of Toronto(多伦多大学) Google AR(谷歌AR)

AI总结 研究探索可控聊天机器人范式,通过激活引导实现个性化,利用线性标量控制偏好表达强度,设计三种界面原型并进行用户研究,发现其在冷启动任务中比单独提示更能契合用户偏好,揭示了相关个性化方面的不同价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21839 2026-07-27 cs.CR cs.LG 新提交

Certified in Theory, Broken in Practice: Assumption Gaps in Cryptographic Model Certification

理论上可认证,实践中却被破解:密码学模型认证中的假设差距

Carter Luck, Olive Franzese-McLaughlin, Elisaweta Masserova, Akira Takahashi, Antigoni Polychroniadou, Nicolas Papernot

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Vector Institute & University of Toronto(向量研究所及多伦多大学) Carnegie Mellon University(卡内基梅隆大学) J.P.Morgan AI Research & AlgoCRYPT CoE(摩根大通人工智能研究及AlgoCRYPT中心) University of Toronto(多伦多大学)

AI总结 研究密码学模型认证中现有安全定义与实际应用的差距,通过精心设计训练数据可攻击相关认证方案。为此形式化严格安全概念,引入通用协议模板,为设计安全隐私保护的机器学习审计协议提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21758 2026-07-27 cs.CL 新提交

Humanly: A Configurable and Traceable Environment for Human-AI Collaborative Writing

Humanly:一个用于人机协作写作的可配置且可追溯的环境

Shenzhe Zhu, Haoqian Zhang, Xu Yang, Jingyu Tang, Yi Nian, Xiaoxue Du, Shu Yang, Alex Pentland, Joachim Baumann, Jiaxin Pei

机构 * UT Austin(德克萨斯大学奥斯汀分校) University of Toronto(多伦多大学) Stanford University(斯坦福大学) MIT(麻省理工学院) USC(南加州大学) KAUST(阿卜杜拉国王科技大学)

AI总结 研究针对人机协作写作难以判断创作过程的问题,提出Humanly写作平台,用户能配置环境,平台记录活动与辅助,可打包会话生成证书,支持多种场景,经研究验证对各角色有帮助且能区分打字方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19212 2026-07-27 cs.CL cs.AI cs.CY 版本更新

When Ethics and Payoffs Diverge: LLM Agents in Morally Charged Social Dilemmas

当伦理与收益相悖时:道德两难情境下的大语言模型智能体

Steffen Backmann, David Guzman Piedrahita, Terry Jingchen Zhang, Emanuel Tewolde, Rada Mihalcea, Bernhard Schölkopf, Zhijing Jin

机构 * ETH Zürich(苏黎世联邦理工学院) University of Zurich(苏黎世大学) Carnegie Mellon University(卡内基梅隆大学) University of Michigan(密歇根大学) Max Planck Institute for Intelligent Systems, Tübingen(图宾根人工智能研究所) University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 研究道德要求与利润激励冲突时LLMs在道德两难博弈中的行为,引入\msim评估九个模型,通过ATEs估计因果效应、分析推理轨迹,发现模型道德行为有情境脆弱性,揭示了部署风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20764 2026-07-24 cs.AI 新提交

ArbiGraph: Arbitrarily Scalable Verifiable Task Graphs for Evaluating Context Management

ArbiGraph:用于评估上下文管理的任意可扩展可验证任务图

Pavel Golikov, Evgenii Opryshko, Gennady Pekhimenko, Mark C. Jeffrey

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 ArbiGraph作为基准生成器,将任务表示为带Python求解器的自然语言问题,通过类型化中间状态组合任务。用多种任务类别实例化并评估智能体,发现其在孤立任务和复杂相关任务上表现不同,揭示了单任务评估无法发现的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20207 2026-07-23 cs.RO 新提交

SeededGrasp: Language-Guided Grasping in Complex Scenes with Multiple Embodiments

SeededGrasp:复杂场景中多实体语言引导抓取

Yang Xu, Gurpreet Singh Mukker, Raymond Wang, Jasper Gerigk, Maria Attarian, Igor Gilitschenski

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) University of British Columbia(英属哥伦比亚大学) Google Deepmind(谷歌DeepMind)

AI总结 针对复杂场景中机器人抓取问题,提出 SeededGrasp 框架,通过 VLM 预测种子点,结合轻量级抓取生成模型,解耦语义与几何执行,无需端到端训练,发布多实体数据集,实验证明该方法优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19779 2026-07-23 cs.CV 新提交

Frequency-Hierarchical Active k-Space Sampling for Diagnostic MRI

用于诊断性MRI的频率分层主动k空间采样

Ruru Xu, Kian Anvari Hamedani, Zhikai Yang, Ilkay Oksuz

机构 * Istanbul Technical University(伊斯坦布尔技术大学) University of Toronto(多伦多大学) Sunnybrook Research Institute(桑尼布鲁克研究所) KTH Royal Institute of Technology(皇家理工学院)

AI总结 研究针对MRI加速采样中不同频率信息处理难题,提出HieraSample框架,通过余弦退火课程和基于Mamba的策略,在不同加速倍数下实现高效采样,在fastMRI+膝盖基准测试中提升了ACL诊断性能。

Comments EMA4MICCAI 2026: The 2nd MICCAI Workshop on Efficient Medical AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19575 2026-07-23 cs.CV 新提交

VQ-Transplant: Efficient VQ-Module Integration for Pre-trained Visual Tokenizers

VQ-Transplant:用于预训练视觉分词器的高效VQ模块集成

Xianghong Fang, Yuan Yuan, Dehan Kong, Tim G. J. Rudner

机构 * University of Toronto(多伦多大学) Boston College(波士顿学院)

AI总结 研究针对训练VQ模块资源需求大的问题,提出VQ-Transplant框架,可将新VQ模块集成到预训练分词器,保留编码器-解码器参数,引入轻量级解码器适应策略,降低训练成本95%,在工业级模型上获高重建保真度,推动量化研究发展。

Comments 20 pages, 9 figures and 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14575 2026-07-23 cs.LG cs.AI stat.ME stat.ML 版本更新

Generative Augmented Inference of LLM-generated Data for Market Research: Theory and Empirical Evidence

生成式增强推断

Cheng Lu, Mengxin Wang, Dennis J. Zhang, Heng Zhang

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Toronto(多伦多大学)

AI总结 提出生成式增强推断(GAI)框架,将AI输出视为学习真实标签的高维信息特征而非代理,通过非参数方法建模,实现人机数据联合的一致估计和有效推断,在随机标注下渐近效率严格优于仅用人类数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12037 2026-07-23 cs.LG 版本更新

Frequentist Consistency of Prior-Data Fitted Networks for Causal Inference

用于因果推断的先验数据拟合网络的频率派一致性

Valentyn Melnychuk, Vahid Balazadeh, Stefan Feuerriegel, Rahul G. Krishnan

机构 * LMU Munich \& Munich Center for Machine Learning (MCML), Munich, Germany University of Toronto \& Vector Institute, Toronto, Canada

AI总结 本文分析基于先验数据拟合网络(PFN)的平均处理效应(ATE)估计量的频率派一致性,发现其存在先验诱导的混淆偏差,并提出基于一步后验校正(OSPC)的校准方法,结合鞅后验恢复功能干扰后验,从而恢复频率派一致性并实现半参数Bernstein-von Mises定理。

Journal ref Proceedings of the 43-rd International Conference on Machine Learning, Seoul, South Korea, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19089 2026-07-22 cs.LG q-bio.QM 新提交

An unsupervised clustering analysis of breast cancer data derived from electronic health records enhanced through UMAP dimensionality reduction

通过UMAP降维增强的电子健康记录中乳腺癌数据的无监督聚类分析

Davide Chicco, Nicoletta Benvenuto

机构 * Dipartimento di Informatica Sistemistica e Comunicazione, Università di Milano-Bicocca(信息系统与通信系,米兰比可卡大学) Institute of Health Policy Management and Evaluation, University of Toronto(卫生政策管理与评估研究所,多伦多大学)

AI总结 研究利用电子健康记录中的乳腺癌数据,先采用DBSCAN密度聚类法,又通过UMAP降维增强效果,用三个统计指标评估聚类结果,证实了UMAP与DBSCAN结合用于该数据聚类的有效性,为医学解读患者组提供了支持。

Comments Accepted at the CIBB 2026 conference ( https://cibb2026.teralab.ai/ )

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18754 2026-07-22 cs.AI cs.CL 新提交

AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents

AgentDebugX:用于大语言模型代理中故障可观测性、归因和恢复的开源工具包

Kunlun Zhu, Xuyan Ye, Zhiguang Han, Yuchen Zhao, Bingxuan Li, Weijia Zhang, Muxin Tian, Xiangru Tang, Pan Lu, James Zou, Jiaxuan You, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Toronto(多伦多大学) Google(谷歌公司) Stanford University(斯坦福大学)

AI总结 研究大语言模型代理故障调试难题,提出开源框架AgentDebugX,其核心DeepDebug通过多轮诊断定位根源,在基准测试中表现出色,能修复更多失败任务,还通过多种方式公开工作流程并提供错误中心。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26408 2026-07-22 cs.RO 版本更新

Exploring the Intrinsic Geometry of Diffusion Models with Constrained Inverse Kinematics

探索扩散模型在约束逆运动学中的内在几何结构

Miguel Angel Rogel Garcia, Phone Thiha Kyaw, Jonathan Kelly

机构 * Institute for Aerospace Studies, University of Toronto(航空航天研究所以及多伦多大学)

AI总结 通过约束逆运动学问题,研究扩散模型能否恢复数据流形的内在几何结构,实验表明模型得分函数恢复的内在维度与解析自由度匹配,且潜在空间线性插值保持约束流形结构。

Comments In Proceedings of the Robotics: Science and Systems (RSS) 2026 Workshop on Diffusion for Robot Learning, Sydney, Australia, July 17, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08571 2026-07-22 cs.LG cs.AI cs.CL 版本更新

Robust Reasoning Benchmark

鲁棒推理基准

Pavel Golikov, Evgenii Opryshko, Gennady Pekhimenko, Mark C. Jeffrey

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 本研究提出鲁棒推理基准(RRB),通过13种确定性文本扰动评估8种前沿模型,发现Claude在面对变换提示时表现出异常拒绝行为,而开放权重模型在结构噪声下出现多种失败模式,如认知冲刷、分词崩溃和推理崩溃,导致平均准确率下降高达54%。研究进一步发现由模型自身推理链引起的注意力稀释问题,并提出Intra-Query Attention Dilution概念,表明中间推理步骤会污染标准密集注意力机制,未来架构需整合显式上下文重置以实现可靠推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21014 2026-07-22 cs.LG cs.CL 版本更新

CLT-Forge: A Scalable Library for Cross-Layer Transcoders and Attribution Graphs

CLT-Forge:一种可扩展的跨层转码器和归因图库

Florent Draye, Vedant Palit, Abir Harrasse, Tung-Yu Wu, Jiarui Liu, Punya Syon Pandey, Roderick Wu, Chih-Hao Hsu, Terry Jingchen Zhang, Zhijing Jin, Bernhard Schölkopf

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Jinesis AI Lab(Jinesis人工智能实验室) University of Toronto(多伦多大学) Vector Institute(向量研究所) CMU(卡内基梅隆大学) EuroSafeAI ELLIS Institute Tübingen(图宾根ELLIS研究所)

AI总结 本文提出CLT-Forge库,通过分布式训练、模型分片和压缩激活缓存提升跨层转码器的可扩展性,提供统一的可解释性流程和可视化接口,解决归因图的冗余问题。

Comments 9 pages, 7 figures, 1 table. Code: https://github.com/LLM-Interp/CLT-Forge. Demonstration video: https://youtu.be/6ptrrLawTl8

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04843 2026-07-22 cs.AI 版本更新

Fluid Reasoning Representations

推理模型中的流体表示

Dmitrii Kharlapenko, Terry Jingchen Zhang, Arth Singh, Alessandro Stolfo, Arthur Conmy, Mrinmaya Sachan, Zhijing Jin

机构 * ETH Zurich(苏黎世联邦理工学院) University of Toronto(多伦多大学)

AI总结 研究揭示了推理模型通过上下文细化令牌表示提升抽象问题解决能力的机制,提出流体推理表示概念。

Comments EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16727 2026-07-22 cs.CV cs.LG 版本更新

Pain in 3D: Generating Controllable Synthetic Faces for Automated Pain Assessment

3D 中的疼痛:生成用于自动疼痛评估的可控合成面部

Xin Lei Lin, Soroush Mehraban, Abhishek Moturu, Babak Taati

机构 * Vector Institute(向量研究所) KITE Research Institute(KITE研究机构) University Health Network(大学健康网络) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) Department of Medical Imaging, University of Toronto(多伦多大学医学成像系) Institute of Biomedical Engineering, University of Toronto(多伦多大学生物医学工程研究所)

AI总结 研究针对面部表情自动疼痛评估面临的数据稀缺等问题,提出3DPain数据集及三阶段框架合成多视图面部,还引入ViTPain框架,为可推广的自动疼痛评估建立了可控、多样且基于临床的基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18114 2026-07-21 cs.CL cs.AI cs.LG 新提交

How Does Alignment Tuning Shape Representations of Sycophancy and Related Cue-Induced Biases in LLMs?

对齐调整如何塑造大语言模型中谄媚及相关线索诱导偏差的表征?

Prakhar Gupta, Terry Jingchen Zhang, Florent Draye, Bernhard Schölkopf, Zhijing Jin

机构 * University of Michigan(密歇根大学) Jinesis Lab, University of Toronto & Vector Institute(多伦多大学Jinesis实验室和向量研究所) Max-Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所)

AI总结 研究大语言模型中谄媚及相关线索诱导偏差的位置,通过从隐藏状态提取偏差方向并经探测等三种方法三角测量,发现易感性由对齐调整而非预训练导致,还能适度去偏,偏差是对齐调整安装的不同因果活性方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17467 2026-07-21 cs.CV cs.LG 新提交

DA-MergeLoRA: Hypernetwork-Based LoRA Merging for Few-Shot Test-Time Domain Adaptation

DA-MergeLoRA:基于超网络的LoRA合并用于少样本测试时的域适应

Siobhan Reid, Zhixiang Chi, Li Gu, Omid Reza Heidari, Ziqiang Wang, Yang Wang

机构 * Concordia University(康考迪亚大学) University of Toronto(多伦多大学) Mila – Quebec AI Institute(米拉-魁北克人工智能研究所)

AI总结 研究少样本测试时的域适应问题,提出DA-MergeLoRA框架,将LoRA微调与模型合并相结合,通过元学习训练超网络生成合并因子,在多个域适应数据集上取得最优性能。

Comments ECCV 2026, Code: https://github.com/nahbois4321/DA-MergeLoRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15407 2026-07-20 math.NA cs.AI cs.NA 版本更新

Energy-based Transport for Amortized Bayesian Inference

平均能量基于的贝叶斯推断

Ricardo Baptista, Hojjat Kaveh, Andrew M. Stuart

机构 * California Institute of Technology(加州理工学院) University of Toronto(多伦多大学)

AI总结 本文研究了在仅能获取参数和观测联合分布样本的情况下,非线性逆问题的平均能量基于的贝叶斯推断方法,提出了一种基于传输的方法,通过学习观测依赖的映射来近似后验分布,避免了传统方法的计算开销。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15246 2026-07-17 cs.CV 新提交

ARMOR++: Agentic Orchestration of a Multi-Domain Primitive Set for Transferable Attacks on Deepfake Detectors

ARMOR++:用于对深度伪造检测器进行可转移攻击的多域原语集的智能编排

Christos Korgialas, Gabriel Lee Jun Rong, Dion Jia Xu Ho, Pai Chet Ng, Xiaoxiao Miao, Konstantinos N. Plataniotis

机构 * Department of Informatics, Aristotle University of Thessaloniki(塞萨洛尼基亚里士多德大学信息学系) Infocomm Technology Cluster, Singapore Institute of Technology(新加坡科技学院信息通信技术集群) Department of Applied Physics and Applied Mathematics, Columbia University(哥伦比亚大学应用物理与应用数学系) Division of Natural and Applied Sciences, Duke Kunshan University(昆山杜克大学自然科学与应用科学部) Department of Electrical and Computer Engineering, University of Toronto(多伦多大学电气与计算机工程系)

AI总结 研究针对深度伪造检测器在黑盒对抗转移下可靠性下降问题,提出ARMOR++多智能体框架,利用视觉与语言模型提供语义先验并编排原语选择等,整合多种原语有效针对异构偏差,实验表明其性能优于现有基线,凸显当前检测器可靠性差距及智能编排的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14995 2026-07-17 cs.LG q-bio.QM 新提交

Multimodal Semantic-Aware Contrastive Learning For False Negative Mitigation in 3D Medical Imaging

用于减轻 3D 医学成像中假阴性的多模态语义感知对比学习

Sara Ketabi, Matthias W. Wagner, Cynthia Hawkins, Uri Tabori, Birgit Betina Ertl-Wagner, Farzad Khalvati

机构 * University of Toronto(多伦多大学) The Hospital for Sick Children(病童医院) Vector Institute(向量研究所) University Hospital Augsburg(奥格斯堡大学医院)

AI总结 研究针对3D医学成像中假阴性问题,提出多模态语义感知对比学习框架MseaCL,通过纳入放射学报告语义相似性作指导信号,经实验验证该框架用于预训练可提升下游任务表现,如儿科脑肿瘤分子分类AUC至少增22.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03747 2026-07-17 cs.RO 版本更新

Observability-Aware Control for Quadrotor Formation Flight with Range-only Measurement

具有仅距离测量的四旋翼编队飞行的可观测性意识控制

H S Helson Go, Ching Lok Chong, Longhao Qian, Hugh H. -T. Liu

机构 * Institute for Aerospace Studies, University of Toronto(多伦多大学航空航天研究 institute)

AI总结 本文提出一种基于STLOG的OPC控制器,用于提升四旋翼编队飞行在仅距离测量下的可观测性与定位鲁棒性。

Comments 37 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13431 2026-07-16 cs.LG cs.AI cs.CL 新提交

Discrete Diffusion Models: A Unified Framework from Tokenization to Generation

离散扩散模型:从词元化到生成的统一框架

Ye Yuan, Weien Li, Rui Song, Zeyu Li, Haochen Liu, Xiangyu Kong, Zixuan Dong, Linfeng Du, Zipeng Sun, Weixu Zhang, Jiaxin Huang, Changjiang Han, Yonghan Yang, Zichen Zhao, Xiuyuan Hu, Haolun Wu, Yankai Chen, Fengran Mo, Jikun Kang, Bowei He, Philip S. Yu, Xue Liu

机构 * McGill University(麦吉尔大学) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) University of Cambridge(剑桥大学) University of Toronto(多伦多大学) MBZUAI - Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Tsinghua University(清华大学) Rochester Institute of Technology(罗彻斯特理工学院) Salesforce(Salesforce公司) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

AI总结 研究离散扩散模型,引入统一框架从离散状态空间构建审视该模型,让现有公式成为共同设计空间实例,揭示训练、推理等方面权衡,为未来研究提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08016 2026-07-16 cs.CV cs.GR 版本更新

LightCrafter: PBR-Conditioned Video Diffusion Refinement for Controllable and Consistent Relighting

LightCrafter:用于可控且一致的重光照的PBR条件视频扩散细化

Zixin Guo, Yehonathan Litman, Yifeng He, John Miller, Chuhan Chen, Deva Ramanan

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Toronto(多伦多大学) Bosch Research(博世研究)

AI总结 研究视频重光照问题,提出LightCrafter混合管道,将其重表述为代理视频转换,利用PBR渲染并结合光度先验,在真实世界重光照基准上优于现有技术,还贡献合成基准及相关资源。

Comments Project page: https://www.zixinguo.me/lightcrafter

详情

展开后加载摘要…

URL PDF HTML 收藏