arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

共收录 2370
2603.09109 2026-03-12 cs.CV cs.AI

VIVID-Med: LLM-Supervised Structured Pretraining for Deployable Medical ViTs

VIVID-Med: 基于LLM监督的结构化预训练用于可部署的医学ViT

Xiyao Wang, Xiaoyu Tan, Yang Dai, Yuxuan Fu, Shuo Li, Xihe Qiu

机构 * Shanghai University of Engineering Science(上海工程技术大学) National University of Singapore(新加坡国立大学) Case Western Reserve University(凯斯西储大学)

AI总结 VIVID-Med通过LLM监督的结构化预训练方法,实现轻量级可部署的医学ViT模型,在医学图像分析中表现出高效和强泛化能力。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23162 2026-03-12 cs.RO cs.CV

Cosmos-H-Surgical: Learning Surgical Robot Policies from Videos via World Modeling

Cosmos-H-Surgical: 通过世界建模学习手术机器人策略

Yufan He, Pengfei Guo, Mengya Xu, Zhaoshuo Li, Andriy Myronenko, Dillan Imans, Bingjie Liu, Dongren Yang, Mingxue Gu, Yongnan Ji, Yueming Jin, Ren Zhao, Baiyong Shen, Daguang Xu

机构 * NVIDIA The Chinese University of Hong Kong(香港中文大学) Sung Kyun Kwan University(全州大学) Wenzhou Medical University(温州医学院) National University of Singapore(新加坡国立大学) Ruijin Hospital(瑞金医院)

AI总结 本文提出通过世界建模学习手术机器人策略,利用合成数据和逆动力学模型提升自主手术能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20325 2026-03-12 cs.CV

AD-R1: Closed-Loop Reinforcement Learning for End-to-End Autonomous Driving with Impartial World Models

AD-R1: 闭环强化学习用于端到端自动驾驶的中立世界模型

Tianyi Yan, Tao Tang, Xingtai Gui, Yongkang Li, Jiasen Zhesng, Weiyao Huang, Lingdong Kong, Wencheng Han, Xia Zhou, Xueyang Zhang, Yifei Zhan, Kun Zhan, Cheng-zhong Xu, Jianbing Shen

机构 * SKL-IOTSC, University of Macau(SKL-IOTSC,澳门大学) Li Auto Inc. Sun Yat-sen University(中山大学) Huazhong University of Science and Technology(华中科技大学) Northwestern University(西北大学) National University of Singapore(新加坡国立大学)

AI总结 AD-R1通过引入中立世界模型和反事实合成技术,提升自动驾驶系统在危险预测和安全控制方面的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09496 2026-03-11 cs.CV

SurgFed: Language-guided Multi-Task Federated Learning for Surgical Video Understanding

SurgFed: 基于语言引导的多任务联邦学习用于手术视频理解

Zheng Fang, Ziwei Niu, Ziyue Wang, Zhu Zhuo, Haofeng Liu, Shuyang Qian, Jun Xia, Yueming Jin

机构 * National University of Singapore(国立新加坡大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

AI总结 SurgFed通过语言引导的通道选择和超聚合方法,提升手术视频多任务联邦学习的跨站点和跨任务适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11648 2026-03-11 cs.LG cs.AI

Lightweight Time Series Data Valuation on Time Series Foundation Models via In-Context Finetuning

基于上下文微调的轻量时间序列数据估值方法

Shunyu Wu, Tianyue Li, Yixuan Leng, Jingyi Suo, Jian Lou, Dan Li, See-Kiong Ng

机构 * Sun Yat-sen University State Key Laboratory of Internet Architecture(中山大学互联网架构国家重点实验室) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出LTSV方法,通过上下文微调实现轻量时间序列数据估值,有效解决传统方法的计算瓶颈和时间依赖性问题。

Comments Accepted as a full paper at DASFAA 2026 (The 31st International Conference on Database Systems for Advanced Applications)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17439 2026-03-11 cs.RO cs.AI cs.CV cs.LG

From Spatial to Actions: Grounding Vision-Language-Action Model in Spatial Foundation Priors

从空间到动作:在空间先验基础上构建视觉-语言-动作模型

Zhengshen Zhang, Hao Li, Yalun Dai, Zhengbang Zhu, Lei Zhou, Chenchen Liu, Dong Wang, Francis E. H. Tay, Sijin Chen, Ziwei Liu, Yuxiao Liu, Xinghang Li, Pan Zhou

机构 * ByteDance Seed(字节跳动种子) NUS(新加坡国立大学) NTU(国立技术大学) THU(清华大学) SMU(南方大学)

AI总结 FALCON通过引入丰富的3D空间标记,改进了视觉-语言-动作模型的空间表示、模态可转移性和对齐能力,在多个基准和现实任务中取得最佳性能。

Comments Accepted at ICLR 2026. Project page: https://falcon-vla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01290 2026-03-11 cs.LG cs.AI

Rating Quality of Diverse Time Series Data by Meta-learning from LLM Judgment

通过LLM判断对异质时间序列数据进行质量评级

Shunyu Wu, Dan Li, Wenjie Feng, Haozheng Ye, Jian Lou, See-Kiong Ng

机构 * Sun Yat-sen University(中山大学) State Key Laboratory of Al Safety(人工智能安全国家重点实验室) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出TSRating框架,利用LLM判断对异质时间序列数据进行质量评级,通过元学习提升跨领域适应性。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08983 2026-03-11 cs.RO cs.CV

SurgCalib: Gaussian Splatting-Based Hand-Eye Calibration for Robot-Assisted Minimally Invasive Surgery

SurgCalib: 基于高斯点散的机器人辅助微创手术手眼标定

Zijian Wu, Shuojue Yang, Yu Chung Lee, Eitan Prisman, Yueming Jin, Septimiu E. Salcudean

机构 * Robotics and Control Laboratory, University of British Columbia(机器人与控制实验室,不列颠哥伦比亚大学) Department of Biomedical Engineering, National University of Singapore(生物医学工程系,新加坡国立大学) Division of Otolaryngology – Head and Neck Surgery, University of British Columbia(耳鼻喉科–头颈外科部,不列颠哥伦比亚大学)

AI总结 SurgCalib通过基于高斯点散的无标记方法实现手术机器人手眼标定,提升手术精度与无菌环境合规性。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08800 2026-03-11 cs.CV

Granulon: Awakening Pixel-Level Visual Encoders with Adaptive Multi-Granularity Semantics for MLLM

Granulon: 通过自适应多粒度语义唤醒像素级视觉编码器以实现MLLM

Junyuan Mao, Qiankun Li, Linghao Meng, Zhicheng He, Xinliang Zhou, Kun Wang, Yang Liu, Yueming Jin

机构 * National University of Singapore(国立新加坡大学) Nanyang Technological University(南洋理工大学)

AI总结 Granulon通过自适应多粒度语义增强,提升多模态大语言模型的像素级视觉理解和多粒度推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08455 2026-03-10 cs.AI cs.LG

The Boiling Frog Threshold: Criticality and Blindness in World Model-Based Anomaly Detection Under Gradual Drift

青蛙沸腾阈值:世界模型基于异常检测中的临界性与盲目性

Zhe Hong

机构 * National University of Singapore(新加坡国立大学)

AI总结 研究揭示了世界模型在异常检测中的临界阈值,发现检测阈值受噪声底座、检测器和环境动态的三重交互影响,且正弦漂移无法被检测到。

Comments 10 pages, 5 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08271 2026-03-10 cs.CV

Prototype-Guided Concept Erasure in Diffusion Models

扩散模型中的原型引导概念擦除

Yuze Cai, Jiahao Lu, Hongxiang Shi, Yichao Zhou, Hong Lu

机构 * Fudan University(复旦大学) National University of Singapore(国立新加坡大学)

AI总结 本文提出通过原型引导的方法在扩散模型中实现更可靠的概念擦除,尤其针对广义概念如性与暴力,提升图像生成的安全性和可控性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08136 2026-03-10 cs.RO

POIROT: Investigating Direct Tangible vs. Digitally Mediated Interaction and Attitude Moderation in Multi-party Murder Mystery Games

POIROT:探讨多党谋杀谜游戏中的直接实体交互与数字中介交互及态度调节

Wen Chen, Rongxi Chen, Shankai Chen, Huiyang Gong, Minghui Guo, Yingri Xu, Xintong Wu, Xinyi Fu

机构 * Tsinghua University(清华大学) University of Pennsylvania(宾夕法尼亚大学) Syracuse University(Syracuse大学) National University of Singapore(新加坡国立大学) Royal College of Art(皇家艺术学院)

AI总结 POIROT研究通过实验揭示,用户对机器人的负面态度影响其在多党谋杀谜游戏中的沉浸体验,表明交互方式需根据用户倾向进行适应性调整。

Comments 16 pages, 7 figures. Accepted to the 21st ACM/IEEE International Conference on Human-Robot Interaction (HRI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08122 2026-03-10 cs.RO

Towards Human-Like Manipulation through RL-Augmented Teleoperation and Mixture-of-Dexterous-Experts VLA

通过强化学习增强的遥控操作与混合的灵巧专家VLA实现人机操作

Tutian Tang, Xingyu Ji, Wanli Xing, Ce Hao, Wenqiang Xu, Lin Shao, Cewu Lu, Qiaojun Yu, Jiangmiao Pang, Kaifeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Sharpa Shanghai AI Lab(上海人工智能实验室) Zhongguancun Academy(中关村学院) National University of Singapore(新加坡国立大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出IMCopilot和MoDE-VLA框架,通过强化学习和多模态融合提升机器人灵巧操作能力,实现接触丰富的手内任务性能提升。

Comments Project Homepage: https://sites.google.com/view/mode-vla

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08068 2026-03-10 cs.AI

In-Context Reinforcement Learning for Tool Use in Large Language Models

上下文强化学习用于大型语言模型中的工具使用

Yaoqi Ye, Yiran Zhao, Keyu Duan, Zeyu Zheng, Kenji Kawaguchi, Cihang Xie, Michael Qizhe Shieh

机构 * National University of Singapore(新加坡国立大学) Salesforce AI Research(Salesforce AI研究) University of California Berkeley(加州大学伯克利分校) University of California, Santa Cruz(加州大学圣克ruz分校)

AI总结 本文提出ICRL框架,通过强化学习无需微调即可实现大型语言模型的工具使用能力,实验显示其在推理和工具任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08059 2026-03-10 cs.CV cs.AI

ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning

ImageEdit-R1: 通过强化学习提升多智能体图像编辑

Yiran Zhao, Yaoqi Ye, Xiang Liu, Michael Qizhe Shieh, Trung Bui

机构 * National University of Singapore(新加坡国立大学) Adobe Research(Adobe研究)

AI总结 ImageEdit-R1通过强化学习实现多智能体图像编辑,提升复杂指令下的编辑效果与上下文感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08030 2026-03-10 cs.CV

QualiTeacher: Quality-Conditioned Pseudo-Labeling for Real-World Image Restoration

QualiTeacher: 基于质量条件的伪标签用于现实世界图像恢复

Fengyang Xiao, Jingjia Feng, Peng Hu, Dingming Zhang, Lei Xu, Guanyi Qin, Lu Li, Chunming He, Sina Farsiu

机构 * Duke University Tsinghua University \'Ecole Polytechnique F\'ed\'erale de Lausanne (EPFL) National University of Singapore Sun Yat - sen University or

AI总结 QualiTeacher通过条件化伪标签质量提升图像恢复质量,解决传统方法中伪标签质量与模型泛化能力的矛盾。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07988 2026-03-10 cs.CV cs.GR cs.MA cs.RO

TeamHOI: Learning a Unified Policy for Cooperative Human-Object Interactions with Any Team Size

TeamHOI: 学习一种统一的策略以处理任意团队规模的协作人-物体交互

Stefan Lionar, Gim Hee Lee

机构 * Garena Sea AI Lab National University of Singapore(新加坡国立大学)

AI总结 TeamHOI通过统一策略实现任意团队规模的协作人-物体交互,采用Transformer网络和对抗运动先验策略提升协作行为的物理合理性和多样性。

Comments CVPR 2026. Project page: https://splionar.github.io/TeamHOI/ Code: https://github.com/sail-sg/TeamHOI

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07650 2026-03-10 cs.RO

Multi-Agent Off-World Exploration for Sparse Evidence Discovery via Gaussian Belief Mapping and Dual-Domain Coverage

多智能体非世界探索用于稀疏证据发现的高斯信念映射与双域覆盖

Zhuoran Qiao, Tianxin Hu, Thien-Minh Nguyen, Shenghai Yuan

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) The University of Queensland(昆士兰大学)

AI总结 本文提出基于高斯信念映射和双域覆盖的多智能体路径规划框架,用于非世界稀疏证据发现,通过平衡信息获取与操作安全,提升探索效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00586 2026-03-10 cs.CV

WildActor: Unconstrained Identity-Preserving Video Generation

WildActor: 无约束身份保持视频生成

Qin Guo, Tianyu Yang, Xuanhua He, Fei Shen, Yong Zhang, Zhuoliang Kang, Xiaoming Wei, Dan Xu

机构 * The Hong Kong University of Science(香港科学与技术大学) National University of Singapore(新加坡国立大学)

AI总结 WildActor通过不对称注意力机制和视点自适应采样策略,在无约束视角下实现身份保持的人类视频生成。

Comments Project Page: https://wildactor.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18064 2026-03-10 cs.CV

3DMedAgent: Unified Perception-to-Understanding for 3D Medical Analysis

3DMedAgent:面向3D医学分析的统一感知-理解框架

Ziyue Wang, Linghan Cai, Chang Han Low, Haofeng Liu, Junde Wu, Jingyu Wang, Rui Wang, Lei Song, Jiang Bian, Jingjing Fu, Yueming Jin

机构 * National University of Singapore(新加坡国立大学) Microsoft Research(微软研究院) TUD Dresden University of Technology(德累斯顿技术大学) University of Oxford(牛津大学)

AI总结 3DMedAgent通过统一框架实现2D MLLMs在3D医学分析中的高效处理,无需3D特定微调,提升3D医学图像的感知与理解能力。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13824 2026-03-10 cs.LG

ELSA: Efficient LLM-Centric Split Aggregation for Privacy-Aware Hierarchical Federated Learning over the Network Edge

ELSA: 面向网络边缘的隐私感知分层联邦学习的高效LLM中心分割聚合

Xiaohong Yang, Tong Xie, Minghui Liwang, Chikai Shang, Yang Lu, Zhenzhen Jiao, Liqun Fu, Seyyedali Hosseinalipour

机构 * School of Informatics, Xiamen University(厦门大学信息学院) National University of Singapore(新加坡国立大学) Teleinfo iF-Labs, China Academy of Information and Communications Technology(Teleinfo iF-Labs,中国信息通信技术研究院) Department of Electrical Engineering, University at Buffalo-SUNY(电气工程系,布法罗大学-纽约州立大学)

AI总结 ELSA通过任务无关聚类、动态模型分割和轻量通信方案,实现网络边缘隐私保护下的高效LLM微调。

Comments 11 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17186 2026-03-10 cs.CV

It is not always greener on the other side: Greenery perception across demographics and personalities in multiple cities

另一边未必更绿:在多个城市中,对绿色的感知存在种族和个性差异

Matias Quintana, Fangqi Liu, Jussi Torkko, Youlong Gu, Xiucheng Liang, Yujun Hou, Koichi Ito, Yihan Zhu, Mahmoud Abdelrahman, Tuuli Toivonen, Yi Lu, Filip Biljecki

机构 * Future Cities Lab Global, Singapore-ETH Centre(未来城市实验室全球,新加坡-ETH中心) Department of Architecture and Civil Engineering, City University of Hong Kong(香港城市大学建筑与土木工程系) Digital Geography Lab, Department of Geosciences and Geography, University of Helsinki(赫尔辛基大学地理科学与地理系数字地理实验室) Department of Architecture, National University of Singapore(新加坡国立大学建筑系) Department of Real Estate, National University of Singapore(新加坡国立大学房地产系)

AI总结 本研究通过分析多个城市中绿色感知的差异,发现居住地对绿色感知有显著影响,而人口统计数据和个性在感知中作用较小。

Journal ref Landscape and Urban Planning 271 (2026) 105618

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23223 2026-03-10 cs.RO cs.SY eess.SY

SAC-Loco: Safe and Adjustable Compliant Quadrupedal Locomotion

SAC-Loco:安全且可调节的四足机器人运动

Aoqian Zhang, Zixuan Zhuang, Chunzheng Wang, Shuzhi Sam Ge, Fan Shi, Cheng Xiang

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)

AI总结 SAC-Loco提出了一种安全且可调节的四足机器人运动框架,通过可调节的扰动顺应性和鲁棒的故障预防,实现对外部力扰动的稳健响应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16635 2026-03-10 cs.DB cs.LG

WikiDBGraph: A Data Management Benchmark Suite for Collaborative Learning over Database Silos

WikiDBGraph: 一个用于数据库孤岛上协作学习的数据管理基准测试套件

Zhaomin Wu, Ziyang Wang, Bingsheng He

机构 * National University of Singapore(新加坡国立大学)

AI总结 WikiDBGraph通过构建大规模现实数据库数据集,评估协作学习在处理现实数据孤岛中的有效性与局限性,揭示了现有方法在实际部署中的不足。

Comments ICDE 2026

Journal ref ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07165 2026-03-10 cs.RO

RoTri-Diff: A Spatial Robot-Object Triadic Interaction-Guided Diffusion Model for Bimanual Manipulation

RoTri-Diff: 一种基于空间机器人-物体三元交互引导的扩散模型用于双臂操作

Zixuan Chen, Nga Teng Chan, Yiwen Hou, Chenrui Tie, Zixuan Liu, Haonan Chen, Junting Chen, Jieqi Shi, Yang Gao, Jing Huo, Lin Shao

机构 * School of Computer Science, Nanjing University(南京大学计算机科学学院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

AI总结 RoTri-Diff通过建模机器人-物体三元交互关系,提出了一种基于扩散的模仿学习框架,以提高双臂操作的稳定性和协调性。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06985 2026-03-10 cs.CV

Perception-Aware Multimodal Spatial Reasoning from Monocular Images

视感知-aware的多模态空间推理从单目图像

Yanchun Cheng, Rundong Wang, Xulei Yang, Alok Prakash, Daniela Rus, Marcelo H Ang, ShiJie Li

机构 * NUS, Singapore(新加坡国立大学) NTU, Singapore(新加坡国立大学) MIT, US(麻省理工学院) A*STAR, Singapore(新加坡科技研究局)

AI总结 本文提出了一种感知-aware的多模态推理框架,通过统一标记空间联合处理视觉证据和文本推理,提升单目图像空间推理的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06617 2026-03-10 cs.LG cs.AI

Evo: Autoregressive-Diffusion Large Language Models with Evolving Balance

Evo:具有进化平衡的自回归-扩散大语言模型

Junde Wu, Minhao Hu, Jiayuan Zhu, Yuyuan Liu, Tianyi Zhang, Kang Li, Jingkun Chen, Jiazhen Pan, Min Xu, Yueming Jin

机构 * University of Oxford(牛津大学) National University of Singapore(新加坡国立大学) Technical University of Munich(慕尼黑技术大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 Evo通过进化平衡机制,结合自回归和扩散模型,实现高效且高质量的语言生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06220 2026-03-09 cs.CV

Word-Anchored Temporal Forgery Localization

基于词锚的时序伪造定位

Tianyi Wang, Xi Shao, Harry Cheng, Yinglong Wang, Mohan Kankanhalli

机构 * National University of Singapore(新加坡国立大学) Nanjing University of Posts and Telecommunications(南京邮电大学) Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东科学院))

AI总结 基于词锚的时序伪造定位方法通过词级二分类提升定位精度,减少计算成本,克服类别不平衡问题。

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05845 2026-03-09 cs.CV

Cog2Gen3D: Sculpturing 3D Semantic-Geometric Cognition for 3D Generation

Cog2Gen3D: 三维语义-几何认知雕刻用于三维生成

Haonan Wang, Hanyu Zhou, Haoyue Liu, Tao Gu, Luxin Yan

机构 * School of Artificial and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) School of Computing, Macquarie University(麦考瑞大学计算机学院)

AI总结 Cog2Gen3D通过结合语义和绝对几何信息,提出了一种三维认知引导的扩散框架,以实现可控的三维生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03214 2026-03-09 cs.CV

FARTrack: Fast Autoregressive Visual Tracking with High Performance

FARTrack: 快速自回归视觉跟踪与高性能

Guijie Wang, Tong Lin, Yifan Bai, Anjia Cao, Shiyi Liang, Wangbo Zhao, Xing Wei

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室) DAMO Academy, Alibaba Group(阿里云达摩院) National University of Singapore(新加坡国立大学)

AI总结 FARTrack通过任务特定自蒸馏和帧间自回归稀疏化,实现了高效且高性能的视觉跟踪,在GOT-10k上达到70.6%的AO,同时在GPU和CPU上分别达到343 FPS和121 FPS。

详情

展开后加载摘要…

URL PDF HTML 收藏