Understanding Cross-Rig Generalization in Automotive Perception: a Multi-Rig Benchmark and Rig Variation Metrics
理解自动驾驶感知中的跨传感器配置泛化:多配置基准与配置变化度量
Tim Alexander Bader, Tim Dieter Eberhardt, Maximilian Dillitzer, Wilhelm Stork
机构
*
Dept. of Highly Automated and Assisted Driving, Dr. Ing. h.c. F. Porsche AG(保时捷股份公司高度自动化与辅助驾驶部门)
;
Institute for Information Processing Technologies, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院信息处理技术研究所)
;
Faculty of Mobility and Technology, Esslingen University of Applied Sciences(埃斯林根应用科学大学移动性与技术学院)
SemCityLoc: Aerial 6DoF Localization Using Semantic 3D City Models
SemCityLoc: 使用语义3D城市模型的航空6自由度定位
Jingfeng Mao, Xuyang Chen, Qilin Zhang, Oussema Dhaouadi, Guangming Wang, Brian Sheil, Daniel Cremers, Yan Xia, Olaf Wysocki
机构
*
Technical University of Munich(慕尼黑工业大学)
;
University of Cambridge(剑桥大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)
;
ETH Zurich(苏黎世联邦理工学院)
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
Beijing Academy of Artificial Intelligence (BAAI)(北京智源人工智能研究院)
;
Beihang University(北京航空航天大学)
;
Eastern Institute of Technology, Ningbo(宁波东方理工大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Microsoft Research Asia (MSRA)(微软亚洲研究院)
Paying More Attention to Visual Tokens in Self-Evolving Large Multimodal Models
在自进化大型多模态模型中更加关注视觉标记
Shravan Venkatraman, Ritesh Thawkar, Omkar Thawakar, Rao Muhammad Anwer, Hisham Cholakkal, Salman Khan, Fahad Khan
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Aalto University(阿尔托大学)
;
Australian National University(澳大利亚国立大学)
;
Linköping University(林雪平大学)
See & Sniff: Learning Visuo-Olfactory Representations
See & Sniff: 学习视觉-嗅觉表征
Seongyu Kim, Seungwoo Lee, Hyeonggon Ryu, Joon Son Chung, Arda Senocak
机构
*
Korea Advanced Institute of Science and Technology(韩国科学技术院)
;
Hankuk University of Foreign Studies(韩国外国语大学)
;
Ulsan National Institute of Science and Technology(蔚山科学技术院)
E-TTS: A New Embodied Test-Time Scaling Framework for Robotic Manipulation
E-TTS:一种新的机器人操作具身测试时缩放框架
Wen Ye, Peiyan Li, Tingyu Yuan, Yuan Xu, Xiangnan Wu, Chaoyang Zhao, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心)
;
FiveAges(五时代)
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
Liangzhu Laboratory and WeDoctor Cloud(良渚实验室和微医云)
;
Shanghai Innovation Institute(上海创新研究院)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
State Key Laboratory of Transvascular Implantation Devices and TIDRI(经血管植入器械全国重点实验室和TIDRI)
;
Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)
机构
*
Key Laboratory of Image Processing and Intelligent Control, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院图像处理与智能控制重点实验室)
;
Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室)
Capacity-Controlled Multi-View Stylization of 3D Gaussian Splatting
容量控制的多视图3D高斯泼溅风格化
Zhihao Wen, Yixin Yang, Bojian Wu, Yang Zhou, Dani Lischinski, Daniel Cohen-Or, Hui Huang
机构
*
Guangdong Provincial Key Laboratory of Visual Media and Multidimensional Intelligence, CSSE, Shenzhen University(广东省可视媒体与多维智能重点实验室,计算机科学与软件工程学院,深圳大学)
;
Tencent Games(腾讯游戏)
;
The Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
Tel Aviv University(特拉维夫大学)