Move-Then-Operate: Behavioral Phasing for Human-Like Robotic Manipulation
移动-然后-操作:用于类人机器人操作的行为相位
Haoming Xu, Lei Lei, Jie Gu, Chu Tang, Jingmin Chen, Ruiqi Wang
机构
*
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences, Hangzhou, China.(杭州高等研究院,中国科学院大学,中国杭州)
;
University of Science and Technology of China, Hefei, China.(中国科学技术大学,中国合肥)
;
School of Aritificial intelligence, Institute of Artificial Intelligence, University of Science and Technology Beijing, Beijing, China(人工智能学院,人工智能研究院,北京科技大学,中国北京)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
AnyverseDynamics
Let the Dynamics Flow: Stable Flow Matching Dynamical Systems
让动力学流动:稳定的流匹配动力系统
Rodrigo Pérez-Dattari, Francisco Leiva, Andrea Testa, Leonel Rozo, Javier Ruiz del Solar, Noémie Jaquier
机构
*
Department of Robotics, Perception, and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院)
;
Advanced Mining Technology Center (AMTC) and Department of Electrical Engineering, Universidad de Chile(先进采矿技术中心(AMTC)和电气工程系,智利大学)
;
Bosch Center for Artificial Intelligence, Renningen, Germany(博世人工智能中心,德国Renningen)
;
Italian Institute of Artificial Intelligence (AI4I), Turin, Italy(意大利人工智能研究所(AI4I),意大利都灵)
LongSpace: Exploring Long-Horizon Spatial Memory from Perception to Recall in Video
LongSpace: 从感知到回忆的视频长程空间记忆探索
Shiqiang Lang, Jing Liu, Haoyang He, Peiwen Sun, Yuanteng Chen, Tao Liu, Lan Yang, Longteng Guo, Honggang Zhang
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Zhongguancun Academy(中关村学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
The Chinese University of Hong Kong(香港中文大学)
;
Xi’an Jiaotong University(西安交通大学)
Flattery in Motion: Benchmarking and Analyzing Sycophancy in Video-LLMs
视频中的奉承:视频大语言模型中奉承行为的基准测试与分析
Wenrui Zhou, Mohamed Hendy, Shu Yang, Qingsong Yang, Zikun Guo, Yuyu Luo, Lijie Hu, Di Wang
机构
*
Provable Responsible AI and Data Analytics (PRADA) Lab(可证负责任人工智能与数据 analytics 实验室)
;
King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹科学与技术大学)
;
HKUST(香港科技大学)
;
MBZUAI(穆罕默德·本·拉希德人工智能研究所)
;
University of Science and Technology of China(中国科学技术大学)
;
Kyungpook National University(庆尚国立大学)
Watch Before You Answer: Learning from Visually Grounded Post-Training
在回答前观看:从视觉引导的后训练中学习
Yuxuan Zhang, EunJeong Hwang, Huaisong Zhang, Penghui Du, Yiming Jia, Dongfu Jiang, Xuan He, Shenhui Zhang, Ping Nie, Peter West, Kelsey R. Allen
机构
*
University of British Columbia(不列颠哥伦比亚大学)
;
Vector Institute(向量研究所)
;
Etude AI
;
Kolors Team, Kuaishou Technology(快手科技Kolors团队)
;
University of Toronto(多伦多大学)
;
University of Waterloo(滑铁卢大学)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
Asynchronous Pipeline Parallelism for Real-Time Multilingual Lip Synchronization in Video Communication Systems
异步流水线并行用于实时多语言唇同步视频通信系统
Eren Caglar, Amirkia Rafiei Oskooei, Mehmet Kutanoglu, Mustafa Keles, Mehmet S. Aktas
机构
*
Department of Data Science
;
Big Data Yildiz Technical University Istanbul, Turkey
;
Department of Computer Engineering Yildiz Technical University Istanbul, Turkey
;
R\&D Center Aktif Investment Bank Inc. Istanbul, Turkey
;
3.5cm R\&D Center 3.5cm Aktif Investment Bank Inc. 3.5cm Istanbul, Turkey 3.5cm
;
0.25cm Department of Computer Engineering 0.25cm Yildiz Technical University 0.25cm Istanbul, Turkey 0.25cm