UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models
UAOR: 面向视觉-语言-动作模型的不确定性感知观测重注入
Jiabing Yang, Yixiang Chen, Yuan Xu, Peiyan Li, Zichen Wen, Bowen Fang, Tao Yu, Xiangnan Wu, Qisen Ma, Kai Wang, Ziheng He, Yingda Li, Zhengbo Zhang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别新技术实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
FiveAges(五代)
CodeGraphVLP: Code-as-Planner Meets Semantic-Graph State for Non-Markovian Vision-Language-Action Models
CodeGraphVLP:代码规划器与语义图状态的结合用于非马尔可夫视觉-语言-动作模型
Khoa Vo, Sieu Tran, Taisei Hanyu, Yuki Ikebe, Duy Nguyen, Nghi D. Q. Bui, Minh Vu, Anthony Gunderman, Chase Rainwater, Anh Nguyen, Ngan Le
机构
*
University of Arkansas(亚拉巴马大学)
;
Max Planck Research School for Intelligent Systems and the University of Stuttgart(马克斯·普朗克智能系统研究学校和斯图加特大学)
;
Center of AI Research, VinUniversity(Vin大学人工智能研究中心)
;
TU Wien(维也纳技术大学)
;
University of Liverpool(利物浦大学)
机构
*
Sichuan University(四川大学)
;
Sun Yat-sen University(中山大学)
;
Australian National University(澳大利亚国立大学)
;
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shanghai Jiao Tong University(上海交通大学)
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Beihang University(北京航空航天大学)
;
Huawei Foundation Model Department(华为基础模型部门)
MAC 2026: Advancing Micro-Action Analysis Towards Fine-Grained Understanding
MAC 2026:推动微动作分析迈向细粒度理解
Kun Li, Dan Guo, Jihao Gu, Pengyu Liu, Xiaobai Li, Haoyu Chen, Yanbin Hao, Guoying Zhao, Meng Wang
机构
*
United Arab Emirates University(阿联酋大学)
;
Hefei University of Technology(合肥工业大学)
;
University College London(伦敦大学学院)
;
Zhejiang University(浙江大学)
;
University of Oulu(奥卢大学)
;
CMVS, University of Oulu(奥卢大学计算机视觉与媒体研究中心)
专题命中
GUI与屏幕智能体
:multimodal large language model(abstract);分类 cs.CV