TASC: Task-Aware Shared Control for Relational Telemanipulation
TASC:面向关系遥操作的任务感知共享控制
Ze Fu, Pinhao Song, Yutong Hu, Renaud Detry
机构
*
KU Leuven, Dept. Mechanical Engineering, Research unit Robotics, Automation and Mechatronics(KU莱顿机械工程系,机器人、自动化与机电一体化研究单位)
;
KU Leuven, Dept. Electrical Engineering, Research unit Processing Speech and Images(KU莱顿电气工程系,语音与图像处理研究单位)
See-and-Reach: Precise Vision-Language Navigation for UAVs within the Field of View
See-and-Reach: 视场内的精确视觉语言导航用于无人机
Fanfu Xue, En Yu, Yantian Shen, Zhikun Hu, Hongjun Wang, Yang Yang, Xindi Wang, Jiande Sun
机构
*
School of Information Science and Engineering, Shandong University(山东大学信息科学与工程学院)
;
Faculty of Engineering and Information Technology, University of Technology Sydney(悉尼科技大学工程与信息技术学院)
;
School of Computer Science and Technology, Shandong University(山东大学计算机科学与技术学院)
;
School of Artificial Intelligence, Shandong University(山东大学人工智能学院)
;
School of Computer Science and Artificial Intelligence, Shandong Normal University(山东师范大学计算机科学与人工智能学院)
;
Interdisciplinary Research Center of General Artificial Intelligence, Shandong Normal University(山东师范大学通用人工智能跨学科研究中心)
StylisticBias: A Few Human Visual Cues Drive Most Social Biases in MLLMs
StylisticBias: 少数人类视觉线索驱动多模态大语言模型中的大部分社会偏见
Shaghayegh Kolli, Timo Cavelius, Nafiseh Nikeghbal, Samantha Dalal, Jana Diesner
机构
*
Technical University of Munich(慕尼黑工业大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Princeton Center for Information and Technology Policy(普林斯顿信息与技术政策中心)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV
Timage: A Generative Text-in-Image Paradigm for Fine-Tuning Vision-Language Models
Timage: 一种用于微调视觉语言模型的文本嵌入图像生成范式
Yifeng Wu, Huimin Huang, Ruiluo Wu, Chunyi Lin, Guanhua Chen, Xian Wu, Wang Song, Ruize Han
机构
*
Fudan University(复旦大学)
;
Shenzhen University of Advanced Technology(深圳先进技术大学)
;
Tencent Jarvis Lab(腾讯贾维斯实验室)
;
Southern University of Science and Technology(南方科技大学)
专题命中
VLM训练与架构
:vision-language model(title);multimodal large language model(abstract);分类 cs.CV
Ying Shen, Zhiyang Xu, Jiuhai Chen, Shizhe Diao, Jiaxin Zhang, Yuguang Yao, Joy Rimchala, Ismini Lourentzou, Lifu Huang
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Maryland(马里兰大学)
;
Nvidia(英伟达)
;
Salesforce AI Research(Salesforce AI研究)
;
Intuit AI Research(Intuit AI研究)
Co-policy: Responsive Human-Robot Co-Creation for Musical Performances
Co-policy: 响应式人机音乐共创框架
Xuetao Li, Wenke Huang, Mang Ye, Zijian Liu, Jinhua Xie, Jifeng Xuan, Miao Li
机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
School of Automation, Wuhan University of Technology(武汉理工大学自动化学院)
;
School of Geodesy and Geomatics, Wuhan University(武汉大学测绘学院)
;
School of Robotics, Wuhan University(武汉大学机器人学院)
NRITYAM: Language Models Meet Art and Heritage of Dance
NRITYAM:语言模型遇见舞蹈的艺术与遗产
Punit Kumar Singh, Niladri Ghosh, Advait Joshiınst, Shailee Choudhary, Michael Färber, Haiqin Yang
机构
*
Shenzhen Technology University(深圳技术大学)
;
New Delhi Institute of Management(新德里管理学院)
;
Technische Universität Dresden(德累斯顿工业大学)
;
Ramakrishna Mission Vivekananda Educational and Research Institute(罗摩克里希纳传道会维韦卡南达教育与研究学院)
;
Indian Institute of Technology(印度理工学院)
;
Swami Vivekananda Institute of Technology(斯瓦米·维韦卡南达技术学院)
;
GuangDong Engineering Technology Research Center of Edge Intelligence(广东省边缘智能工程技术研究中心)
专题命中
其他VLM
:multimodal large language model(abstract);分类 cs.AI