GSAM: A Generalizable and Safe Robotic Framework for Articulated Object Manipulation
GSAM: 一种通用且安全的铰接物体操作机器人框架
Beichen Shao, Mengying Xie, Heng Su, Wanyi Zhang, Mingyan Li, Yan Ding, Fausto Giunchiglia, Chao Chen
机构
*
College of Computer Science, Chongqing University, Chongqing, China(重庆大学计算机学院)
;
Lumos Robotics, China(Lumos机器人中国)
;
Xi'an Jiaotong-Liverpool University, China(西安交通大学利物浦大学)
;
Fudan University, China(复旦大学)
;
Department of Information Engineering and Computer Science, University of Trento, Trento, Italy(特伦托大学信息工程与计算机科学系)
How Much Do LLMs Know About Chinese Zero Pronouns?
LLMs 对中文零代词的了解程度如何?
Yifei Li, Guanyi Chen, Tingting He
机构
*
Hubei Provincial Key Laboratory of Artificial Intelligence and Smart Learning(湖北省人工智能与智能学习重点实验室)
;
National Language Resources Monitoring and Research Center for Network Media(网络媒体语言资源监测与研究中心)
;
School of Computer Science, Central China Normal University(中央财经大学计算机学院)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.CL
SLAT: Segment-Level Adaptive Trimming for Efficient CoT Reasoning
SLAT:面向高效CoT推理的段级自适应修剪
Jian Yao, Xiongcai Luo, Ran Cheng, Kay Chen Tan
机构
*
Department of Data Science and Artificial Intelligence, The Hong Kong Polytechnic University(数据科学与人工智能学院,香港理工大学)
;
The Hong Kong Polytechnic University-Daya Bay Technology and Innovation Research Institute, Huizhou,Guangdong Province, China(香港理工大学大亚湾科技与创新研究院,广东惠州市)
;
The Hong Kong Polytechnic University Shenzhen Research Institute, Shenzhen, China(香港理工大学深圳研究院,深圳)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.AI
机构
*
Department of Computer Science, City University of Hong Kong, Hong Kong SAR, China(香港城市大学计算机科学系)
;
Harbin Institute of Technology, Harbin, China(哈尔滨工业大学)
iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement Learning
iVGR: 通过强化学习将视觉基础推理内化到多模态大语言模型中
Chang-Bin Zhang, Yujie Zhong, Qiang Zhang, Kai Han
机构
*
Visual AI Lab, The University of Hong Kong(香港大学视觉人工智能实验室)
;
Independent Researcher(独立研究者)
;
University of Science and Technology of China(中国科学技术大学)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract)
SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes
SpatialAct:探测VLM智能体在3D场景中的空间推理到行动能力
Tianhui Liu, Jie Feng, Zhiheng Zheng, Shengyuan Wang, Yiming Guo, Yanxin Xi, Hangyu Fan, Yong Li, Pan Hui
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Zhongguancun Academy(中关村学院)
;
Tsinghua University(清华大学)
;
Helsinki University(赫尔辛基大学)
Multi-Turn Multi-Agent Dialogue for Collaborative Reconstruction Improves VLM Performance on Spatial Reasoning, But Only Barely
多轮多智能体对话用于协作重建仅略微提升VLM在空间推理上的性能
Chalamalasetti Kranti, Sherzod Hakimov, David Schlangen
机构
*
Computational Linguistics, Department of Linguistics University of Potsdam(语言学计算系,语言学系 柏林洪堡大学)
;
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))
Yufei Li, Yisen Gao, Jiaxuan Xiong, Jiaxin Bai, Shijie Zhong, Haoyu Huang, Zhongwei Xie, Hong Ting Tsang, Yangqiu Song
机构
*
HKUST(香港理工大学)
;
Beijing Institute of Technology(北京理工大学)
;
Hong Kong Baptist University(香港 Baptist 大学)
;
Guangdong University of Technology(广东技术大学)