SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
SpatiaLQA: 一个评估视觉-语言模型空间逻辑推理能力的基准
Yuechen Xie, Xiaoyan Zhang, Yicheng Shan, Hao Zhu, Rui Tang, Rong Wei, Mingli Song, Yuanyu Wan, Jie Song
机构
*
Zhejiang University(浙江大学)
;
The University of Sydney(悉尼大学)
;
ManyCore
;
State Key Laboratory of Blockchain and Security, Zhejiang University(浙江大学区块链与安全国家重点实验室)
;
Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)
机构
*
School of Big Data & Software Engineering, Chongqing University(大数据与软件工程学院,重庆大学)
;
School of Computer Science & Technology, Chongqing University(计算机科学与技术学院,重庆大学)
机构
*
Tsinghua University(清华大学)
;
Swinburne University of Technology(斯威本理工大学)
;
The Australian National University(澳大利亚国立大学)
;
Key Laboratory of Pervasive Computing, Ministry of Education(教育部感知计算重点实验室)
Discover, Segment, and Select: A Progressive Mechanism for Zero-shot Camouflaged Object Segmentation
发现、分割与选择:一种用于零样本伪装物体分割的渐进机制
Yilong Yang, Jianxin Tian, Shengchuan Zhang, Liujuan Cao
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,教育部,厦门大学)