JigShape: Evaluating Visual-Geometric Reasoning in VLMs through Jigsaw Puzzles
JigShape:通过拼图任务评估视觉语言模型的视觉几何推理能力
Shawn Li, Wei Yang, Jike Zhong, Jiate Li, Jiawei Yang, You Qin, Ryan Rossi, Franck Dernoncourt, Roger Zimmermann, Yue Wang, Zhengzhong Tu, Vicente Ordonez, Mohit Bansal, Yue Zhao
机构
*
University of Southern California(南加州大学)
;
National University of Singapore(新加坡国立大学)
;
Adobe Research(奥多比研究院)
;
Texas A&M University(德克萨斯农工大学)
;
Rice University(莱斯大学)
;
The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
机构
*
MemTensor (Shanghai) Technology Co., Ltd.(墨芯(上海)科技有限公司)
;
Renmin University of China(中国人民大学)
;
National University of Singapore(新加坡国立大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Tongji University(同济大学)
机构
*
Hong Kong University of Science and Technology(香港科学与技术大学)
;
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Peking University(北京大学)
;
Independent Researcher(独立研究者)
Convergence analysis of controlled particle systems arising in deep learning: from finite to infinite sample size
深度学习中受控粒子系统的收敛性分析:从有限样本量到无限样本量
Huafu Liao, Alpár R. Mészáros, Chenchen Mou, Chao Zhou
机构
*
School of Mathematical Sciences, Dalian University of Technology(大连理工大学数学科学学院)
;
Department of Mathematical Sciences, University of Durham(杜伦大学数学科学学院)
;
Department of Mathematics, City University of Hong Kong(香港城市大学数学系)
;
Department of Mathematics and Risk Management Institute, National University of Singapore(新加坡国立大学数学系与风险管理研究所)
Trust but Verify:Evidence-Linked Multi-Agent Clinical Information Extraction in Pathology
从细则中发现幽门螺杆菌:基于证据关联的多智能体胃活检报告病例发现
Yufan Wang, Anit Kumar Sahu, Yan Fei Ng, Daniel Kang, Shayan Vassef, Soorya Ram Shimgekar, Koustuv Saha, Piyum Zonooz, Navin Kumar, Chee Leong Cheng, Li Yan Khor
机构
*
Department of Anatomical Pathology, Singapore General Hospital(新加坡中央医院解剖病理科)
;
Duke–NUS Medical School(新加坡国立大学Duke-NUS医学院)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Independent Researcher(独立研究者)
SOD: Step-wise On-policy Distillation for Small Language Model Agents
SOD:分步式在线蒸馏用于小型语言模型代理
Qiyong Zhong, Mao Zheng, Mingyang Song, Xin Lin, Jie Sun, Houcheng Jiang, Xiang Wang, Junfeng Fang
机构
*
Zhejiang University(浙江大学)
;
Large Language Model Department, Tencent(腾讯大语言模型部门)
;
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement
从可验证奖励强化学习到自验证奖励强化学习:任务转换为开放式语言模型自我改进带来自验证奖励
Qinsi Wang, Jing Shi, Huazheng Wang, Kun Wan, Yiran Wu, Bo Liu, Qingyun Wu, Hai Helen Li, Yiran Chen, Handong Zhao, Wentian Zhao
机构
*
Duke University(杜克大学)
;
Adobe Inc.(奥多比公司)
;
Oregon State University(俄勒冈州立大学)
;
Pennsylvania State University(宾夕法尼亚州立大学)
;
National University of Singapore(新加坡国立大学)
;
Amazon(亚马逊)
机构
*
Department of computer science, National University of Singapore(新加坡国立大学计算机科学系)
;
School of Artificial Intelligence, Shandong University(山东大学人工智能学院)
;
Shanghai Advanced Research Institute, Chinese Academy of Science(中国科学院上海先进研究院)
;
University of Chinese Academy of Sciences, Beijing(中国科学院大学北京校区)
So-Fake: Benchmarking and Explaining Social Media Image Forgery Detection
So-Fake:社交媒体图像伪造检测的基准构建与可解释性研究
Zhenglin Huang, Xiangtai Li, Xi Yang, Bei Peng, Xiaowei Huang, Baoyuan Wu, Dacheng Tao, Ming-Hsuan Yang, Guangliang Cheng
机构
*
University of Liverpool, UK(利物浦大学)
;
Nanyang Technological University(南洋理工大学)
;
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
The University of Sheffield(谢菲尔德大学)
机构
*
National University of Singapore(新加坡国立大学)
;
PuzzleLogic Pte Ltd(拼图逻辑私人有限公司)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区)
;
Peking Union Medical College Hospital(北京协和医院)
机构
*
Nanjing University of Science and Technology(南京理工大学)
;
National University of Singapore(新加坡国立大学)
;
Beihang University(北京航空航天大学)
;
Nanjing Forestry University(南京林业大学)
On the Rate of Convergence of Kolmogorov-Arnold Network Regression Estimators
关于Kolmogorov-Arnold网络回归估计器收敛速度的论文
Wei Liu, Eleni Chatzi, Zhilu Lai
机构
*
Department of Industrial Systems Engineering and Management, National University of Singapore(新加坡国立大学工业系统工程与管理系)
;
Department of Civil, Environmental and Geomatic Engineering, ETH Zürich(苏黎世联邦理工学院土木、环境与地理工程系)
;
Internet of Things Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)物联网研究组)
A Density-Matrix Framework for Electronic-Structure Analysis of Functional-Group and Salt Effects in Lithium-Metal Electrolytes
用于锂金属电解质中官能团和盐效应电子结构分析的密度矩阵框架
Mingkang Liu, Huize Yu, Yanbin Gao, Nan Yao, Xiang Chen, Lei Shen
机构
*
National University of Singapore(新加坡国立大学)
;
Tsinghua University(清华大学)
;
Institute for Carbon Neutrality, Tsinghua University(清华大学碳中和研究院)
;
AI Solid-State Battery Innovation Center(人工智能固态电池创新中心)
;
C Innovation Laboratory (21C LAB), Contemporary Amperex Technology Co., Limited (CATL)(21C创新实验室(21C实验室),宁德时代新能源科技股份有限公司)
;
National University of Singapore Guangzhou Research Translation and Innovation Institute(新加坡国立大学广州研究院)
;
National University of Singapore (Chongqing) Research Institute(新加坡国立大学(重庆)研究院)
Deep Expert Injection for Anchoring Retinal VLMs with Domain-Specific Knowledge
深度专家注入用于带有领域特定知识的视网膜视觉语言模型的锚定
Shuai Lu, Meng Wang, Jia Guo, Jiawei Du, Bo Liu, Shengzhu Yang, Weihang Zhang, Huazhu Fu, Huiqi Li
机构
*
Beijing Institute of Technology, Beijing, China(北京理工大学)
;
National University of Singapore, Singapore(新加坡国立大学)
;
Tsinghua University, Beijing, China(清华大学)
;
The Hong Kong Polytechnic University, Hong Kong(香港理工大学)
机构
*
People’s Daily Online(人民网)
;
Nanyang Technological University(南洋理工大学)
;
Tongji University(同济大学)
;
Nanjing University of Science and Technology(南京理工大学)
;
National University of Singapore(新加坡国立大学)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
School of Computer Science and Engineering(计算机科学与工程学院)
;
Nanjing University of Science and Technology(南京理工大学)
;
Faculty of Data Science(数据科学学院)
;
City University of Macau(澳门城市大学)
;
Beijing Institute of Technology(北京理工大学)
;
Fondazione Bruno Kessler(布鲁诺·凯瑟尔基金会)
;
School of Public Health(公共卫生学院)
;
Shanghai Jiao Tong University(上海交通大学)
;
School of Computing(计算机学院)
;
National University of Singapore(新加坡国立大学)
FlowInOne:Unifying Multimodal Generation as Image-in, Image-out Flow Matching
FlowInOne:将多模态生成统一为图像输入、图像输出的流匹配
Junchao Yi, Rui Zhao, Jiahao Tang, Weixian Lei, Linjie Li, Qisheng Su, Zhengyuan Yang, Lijuan Wang, Xiaofeng Zhu, Alex Jinpeng Wang
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Central South University(中南大学)
;
National University of Singapore(新加坡国立大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Microsoft(微软)