UpstreamQA: A Modular Framework for Explicit Reasoning on Video Question Answering Tasks
UpstreamQA:一个用于视频问答任务显式推理的模块化框架
Jason Nguyen, Ameet Rao, Alexander Chang, Ishaan Kumar, Erin Tan
机构
*
Lincoln North Star High School(林肯北星高中)
;
The Charter School of Wilmington(威尔明顿 charter 学校)
;
Greenwich High School(格林威治高中)
;
Santa Susana High School(圣塔苏娜高中)
;
UC Berkeley(伯克利大学)
机构
*
RMIT University(皇家墨尔本理工大学)
;
Monash University(墨尔本大学)
;
Adelaide University(阿德莱德大学)
;
The University of Hong Kong(香港大学)
;
ESPOL University(ESPOL大学)
机构
*
Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学计算机科学与工程系)
;
SkyReels, Skywork AI(SkyReels与Skywork AI)
;
Independent Researcher(独立研究者)
Vision-Language-Action in Robotics: A Survey of Datasets, Benchmarks, and Data Engines
机器人中的视觉-语言-动作:数据集、基准和数据引擎的综述
Ziyao Wang, Bingying Wang, Hanrong Zhang, Tingting Du, Tianyang Chen, Guoheng Sun, Yexiao He, Zheyu Shen, Wanghao Ye, Ang Li
机构
*
University of Maryland, College Park(马里兰大学学院公园分校)
;
University of Utah(犹他大学)
;
Northeastern University(东北大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Ant Group(蚂蚁集团)
;
Visual Geometry Group, University of Oxford(牛津大学视觉几何组)
;
Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo(宁波数字孪生研究院,东部技术研究院,宁波)
;
Zhejiang Key Laboratory of Industrial Intelligence and Digital Twin(浙江工业智能与数字孪生重点实验室)
CommentsAccepted to The 33rd ACM International Conference on Advances in Geographic Information Systems(SIGSPATIAL '25) as a short paper in the Short Paper Track
Journal refIn Proceedings of the 33rd ACM International Conference on Advances in Geographic Information Systems (SIGSPATIAL '25), 2025, pp. 1186-1189
CommentsIn Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR'26), July 20-24, 2026, Melbourne, VIC, Australia
AnalogRetriever: Learning Cross-Modal Representations for Analog Circuit Retrieval
AnalogRetriever: 为模拟电路检索学习跨模态表示
Yihan Wang, Lei Li, Yao Lai, Jing Wang, Yan Lu
机构
*
Tsinghua University(清华大学)
;
The University of Hong Kong(香港大学)
;
University of Cambridge(剑桥大学)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
RADIANT-LLM: an Agentic Retrieval Augmented Generation Framework for Reliable Decision Support in Safety-Critical Nuclear Engineering
RADIANT-LLM:一种用于安全关键核工程中可靠决策支持的代理检索增强生成框架
Zavier Ndum Ndum, Jian Tao, John Ford, Mansung Yim, Yang Liu
机构
*
Department of Nuclear Engineering, Texas A\&M University, College Station, TX, USA
;
College of Performance, Visualization
;
Fine Arts, Texas A\&M University, College Station, TX, USA
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
Mila - Quebec AI Institute(魁北克人工智能研究所)
;
Google DeepMind(谷歌DeepMind)
;
Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院)
;
Akool Research(Akool研究)
MIMIC: A Generative Multimodal Foundation Model for Biomolecules
MIMIC:一种生成式多模态基础模型用于生物分子
Siavash Golkar, Jake Kovalic, Irina Espejo Morales, Samuel Sledzieski, Minhuan Li, Ksenia Sokolova, Geraud Krawezik, Alberto Bietti, Claudia Skok Gibbs, Roman Klypa, Shengwei Xiong, Francois Lanusse, Liam Parker, Kyunghyun Cho, Miles Cranmer, Tom Hehir, Michael McCabe, Lucas Meyer, Rudy Morel, Payel Mukhopadhyay, Mariel Pettee, Helen Qu, Jeff Shen, David Fouhey, Hadi Sotoudeh, Vikram Mulligan, Pilar Cossio, Sonya M. Hanson, Alisha N. Jones, Olga G. Troyanskaya, Shirley Ho
机构
*
Polymathic AI Center for Data Science, New York University(多学科人工智能数据科学中心,纽约大学)
;
Polymathic AI Department of Applied Physics, Yale University(多学科人工智能应用物理系,耶鲁大学)
;
Center for Computational Mathematics, Flatiron Institute(计算数学中心,Flatiron研究所)
;
Center for Computational Biology, Flatiron Institute(计算生物学中心,Flatiron研究所)
;
Princeton Precision Health, Princeton University(普林斯顿精准健康,普林斯顿大学)
;
Department of Chemistry, New York University(化学系,纽约大学)
;
Department of Computer Science, Princeton University(计算机科学系,普林斯顿大学)
;
Lewis-Sigler Institute for Integrative Genomics, Princeton University(刘易斯-西格尔整合基因组学研究所,普林斯顿大学)
;
Center for Computational Astrophysics, Flatiron Institute(计算天文学中心,Flatiron研究所)
;
Department of Astrophysical Sciences, Princeton University(天体物理科学系,普林斯顿大学)
;
Department of Physics, New York University(物理学系,纽约大学)
专题命中
多模态生成
:multimodal(title,abstract);multimodal foundation model(title,abstract);分类 cs.AI
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
超越跨模态对齐:测量和利用模态差距在视觉-语言模型中
Hanqi Yan, Xiangxiang Cui, Lu Yin, Jindong Gu, Paul Pu Liang, Yulan He, Yifei Wang
机构
*
King’s College London(伦敦国王学院)
;
University of Surrey(萨里大学)
;
University of Oxford(牛津大学)
;
MIT CSAIL(麻省理工学院CSAIL实验室)
;
The Alan Turing Institute(阿兰·图灵研究院)