SceneRAG: Scene-level Retrieval-Augmented Generation for Video Understanding
Nianbo Zeng, Haowen Hou, Fei Richard Yu, Si Shi, Ying Tiffany He
机构
*
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室)
;
College of Computer Science and Software Engineering(计算机科学与软件工程学院)
Wenbin Wang, Yongcheng Jing, Liang Ding, Yingjie Wang, Li Shen, Yong Luo, Bo Du, Dacheng Tao
机构
*
Wuhan University(武汉大学)
;
Nanyang Technological University(南洋理工大学)
;
The University of Sydney(悉尼大学)
;
Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)
CommentsASME 2025 International Design Engineering Technical Conferences and Computers and Information in Engineering Conference IDETC/CIE2025, August 17-20, 2025, Anaheim, CA (IDETC2025-168615)
WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering
WikiSeeker: 重新思考视觉语言模型在基于知识的视觉问答中的作用
Yingjian Zhu, Xinming Wang, Kun Ding, Ying Wang, Bin Fan, Shiming Xiang
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室 (MAIS))
Concept-Enhanced Multimodal RAG: Towards Interpretable and Accurate Radiology Report Generation
概念增强的多模态RAG:迈向可解释且准确的放射科报告生成
Marco Salmè, Federico Siciliano, Fabrizio Silvestri, Paolo Soda, Rosa Sicilia, Valerio Guarrasi
机构
*
Department of Engineering(工程系)
;
Research Unit of Artificial Intelligence and Computer Systems(人工智能与计算机系统研究单位)
;
Università Campus Bio-Medico of Roma(罗马大学生物医学校园)
;
Department of Computer, Control and Management Engineering(计算机、控制与管理工程系)
;
Sapienza University of Rome(罗马萨皮恩扎大学)
;
Department of Diagnostics and Intervention, Radiation Physics, Biomedical Engineering(诊断与介入、辐射物理、生物医学工程系)
;
Umeå University(乌梅拉大学)
;
UniCamillus-Saint Camillus International University of Health Sciences(UniCamillus-圣卡米卢斯国际健康科学大学)
机构
*
Dept. of Computer Engineering(计算机工程系)
;
SIES Graduate School of Technology(SIES技术研究生学院)
;
Bharatiya Vidya Bhavan's Sardar Patel Institute of Technology(巴哈里亚·维达·巴万学院萨达尔·帕特尔技术学院)
A/B Agent: A Self-Evolving Agent for Strategy Iteration in Industrial A/B Testing
A/B Agent:面向工业A/B测试中策略迭代的自进化智能体
Zhuohang Jiang, Yuxin Chen, Yongsen Pan, Zheng Hu, Wenqi Fan, Qing Li, Hongyang Wang, Jun Wang, Wenwu Ou
机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
Kuaishou Technology(快手科技)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Southwest Jiaotong University(西南交通大学)
OralAgent: Integrating Reasoning, Tools, and Knowledge for Interactive Dental Image Analysis
OralAgent: 融合推理、工具与知识的交互式牙科影像分析
Jing Hao, Siyuan Dai, Yongxin Zhang, Yuci Liang, Jiamin Wu, Jiahao Bao, Yuxuan Fan, Zanting Ye, Yanpeng Sun, Xinyu Zhang, Ming Hu, Liang Zhan, James Kit Hon Tsoi, Linlin Shen, Junjun He, Kuo Feng Hung
机构
*
Faculty of Dentistry, the University of Hongkong, Hong Kong SAR, China(香港大学牙科学院,中国香港特别行政区)
;
Department of Electrical and Computer Engineering, University of Pittsburgh, Pittsburgh, PA, USA(匹兹堡大学电气与计算机工程系,美国宾夕法尼亚州匹兹堡)
;
Shenzhen University, China(深圳大学,中国)
;
Department of Craniomaxillofacial Surgery, Shanghai Ninth People’s Hospital, China(上海第九人民医院口腔颌面外科部,中国)
;
Nanyang technological University, Singapore(南洋理工大学,新加坡)
;
School of Biomedical Engineering, Southern Medical University, China(南方医科大学生物医学工程学院,中国)
;
Singapore University of Technology and Design, Singapore(新加坡科技设计大学,新加坡)
;
University of Auckland, new zealand(奥克兰大学,新西兰)
;
Shanghai Artificial Intelligence Laboratory , China(上海人工智能实验室,中国)