WebDS: An End-to-End Benchmark for Web-based Data Science
WebDS: 一种端到端的基于网络的数据科学基准
Ethan Hsu, Hong Meng Yam, Ines Bouissou, Aaron Murali John, Raj Thota, Josh Koe, Vivek Sarath Putta, G K Dharesan, Alexander Spangher, Shikhar Murty, Tenghao Huang, Christopher D. Manning
机构
*
Stanford University(斯坦福大学)
;
Pinetree Research(Pinetree研究公司)
;
University of California, Berkeley(加州大学伯克利分校)
;
Singapore University of Technology and Design(新加坡科技设计大学)
;
University of Southern California(南加州大学)
Comments5 pages, 6 figures, Proceedings of the 31st International Symposium on Lepton Photon Interactions at High Energies (LP2025). https://cds.cern.ch/record/2952677
Developing an AI Assistant for Knowledge Management and Workforce Training in State DOTs
为州交通部门的知识管理和员工培训开发人工智能助手
Divija Amaram, Lu Gao, Gowtham Reddy Gudla, Tejaswini Sanjay Katale
机构
*
Department of Computer Science, University of Houston(计算机科学系,休斯顿大学)
;
Department of Civil and Environmental Engineering, University of Houston(土木与环境工程系,休斯顿大学)
;
Ph.D Department of Civil and Environmental Engineering, University of Houston(土木与环境工程系,休斯顿大学)
;
Engineering Data Science, University of Houston(工程数据科学,休斯顿大学)
Training High-Level Schedulers with Execution-Feedback Reinforcement Learning for Long-Horizon GUI Automation
通过执行反馈强化学习训练高阶调度器以实现长周期GUI自动化
Zehao Deng, Tianjie Ju, Zheng Wu, Zhuosheng Zhang, Gongshen Liu
机构
*
School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院)
;
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments
LaViRA: 语言-视觉-机器人动作翻译用于连续环境中的零样本视觉语言导航
Hongyu Ding, Ziming Xu, Yudong Fang, You Wu, Zixuan Chen, Jieqi Shi, Jing Huo, Yifan Zhang, Yang Gao
机构
*
School of Computer Science, Nanjing University(南京大学计算机科学学院)
;
School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
专题命中
GUI与屏幕智能体
:grounding(abstract);multimodal large language model(abstract)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
;
University of Adelaide(阿德莱德大学)
;
Wuhan University(武汉大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Beijing Jiaotong University(北京交通大学)
;
AIR Wuxi Innovation Center, Tsinghua University(清华大学无锡创新中心)
;
Lenovo(联想集团)
专题命中
GUI与屏幕智能体
:multimodal large language model(abstract);分类 cs.CV、cs.AI
Logit-Level Uncertainty Quantification in Vision-Language Models for Histopathology Image Analysis
视觉-语言模型在病理图像分析中的logit级不确定性量化
Betul Yurdem, Ferhat Ozgur Catak, Murat Kuzlu, Mehmet Kemal Gullu
机构
*
Department of Electrical and Electronics Engineering, Izmir Bakircay University(电气与电子工程系,伊兹密尔巴克伊大学)
;
Department of Electrical Engineering and Computer Science, University of Stavanger(电气工程与计算机科学系,斯塔万格大学)
;
Batten College of Engineering and Technology, Old Dominion University(工程与技术学院,老奥布良大学)
机构
*
Dalian Maritime University(大连海事大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Tsinghua University(清华大学)
;
Nanyang Technological University(南洋理工大学)
;
Xi'an Jiaotong University(西安交通大学)
;
Renmin University of China(中国人民大学)
;
Wuhan University(武汉大学)
专题命中
幻觉与鲁棒性
:MLLM(title);multimodal large language model(abstract);分类 cs.AI
Cognition to Control - Multi-Agent Learning for Human-Humanoid Collaborative Transport
认知到控制 - 多智能体学习用于人-仿人协作运输
Hao Zhang, Ding Zhao, H. Eric Tseng
机构
*
Department of Electrical Engineering, the University of Texas at Arlington(电气工程系,德克萨斯大学阿灵顿分校)
;
Department of Mechanical Engineering, Carnegie Mellon University(机械工程系,卡内基梅隆大学)
Comments9 pages, 9 figures. Jake Thomas served as Editor for this manuscript
Journal refProceedings of the 2025 Conference on Applied Machine Learning for Information Security, Proceedings of Machine Learning Research PMLR Vol 299 pp 28 41
Merlin: A Computed Tomography Vision-Language Foundation Model and Dataset
Merlin:一种计算断层扫描视觉-语言基础模型和数据集
Louis Blankemeier, Ashwin Kumar, Joseph Paul Cohen, Jiaming Liu, Longchao Liu, Dave Van Veen, Syed Jamal Safdar Gardezi, Hongkun Yu, Magdalini Paschali, Zhihong Chen, Jean-Benoit Delbrouck, Eduardo Reis, Robbie Holland, Cesar Truyts, Christian Bluethgen, Yufu Wu, Long Lian, Malte Engmann Kjeldskov Jensen, Sophie Ostmeier, Maya Varma, Jeya Maria Jose Valanarasu, Zhongnan Fang, Zepeng Huo, Zaid Nabulsi, Diego Ardila, Wei-Hung Weng, Edson Amaro Junior, Neera Ahuja, Jason Fries, Nigam H. Shah, Greg Zaharchuk, Marc Willis, Adam Yala, Andrew Johnston, Robert D. Boutin, Andrew Wentland, Curtis P. Langlotz, Jason Hom, Sergios Gatidis, Akshay S. Chaudhari
机构
*
Stanford University(斯坦福大学)
;
Stanford Center for Artificial Intelligence in Medicine and Imaging(斯坦福大学医学与成像人工智能中心)
;
Department of Electrical Engineering(电气工程系)
;
University of California Berkeley(加州大学伯克利分校)
;
Department of Radiology(放射科)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
Hospital Israelita Albert Einstein(以色列特医院阿尔伯特·爱因斯坦医院)