Development, Evaluation, and Deployment of a Multi-Agent System for Thoracic Tumor Board
胸腔肿瘤板的多智能体系统开发、评估与部署
Tim Ellis-Caleo, Timothy Keyes, Nerissa Ambers, Faraah Bekheet, Wen-wai Yim, Nikesh Kotecha, Nigam H. Shah, Joel Neal
机构
*
Division of Oncology, Department of Medicine, Stanford University School of Medicine(斯坦福大学医学院肿瘤学部)
;
Technology and Digital Solutions, Stanford Health Care(斯坦福健康医疗技术与数字解决方案部)
;
Department of Biomedical Data Science, Stanford University School of Medicine(斯坦福大学医学院生物医学数据科学部)
;
Nursing Informatics, Stanford Health Care(斯坦福健康护理信息学部)
;
Department of Medicine, Stanford University School of Medicine(斯坦福大学医学院医学部)
;
Microsoft AI, Redmond, WA(微软人工智能,西雅图)
;
Stanford Cancer Institute, Palo Alto, CA(斯坦福癌症研究所)
Edu-MMBias: A Three-Tier Multimodal Benchmark for Auditing Social Bias in Vision-Language Models under Educational Contexts
Edu-MMBias: 一种三级多模态基准,用于在教育背景下审计视觉-语言模型中的社会偏见
Ruijia Li, Mingzi Zhang, Zengyi Yu, Yuang Wei, Bo Jiang
机构
*
School of Computer Science and Technology, East China Normal University(东华师范大学计算机科学与技术学院)
;
Shanghai Institute of Artificial Intelligence for Education, East China Normal University(东华师范大学教育人工智能研究所)
;
Faculty of Education, East China Normal University(东华师范大学教育学院)
Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety
大规模安全:大型模型和智能体安全的全面综述
Xingjun Ma, Yifeng Gao, Yixu Wang, Ruofan Wang, Xin Wang, Ye Sun, Yifan Ding, Hengyuan Xu, Yunhao Chen, Yunhan Zhao, Hanxun Huang, Yige Li, Yutao Wu, Jiaming Zhang, Xiang Zheng, Yang Bai, Zuxuan Wu, Xipeng Qiu, Jingfeng Zhang, Yiming Li, Xudong Han, Haonan Li, Jun Sun, Cong Wang, Jindong Gu, Baoyuan Wu, Siheng Chen, Tianwei Zhang, Yang Liu, Mingming Gong, Tongliang Liu, Shirui Pan, Cihang Xie, Tianyu Pang, Yinpeng Dong, Ruoxi Jia, Yang Zhang, Shiqing Ma, Xiangyu Zhang, Neil Gong, Chaowei Xiao, Sarah Erfani, Tim Baldwin, Bo Li, Masashi Sugiyama, Dacheng Tao, James Bailey, Yu-Gang Jiang
机构
*
Fudan University(复旦大学)
;
The University of Melbourne(墨尔本大学)
;
Singapore Management University(新加坡国立大学)
;
Deakin University(德肯大学)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
;
City University of Hong Kong(香港城市大学)
;
University of Oxford(牛津大学)
;
Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shanghai Jiao Tong University(上海交通大学)
;
Nanyang Technological University(南洋理工大学)
;
The University of Sydney(悉尼大学)
;
Griffith University(格里菲斯大学)
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Sea AI Lab(Sea AI实验室)
;
Tsinghua University(清华大学)
;
Virginia Tech(弗吉尼亚理工大学)
;
CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全部)
;
University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)
;
Purdue University(普渡大学)
;
Duke University(杜克大学)
;
University of Wisconsin - Madison(威斯康星大学麦迪逊分校)
;
RIKEN(理化学研究所)
;
The University of Tokyo(东京大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI
Evaluating Language Models for Harmful Manipulation
评估用于有害操控的语言模型
Canfer Akbulut, Rasmi Elasmar, Abhishek Roy, Anthony Payne, Priyanka Suresh, Lujain Ibrahim, Seliem El-Sayed, Charvi Rastogi, Ashyana Kachra, Will Hawkins, Kristian Lum, Laura Weidinger
Universal NER v2: Towards a Massively Multilingual Named Entity Recognition Benchmark
通用命名实体识别v2:迈向大规模多语言命名实体识别基准
Terra Blevins, Stephen Mayhew, Marek Šuppa, Hila Gonen, Shachar Mirkin, Vasile Pais, Kaja Dobrovoljc, Voula Giouli, Jun Kevin, Eugene Jang, Eungseo Kim, Jeongyeon Seo, Xenophon Gialis, Yuval Pinter
机构
*
Northeastern University, USA(东北大学)
;
Duolingo, USA(Duolingo)
;
Comenius University Bratislava, Slovakia(布拉迪斯拉发康门尼大学)
;
University of British Columbia, Canada(不列颠哥伦比亚大学)
;
Alpinference, France(Alpinference)
;
Research Institute for Artificial Intelligence, Romanian Academy, Romania(罗马尼亚科学院人工智能研究所)
;
University of Ljubljana, Slovenia(卢布尔雅那大学)
;
Aristotle University of Thessaloniki / ILSP, Athena Research Center, Greece(雅典纳基大学 / ILSP, 雅典研究中心)
;
Universitas Pelita Harapan, Indonesia(佩利塔哈盼望大学)
;
Seoul National University, South Korea(首尔国立大学)
;
Independent Researcher, South Korea(韩国独立研究员)
;
Democritus University of Thrace, Greece(特拉布宗大学)
;
Ben-Gurion University of the Negev, Israel(贝尼·格里大学)
Invariant Features for Global Crop Type Classification
全局作物类型分类的不变特征
Xin-Yi Tong, Sherrie Wang
机构
*
Laboratory for Information and Decision Systems, MIT(信息与决策系统实验室,麻省理工学院)
;
Department of Mechanical Engineering, MIT(机械工程系,麻省理工学院)
;
Institute for Data, Systems, and Society, MIT(数据、系统与社会研究所,麻省理工学院)
Mobile GUI Agents under Real-world Threats: Are We There Yet?
移动GUI代理在现实威胁下的表现:我们已经到达了吗?
Guohong Liu, Jialei Ye, Jiacheng Liu, Yuanchun Li, Wei Liu, Pengzhi Gao, Jian Luan, Yunxin Liu
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
University of Electronic Science and Technology of China(电子科学与技术大学)
;
Peking University(北京大学)
;
MiLM Plus, Xiaomi Inc.(MiLM Plus,小米公司)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.AI
LOLGORITHM: Funny Comment Generation Agent For Short Videos
LOLGORITHM:短视频 funny 评论生成代理
Xuan Ouyang, Bouzhou Wang, Senan Wang, Siyuan Xiahou, Jinrong Zhou, Yuekang Li
机构
*
University of New South Wales(新南威尔士大学)
;
University of Sydney(悉尼大学)
;
The University of Hong Kong(香港大学)
;
University of Southern California(南加州大学)
StructDiff: A Structure-Preserving and Spatially Controllable Diffusion Model for Single-Image Generation
StructDiff:一种结构保持且空间可控的单图像生成扩散模型
Yinxi He, Kang Liao, Chunyu Lin, Tianyi Wei, Yao Zhao
机构
*
Institute of Information Science, Beijing Jiaotong University(信息科学研究院,北京交通大学)
;
Visual Intelligence +X International Cooperation Joint Laboratory of MOE, Beijing(教育部视觉智能+X国际合作联合实验室,北京)
;
College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract)
机构
*
Department of Information Technology, Rajkiya Engineering College Banda(拉贾基亚工程学院班达信息科技系)
;
School of AI and Data Science, Indian Institute of Technology Jodhpur(印度理工学院乔普拉人工智能与数据科学学院)
CommentsWe evaluate whether VLMs can comprehend multi-scale visual stock price data like human analysts with a proposed benchmark, identifying current VLMs' weak predictive power, significant biases, and limited sensitivity to forecast horizons and prompts
OpenTME: An Open Dataset of AI-powered H&E Tumor Microenvironment Profiles from TCGA
OpenTME:一个基于AI的H&E肿瘤微环境谱开放数据集
Maaike Galama, Nina Kozar-Gillan, Christina Embacher, Todd Dembo, Cornelius Böhm, Evelyn Ramberger, Julika Ribbat-Idel, Rosemarie Krupar, Verena Aumiller, Miriam Hägele, Kai Standvoss, Gerrit Erdmann, Blanca Pablos, Ari Angelo, Simon Schallenberg, Andrew Norgan, Viktor Matyas, Klaus-Robert Müller, Maximilian Alber, Lukas Ruff, Frederick Klauschen
机构
*
Aignostics, Germany(德国Aignostics公司)
;
Institute of Pathology, Charité – Universitätsmedizin Berlin, Germany(德国柏林Charité大学医学院病理研究所)
;
Department of Laboratory Medicine and Pathology, Mayo Clinic, Rochester, MN, US(美国明尼苏达州罗切斯特梅奥诊所实验室医学与病理学部)
;
Machine Learning Group, Technische Universität Berlin, Germany(德国柏林技术大学机器学习小组)
;
BIFOLD – Berlin Institute for the Foundations of Learning and Data, Germany(德国柏林学习与数据基础研究所(BIFOLD))
;
Department of Artificial Intelligence, Korea University, Republic of Korea(韩国韩国大学人工智能系)
;
Max-Planck Institute for Informatics, Germany(德国马克斯·普朗克信息研究所)
;
German Cancer Research Center (DKFZ) & German Cancer Consortium (DKTK), Berlin & Munich Partner Sites, Germany(德国癌症研究中心(DKFZ)与德国癌症联盟(DKTK)柏林及慕尼黑合作伙伴站点)
;
Institute of Pathology, Ludwig-Maximilians-Universität München, Germany(德国慕尼黑路德维希-马克西米利安大学病理研究所)
;
Bavarian Cancer Research Center (BZKF), Germany(德国巴伐利亚癌症研究中心(BZKF))