机构
*
National Taiwan University(国立台湾大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Academia Sinica, Taiwan(台湾“中央研究院”)
;
NTU AI-CoRE(国立清华大学AI研究中心)
专题命中
评测与基准
:LLM(summary_cn,abstract_cn);large language model(title);language model(title);分类 cs.CL、cs.AI
Agentic Large Language Models for Training-Free Neuro-Radiological Image Analysis
基于代理的大型语言模型用于无训练神经放射学图像分析
Ayhan Can Erdur, Daniel Scholz, Jiazhen Pan, Benedikt Wiestler, Daniel Rueckert, Jan C. Peeken
机构
*
Department of Radiation Oncology, TUM University Hospital, Munich, Germany(放射肿瘤科,慕尼黑技术大学医院,德国)
;
Chair for AI in Healthcare and Medicine, Technical University of Munich (TUM)(人工智能在医疗和健康领域的主任,慕尼黑技术大学)
;
Chair for AI for Image-Guided Diagnosis and Therapy, Technical University of Munich (TUM)(人工智能在影像引导诊断和治疗领域的主任,慕尼黑技术大学)
;
Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心(MCML),德国慕尼黑)
;
Department of Computing, Imperial College London, London, UK(计算系,伦敦帝国学院,英国伦敦)
;
Deutsches Konsortium für Translationale Krebsforschung (DKTK), Partner Site Munich, Munich, Germany(德国转化癌症研究联盟(DKTK),慕尼黑分部,德国慕尼黑)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI
Large language models for post-publication research evaluation: Evidence from expert recommendations and citation indicators
基于大语言模型的发表后研究评估:专家推荐与引用指标的证据
Mengjia Wu, Yi Zhang, Robin Haunschild, Lutz Bornmann
机构
*
Australian Artificial Intelligence Institute, Faculty of Engineering and Information Technology, University of Technology Sydney(澳大利亚人工智能研究所,工程与信息科技学院,新南威尔士大学)
;
Max Planck Institute for Solid State Research(马克斯·普朗克固体物理研究所)
;
Science Policy and Strategy Department, Administrative Headquarters of the Max Planck Society(马克斯·普朗克学会科学政策与战略部门,行政总部)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI
MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models
MHSafeEval:面向大语言模型中心理健康安全的交互层面角色感知评估
Suhyun Lee, Palakorn Achananuparp, Neemesh Yadav, Ee-Peng Lim, Yang Deng
机构
*
Department of Artificial Intelligence, Hanyang University(翰艺大学人工智能系)
;
School of Computing and Information Systems, Singapore Management University(新加坡国立管理学院信息系)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
First, Do No Harm (With LLMs): Mitigating Racial Bias via Agentic Workflows
首先,不要伤害(与LLM一起):通过代理工作流减轻种族偏见
Sihao Xing, Zaur Gouliev
机构
*
School of Enterprise Computing and Digital Transformation(企业计算与数字化转型学院)
;
Technological University Dublin(都柏林技术大学)
;
School of Information and Communication Studies(信息与传播研究学院)
;
University College Dublin(都柏林大学学院)
专题命中
评测与基准
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
;
Beijing Key Laboratory of Artificial Intelligence for Education Engineering Research Center of Intelligent Technology and Educational Application, Ministry of Education(北京市教育厅人工智能教育工程研究中心智能技术与教育应用联合实验室)
专题命中
评测与基准
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
Salesforce AI Research(Salesforce AI研究院)
;
Intuit(Intuit公司)
;
Vanderbilt University(范德比大学)
;
University of California, Davis(加州大学戴维斯分校)
;
Vanderbilt University Medical Center(范德比大学医学中心)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
Alexandria: A Multi-Domain Dialectal Arabic Machine Translation Dataset for Culturally Inclusive and Linguistically Diverse LLMs
Alexandria:一个多领域方言阿拉伯语机器翻译数据集,用于文化包容和语言多样性的LLM
Abdellah El Mekki, Samar M. Magdy, Houdaifa Atou, Ruwa AbuHweidi, Baraah Qawasmeh, Omer Nacar, Thikra Al-hibiri, Razan Saadie, Hamzah Alsayadi, Nadia Ghezaiel Hammouda, Alshima Alkhazimi, Aya Hamod, Al-Yas Al-Ghafri, Wesam El-Sayed, Asila Al sharji, Mohamad Ballout, Anas Belfathi, Karim Ghaddar, Serry Sibaee, Alaa Aoun, Areej Asiri, Lina Abureesh, Ahlam Bashiti, Majdal Yousef, Abdulaziz Hafiz, Yehdih Mohamed, Emira Hamedtou, Brakehe Brahim, Rahaf Alhamouri, Youssef Nafea, Aya El Aatar, Walid Al-Dhabyani, Emhemed Hamed, Sara Shatnawi, Fakhraddin Alwajih, Khalid Elkhidir, Ashwag Alasmari, Abdurrahman Gerrio, Omar Alshahri, AbdelRahim A. Elmadany, Ismail Berrada, Amir Azad Adli Alkathiri, Fadi A Zaraket, Mustafa Jarrar, Yahya Mohamed El Hadj, Hassan Alhuzali, Muhammad Abdul-Mageed
机构
*
The University of British Columbia(不列颠哥伦比亚大学)
;
Canada Research Chair in NLP and ML(自然语言处理和机器学习研究主席)
;
Mohammed VI Polytechnic University(穆莱·阿卜杜勒阿齐兹国王理工学院)
;
Birzeit University(比尔泽特大学)
;
Western Michigan University(西部密歇根大学)
;
Tuwaiq Academy(图瓦伊克学院)
;
King Khalid University(国王卡利德大学)
;
American University of Beirut(贝鲁特美国大学)
;
Ibb University(伊卜大学)
;
University of Hail(海勒大学)
;
University of Technology and Applied Sciences(技术与应用科学大学)
;
Arab Open University(阿拉伯开放大学)
;
Minia University(米尼亚大学)
;
Nantes University(南特大学)
;
Prince Sultan University(沙特王子大学)
;
Umm Al-Qura University(乌姆·阿勒·卡拉大学)
;
University of Nouakchott(努尔人大学)
;
Fatabyyano(法塔比亚诺)
;
Independent Researcher(独立研究者)
;
Hadhramout University(哈德拉姆大学)
;
Cairo University(开罗大学)
;
Misurata University(米斯拉塔大学)
;
Al-Balqa Applied University(巴勒斯坦应用大学)
;
University of Khartoum(喀土穆大学)
;
Sultan Qaboos Higher Centre for Culture and Science(穆罕默德·本·拉希德·阿勒马克图姆文化与科学高级中心)
;
Arab Center for Research and Policy Studies(阿拉伯研究中心)
;
Hamad Bin Khalifa University(哈马德·本·哈利法大学)
;
Institut Supérieur du Numérique(数字高级学院)
专题命中
评测与基准
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL
QuickScope: Certifying Hard Questions in Dynamic LLM Benchmarks
QuickScope:动态LLM基准测试中验证难题问题
Taylor Lundy, Narun K. Raman, Kevin Leyton-Brown
机构
*
Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家)
;
School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)
HR-Agents: Using Multiple LLM-based Agents to Improve Q&A about Brazilian Labor Legislation
HR-Agents:利用多个基于大语言模型的代理提高关于巴西劳动立法的问题解答
Abriel K. Moraes, Gabriel S. M. Dias, Vitor L. Fabris, Lucas D. Gessoni, Leonardo R. do Nascimento, Charles S. Oliveira, Vitor G. C. B. de Farias, Fabiana C. Q. de O. Marucci, Matheus H. R. Vicente, Gabriel U. Talasso, Erik Soares, Amparo Munoz, Sildolfo Gomes, Maria L. A. de S. Cruvinel, Leonardo T. dos Santos, Renata De Paris, Wandemberg Gibaut
机构
*
Eldorado Institute of Research(埃洛多研究 institute)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
Diagnosing LLM-based Rerankers in Cold-Start Recommender Systems: Coverage, Exposure and Practical Mitigations
诊断基于大语言模型的重排器在冷启动推荐系统中的表现:覆盖、曝光与实际缓解措施
Ekaterina Lemdiasova, Nikita Zmanovskii
机构
*
V. A. Trapeznikov ICS RAS Russian Biotechnological University (ROSBIOTECH)(Trapeznikov ICS 俄罗斯科学院俄罗斯生物技术大学)
;
Russian Biotechnological University (ROSBIOTECH)(俄罗斯生物技术大学)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
Results-Actionability Gap: Understanding How Practitioners Evaluate LLM Products in the Wild
结果-可行动性差距:理解从业者如何在实际中评估大语言模型产品
Willem van der Maden, Malak Sadek, Ziang Xiao, Aske Mottelson, Q. Vera Liao, Jichen Zhu
机构
*
HCI \& Design Section IT University of Copenhagen Copenhagen Denmark
;
Centre for Human-Inspired Artificial Intelligence, Cambridge University Cambridge United Kingdom
;
Computer Science Johns Hopkins University Baltimore Maryland United States
;
Engineering University of Michigan Ann Arbor Michigan United States
;
IT University of Copenhagen
;
Centre for Human-Inspired Artificial Intelligence, Cambridge University
;
Johns Hopkins University
;
University of Michigan
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI