CARTE: A Benchmark for Mapping Language Model Knowledge Across France
CARTE:法国语言模型知识映射基准
Sarah Almeida Carneiro, Christos Xypolopoulos, Xiao Fei, Yang Zhang, Michalis Vazirgiannis
机构
*
École Polytechnique, Institut Polytechnique de Paris(巴黎政治学院)
;
National Technical University of Athens(雅典国家技术大学)
;
Mohamed bin Zayed University of Artificial Intelligence(姆阿扎德人工智能大学)
专题命中
评测与基准
:language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL
TukaBench: A Culturally Grounded Jailbreak Benchmark for African Languages
TukaBench: 一个基于文化的非洲语言越狱基准
Victor Akinode, Senyu Li, Wassim Hamidouche, Waqas Zamir, Inbal Becker-Reshef, David Ifeoluwa Adelani
机构
*
Mila - Quebec AI Institute(魁北克人工智能研究院)
;
McGill University(麦吉尔大学)
;
Microsoft AI for Good Research Lab(微软人工智能造福人类研究实验室)
;
Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)
专题命中
评测与基准
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects
PolySpeech-100:面向100多种语言和方言的大规模语音理解基准
Sicheng Yang, Shulan Ruan, Shiwei Wu, Yu Liu, Lu Fan, Zhi Li, You He
机构
*
Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
;
JD AI Research(京东人工智能研究院)
专题命中
评测与基准
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
A Foundation Model for Wearable Movement Data in Mental Health Research
心理健康研究中可穿戴运动数据的基础模型
Franklin Y. Ruan, Aiwei Zhang, Jenny Y. Oh, SouYoung Jin, Nicholas C. Jacobson
机构
*
Dartmouth College(达特茅斯学院)
;
National Institute of Diabetes and Digestive and Kidney Diseases(国家糖尿病、消化系统疾病和肾病研究所)
;
National Institutes of Health(美国国立卫生研究院)
;
Department of Computer Science at Dartmouth College(达特茅斯学院计算机科学系)
CommentsF. Y. Ruan, A. Zhang, J. Y. Oh, S. Jin and N. C. Jacobson, "A Foundation Model for Wearable Movement Data in Mental Health Research," in IEEE Journal of Biomedical and Health Informatics, doi: 10.1109/JBHI.2026.3694809
When Single Answer Is Not Enough: Rethinking Single-Step Retrosynthesis Benchmarks for LLMs
当单一答案不够时:重新思考面向大语言模型的单步逆合成基准
Bogdan Zagribelnyy, Ivan Ilin, Maksim Kuznetsov, Nikita Bondarev, Mathieu Reymond, Roman Schutski, Thomas MacDougall, Rim Shayakhmetov, Zulfat Miftakhutdinov, Mikolaj Mizera, Vladimir Aladinskiy, Alex Aliper, Alex Zhavoronkov
机构
*
DeepMind, London, UK(伦敦英国深度思维公司)
专题命中
评测与基准
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents
SeClaw: 面向自主代理评估的规范驱动安全任务合成
Hao Cheng, Changtao Miao, Tianle Song, Yin Wu, He Liu, Erjia Xiao, Junchi Chen, Xiaoyu Shi, Yichi Wang, Jing Yang, Taowen Wang, Jinhao Duan, Mengshu Sun, Peiyan Dong, Xuan Shen, Yang Cao, Renjing Xu, Kaidi Xu, Jindong Gu, Bo Zhang, Jize Zhang, Chenhao Lin, Philip Torr, Chao Shen
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
Ant Digital Technologies, Ant Group(蚂蚁集团数字技术部)
;
Xi’an Jiaotong University(西安交通大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
University of Oxford(牛津大学)
;
City University of Hong Kong(香港城市大学)
;
Institute of Science Tokyo(东京科学研究所)
;
Zhejiang University(浙江大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
Beijing University of Technology(北京理工大学)
Genotype-Conditioned Molecular Generation via Evidence-Grounded Multi-Objective Latent Perturbation in Diffusion Models
基于证据的多目标潜在扰动在扩散模型中的基因型条件分子生成
Brenda Nogueira, Gisela A. Gonzalez-Montiel, Nitesh V. Chawla, Nuno Moniz
机构
*
Department of Computer Science and Engineering(计算机科学与工程系)
;
University of Notre Dame(诺克斯大学)
;
Department of Chemistry and Biochemistry(化学与生物化学系)
;
Lucy Family Institute for Data & Society(数据与社会学院)
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
University of Glasgow(格拉斯哥大学)
;
Independent Researcher(独立研究员)
;
Corespeed Inc.(Corespeed公司)
Beyond AI as Assistants: Toward Autonomous Discovery in Cosmology
超越AI助手:迈向宇宙学中的自主发现
Licong Xu, Thomas Borrett
机构
*
Institute of Astronomy, University of Cambridge(剑桥大学天文研究所)
;
Kavli Institute for Cosmology, University of Cambridge(剑桥大学凯斯勒宇宙研究所)
;
Cavendish Astrophysics, University of Cambridge(剑桥大学卡文迪许天体物理研究所)