Thomas Simon Foster, Bassel Al Omari, Tingchen Fu, Thomas Mann, Carl Domond, Lucia Cipolina-Kun, Bhavul Gauri, Muna Aghamelu, Alexander D. Goldie, Eryk Helenowski, Jean-Christophe Gagnon-Audet, Alberto Pepe, Saba Nazir, Daniel Izcovich, Noam Levi, Rishi Hazra, Karen Hambardzumyan, Nicolas Baldwin, Xian Li, Martin Josifoski, Paris Giampouras, Masoud Jalili Sabet, Anya Sims, Hela Momand, Tatiana Shavrina, Despoina Magka, Jason Weston, Yulin Wang, Anirudh Goyal, João Henriques, Yoram Bachrach, Emily McMilin, Jakob Nicolaus Foerster
机构
*
FAIR at Meta
;
University of Oxford(牛津大学)
;
University College London(伦敦大学学院)
Beyond Simulated Benchmarks: Evaluating Motion Representations for Fall Detection Under Real-World Data Scarcity
超越模拟基准:真实世界数据稀缺下跌倒检测的运动表示评估
Timilehin B. Aderinola, Ilaria D'Ascanio, Luca Palmerini, Lorenzo Chiari, Jochen Klenk, Clemens Becker, Brian Caulfield, Georgiana Ifrim
机构
*
University College Dublin (UCD)(都柏林大学学院)
;
University of Bologna(博洛尼亚大学)
;
Robert Bosch Hospital(罗伯特博世医院)
;
Heidelberg University Hospital(海德堡大学医院)
ViTOED: A Dataset for Target-Oriented Emotion Detection on Vietnamese Social Media Texts
ViTOED:面向越南社交媒体文本的定向情感检测数据集
Chanh Vo, Son T. Luu, Ngan Luu-Thuy Nguyen
机构
*
Faculty of Information Science and Engineering, University of Information Technology(信息科学与工程学院,信息科技大学)
;
Vietnam National University, Ho Chi Minh City(越南国家大学胡志明市分校)
机构
*
Hangzhou Institute for Advanced Study(杭州高等研究院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Computer Network Information Center(计算机网络信息中心)
;
Chinese Academy of Sciences(中国科学院)
Apodex Discovery: Reality Benchmarks and Environments for Evaluating and Building Discoverative Artificial Intelligence
Apodex Discovery:用于评估和构建发现式人工智能的现实基准与环境
Brian Wang, Bin Feng, Xiaoman Pan, Chenyang An, Felix Liu, Tangqi Fang, Gongbo Sun, Lingfeng Shen, Ning Wang, Handuo Zhang, Feng Chen, Fuchao Yang, Xiang Wang, Jiacheng Lin, Siting Li, Zixuan Liu, Chi Han, Zhenhailong Wang, Kunlun Zhu, Lawrence Zhao, Yueqi Guo, Kailong Wen, Feng Xing, Yiling Guo, Lidong Bing, David Tan, Bo An, Heng Ji, Sheng Wang
Comments9 pages, 7 figures, 5 tables. Conditionally accepted to VISxVision 2026, a workshop at IEEE VIS 2026. Includes appendix with per-task stimuli, metric derivations, and full per-model results
When Skills Meet Safety: Benchmarking and Characterizing the Adaptive Jailbreak Robustness of Skill-Merged LLMs
当技能与安全相遇:对技能合并大语言模型的自适应越狱鲁棒性进行基准测试与表征
Yu Ma, Hongli Shi, Jing Li, Xinran Xu, Weiwei Hou
机构
*
Google(谷歌公司)
;
University of New South Wales(新南威尔士大学)
;
University of Technology Sydney(悉尼科技大学)
;
Zhejiang University(浙江大学)
;
Australian National University(澳大利亚国立大学)
Illusion of Alignment: Detecting Hidden Disagreement in Collaborative Dialogue
对齐的错觉:检测协同对话中的隐藏分歧
Kaiming Liu, Fuwen Luo, Ziyue Wang, Jinrui Ju, Yuxuan Liu, Xuanyu Lei, Yunghwei Lai, Peng Li, Yang Liu
机构
*
College of AI, Tsinghua University(清华大学人工智能学院)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
Institute for AI, Tsinghua University(清华大学人工智能研究院)