CommentsAccepted at the Conference on Language Modeling (COLM) 2026. 45 pages, including appendices; 24 figures and 12 tables. Code: https://github.com/withmartian/mi-cot
The IOL-AI Challenge: An Open Challenge towards Advancing Linguistic Reasoning
IOL-AI挑战赛:一项旨在推进语言推理的开放挑战赛
Eduardo Sánchez, Rita Berrada, Dan-Mircea Mirea, Sara Rajaee, Alexander Piperski, Ana Meta Dolinar, Boris Iomdin, Andrey Nikulin, Mariya Shmatova, Marzieh Fadaee, Julia Kreutzer
机构
*
University College London(伦敦大学学院)
;
Meta
;
CentraleSupélec(中央高等电力学院)
;
McGill University(麦吉尔大学)
;
Cohere Labs(Cohere实验室)
;
Princeton University(普林斯顿大学)
;
University of Amsterdam(阿姆斯特丹大学)
;
Stockholm University(斯德哥尔摩大学)
;
Faculty of Liberal Arts and Sciences(文理学院)
;
Universidade Federal de Goiás(戈亚斯联邦大学)
CommentsTheory paper, 13 pages, 1 analytical figure. Deterministic verification code is included as ancillary material. No new language-model experiment
MedClaw: Heuristic Agent Harness for Long-Horizon Surgical Video Reasoning
MedClaw:用于长程手术视频推理的启发式智能体框架
Yingying Fan, Penghui Du, Leyan Zhu, Runze He, Zimeng Wu, Yuxuan Zhang, Liang Chen, Jiahao Xie, Jiangtang Wang, Shuai Shao, Anchao Yang, Yutong Bai, Yan Wang
机构
*
School of Automation and Intelligence, Beijing Jiaotong University(北京交通大学自动化与智能学院)
;
University of Maryland(马里兰大学)
;
Suzhou Institute for Advanced Research, University of Science and Technology of China(中国科学技术大学苏州高等研究院)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Beijing Tiantan Hospital, Capital Medical University(首都医科大学附属北京天坛医院)
IO Factory: Simulating AI-Enabled Influence Campaigns at Scale
IO Factory:大规模模拟AI驱动的影响力行动
Lukasz Olejnik, Wenchao Dong, Jonas R. Kunst, Signe Riemer-Sørensen, Tobias Herb, Meeyoung Cha, Daniel Thilo Schroeder
机构
*
King’s College London(伦敦国王学院)
;
Max Planck Institute for Security and Privacy(马克斯·普朗克安全与隐私研究所)
;
BI Norwegian Business School(挪威商学院)
;
University of Oslo(奥斯陆大学)
;
SINTEF Digital(SINTEF数字研究所)
;
Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)