机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)
;
Beihang University(北京航空航天大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
TokenCast: Forecasting Token Consumption During LLM Agent Execution
TokenCast:预测LLM智能体执行过程中的令牌消耗
Chaoqian Ouyang, Ling Yue, Libin Zheng, Huanghui Guo, Shengxiang Xu, YiShu Wang, Ran Li, Jian Yin, Shaowu Pan, Shimin Di
机构
*
Sun Yat-Sen University(中山大学)
;
Rensselaer Polytechnic Institute(伦斯勒理工学院)
;
Southeast University(东南大学)
;
Hong Kong University of Science and Technology(香港科技大学)
KV-streams for Efficient Compaction in Agentic Reinforcement Learning
KV-streams:用于智能体强化学习中高效压缩的键值流
Emiliano Penaloza, Dane Malenfant, Dheeraj Vattikonda, Roger Creus Castanyer, Siddarth Venkatraman, Abhay Puri, Jonathan Light, Matthew James Sargent, Augustine N. Mavor-Parker, Massimo Caccia, Lucas Caccia, Glen Berseth, Esmeralda S. Whitammer, Alessandro Sordoni, Minseon Kim, Marc-Alexandre Côté, Laurent Charlin, Guillaume Lajoie
机构
*
Mila(米拉研究所)
;
Microsoft(微软)
;
McGill University(麦吉尔大学)
;
Université de Montréal(蒙特利尔大学)
;
Polytechnique Montréal(蒙特利尔理工学院)
;
ServiceNow Inc(ServiceNow公司)
;
Rensselaer Polytechnic Institute(伦斯勒理工学院)
;
University College London, University of London(伦敦大学学院)
;
Vmax(Vmax公司)
;
Edinburgh University(爱丁堡大学)
;
Microsoft Research(微软研究院)
;
Cohere(Cohere公司)
;
HEC Montréal(蒙特利尔高等商学院)
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
University of Science and Technology of China(中国科学技术大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
Copy the Same, Distill the Difference: Initializing Linear Vision Transformers
复制相同,蒸馏差异:初始化线性视觉Transformer
Huaiyuan Qin, Muli Yang, Gabriel James Goenawan, Shiqi Huang, Min Kass Chong, Wahyu Wiratama, Peng Hu, Chen Gong, Wu Liu, Xi Peng, Chun Jian Ho, Hongyuan Zhu
机构
*
Institute of Advanced Intelligence and Computing (IAIC), A*STAR(先进智能与计算研究所(IAIC),新加坡科技研究局)
;
Nanyang Technological University(南洋理工大学)
;
ST Engineering Geo-Insights(新科工程地理信息公司)
;
Sichuan University(四川大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
University of Science and Technology of China(中国科学技术大学)
;
University of Liverpool(利物浦大学)
;
Nanyang Technological University(南洋理工大学)
;
The University of Hong Kong(香港大学)
;
Zhejiang University(浙江大学)
Shockingly Simple Self-retrospection Improves Agentic Models Without RL
惊人简单的自我反思无需强化学习即可提升智能体模型
Jonathan Light, Christopher Zhang Cui, Jeonghye Kim, Roger Creus Castanyer, Emiliano Penaloza, Zhengyan Shi, Alessandro Sordoni, Marc-Alexandre Côté, Xingdi Yuan, Minseon Kim
机构
*
RPI(伦斯勒理工学院)
;
UC San Diego(加州大学圣迭戈分校)
;
KAIST(韩国科学技术院)
;
Mila(米拉研究所)
;
Microsoft Research(微软研究院)
GeoVerse: World-Consistent Novel View Synthesis in Geometric Latent Space
GeoVerse:几何潜在空间中的世界一致新视角合成
Kerui Ren, Tao Lu, Linning Xu, Changjian Jiang, Mu Huang, Chunhua Shen, Mulin Yu, Bo Dai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
The Chinese University of Hong Kong(香港中文大学)
;
The University of Hong Kong(香港大学)
;
Fudan University(复旦大学)
;
Zhejiang University(浙江大学)
Artin Sermaxhaj, Nastaran Alipour, Donat Sinani, Johannes Hog, Neeratyoy Mallik, Jenia Jitsev, Danny Stoll
机构
*
University of Freiburg(弗莱堡大学)
;
Zuse School ELIZA(楚泽学院ELIZA)
;
Juelich Supercomputing Center (JSC), Research Center Juelich (FZJ)(于利希超算中心(JSC),于利希研究中心(FZJ))