Beyond Sequential Distance: Inter-Modal Distance Invariant Position Encoding
超越序列距离:模态间距离不变位置编码
Lin Chen, Bolin Ni, Qi Yang, Zili Wang, Kun Ding, Ying Wang, Houwen Peng, Shiming Xiang
机构
*
MAIS, Institute of Automation, Chinese Academy of Sciences, China(MAIS,自动化研究所,中国科学院,中国)
;
University of Chinese Academy of Sciences, China(中国科学院大学,中国)
;
Tencent Hunyuan Team, China(腾讯文言团队,中国)
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Kling Team, Kuaishou Technology(Kling团队,快手科技)
;
Tsinghua University(清华大学)
;
Sun Yat-sen University(中山大学)
Knowledge Graph Enhanced Memory-Augmented Retrieval for Long Context Modeling
知识图谱增强的记忆增强检索用于长上下文建模
Ghadir Alselwi, Basem Suleiman, Hao Xue, Shoaib Jameel, Hakim Hacid, Flora D. Salim, Imran Razzak
机构
*
University of New South Wales(新南威尔士大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
University of Southampton(南安普顿大学)
;
Technology Innovation Institute(技术创新研究所)
;
Mohamed Bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
HDRAgent: An Agentic Framework for Multi-Exposure HDR Imaging
HDRAgent: 一种用于多曝光HDR成像的智能体框架
Weiyu Zhou, Tao Hu, Yijian Wang, Xiaogang Xu, Ruixing Wang, Qingsen Yan
机构
*
School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院)
;
Shenzhen Research Institute, Northwestern Polytechnical University(西北工业大学深圳研究院)
;
Zhejiang University(浙江大学)
;
Camera Group, DJI(大疆相机部门)
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)
MesaNet: Sequence Modeling by Locally Optimal Test-Time Training
MesaNet: 通过局部最优测试时训练进行序列建模
Johannes von Oswald, Nino Scherrer, Seijin Kobayashi, Luca Versari, Songlin Yang, Sarthak Mittal, Maximilian Schlegel, Kaitlin Maile, Yanick Schimpf, Oliver Sieberling, Alexander Meulemans, Rif A. Saurous, Guillaume Lajoie, Charlotte Frenkel, Razvan Pascanu, Blaise Agüera y Arcas, João Sacramento
机构
*
Google(谷歌)
;
Paradigms of Intelligence Team(智能范式团队)
;
Google DeepMind(谷歌DeepMind)
;
MIT CSAIL(麻省理工学院CSAIL)
Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends
迈向交互式视频世界建模:前沿、挑战、基准与未来趋势
Jiuming Liu, Chaojun Ni, Mengmeng Liu, Chensheng Peng, Fangjinhua Wang, Sitian Shen, Marc Pollefeys, Masayoshi Tomizuka, Ayush Tewari, Per Ola Kristensson
机构
*
Department of Engineering, University of Cambridge, U.K.(剑桥大学工程系)
;
Peking University(北京大学)
;
University of Twente(埃因霍温理工大学)
;
Mechanical Systems Control Laboratory, University of California, Berkeley, USA(加州大学伯克利分校机械系统控制实验室)
;
ETH Zurich(苏黎世联邦理工学院)
;
Microsoft(微软公司)
;
University of Oxford(牛津大学)
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)
Dynamic Resilient Spatio-Semantic Memory with Hybrid Localization for Mobile Manipulation
面向移动操作的动态弹性时空语义记忆与混合定位
Zhijie Yan, Shufei Li, Ze Zhang, Xin Liu, Yuhang Zheng, Zuoxu Wang
机构
*
School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)
;
Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系)
;
School of Computing, National University of Singapore(新加坡国立大学计算机学院)
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)
SpaMEM: Benchmarking Dynamic Spatial Reasoning via Perception-Memory Integration in Embodied Environments
SpaMEM:具身环境中通过感知-记忆集成进行动态空间推理的基准测试
Chih-Ting Liao, Xi Xiao, Chunlei Meng, Zhangquan Chen, Yitong Qiao, Weilin Zhou, Tianyang Wang, Xu Zheng, Xin Cao
机构
*
The University of New South Wales(新南威尔士大学)
;
The University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)
;
Fudan University(复旦大学)
;
Tsinghua University(清华大学)
;
Zhejiang University(浙江大学)
;
Xinjiang University(新疆大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)