OCC-RAG: Optimal Cognitive Core for Faithful Question Answering
OCC-RAG:面向忠实问答的最优认知核心
Maksim Savkin, Mikhail Goncharov, Alexander Gambashidze, Alla Chepurova, Dmitrii Tarasov, Nikita Andriianov, Daria Pugacheva, Vasily Konovalov, Andrey Galichin, Ivan Oseledets
机构
*
OCC Team(OCC团队)
专题命中
预训练与数据
:language model(abstract);small language model(abstract);SLM(abstract_cn);分类 cs.CL
When Data Is Scarce: Scaling Sparse Language Models with Repeated Training
当数据稀缺时:通过重复训练扩展稀疏语言模型
Boqian Wu, Qiao Xiao, Patrik Okanovic, Tomasz Sternal, Maurice van Keulen, Mykola Pechenizkiy, Elena Mocanu, Torsten Hoefler, Decebal Constantin Mocanu
机构
*
Eindhoven University of Technology(埃因霍温理工大学)
;
University of Luxembourg(卢森堡大学)
;
University of Twente(埃因霍温大学)
;
ETH Zürich(苏黎世联邦理工学院)
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
University of Washington(华盛顿大学)
;
University of Toronto(多伦多大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
University of California, Los Angeles(加州大学洛杉矶分校)
机构
*
Department of Industrial Engineering and Operations Research and Data Science Institute, Columbia University(工业工程与运筹学系及数据科学研究所,哥伦比亚大学)
;
Decision, Risk, and Operations Division, Columbia Business School(决策、风险与运营部门,哥伦比亚商学院)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
WALL-WM: Carving World Action Modeling at the Event Joints
WALL-WM:在事件关节处雕刻世界动作建模
Shalfun Li, Victor Yao, Charles Yang, Truth Qu, Regis Cheng, Ryan Yu, Howard Lu, Newton Von, Vincent Chen, Yohann Tang, Maeve Zhang, Ellie Ma, Gody Li, Sage Yang, Lorien Shu, J. W. Gao, Ethan Chen, Colin Ye, Yu Sun, Elise Mon, PS Zhang, Neo Li, Lily Li, James Wang, Ping Yang, Chris Pan, Lucy Liang, Hang Su, Roy Gan, Hao Wang, Qian Wang
专题命中
预训练与数据
:language model(abstract,journal_ref);分类 cs.CL;large language model(journal_ref)
AI总结
通过在大规模德语语料库上使用 RoBERTa 架构和 Whole Word Masking 进行增量预训练,GeistBERT 在多项德语 NLP 任务上取得了领先性能,并在 GermEval 2018 细粒度文本分类中达到新 SOTA。
Journal refProceedings of the Workshop on Beyond English: Natural Language Processing for all Languages in an Era of Large Language Models, 2025, pp. 42-50
Versatile Framework with Semantic and Structural guidance for Image Reconstruction from Brain Activity
基于语义和结构引导的大脑活动图像重建通用框架
Yizhuo Lu, Changde Du, Qiongyi Zhou, Liuyun Jiang, Huiguang He
机构
*
State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology(脑认知与脑启发智能技术国家重点实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
SindBERT, the Sailor: Charting the Seas of Turkish NLP
SindBERT,水手:绘制土耳其语NLP的海洋
Raphael Schmitt, Stefan Schweter
机构
*
School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院)
;
Institute of General Practice, Faculty of Medicine and Medical Center, University of Freiburg(弗赖堡大学医学系一般实践研究所)
;
Independent Researcher(独立研究者)
AlbedoEdit: Unified Instance-Level Video Editing with Albedo Guidance
AlbedoEdit: 基于反照率引导的统一实例级视频编辑
Xilong Zhou, Bao-Huy Nguyen, Zheng Zeng, Jacob Munkberg, Jon Hasselgren, Thomas Leimkühler, Nima Kalantari, Miloš Hašan, Christian Theobalt
机构
*
Max Planck Institute for Informatics(马克斯·普朗克信息研究所)
;
University of California Santa Barbara(加州大学圣巴巴拉分校)
;
NVIDIA Research(NVIDIA研究)
;
Texas A & M University(德克萨斯A&M大学)
Ryan Yu, Pushi Zhang, Starrick Liu, Brae Liu, Miracle Kang, Shalfun Li, Lights Shi, Ellie Ma, Ping Yang, Chris Pan, Jerry Chen, Dongxiu Liu, Rain Sun, Miles Guo, Byron Zhang, Hugo Zhou, Zach Xu, Vincent Chen, Harrison Huang, James Wang, Dance Kuzi, Andy Zhai, Hang Su, Roy Gan, Lucy Liang, Hao Wang, Qian Wang