机构
*
Zhejiang University(浙江大学)
;
Westlake University(西湖大学)
;
Xiamen University(厦门大学)
;
University of Sussex(Sussex大学)
;
Tianjin University(天津大学)
;
Wuhan University(武汉大学)
;
Hebei University of Technology(河北工业大学)
;
Nanjing University(南京大学)
;
Fudan University(复旦大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
South China University of Technology(华南理工大学)
机构
*
China University of Geosciences (Beijing)(中国地质大学(北京))
;
Shenzhen University(深圳大学)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
;
City University of Hong Kong(香港城市大学)
专题命中
长上下文与记忆
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
The $\mathbf{Y}$-Combinator for LLMs: Solving Long-Context Rot with $λ$-Calculus
LLMs的Y-组合子:解决长上下文旋转问题的λ演算
Amartya Roy, Rasul Tutunov, Xiaotong Ji, Matthieu Zimmer, Haitham Bou-Ammar
机构
*
The School of Interdisciplinary Research(跨学科研究学院)
;
Indian Institute of Technology (IIT) Delhi(印度理工学院德里分校)
;
Robert Bosch GmbH, India(德国罗伯特·博世有限公司,印度)
;
Huawei Noah’s Ark Lab(华为诺亚方舟实验室)
;
Huawei Noah’s Ark UCL Centre for Artificial Intelligence(华为诺亚方舟大学伦敦人工智能中心)
TextReasoningBench: Does Reasoning Really Improve Text Classification in Large Language Models?
TextReasoningBench: 推理是否真的能提升大语言模型中的文本分类性能?
Xinyu Guo, Yazhou Zhang, Jing Qin
机构
*
School of Computer Science and Technology, Tianjin University(天津大学计算机科学与技术学院)
;
School of Nursing, The Hong Kong Polytechnic University(香港理工大学护理学院)
专题命中
推理与问题求解
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
One Model, Two Minds: Task-Conditioned Reasoning for Unified Image Quality and Aesthetic Assessment
一个模型,两种思维:任务条件推理用于统一的图像质量与审美评估
Wen Yin, Cencen Liu, Dingrui Liu, Bing Su, Yuan-Fang Li, Tao He
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Faculty of Information Technology, Monash University(莫纳什大学信息科技学院)
;
The Laboratory of Intelligent Collaborative Computing of UESTC(UESTC智能协同计算实验室)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)
Evaluating Evidence Grounding Under User Pressure in Instruction-Tuned Language Models
评估在用户压力下指令调优语言模型的证据基础
Sai Koneru, Elphin Joe, Christine Kirchhoff, Jian Wu, Sarah Rajtmajer
机构
*
College of Information Sciences and Technology, Pennsylvania State University(宾夕法尼亚州立大学信息科学与技术学院)
;
Department of Computer Science, Old Dominion University(老 Dominion 大学计算机科学系)
LoopRPT: Reinforcement Pre-Training for Looped Language Models
LoopRPT: 用于循环语言模型的强化预训练
Guo Tang, Shixin Jiang, Heng Chang, Nuo Chen, Yuhan Li, Huiming Fan, Jia Li, Ming Liu, Bing Qin
机构
*
Harbin Institute of Technology, Harbin, China(哈尔滨工业大学)
;
Tsinghua University, Beijing, China(清华大学)
;
The Hong Kong University of Science and Technology, Guangzhou, China(香港科学与技术大学)
机构
*
Dartmouth College, USA(达特茅斯学院)
;
University of Cambridge, UK(剑桥大学)
;
The University of Melbourne, Australia(墨尔本大学)
;
Google Research, UK(谷歌研究)
;
Tsinghua University, China(清华大学)
Learning Dynamic Belief Graphs for Theory-of-mind Reasoning
学习动态信念图以进行心灵理论推理
Ruxiao Chen, Xilei Zhao, Thomas J. Cova, Frank A. Drews, Susu Xu
机构
*
Department of Civil
;
Systems Engineering, Johns Hopkins University, Baltimore, MD, USA
;
School of the Environment, Society \& Sustainability, University of Utah, Salt Lake City, UT, USA
;
Department of Psychology, University of Utah, Salt Lake City, UT, USA
;
Coastal Engineering, University of Florida, Gainesville, FL, USA
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI