NeuReasoner: Towards Explainable, Controllable, and Unified Reasoning via Mixture-of-Neurons
NeuReasoner:通过混合神经元实现可解释、可控和统一的推理
Haonan Dong, Kehan Jiang, Haoran Ye, Wenhao Zhu, Zhaolu Kang, Guojie Song
机构
*
State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院通用人工智能国家重点实验室)
;
School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)
机构
*
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
;
Nanyang Technological University(南洋理工大学)
;
School of Cyber Science and Engineering, Southeast University(东南大学网络空间安全学院)
;
Purple Mountain Laboratories(紫金山实验室)
LumiVideo: An Intelligent Agentic System for Video Color Grading
LumiVideo:一种用于视频色彩分级的智能代理系统
Yuchen Guo, Junli Gong, Hongmin Cai, Yiu-ming Cheung, Weifeng Su
机构
*
Northwestern University(西北大学)
;
Northeastern University(东北大学)
;
South China University of Technology(华南理工大学)
;
Hong Kong Baptist University(香港浸会大学)
;
Beijing Normal - Hong Kong Baptist University(北京师范大学-香港浸会大学)
机构
*
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
College of Information Science and Technology, Eastern Institute of Technology(东方理工学院信息科学与技术学院)
Beyond the Parameters: A Technical Survey of Contextual Enrichment in Large Language Models: From In-Context Prompting to Causal Retrieval-Augmented Generation
超越参数:大型语言模型中上下文丰富技术的综述:从上下文提示到因果检索增强生成
Prakhar Bansal, Shivangi Agarwal
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.CL、cs.AI
V2X-QA: A Comprehensive Reasoning Dataset and Benchmark for Multimodal Large Language Models in Autonomous Driving Across Ego, Infrastructure, and Cooperative Views
V2X-QA:面向自动驾驶多视角的多模态大语言模型综合数据集与基准测试
Junwei You, Pei Li, Zhuoyu Jiang, Weizhe Tang, Zilin Huang, Rui Gan, Jiaxi Liu, Yan Zhao, Sikai Chen, Bin Ran
机构
*
Department of Civil and Environmental Engineering, University of Wisconsin–Madison(威斯康星大学麦迪逊分校土木与环境工程系)
;
Department of Civil and Architectural Engineering and Construction Management, University of Wyoming(怀俄明大学土木与建筑工程及施工管理系)
;
School of Transportation, Southeast University(东南大学交通学院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
Using LLM-as-a-Judge/Jury to Advance Scalable, Clinically-Validated Safety Evaluations of Model Responses to Users Demonstrating Psychosis
利用LLM作为法官/陪审团推进模型响应用户表现精神病的可扩展、临床验证的安全性评估
May Lynn Reese, Markela Zeneli, Mindy Ng, Jacob Haimes, Andreea Damien, Elizabeth Stade
机构
*
Apart Research
;
Odyssean Institute
;
London School of Economics and Political Science(伦敦政治经济学院)
;
Stanford Institute for Human-Centered AI(斯坦福大学以人为本人工智能研究所)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Let's Have a Conversation: Designing and Evaluating LLM Agents for Interactive Optimization
让我们交谈:设计和评估用于交互优化的LLM代理
Joshua Drossman, Alexandre Jacquillat, Sébastien Martin
机构
*
Operations Research Center and Sloan School of Management, Massachusetts Institute of Technology(麻省理工学院运筹学研究中心和斯隆管理学院)
;
Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI