In-context superposition: human-like working memory interference in large language models
类人工作记忆干扰在大语言模型中
Hua-Dong Xiong, Li Ji-An, Jiaqi Huang, Robert C. Wilson, Kwonjoon Lee, Xue-Xin Wei
机构
*
School of Psychological and Brain Sciences, Georgia Tech(佐治亚理工学院心理与脑科学学院)
;
Department of Psychology, New York University(纽约大学心理学系)
;
Department of Cognitive Science, Indiana University Bloomington(印第安纳大学布卢明顿分校认知科学系)
;
Honda Research Institute(本田研究所)
;
Center of Excellence for Computational Cognition, Georgia Tech(佐治亚理工学院计算认知卓越中心)
;
Departments of Neuroscience and Psychology, The University of Texas at Austin(德克萨斯大学奥斯汀分校神经科学和心理学系)
OpenRC: An Open-Source Robotic Colonoscopy Framework for Multimodal Data Acquisition and Autonomy Research
OpenRC:一种用于多模态数据采集和自主性研究的开源机器人结肠镜框架
Siddhartha Kapuria, Mohammad Rafiee Javazm, Naruhiko Ikoma, Joga Ivatury, Mohammad Ali Nasseri, Nassir Navab, Farshid Alambeigi
机构
*
Walker Department of Mechanical Engineering, The University of Texas at Austin(德克萨斯大学奥斯汀分校沃克机械工程系)
;
Department of Surgical Oncology, Division of Surgery, The University of Texas MD Anderson Cancer Center(德克萨斯大学MD安德森癌症中心外科肿瘤学系)
;
School of Medicine and Health, Technical University of Munich(慕尼黑工业大学医学与健康学院)
Towards Understanding On-Policy Distillation through the Lens of Test-Time Scaling
从测试时缩放的视角理解在线策略蒸馏
Xinmu Ge, Zizhuo Zhang, Yu Huang, Jianing Zhu, Lin Yuan, Wanli Gu, Weichang Wu, Weiran Huang, Xiaolu Zhang, Bo Han, Jun Zhou, Jiangchao Yao
机构
*
Hong Kong Baptist University(香港浸会大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Ant Group(蚂蚁集团)
Large language models reorganize representational geometry during in-context learning
大型语言模型在上下文学习中重组表征几何结构
Hua-Dong Xiong, Li Ji-An, Robert C. Wilson, Kwonjoon Lee, Xue-Xin Wei
机构
*
School of Psychological and Brain Sciences, Georgia Tech(佐治亚理工学院心理与脑科学学院)
;
Department of Psychology, New York University(纽约大学心理学系)
;
Center of Excellence for Computational Cognition, Georgia Tech(佐治亚理工学院计算认知卓越中心)
;
Honda Research Institute(本田研究院)
;
Departments of Neuroscience and Psychology, The University of Texas at Austin(德克萨斯大学奥斯汀分校神经科学与心理学系)
Deployment Is Not Destiny: Robot Recomposition in the Field with Unseen Software, Hardware, and Compute Payloads
部署并非宿命:面向现场未知软件、硬件与计算负载的机器人重组
Steven Swanbeck, Jonathan Salfity, Jeffery Gunawan, Corrie Van Sice, Mitch Pryor, Robert Blake Anderson
机构
*
Texas Robotics(德克萨斯机器人研究所)
;
Walker Department of Mechanical Engineering, The University of Texas at Austin(德克萨斯大学奥斯汀分校沃克机械工程学院)
;
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
EndoMD-SLAM: Endoscopic Gaussian Splatting SLAM under Optical Degradation with Memory and Static-Transient Decomposition
EndoMD-SLAM:光学退化下的内窥镜高斯溅射SLAM,具备记忆与静态-瞬态分解能力
Nuo Chen, Kangqi Ni, Lulin Liu, Joga Ivatury, Ying Ding, Farshid Alambeigi, Tianlong Chen, Zhiwen Fan
机构
*
Texas A&M University(德克萨斯农工大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
University of Minnesota(明尼苏达大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
From Words to Widgets for Controllable LLM Generation
从词语到小部件:可控制的LLM生成
Chao Zhang, Yiren Liu, Lunyiu Nie, Jeffrey M. Rzeszotarski, Yun Huang, Tal August
机构
*
Cornell University(康奈尔大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Loyola University Maryland(路易斯安那大学马里兰分校)
Separating Decision-Rule Misalignment from Readout-Coverage Limitations in Speech Language Models
区分语音语言模型中的决策规则失配与读出覆盖限制
Linkai Peng, Baorian Nuchged
机构
*
Institute for the Brain and Cognitive Sciences, University of Connecticut(康涅狄格大学脑与认知科学研究所)
;
Department of Linguistics, The University of Texas at Austin(德克萨斯大学奥斯汀分校语言学系)
When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation
当AI基准测试达到平台期:基准饱和的系统性研究
Mubashara Akhtar, Anka Reuel, Prajna Soni, Sanchit Ahuja, Pawan Sasanka Ammanamanchi, Ruchit Rawal, Vilém Zouhar, Srishti Yadav, Chenxi Whitehouse, Dayeon Ki, Jennifer Mickel, Leshem Choshen, Marek Šuppa, Jan Batzner, Jenny Chim, Jeba Sania, Yanan Long, Hossein A. Rahmani, Christina Knight, Yiyang Nan, Jyoutir Raj, Yu Fan, Shubham Singh, Subramanyam Sahoo, Eliya Habba, Usman Gohar, Siddhesh Pawar, Robert Scholz, Arjun Subramonian, Jingwei Ni, Mykel Kochenderfer, Sanmi Koyejo, Mrinmaya Sachan, Stella Biderman, Zeerak Talat, Avijit Ghosh, Irene Solaiman
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
University of Toronto(多伦多大学)
;
University of Washington(华盛顿大学)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Michigan(密歇根大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
DelusionEval: Measuring Delusion-Linked Behaviors in AI Chatbots
DelusionEval:评估AI聊天机器人中与妄想相关的行为
Jared Moore, Andrea Mock, Yifan Mai, Jacy Reese Anthis, Ryan Louie, William Agnew, Ashish Mehta, Kevin Klyman, Percy Liang, Nick Haber, Eric Lin, Desmond C. Ong
机构
*
Stanford University(斯坦福大学)
;
University of Chicago(芝加哥大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Harvard University(哈佛大学)
;
The University of Texas at Austin(德克萨斯大学奥斯汀分校)