CommentsPreprint. 3 figures, 3 tables. Diagnostic study of context compliance in RAG under knowledge conflict; closed-API evaluations (Gemini-2.5-Flash and Claude family)
Maijunxian Wang, Yijiang Li, Bingyang Wang, Tianwei Zhao, Ran Ji, Qingying Gao, Emmy Liu, Hokin Deng, Dezhi Luo
机构
*
Cognitive Science Program, University of California, Berkeley(加州大学伯克利分校认知科学项目)
;
Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系)
;
School of Computer Science, Georgia Institute of Technology & Emory University(佐治亚理工学院计算机科学学院及埃默里大学)
;
Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系)
;
Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系)
;
Equal Advising Department of Computer Science & Wilmer Eye Institute, Johns Hopkins University(约翰霍普金斯大学计算机科学系及威尔默眼科研究所)
;
Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)
;
Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
;
Weinberg Institute for Cognitive Science, University of Michigan(密歇根大学韦恩伯格认知科学研究所)
机构
*
Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系)
;
School of Electrical and Computer Engineering, Cornell University(康奈尔大学电气与计算机工程学院)
;
UC San Diego Health(加州大学圣地亚哥医学中心)
Cluster and then Embed: A Modular Approach for Visualization
先聚类再嵌入:一种可视化的模块化方法
Elizabeth Coda, Ery Arias-Castro, Gal Mishne
机构
*
Department of Mathematics, University of California, San Diego(数学系,加州大学圣地亚哥分校)
;
Halıcıoğlu Data Science Institute, University of California, San Diego(Halıcıoğlu数据科学研究所,加州大学圣地亚哥分校)
EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World
EgoVerse:一个用于机器人学习的视点人类数据集
Ryan Punamiya, Simar Kareer, Zeyi Liu, Josh Citron, Ri-Zhao Qiu, Xiongyi Cai, Alexey Gavryushin, Jiaqi Chen, Davide Liconti, Lawrence Y. Zhu, Patcharapong Aphiwetsa, Baoyu Li, Aniketh Cheluva, Pranav Kuppili, Yangcen Liu, Dhruv Patel, Aidan Gao, Hye-Young Chung, Ryan Co, Renee Zbizika, Jeff Liu, Xiaomeng Xu, Haoyu Xiong, Geng Chen, Sebastiano Oliani, Wenkai Xuan, Chenyu Yang, Xi Wang, James Fort, Richard Newcombe, Josh Gao, Jason Chong, Garrett Matsuda, Aseem Doriwala, Marc Pollefeys, Robert Katzschmann, Xiaolong Wang, Shuran Song, Judy Hoffman, Danfei Xu
机构
*
Georgia Institute of Technology(佐治亚理工学院)
;
Stanford University(斯坦福大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
ETH Zürich(苏黎世联邦理工学院)
;
MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)
;
Meta Reality Labs Research(Meta现实实验室)
;
Mecka AI
;
Scale AI
Similarity of Neural Network Representations in Superposition
神经网络表示在叠加中的相似性
Sunny Liu, Habon Issa, André Longon, Liv Gorton, Meenakshi Khosla, Alex Williams, David Klindt
机构
*
Cold Spring Harbor Laboratory(冷泉港实验室)
;
UC San Diego(加州大学圣地亚哥分校)
;
Anthropic(Anthropic公司)
;
New York University Flatiron Institute(纽约大学Flatiron研究所)
Are LLM Evaluators Really Narcissists? Sanity Checking Self-Preference Evaluations
LLM评估者真的是自恋者吗?对自我偏好评估的健全性检查
Dani Roytburg, Matthew Bozoukov, Matthew Nguyen, Jou Barzdukas, Mackenzie Puig-Hall, Narmeen Oozeer
机构
*
Department of Machine Learning, Carnegie Mellon University, Pittsburgh, PA, USA(卡内基梅隆大学机器学习系)
;
Department of Computer Science and Engineering, University of California San Diego, La Jolla, CA, USA(加州大学圣地亚哥分校计算机科学与工程系)
;
Department of Computer Science, University of Virginia, Charlottesville, VA, USA(弗吉尼亚大学计算机科学系)
;
Martian Research, San Francisco, California, USA(火星研究公司)
;
Apart Research, San Francisco, California, USA(Apart研究公司)
A Robust Model-Based Approach for Continuous-Time Policy Evaluation with Unknown Lévy Process Dynamics
基于模型的鲁棒方法用于具有未知Lévy过程动力学的连续时间策略评估
Qihao Ye, Xiaochuan Tian, Yuhua Zhu
机构
*
Department of Mathematics, University of California, San Diego, CA 92093, United States(加州大学圣地亚哥分校数学系)
;
Department of Statistics and Data Science, University of California, Los Angeles, CA 90095, United States(加州大学洛杉矶分校统计学与数据科学系)
Ayush Noori, Aaron E. Boussina, Hai Ho Bich, James Anibal, Julia Maslinski, Manuel Burger, Martin Faltys, Adam Rodman, Alan Karthikesalingam, Alessandro Blasimme, Annelia Itwaru, Ben Kaplan, Bilal A. Mateen, Christopher A. Longhurst, Daniel Yang, Dave deBronkart, Effy Vayena, Fedor Sergeev, Gauden Galea, Ha Thi Hai Duong, Harold F. Wolf, Jacob Waxman, Joerg C. Schefold, Joshua C. Mandel, Juliana Rotich, Kenneth D. Mandl, Lily Poursoltan, Maryam Mustafa, Melissa Miles, Nigam H. Shah, Noa Dagan, Pavan Bodanki, Peter Lee, Philipp Koralus, Prathamesh Parchure, Prem Timsina, Ran D. Balicer, Robert Korom, Scott Mahoney, Seth Hain, Tien Yin Wong, Trevor Mundel, Vivek Natarajan, Ankit Sakhuja, Benjamin Glicksberg, C. Louise Thwaites, Gunnar Rätsch, Karandeep Singh, David A. Clifton, Isaac S. Kohane, Marinka Zitnik
机构
*
Harvard Medical School(哈佛医学院)
;
University of Oxford(牛津大学)
;
Institute for Ethics in AI(人工智能伦理研究所)
;
Cosmos Institute(宇宙研究所)
;
Harvard Medical School and Clalit Research Institute(哈佛医学院和Clalit研究机构)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Joan and Irwin Jacobs Center for Health Innovation(乔安和伊万·雅各布健康创新中心)
;
Oxford University Clinical Research Unit(牛津大学临床研究中心)
;
Icahn School of Medicine at Mount Sinai(辛格纳医学中心)
;
The Hasso Plattner Institute for Digital Health at Mount Sinai(辛格纳医学中心数字健康研究所)
;
ETH Zurich(苏黎世联邦理工学院)
;
University Hospital, University of Bern(伯恩大学医院)
;
Beth Israel Deaconess Medical Center(贝斯以色列医疗中心)
;
Google DeepMind(谷歌DeepMind)
;
The Mount Sinai AI Assurance Lab(辛格纳医学中心人工智能保证实验室)
;
University of Birmingham(伯明翰大学)
;
PATH(PATH组织)
;
Seattle Children’s Hospital(西雅图儿童医院)
;
Department of Pediatrics, University of California, San Diego(加州大学圣地亚哥分校儿科部)
;
Kaiser Foundation Health and Hospitals(凯撒基金会健康与医院)
;
e-Patient Dave, LLC(e-Patient Dave公司)
;
Regional Office for Europe, World Health Organization(世界卫生组织欧洲地区办公室)
;
University of Malta(马耳他大学)
;
Centre for Tropical Medicine and Global Health, University of Oxford(牛津大学热带医学与全球健康中心)
;
Healthcare Information and Management Systems Society(医疗信息与管理系统协会)
;
Clalit Research Institute, Innovation Division, Clalit Health Services(Clalit研究机构创新部门,Clalit健康服务)
;
Microsoft Research(微软研究院)
;
Gates Foundation(比尔及梅琳达·盖茨基金会)
;
Computational Health Informatics Program, Boston Children’s Hospital(波士顿儿童医院计算健康信息学项目)
Policy Gradient with Self-Attention for Model-Free Distributed Nonlinear Multi-Agent Games
基于自注意力的策略梯度用于无模型分布式非线性多智能体博弈
Eduardo Sebastián, Maitrayee Keskar, Eeman Iqbal, Eduardo Montijano, Carlos Sagüés, Nikolay Atanasov
机构
*
Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学)
;
Department of Electrical and Computer Engineering, University of California San Diego(电气与计算机工程系,加州大学圣地亚哥分校)
;
RoPeRt group, at DIIS - I3A, Universidad de Zaragoza(RoPeRt组,DIIS - I3A,阿拉贡大学)
Breaking the Mirror: Activation-Based Mitigation of Self-Preference in LLM Evaluators
打破镜像:基于激活的LLM评估者自我偏好缓解方法
Dani Roytburg, Matthew Bozoukov, Matthew Nguyen, Jou Barzdukas, Simon Fu, Narmeen Oozeer
机构
*
University of Virginia(弗吉尼亚大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
School of Computer Science(计算机科学学院)
Sink-Token-Aware Pruning for Fine-Grained Video Understanding in Efficient Video LLMs
面向高效视频大语言模型的sink-token感知剪枝:用于细粒度视频理解
Kibum Kim, Jiwan Kim, Kyle Min, Yueqi Wang, Jinyoung Moon, Julian McAuley, Chanyoung Park
机构
*
Korea Advanced Institute of Science and Technology (KAIST)(韩国高级科学技术研究院)
;
Oracle
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Electronics and Telecommunications Research Institute (ETRI)(电子电信研究院)
StructSAM: Structure- and Spectrum-Preserving Token Merging for Segment Anything Models
StructSAM: 面向分割一切模型的结构与谱保持令牌合并
Duy M. H. Nguyen, Tuan A. Tran, Duong Nguyen, Siwei Xie, Trung Q. Nguyen, Mai T. N. Truong, Daniel Palenicek, An T. Le, Michael Barz, TrungTin Nguyen, Tuan Dam, Ngan Le, Minh Vu, Khoa Doan, Vien Ngo, Pengtao Xie, James Zou, Daniel Sonntag, Jan Peters, Mathias Niepert
机构
*
University of Stuttgart(斯图加特大学)
;
DFKI
;
Max Planck Research School(马克斯·普朗克研究学校)
;
University of Oldenburg(奥尔登堡大学)
;
Technical University of Darmstadt(达姆施塔特技术大学)
;
VinRobotics
;
VinUniversity(Vin大学)
;
Aalto University(阿莱大学)
;
Queensland University of Technology(昆士兰技术大学)
;
HUST(华中科技大学)
;
Technical University of Denmark(丹麦技术大学)
;
University of Arkansas(阿肯色大学)
;
UC San Diego(圣地亚哥大学)
;
Stanford University(斯坦福大学)