RoboStream: Weaving Spatio-Temporal Reasoning with Memory in Vision-Language Models for Robotics
RoboStream: 用记忆融合时空推理提升视觉语言模型在机器人中的应用
Yuzhi Huang, Jie Wu, Weijue Bu, Ziyi Xiong, Gaoyang Jiang, Ye Li, Kangye Ji, Shuzhao Xie, Yue Huang, Chenglei Wu, Jingyan Jiang, Zhi Wang
机构
*
Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)
;
YXGN Robotics(YXGN机器人)
;
China University of Mining and Technology(中国矿业大学)
;
Shenzhen Technology University(深圳技术大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
Xiamen University(厦门大学)
GReFEM: Multimodal LLMs as Zero-Shot Semantic Assistants for Physics-Guided 3D Mesh Refinement
GReFEM:多模态大语言模型作为用于物理引导的3D网格细化的零样本语义助手
Kartik Bali, Mahish K. Guru, Christian J Cyron, Roland Aydin
机构
*
Institute of Material Systems Modeling(材料系统建模研究所)
;
Helmholtz Zentrum Hereon(海德堡研究中心Hereon)
;
Institute of Material and Process Design(材料与加工设计研究所)
;
German Research Center for Artificial Intelligence(德国人工智能研究中心)
Latent Reward Steering: An Adaptive Inference-Time Framework that Implicitly Promotes Cognitive Behaviors in Reasoning LLMs
潜在奖励引导:一种自适应推理时框架,隐式促进推理大语言模型中的认知行为
Jiakang Li, Guanyu Zhu, Can Jin, Chenxi Huang, Dexu Yu, Ronghao Chen, Yang Zhou, Hongwu Peng, Xuanqi Lan, Dimitris N. Metaxas, Youhua Li
机构
*
Rutgers University(罗格斯大学)
;
South China Agricultural University(华南农业大学)
;
Columbia University(哥伦比亚大学)
;
Fenz.AI
;
QuantaAlpha
;
Adobe
;
Santa Clara University(圣克拉拉大学)
;
City University of Hong Kong(香港城市大学)
Evaluating Retrieval-Augmented Generation vs. Long-Context Input for Clinical Reasoning over EHRs
评估检索增强生成与长上下文输入用于电子健康记录临床推理的效果
Skatje Myers, Dmitriy Dligach, Timothy A. Miller, Samantha Barr, James Landefeld, Yanjun Gao, Matthew Churpek, Anoop Mayampurath, Majid Afshar
机构
*
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
Loyola University Chicago(芝加哥洛约拉大学)
;
Boston Children’s Hospital Harvard Medical School(波士顿儿童医院哈佛医学院)
;
University of Colorado-Anschutz(科罗拉多大学安舒茨分校)
How to DP-fy Your Data: A Practical Guide to Generating Synthetic Data With Differential Privacy
如何让你的数据实现差分隐私:使用差分隐私生成合成数据的实用指南
Natalia Ponomareva, Zheng Xu, H. Brendan McMahan, Peter Kairouz, Lucas Rosenblatt, Vincent Cohen-Addad, Cristóbal Guzmán, Ryan McKenna, Galen Andrew, Alex Bie, Da Yu, Alex Kurakin, Morteza Zadimoghaddam, Sergei Vassilvitskii, Andreas Terzis
机构
*
Google Research USA(谷歌DeepMind)
;
NYU Work done at Google as part of student researcher engagement New York NY USA
;
Google Research New York NY USA
;
Institute for Mathematical
;
Computational Engineering, Faculty of Mathematics
;
School of Engineering, Pontificia Universidad Cat\'olica de Chile Santiago Chile
;
Google DeepMind Mountain View CA USA
;
Google Research
;
School of Engineering, Pontificia Universidad Cat\'olica de Chile
;
Google DeepMind
Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models
十年视觉语言人工智能模型中准确性和视觉认知错误的演变
Shravan Murlidaran, Miguel P. Eckstein
机构
*
Psychological & Brain Sciences, University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校心理与脑科学系)
;
Department of Computer Science, University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校计算机科学系)
;
Department of Electrical and Computer Engineering, University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校电气与计算机工程系)