arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-03-05 至 2026-03-05 共收录 4
2603.03985 2026-03-05 cs.CV

RIVER: A Real-Time Interaction Benchmark for Video LLMs

RIVER:面向视频大语言模型的实时交互基准

Yansong Shi, Qingsong Zhao, Tianxiang Jiang, Xiangyu Zeng, Yi Wang, Limin Wang

机构 * School of Information Science And Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学) State Key Lab of Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

AI总结 RIVER基准通过引入实时交互任务框架,改进视频大语言模型的实时交互能力,提升长期记忆与未来感知表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03960 2026-03-05 cs.RO cs.CV

Structural Action Transformer for 3D Dexterous Manipulation

结构动作变换器用于3D灵巧操作

Xiaohan Lei, Min Wang, Bohong Weng, Wengang Zhou, Houqiang Li

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

AI总结 本文提出结构动作变换器,通过结构化视角解决高自由度机械手的跨身体技能转移问题,实现更高效的灵巧操作。

Comments Accepted by CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03820 2026-03-05 cs.LG cs.AI

Fairness Begins with State: Purifying Latent Preferences for Hierarchical Reinforcement Learning in Interactive Recommendation

公平始于状态:在交互推荐中通过净化潜在偏好进行分层强化学习

Yun Lu, Xiaoyu Shi, Hong Xie, Xiangyu Zhao, Mingsheng Shang

机构 * Chongqing Institute of Green and Intelligent Technology, Chinese Academy of Sciences(中国科学院重庆绿色智能技术研究所) Chongqing School, University of Chinese Academy of Sciences(中国科学院大学重庆学院) The First Affiliated Hospital, University of Science and Technology of China(中国科学技术大学第一附属医院) City University of Hong Kong(香港城市大学)

AI总结 本文提出DSRM-HRL框架,通过净化潜在偏好解决交互推荐中的公平与准确冲突,实现推荐效用与曝光公平的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03798 2026-03-05 cs.RO

Learning Surgical Robotic Manipulation with 3D Spatial Priors

利用3D空间先验学习手术机器人操作

Yu Sheng, Lidian Wang, Xiaomeng Chu, Jiajun Deng, Min Cheng, Yanyong Zhang, Bei Hua, Houqiang Li, Jianmin Ji

机构 * University of Science and Technology of China(中国科学技术大学) Tuodao Medical(图道医疗) Yale University(耶鲁大学)

AI总结 本文提出SST,一种端到端的视觉-运动策略,通过内窥镜图像中的3D空间线索提升手术机器人操作的3D空间意识,实现了复杂手术任务的高性能表现。

Comments CVPR26

详情

展开后加载摘要…

URL PDF HTML 收藏