arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-09 至 2026-04-09 共收录 58 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2510.15510 2026-04-09 cs.CV cs.RO 81%

Exploring Conditions for Diffusion models in Robotic Control

探索扩散模型在机器人控制中的条件

Heeseong Shin, Byeongho Heo, Dongyoon Han, Seungryong Kim, Taekyung Kim

机构 * KAIST AI(韩国科学技术院人工智能学院) NAVER AI Lab(NAVER人工智能实验室)

专题命中 机器人学习 :robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 本文研究利用预训练文本到图像扩散模型获取任务适应的视觉表示,提出ORCA方法以动态视觉信息提升机器人控制性能。

Comments Accepted to CVPR 2026. Project page: https://orca-rc.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07331 2026-04-09 cs.RO cs.AI cs.CV 67%

RoSHI: A Versatile Robot-oriented Suit for Human Data In-the-Wild

RoSHI:一种面向机器人的多功能服装

Wenjing Margaret Mao, Jefferson Ng, Luyang Hu, Daniel Gehrig, Antonio Loquercio

机构 * Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 RoSHI结合低成本稀疏IMU与Project Aria眼镜,实现从第一人称感知中估计完整3D姿态和身体形状,用于真实世界机器人学习。

Comments 8 pages, 4 figures. *Equal contribution by first three authors. Project webpage: https://roshi-mocap.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 15 篇

2604.06778 2026-04-09 cs.RO 79%

RichMap: A Reachability Map Balancing Precision, Efficiency, and Flexibility for Rich Robot Manipulation Tasks

RichMap: 一种平衡精度、效率和灵活性的可达性地图用于丰富的机器人操作任务

Yupu Lu, Yuxiang Ma, Jia Pan

机构 * School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出RichMap,一种高精度可达性地图表示,通过优化传统网格结构,在保持结构灵活性的同时实现接近紧凑地图形式的性能,通过理论容量界和异步流水线实现高效构建,并在多个指标上验证其高预测精度和低误报率。

Comments Accepted by WAFR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02643 2026-04-09 cs.RO 79%

Differentiable SpaTiaL: Symbolic Learning and Reasoning with Geometric Temporal Logic for Manipulation Tasks

可微分空间时间逻辑:用于操作任务的符号学习与推理

Licheng Luo, Kaier Liang, Cristian-Ioan Vasile, Mingyu Cai

机构 * UC Riverside(加州大学河滨分校) Lehigh University(里海大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出可微分空间时间逻辑框架,通过构建光滑的几何基础元来解决复杂操作任务中的几何与时间约束问题,实现端到端的可微分映射,无需外部离散求解器。

Comments Code available at: https://github.com/plen1lune/DiffSpaTiaL

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07335 2026-04-09 cs.RO 79%

TAMEn: Tactile-Aware Manipulation Engine for Closed-Loop Data Collection in Contact-Rich Tasks

TAMEn:用于接触密集任务闭环数据收集的触觉感知操作引擎

Longyan Wu, Jieji Ren, Chenghang Jiang, Junxi Zhou, Shijia Peng, Ran Huang, Guoying Gu, Li Chen, Hongyang Li

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) OpenDriveLab at The University of Hong Kong(香港大学OpenDriveLab) Shanghai Jiao Tong University(上海交通大学) East China University of Science and Technology(华东理工大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出TAMEn,通过双模采集管道和触觉-视觉学习框架,提升机器人双臂操作任务的闭环策略优化效果,实验表明任务成功率从34%提升至75%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21540 2026-04-09 cs.CR cs.CV 74%

PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking

PRISM:基于图像序列操作的程序化推理用于LVLM劫持

Quanchen Zou, Zonghao Ying, Moyang Chen, Wenzhuo Xu, Yisong Xiao, Yakai Li, Deyue Zhang, Dongdong Yang, Zhao Liu, Xiangzheng Zhang

专题命中 机器人操作 :manipulation(title);分类 cs.CV

AI总结 本文提出PRISM框架,通过分解有害指令为多个无害视觉组件,利用模型推理过程生成有害输出,有效提升LVLM劫持成功率。

Comments This version is withdrawn to consolidate the submission under the corresponding author's primary account. The most recent and maintained version of this work can be found at arXiv:2603.09246

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22177 2026-04-09 cs.HC cs.AI 74%

Analyzing Multimodal Interaction Strategies for LLM-Assisted Manipulation of 3D Scenes

分析用于LLM辅助3D场景操作的多模态交互策略

Junlong Chen, Jens Grubert, Per Ola Kristensson

机构 * University of Cambridge(剑桥大学) Coburg University of Applied Sciences(科堡应用科学大学)

专题命中 机器人操作 :manipulation(title);分类 cs.AI

AI总结 本文通过实证研究揭示LLM辅助3D场景编辑系统中的交互模式与关键障碍,提出改进自然语言界面的设计建议,证明LLM辅助交互系统在沉浸环境中的有效性。

Comments Published in the IEEE VR (IEEE Conference on Virtual Reality and 3D User Interfaces) 2025 Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06091 2026-04-09 cs.SI 71%

Characterizing AI Manipulation Risks in Brazilian YouTube Climate Discourse

刻画巴西YouTube气候变化 discourse 中的AI操纵风险

Wenchao Dong, Marcelo S. Locatelli, Virgilio Almeida, Meeyoung Cha

专题命中 机器人操作 :manipulation(title)

AI总结 本研究通过三个案例分析,探讨了心理内容特征如何驱动观众参与,影响内容流行度,并为生成式语言模型设计说服性合成活动提供见解,同时发布了一个包含226万条评论的大型公开数据集。

Comments Published at the Special Track on AI for Social Impact at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06754 2026-04-09 cs.LG cs.CY 70%

The Rhetoric of Machine Learning

机器学习的修辞学

Robert C. Williamson

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);分类 cs.LG

AI总结 本文从修辞学角度探讨机器学习技术,指出其本质具有说服性,而非中立的客观建模方法,分析其修辞特征及'操纵即服务'的商业模式。

Comments 25 pages. Text of a talk given at AlphaPersuade 2.0, 26 March 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07086 2026-04-09 eess.SP 67%

Radio-Frequency Inverse Rendering for Wireless Environment Modeling

无线环境建模的射频逆渲染

Fuhai Wang, Zihan Jin, Lehang Wang, Xuehui Dong, Tiebin Mi, Robert Caiming Qiu, Zenan ling

专题命中 机器人操作 :manipulation(abstract);world model(abstract)

AI总结 本文提出一种物理基础的射频逆渲染框架,通过分离射频发射、几何和材料电磁特性,提升无线环境建模的精度与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06589 2026-04-09 cs.RO 57%

BiDexGrasp: Coordinated Bimanual Dexterous Grasps across Object Geometries and Sizes

BiDexGrasp: 跨物体几何与尺寸的协调双臂灵巧抓取

Mu Lin, Yi-Lin Wei, Jiaxuan Chen, Yuhao Lin, Shuoyu Chen, Jiangran Lyu, Jiayi Chen, Yansong Tang, He Wang, Wei-Shi Zheng

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) School of Computer Science, Peking University(北京大学计算机学院) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO

AI总结 本文提出BiDexGrasp,包含大规模双臂灵巧抓取数据集和新型生成模型,通过高效区域基抓取初始化与解耦力闭合优化策略,生成协调且高质量的抓取。

Comments Project Page: https://frenkielm.github.io/BiDexGrasp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06341 2026-04-09 cs.RO 57%

Occlusion Handling by Pushing for Enhanced Fruit Detection

通过推动提升水果检测的遮挡处理

Ege Gursoy, Dana Kulić, Andrea Cherubini

机构 * LIRMM, Univ. Montpellier, CNRS(蒙彼利埃大学-法国国家科学研究中心-蒙彼利埃机器人研究所) Monash University(莫纳什大学)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO

AI总结 本文提出通过推动清除遮挡物提升水果检测效果,结合深度学习、经典图像处理和3D霍夫变换实现遮挡处理。

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06186 2026-04-09 cs.HC cs.AI 57%

Full State-Space Visualisation of the 8-Puzzle: Feasibility, Design, and Educational Use

8数码谜题的全状态空间可视化:可行性、设计与教育应用

Ian Frank, Kanata Kawanishi

机构 * Future University Hakodate(公立函馆未来大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出一个交互式学习系统,展示8数码谜题全可达状态空间的可视化,结合抽象图结构与具体拼图操作,验证其教育价值。

Comments This is a preprint of a paper accepted to IEEE ITET 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07071 2026-04-09 cs.HC cs.CR 50%

BioMoTouch: Touch-Based Behavioral Authentication via Biometric-Motion Interaction Modeling

BioMoTouch:基于生物-运动交互建模的触控行为认证

Zijian Ling, Jianbang Chen, Hongwei Li, Hongda Zhai, Man Zhou, Jun Feng, Zhengxiong Li, Qi Li, Qian Wang

专题命中 机器人操作 :manipulation(abstract)

AI总结 BioMoTouch通过整合电容触控屏与惯性传感器信号,建立生物特征与行为动态的联合模型,实现高鲁棒性的触控认证,实验显示其在99.71%的平衡准确率和0.27%的误判率下表现优异。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06528 2026-04-09 quant-ph 50%

High-Dimensional Quantum Photonics: Roadmap

高维量子光子学:路线图

Mehul Malik, Micheal Kues, Takuya Ikuta, Hiroki Takesue, Daniele Bajoni, David J. Moss, Roberto Morandotti, Andrew Forbes, Stephen Walborn, Ebrahim Karimi, Yunhong Ding, Stefano Paesani, Caterina Vigliar, Benjamin Brecht, Christine Silberhorn, Frédéric Bouchard, Michał Karpiński, Benjamin Sussman, Joseph M. Lukens, Yaron Bromberg, Robert Fickler, Taira Giordani, Fabio Sciarrino, Yun Zheng, Jianwei Wang, Marcus Huber, Armin Tavakoli, Roope Uola, Nicolas Brunner, Nicolai Friis, Natalia Herrera Valencia, Jacquiline Romero, Will McCutcheon

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文综述高维量子光子学各领域进展,识别跨多光子自由度的挑战与机遇,探讨理论与实验的整合方向以推动量子技术发展。

Comments 89+28 pages, 36 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13294 2026-04-09 quant-ph cond-mat.mes-hall cond-mat.str-el 50%

Realization of fermionic Laughlin state on a quantum processor

在量子处理器上实现费米子Laufflin态

Lingnan Shen, Mao Lin, Cedric Yen-Yu Lin, Di Xiao, Ting Cao

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究在量子处理器上实现了ν=1/3的费米子Laufflin态,通过高效可扩展的变分哈密顿量ansatz,结合对称性验证误差缓解技术,验证了相关孔和Chiral边模等关键可观测量,为模拟材料内禀拓扑序提供了新框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07205 2026-04-09 physics.atom-ph cond-mat.quant-gas quant-ph 50%

Defect-free arrays at the thousand-atom scale in a 4-K cryogenic environment

在4K低温环境中实现千原子级无缺陷阵列

Desiree Lim, Hadriel Mamann, Grégoire Pichard, Lilian Bourachot, Arvid Lindberg, Clotilde Hamot, Hugo Le Bars, Florian Fasola, Siddhy Tan, Gwennolé Cournez, Sylvain Dutartre, Thierry Cartry, Sylvain Lemettre, Richard Hostein, Julien Paris, Franck Ferreyrol, Andréa Collardey, Adrien Signoles, Thierry Lahaye, Corentin Monmeyran, Bruno Ximenez

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种4K低温平台,利用高数值孔径光学实现大尺度镊子阵列,显著延长了制备大尺度阵列的实验时间,成功制备出含1024个原子的无缺陷阵列,为量子计算提供新机遇。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 14 篇

2309.08780 2026-04-09 cs.RO 83%

STERN: Simultaneous Trajectory Estimation and Relative Navigation for Autonomous Underwater Proximity Operations

STERN: 自主水下近距操作中的轨迹估计与相对导航

Aldo Terán Espinoza, Antonio Terán Espinoza, John Folkesson, Clemens Deutsch, Niklas Rolleberg, Peter Sigray, Jakob Kuttenkeuler

机构 * Centre for Naval Architecture, KTH Royal Institute of Technology(KTH皇家理工学院海军建筑中心) Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(KTH皇家理工学院机器人、感知与学习系)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出STERN方法,通过因子图模型实现自主水下车辆的近距操作中的轨迹估计与相对导航,通过模拟和真实数据验证了方法的灵活性和动态假设的限制。

Comments v2 updated after revision. Article contains 24 pages and 18 figures. Published in the IEEE Journal of Oceanic Engineering, available at: https://doi.org/10.1109/JOE.2025.3624470

Journal ref IEEE Journal of Oceanic Engineering, vol. 51, no. 1, pp. 293-316, Jan. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07286 2026-04-09 cs.RO cs.AI cs.LG 82%

CADENCE: Context-Adaptive Depth Estimation for Navigation and Computational Efficiency

CADENCE:面向导航和计算效率的上下文自适应深度估计

Timothy K Johnsen, Marco Levorato

机构 * San Diego State University(圣地亚哥州立大学) University of California, Irvine(加州大学尔湾分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 CADENCE通过动态调整轻量级单目深度估计网络的计算复杂度,实现导航需求与环境上下文的闭环控制,降低能耗并提升导航精度。

Comments 7 pages, 7 figures, Accepted for publication at IEEE World AI IoT Congress (AIIoT) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05529 2026-04-09 cs.AI cs.RO 81%

Before We Trust Them: Decision-Making Failures in Navigation of Foundation Models

在我们信任之前:基础模型导航决策中的失败

Jua Han, Jaeyoon Seo, Jungbin Min, Sieun Choi, Huichan Seo, Jihie Kim, Jean Oh

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 研究发现基础模型在导航任务中存在显著决策失败,需更细致评估以理解其局限性。

Comments Corrected author order in metadata; manuscript changed

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18525 2026-04-09 cs.RO cs.CV 81%

Splatblox: Traversability-Aware Gaussian Splatting for Outdoor Robot Navigation

Splatblox:面向户外机器人导航的可通行性感知高斯点绘制

Samarth Chopra, Jing Liang, Gershom Seneviratne, Yonghan Lee, Jaehoon Choi, Jianyu An, Stephen Cheng, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学帕克分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 Splatblox通过融合RGB图像和LiDAR点云,构建了具有几何和语义信息的可通行性感知ESDF,实现户外复杂环境下的实时自主导航,实验表明其在可通行性判断和路径规划方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06972 2026-04-09 cs.RO cs.MA 79%

Differentiable Environment-Trajectory Co-Optimization for Safe Multi-Agent Navigation

可微环境-轨迹联合优化用于安全多智能体导航

Zhan Gao, Gabriele Fadini, Stelian Coros, Amanda Prorok

机构 * University of Cambridge(剑桥大学) Zurich University of Applied Sciences, ZHAW(苏黎世应用科技大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种可微环境-轨迹联合优化方法,通过双层优化问题提升多智能体导航的安全性和效率,实验验证了其在物流和交通场景中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05477 2026-04-09 cs.RO 79%

Trust Through Transparency: Explainable Social Navigation for Autonomous Mobile Robots via Vision-Language Models

通过透明实现信任:通过视觉语言模型实现自主移动机器人的可解释社交导航

Oluwadamilola Sotomi, Devika Kodi, Aliasghar Arab

机构 * New York University, Tandon School of Engineering(纽约大学坦登工程学院) General Autonomy Inc.(通用自主公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种多模态可解释模块,结合视觉语言模型和热图提升自主导航的透明度,通过自然语言总结使机器人感知、分析并表达观察结果,实验表明实时解释能提升用户信任和理解。

Comments Submitted to IEEE Conferences

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13200 2026-04-09 cs.HC 78%

Navig-AI-tion: Navigation by Contextual AI and Spatial Audio

导航-AI:通过上下文AI和空间音频进行导航

Mathias N. Lystbæk, Haley Adams, Ranjith Kagathi Ananda, Eric J Gonzalez, Luca Ballan, Qiuxuan Wu, Andrea Colaço, Peter Tan, Mar Gonzalez-Franco

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出结合视觉语言模型与空间音频的导航系统,通过环境地标锚定指令并提供方向性空间音频信号,提升导航准确性与用户体验。

Comments 5 pages, 2 figures, to be published in Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems (CHI EA '26), 6 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06621 2026-04-09 cs.GL cs.LG stat.ML 57%

The Theorems of Dr. David Blackwell and Their Contributions to Artificial Intelligence

大卫·布莱克韦尔定理及其对人工智能的贡献

Napoleon Paxton

机构 * School of Information, University of California, Berkeley(加州大学伯克利分校信息学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本文综述了布莱克韦尔的三个重要定理及其对现代人工智能和机器学习的影响,包括马尔可夫链蒙特卡罗推断、自主机器人导航、生成模型训练等领域的应用。

Comments Survey article, 19 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06392 2026-04-09 cs.AI cs.MA cs.SE 57%

Qualixar OS: A Universal Operating System for AI Agent Orchestration

Qualixar OS:面向AI代理编排的通用操作系统

Varun Pratap Bhardwaj

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 Qualixar OS是首个应用层操作系统,支持异构多代理系统,提供10个LLM供应商、8+代理框架和7种传输的完整运行时,包含12种多代理拓扑执行语义、LLM驱动的团队设计引擎、三层模型路由、共识判断管道、四层内容归属和通用兼容性等功能。

Comments 20 pages, 7 figures, 8 tables. Zenodo DOI: 10.5281/zenodo.19454219

URL PDF HTML 收藏
2601.07154 2026-04-09 cs.CV 57%

Motion Focus Recognition in Fast-Moving Egocentric Video

眼动视频中运动聚焦识别

Si-En Hong, James Tribble, Alexander Lake, Hao Wang, Chaoyi Zhou, Ashish Bastola, Siyu Huang, Eisa Chaudhary, Brian Canada, Ismahan Arslan-Ari, Abolfazl Razi

机构 * Clemson University(克莱姆森大学) University of South Carolina Beaufort(南卡罗来纳大学博福特分校) University of South Carolina(南卡罗来纳大学)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 本文提出一种实时运动聚焦识别方法,通过相机姿态估计基础模型和系统级优化,实现对眼动视频中主体运动意图的估计,适用于边缘部署的运动分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07279 2026-04-09 cs.CV 57%

Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training

Mem3R: 基于混合记忆的流式3D重建

Changkun Liu, Jiezhi Yang, Zeman Li, Yuan Deng, Jiancong Guo, Luca Ballan

机构 * Google(谷歌) The Hong Kong University of Science and Technology(香港科技大学) University of Southern California(南加州大学)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 Mem3R通过分离相机跟踪与几何映射,利用隐式快权记忆和显式token状态提升长序列的时序一致性,相比CUT3R显著提升性能并减小模型规模。

Comments Project page: https://lck666666.github.io/Mem3R/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09646 2026-04-09 cs.CV 57%

VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification

VHOI:通过运动稠密化从稀疏轨迹生成可控的人-物交互视频

Wanyue Zhang, Lin Geng Foo, Thabo Beeler, Rishabh Dabral, Christian Theobalt

机构 * MPI for Informatics, SIC(马克斯·普朗克信息学研究所,SIC) VIA Center(VIA中心) Google(谷歌)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 VHOI通过运动稠密化将稀疏轨迹转化为HOI掩码序列,再通过视频扩散模型生成可控的人-物交互视频,提出了一种新颖的HOI-aware运动表示,增强了模型对真实交互动态的理解与生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06175 2026-04-09 cs.HC 50%

User-Centric Design of UI for Mobile Banking Apps: Improving UI and Features for Better Customer Experience

以用户为中心的移动银行应用UI设计:通过改进UI和功能提升客户体验

Luniva Chitrakar, Ishan Panta, Biplov Paneru, Sangharsh Poudel, Lahana Kansakar

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过用户调研和测试,探讨移动银行应用UI设计改进,以提升用户体验,解决导航、术语不清等问题,并提出利用格式心理学优化布局。

详情

展开后加载摘要…

URL PDF HTML 收藏