arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 1471 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 307 篇

2603.03495 2026-08-12 cs.RO 版本更新 57%

Navigating in Uncertain Environments with Heterogeneous Visibility

在不确定环境中利用异质可见性导航

Jongann Lee, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种基于异质可见性的导航算法,通过优化观察奖励与通行成本之和,有效降低导航成本并提升信息获取效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17005 2026-08-12 cs.RO cs.SY eess.SY 版本更新 57%

Autonomous Exploration-Based Precise Mapping for Mobile Robots through Stepwise and Consistent Motions

基于逐步一致运动的移动机器人自主探索精准建图

Muhua Zhang, Lei Ma, Ying Wu, Kai Shen, Yongkui Sun, Henry Leung

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种面向采用激光SLAM的室内移动机器人的自主探索框架,通过多RRT采样、逐步一致运动等策略提升建图精度与鲁棒性,经仿真与真实实验验证其优于基准2D算法。

Comments 8 pages, 11 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31119 2026-08-11 cs.LG 版本更新 57%

Visualizing High-Dimensional Graph Embeddings via Informed Multi-View Projections

通过信息多视图投影可视化高维图嵌入

Ya Ji, Xuefeng Li, Timo Brand, Jacob Miller, Peng Zhang, Stephen Kobourov, Yifan Hu

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院) School of Computation, Information and Technology, Technical University of Munich(慕尼黑工业大学计算、信息与技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 提出在高维空间中嵌入图,并通过可微分的边交叉代理搜索优化美学和可读性指标的二维视角,优于标准布局,并引入交互系统DataFly。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00637 2026-08-11 cs.RO 版本更新 57%

Global-Local Attention Decomposition for Terrain Encoding in Humanoid Perceptive Locomotion

全局-局部注意力分解用于人形感知运动中的地形编码

Shengcheng Fu, Yang Zhang, Zhanxiang Cao, Liyun Yan, Yizhi Chen, Yunpeng Yin, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Humanoid Robot (Shanghai) Co., Ltd.(人形机器人(上海)有限公司)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出全局-局部注意力分解(GLAD)方法,通过粗到细编码器分离全局地形感知和局部立足点选择,实现人形机器人在稀疏立足点和受限环境中的鲁棒运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28272 2026-08-11 cs.RO 版本更新 57%

Point of View: How Perspective Affects Perceived Robot Sociability

视角:透视如何影响感知的机器人社交性

Subham Agrawal, Aftab Akhtar, Nils Dengler, Maren Bennewitz

机构 * Humanoid Robots Lab, University of Bonn, Germany(波恩大学人形机器人实验室,德国)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文通过VR用户研究,比较全知视角与第一人称视角对机器人轨迹社交性的感知差异,发现全知视角下社交性高的轨迹在近距离第一人称体验中可能更令人不安,而头部点头等社交信号可提升感知社交性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23290 2026-08-11 cs.CV 版本更新 57%

LineGraph2Road: Structural Graph Reasoning on Line Graphs for Road Network Extraction

LineGraph2Road:基于线路图的结构图推理用于道路网络提取

Zhengyang Wei, Renzhi Jing, Yiyi He, Jenny Suckale

机构 * Stanford University(斯坦福大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 LineGraph2Road通过构建全局稀疏欧几里得图并应用图变换器,提升道路网络提取的连通性预测,解决长距离依赖和复杂拓扑问题,实现高精度道路提取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13361 2026-08-11 cs.RO 版本更新 57%

CLEAR: A Semantic-Geometric Terrain Abstraction for Large-Scale Unstructured Environments

CLEAR: 一种用于大规模无结构环境的语义-几何地形抽象

Pranay Meshram, Charuvahan Adhivarahan, Ehsan Tarkesh Esfahani, Souma Chowdhury, Chen Wang, Karthik Dantu

机构 * Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学) Department of Mechanical and Aerospace Engineering, University at Buffalo(机械与航空航天工程系,布法罗大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 CLEAR通过结合边界感知的空间分解与递归平面拟合,实现了大规模无结构环境中的高效地形抽象,提高了路径规划的速度和可靠性。

Comments Accepted in IEEE RA-L August, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06305 2026-08-10 cs.AI cs.CL cs.IR 版本更新 57%

Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations

超越Top-K:用可解释智能体操作替代黑盒检索

Sagar Tamang, Ayush Vyas, Tabarakul Hazarika

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 该研究针对长文档检索的结构缺陷,提出无嵌入智能体检索框架READ,在政府财务报告数据集上显著优于密集检索,且性能提升源于操作界面,同时发现BM25与READ无统计差异。

Comments 20 pages, 5 figures, 14 tables. Code, benchmark, and full result trajectories: https://github.com/twospoon/READ

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00829 2026-08-10 cs.RO 版本更新 57%

GeminiPainter's sequence-formed pipeline comprised of perception, cognition, planning, and action stages

GeminiPainter的序列式流程由感知、认知、规划和行动阶段组成

Miguel Altamirano Cabrera, Aleksey Fedoseev, Iana Zhura, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科学技术学院)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 该研究提出自主机器人肖像生成系统,整合多技术实现绘画,经实验获用户高分评价,产出可识别且具吸引力的机器人肖像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12147 2026-08-10 cs.SE cs.AI cs.CL 版本更新 57%

From Plan to Action: How Well Do Agents Follow the Plan?

评估自主编程代理中的计划合规性

Shuyang Liu, Saman Dehghan, Jatin Ganhotra, Martin Hirzel, Reyhaneh Jabbarvand

机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校) IBM(IBM公司)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文系统分析了编程代理在执行任务时对计划的遵循情况,通过16991条轨迹评估不同计划变体的影响,发现计划提醒能提高任务成功率,但不恰当的计划补充可能降低性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02018 2026-08-07 cs.CV 版本更新 57%

Invisible Ink Threats: Adversarial Goals Behind Legitimate Tasks in Computer-Use Agents

隐形墨水威胁:计算机使用智能体中合法任务背后的对抗目标

Jia-Chen Zhang, Ze-Yu Zhang, Kai-Wei Zhang

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 该研究针对计算机使用智能体的隐形墨水威胁,构建II-Bench与HITLCUA框架评估后发现,低危害注入可绕过防御,暴露出现有CUAs的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17430 2026-08-06 cs.RO 版本更新 57%

SafeLand: Safe Autonomous Landing in Unknown Environments with Bayesian Semantic Mapping

SafeLand: 在未知环境中使用贝叶斯语义映射实现安全自主着陆

Markus Gross, Andreas Greiner, Sai Bharadhwaj Matha, Felix Soest, Daniel Cremers, Henri Meeß

机构 * Fraunhofer IVI Autonomous Aerial Systems(弗劳恩霍夫IVI自主航空系统) TU Munich Computer Vision Group(慕尼黑工业大学计算机视觉组) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出SafeLand系统,通过深度学习语义分割构建在线语义地面地图,结合贝叶斯概率过滤和行为树实现安全自主着陆,通过200次模拟和60次实地测试,展示零误报的人类检测率和亚秒响应延迟。

Journal ref ECCV 2026 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20482 2026-08-05 cs.AI cs.CL 版本更新 57%

PersonaTrail: Benchmarking Personalized Web Agents through Browsing Trails

PersonaTrail:通过浏览轨迹对个性化网络代理进行基准测试

Seungbin Yang, Chaewoon Ki, Dohyun Lee, Jaegul Choo, ChaeHun Park

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 研究针对用户指令不明确时网络代理需从浏览历史推断上下文的问题,引入PersonaTrail基准及偏好感知上下文记忆框架PACMem,利用浏览轨迹评估代理,实验证明PACMem优于现有基于记忆的基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18660 2026-08-05 cs.RO 版本更新 57%

MVP-Tac: A Miniaturized Dual-Modal Vision and Photoelastic Tactile Sensor for Robot-Assisted Minimally Invasive Surgery

MVP-Tac:一种用于机器人辅助微创手术的小型化双模态视觉与光弹性触觉传感器

Md Rakibul Islam Prince, Jaeeun Kim, Yuhao Zhou, Mason Vrshek, Shivani Reddy Sama, Adyaa Khera, Sheeraz Athar, Zijie Xu, Jiabin Liu, Shaoting Lin, Wei Li, Yu She

机构 * Elmore Family School of Electrical and Computer Engineering, Purdue University(普渡大学埃尔莫尔电气与计算机工程学院) Edwardson School of Industrial Engineering, Purdue University(普渡大学爱德华森工业工程学院) School of Mechanical Engineering, Purdue University(普渡大学机械工程学院) Robotics Engineering Technology, Purdue University(普渡大学机器人工程技术学院) Department of Civil Engineering, Stony Brook University(石溪大学土木工程系) Department of Mechanical Engineering, Michigan State University(密歇根州立大学机械工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 研究针对机器人辅助微创手术缺乏触觉反馈问题,介绍了MVP-Tac传感器,它采用反射光弹性成像,能在视觉触觉间切换,经力校准及肿瘤触诊等实验验证其有效性,为恢复RMIS中触诊并保持视觉反馈提供实用途径。

Comments 8 pages, 8 figures. To appear in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15169 2026-08-05 cs.CV 版本更新 57%

MeSS: City Mesh-Guided Outdoor Scene Generation with Cross-View Consistent Diffusion

MeSS: 基于城市网格的户外场景生成与跨视角一致扩散

Xuyang Chen, Zhijun Zhai, Kaixuan Zhou, Zengmao Wang, Jianan He, Dong Wang, Yanfeng Zhang, mingwei Sun, Rüdiger Westermann, Konrad Schindler, Liqiu Meng

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 MeSS通过改进跨视角一致性,利用城市网格模型生成高质量且风格一致的户外场景,并结合3D高斯点划重建技术提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11768 2026-08-04 cs.RO 版本更新 57%

Identifying and Exploiting Structure in Robot Co-Design

识别机器人协同设计的归纳偏置

Apoorv Vaish, Oliver Brock

机构 * Robotics and Biology Laboratory, Technische Universität Berlin(柏林工业大学机器人与生物学实验室) Science of Intelligence (SCIoI), Cluster of Excellence, Berlin, Germany(德国柏林卓越集群“智能科学”(SCIoI))

专题命中 具身导航 :manipulation(abstract);分类 cs.RO

AI总结 本文通过分析软运动和操作任务的协同设计景观,识别出三种跨区域一致的模式,提出高效的协同设计算法,比基准算法提升36%,并在样本效率上提升两序量级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28067 2026-08-04 cs.LG 版本更新 57%

From Vessel Trajectories to Safety-Critical Encounter Scenarios: A Generative AI Framework for Autonomous Ship Digital Testing

从船舶轨迹到安全关键性遭遇场景:一种生成式AI框架用于自主船舶数字测试

Sijin Sun, Liangbin Zhao, Xiuju Fu

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本文提出一种数据驱动框架,将大规模AIS轨迹转化为结构化安全关键性遭遇场景,结合生成轨迹建模与自动化遭遇配对,提升场景生成的可扩展性与真实性。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03011 2026-08-04 cs.RO 版本更新 57%

3D-CovDiffusion: 3D-Aware Diffusion Policy for Coverage Path Planning

3D-CovDiffusion:面向覆盖路径规划的三维感知扩散策略

Chenyuan Chen, Haoran Ding, Ran Ding, Tianyu Liu, Zewen He, Anqing Duan, Yoshihiko Nakamura

机构 * IEEE

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出 3D-CovDiffusion,将覆盖路径规划转化为条件序列生成问题,采用几何条件扩散框架从三维点云合成轨迹,相比基线方法在轨迹平滑度、覆盖率等指标上实现显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22910 2026-08-04 cs.RO 版本更新 57%

Good Weights: Proactive, Adaptive Dead Reckoning Fusion for Continuous and Robust Visual SLAM

Good Weights:用于连续鲁棒视觉SLAM的主动自适应航位推算融合算法

Yanwei Du, Jing-Chen Peng, Patricio A. Vela

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) Institute of Robotics and Intelligent Machines(机器人与智能机械研究所) Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出Good Weights算法,通过自适应融合航位推算与被动视觉SLAM,解决纹理缺失等环境下视觉SLAM位姿估计差、跟踪丢失的问题,提升了视觉SLAM的性能与鲁棒性。

Comments 8 pages, 9 figures, 1 table. Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11970 2026-07-31 cs.RO 版本更新 57%

ARCSnake V2: Mechanical Adaptations For An Amphibious Multi-Domain Screw-Propelled Snake-Like Robot

ARCSnake V2:适用于水陆两栖多领域的螺旋推进蛇形机器人的机械改进

Sara Wickenhiser, Lizzie Peiros, Calvin Joyce, Peter Gavrilov, Sujaan Mukherjee, Syler Sylvester, Junrong Zhou, Mandy Cheung, Jason Lim, Florian Richter, Michael C. Yip

机构 * Mechanical and Aerospace Engineering Department, University of California San Diego(加州大学圣地亚哥分校机械与航空航天工程系) Electrical and Computer Engineering Department, University of California, San Diego(加州大学圣地亚哥分校电气与计算机工程系)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 ARCSnake V2是ARCSnake V1的改进型两栖螺旋推进蛇形机器人,结合超冗余蛇形机器人高机动性与阿基米德螺旋推进的地形适应性,经实验验证具备水下作业能力,可作为多领域探索等任务的多功能平台。

Comments 8 pages, 5 figures, IROS

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08574 2026-07-30 cs.RO 版本更新 57%

RVC-NMPC: Nonlinear Model Predictive Control with Reciprocal Velocity Constraints for Mutual Collision Avoidance in Agile UAV Flight

RVC-NMPC:基于互斥碰撞回避的非线性模型预测控制

Vit Kratky, Robert Penicka, Parakh M. Gupta, Ondrej Prochazka, Martin Saska

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种基于RVC-NMPC的非线性模型预测控制方法,通过高效计算和直接整合互斥速度约束,实现高频率的碰撞回避控制,适用于敏捷无人机飞行。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18379 2026-07-29 cs.LG eess.SP physics.geo-ph physics.space-ph 版本更新 57%

Forecasting Ionospheric Irregularities on GNSS Lines of Sight Using Dynamic Graphs with Ephemeris Conditioning

利用动态图与轨道数据条件化预测GNSS视线上电离层不规则性

Mert Can Turkmen, Eng Leong Tan, Yee Hui Lee

机构 * Nanyang Technological University(南洋理工大学)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本文提出利用动态图和轨道数据条件化预测GNSS视线上电离层不规则性,通过构建动态图结构提升预测精度,实验结果显示模型在BSS和PR-AUC指标上均优于传统方法。

Comments 17 pages, 8 figures, submitted to IEEE Transactions on Geoscience and Remote Sensing

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05658 2026-07-28 physics.ao-ph cs.LG physics.geo-ph 版本更新 57%

Integrating GNSS-Derived Zenith Wet Delay into a Weather Foundation Model Improves Precipitation Forecasting

将全球导航卫星系统(GNSS)导出的天顶湿延迟整合到天气基础模型中可改善降水预报

Leonardo Trentini, Fanny Lehmann, Laura Crocetti, Benedikt Soja

机构 * Weather Foundation(天气基金会)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 研究将GNSS导出的ZWD整合到Aurora天气基础模型中,扩展后的模型学习ZWD能力与预训练变量相当,微调时纳入ZWD可改善降水预报,增益随严重程度增加,能让降水功率谱更现实。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10760 2026-07-28 cs.RO 版本更新 57%

MAGS-SLAM: Monocular Multi-Agent Gaussian Splatting SLAM for Geometrically and Photometrically Consistent Reconstruction

MAGS-SLAM:单目多智能体高斯点云SLAM用于几何和光度一致的重建

Zhihao Cao, Qi Shao, Shuhao Zhai, Jing Zhang, Anh Nguyen, Hesheng Wang, Baoru Huang

机构 * ETH Zurich(苏黎世联邦理工学院) Harbin Engineering University(哈尔滨工程大学) University of Liverpool(利物浦大学) University of Macau(澳门大学) University of Ottawa(多伦多大学) Wuhan University(武汉大学) Imperial College London(伦敦帝国学院)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 MAGS-SLAM通过单目视觉实现多智能体高斯点云SLAM,无需RGB-D传感器即可完成几何和光度一致的场景重建,实验表明其跟踪精度和渲染质量可与现有RGB-D方法媲美。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17604 2026-07-28 cs.RO 版本更新 57%

MoE-Based Learned Inertial Odometry for Bicycle Localization

基于专家混合模型的自行车定位学习惯性里程计

Hao Qiao, Yan Wang, Shuo Yang, Xiaoyao Yu, Jian kuang, Xiaoji Niu

机构 * School of Geodesy and Geomatics(测绘学院) GNSS Research Center(GNSS研究中心) Hubei Luojia Laboratory(湖北珞珈实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对城市峡谷中自行车定位难题,提出基于MoE网络的学习惯性里程计,将神经速度预测器与扩展卡尔曼滤波器耦合,减少计算开销,在低FLOPs下取得良好精度和泛化能力,优于其他模型。

Comments This work has been submitted to the IEEE for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03910 2026-07-28 cs.SE cs.AI cs.CL 版本更新 57%

CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases

CodexGraph:通过代码图数据库连接大型语言模型和代码库

Xiangyan Liu, Bo Lan, Zhiyuan Hu, Yang Liu, Zhicheng Zhang, Fei Wang, Michael Shieh, Wenmeng Zhou

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 研究旨在解决大型语言模型处理整个代码库的难题,提出通过将LLM代理与代码库图数据库接口集成的CodexGraph系统,利用图数据库特性实现精确上下文检索和代码导航,经多基准评估及实际应用开发,展现其在软件工程中的竞争力与潜力。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12997 2026-07-24 cs.AI cs.CL 版本更新 57%

WebCoach: Self-Evolving Web Agents with Cross-Session Memory Guidance

WebCoach:具有跨会话记忆引导的自我进化网络代理

Genglin Liu, Shijie Geng, Sha Li, Hejie Cui, Sarah Zhang, Xin Liu, Tianyi Liu

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Amazon(亚马逊)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 研究针对网页代理跨会话学习不足问题,提出WebCoach框架,通过三个关键组件赋予代理跨会话记忆,可长期规划与自我进化,在WebVoyager基准测试中提升了不同LLM backbone的代理性能。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00934 2026-07-24 cs.LO cs.RO 版本更新 57%

pacSTL: PAC-Bounded Signal Temporal Logic from Data-Driven Reachability Analysis

pacSTL: 基于数据驱动可达性分析的PAC有界信号时序逻辑

Hanna Krasowski, Elizabeth Dietrich, Emir Cem Gezer, Roger Skjetne, Asgeir Johan Sørensen, Murat Arcak

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出pacSTL框架,结合PAC有界可达集预测与区间STL,通过优化问题计算原子鲁棒性上下界并传播,实现规范级别的PAC有界鲁棒性评估,用于不确定动态系统的验证与监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22649 2026-07-23 cs.CV 版本更新 57%

Interactive Medical-SAM2 GUI: A Napari-based semi-automatic annotation tool for medical images

交互式医学-SAM2 GUI:基于Napari的半自动标注工具用于医学图像

Woojae Hong, Jong Ha Hwang, Jiyong Chung, Joongyeon Choi, Hyunggun Kim, Yong Hwy Kim

机构 * Department of Biomechatronic Engineering, Sungkyunkwan University(生物机电工程系,全州大学) Department of Neurosurgery, Seoul National University Hospital, Seoul National University College of Medicine(神经外科,首尔国立大学医院,首尔国立大学医学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 交互式医学-SAM2 GUI 提供基于Napari的本地工作流,实现高效的3D医学图像半自动标注与导出功能。

Comments Planning to submit JOSS (Journal of Open Source Software)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13715 2026-07-22 cs.CV 版本更新 57%

MVGD-Net: A Novel Motion-aware Video Glass Surface Detection Method

MVGD-Net: 一种新颖的运动感知视频玻璃表面检测网络

Yiwei Lu, Hao Huang, Tao Yan

机构 * Tao Yan(谭燕)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 MVGD-Net通过利用视频中运动不一致特性,提出新颖网络检测玻璃表面,结合多模块融合与大规模数据集提升检测性能。

Comments This paper has been accepted by the 40th AAAI Conference on Artificial Intelligence (AAAI-26). It contians 9 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏