arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-11 至 2026-08-11 共收录 42 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 42 篇

2608.09073 2026-08-11 cs.RO 新提交 90%

Latent World Models with Monotone Planning Costs for Image-Goal Navigation

带有单调规划代价的潜在世界模型用于图像目标导航

Amirhosein Chahe, Siwei Cai, Lifeng Zhou

机构 * Drexel University(卓克索大学)

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 本文提出基于冻结DINO编码器的潜在世界模型,通过自回归回退损失与单调代价排序损失优化,在GNM数据集上实现图像目标导航最优性能,方向误差较基线降低2.7倍,还可零样本部署于物理机器人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08814 2026-08-11 cs.CV cs.AI cs.LG 新提交 89%

360CityArena: A Realistic Virtual Urban Navigation Benchmark for Embodied Agents

360CityArena:面向具身智能体的真实虚拟城市导航基准

Kenta Watanabe, Atsuyuki Miyai, Mizuki Takenawa, Kiyoharu Aizawa, Toshihiko Yamasaki

机构 * The University of Tokyo(东京大学)

专题命中 具身导航 :embodied agent(title,abstract);navigation(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 研究人员提出基于东京秋叶原重建的360CityArena城市导航基准,评估具身智能体城市探索能力,发现最强模型Gemini 2.5 Flash表现远低于人类,为相关研究提供了挑战性测试平台。

Comments ECCV2026. Project Page: https://360mm-team.github.io/360CityArena/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07548 2026-08-11 cs.RO cs.CV 新提交 88%

SC$^{2}$-WM: A Self-Correcting World Model with Closed-Loop Feedback for Vision-and-Language Navigation in Continuous Environments

SC²-WM:用于连续环境下视觉语言导航的带闭环反馈的自校正世界模型

Xuan Yao, Yuze Zhu, Junyu Gao, Zongmeng Wang, Changsheng Xu

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);分类 cs.RO、cs.CV

AI总结 针对连续环境视觉语言导航中开环执行的状态漂移问题,提出带闭环反馈的自校正世界模型SC²-WM,通过状态级计划优化与测试时模型自适应提升导航鲁棒性和泛化性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09196 2026-08-11 cs.RO 新提交 85%

SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot

SAIN:面向移动机器人的、结合主动对话 grounding 的结构感知交互式导航

Yuhao Cao, Xiao Liu, Yang Xie, Lu Liu, Haoyao Chen

机构 * School of Mechanical Engineering and Automation, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机械工程与自动化学院) Department of Mechanical Engineering, City University of Hong Kong(香港城市大学机械工程系)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.RO

AI总结 本文提出SAIN零样本框架,将主动对话转化为持久导航状态,在VL-LN IIGN基准上提升了导航成功率与加权成功率,无需特定任务策略训练,验证了对话转状态机制的有效性。

Comments 8 pages, 4 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06833 2026-08-11 cs.RO 版本更新 85%

Unordered Landmark Visual Navigation

无序地标视觉导航

Hao Ren, Junzhe Zhu, Yihan Li, Zetong Bi, Le Zheng, Zhi Li, Yiqing Yuan, Zhaoliang Wan, Dizhe Zhang, Lu Qi, Hui Cheng

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO

AI总结 针对无序图像导航的挑战,本文提出无需时间与里程计先验的ULVN框架,通过整合建图、定位与规划,在仿真和真实场景中性能优于现有最优方法。

Comments ECCV2026 Oral & Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08596 2026-08-11 cs.CV 新提交 83%

Goal-oriented Navigation Instruction Generation with Tour Video Priors

基于旅游视频先验的面向目标的导航指令生成

Fangdi Li, Juncheng Liao, Changxu Cheng, Jiazhi Wang, Senda Chen, Tao Wang, Wuyue Zhao

机构 * Uni-Ubi AI(优必爱人工智能) Zhejiang University(浙江大学) Tongji University(同济大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本研究提出面向目标的视频 grounding 导航指令生成任务VideoNIG,设计两阶段课程学习框架解决该任务,实验表明其可提升指令质量,集成VLN智能体后可实现端到端导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07557 2026-08-11 cs.RO cs.AI cs.CV 新提交 82%

AeroDPO: Unleashing Lightweight UAV Navigation with High-Fidelity Perception and Automated Preference Optimization

AeroDPO:释放具备高保真感知与自动偏好优化的轻量级无人机导航能力

Peng Xu, Chengcheng Wang, Shaohua Wan

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出AeroDPO,通过高保真感知与自动偏好优化,使20亿参数轻量级无人机导航模型达到70亿参数模型的成功率,同时降低分布外场景碰撞率,成为自主空中智能体新SOTA。

Comments 7 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07542 2026-08-11 cs.AI cs.LG cs.MA cs.RO 新提交 82%

An AI Scientist that Doesn't Drift: Taste, Structure, and Falsifiable Findings in a Quadruped Navigation Research Loop

不会发生漂移的AI科学家:四足机器人导航研究循环中的偏好、结构与可证伪发现

Yiwen Zhang, Eloise Zeng, Jaeha Lee, Tony Yue Yu

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 该研究提出一款基于自研究范式的AI科学家,通过新增实验卡片、专门子智能体和偏好神谕kkanbu的组件,解决自主研究循环漂移问题,在四足机器人导航实验中验证了框架的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06134 2026-08-11 cs.HC 版本更新 82%

MAESTRO: Adapting GUIs and Guiding Navigation with User Preferences in Conversational Agents with GUIs

MAESTRO:在具有GUI的对话代理中通过用户偏好适应GUI并引导导航

Sangwook Lee, Adnan Abbas, Sang Won Lee, Young-Ho Kim, Yan Chen

专题命中 具身导航 :navigation(title,abstract)

AI总结 MAESTRO通过提取用户偏好并指导工作流导航,提升对话代理中GUI的适应性和导航效率,通过实验验证其有效性。

Comments 19 pages, 6 figures, 2 tables. Published at UIST '26. This is the camera-ready version, posted under CC BY 4.0

Journal ref Proceedings of the 39th Annual ACM Symposium on User Interface Software and Technology (UIST '26), November 2-5, 2026, Detroit, MI, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09564 2026-08-11 cs.CV cs.AI 新提交 81%

From Semantic Grounding to Decision Optimization: A Unified Framework for Long-Horizon UAV Vision-Language Navigation

从语义接地到决策优化:面向长 horizon 无人机视觉语言导航的统一框架

Zeyuan Ma, Jiaxin Chen, Di Huang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 本文针对无人机视觉语言导航的现有问题,提出统一语义到决策框架,经实验在AerialVLN和OpenFly基准上达到SOTA性能。

Comments 10 pages, 5 figures. Accepted at ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08545 2026-08-11 cs.RO cs.LG 新提交 81%

Curriculum Generation under Structured Parametric Environments for Robust Navigation Policies

结构化参数环境下用于鲁棒导航策略的课程生成

Prishita Ray

机构 * Cornell University(康奈尔大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文针对结构化参数环境提出重参数化课程生成框架,结合分布偏移正则化,在OpenAI Gym的两类连续控制环境中,显著优于多种基线方法,提升了导航策略的鲁棒性。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07797 2026-08-11 cs.RO cs.CV 新提交 81%

Drone-Assisted UAV-UGV Collaboration for Autonomous Navigation in Snow-Covered Terrain

无人机辅助的无人机-无人车协同积雪覆盖地形自主导航

Shreyam Gupta, P. Agrawal, Priyam Gupta, R. Gautam

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 针对积雪覆盖地形传统导航方法失效的问题,提出无人机-无人车协同导航框架,采用定制U-Net、EKF、YOLOv5等技术实现高分割精度与低定位误差,可在遮挡环境中完成自主导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07751 2026-08-11 cs.RO cs.LG 新提交 81%

CoCoNav: Conformal Control for Safe Robot Navigation in Crowds

CoCoNav:面向人群环境中安全机器人导航的保形控制

Cheng Guo, Mingzhe Ni, Zheng Liang, Yihu Ling, Yuan Hu, Michele Caprio, Daniele Pucci, Wei Pan

机构 * The University of Manchester(曼彻斯特大学) Italian Institute of Technology(意大利技术研究院) Genisom AI University of Warwick(华威大学) Newcastle University(纽卡斯尔大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出CoCoNav框架,结合在线保形校准与“先松弛再验证”规划器,在人群环境机器人导航中实现了避碰、任务成功与效率的良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07566 2026-08-11 cs.AI cs.RO 新提交 81%

The Field Knows: Cross-Dimensional Geometry from Navigation to Black Holes

场域知晓:从导航到黑洞的跨维度几何

Chenghao Xu

机构 * National Engineering Research Center of Robot Visual Perception and Control Technology(机器人视觉感知与控制技术国家工程研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究提出了由单个因果对比损失训练的连续度量场框架,可跨维度发现几何结构,在机器人导航和黑洞场景中均表现出良好性能,具备零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14357 2026-08-11 cs.RO cs.AI 版本更新 81%

SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation

SUM-AgriVLN:面向农业视觉语言导航的空间理解记忆

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 针对现有农业视觉语言导航方法忽视重复指令的空间记忆潜力的局限,提出SUM模块并集成至AgriVLN构建SUM-AgriVLN,在A2A基准上将SR从0.47提至0.54,NE仅微增,达领域顶尖性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09121 2026-08-11 cs.AI 新提交 79%

MELLON - Multimodal Enhanced LLM for Online Navigation

MELLON——面向在线导航的多模态增强型大语言模型

Ruiyu Li, Haoyang Cai, Zhitong Guo, Tong Hu

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 针对网页导航智能体现有模型的不足,本文以WebShop为基准,提出MELLON等三项多模态增强方案,训练1个epoch后MELLON任务完成准确率提升9.26%,验证了多模态方法的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00854 2026-08-11 cs.RO 版本更新 79%

Minute-Scale Training for Microrobot Navigation

微型机器人导航的分钟级训练

Yinghan Sun, Aoji Zhu, Xiang Ji, Yamei Li, Jiachi Zhao, Yun Wang, Li Zhang, Huijun Gao, Lidong Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen Loop Area Institute(深圳河套学院) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文针对微型机器人DRL导航训练耗时久的问题,提出含全向量化模拟器与TSR奖励框架的学习框架,将训练缩至10分钟内,支持零样本部署,可缩短设计周期、加速部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26041 2026-08-11 cs.CV 版本更新 79%

Where and How to Prune: An Empirical Study of Visual Token Pruning for GUI Agent Navigation

重新思考GUI视觉代理中历史截图的标记剪枝:语义、空间和时间视角

Daiqiang Li, Zihao Pan, Zeyu Zhang, Xuyang Liu, Shijia Xu, Ronghao Chen, Huacan Wang, Honggang Chen, Linfeng Zhang, Zhangquan Chen, Haiyun Jiang

机构 * Sichuan University(四川大学) Sun Yat-sen University(中山大学) Australian National University(澳大利亚国立大学) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文从语义、空间和时间角度研究GUI视觉代理中历史截图的标记剪枝,发现背景区域对界面状态转换有重要价值,随机剪枝在空间结构保留上更有效,且GUI代理具有近期效应,通过分配更多预算给近期截图可降低计算成本而不影响性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19930 2026-08-11 cs.RO cs.MA 版本更新 79%

A Communication-Efficient Digital Twin Framework for PSO-Based Swarm Navigation and Obstacle Avoidance

面向基于粒子群优化(PSO)的集群导航与避障的通信高效数字孪生框架

Siyu Yuan, Khurshid Alam, Bin Han, Dennis Krummacker, Hans D. Schotten

机构 * University of Kaiserslautern (RPTU)(凯撒斯劳滕大学(RPTU)) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对工业集群目标定位的避障与通信难题,提出部署于MEC服务器的DT辅助PSO框架,可减少通信负载、加快收敛,在复杂工业协同探索场景具有应用潜力。

Comments Accepted by IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07501 2026-08-11 cs.HC 新提交 78%

Customized Tourist Navigation in Urban Contexts Following General Trends and Individual Preferences

结合通用趋势与个人偏好的城市环境下定制化游客导航

Andrea Zingoni, Sediola Ruko, Enrique Yeguas-Bolívar, José Manuel Alcalde-Llergo

专题命中 具身导航 :navigation(title,abstract)

AI总结 该研究针对游客城市导航难题,推出PATH工具,基于游客频率与POI偏好的启发式规则计算最优路径,经维泰博案例验证,推荐路线获高度好评,可提升城市探索体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07740 2026-08-11 cs.RO cs.SY eess.SY 新提交 74%

Enhancing Autonomous Vehicle Navigation with a Clothoid-Based Lateral Controller

基于回旋曲线(Clothoid)的横向控制器增强自动驾驶车辆导航

Aashish Shaju, Steve Southward, Mehdi Ahmadian

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 本研究提出结合自适应预瞄机制的Clothoid横向控制器,通过准反馈算法与超前滤波器提升自动驾驶车辆路径跟踪精度与稳定性,经TruckSim-Simulink联合仿真验证性能显著改善。

Comments Published version. 21 pages. Published in Applied Sciences, 2024

Journal ref Applied Sciences 14(5), 1817 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10744 2026-08-11 cs.CV cs.RO 版本更新 73%

Traj-VLN: Learning Pixel-Space Interaction via Autoregressive Trajectory Generation

Traj-VLN:通过自回归轨迹生成学习像素空间交互

Changfei Fu, Guangcheng Chen, Aoxiang Gu, Haoxiang Liang, Wenjun Xu, Hong Zhang

机构 * Southern University of Science and Technology(南方科技大学) Peng Cheng National Laboratory(鹏城国家实验室) Guangdong University of Technology(广东工业大学)

专题命中 具身导航 :embodied agent(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究连续环境中视觉与语言导航问题,提出通过自回归轨迹生成在2D像素空间微调视觉语言模型来学习导航交互的方法,实验验证该方法能显著提升性能,旗舰模型在有限资源和数据下达最优水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07606 2026-08-11 cs.RO cs.AI cs.HC eess.IV 新提交 62%

Enhanced Real-Time 6-DOF Extended Reality Catheter Tracking for Evaluating Potential Improvement in Efficiency, Precision, and Depth Perception for Cardiac Interventions

用于评估心脏介入效率、精度和深度感知潜在提升的增强型实时六自由度扩展现实导管跟踪技术

Mohsen Annabestani, Sandhya Sriram, Andrew Kuzemczak, S. Chiu Wong, Alexandros Sigaras, Bobak Mosadegh

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究开发基于XR的实时6-DOF导管跟踪平台,经20名医学生测试,其可使心脏介入操作速度提升超5倍、导管移动距离减约5倍,还能提高精度、降低变异性,优化操作体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26046 2026-08-11 cs.RO cs.CV 版本更新 62%

RoboAtlas: Contextual Active SLAM

RoboAtlas:上下文感知主动SLAM

Alexander Schperberg, Shivam K. Panda, Abraham P. Vinod, Rokaha Bhagawan, M. K. Jawed, Stefano Di Cairano

机构 * Mitsubishi Electric Research Laboratories(三菱电机研究实验室) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 提出RoboAtlas框架,通过上下文感知的多臂赌博机平衡几何探索与语义推理,结合3D语义地图OpenRoboVox,在真实环境中实现100%任务成功率,并在GOAT-Bench上以90.6%成功率达到SOTA。

Comments Alexander Schperberg and Shivam K. Panda made equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09484 2026-08-11 cs.RO 新提交 57%

Graph-Guided Safe Diffuser: Topological Graph Guidance for Safe Diffusion Planning

图引导的安全扩散器:用于安全扩散规划的拓扑图引导

Nakgyu Yang, KwangBin Lee, SooJean Han

机构 * School of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院电气工程学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 该研究提出图引导的安全扩散器(G2SD)框架,用高层拓扑图规划器引导低层扩散模型,解决扩散规划器的流形破裂问题,在Maze2D导航等任务中大幅提升无碰撞目标到达率与任务性能。

Comments 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09146 2026-08-11 cs.CV 新提交 57%

Multi-Submap Implicit Neural SLAM with Local-to-Global Loop Closure for Large-Scale Scene Reconstruction

面向大规模场景重建的结合局部到全局回环检测的多子图隐式神经SLAM

Tianchen Deng, Chongdi Wang, Nailin Wang, Lei Zhao, Ziqi Ma, Tianjun Zhang, Zhe Liu, Danwei Wang, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Carnegie Mellon University(卡内基梅隆大学) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)

专题命中 具身导航 :robotic(abstract);分类 cs.CV

AI总结 本文提出一种带多子图架构与双层回环检测机制的神经SLAM系统,结合渐进式建图、光流跟踪、局部到全局回环及子图间在线蒸馏算法,在大规模场景重建性能上优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08949 2026-08-11 cs.CV 新提交 57%

EndoMD-SLAM: Endoscopic Gaussian Splatting SLAM under Optical Degradation with Memory and Static-Transient Decomposition

EndoMD-SLAM:光学退化下的内窥镜高斯溅射SLAM,具备记忆与静态-瞬态分解能力

Nuo Chen, Kangqi Ni, Lulin Liu, Joga Ivatury, Ying Ding, Farshid Alambeigi, Tianlong Chen, Zhiwen Fan

机构 * Texas A&M University(德克萨斯农工大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Minnesota(明尼苏达大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 EndoMD-SLAM是针对内窥镜光学退化问题的SLAM框架,通过记忆驱动门控、静态-瞬态分解等机制,在结肠镜检查基准上实现了轨迹误差降低91%、PSNR提升9.9 dB的效果。

Comments Project page: https://endomd-slam.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08648 2026-08-11 cs.CV 新提交 57%

Agentic Visual Reasoning in Whole-Slide Pathology Images via Active Perception

基于主动感知的全切片病理图像智能体视觉推理

Jingyun Chen, Fengchun Liu, Linghan Cai, Songhan Jiang, Shenjin Huang, Hongpeng Wang, Lequan Yu, Yongbing Zhang

机构 * College of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 该研究提出AdaptivePath主动感知框架,通过序列决策实现千兆像素病理切片的视觉推理,在病理VQA基准及TCGA六队列癌症亚型分类上取得最优性能,辅助病理学家诊断。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08468 2026-08-11 cs.CR cs.AI 新提交 57%

SkillsMetric: Mapping the Detection Boundary of Static Analysis for Malicious Agent Skills

SkillsMetric:映射恶意智能体技能静态分析的检测边界

Xinze Chen, Chi Zhang, Ping Ji, Yimin Liu

专题命中 具身导航 :manipulation(abstract);分类 cs.AI

AI总结 本研究提出五阶段静态分析框架SkillsMetric,构建含2266个技能的对抗性数据集,发现静态分析对部分攻击检测不足,需结合静态预筛选与语义审查的纵深防御架构。

Comments 6 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31119 2026-08-11 cs.LG 版本更新 57%

Visualizing High-Dimensional Graph Embeddings via Informed Multi-View Projections

通过信息多视图投影可视化高维图嵌入

Ya Ji, Xuefeng Li, Timo Brand, Jacob Miller, Peng Zhang, Stephen Kobourov, Yifan Hu

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院) School of Computation, Information and Technology, Technical University of Munich(慕尼黑工业大学计算、信息与技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 提出在高维空间中嵌入图,并通过可微分的边交叉代理搜索优化美学和可读性指标的二维视角,优于标准布局,并引入交互系统DataFly。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏