arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2965 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 2965 篇

2604.11920 2026-04-15 physics.geo-ph 50%

pDSurfTomo: A High-Performance Parallel Computing Package for Direct Surface Wave Tomography

pDSurfTomo:一种高性能并行计算包用于直接表面波反演

Shaohang Zhu, Junlun Li, Guoyi Chen, Hongjian Fang, Huajian Yao

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本文提出pDSurfTomo,通过混合CPU-GPU加速提升大规模高分辨率表面波反演效率,采用并行设计优化敏感核计算,结合OpenMP实现快速Marching方法并行化,利用GPU加速稀疏线性最小二乘问题求解,显著提升计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10598 2026-04-14 cs.RO 50%

AWARE: Adaptive Whole-body Active Rotating Control for Enhanced LiDAR-Inertial Odometry under Human-in-the-Loop Interaction

AWARE: 一种适应性全身主动旋转控制用于增强人体在环交互下的激光雷达惯性里程计

Yizhe Zhang, Jianping Li, Liangliang Yin, Zhen Dong, Bisheng Yang

机构 * organization= State Key Laboratory of Information Engineering in Surveying, Mapping Remote Sensing , addressline= Wuhan University , city= Wuhan , postcode= 430079 , country= China organization= School of Electrical Electronic Engineering , addressline= Nanyang Technological University , postcode= 639798 , country= Singapore

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出AWARE框架,通过UAV自身旋转能力扩展传感器视野,提升LIO可观测性。采用可微分MPC与强化学习结合,实现估计精度与飞行稳定性平衡,并通过安全飞行走廊机制确保操作安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08292 2026-04-10 cs.RO 50%

EMMa: End-Effector Stability-Oriented Mobile Manipulation for Tracked Rescue Robots

EMMa:面向履带救援机器人的末端稳定性导向移动操作

Yifei Wang, Hao Zhang, Jidong Huang, Shuohang Fang, Haoyao Chen

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出了一种面向履带救援机器人的移动操作框架,通过协调路径优化模型和紧凑成本/约束表示,提高末端操作的稳定性和任务成功率。

Comments 14 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05351 2026-04-10 cs.RO cs.CV 50%

AnyImageNav: Any-View Geometry for Precise Last-Meter Image-Goal Navigation

AnyImageNav: 任意视角几何用于精确最后一步图像目标导航

Yijie Deng, Shuaihang Yuan, Yi Fang

机构 * NYUAD Center for Artificial Intelligence and Robotics (CAIR)(纽约大学阿布扎比分校人工智能与机器人中心) New York University Abu Dhabi, Electrical Engineering(纽约大学阿布扎比分校电气工程系) Embodied AI and Robotics (AIR) Lab, NYU Abu Dhabi(纽约大学阿布扎比分校具身人工智能与机器人实验室)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出AnyImageNav,通过语义到几何的级联方法实现精确6自由度相机姿态恢复,提升导航成功率和定位精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06693 2026-04-09 cs.CR cs.CY 50%

Aegon: Auditable AI Content Access with Ledger-Bound Tokens and Hardware-Attested Mobile Receipts

Aegon:基于账本绑定令牌和硬件认证移动收据的可审计AI内容访问

Amrish Baskaran, Nirbhay Pherwani, Raghul Krishnan

专题命中 GUI与网页智能体 :AI agent(abstract)

AI总结 Aegon通过扩展JWT令牌并维护证书透明度风格的Merkle树,实现可审计的AI内容许可,提供独立验证的交易记录,支持第三方审计和硬件认证的合规收据。

Comments 9 pages, 5 figures, 5 tables. Protocol design white paper. Submitted to arXiv for priority establishment; prototype implementation and evaluation are planned as future work

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18525 2026-04-09 cs.RO cs.CV 50%

Splatblox: Traversability-Aware Gaussian Splatting for Outdoor Robot Navigation

Splatblox:面向户外机器人导航的可通行性感知高斯点绘制

Samarth Chopra, Jing Liang, Gershom Seneviratne, Yonghan Lee, Jaehoon Choi, Jianyu An, Stephen Cheng, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学帕克分校)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 Splatblox通过融合RGB图像和LiDAR点云,构建了具有几何和语义信息的可通行性感知ESDF,实现户外复杂环境下的实时自主导航,实验表明其在可通行性判断和路径规划方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05317 2026-04-08 quant-ph 50%

Square-root Time Atom Reconfiguration Plan for Lattice-shaped Mobile Tweezers

平方根时间原子重构计划用于晶格形移动镊子

Koki Aoyama, Takafumi Tomita, Fumihiko Ino

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一种可扩展算法,通过并行化原子运输生成二维晶格图案,将运输时间降至O(√N),并利用分治策略和peephole优化技术,实现总运输成本降低至现有算法的1/7,同时提升原子捕获率。

Comments 30 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00621 2026-04-07 cs.GT 50%

Heterogeneous Mean Field Game Framework for LEO Satellite-Assisted V2X Networks

异质均场博弈框架用于低轨卫星辅助V2X网络

Kangkang Sun, Jianhua Li, Xiuzhen Chen, Mingzhe Chen, Minyi Guo

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出异质均场博弈框架,解决大规模车辆混合舰队在严格延迟约束下的协调问题,通过类型选择律和均衡求解器实现高效资源分配,实验验证了其在1D队列状态空间中的最优类型数标度。

Comments 18 pages, 7 figures, has been submitted to IEEE Transactions on Mobile Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17013 2026-04-07 cs.RO 50%

MfNeuPAN: Proactive End-to-End Navigation in Dynamic Environments via Direct Multi-Frame Point Constraints

MfNeuPAN: 通过直接多帧点约束实现动态环境中的前瞻性端到端导航

Yiwen Ying, Hanjing Ye, Senzi Luo, Luyao Liu, Yu Zhan, Li He, Hong Zhang

机构 * Department of Electronic and Electrical Engineering, Southern University of Science and Technology(南方科技大学电子与电气工程系) Shenzhen Key Laboratory of Robotics and Computer Vision(深圳市机器人视觉与感知重点实验室)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出MfNeuPAN框架,通过多帧点约束实现动态环境中的前瞻性端到端导航,提升机器人在未知动态环境中的导航鲁棒性和效率。

Comments 6 pages, 9 figures, accepted at IEEE ROBIO 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03096 2026-04-06 cs.RO 50%

An Open-Source LiDAR and Monocular Off-Road Autonomous Navigation Stack

开源的激光雷达与单目越野自主导航栈

Rémi Marsal, Quentin Picard, Adrien Poiré, Sébastien Kerbourc'h, Thibault Toralba, Clément Yver, Alexandre Chapoutot, David Filliat

机构 * U2IS, ENSTA, Institut Polytechnique de Paris(巴黎综合理工学院,ENSTA,U2IS) AMIAD, Pôle Recherche(AMIAD,研究部) LARIAD, a joint AMIAD-ENSTA laboratory(LARIAD,AMIAD-ENSTA联合实验室)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一个开源的越野导航栈,结合激光雷达和单目3D感知,无需特定任务训练,通过边缘遮蔽和时间平滑提升鲁棒性,实验证明单目深度估计可替代激光雷达。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02277 2026-04-03 physics.comp-ph 50%

Magboltz-GUI: a Python-based graphical user interface for Magboltz

Magboltz-GUI:一种基于Python的图形用户界面用于Magboltz

Michele Renda. Dan Andrei Ciubotaru, Călin Alexa

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本文提出Magboltz-GUI,一种基于Python的图形界面,用于定义气体混合物、配置模拟参数、运行Magboltz并可视化或导出结果,旨在为气体探测器研究和教学提供轻量级前端工具。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01869 2026-04-03 cs.CV 50%

GeoAI Agency Primitives

地理人工智能代理原语

Akram Zaytar, Rohan Sawahn, Caleb Robinson, Gilles Q. Hacheme, Girmaw A. Tadesse, Inbal Becker-Reshef, Rahul Dodhia, Juan Lavista Ferres

机构 * Microsoft AI for Good Lab(微软人工智能公益实验室) NASA Harvest

专题命中 GUI与网页智能体 :agentic(abstract)

AI总结 本文提出9个原语用于地理人工智能代理层,解决GIS实践中迭代协作的缺失问题,通过基准测试提升人类生产力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11672 2026-04-03 cs.DC 50%

OSGym: Scalable OS Infra for Computer Use Agents

OSGym: 用于计算机使用代理的可扩展操作系统基础设施

Zengyi Qin, Jinyuan Chen, Yunze Man, Shengcao Cao, Ziqi Pang, Zhuoyuan Wang, Han Fang, Ling Zhu, Zixin Xie, Zibu Wei, Tianshu Ran, Haoran Geng, Ray Pan, Qizhen Sun, Zachary Bright, Yuyang Cai, Chongye Yang, Jiace Zhao, Tianrui Liu, Han Cao, Yeyang Zhou, Rui Wang, Song Wang, Xiang Ren, Bo Zhang, Yutong Ban, Pieter Abbeel, Brian Anthony

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 OSGym通过分布式状态管理、硬件感知复制调度、KVM虚拟化与容器池等优化,实现高可扩展性和资源效率,支持千级操作系统副本,降低代理训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00343 2026-04-02 cs.RO 50%

Real Time Local Wind Inference for Robust Autonomous Navigation

实时局部风场推断用于稳健自主导航

Spencer Folk

机构 * University of Pennsylvania(宾夕法尼亚大学) NASA Ames Research Center(美国国家航空航天局艾姆斯研究中心)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文通过融合距离测量与稀疏实地风测数据,实现实时风场推断,解决密集城市环境中地形数据的充分性及学习风模型在运动规划中的应用,提升自主导航的能耗效率与避障能力。

Comments PhD Thesis, University of Pennsylvania, 2026. 152 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29364 2026-04-01 eess.SP 50%

Intelligent Forensics in Next-Generation Mobile Networks: Evidence, Methods, and Applications

下一代移动网络中的智能取证:证据、方法与应用

Jiacheng Wang, Weihong Qin, Jialing He, Changyuan Zhao, Dusit Niyato, Tao Xiang

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本文探讨了下一代移动网络中的智能取证,提出以证据为中心的框架,系统化取证流程,并分析了传统方法与AI技术的互补作用,涵盖异常检测、溯源与时间线重建等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04094 2026-03-31 cs.RO 50%

Object-Reconstruction-Aware Whole-body Control of Mobile Manipulators

面向物体重建的移动机械臂整体控制

Fatih Dursun, Bruno Vilhena Adorno, Simon Watson, Wei Pan

机构 * University of Manchester(曼彻斯特大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一种高效方法,通过计算最信息区域的焦点点,使移动机械臂在路径上保持该点在摄像头视野中,从而在不增加路径规划的情况下提升物体重建效率。

Comments 19 pages, 17 figures, 5 tables. Under Review for the IEEE Transactions on Robotics (T-RO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11479 2026-03-31 cs.RO 50%

OVSegDT: Segmenting Transformer for Open-Vocabulary Object Goal Navigation

OVSegDT:用于开放词汇物体目标导航的分割Transformer

Tatiana Zemskova, Aleksei Staroverov, Dmitry Yudin, Aleksandr Panov

机构 * Cognitive AI Systems Lab(认知人工智能系统实验室) MIRAI NUST MISIS(国立研究型技术大学MISIS)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出OVSegDT,一种轻量级Transformer策略,通过语义分支和熵自适应损失调节解决开放词汇物体目标导航中的过拟合和安全问题,提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21798 2026-03-31 eess.SP 50%

Adaptive Multipath-Based SLAM for Distributed MIMO Systems

自适应多径基于的分布式MIMO系统SLAM

Xuhong Li, Benjamin J. B. Deutschmann, Erik Leitinger, Florian Meyer

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出一种基于贝叶斯的多径SLAM方法,用于分布式MIMO系统,解决现有方法在非凸几何环境中融合多径信息的限制,通过自适应检测概率和软射线追踪策略提升定位和建图性能。

Comments 32 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25382 2026-03-27 cs.RO 50%

IntentReact: Guiding Reactive Object-Centric Navigation via Topological Intent

IntentReact: 通过拓扑意图引导以对象为中心的反应式导航

Yanmei Jiao, Anpeng Lu, Wenhan Hu, Rong Xiong, Yue Wang, Huajin Tang, Wen-an Zhang

机构 * School of Information Science and Engineering, Hangzhou Normal University(杭州师范大学信息科学与工程学院) State Key Laboratory of Industrial Control and Technology, Zhejiang University(浙江大学工业控制技术国家重点实验室) Neuromorphic Computing and Robotic Cognition Lab, Zhejiang University(浙江大学神经形态计算与机器人认知实验室) Department of Automation, Zhejiang University of Technology(浙江工业大学自动化系)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出IntentReact框架,通过将全局拓扑指导编码为方向信号来引导机器人以对象为中心的反应式导航,提升导航精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22731 2026-03-25 cs.RO cs.SY eess.SY 50%

Fleet-Level Battery-Health-Aware Scheduling for Autonomous Mobile Robots

车队层面的电池健康意识调度

Jiachen Li, Shihao Li, Jian Chu, Wei Li, Dongmei Chen

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一种多机器人调度方法,考虑电池退化成本,优化任务分配、服务顺序、充电决策和充电模式,平衡车队退化。通过线性化非线性退化项,结合实例数据改进松弛,采用分层启发式方法提升可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10154 2026-03-24 cs.RO 50%

CompassNav: Steering From Path Imitation To Decision Understanding In Navigation

CompassNav: 从路径模仿到决策理解的导航导航

LinFeng Li, Jian Zhao, Yuan Xie, Xin Tan, Xuelong Li

机构 * East China Normal University(东华师范大学) The Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信) Northwestern Polytechnical University(西北工业大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出CompassNav方法,通过引入Compass-Data-22k数据集和gap-aware奖励函数,使导航代理能理解而非单纯模仿路径,实现更高效的导航性能。

Journal ref Proceedings of the 14th International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21269 2026-03-24 cs.RO 50%

DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation

DyGeoVLN: 将动态几何基础模型注入视觉-语言导航

Xiangchen Liu, Hanghan Zheng, Jeil Jeong, Minsung Yoon, Lin Zhao, Zhide Zhong, Haoang Li, Sung-Eui Yoon

机构 * KAIST(韩国科学技术院) HKUST(GZ)(香港科技大学(广州)) JD Explore Academy(JD探索学院)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出DyGeoVLN框架,通过跨分支特征融合将动态几何基础模型注入视觉-语言导航,实现显式3D空间表示和视觉-语义推理,并引入新的无姿态自适应分辨率令牌剪枝策略以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20804 2026-03-24 cs.CV cs.RO 50%

Does Peer Observation Help? Vision-Sharing Collaboration for Vision-Language Navigation

同伴观察有助于吗?面向视觉语言导航的视觉共享协作

Qunchao Jin, Yiliao Song, Qi Wu

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) Adelaide University(阿德莱德大学) Responsible AI Research Centre(负责任人工智能研究中心)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出Co-VLN框架,研究同伴观察对视觉语言导航的影响,通过共享感知记忆扩展接收场,验证了在R2R基准下两种方法中性能的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20625 2026-03-24 cs.NI 50%

Immersive Volumetric Video Playback: Near-RT Resource Allocation and O-RAN-based Implementation

沉浸式体积极限视频回放:近实时资源分配与O-RAN-based实现

Yao Wen, Luping Xiang, Kun Yang

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出基于O-RAN的沉浸式体积极限视频回放框架,通过近实时控制循环联合优化无线电、计算和内容资源,降低运动到光子延迟,提升用户体验。

Comments Accepted to TMC, IEEE Transactions on Mobile Computing. https://doi.org/10.1109/TMC.2026.3674975

Journal ref IEEE Transactions on Mobile Computing (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08935 2026-03-24 cs.RO cs.CV 50%

Expand Your SCOPE: Semantic Cognition over Potential-Based Exploration for Embodied Visual Navigation

拓展你的SCOPE:基于潜在探索的语义认知用于具身视觉导航

Ningnan Wang, Weihuang Chen, Liming Chen, Haoxuan Ji, Zhongyu Guo, Xuchong Zhang, Hongbin Sun

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出SCOPE框架,通过利用前沿信息驱动潜在探索,提升具身视觉导航中的决策质量与目标相关性,实验表明其在准确性和泛化能力上优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17340 2026-03-24 cs.RO cs.SY eess.SY 50%

AERO-MPPI: Anchor-Guided Ensemble Trajectory Optimization for Agile Mapless Drone Navigation

AERO-MPPI:基于锚点的轨迹优化用于无地图无人机敏捷导航

Xin Chen, Rui Huang, Longbin Tang, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出AERO-MPPI框架,通过GPU加速统一感知与规划,利用多分辨率LiDAR点云提取锚点,构建多项式轨迹引导,提升无人机在复杂环境中的敏捷导航能力。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18443 2026-03-20 cs.CV 50%

SR-Nav: Spatial Relationships Matter for Zero-shot Object Goal Navigation

SR-Nav:空间关系对于零样本物体目标导航至关重要

Leyuan Fang, Zan Mao, Zijing Wang, Yinlong Yan

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 SR-Nav通过建模观察和经验的空间关系,提升感知与规划能力,在HM3D实验中实现最先进的成功率和导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12696 2026-03-20 cs.RO cs.CV 50%

HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation

HaltNav: 基于轻量拓扑先验的反应式视觉停止用于鲁棒视觉-语言导航

Zihui Yu, Pingcong Li, Bichi Zhang, Sören Schwertfeger

机构 * SIST, ShanghaiTech University(上海科技大学信息与通信科学核心平台,上海科技大学) Key Laboratory of Intelligent Perception and Human-Machine Collaboration(智能感知与人机协同重点实验室)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出HaltNav框架,结合轻量拓扑先验与局部探索能力,通过反应式视觉停止机制提升视觉-语言导航的鲁棒性,实验表明其在复杂环境下的表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01122 2026-03-20 cs.RO 50%

Fast Confidence-Aware Human Prediction via Hardware-accelerated Bayesian Inference for Safe Robot Navigation

通过硬件加速的贝叶斯推理实现快速置信度感知的人类预测以实现安全的机器人导航

Michael Lu, Minh Bui, Xubo Lyu, Mo Chen

机构 * School of Computing Science, Simon Fraser University(西蒙弗雷泽大学计算科学学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一种基于GPU加速的贝叶斯推理方法,实现高效安全的人类行为预测,支持更精细的轨迹预测,通过实验证明机器人在动态环境中与人类共存的潜力。

Comments Update the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24910 2026-03-19 cs.CV 50%

Learning Goal-Oriented Vision-and-Language Navigation with Self-Improving Demonstrations at Scale

基于大规模自改进演示的目标导向视觉-语言导航学习

Songze Li, Zun Wang, Gengze Zhou, Jialu Li, Xiangyu Zeng, Ziyang Gong, Limin Wang, Yu Qiao, Qi Wu, Mohit Bansal, Yi Wang

机构 * Shanghai AI Laboratory(上海人工智能实验室) UNC Chapel Hill(北卡罗来纳大学教堂山分校) Fudan University(复旦大学) The University of Adelaide(阿德莱德大学) Nanjing University(南京大学) Shanghai Jiaotong University(上海交通大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出SID方法,通过自改进演示提升导航能力,实现高效探索和泛化,显著提升导航性能,达到新状态的SOTA水平。

详情

展开后加载摘要…

URL PDF HTML 收藏