arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-10 至 2026-04-10 共收录 68 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 17 篇

2604.08534 2026-04-10 cs.RO 83%

ActiveGlasses: Learning Manipulation with Active Vision from Ego-centric Human Demonstration

ActiveGlasses: 从第一人称人类示范中学习 manipulation 与 active vision

Yanwen Zou, Chenyang Shi, Wenye Yu, Han Xue, Jun Lv, Ye Pan, Chuan Wen, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix Ltd(Noematrix有限公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 ActiveGlasses 通过主动视觉从第一人称人类示范中学习机器人 manipulation,实现零样本迁移,优于基线方法并在不同机器人平台间泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07395 2026-04-10 cs.RO cs.AI cs.CV 80%

A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring

一种物理代理循环用于语言引导的抓取与执行状态监控

Wenze Wang, Mehdi Hosseinzadeh, Feras Dayoub

机构 * Australian Institute for Machine Learning (AIML), Adelaide University(澳大利亚阿德莱德大学澳大利亚机器学习研究所)

专题命中 机器人操作 :embodied agent(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出一种物理代理循环,通过事件接口和执行监控层提升语言引导抓取的鲁棒性和可解释性,验证了其在视觉模糊和执行失败场景中的有效性。

Comments Project page: https://wenzewwz123.github.io/Agentic-Loop/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08292 2026-04-10 cs.RO 79%

EMMa: End-Effector Stability-Oriented Mobile Manipulation for Tracked Rescue Robots

EMMa:面向履带救援机器人的末端稳定性导向移动操作

Yifei Wang, Hao Zhang, Jidong Huang, Shuohang Fang, Haoyao Chen

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种面向履带救援机器人的移动操作框架,通过协调路径优化模型和紧凑成本/约束表示,提高末端操作的稳定性和任务成功率。

Comments 14 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07457 2026-04-10 cs.RO cs.AI cs.LG 78%

CMP: Robust Whole-Body Tracking for Loco-Manipulation via Competence Manifold Projection

CMP:通过能力流形投影实现鲁棒的全身跟踪以用于移动操纵

Ziyang Cheng, Haoyu Wei, Hang Yin, Xiuwei Xu, Bingyao Yu, Jie Zhou, Jiwen Lu

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出CMP方法,通过能力流形投影提升移动操纵中对抗分布外输入的鲁棒性,实验显示在典型OoD场景中生存率提升达10倍,且跟踪精度损失低于10%。

Comments 14 pages, 8 figures. Under review. Project page and videos: https://shepherd1226.github.io/CMP

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13146 2026-04-10 physics.optics 78%

Scalable Generalized Meta-Spanners Enabling Parallel Multitasking Optical Manipulation

可扩展的通用元跨度结构实现并行多任务光学操控

Tianyue Li, Wenyu Gao, Boyan Fu, Tianhua Shao, Yuchao Fu, Siarhei Zavatski, Jeeban Kumar Nayak, Shaohui Yan, Xiaohao Xu, Shuming Wang, Baoli Yao, Zhenlin Wang, Shining Zhu, Olivier J. F. Martin, C. T. Chan

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文提出通用元跨度结构(GOMS),通过复幅调制生成无透镜可定制光学场,实现纵向可变操控和平面跨度阵列,优于传统环形轨道流,实验验证了其在单粒子动态和粒子群并行操控中的稳定性,展示了超紧凑平台的可扩展性。

Comments 25 pages, 5 figures

Journal ref Science Advances, 12 (15), eaed5302, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18455 2026-04-10 cs.RO 72%

Learning Geometry-Aware Nonprehensile Pushing and Pulling with Dexterous Hands

学习几何感知的非抓取推拉与拉拽技术:灵活手部应用

Yunshuang Li, Yiyang Ling, Gaurav S. Sukhatme, Daniel Seita

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出GD2P方法,通过生成和学习预接触手部姿态实现非抓取推拉,利用接触引导采样和物理模拟生成有效姿态,展示灵活手部在非抓取操作中的应用潜力。

Comments Published at International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08528 2026-04-10 cs.RO 57%

A-SLIP: Acoustic Sensing for Continuous In-hand Slip Estimation

A-SLIP:用于连续手握滑动估计的声学传感

Uksang Yoo, Yuemin Mao, Jean Oh, Jeffrey Ichnowski

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 A-SLIP通过多通道声学传感系统实现手握滑动的实时连续估计,采用压电微声器捕捉接触振动,利用轻量卷积网络处理音频数据,有效提升滑动方向和幅度估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08514 2026-04-10 cs.LG 57%

DiffGradCAM: A Class Activation Map Using the Full Model Decision to Solve Unaddressed Adversarial Attacks

DiffGradCAM:利用完整模型决策解决未处理对抗攻击的类别激活图

Jacob Piland, Chris Sweet, Adam Czajka

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文提出DiffGradCAM及DiffGradCAM++,通过对比方法提升类别激活图的鲁棒性,对抗被动欺骗攻击,验证了其在多类任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02978 2026-04-10 cs.LG 57%

On the Robustness of Tabular Foundation Models: Test-Time Attacks and In-Context Defenses

表格基础模型的鲁棒性:测试时攻击与上下文防御

Mohamed Djilani, Thibault Simonetto, Karim Tit, Florian Tambon, Salah Ghamizi, Maxime Cordy, Mike Papadakis

机构 * Luxembourg Institute of Health(卢森堡健康研究所) SnT / University of Luxembourg(卢森堡大学SnT中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究探讨了表格基础模型在测试时对抗攻击的脆弱性及上下文防御方法,发现微小结构扰动可显著降低预测精度,并提出通过对抗性微调和上下文学习提升鲁棒性。

Comments This work has been accepted for publication at the IEEE Conference on Secure and Trustworthy Machine Learning (SaTML). The final version will be available on IEEE Xplore. To IEEE SaTML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07986 2026-04-10 cs.CV 57%

DP-DeGauss: Dynamic Probabilistic Gaussian Decomposition for Egocentric 4D Scene Reconstruction

DP-DeGauss:动态概率高斯分解用于眼动4D场景重建

Tingxi Chen, Zhengxue Cheng, Houqiang Zhong, Su Wang, Rong Xie, Li Song

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(上海交通大学图像通信与网络工程研究所) Nvidia(英伟达)

专题命中 机器人操作 :embodied AI(abstract);分类 cs.CV

AI总结 本文提出DP-DeGauss方法,通过动态概率高斯分解实现眼动4D场景重建,解决动态第一视角场景重建中的复杂运动、遮挡和手-物体交互问题,实现背景、手部和物体的解耦。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07517 2026-04-10 cs.RO 57%

Grasp as You Dream: Imitating Functional Grasping from Generated Human Demonstrations

抓取如梦:从生成的人类示范中模仿功能抓取

Chao Tang, Jiacheng Xu, Haofei Lu, Bolin Zou, Wenlong Dong, Hong Zhang, Danica Kragic

机构 * Department of Robotics, Perception and Learning, KTH Royal Institute of Technology(KTH皇家理工学院机器人、感知与学习系) Shenzhen Key Laboratory of Robotics and Computer Vision, Southern University of Science and Technology(南方科技大学深圳市机器人视觉与感知重点实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出GraspDreamer方法,利用视觉生成模型合成的人类示范实现零样本功能抓取,通过隐含的通用先验知识和动作优化,提升数据效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08740 2026-04-10 cond-mat.mes-hall 50%

Light-induced pseudo-magnetic fields in three-dimensional topological semimetals

三维拓扑半金属中光诱导的伪磁场

Arpit Raj, Swati Chaudhary, Martin Rodriguez-Vega, Maia G. Vergniory, Roni Ilan, Gregory A. Fiete

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过Floquet工程利用可调线偏振光生成和控制Weyl半金属中的伪磁场,提出设计原理并分析其光学响应。

Comments 16 pages, 13 figures

Journal ref Phys. Rev. B 113, 155117 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07971 2026-04-10 quant-ph 50%

Simultaneous ground-state cooling of six mechanical modes of two levitated nanoparticles

六种机械模式的同时地面态冷却两个悬摆纳米颗粒

Qian Zhang, Yi Xu, Jie-Qiao Liao

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过相干散射机制实现了两个悬摆纳米颗粒六种机械位移模式的同时地面态冷却,展示了耦合结构和冷却机制,并探讨了暗模式对冷却的影响。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07701 2026-04-10 physics.optics 50%

Controllable Chirality Sorting of Particles via Topological Optical Quasiparticles

通过拓扑光学准粒子实现粒子的可控手性分选

Hao Zhang, Xi Xie, Yijie Shen

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出利用聚焦拓扑光学准粒子实现连续粒子分选的新方法,通过调控拓扑电荷实现手性粒子的高效空间分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07619 2026-04-10 physics.optics cond-mat.mes-hall cond-mat.mtrl-sci quant-ph 50%

Hybrid-2D Excitonic Metasurfaces for Complex Amplitude Modulation

混合二维激子元表面用于复杂振幅调制

Tom Hoekstra, Mark L. Brongersma, Jorik van de Groep

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种混合二维激子元表面,实现可见光范围内独立的振幅和相位控制,用于可重构波前整形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06575 2026-04-10 cs.MS cs.SC math.AG math.DG math.OC 50%

Polylab: A MATLAB Toolbox for Multivariate Polynomial Modeling

Polylab:用于多元多项式建模的MATLAB工具箱

Yi-Shuai Niu, Shing-Tung Yau

专题命中 机器人操作 :manipulation(abstract)

AI总结 Polylab是一个用于多元多项式标量和多项式矩阵的MATLAB工具箱,支持CPU和GPU后端的统一符号-数值接口。其核心功能包括多项式构造、代数运算、简化、矩阵运算、微分、雅可比和海森矩阵构造等,版本3.1新增了变量身份和命名处理及自动微分的仿射-正向方向计算。

Comments 21 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28724 2026-04-10 cond-mat.mes-hall cond-mat.mtrl-sci 50%

Robust Floquet-induced gap in irradiated graphite

在受辐照石墨中鲁棒的Floquet诱导间隙

Fei Wang, Xuanxi Cai, Wanying Chen, Jinxi Lu, Tianshuang Sheng, Xiao Tang, Jiansong Li, Hongyun Zhang, Shuyun Zhou

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过强红外泵浦揭示了石墨中鲁棒的Floquet诱导间隙,展示了在层间耦合和光激发存在下,电子态的相干调控与Dirac费米子的相干操控。

Journal ref Chinese Physics Letters 43, 050705 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 17 篇

2604.07957 2026-04-10 cs.AI cs.CV cs.RO 89%

WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models

WorldMAP: 通过生成世界模型提升视觉-语言导航轨迹预测

Hongjin Chen, Shangyun Jiang, Tonghua Su, Chen Gao, Xinlei Chen, Yong Li, Zhibo Chen

机构 * Harbin Institute of Technology(哈尔滨工业大学) Shandong University(山东大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy(中关村学院)

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 WorldMAP通过生成世界模型与教师-学生框架,将生成的未来场景转化为语义空间结构和规划监督,提升导航轨迹预测的稳定性与准确性,取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01563 2026-04-10 cs.RO cs.AI cs.LG 82%

NaviSlim: Adaptive Context-Aware Navigation and Sensing via Dynamic Slimmable Networks

NaviSlim: 通过动态可缩放网络实现自适应的上下文感知导航与感知

Tim Johnsen, Marco Levorato

机构 * University of California, Irvine(加州大学尔湾分校) San Diego State University(圣地亚哥州立大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出NaviSlim模型,通过动态调整计算和感知资源,提升小型自主飞行器在复杂环境中的导航能力,实验显示模型复杂度减少57-92%,传感器利用率提升61-80%。

Comments 13 pages, 12 figures

Journal ref 2024 IEEE/ACM Ninth International Conference on Internet-of-Things Design and Implementation (IoTDI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20549 2026-04-10 cs.CV cs.RO 81%

Deep Learning-Powered Visual SLAM Aimed at Assisting Visually Impaired Navigation

基于深度学习的视觉SLAM:辅助视障导航

Marziyeh Bamdad, Hans-Peter Hutter, Alireza Darvishy

机构 * Institute of Computer Science, ZHAW School of Engineering(苏黎世应用科技大学工程学院计算机科学研究所) Department of Informatics, University of Zurich(苏黎世大学信息学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出SELM-SLAM3框架,结合SuperPoint和LightGlue提升特征提取与匹配鲁棒性,在低纹理、运动模糊等挑战性条件下实现更精确的定位与跟踪,提升视障导航可靠性。

Comments 8 pages, 7 figures, 4 tables. Published in the Proceedings of the 20th International Joint Conference on Computer Vision, Imaging and Computer Graphics Theory and Applications (VISIGRAPP 2025), VISAPP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05351 2026-04-10 cs.RO cs.CV 81%

AnyImageNav: Any-View Geometry for Precise Last-Meter Image-Goal Navigation

AnyImageNav: 任意视角几何用于精确最后一步图像目标导航

Yijie Deng, Shuaihang Yuan, Yi Fang

机构 * NYUAD Center for Artificial Intelligence and Robotics (CAIR)(纽约大学阿布扎比分校人工智能与机器人中心) New York University Abu Dhabi, Electrical Engineering(纽约大学阿布扎比分校电气工程系) Embodied AI and Robotics (AIR) Lab, NYU Abu Dhabi(纽约大学阿布扎比分校具身人工智能与机器人实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出AnyImageNav,通过语义到几何的级联方法实现精确6自由度相机姿态恢复,提升导航成功率和定位精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13086 2026-04-10 cs.RO cs.AI 81%

NaviSplit: Dynamic Multi-Branch Split DNNs for Efficient Distributed Autonomous Navigation

NaviSplit:动态多分支分割DNNs用于高效分布式自主导航

Timothy K Johnsen, Ian Harshbarger, Zixia Xia, Marco Levorato

机构 * University of California Irvine(加利福尼亚大学尔湾分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出NaviSplit框架,通过动态多分支DNN实现高效自主导航,减少数据传输量并提升导航精度。

Comments 6 pages, 3 figures

Journal ref 2024 IEEE 25th International Symposium on a World of Wireless, Mobile and Multimedia Networks (WoWMoM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08443 2026-04-10 cs.RO cs.HC 79%

A Soft Robotic Interface for Chick-Robot Affective Interactions

一种柔软的机器人接口用于鸡-机器人情感互动

Jue Chen, Alexander Mielke, Kaspar Althoefer, Elisabetta Versace

机构 * Queen Mary University of London(伦敦玛丽女王大学) School of Biological and Behavioural Sciences, Queen Mary University of London(伦敦玛丽女王大学生物与行为科学学院)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种以动物为中心的柔软机器人情感接口,用于新生鸡的机器人情感互动研究,通过温度、呼吸样变形和面孔状视觉刺激等安全可控的提示,评估鸡对接口的接受度及与机器人互动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08232 2026-04-10 cs.AI 79%

HiRO-Nav: Hybrid ReasOning Enables Efficient Embodied Navigation

HiRO-Nav:混合推理实现高效具身导航

He Zhao, Yijun Yang, Zichuan Lin, Deheng Ye, Chunyan Miao

机构 * Nanyang Technological University(南洋理工大学) Tencent(腾讯) Independent Researcher(独立研究员)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 HiRO-Nav通过混合推理策略,在导航任务中根据动作熵动态决定是否进行推理,提升决策质量并降低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07973 2026-04-10 cs.AI 79%

How Far Are Large Multimodal Models from Human-Level Spatial Action? A Benchmark for Goal-Oriented Embodied Navigation in Urban Airspace

大型多模态模型距离人类水平的空间行动还有多远?一个面向城市空域目标导向的具身导航基准测试

Baining Zhao, Ziyou Wang, Jianjie Fang, Zile Zhou, Yanggang Xu, Yatai Ji, Jiacheng Xu, Qian Zhang, Weichen Zhang, Chen Gao, Xinlei Chen

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Northeastern University(东北大学) National University of Defense Technology(国防科技大学) Shandong University(山东大学) BNRist, Tsinghua University(清华大学北京信息科学与技术国家研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文通过构建包含5037个高质量目标导向导航样本的数据集,评估17种代表性模型在城市3D空间中具身空间行动的能力,发现尽管LMMs展现出新兴行动能力,但仍远未达到人类水平,并揭示导航误差在关键决策分歧后迅速发散的现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05903 2026-04-10 eess.SP 78%

Optimal Anchor Deployment and Topology Design for Large-Scale AUV Navigation

大规模水下AUV导航的最优锚点部署与拓扑设计

Wei Huang, Junpeng Lu, Tianhe Xu, Jianxu Shu, Hao Zhang, Kaitao Meng, Yanan Wu

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文研究了大规模水下AUV导航中锚点部署拓扑的优化方法,分析了部署模式并推导了锚点对导航性能的影响规律,通过实验验证了优化效果。

Journal ref IEEE Sensors Journal, 01 March 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08032 2026-04-10 cs.AI cs.RO 76%

"Why This Avoidance Maneuver?" Contrastive Explanations in Human-Supervised Maritime Autonomous Navigation

为何这种避让动作?

Joel Jose, Andreas Madsen, Andreas Brandsæter, Tor A. Johansen, Erlend M. Coates

机构 * Department of ICT and Natural Sciences, Norwegian University of Science and Technology (NTNU), Ålesund, Norway(挪威科技大学(NTNU)奥勒松校区信息通信技术与自然科学系) Department of Ocean Operations and Civil Engineering, Norwegian University of Science and Technology (NTNU), Ålesund, Norway(挪威科技大学(NTNU)奥勒松校区海洋运营与土木工程系) Department of Science and Mathematics, Volda University College (HVO), Volda, Norway(沃尔达大学学院(HVO)科学与数学系) Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU), Trondheim, Norway(挪威科技大学(NTNU)特隆赫姆校区工程控制论系)

专题命中 具身导航 :navigation(title);分类 cs.RO、cs.AI

AI总结 本文探讨如何通过对比解释帮助海上导航员理解避让决策,提出生成对比解释的方法,并通过用户研究验证其在复杂多船场景中的有效性及认知负荷影响。

Comments Submitted to IEEE Intelligent Transportation Systems Conference (ITSC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04500 2026-04-10 cs.AI cs.RO 73%

"Don't Do That!": Guiding Embodied Systems through Large Language Model-based Constraint Generation

别这样做!

Amin Seffo, Aladin Djuhera, Masataro Asai, Holger Boche

机构 * Technical University Munich(慕尼黑工业大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出STPR框架,利用LLM将自然语言中的约束转化为可执行Python代码,解决复杂约束的翻译问题,并在仿真环境中验证其高效性和兼容性。

Comments ICLR 2026 Workshop -- Agentic AI in the Wild: From Hallucinations to Reliable Autonomy

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08369 2026-04-10 cs.AI cs.CL cs.MA 57%

Don't Overthink It: Inter-Rollout Action Agreement as a Free Adaptive-Compute Signal for LLM Agents

不要过度思考:跨回合动作一致性作为LLM代理的自由自适应计算信号

Khushal Sethi

机构 * Stanford University(斯坦福大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 TrACE通过测量跨回合动作一致性,实现LLM代理的自适应计算分配,无需训练或外部验证,在多步序列决策任务中提升效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07929 2026-04-10 cs.IR cs.AI 57%

Same Outcomes, Different Journeys: A Trace-Level Framework for Comparing Human and GUI-Agent Behavior in Production Search Systems

相同结果,不同旅程:一种基于轨迹层面的框架,用于比较人类和GUI代理在生产搜索系统中的行为

Maria Movin, Claudia Hauff, Aron Henriksson, Panagiotis Papapetrou

机构 * Spotify, Sweden(Spotify瑞典) Spotify, Netherlands(Spotify荷兰) Stockholm University, Sweden(斯德哥尔摩大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文提出一个基于轨迹的评估框架,比较人类和GUI代理在任务结果、努力、查询构建和界面状态导航中的行为差异,通过实验证明代理行为与人类不同,强调轨迹层面诊断的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏