arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2955 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 2955 篇

2608.13606 2026-08-17 cs.AI cs.CL cs.LG cs.MA cs.MM 新提交 67%

MobileMem: Learning from a Year of Mobile Experiences

MobileMem:从一年的移动体验中学习

Xinle Deng, Yida Xue, Xiangyuan Ru, Haoming Xu, Shuofei Qiao, Mengru Wang, Yijun Chen, Buqiang Xu, Chen Jiang, Yuchen Eleanor Jiang, Lizhong Wang, Jianfeng Wang, Li Zeng, Haofen Wang, Guilin Qi, Huajun Chen, Ningyu Zhang

机构 * OPPO OpenKG

专题命中 GUI与网页智能体 :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究推出MobileMem基准与框架,基于一年移动体验构建,用于设备端长期记忆研究,支持多类推理,推动智能体从信息检索向体验智能发展。

Comments Technical Report; Project Page: this http URL (http://mobilemem.openkg.cn/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04425 2026-08-11 cs.CL cs.AI cs.CV cs.LG cs.MM 版本更新 67%

UI-MOPD: Multi-Platform On-Policy Distillation for Unified GUI Agents

UI-MOPD:用于持续GUI智能体学习的多平台策略蒸馏

Niu Lian, Tongbo Chen, Zhehao Yu, Chengzhen Duan, Fazhan Liu, Hui Liu, Pei Fu, Jian Luan, Heng Qu, Shu-Tao Xia, Jinpeng Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Xiaomi(小米) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Zhejiang University(浙江大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对构建多平台GUI智能体的挑战,构建高质量数据集Uni-GUI,提出UI-MOPD方法,通过多教师策略蒸馏实现持续学习,动态选教师并转移行为先验,实验证明其能平衡跨平台能力保留与新平台适应。

Comments Technical report. 27 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26148 2026-08-04 cs.RO 版本更新 67%

Embodied Agents Take Control: Minimal-Interface Zero-Shot Agents Rival Industrial-Scale Policies in Vision-and-Language Navigation

具身智能体自主掌控:最小接口零样本智能体在视觉语言导航中可媲美工业级策略

Jian Zhou, Xunyi Zhao, Gengze Zhou, Zerui Li, Sihao Lin, Jiajun Liu, Qi Wu

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) Adelaide University(阿德莱德大学) Responsible AI Research Centre(负责任人工智能研究中心) CSIRO Data61(联邦科学与工业研究组织数据61中心) The University of Queensland(昆士兰大学)

专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract)

AI总结 本研究提出智能具身控制,以零样本导航为测试平台,评估三种智能体框架,发现最小接口下部分框架可媲美工业级策略,同时揭示模型、框架与接口对具身智能体的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14548 2026-07-17 cs.CV 新提交 67%

HyMobileAgent: Data-Environment Co-Scaling for Efficient GUI Agents

HyMobileAgent:用于高效GUI代理的数据-环境协同扩展

Hy Vision Team, Huawen Shen, Zhengyang Tang, Shangpin Peng, Liang Wu, Anran Zhang, Weinong Wang, Yiduo Guo, Chenxin Li, Zhengyao Fang, Yang Ding, Junyi Li, Fei Tang, Zheng Ruan, Yi Zhang, Xingran Zhou, Dingchen Yang, Sunqi Fan, Zhiyi Wan, Han Hu, Xin Lai, Pengyuan Lyu, Chengquan Zhang

机构 * PhoneWorld Mock App Factory(手机世界模拟应用工厂)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 研究移动GUI代理在数字环境中的运行,基于Hy3.0-VL-A3B构建HyMobileAgent,开发数据和环境协同扩展框架,集成多种机制和管道,提出渐进式训练方法,解决移动交互关键瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00333 2026-07-15 cs.CR 版本更新 67%

(A)I Sees What You Don't: Exploiting New Attack Surfaces in Third-Party Mobile Agents

(AI)看见你看不见的:利用第三方移动代理中的新攻击面

Zidong Zhang, Zhentao Xie, Wenrui Diao, Jianliang Wu

专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文识别了第三方移动代理在屏幕感知和通道滥用方面的两种新攻击面,并设计了七种具体攻击,证明恶意应用可在无权限下劫持代理行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01830 2026-07-14 cs.RO 版本更新 67%

What Matters in RL-Based Methods for Object-Goal Navigation? An Empirical Study and A Unified Framework

基于强化学习的目标导航方法中什么重要?实证研究与统一框架

Hongze Wang, Boyang Sun, Jiaxu Xing, Fan Yang, Marco Hutter, Dhruv Shah, Davide Scaramuzza, Marc Pollefeys

机构 * Computer Vision and Geometry Group, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机视觉与几何组) Robotics and Perception Group, University of Zurich, Switzerland(苏黎世大学机器人与感知组) Robotic Systems Lab, ETH Zurich, Switzerland(苏黎世联邦理工学院机器人系统实验室) Princeton Robotic Intelligence and SysteMs group, Princeton University, USA(普林斯顿大学机器人智能与系统组) Microsoft, Switzerland(微软公司)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 研究目标导航中基于强化学习方法各组件影响,通过分解导航管道为感知、策略和测试时增强三组件进行实证研究,引入统一框架,构建增强系统达领先性能,提供见解与建议,凸显当前智能体与人类导航差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31612 2026-07-03 cs.CV 新提交 67%

What Memory Do GUI Agents Really Need? From Passive Records to Active Task-Driving States

GUI代理真正需要什么样的记忆?从被动记录到主动任务驱动状态

Chen Liu, Ling Chen, Hanzhang Zhou, Xu Zhang, Quyu Kong, Panrong Tong, Wenhao Wang, Xin Yu, Steven Hoi, Yue Wang

机构 * Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) University of Technology Sydney(悉尼科技大学) Adelaide University(阿德莱德大学)

专题命中 GUI与网页智能体 :agent(abstract);workflow(abstract)

AI总结 提出主动任务驱动记忆(ATMem),将GUI代理的记忆从被动存储转变为主动维护的执行状态,并引入STR-GRPO强化学习方法,通过对比记忆开启和关闭的轨迹来选择性使用记忆,以提升长周期任务执行的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25760 2026-06-25 cs.LG cs.AI cs.CL cs.CV 新提交 67%

Uncertainty Quantification for Computer-Use Agents: A Benchmark across Vision-Language Models and GUI Grounding Datasets

计算机使用代理的不确定性量化:跨视觉语言模型和GUI基础数据集的基准测试

Divake Kumar, Sina Tayebati, Devashri Naik, Amanda Sofie Rios, Nilesh Ahuja, Omesh Tickoo, Ranganath Krishnan, Amit Ranjan Trivedi

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Intel Labs(英特尔实验室) Capital One AI Labs(Capital One AI实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出跨机制基准Argus,评估27种后验不确定性量化方法在4个VLM代理和4个数据集上的表现,发现UQ排名在固定模型内跨数据集稳定,但跨模型类别和接口时下降,隐藏状态和密度方法最稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02031 2026-06-05 cs.LG cs.AI cs.CL cs.CV 67%

OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents

OpenWebRL: 揭秘视觉网络代理的在线多轮强化学习

Rui Yang, Qianhui Wu, Yuxi Chen, Hao Bai, Wenlin Yao, Hao Cheng, Baolin Peng, Huan Zhang, Tong Zhang, Jianfeng Gao

机构 * UIUC(伊利诺伊大学香槟分校) Microsoft(微软)

专题命中 GUI与网页智能体 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出OpenWebRL框架,通过在线多轮强化学习在真实网站上训练视觉网络代理,以4B参数模型在基准测试中达到开源最优,并与闭源系统竞争。

Comments 36 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.02459 2026-06-04 eess.SY cs.RO cs.SY 67%

Fault Tolerant Control for Networked Mobile Robots

网络化移动机器人故障容错控制

Pietro Pierpaoli, Dominique Sauter, Magnus Egerstedt

专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出了一种两阶段技术,用于网络化移动机器人中偏置测量代理的识别与补偿,通过单个观测者代理部署的故障识别滤波器估计网络中的单个故障,并在检测到故障后启动最优领导者基于的补偿策略。

Comments 7 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.08692 2026-06-04 eess.SY cs.SY 67%

Robust Decentralized Abstractions for Multiple Mobile Manipulators

多移动机械臂的鲁棒去中心化抽象

Christos K. Verginis, Dimos V. Dimarogonas

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出去中心化控制器,使移动机械臂在预定区域导航,同时保证多代理间碰撞避免和连接性维护。通过将耦合多代理系统抽象为多个有限状态转移系统,应用于基于时序逻辑的高层计划。

Comments Accepted for publication in the IEEE Conference on Decision and Control, Melbourne, Australia, 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.00793 2026-06-04 eess.SY cs.MA cs.SY 67%

3D Mobile Localization Using Distance-only Measurements

使用仅距离测量的3D移动定位

Bomin Jiang, Brian D. O. Anderson, Hatem Hman

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究了在3D空间中,仅利用噪声距离测量实现无人机群体定位的问题,提出基于半正定规划的算法并结合梯度下降进行最大似然估计,通过实验验证了算法的有效性。

Comments Submitted to IEEE Transactions on Aerospace and Electronic Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
1604.07849 2026-06-04 cs.RO cs.SY eess.SY math.OC 67%

Distributed rotational and translational maneuvering of rigid formations and their applications

分布式刚体编队的旋转和翻译 maneuvering 及其应用

Hector Garcia de Marina, Bayu Jayawardhana, Ming Cao

专题命中 GUI与网页智能体 :agent(abstract,abstract_cn)

AI总结 本文提出一种分布式控制器,通过引入距离约束参数实现编队与运动控制,允许恒定集体翻译、旋转或组合,同时保证编队形状无畸变,应用于编队对齐和目标追踪。

Comments 14 pages

Journal ref Robotics, IEEE Transactions on, Volume 32, Issue 3, Pages 684 - 696, Year 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1607.02632 2026-06-04 cs.RO cs.SY eess.SY 67%

Decentralized, Self-organizing, Potential field-based Control for Individuallymotivated, Mobile Agents in a Cluttered Environment: A Vector-Harmonic Potential Field Approach

去中心化、自组织、基于势场的控制方法用于在复杂环境中具有个体动机的移动智能体:一种向量谐波势场方法

Ahmad A. Masoud

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种去中心化、自组织的势场控制方法,用于复杂环境中多个智能体的协同运动控制,通过向量谐波势场方法实现低计算成本和自适应性。

Journal ref IEEE Transactions on Systems, Man, and Cybernetics - Part A: Systems and Humans, May 2007, Volume:37, Issue: 3, pp. 372-390

详情

展开后加载摘要…

URL PDF HTML 收藏
1606.01638 2026-06-04 eess.SY cs.SY 67%

Distance-based Control of K4 Formation with Almost Global Convergence

基于距离的K4形形成控制与近全局收敛

Myoung-Chul Park, Zhiyong Sun, Minh Hoang Trinh, Brian D. O. Anderson, Hyo-Sung Ahn

专题命中 GUI与网页智能体 :agent(abstract,abstract_cn)

AI总结 本文提出基于距离的K4形控制策略,通过改进梯度控制律实现近全局收敛,利用四面体形成性质确保二维空间中四代理达到期望形成形状。

Comments 6 pages, submitted to CDC 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1503.04473 2026-06-04 cs.DM cs.CR cs.SY eess.SY 67%

Guarding Networks Through Heterogeneous Mobile Guards

通过异质移动守卫守护网络

Waseem Abbas, Sajal Bhatia, Xenofon Koutsoukos

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究如何利用异质移动守卫应对多代理系统中的连续入侵攻击,提出将网络分解为集群并分配合适范围的守卫以实现永恒安全。

Comments American Control Conference, Chicago, IL, 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03951 2026-06-03 cs.CV 67%

Demo2Tutorial: From Human Experience to Multimodal Software Tutorials

Demo2Tutorial:从人类经验到多模态软件教程

Zechen Bai, Zhiheng Chen, Yiqi Lin, Kevin Qinghong Lin, Difei Gao, Xiangwu Guo, Xin Wang, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 提出Demo2Tutorial框架,通过屏幕录制和交互日志将人类经验解析为结构化多模态教程,用于人类学习和GUI智能体训练,实验证明其生成质量超越人工教程并提升任务效率。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01993 2026-06-02 cs.CL cs.AI cs.LG 67%

MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?

MMG2Skill: 智能体能否从野外指南中提炼出自我进化的技能?

Xinyu Che, Junqi Xiong, Yunfei Ge, Xinping Lei, Shihao Li, Hang Yan, Han Li, Yuanxing Zhang, Zhiqi Bai, Jinhua Hao, Ming Sun, Han Li, Jiaheng Liu

机构 * Nanjing University(南京大学) Kuaishou Technology(快手科技)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出MMG2Skill框架,将多模态异构的野外指南编译为可编辑技能,通过轨迹级根因反馈持续改进,在GUI控制、开放游戏和策略卡牌任务中显著提升VLM智能体性能。

Comments 35 pages, 12 figures, 13 tables. Code: https://github.com/NJU-LINK/MMG2Skill

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12724 2026-06-02 cs.RO 67%

TRANS: Terrain-aware Reinforcement Learning for Agile Navigation of Quadruped Robots under Social Interactions

TRANS:面向社交互动下四足机器人敏捷导航的地形感知强化学习

Wei Zhu, Irfan Tito Kurniawan, Ye Zhao, Mitsuhiro Hayashibe

机构 * Department of Robotics, Graduate School of Engineering, Tohoku University(东邦大学机器人学系) Laboratory for Intelligent Decision and Autonomous Robots, Woodruff School of Mechanical Engineering, Georgia Institute of Technology(佐治亚理工学院智能决策与自主机器人实验室)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 提出一个名为TRANS的两阶段深度强化学习框架,通过三个DRL流水线(TRANS-Loco、TRANS-Nav和统一TRANS)实现四足机器人在非结构化地形上的社交导航,克服了传统方法中运动规划与运动控制分离、缺乏地形感知以及假设静态环境等局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24761 2026-05-26 cs.CV cs.RO 67%

Drift-Resistant Navigation World Model with Anchored Epipolar Guidance

抗漂移导航世界模型与锚定对极引导

Po-Chien Luan, Zimin Xia, Wuyang Li, Yang Gao, Alexandre Alahi

机构 * EPFL(瑞士联邦理工学院)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 提出一种抗漂移导航世界模型,通过锚定引导滚动和双向对极几何约束,同时减轻感知漂移和几何漂移,提升长期视觉质量、几何一致性和多视图连贯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16784 2026-05-19 cs.MA 67%

Dynamic Deployment of Mobile Charging Trucks During Natural Disaster Evacuation: An Offline-to-Online Framework

自然灾害疏散期间移动充电车的动态部署:一种离线到在线框架

Rui Ma, Zilin Bian, Kaan Ozbay

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种离线到在线框架,用于在自然灾害疏散期间动态部署移动充电车,以缓解固定充电站过载问题,通过风险感知的分配和动态路由策略减少风险暴露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23299 2026-04-28 cs.HC cs.MA 67%

Proteus: Shapeshifting Desktop Visualizations for Mobile via Multi-level Intelligent Adaptation

Proteus:通过多级智能适应实现移动端的桌面可视化变形

Can Liu, Sizhe Cheng, Feng Liang, Zhibang Jiang, Lingru Huang, Kavinda Athapaththu, Yong Wang

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 Proteus通过多级智能适应技术,自动将桌面可视化转换为移动端可读的可视化,解决移动端屏幕尺寸和交互方式差异导致的显示问题。

Comments accepted by ACM Designing Interactive Systems Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17190 2026-04-21 cs.CV 67%

LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation

LookasideVLN: 基于方向的空中视觉与语言导航

Yuwei Ning, Ganlong Zhao, Yipeng Qin, Si Liu, Yang Liu, Liang Lin, Guanbin Li

机构 * Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) The Chinese University of Hong Kong(香港中文大学) Centre for Perceptual and Interactive Intelligence(感知与交互智能中心) Cardiff University(卡迪夫大学) Beihang University(北航) Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 本文提出LookasideVLN,通过利用自然语言中的方向线索提升空中视觉与语言导航的准确性和效率,采用方向感知图、空间地标知识库和方向MLLM导航代理三种核心组件。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16298 2026-04-20 cs.CV cs.RO 67%

FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation

FineCog-Nav:整合细粒度认知模块以实现零样本多模态无人机导航

Dian Shao, Zhengzheng Xu, Peiyang Wang, Like Liu, Yule Wang, Jieqi Shi, Jing Huo

机构 * Northwestern Polytechnical University(西北工业大学) Nanjing University(南京大学)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 本文提出FineCog-Nav框架,通过细粒度认知模块提升无人机零样本多模态导航性能,构建了AerialVLN-Fine基准测试集,实验表明其在指令遵循、长视距规划和环境泛化方面优于基线方法。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07267 2026-04-15 cs.RO 67%

Bio-Inspired Topological Autonomous Navigation with Active Inference in Robotics

生物启发的拓扑自主导航与主动推断在机器人中的应用

Daria de Tinguy, Tim Verbelen, Emilio Gamba, Bart Dhoedt

机构 * Ghent University(根特大学) Verses Flanders Make(佛兰德斯制造)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 本文提出一种基于主动推断框架的生物启发代理,实现环境拓扑地图的实时生成与更新,通过概率推理框架实现可解释的导航,并在动态和未知环境中表现出鲁棒适应性。

Comments Conference ICCAS 2025 - accepted (in processing)

Journal ref Communications in Computer and Information Science, vol 2857, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11784 2026-04-14 cs.LG cs.AI cs.CL cs.CV 67%

ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents

ClawGUI:一个用于训练、评估和部署GUI代理的统一框架

Fei Tang, Zhiqiong Lu, Boxuan Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 ClawGUI通过统一框架解决GUI代理训练、评估和部署中的三大缺口,提供标准化评估流程和跨平台部署能力,实现移动端GUI任务的成功率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07705 2026-04-10 cs.RO 67%

Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models

面向大语言模型时代的空中机器人视觉-语言导航

Xingyu Xia, Lekai Zhou, Yujie Tang, Xiaozhou Zhu, Hai Zhu, Wen Yao

机构 * Defense Innovation Institute, Chinese Academy of Military Sciences(军事科学院国防创新研究院) Intelligent Game and Decision Laboratory(智能博弈与决策实验室) Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院)

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文综述了空中机器人视觉-语言导航领域,分析了大语言模型与视觉-语言模型的整合,归纳了五类架构方法,指出了评估体系的不足,并提出了七个开放性问题。

Comments 28 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24895 2026-04-08 cs.HC 67%

PII Shield: A Browser-Level Overlay for User-Controlled Personal Identifiable Information (PII) Management in AI Interactions

PII Shield:一种浏览器层面的叠加层,用于在AI交互中实现用户控制的个人可识别信息(PII)管理

Max Holschneider, Saetbyeol LeeYouk

专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出PII Shield,通过企业级红actions管道,为用户提供直观的免费AI交互隐私保护体验,引入本地实体匿名化和干扰第三方分析的'烟雾'机制,以平衡用户数据使用与隐私保护。

Comments Accepted at the Proceedings of the CHI 2026 Workshop: Ethics at the Front-End

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21861 2026-04-08 cs.NI cs.MA cs.SY eess.SY 67%

Spatiotemporal Continual Learning for Mobile Edge UAV Networks: Mitigating Catastrophic Forgetting

空间时间连续学习用于移动边缘UAV网络:缓解灾难性遗忘

Chuan-Chi Lai

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出STCL框架,通过G-MAPPO算法结合GDPO机制和梯度正交化层,平衡异质目标,提升UAV网络在动态环境中的服务可靠性与性能。

Comments 13 pages, 4 figures, 2 tables, manuscript submitted to IEEE journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01659 2026-04-03 cs.RO 67%

AURA: Multimodal Shared Autonomy for Real-World Urban Navigation

AURA:多模态共享自主控制用于真实世界城市导航

Yukai Ma, Honglin He, Selina Song, Wayne Wu, Bolei Zhou

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Zhejiang University(浙江大学)

专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract)

AI总结 AURA通过将城市导航分解为高层人类指令和低层AI控制,减少人工操作负担,提升导航稳定性,并在真实世界中实现44%的接管减少。

Comments 17 pages, 18 figures, 4 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏