AutoGLM: Autonomous Foundation Agents for GUIs
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract)
Comments 7 pages, 3 figures, 6 tables
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract)
专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);planning(abstract)
Comments Accepted to the IEEE PERCOM 2023 Workshop on Pervasive Digital Twins
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract)
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Accepted at NeurIPS 2022
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract)
专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);planning(abstract)
Comments Accepted for publication at AI-HRI 2020 (arXiv:2010.13830)
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Chai:加密误用漏洞的智能发现
机构 * UC Berkeley(加州大学伯克利分校)
专题命中 GUI与网页智能体 :agentic(title);分类 cs.AI
AI总结 提出Chai系统,利用AI改进差分测试,从库级缺陷出发沿依赖图传播,发现并验证加密误用漏洞,在X.509、JWT、SAML库中发现超100个漏洞。
InquireMobile: 教授基于VLM的移动代理通过强化微调请求人类帮助
机构 * Future Living Lab, Alibaba Group(未来生活实验室,阿里巴巴集团) ; Alibaba Group Holding Limited(阿里巴巴集团控股有限公司) ; Taobao & Tmall Group of Alibaba(阿里巴巴淘宝与天猫集团)
专题命中 GUI与网页智能体 :agent(title);分类 cs.AI
AI总结 本文提出InquireMobile,通过强化学习方法提升移动代理在关键决策点主动请求人类帮助的能力,实现46.8%的询问成功率提升,成为InquireBench上表现最佳的基线模型。
Comments 15 pages, 10 figures
认知防火墙:通过混合边缘云防御保护基于浏览器的AI代理免受间接提示注入攻击
机构 * eBay Inc(eBay公司)
专题命中 GUI与网页智能体 :AI agent(title);分类 cs.AI
AI总结 本文提出认知防火墙,通过混合边缘云防御机制,有效降低基于浏览器的AI代理遭受间接提示注入攻击的成功率,同时显著提升系统响应效率。
WebWorld: 一个大规模的世界模型用于网络代理训练
机构 * Alibaba Group(阿里巴巴集团) ; Zhejiang University(浙江大学)
专题命中 GUI与网页智能体 :agent(title);分类 cs.AI
AI总结 WebWorld是一个大规模开放网络模拟器,通过大规模训练实现网络代理的有效训练,展示了在多个领域中的泛化能力。
TaskAudit: 通过代理任务执行检测移动应用中的功能性错误
专题命中 GUI与网页智能体 :agentic(title);分类 cs.SE
AI总结 TaskAudit通过代理任务执行检测移动应用中的功能性错误,识别出更多常见的可访问性问题。
Comments CHI 2026
机构 * Show Lab, National University of Singapore(新加坡国立大学展示实验室)
专题命中 GUI与网页智能体 :agent(title);分类 cs.AI
机构 * College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(人工智能学院,南京航空航天大学) ; Hong Kong Baptist University(香港 Baptist 大学) ; SKLCCSE Lab, Beihang University(SKLCCSE 实验室,北京航空航天大学) ; Pengcheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国)
专题命中 GUI与网页智能体 :agent(title);分类 cs.CL
机构 * Lionrock AI Lab(狮岩人工智能实验室) ; China Merchants Research Institute of Advanced Technology(中国商人先进科技研究院)
专题命中 GUI与网页智能体 :agent(title);分类 cs.AI
机构 * University of Notre Dame(诺丁汉大学) ; University of Michigan(密歇根大学) ; Northeastern University(东北大学) ; University of Washington(华盛顿大学) ; Johns Hopkins University(约翰霍普金斯大学)
专题命中 GUI与网页智能体 :agent(title);分类 cs.AI
专题命中 GUI与网页智能体 :agent(title);分类 cs.CL
专题命中 GUI与网页智能体 :agent(title);分类 cs.LG
Comments 20pages,5 figures
专题命中 GUI与网页智能体 :planning(title);分类 cs.AI
Comments 54 pages, 18 figures. This paper has been submitted to Transportation Research Part E: Logistics and Transportation Review (Manuscript Number: TRE-D-23-00202)
专题命中 GUI与网页智能体 :planning(title);分类 cs.LG
专题命中 GUI与网页智能体 :agent(title);分类 cs.LG
CAP:用于评估具备复杂动作与感知能力的跨站点浏览器智能体的可扩展基准
机构 * Macau University of Science and Technology(澳门科技大学) ; Tsinghua University(清华大学) ; Southeast University(东南大学) ; FellouAI ; ARGUS Lab(ARGUS实验室) ; The University of Edinburgh(爱丁堡大学)
专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL
AI总结 研究人员推出可扩展基准CAP,通过分解-重组流程构建420项跨站点网页任务,实验发现当前浏览器智能体在感知密集型交互上存在明显瓶颈,与真实需求差距较大。
Comments Accepted to COLM 2026. Project page: https://warriorxu0302.github.io/CAP-Bench/
JaleesBench:AI助手能否成为良好的精神陪伴?
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL
AI总结 研究人员推出JaleesBench基准测试,评估AI助手的精神陪伴能力,发现简单提示指导可提升通用模型的陪伴表现,领域微调助手的优势来自检索和提示层,还可用于改进现有宗教类AI助手。
Comments 21 pages, 8 figures, 4 tables. Open-source harness, scenario bank, proof texts, and full evaluation (model responses and both judges' verdicts): https://github.com/iaser-ai/jaleesbench . Interactive browser for inspecting scenarios, responses, and judge verdicts: https://s.iaser.ai/jb
Qwen-CUA:面向几乎所有场景的原生计算机使用智能体
机构 * Qwen Team(通义千问团队) ; Xlang Lab(Xlang实验室)
专题命中 GUI与网页智能体 :agent(abstract);tool use(abstract);分类 cs.CL、cs.LG
AI总结 本文提出原生计算机使用智能体Qwen-CUA,采用397B-A17B Qwen混合专家主干,经大规模训练后在多基准测试中性能优于Qwen3.7,为通用能力智能体奠定基础。
Comments 24 pages, 10 figures. Technical report
超越GUI范式:移动代理是否需要手机屏幕?
机构 * Mila – Québec AI Institute(魁北克人工智能研究所) ; Concordia University(康科迪亚大学) ; University of Toronto(多伦多大学) ; McMaster University(麦马斯特大学)
专题命中 GUI与网页智能体 :agent(abstract,abstract_cn);分类 cs.CL、cs.SE
AI总结 本文挑战移动代理的GUI主导范式,提出CLI应同等重要,通过实验证明CLI代理在AndroidWorld和MobileWorld上超越GUI基线,并引入CLI-Advantage任务套件展示其优势。
GTA:大规模生成面向Web智能体的长程任务
机构 * University of Southern California(南加州大学) ; Salesforce AI Research(Salesforce人工智能研究) ; University of California, Davis(加州大学戴维斯分校)
专题命中 GUI与网页智能体 :agent(abstract);tool-use(abstract);分类 cs.AI、cs.CL
AI总结 提出GTA框架,通过集成爬取、检索式种子生成、上下文内生成和自动质量控制,为Web智能体生成带可执行轨迹的真实长程任务,解决现有基准缺乏过程监督和可扩展性问题。
Comments Published at Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics
面向持续游戏生成的GUI智能体
机构 * Fudan University(复旦大学) ; Xiaohongshu Inc.(小红书公司) ; Tongji University(同济大学) ; University of California, Santa Barbara(加州大学圣芭芭拉分校)
专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE
AI总结 提出利用GUI智能体作为客观评估者和主观测试者,通过PlaytestArena和Play2Code框架实现持续游戏生成,显著提升可玩性。
移动众包中用于LLM微调的诚实在线偏好聚合
机构 * Singapore University of Technology and Design(新加坡科技设计大学) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG
AI总结 针对移动众包中工人可能策略性谎报偏好反馈的问题,提出一种动态贝叶斯博弈模型和在线加权聚合机制,确保工人诚实反馈并实现次线性遗憾。