arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 460 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 460 篇

2605.10913 2026-06-25 cs.AI cs.PL cs.SE 版本更新 57%

Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces

Shepherd: 一个为元代理提供形式化执行迹的运行时基座

Simon Yu, Derek Chong, Ananjan Nandi, Dilara Soylu, Jiuding Sun, Christopher D Manning, Weiyan Shi

机构 * Northeastern University(东北大学) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出Shepherd,一个基于函数式编程的Python运行时基座,将代理执行作为一等对象,通过类似Git的执行迹支持元代理的检查、分叉和重放,在三个用例中显著提升性能。

Comments 50 pages, 22 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00804 2026-06-25 cs.CR cs.AI cs.DB 版本更新 57%

Epistemic Bias Injection: Manipulating LLM Opinion via Selective Context Retrieval

认知偏见注入:通过选择性上下文检索操纵LLM观点

Hao Wu, Prateek Saxena

机构 * National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究通过检索增强生成(RAG)数据库注入事实正确但认知偏见的段落,以操纵LLM输出立场,并提出基于几何度量的攻击与防御方法BiasDef。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04109 2026-06-25 cs.HC cs.AI 版本更新 57%

Tinker Tales: A Tangible Dialogue System for Child-AI Co-Creative Storytelling

Tinker Tales:一个用于儿童与AI共同创意故事讲述的有形对话系统

Nayoung Choi, Jiseung Hong, Peace Cyebukayire, Ikseon Choi, Jinho D. Choi

机构 * Department of Computer Science, Emory University(埃默里大学计算机科学系) Department of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) School of Nursing, Emory University(埃默里大学护理学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出Tinker Tales有形对话系统,通过结合物理故事板、NFC玩具和移动应用,支持儿童与AI在四个叙事阶段进行协作故事创作,并发现提示框架影响儿童叙事贡献的形式和一致性。

Comments Accepted to SIGDIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04560 2026-06-24 cs.RO 版本更新 57%

From Local Corrections to Generalized Skills: Improving Neuro-Symbolic Policies with MEMO

从局部修正到通用技能:利用MEMO改进神经符号策略

Benjamin A. Christie, Yinlong Dai, Mohammad Bararjanianbahnamiri, Simon Stepputtis, Dylan P. Losey

机构 * Collab Dept. of Mechanical Engineering, Virginia Tech, Blacksburg, USA.(机械工程系,弗吉尼亚理工学院,黑斯堡,美国) TEA Lab(TEA实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对机器人神经符号策略中技能不足的问题,提出MEMO框架,通过收集、聚类和改写多用户自然语言修正,构建检索增强的技能手册,动态扩展技能库,实现新任务泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00271 2026-06-19 cs.RO 版本更新 57%

Learn from What We HAVE: History-Aware VErifier that Reasons about Past Interactions Online

从我们所拥有的学习:在线推理过去交互的历史感知验证器

Yishu Li, Xinyi Mao, Ying Yuan, Kyutae Sim, Ben Eisner, David Held

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出历史感知验证器HAVE,通过解耦动作生成与验证,利用历史交互在线消除歧义,理论证明其提升期望动作质量,在多个模拟和真实环境中验证有效性。

Comments CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05925 2026-06-18 cs.RO 版本更新 57%

DexSynRefine: Synthesizing and Refining Human-Object Interaction Motion for Physically Feasible Dexterous Robot Actions

DexSynRefine:合成与精炼人-物交互运动以实现物理可行的灵巧机器人动作

Hyesung Lee, Hyunwoo Jung, Si-Hwan Heo, Sungwook Yang

机构 * Korea Institute of Science and Technology(韩国科学技术院) KAIST(韩国科学技术院) Hanyang University(翰阳大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出DexSynRefine框架,通过HOI-MMFP运动先验合成手-物轨迹,结合任务空间残差强化学习和接触动力学适应,将人-物交互数据转化为物理可行的灵巧操作,在五个任务上成功率提升50-70个百分点。

Comments Project page: https://dexsynrefine.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02874 2026-06-18 cs.RO 版本更新 57%

Steering Flexible Linear Objects in Planar Environments by Two Robot Hands Using Euler's Elastica Solutions

使用欧拉弹性线解在两机器人手在平面环境中操控柔性线性物体

Aharon Levin, Elon Rimon, Amir Shapiro

机构 * Dept. of ME, Technion, Israel(技术学院机械工程系,以色列) Dept. of ME, Ben-Gurion University, Israel(本· Gurion大学机械工程系,以色列)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文利用欧拉弹性线解,通过控制两机器人手的抓取端点位置和切线,实现平面环境中柔性线性物体的无自交、稳定和避障操控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03177 2026-06-17 cs.RO 版本更新 57%

ConTrack: Constrained Hand Motion Tracking with Adaptive Trade-off Control

ConTrack: 具有自适应权衡控制的约束手部运动跟踪

Yutong Liang, Quanquan Peng, Ri-Zhao Qiu, Xiaolong Wang

机构 * University of California San Diego(加州大学圣地亚哥分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出一种基于强化学习的框架ConTrack,通过将物体跟踪视为约束并利用双变量更新自适应调整任务-风格权衡,同时结合自适应中轨迹重置库,实现长时域、接触密集的手部运动跟踪,在仿真和真实机器人上显著提升成功率和物体位姿精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06257 2026-06-17 cs.LG cs.GT 版本更新 57%

On Randomized Algorithms in Online Strategic Classification

关于在线策略分类中的随机化算法

Chase Hutton, Adam Melrod, Han Shao

机构 * University of Maryland(马里兰大学) Harvard University(哈佛大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究在线策略分类中随机化算法的优势,在可实现和不可知场景下分别给出基于Littlestone维度和操纵图最大度的改进界限,并证明随机化可突破确定性算法的下界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18003 2026-06-17 cs.CR cs.AI cs.CY 版本更新 57%

BadScientist: Can a Research Agent Write Convincing but Unsound Papers that Fool LLM Reviewers?

BadScientist: 研究代理能否写出令人信服但不严谨的论文来欺骗LLM审稿人?

Fengqing Jiang, Yichen Feng, Yuetai Li, Luyao Niu, Basel Alomair, Radha Poovendran

机构 * University of Washington(华盛顿大学) King Abdulaziz City for Science and Technology(卡布斯科学与技术城) HUMAIN

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出BadScientist框架,通过无需真实实验的呈现操纵策略生成造假论文,揭示LLM审稿系统存在系统性漏洞,造假论文接受率高达一定水平,且审稿人存在“担忧-接受冲突”,当前检测方法效果有限。

Comments ACL 2026; Project Page at https://bad-scientist.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00885 2026-06-16 cs.CV 版本更新 57%

HanDyVQA: A Video QA Benchmark for Fine-Grained Hand-Object Interaction Dynamics

HanDyVQA:面向细粒度手-物交互动态的视频问答基准

Masatoshi Tateno, Gido Kato, Hirokatsu Kataoka, Yoichi Sato, Takuma Yagi

机构 * Institute of Industrial Science, The University of Tokyo(东京大学工业科学研究所) National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院) Waseda University(早稻田大学) Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出HanDyVQA基准,通过六类问题(11.1K QA对)和10.3K分割掩码,全面评估视频模型对手-物交互中操作与效果的细粒度时空推理能力,发现最佳模型Gemini-2.5-Pro仅73%准确率(人类97%)。

Comments CVPR 2026, Project page: https://masatate.github.io/HanDyVQA-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08774 2026-06-16 q-bio.BM cs.LG 版本更新 57%

Generative Molecular Design with Steerable and Granular Synthesizability Control

具有可引导和粒度合成性控制的生成式分子设计

Jeff Guo, Víctor Sabanza-Gil, Olha Semenenko, Oleksii Hrabovskyi, Mykola Protopopov, Anna Kapeliukha, Oleksandr Mosia, Sofiia Hatych, Diana Alieksieieva, Tom Nelis, Patrick Molliet, Helena Solé-Àvila, Valentas Olikauskas, Nina Aregger, Irina Morozova, Joseph Schmidt, Zlatko Jončev, Olga Tarkhanova, Petro Borysko, Jerome Waser, Bruno Correia, Jeremy Luterbacher, Philippe Schwaller

机构 * Laboratory of Artificial Chemical Intelligence (LIAC)(人工化学智能实验室) NCCR Catalysis(催化联合研究所) Laboratory of Sustainable and Catalytic Processing (LPDC)(可持续与催化加工实验室) CHEMSPACE LLC Enamine Ltd.(Enamine有限公司) Taras Shevchenko National University of Kyiv(基塔斯·谢甫琴科基辅国立大学) V. P. Kukhar Institute of Bioorganic Chemistry and Petrochemistry(V. P. Kukhar生物有机化学与石油化学研究所) Palladin Institute of Biochemistry(Palladin生物化学研究所) Laboratory of Catalysis and Organic Synthesis (LCSO)(催化与有机合成实验室) Laboratory of Protein Design and Immunoengineering (LPDI)(蛋白质设计与免疫工程实验室)

专题命中 机器人操作 :navigation(abstract);分类 cs.LG

AI总结 提出统一合成约束分子设计与超大规模虚拟筛选的生成框架,通过可引导和粒度合成性控制,生成满足多参数优化目标且具有预测合成路径的分子,在BRD4和Wee1靶点上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23336 2026-06-15 cs.IR cs.CL cs.LG 版本更新 57%

Efficient Rationale-based Retrieval: On-policy Distillation from Generative Rerankers based on JEPA

高效基于理由的检索:基于JEPA的生成重排序器的在线蒸馏

Teng Chen, Sheng Xu, Feixiang Guo, Xiaoyu Wang, Qingqing Gu, Hongyan Li, Luo Ji

机构 * Geely AI Lab(吉利人工智能实验室)

专题命中 机器人操作 :robotic(abstract);分类 cs.LG

AI总结 本文提出Rabtriever,通过在线蒸馏从生成重排序器中学习,将查询和文档独立编码,提升检索效率,同时在多个任务中表现优异。

Comments 11 pages, 8 figures. ICMR 2026 (https://youtu.be/apDcrzEVwq4)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19115 2026-06-15 cs.CV 版本更新 57%

FBSDiff++: Improved Frequency Band Substitution of Diffusion Features for Efficient and Highly Controllable Text-Driven Image-to-Image Translation

FBSDiff++: 改进的扩散特征频带替换用于高效且高度可控的文本驱动图像到图像翻译

Xiang Gao, Yunpeng Jia

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出FBSDiff++框架,通过动态频带替换扩散特征,实现无需训练的文本驱动图像到图像翻译,支持外观、布局和轮廓引导,并大幅提升推理速度(8.9倍),支持任意分辨率输入和局部编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00167 2026-06-12 cs.RO 版本更新 57%

EgoMoD: Predicting Global Maps of Dynamics from Local Egocentric Observations

EgoMoD:从局部自我中心观测预测全局动态地图

Iacopo Catalano, David Morilla-Cabello, Jorge Pena-Queralta, Eduardo Montijano

机构 * University of Turku, Finland(芬兰图尔库大学) Centre for Artificial Intelligence, Zürich University of Applied Sciences, Winterthur, Switzerland(瑞士应用科学大学人工智能中心) Instituto de Investigación en Ingeniería de Aragón, Universidad de Zaragoza, Spain(西班牙阿拉贡工程研究所,萨拉戈萨大学)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO

AI总结 提出EgoMoD方法,利用短时自我中心视频和位姿条件架构,学习从局部观测预测全局运动动态地图,替代传统全局感知基础设施,实现零样本迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10040 2026-06-11 cs.RO 版本更新 57%

Efficient-WAM: A 1B-Parameter World-Action Model with Low-Cost Future Imagination

Efficient-WAM: 一种具有低成本未来想象能力的10亿参数世界-动作模型

Jiajun Li, Tiecheng Guo, Yifan Ye, Rongyu Zhang, Xiaowei Chi, Qianpu Sun, Ying Li, Yunfan Lou, Yan Huang, Zhihe Lu, Meng Guo, Shanghang Zhang

机构 * The University of Hong Kong(香港大学) Peking University(北京大学) Muka Robotics(Muka机器人) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出Efficient-WAM,通过紧凑视频专家、稀疏视频潜变量和非对称去噪降低未来想象成本,在保持控制性能的同时实现30倍推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06827 2026-06-11 cs.RO 版本更新 57%

DynaRetarget: Dynamically-Feasible Retargeting using Sampling-Based Trajectory Optimization

DynaRetarget: 基于采样的轨迹优化的动态可行重定向

Victor Dhedin, Ilyass Taouil, Shafeef Omar, Dian Yu, Kun Tao, Angela Dai, Majid Khadiv

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出DynaRetarget框架,通过采样轨迹优化将人体运动重定向为人形机器人控制策略,实现长时域动态可行运动,在数百个演示中取得更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13854 2026-06-11 cs.LO cs.AI cs.SC 版本更新 57%

Power Term Polynomial Algebra for Boolean Logic

布尔逻辑的幂项多项式代数

Emanuele Sansone, Armando Solar-Lezama

机构 * CSAIL, MIT(MIT计算机科学与人工智能实验室) ESAT, KU Leuven(比利时鲁文大学ESAT研究所) KU Leuven(鲁文大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出幂项多项式代数,一种介于CNF和ANF之间的布尔公式表示语言,通过幂项和多项式直接编码CNF子句与单项式族,避免辅助变量和约束,支持代数运算与重写规则。

Comments Pragmatics of SAT

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06547 2026-06-11 cs.CR cs.AI cs.CL cs.ET 版本更新 57%

"Do Not Mention This to the User": Detecting and Understanding Malicious Agent Skills in the Wild

“不要向用户提及此事”:检测与理解恶意代理技能

Yi Liu, Zhihao Chen, Yanjun Zhang, Gelei Deng, Yuekang Li, Jianting Ning, Leo Yu Zhang

机构 * Griffith University(格里菲斯大学) Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学) Zhejiang Key Laboratory of Digital Fashion and Data Governance, Zhejiang Sci-Tech University(浙江数字时尚与数据治理重点实验室,浙江科技大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文通过对两个主要注册中心的98,380个技能进行系统安全分析,结合静态模式匹配和动态行为验证,识别出157个恶意技能,揭示了13种攻击技术中的632个不同漏洞,并发现攻击复杂性与隐藏投入相关。

Comments Accepted to the 35th USENIX Security Symposium (USENIX Security 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10743 2026-06-11 cs.LG 版本更新 57%

Kalman Linear Attention: Parallel Bayesian Filtering For Efficient Language Modelling and State Tracking

Kalman线性注意力:用于高效语言建模和状态跟踪的并行贝叶斯滤波

Vaisakh Shaj, Cameron Barker, Aidan Scannell, Andras Szecsenyi, Elliot J. Crowley, Amos Storkey

机构 * University of Cambridge(剑桥大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 提出Kalman线性注意力层,将序列混合重写为信息形式的精确贝叶斯滤波,实现时间并行推理,在相同计算成本下比GLA更具表达力,并在状态跟踪任务中超越线性SSM和注意力。

Comments Accepted at ICML 2026. An earlier version of this work was presented at the 1st Workshop on Epistemic Intelligence in Machine Learning (EIML) at EurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09203 2026-06-10 cs.RO 版本更新 57%

Deterministic Execution of ROS 2 Applications via Lingua Franca

通过Lingua Franca实现ROS 2应用的确定性执行

Harun Teper, Shaokai Lin, Shulu Li, Edward A. Lee, Jian-Jia Chen

机构 * TU Dortmund University(多特蒙德工业大学) University of California, Berkeley(加州大学伯克利分校) RWTH Aachen University(亚琛工业大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 提出框架将未修改的ROS 2应用转换为Lingua Franca程序,利用逻辑时间实现确定性执行,解决ROS 2中回调执行顺序和消息交织的非确定性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06323 2026-06-10 cs.RO 版本更新 57%

VOLT: Vision and Language Trajectory Segmentation for Faster-than-Demonstration Policies

VOLT: 面向超演示速度策略的视觉与语言轨迹分割

Robert Ramirez Sanchez, Daniel J. Evans, Dylan P. Losey, Siddarth Jain

机构 * Collab , Dept. of Mechanical Engineering, Virginia Tech, Blacksburg, VA 24061(机械工程系,弗吉尼亚理工学院,布莱克斯堡,VA 24061) Mitsubishi Electric Research Laboratories ( MERL ), Cambridge, MA 02139(三菱电机研究实验室(MERL),剑桥,MA 02139)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出VOLT方法,通过视觉与语言线索对演示轨迹进行分割,选择性下采样安全加速部分,保留需要精细操作的慢速段,从而训练出比演示更快的机器人策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00745 2026-06-10 cs.CL cs.AI cs.GT cs.IR econ.TH 版本更新 57%

Dynamics of Adversarial Attacks on Large Language Model-Based Search Engines

基于大型语言模型的搜索引擎对抗攻击动力学

Xiyang Hu

机构 * Arizona State University(亚利桑那州立大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文将排名操纵攻击建模为无限重复囚徒困境,分析合作维持条件,发现降低攻击成功率可能反而激励攻击,防御措施在某些情况下无效。

Comments New Frontiers in Game-Theoretic Learning Workshop, International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.03018 2026-06-10 cs.RO cs.SY eess.SY 版本更新 57%

RAPTOR: Rapid Aerial Pickup and Transport of Objects by Robots

RAPTOR: 机器人快速空中抓取与运输物体

Aurel Appius, Erik Bauer, Marc Blöchlinger, Aashi Kalra, Robin Oberson, Arman Raayatsanati, Pascal Strauch, Sarath Suresh, Marco von Salis, Robert K. Katzschmann

机构 * Soft Robotics Lab, ETH Zurich, Switzerland(软机器人实验室,苏黎世联邦理工学院,瑞士)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出一种结合软材料Fin Ray夹爪和Fast DDS中间件的四旋翼平台RAPTOR,实现高速飞行中对不同几何形状物体的灵活抓取,平均抓取成功率83%,有效载荷达先前工作的四倍。

Comments 7 pages, 10 figures, accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2022. Video: https://youtu.be/KHkBlBABsC8 Project page: https://srl-ethz.github.io/RAPTOR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06497 2026-06-09 cs.GR cs.CV cs.HC 版本更新 57%

Real-Time AttentionBender: Granular Interactive Network Bending of Video Diffusion Transformers

实时注意力弯曲:视频扩散变换器的粒度交互式网络弯曲

Adam Cole, Rebecca Fiebrink, Mick Grierson

机构 * Creative Computing Institute(创意计算研究所) University of the Arts London(伦敦艺术大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出实时注意力弯曲工具,通过操纵视频扩散变换器的自注意力、交叉注意力及前馈网络,实现逐层、逐步、逐令牌的交互式生成控制,增强艺术家的创作代理与模型材料亲密性。

Comments 5 pages, 4 figures. Accepted to ACM Creativity & Cognition XAIxArts Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08304 2026-06-09 cs.CR cs.AI 版本更新 57%

Securing Retrieval-Augmented Generation: A Taxonomy of Attacks, Defenses, and Future Directions

保障检索增强生成:攻击、防御与未来方向的分类法

Yuming Xu, Mingtao Zhang, Zhuohan Ge, Haoyang Li, Nicole Hu, Yongqi Zhang, Zhiyuan Wen, Jason Chen Zhang, Qing Li, Lei Chen

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出SLOT分类法,从攻击面、防御层、目标(遵循CIA属性)和攻击目标四个维度系统化梳理检索增强生成(RAG)的安全风险与防御,并指出知识访问管道中的结构性错配,最后展望未来方向。

Comments We have curated a paper list on RAG security in https://github.com/TreeAI-Lab/Awesome-RAG-Security, and we warmly welcome authors who wish to have their new work included to contact us via email

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17245 2026-06-09 cs.AI 版本更新 57%

Web Agents Should Use Typed Actions Instead of Click-Based Browsing

Web 智能体应使用类型化动作而非基于点击的浏览

Linxi Jiang, Rui Xi, Zhijie Liu, Shuo Chen, Zhiqiang Lin, Suman Nath

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出通过语义层支持的类型化动作(web verbs)替代低层交互原语,以构建可靠、可审计的Web智能体,并通过案例展示其优势。

Comments Accepted to the ICML 2026 Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03256 2026-06-09 cs.CV 版本更新 57%

Muses: Designing, Composing, Generating Nonexistent Fantasy 3D Creatures without Training

Muses: 无需训练的设计、组合与生成不存在的幻想3D生物

Hexiao Lu, Xiaokun Sun, Zeyu Cai, Hao Guo, Ying Tai, Jian Yang, Zhenyu Zhang

机构 * Nanjing University(南京大学) China Agricultural University(中国农业大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出Muses,首个无需训练的馈送式幻想3D生物生成方法,利用3D骨架实现结构感知的设计、组合与生成,在视觉保真度和文本对齐方面达到最优。

Comments Project page: https://luhexiao.github.io/Muses.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10758 2026-07-08 cs.CR 版本更新 56%

Agents at Risk: How Users Unwittingly Undermine LLM Safety

处于风险中的智能体:用户如何在不知情的情况下破坏大语言模型的安全性

Fengchao Chen, Tingmin Wu, Van Nguyen, Surya. Nepal, Carsten Rudolph

专题命中 机器人操作 :manipulation(abstract,comments)

AI总结 研究基于大语言模型的智能体安全问题,介绍用户中继上下文操纵攻击,通过让良性用户在请求中传递对抗性内容,实验表明该攻击在多种防御下优于提示注入基线,揭示当前智能体框架设计缺陷。

Comments User-relayed Context Manipulation; LLM-based Agents; Agent Security; Human Factors in Cybersecurity; Web-Use Agents; Planning Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00030 2026-08-17 physics.gen-ph 版本更新 50%

Building an analogue simulator of a photonic quantum computer with transparent tape, maple syrup, and cat lasers, and implementing first quantum algorithms in the classroom

用透明胶带、枫糖浆和猫激光器构建光量子计算机的模拟器,并在课堂上实现首个量子算法

Ghislain Lefebvre

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文利用透明胶带、枫糖浆和猫激光器构建光量子计算机模拟器,实现单量子比特门和双量子比特门,并在课堂上演示首个量子算法,成本低且易于操作。

Comments 29 pages, 43 figures

详情

展开后加载摘要…

URL PDF HTML 收藏