arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-11 至 2026-06-11 共收录 93 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2505.03296 2026-06-11 cs.RO cs.AI cs.LG 版本更新 83%

The Unreasonable Effectiveness of Discrete-Time Gaussian Process Mixtures for Robot Policy Learning

离散时间高斯过程混合在机器人策略学习中的惊人有效性

Jan Ole von Hartz, Adrian Röfer, Joschka Boedecker, Abhinav Valada

机构 * Department of Computer Science, University of Freiburg, Germany(弗赖堡大学计算机科学系)

专题命中 机器人学习 :robot policy(title);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG;robotics(comments)

AI总结 提出MiDiGap方法,利用少量演示和相机观测,通过离散时间高斯过程混合实现机器人操作策略的灵活表示与模仿学习,在长时域、高约束、动态和多模态任务上取得SOTA性能,并支持推理时引导。

Comments Submitted for publication to IEEE Transaction on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 29 篇

2606.11396 2026-06-11 cs.RO 新提交 88%

PLUME: Probabilistic Latent Unified World Modeling and Parameter Estimation for Multi-Finger Manipulation

PLUME: 多指操作的概率潜在统一世界建模与参数估计

Abhinav Kumar, Soshi Iba, Rana Soltani Zarrin, Dmitry Berenson

机构 * University of Michigan(密歇根大学) Honda Research Institute USA(本田美国研究所)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 提出PLUME世界模型,联合学习参数信念演化与条件动力学,通过在线参数推断实现零样本迁移,在螺丝刀旋转等任务中优于现有方法。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11372 2026-06-11 cs.RO 新提交 88%

HiPi: Reproducible High-Fidelity Piezoresistive Sensors for Robotic Manipulation

HiPi: 用于机器人操作的可复现高保真压阻传感器

Changyi Lin, Raihan Haque, Hui-Ping Wang, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学) General Motors(通用汽车)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 提出HiPi系统,通过低串扰读出原理和可复现硬件设计,在双机械臂四阵列2048触觉点场景下实现220Hz读出,将接触几何IoU从0.428提升至0.797。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12386 2026-06-11 cs.RO 版本更新 88%

SafeManip: A Property-Driven Benchmark for Temporal Safety Evaluation in Robotic Manipulation

SafeManip: 一种基于属性的基准,用于机器人操作中的时间安全评估

Chengyue Huang, Khang Vo Huynh, Sebastian Elbaum, Zsolt Kira, Lu Feng

机构 * Department of Machine Learning, Georgia Institute of Technology(佐治亚理工学院机器学习系) Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 SafeManip通过定义可重用的安全模板,评估机器人操作中的时间安全属性,涵盖碰撞安全、抓取稳定性等八类安全类别,验证了现有方法在安全评估上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11525 2026-06-11 cs.RO cs.LG 新提交 86%

Learning Object Manipulation from Scratch via Contrastive Interaction

通过对比交互从零开始学习物体操作

Tongle Shen, Caleb Chuck, Fan Feng, Biwei Huang

机构 * UC San Diego(加州大学圣地亚哥分校) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 针对对比强化学习在交互密集操作任务中表现不佳的问题,提出交互加权重采样方法,通过保留模式边界提升多模态分段非线性可达性表示,在仿真和真实机器人空气曲棍球任务中取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11818 2026-06-11 cs.RO 新提交 83%

Human-Guided Co-Manipulation of Carbon Fiber Plies

碳纤维铺层的人机协同操作

Rami Ojanen, James Fant-Male, Roel Pieters

机构 * Automation Technology and Mechanical Engineering, Tampere University(坦佩雷大学自动化技术与机械工程系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 针对柔性材料自动化处理困难的问题,本文提出结合语音指令、视觉腕部跟踪和力/柔顺控制的多模态方法,实现碳纤维铺层的高效人机协同操作。

Comments Accepted to the 35th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20348 2026-06-11 cs.RO cs.AI cs.MA 版本更新 81%

Bimanual Robot Manipulation via Multi-Agent In-Context Learning

通过多智能体上下文学习的双臂机器人操作

Alessio Palma, Indro Spinelli, Vignesh Prasad, Luca Scofano, Yufeng Jin, Georgia Chalvatzaki, Fabio Galasso

机构 * Sapienza University of Rome(罗马萨皮恩扎大学) TU Darmstadt(达姆施塔特技术大学) Hessian.AI(黑森AI)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出BiCICLe框架,将双臂操作建模为多智能体主从问题,通过解耦动作空间实现标准LLM的少样本学习,在TWIN基准上平均成功率70.5%,超越无训练基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09459 2026-06-11 cs.CV cs.AI 版本更新 81%

RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization

RelayFormer: 一种用于可扩展图像和视频篡改定位的统一局部-全局注意力框架

Wen Huang, Jiarui Yang, Tao Dai, Jiawei Li, Shaoxiong Zhan, Bin Wang, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) College of Artificial Intelligence, Nankai University(南开大学人工智能学院) College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI、cs.CV

AI总结 提出RelayFormer统一框架,通过全局局部中继(GLR)令牌和中继注意力机制,适应不同分辨率并统一处理图像与视频,在篡改定位任务中实现高效且性能优越。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12402 2026-06-11 cs.RO cs.AI cs.CV 新提交 80%

DIRECT: When and Where Should You Allocate Test-Time Compute in Embodied Planners?

DIRECT: 在具身规划器中何时何地分配测试时计算?

Jadelynn Dao, Milan Ganai, Yasmina Abukhadra, Ajay Sridhar, Mozhgan Nasr Azadani, Katie Luo, Clark Barrett, Jiajun Wu, Chelsea Finn, Marco Pavone

机构 * Stanford University(斯坦福大学) University of Waterloo(滑铁卢大学) NVIDIA(英伟达)

专题命中 机器人操作 :embodied agent(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出DIRECT路由框架,根据多模态场景上下文按提示分配计算资源,优化成功-成本帕累托前沿,实验表明不同缩放轴带来不同能力增益,在物理机器人上以更低延迟匹配或超越更强模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12028 2026-06-11 cs.RO 新提交 79%

VICX: Generalizable Robot Manipulation via Video Generation and In-Context Operator Network

VICX: 通过视频生成和上下文操作网络实现可泛化的机器人操作

Song Chen, Linyan Xiang, Ying Zhou, Liu Yang

机构 * National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出VICX框架,利用冻结视频生成模型生成视觉计划,并通过视频到轨迹的上下文操作网络(V2T-ICON)将其映射为机器人可执行轨迹,实现跨任务、跨本体泛化。

Comments The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11771 2026-06-11 cs.IT math.IT 新提交 78%

Segment-Wise Soft Robotics Inspired Flexible Antenna Arrays: Design and Optimization

分段式软体机器人柔性天线阵列:设计与优化

Shuaishuai Han, Konstantinos Ntougias, Elio Faddoul, Ioannis Krikidis

专题命中 机器人操作 :robotics(title);robotic(abstract)

AI总结 提出分段式软体机器人天线系统,通过独立控制分段运动实现天线位置重构,并设计两种部署方案及优化算法,显著提升和速率。

Comments Summitted to IEEE transaction journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05476 2026-06-11 quant-ph 78%

A three-dimensional multimode lumped-element resonator for collective spin manipulation and dispersive readout

一种三维多模式集中元件谐振器用于集体自旋操控和色散读取

Zhuo Chen, Wenhua Qin, Hanyu Ren, Ziyi Liu, Kae Nemoto, William John Munro, Yingqiu Mao, Johannes Majer

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文提出一种三维多模式微波谐振器,实现宏观自旋集体操控与色散读取,通过几何对称性设计两个抗对称模式,以不同频率耦合至同一自旋集合,展示强耦合与非破坏性色散读取。

Journal ref Appl. Phys. Lett. 128, 224001 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12217 2026-06-11 cs.CV cs.AI cs.RO 新提交 75%

Making Foresight Actionable: Repurposing Representation Alignment in World Action Models

使远见可操作:在世界动作模型中重新利用表示对齐

Lu Qiu, Yizhuo Li, Yi Chen, Yuying Ge, Yixiao Ge, Xihui Liu

机构 * The University of Hong Kong(香港大学) XPENG Robotics(小鹏机器人)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 针对世界动作模型中视觉预测与动作提取不匹配的问题,提出AGRA方法,通过对齐视频扩散特征与语义表示,提升动作解码器对任务相关区域的关注,从而改善操作任务的性能与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12048 2026-06-11 cs.RO 新提交 74%

Point Cloud Segmentation for Autonomous Clip Positioning in Laparoscopic Cholecystectomy on a Phantom

用于腹腔镜胆囊切除术中自动夹子定位的点云分割(在体模上)

Balázs Gyenes, Nikolai Franke, Paul Maria Scheikl, Pit Henrich, Rayan Younis, Gerhard Neumann, Martin Wagner, Franziska Mathis-Ullrich

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) HIDSS4Health - Helmholtz Information and Data Science School for Health(亥姆霍兹信息与数据科学健康学校) Friedrich-Alexander-University, Erlangen-Nuremberg(弗里德里希-亚历山大大学埃尔朗根-纽伦堡) University Hospital Carl Gustav Carus and Centre for Tactile Internet with Human-in-the-loop (CeTI), Dresden University of Technology(卡尔·古斯塔夫·卡鲁斯大学医院及德累斯顿工业大学触觉互联网人机共融卓越中心)

专题命中 机器人操作 :robotics(abstract,comments);robotic(abstract);分类 cs.RO

AI总结 提出首个在腹腔镜手术体模上实现自主夹子定位的机器人系统,通过点云分割和样条插值提取目标位置,利用合成数据预训练和两种数据增强克服数据稀缺,达到0.75mm精度和100%成功率。

Comments 8 pages, 5 figures, accepted to IEEE Robotics and Automation Letters (RAL)

Journal ref IEEE Robotics and Automation Letters (Volume: 10, Issue: 8, August 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11628 2026-06-11 cs.RO cs.AI 新提交 73%

LUCID: Learning Embodiment-Agnostic Intent Models from Unstructured Human Videos for Scalable Dexterous Robot Skill Acquisition

LUCID:从非结构化人类视频学习与具身无关的意图模型以实现可扩展的灵巧机器人技能获取

Harsh Gupta, Guanya Shi, Wenzhen Yuan

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人操作 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 提出LUCID两阶段框架,从互联网规模的非结构化人类视频学习任务意图,并在大规模并行仿真中学习机器人控制,实现零样本迁移到不同具身和场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11982 2026-06-11 cs.LG 新提交 70%

PAWS: Preference Learning with Advantage-Weighted Segments

PAWS: 基于优势加权片段的首选学习

Aleksandar Taranovic, Onur Celik, Niklas Freymuth, Ge Li, Serge Thilges, Huy Le, Tai Hoang, Rania Rayyes, Gerhard Neumann

机构 * University of Freiburg(弗莱堡大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.LG

AI总结 针对偏好强化学习中训练与推理分布不匹配导致时间信用分配退化的问题,提出PAWS方法,利用片段级优势函数直接进行策略更新,在机器人操作和运动任务上优于现有方法。

Comments Published as a conference paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12261 2026-06-11 cs.LG cs.AI cs.CV 版本更新 67%

The Latent Color Subspace: Emergent Order in High-Dimensional Chaos

潜在颜色子空间:高维混沌中的涌现秩序

Mateusz Pach, Jessica Bader, Quentin Bouniot, Serge Belongie, Zeynep Akata

机构 * University of California, Berkeley(加州大学伯克利分校) University of Toronto(多伦多大学) University of Cambridge(剑桥大学) University of Oxford(牛津大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文揭示了FLUX.1变分自编码器潜在空间中颜色表示的HSL结构,并提出一种无需训练的闭式潜在空间操作方法,实现对生成图像颜色的预测与显式控制。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12200 2026-06-11 cs.LG cs.AI 新提交 62%

Implicit Neural Representations of Individual Behavior

个体行为的隐式神经表示

Andrew Kang, Priya Narasimhan

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 提出Behavioral INR模型,用隐式神经表示从无标签多策略行为数据中学习策略表示,通过FiLM层调节策略函数,实现无监督策略识别,在连续状态-动作空间中提升策略可识别性。

Comments ICML 2026, Structured Probabilistic Inference & Generative Modeling Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11826 2026-06-11 cs.RO 新提交 57%

Modular Anthropomorphic Hand Design via Multi-Parameter Finger Benchmarking and Selection

模块化拟人手设计:基于多参数手指基准测试与选择

Yu Zhang, Huijiang Wang, Josie Hughes

机构 * The CREATE Lab, Institute of Mechanical Engineering, Swiss Federal Institute of Technology in Lausanne (EPFL)(瑞士洛桑联邦理工学院机械工程研究所CREATE实验室)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 提出一种模块化拟人手设计框架,通过多参数基准测试优化手指设计,实现整手性能提升,并在多物体抓取和灯泡旋拧任务中验证有效性。

Comments 14 pages, 13 figures. Submitted to an IEEE journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11446 2026-06-11 cs.CV cs.GR 新提交 57%

3D-CBM: A Framework for Concept-Based Interpretability in Generative 3D Modeling

3D-CBM:生成式3D建模中基于概念可解释性的框架

Ahmad Al-Kabbany

机构 * Yubree Labs Multimedia Interaction and Communication Lab, Arab Academy for Science and Technology(阿拉伯科学技术学院多媒体交互与通信实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出将概念瓶颈模型(CBM)融入3D生成架构,通过多层级可解释原语和功能属性映射,实现语义可操控的3D生成,实验验证了高概念预测精度和交互式纠错能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10040 2026-06-11 cs.RO 版本更新 57%

Efficient-WAM: A 1B-Parameter World-Action Model with Low-Cost Future Imagination

Efficient-WAM: 一种具有低成本未来想象能力的10亿参数世界-动作模型

Jiajun Li, Tiecheng Guo, Yifan Ye, Rongyu Zhang, Xiaowei Chi, Qianpu Sun, Ying Li, Yunfan Lou, Yan Huang, Zhihe Lu, Meng Guo, Shanghang Zhang

机构 * The University of Hong Kong(香港大学) Peking University(北京大学) Muka Robotics(Muka机器人) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出Efficient-WAM,通过紧凑视频专家、稀疏视频潜变量和非对称去噪降低未来想象成本,在保持控制性能的同时实现30倍推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06827 2026-06-11 cs.RO 版本更新 57%

DynaRetarget: Dynamically-Feasible Retargeting using Sampling-Based Trajectory Optimization

DynaRetarget: 基于采样的轨迹优化的动态可行重定向

Victor Dhedin, Ilyass Taouil, Shafeef Omar, Dian Yu, Kun Tao, Angela Dai, Majid Khadiv

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出DynaRetarget框架,通过采样轨迹优化将人体运动重定向为人形机器人控制策略,实现长时域动态可行运动,在数百个演示中取得更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13854 2026-06-11 cs.LO cs.AI cs.SC 版本更新 57%

Power Term Polynomial Algebra for Boolean Logic

布尔逻辑的幂项多项式代数

Emanuele Sansone, Armando Solar-Lezama

机构 * CSAIL, MIT(MIT计算机科学与人工智能实验室) ESAT, KU Leuven(比利时鲁文大学ESAT研究所) KU Leuven(鲁文大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出幂项多项式代数,一种介于CNF和ANF之间的布尔公式表示语言,通过幂项和多项式直接编码CNF子句与单项式族,避免辅助变量和约束,支持代数运算与重写规则。

Comments Pragmatics of SAT

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06547 2026-06-11 cs.CR cs.AI cs.CL cs.ET 版本更新 57%

"Do Not Mention This to the User": Detecting and Understanding Malicious Agent Skills in the Wild

“不要向用户提及此事”:检测与理解恶意代理技能

Yi Liu, Zhihao Chen, Yanjun Zhang, Gelei Deng, Yuekang Li, Jianting Ning, Leo Yu Zhang

机构 * Griffith University(格里菲斯大学) Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学) Zhejiang Key Laboratory of Digital Fashion and Data Governance, Zhejiang Sci-Tech University(浙江数字时尚与数据治理重点实验室,浙江科技大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文通过对两个主要注册中心的98,380个技能进行系统安全分析,结合静态模式匹配和动态行为验证,识别出157个恶意技能,揭示了13种攻击技术中的632个不同漏洞,并发现攻击复杂性与隐藏投入相关。

Comments Accepted to the 35th USENIX Security Symposium (USENIX Security 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10743 2026-06-11 cs.LG 版本更新 57%

Kalman Linear Attention: Parallel Bayesian Filtering For Efficient Language Modelling and State Tracking

Kalman线性注意力:用于高效语言建模和状态跟踪的并行贝叶斯滤波

Vaisakh Shaj, Cameron Barker, Aidan Scannell, Andras Szecsenyi, Elliot J. Crowley, Amos Storkey

机构 * University of Cambridge(剑桥大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 提出Kalman线性注意力层,将序列混合重写为信息形式的精确贝叶斯滤波,实现时间并行推理,在相同计算成本下比GLA更具表达力,并在状态跟踪任务中超越线性SSM和注意力。

Comments Accepted at ICML 2026. An earlier version of this work was presented at the 1st Workshop on Epistemic Intelligence in Machine Learning (EIML) at EurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11588 2026-06-11 eess.SP 新提交 50%

Antenna Coding and Digital Precoding for Limited Feedback MIMO Systems Using Pixel Antennas

基于像素天线的有限反馈MIMO系统的天线编码与数字预编码

Zhetong Li, Hongyu Li

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对像素天线带来的信道状态信息获取开销问题,提出基于码本和索引反馈的有限反馈MIMO系统,联合设计天线编码器和数字预编码器,并开发低复杂度离线码本构建算法,性能优于传统固定配置天线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12122 2026-06-11 cond-mat.mtrl-sci 新提交 50%

All-electric picosecond field-free spin-orbit torque switching in magnetic trilayers

磁性三层结构中的全电皮秒无场自旋轨道矩翻转

Xinhou Chen, Shishun Zhao, Yuchen Pu, Qu Yang, Hyunsoo Yang

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过全电片上纳等离子体脉冲发生器实现6.4皮秒脉冲,在磁性三层结构中实现超快无场自旋轨道矩翻转,写入能量降低2-3个数量级,为高速低功耗SOT-MRAM提供新方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11370 2026-06-11 cond-mat.mtrl-sci 新提交 50%

Reconfigurable Strain Gradient Polarity in Crystalline Oxide Nanomembranes for Controlled Bending of Functional Materials

可重构应变梯度极性在晶态氧化物纳米膜中用于功能材料的受控弯曲

Tiffany C. Wang, Minyong Han, Varun Harbola, Harold Y. Hwang

专题命中 机器人操作 :manipulation(abstract)

AI总结 利用单晶锰矿纳米膜制备可切换双稳态纳米鼓,通过控制应变梯度极性实现0.01%至1%的应变变化,为氧化物膜应用提供机械框架。

Journal ref ACS Appl. Nano Mater. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11454 2026-06-11 cs.DB cs.PL 版本更新 50%

Foundations of the GraphAlg Language

GraphAlg语言基础

Daan de Graaf, Robert Brijder, Nikolay Yakovets

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文展示图算法领域特定语言GraphAlg如何建立在矩阵操作形式语言MATLANG之上,通过扩展和语法糖实现,并证明任何GraphAlg程序可在支持同时归纳的for-MATLANG扩展中模拟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00560 2026-06-11 cs.SD eess.AS 版本更新 50%

Edit Content, Preserve Acoustics: Imperceptible Text-Based Speech Editing via Self-Consistency Rewards

编辑内容,保留声学:基于自一致性奖励的不可感知文本语音编辑

Yong Ren, Jiangyan Yi, Jianhua Tao, Tao Wang, Le Xu, Zhengqi Wen

机构 * The State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Department of Automation, Tsinghua University(清华大学自动化系) BNRist, Tsinghua University(清华大学BNRist)

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出一种在稳定语义空间中编辑内容、通过流匹配解码器保持声学连续性的框架,并利用自一致性奖励组相对策略优化实现不可感知的文本语音编辑。

Comments Accepted by Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏