arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 3085 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 494 篇

2608.05109 2026-08-06 eess.IV cs.RO physics.optics 新提交 57%

AI-based single-shot structured-light depth reconstruction for real-time laparoscopic surgical guidance

基于AI的单次结构光深度重建用于实时腹腔镜手术导航

Wayne Wonseok Rodgers, Xiangyi Le, Seonghoon Jang, Shuwen Wei, Justin Opfermann, Michael Kam, Axel Krieger, Jin U. Kang

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究开发了一种基于AI的无同步单次结构光深度重建方法,用于腹腔镜手术导航,其在体模实验中达到了高精度和26.0 Hz的帧率,性能优于基线模型和现成单目深度模型。

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03978 2026-08-05 cs.RO 新提交 57%

Stochastic Multiple Shooting Trajectory Optimization via Sequential Local Policy Evaluation

基于序贯局部策略评估的随机多射击轨迹优化

Ashwin Gupta, Joseph Moore

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种基于序贯局部策略评估的随机多射击轨迹优化方法,通过优化短控制动作序列提升样本效率与终端集收敛性,可用于黑盒动力学的基于模型强化学习,在三类欠驱动任务中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03882 2026-08-05 cs.CL cs.AI cs.IR 新提交 57%

MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning

MultiGlobeQA:面向地理空间推理的多语言且全球多样化基准

Martin Böckling, Elizaveta Nosova, Heiko Paulheim, Andreea Iana

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 MultiGlobeQA是覆盖201个国家地区的多语言地理空间推理基准,含46060个问答对,实验发现LLMs在网格索引等任务上表现差,计算是瓶颈且低收入地区表现差距大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03666 2026-08-05 cs.CV 新提交 57%

XiDepth: a Lightweight and Efficient Network for Self-supervised Monocular Depth Estimation

XiDepth:一种用于自监督单目深度估计的轻量高效网络

Elena Izzo, Riccardo Toniolo, Lamberto Ballan

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 针对自监督单目深度估计模型在嵌入式环境中能耗高、兼容性差的问题,提出基于XiNet算子块的轻量架构XiDepth,在KITTI数据集上仅0.8M参数即达最优性能,树莓派测试显示其FLOPs降40%、能耗降35%。

Comments Accepted to IEEE AVSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02285 2026-08-04 cs.CV 新提交 57%

Sen-Cap: Sensor-Flexible and Noise-Resilient Human Motion Capture via LiDAR-Camera Integration

Sen-Cap:基于激光雷达-相机融合的传感器灵活且抗噪的人体运动捕捉框架

Aoru Xue, Yujing Sun, Yiming Ren, Kwok-Yan Lam, Mao Ye, Yuexin Ma

机构 * ShanghaiTech University(上海科技大学) Digital Trust Centre, Nanyang Technological University(南洋理工大学数字信托中心)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 Sen-Cap是一种无需传感器间校准的激光雷达-相机融合人体运动捕捉框架,通过跨传感器运动估计器与抗噪轨迹跟踪器实现灵活部署与强鲁棒性,在多数据集上达最优性能,适用于真实场景。

Comments 16 pages, 8 figures, 4 tables. Accepted at ECCV 2026. Aoru Xue and Yujing Sun contributed equally. Yuexin Ma is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02191 2026-08-04 cs.CV 新提交 57%

DerainSplat: Feed-Forward Clean 3D Gaussian Splatting from Sparse Rainy Views

DerainSplat:基于稀疏雨天视图的前馈式干净3D高斯溅射重建

Fuzhen Jiang, Changyue Shi, Chuxiao Yang, Xinyuan Hu, Wenjie Ye, Minghao Chen

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 DerainSplat是一种前馈框架,可从少量雨天视图重建干净3D场景,通过四阶段合成数据集与天气网络等设计,在多类数据集上优于现有方法且泛化性强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01562 2026-08-04 cs.RO 新提交 57%

Learning Smooth SE(3) Trajectories under Left-Invariant Riemannian Metrics

左不变黎曼度量下光滑SE(3)轨迹的学习

Yuwei Wu, Vijay Kumar

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 该研究针对SE(3)轨迹生成的计算成本问题,提出基于学习的框架,用神经网络参数化多项式系数与时长,生成的轨迹近似数值优化解且推理达毫秒级,可用于机器人运动原语及四旋翼飞行优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01157 2026-08-04 cs.CV 新提交 57%

InteracVid: Building a Real Interactive Audio-Visual Response Dataset from Live-Chat Videos

InteracVid:基于直播聊天视频构建真实交互式视听响应数据集

Chi Zhang, Haoyang Shi, Yueyi Liu, Zhaokun Yan, Yishu Yin, Yuhang Wu, Miao Liu

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 该研究提出首个开源大规模交互式视听数据集InteracVid,解决现有生成模型监督信号缺失问题,实验证实其可提升多模态助手的交互规划与响应生成性能,为交互式多模态生成提供关键基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01058 2026-08-04 cs.CV 新提交 57%

Extended KAFR: A kinematic-adaptive paradigm for the efficient analysis of surgical video

扩展KAFR:用于手术视频高效分析的运动学自适应范式

Huu Phong Nguyen, Shekhar Madhav Khairnar, Ganesh Sankaranarayanan

机构 * University of Texas Southwestern Medical Center(德克萨斯大学西南医学中心)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本研究验证了运动学自适应帧识别(KAFR)可泛化至腹腔镜手术,其结合YOLO、X3D模型,仅用0.58%的帧就达到91.0%的F1分数,性能优于传统采样且与先进模型相当,大幅降低了手术视频分析的计算负担。

Comments 18

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00633 2026-08-04 cs.HC cs.RO 新提交 57%

bFaaaP: An Inclusive, Head-Angle Piano-Pedal Interaction that Quantitatively Reproduces a Pianist's Intended Pedalling -- Foot-Free, for Acoustic and Electronic Pianos

bFaaaP:一种包容性的免足部钢琴踏板交互系统,可定量复现演奏者的踏板意图——适用于原声钢琴与电子钢琴

Tomoyuki Shishido, Masahiro Ootaki, Hiroyuki Narusawa

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究提出免足部钢琴踏板交互系统bFaaaP,通过头部姿态追踪定量复现演奏者踏板意图,经测试其效果与脚操作无显著差异,已用于公开音乐会并开源软硬件。

Comments 28 pages, 10 figures, 9 tables. Open hardware/software release. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00547 2026-08-04 cs.RO 新提交 57%

Disentangling Visuo-Tactile Foresight: Oracle-Guided Interface Discovery for World Action Models

解耦视觉-触觉前瞻:面向世界动作模型的神谕引导式接口发现

Zihang Yao, Chaoyue Ding, Yingying Yu

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 针对接触丰富的操纵任务中视觉与触觉跨模态接口未被充分探索的问题,提出OVTF框架与AFM模型,在UniVTAC基准7项任务中,AFM平均成功率优于IFM与UniVTAC-ACT。

Comments 6 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00298 2026-08-04 cs.AI 新提交 57%

WM-Cov: Test Adequacy for Interactive World-Model-Style Autonomous Driving Simulation

WM-Cov:交互式世界模型式自动驾驶仿真的测试充分性

Jianxun Cui, Ping Wu, Stanisa Peric, Marko Milojkovic, Vladan Devedzic

机构 * School of Transportation Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学交通科学与工程学院) Chongqing Research Institute of HIT(哈尔滨工业大学重庆研究院) Chongqing Changan Automobile Co., Ltd.(重庆长安汽车股份有限公司) University of Nis(尼什大学) University of Belgrade(贝尔格莱德大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 本文针对交互式世界模型式自动驾驶仿真测试的充分性问题,提出与提供方无关的 WM-Cov 评估层,经多组实验验证其可通过有效交互式证据收敛性更科学地评估测试效果。

Comments 11 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28995 2026-08-03 cs.RO 新提交 57%

Receding-Horizon Next-Best-View Planner for Autonomous Leaf Surface Reconstruction

面向自主叶片表面重建的滚动时域次最佳视点规划器

Arif Ahmed, Sajal K. Das, Parikshit Maini

机构 * University of Nevada, Reno(内华达大学雷诺分校) Missouri University of Science and Technology(密苏里科技大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究针对自主叶片表面重建的规划预算与计算资源限制,提出滚动时域次最佳视点规划器,通过基于质心的信息增益函数优化视点效用,在草莓数据集上使重建精度较基线最高提升10%。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28645 2026-08-03 cs.HC cs.AI 新提交 57%

Looks Right, Works Right: A Project-Level Benchmark for Multi-Screen Mobile App Generation

看起来对,运行起来对:面向多屏移动应用生成的项目级基准测试

Fan Wu, Cuiyun Gao, Yiming Huang, Yang Xiao, Yujia Chen, Qing Liao

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 针对现有设计转代码基准的局限,提出首个项目级多屏移动应用生成基准MobileForge,通过五轴评估及两种测试方法,发现前沿多模态LLM构建的应用存在导航、保真度和可维护性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29225 2026-08-03 cs.LG physics.chem-ph physics.comp-ph 新提交 57%

Frugal Bayesian Optimization: Scalable Surrogates for Data- and Resource-Limited Discovery

节俭型贝叶斯优化:面向数据与资源受限发现的可替代代理模型

Panagiotis Krokidas, Christoforos Rekatsinas, Vassilis Sioros, Grigorios M. Chatziathanasiou, Efi-Maria Papia, George Giannakopoulos

机构 * National Centre for Scientific Research "Demokritos"(希腊德谟克利特国家科学研究中心) University of Patras(帕特雷大学) National and Kapodistrian University of Athens(雅典国立卡波迪斯特里亚大学) Hellenic Mediterranean University(希腊地中海大学) SciFY PNPC

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 针对数据与资源受限的优化场景,该研究通过测试4种代理模型提出感知计算的贝叶斯优化基线FruBO,给出代理推荐框架,为有限预算下的代理选择提供实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27169 2026-07-30 cs.LG 新提交 57%

When Do Learned Diffusion Proposals Help Constraint Solving? A Controlled Study on Continuous Algebraic Systems

学习到的扩散提议何时有助于约束求解?针对连续代数系统的对照研究

Quang Bui, Sparsh Roy, Akash Gundimeda, Davin Yin

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 本研究针对连续代数系统开展对照实验,发现学习到的扩散提议仅在高维、变量未耦合的场景下,才比随机多起点更有助于约束求解,且其优势并非适用于所有真实系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26646 2026-07-30 cs.CV 新提交 57%

Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation

Genie Sim PanoWorld:基于全景场景建模与仿真的无限室内3D世界生成流水线

Yongxin Su, Linjie Hou, Feng Wang, Jialin Tang, Zhijun Li, Qian Wang, Maoqing Yao

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 Genie Sim PanoWorld是两阶段前馈流水线,从单张360°全景生成可自由导航的高保真3D高斯场景,优于几何条件基线,且能零样本泛化至未见室内场景

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26583 2026-07-30 cs.CV 新提交 57%

R-SLPR: Region-based Small-to-Large Point-cloud Registration with Contrastive Learning

R-SLPR:基于区域的小到大点云配准对比学习框架

Yusen Wan, Zeyuan Chen, Qianshi Zou, Xu Chen

机构 * University of Washington(华盛顿大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 针对小到大尺度不匹配的点云配准难题,提出R-SLPR三阶段框架,结合斐波那契网格分割与对比学习,在ModelNet40上实现最优精度,大幅降低位置和旋转MAE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26481 2026-07-30 cs.LG eess.SP 新提交 57%

Conformal Changepoint Localization and Root Cause Analysis with Corrupted Observations

含损坏观测值的保序变点定位与根因分析

Seunghun Yu, Meiyi Zhu, Petar Popovski, Joonhyuk Kang, Osvaldo Simeone

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) King’s College London(伦敦国王学院) Aalborg University(奥尔堡大学) Northeastern University London(伦敦东北大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.LG

AI总结 本文针对含损坏观测值的系统,提出加权CONCH与加权CROC方法,结合元学习优化权重,可在保证置信集目标覆盖率的前提下缩小其规模,提升变点定位与根因分析的实用性。

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26473 2026-07-30 cs.LG cs.CL 新提交 57%

Learning Dynamic User Personas from Implicit Interaction Streams via Iterative Refinement

通过迭代优化从隐式交互流中学习动态用户画像

Haifeng Wu

机构 * PayPal(贝宝)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.LG

AI总结 针对现有个性化LLM依赖显式偏好监督的局限,提出IRIS框架,通过隐式交互流迭代优化用户画像,在Reddit AITA数据上的100位作者测试中,其决策预测准确率达61.0%,优于多种基线方法。

Comments 23 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25918 2026-07-29 cs.RO 新提交 57%

DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models

DC-WAM:用于世界-动作模型的以动态为中心的视觉监督与推理

Haoyuan Ji, Lingxiang Fan, Shang Su, Yinqiao Lu, Mengkai Shi, Jun Gao, Shuo Feng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 研究如何让基于RGB的世界-动作模型从外观主导的重建转向交互诱导的视觉动态,提出DC-WAM框架,通过重新分配监督和计算,结合时间差分流匹配等方法,提升策略性能,尤其在多种分布外扰动下表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25140 2026-07-29 cs.AI cs.CL cs.GR cs.MA 新提交 57%

How Affect Propagates among LLM Agents: Emergent Emotional Contagion in Crowd Simulation

情感如何在大语言模型智能体之间传播:人群模拟中的涌现情感传染

Funda Durupinar

机构 * University of Massachusetts(马萨诸塞大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究多智能体人群模拟中情感传播,通过感知 - 评估 - 表达循环及借鉴相关模型构建架构,在多场景评估,揭示情感传染动态,包括警报扩散、个性影响等,还发现评估步骤动态依赖后端。

Comments 31 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23870 2026-07-28 cs.MA cs.AI 新提交 57%

MulRobBench: A Decision-Level Benchmark for Safe and Security-Policy-Compliant Multimodal UAV Agents

MulRobBench:用于安全且符合安全策略的多模态无人机智能体的决策级基准测试

Belal S. Alsinglawi, Weizheng Wang, Junyi Wu, Yi Jiang, Lianhai Lin, Merouane Debbah, Izzat Alsmadi

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 智慧城市中无人机需在复杂条件下决策,MulRobBench作为决策级基准测试,将多模态观测、安全策略等集成,含多任务样本和评分维度,评估结合多种方式,给出模型得分,通过研究找出决策不稳定原因,为无人机多模态决策提供可重复基准。

Comments 22 pages, 18 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23694 2026-07-28 cs.CV 新提交 57%

Parameter-Efficient Adaptation of SAM3 for Prompt-Driven Surgical Concept Segmentation

用于提示驱动手术概念分割的 SAM3 的参数高效适配

Changjing Liu, Yiming Huang, Beilei Cui, Liangjing Shao, Long Bai, Yanheng Li, Haoxuan Che, Hongliang Ren

机构 * The Chinese University of Hong Kong(香港中文大学) XGEN Labs(XGEN实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 针对手术数据与预训练数据的领域差距及现有方法计算消耗大效率低的问题,提出用低秩适配(LoRA)对 SAM3 进行参数高效适配用于手术概念分割,该方法在单个 GPU 上训练且性能优于主流基线,结果可支持下游手术场景重建和模拟。

Comments Accepted by The 2nd MICCAI Workshop on Efficient Medical AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22832 2026-07-28 cs.LG 新提交 57%

MEMENTO: Memory-Guided Memetic Code-as-Policy Evolution

MEMENTO:内存引导的基于代码的策略进化的模因算法

Alkis Sygkounas, Victor Aregbede, Amy Loutfi, Andreas Persson

机构 * Center for Applied Autonomous Sensor Systems (AASS), Örebro University(应用自主传感器系统中心(AASS),于默奥大学) Örebro University(于默奥大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 研究长期具身任务中基于代码的策略进化问题,提出内存引导单精英模因框架MEMENTO,通过进化展开评估器及利用反馈指标改进策略,在相关领域实验中性能优于基线,还证明了模拟到现实转移的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22030 2026-07-27 cs.RO 新提交 57%

Impedance Control of Ship-Borne Manipulators via Optimization-based Task-Space Inverse Dynamics

基于优化的任务空间逆动力学的舰载机械手阻抗控制

Lingxiao Meng, Bi-Ke Zhu, Xuheng Gao, Zhe Zhang, Jiankun Yang, Jiankun Wang, Haibo Lu, Max Q. -H. Meng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 针对舰载机械手受波浪基座运动影响问题,提出基于扭矩水平优化控制框架,结合任务空间逆动力学和误差状态卡尔曼滤波器,经仿真与实验验证,有效降低跟踪误差,实现动态销孔插入,提升操作成功率并减少接触力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21986 2026-07-27 cs.RO 新提交 57%

Mag4D-SLAM Dataset: A Repeated-Traversal Multi-Modal 4D Geomagnetic Dataset for Localization and Mapping

Mag4D-SLAM数据集:用于定位和映射的重复遍历多模态4D地磁数据集

Bibhutibhusan Nayak, Hyoseok Ju, Giseop Kim

机构 * Department of Robotics and Mechatronics Engineering, DGIST(大邱庆北科学技术院机器人与机电工程系)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 该研究提出Mag4D-SLAM这一首个大规模室外地磁SLAM数据集,含多传感器同步测量与地面真值姿态。通过重复遍历实验分析磁场重复性等特性,支持偏航漂移缓解等研究,还能开启地磁传感补充其他模态及应对特殊情况的新研究。

Comments Accepted to IROS 2026. 8 pages, 8 figures. *Bibhutibhusan Nayak and Hyoseok Ju contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21571 2026-07-24 cs.RO 新提交 57%

Beyond Episodic Evaluation: Memory Architectural Bottlenecks in Sequential Embodied Question Answering

超越情节性评估:序列式具身问答中的内存架构瓶颈

Zikui Cai, Kaushal Janga, Tan Dat Dao, Seungjae Lee, Shivin Dass, Mingyo Seo, Kaiyu Yue, Mintong Kang, Nandhu Pillai, Monte Hoover, Aadi Palnitkar, Ruchit Rawal, Ruijie Zheng, Bo Li, Yuke Zhu, Roberto Martín-Martín, Tom Goldstein, Furong Huang

机构 * University of Maryland, College Park(马里兰大学帕克分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究序列式具身问答中不同内存架构表现,发现仅保留现有记忆不足,短视情节数据训练的智能体有时间不匹配问题。强调结构化、基于空间记忆的必要性,实验表明其能打破准确性-效率权衡,对真实机器人连续智能操作至关重要。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21309 2026-07-24 cs.RO 新提交 57%

Factorized Spatio-Temporal Convolutions for Human Pose Estimation from Planar Lidar

用于基于平面激光雷达的人体姿态估计的分解时空卷积

Simone Arreghini, Mirko Nava, Nicholas Carlotti, Antonio Paolillo, Alessandro Giusti

机构 * Dalle Molle Institute for Artificial Intelligence (IDSIA), USI-SUPSI(瑞士意大利语区大学提契诺大学人工智能达勒莫利研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 针对服务机器人仅配备平面激光雷达和普通处理器的情况,提出基于时空块的轻量级网络,用于全向人体检测和相对2D姿态估计,通过跨模态自监督训练,优于基线模型,适用于计算受限的服务机器人空间感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19243 2026-07-22 cs.CL cs.AI 新提交 57%

Inference-Time Steering for Cross-Lingual Factual Consistency in LLMs

大语言模型中跨语言事实一致性的推理时引导

Alexander Manev

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 研究大语言模型跨语言事实不一致问题,评估零样本上下文引导、CAA、DPO四种干预策略,通过实验发现角色提示是最强干预方式,CAA对配置敏感,DPO适配器收益窄且可转移性低,表明跨语言不一致部分是选择问题,简单干预可能更优。

Comments 8 pages (21 in total), 2 figures, 4 tables. Original manuscript for a Guided Research project conducted at the Technical University of Munich, detailing the complete methodology, full data pipeline, and comprehensive experimental results. A related, condensed subset of this work was subsequently adapted and published at the StereACuLT 2026 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏