arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-06-16 至 2026-06-16 共收录 12
2606.16876 2026-06-16 cs.RO 新提交

ExoTraj: A General Lower-limb Exoskeleton Assistance Policy for Complex Environments

ExoTraj:面向复杂环境的通用下肢外骨骼辅助策略

Xiao-Yin Liu, Guotao Li, Long Sun, Xu Liang, Zeng-Guang Hou

机构 * The State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) The School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CASIA-MUST Joint Laboratory of Intelligence Science and Technology, Institute of Systems Engineering, Macau University of Science and Technology(澳门科技大学系统工程研究所中科院自动化所-澳门科技大学智能科学与技术联合实验室) The School of Automation and Intelligence, Beijing Jiaotong University(北京交通大学自动化与智能学院)

AI总结 提出ExoTraj统一策略,通过快速流匹配实现多模态特征到轨迹的精确预测,并利用模型预测控制优化力矩,在复杂户外场景中实现自适应辅助,无需昂贵运动捕捉系统。

Comments 28 pages, 19 figures, project page: https://xiaoyinliu0714.github.io/Home_ExoTraj/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16672 2026-06-16 cs.CV 新提交

Sinkhorn-CPD: Robust point cloud registration via unbalanced entropic optimal transport

Sinkhorn-CPD:通过非平衡熵最优传输实现鲁棒点云配准

Jin Zhang, Mingyang Zhao, Bing Liu, Xin Jiang

机构 * LMIB & School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院与LMIB) State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院数学科学国家重点实验室) Beijing Key Laboratory of Artificial Intelligence Innovation and Application in the Machine Tool Industry, School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院北京市机床行业人工智能创新与应用重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 提出Sinkhorn-CPD,用双KL散度惩罚替代CPD的目标边际约束,通过非平衡熵最优传输和广义Sinkhorn迭代实现鲁棒点云配准,方差自动退火无需手动调参。

Comments 14 pages, 10 figures; journal version published in Computer-Aided Design

Journal ref Computer-Aided Design 199 (2026) 104104

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16601 2026-06-16 cs.CV 新提交

DifferAD-R1: A Difference-Guided IndustrialAnomaly Localization with Multimodal LargeLanguage Models

DifferAD-R1: 基于差异引导的多模态大语言模型工业异常定位

Dingrong Wang, Xian Tao, Zhen Qu, Hengliang Luo, Xinyi Gong, Fei Shen, Zhengtao Zhang, Guiguang Ding

机构 * Institute of Automation, Chinese Academy of Sciences (CAS)(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CASI Vision Technology Co., Ltd.(中科慧远视觉技术有限公司) Shandong Laboratory of Aluminum Advanced Manufacturing in Binzhou (SLAAMB), Binzhou Institute of Technology, Weiqiao-UCAS Science and Technology Park(山东省滨州市铝先进制造实验室(SLAAMB),滨州技术学院,魏桥国科科技园) Space Information Research Institute, Hangzhou Dianzi University(杭州电子科技大学空间信息研究院) School of Software, Tsinghua University(清华大学软件学院)

AI总结 提出DifferAD-R1框架,通过差异引导双图像范式将异常定位转化为一次性差异定位问题,并设计双一致性定位奖励和难度感知策略,在AD-DualDiff数据集上优于现有方法。

Comments Submitted to IEEE Transactions on Circuits and Systems for Video Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16481 2026-06-16 cs.AI 新提交

Steering Emotional Dynamics for Art Therapy: Controllable Narrative Script Generation through Hierarchically Guided LLM Agents

引导艺术治疗的情感动态:通过分层引导的LLM智能体实现可控叙事脚本生成

Suqing Wang, Qinghai Miao, Chao Guo, Yisheng Lv

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 提出EC-Script框架,通过分层控制情感轨迹生成叙事脚本,实现情感轨迹规划、场景驱动和局部情感调节,显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16330 2026-06-16 cs.AI 新提交

Phase-Aware Guidance Injection for Recurrent MAPPO in Assembly-Line Disruption Recovery

装配线中断恢复中面向阶段的引导注入用于循环MAPPO

Xin Huang, Yongcai Wang, Fengyi Zhang, Zhikun Tao, Yunjun Han, Naiqi Wu

机构 * School of Information, Renmin University of China(中国人民大学信息学院) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) The Information Science Academy, China Electronics Technology Group Corporation(中国电子科技集团公司信息科学研究院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) The Institute of Systems Engineering, Macau University of Science and Technology(澳门科技大学系统工程研究所)

AI总结 提出面向阶段的引导注入框架,在评估时通过logit级动作偏置增强训练好的循环MAPPO调度策略,利用规则、回放和在线LLM引导减少异常恢复时间并保持准时交付。

Comments 6 pages, 4 figures, accepted by the 2026 IEEE International Conference on Automation Science and Engineering (CASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16175 2026-06-16 cs.AI 新提交

PAL-Bench: Evidence-Grounded Profile Reconstruction from Longitudinal Personal Albums

PAL-Bench: 基于纵向个人相册的证据驱动画像重建

Qiwei Yan, Zhiqiang Yuan, Zexi Jia, Nanxing Hu, Kailin Lyu, Jie Zhou, Jinchao Zhang

机构 * Tsinghua University(清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学)

AI总结 提出PAL-Bench基准,通过合成用户和隐私保护审计,评估从纵向个人相册中重建用户画像、社交关系和身份映射的能力,发现现有系统在身份解析和证据引用方面存在不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15912 2026-06-16 cs.LG cs.AI 新提交

On-Policy Distillation with Curriculum Turn-level Guidance for Multi-turn Agents

基于课程回合级指导的在线策略蒸馏用于多轮智能体

Gengsheng Li, Mao Zheng, Mingyang Song, Ruiqi Liu, Tianyu Yang, Jie Sun, Qiyong Zhong, Haiyun Guo, Junfeng Fang, Dan Zhang, Jinqiao Wang

机构 * Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Large Language Model Department, Tencent(腾讯大语言模型部) University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Wuhan AI Research(武汉人工智能研究院)

AI总结 针对多轮智能体在线策略蒸馏中错误累积导致教师监督失效的问题,提出混合教师和学生生成回合的Guided-OPD算法,通过课程式衰减教师干预概率,在ALFWorld等任务上平均提升21.1%得分和25.5%成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15244 2026-06-16 cs.LG 新提交

M-CTX: Exact and Scalable Spatial Context Retrieval for Trajectory Analytics

M-CTX:用于轨迹分析的精确保可扩展空间上下文检索

Kun Ma, Qilong Han, Chengjing Song, Jingzheng Yao, Xiao Han, Yuee Zhou, Changmao Wu

机构 * Harbin Engineering University(哈尔滨工程大学) Wuhan University of Technology(武汉理工大学) University of Chinese Academy of Sciences(中国科学院大学) Alibaba Group(阿里巴巴集团)

AI总结 提出M-CTX框架,将空间上下文构建转化为空间数据库查询,通过索引加速实现226倍加速,解决轨迹预测中上下文构建的系统瓶颈。

Comments 14 pages, 10 figures, 12 tables. Submitted to ICDE 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15231 2026-06-16 cs.AI 新提交

Visual-Seeker: Towards Visual-Native Multimodal Agentic Search via Active Visual Reasoning

Visual-Seeker:通过主动视觉推理实现视觉原生多模态智能搜索

Zhengbo Zhang, Changtao Miao, Jinbo Su, Zhaowen Zhou, Chunxia Zhang, Xukai Wang, Ruiqi Liu, Kaiyuan Zheng, Jiansheng Cai, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * School of Artificial Intelligence UCAS(中国科学院大学人工智能学院) Institute of Automation CAS(中国科学院自动化研究所) Ant Digital Technologies Ant Group(蚂蚁数字科技蚂蚁集团) RUC(中国人民大学) BIT(北京理工大学)

AI总结 提出Visual-Seeker,一种通过主动视觉推理进行视觉原生多模态深度搜索的智能体,在五个基准上达到最先进性能,甚至超越专有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15118 2026-06-16 cs.CV 新提交

Multi-view feature High-order Fusion for Space Weak Object Detection and Segmentation

多视角特征高阶融合用于空间弱目标检测与分割

Weilong Guo, Yuhan Sun, Shengyang Li

机构 * Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间应用工程与技术中心) Key Laboratory of Space Utilization, Chinese Academy of Sciences(中国科学院空间应用重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 针对空间弱目标检测与分割,提出多视角特征高阶融合方法(MHF),通过高阶特征感知和递归任务贡献门控选择,有效聚合弱目标的准确丰富特征,作为即插即用模块显著提升多种视觉模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15112 2026-06-16 cs.CV 新提交

Learn Temporal Consistency For Robust Satellite Video Detector

学习时间一致性以实现鲁棒的卫星视频检测器

Weilong Guo, Shengyang Li, Yanfeng Gu

机构 * Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间应用工程与技术中心) Key Laboratory of Space Utilization, Chinese Academy of Sciences(中国科学院空间应用重点实验室) University of Chinese Academy of Sciences(中国科学院大学) School of Electronics and Information Engineering, Harbin Institute of Technology(哈尔滨工业大学电子与信息工程学院)

AI总结 提出基于时间一致性学习(TCL)的卫星视频目标检测框架,通过时间特征聚合、结构编码和时间一致性约束模块,实现定向细粒度目标检测,在SAT-MTB数据集上达到47.7% mAP,较基线提升4.8%。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04907 2026-06-16 cs.RO 版本更新

WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation

WAM-Nav:面向统一视觉导航的非对称潜在世界-动作建模

Ning Yang, Yan Huang, Kaiwen Peng, Ziheng He, Kai Wang, Cui Miao, Kailin Lyu, Guo Li, Xiaofeng Wang, Zheng Zhu, Jing Liu, Nianfeng Liu

机构 * Nanjing University(南京大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) FiveAges National University of Defense Technology(国防科技大学) Tsinghua University(清华大学) GigaAI

AI总结 提出WAM-Nav,一种联合学习动作生成与潜在视觉预测的非对称扩散Transformer模型,通过共享扩散Transformer实现长时程动作与短时程视觉预测的联合扩散,并引入双流上下文条件机制和目标对齐模块,在统一策略下支持图像目标、点目标和无目标导航,在ClutterScenes和InternScenes基准上分别提升15.7%和3.3%的成功率,并在真实环境中实现85%的任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏