arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2603.27982 2026-04-02 cs.CV cs.AI cs.CL

CDH-Bench: A Commonsense-Driven Hallucination Benchmark for Evaluating Visual Fidelity in Vision-Language Models

CDH-Bench:一种基于常识的幻觉基准,用于评估视觉语言模型中的视觉保真度

Kesheng Chen, Yamin Hu, Qi Zhou, Zhenqian Zhu, Wenjian Luo

机构 * Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies, Institute of Cyberspace Security, School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(广东省新型安全智能技术重点实验室,网络空间安全研究院,计算机科学与技术学院,哈尔滨工业大学(深圳))

AI总结 本文提出CDH-Bench基准,用于评估视觉语言模型在视觉证据与常识冲突时的视觉保真度,通过三种异常类型和两种QA任务,揭示模型在常识驱动下的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00267 2026-04-02 cs.CV

ActErase: A Training-Free Paradigm for Precise Concept Erasure via Activation Redirection

ActErase: 一种无需训练的概念擦除范式通过激活重定向

Yi Sun, Xinhao Zhong, Hongyan Li, Yimin Zhou, Junhao Li, Bin Chen, Xuan Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出无需训练的概念擦除方法ActErase,通过激活差异区域分析和动态替换输入激活,实现高效概念擦除,同时保持模型生成能力,且具有对抗攻击鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21507 2026-04-01 cs.CV

SVBench: Evaluation of Video Generation Models on Social Reasoning

SVBench:视频生成模型在社会推理中的评估

Wenshuo Peng, Gongxuan Wang, Tianmeng Yang, Chuanhao Li, Xiaojie Xu, Hui He, Kaipeng Zhang

机构 * Tsinghua University(清华大学) Shanda AI Research Tokyo(盛大人工智能研究院东京) Shanghai AI Lab(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学) Peking University(北京大学)

AI总结 本文提出SVBench基准,用于评估视频生成模型在社会推理能力上的不足,通过七大核心维度和免训练流程,评估七种先进模型,揭示表面合理性与深层社会推理能力间的差距。

Comments 10pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24745 2026-04-01 cs.CL cs.LG

ProxyAttn: Guided Sparse Attention via Representative Heads

ProxyAttn: 通过代表性头实现引导稀疏注意力

Yixuan Wang, Huang He, Siqi Bao, Hua Wu, Haifeng Wang, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学) Baidu Inc.(百度公司)

AI总结 本文提出ProxyAttn,一种无需训练的稀疏注意力算法,通过压缩注意力头维度实现更精确的块估计,结合代表性头得分和多头动态预算,提升长文本任务的效率和性能。

Comments ICLR 2026 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29410 2026-04-01 cs.CV cs.AI cs.LG

AGFT: Alignment-Guided Fine-Tuning for Zero-Shot Adversarial Robustness of Vision-Language Models

AGFT:基于对齐的微调以提升视觉-语言模型的零样本对抗鲁棒性

Yubo Cui, Xianchao Guan, Zijun Xiong, Zheng Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Shenzhen Loop Area Institute, Shenzhen, China(深圳市环域研究所)

AI总结 本文提出AGFT框架,通过概率预测进行文本引导对抗训练,提升视觉-语言模型的零样本对抗鲁棒性,同时保持跨模态语义结构。

Comments Accepted by CVPR 2026; Code is available at \url{https://github.com/YuboCui/AGFT}

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28740 2026-03-31 cs.RO

FocusVLA: Focused Visual Utilization for Vision-Language-Action Models

FocusVLA: 用于视觉-语言-动作模型的聚焦视觉利用

Yichi Zhang, Weihao Yuan, Yizhuo Zhang, Xidong Zhang, Jia Wan

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) DaiMon Robotics, China(戴蒙机器人公司) Nanjing University, Nanjing, China(南京大学) Renmin University of China, Beijing, China(中国人民大学)

AI总结 本文提出FocusVLA,通过聚焦任务相关视觉区域提升视觉-语言-动作模型的性能,解决视觉信息利用不足的问题。

Comments 25 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19315 2026-03-31 eess.SP cs.AI cs.LG

Advancing Few-Shot Pediatric Arrhythmia Classification with a Novel Contrastive Loss and Multimodal Learning

通过新颖的对比损失和多模态学习推进少样本儿童心律失常分类

Yiqiao Chen, Zijian Huang, Zhenghui Feng

机构 * Faculty of Frontier Sciences, Harbin Institute of Technology(哈尔滨工业大学(深圳)前沿科学学院)

AI总结 本文提出多模态端到端框架,结合体表ECG和心内电图信号,引入自适应全局类感知对比损失,提升少样本下儿童心律失常分类性能。

Comments 12pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19111 2026-03-31 cs.CV cs.AI

A Benchmark for Incremental Micro-expression Recognition

增量微表情识别的基准测试

Zhengqin Lai, Xiaopeng Hong, Yabin Wang, Xiaobai Li

机构 * Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室) Xi’an Jiaotong University(西安交通大学) Zhejiang University(浙江大学)

AI总结 本文提出增量微表情识别基准测试,通过定制学习设置、有序数据集和交叉评估协议,为研究提供基础,并提供六个基线方法的评估结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27694 2026-03-31 cs.CL

Can Large Language Models Simulate Human Cognition Beyond Behavioral Imitation?

大语言模型能否超越行为模仿模拟人类认知?

Yuxuan Gu, Lunjun Liu, Xiaocheng Feng, Kun Zhu, Weihong Zhong, Lei Huang, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文通过217位AI研究者纵向研究轨迹构建基准,评估LLM是否能模拟人类认知,提出多维认知对齐指标,系统评估最新LLM及增强技术,探讨其模拟人类认知的能力及提升空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27583 2026-03-31 cs.RO cs.SY eess.SY

LLM-Enabled Low-Altitude UAV Natural Language Navigation via Signal Temporal Logic Specification Translation and Repair

基于大语言模型的低空无人机自然语言导航:通过信号时序逻辑规范翻译与修复

Yuqi Ping, Huahao Ding, Tianhao Liang, Longyu Zhou, Guangyu Lei, Xinglin Chen, Junwei Wu, Jieyu Zhou, Tingting Zhang

机构 * Guangdong Provincial Key Laboratory of Space-Aerial Networking and Intelligent Sensing, Harbin Institute of Technology, Shenzhen(广东省空天网络与智能感知重点实验室,哈尔滨工业大学(深圳)) Peng Cheng Laboratory (PCL), Shenzhen(鹏城实验室) Information Systems Technology and Design, Singapore University of Technology and Design(新加坡科技设计大学信息系统技术与设计系) School of Computer Science and Engineering, Central South University, Changsha(中南大学计算机科学与工程学院)

AI总结 本文提出一种统一框架,通过将自然语言指令转换为信号时序逻辑规范并利用混合整数线性规划生成轨迹,提升低空无人机在复杂环境中的安全导航能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27541 2026-03-31 cs.NE cs.AI

A Novel Immune Algorithm for Multiparty Multiobjective Optimization

一种新型的多方多目标优化免疫算法

Kesheng Chen, Wenjian Luo, Qi Zhou, Yujiang liu, Peilan Xu, Yuhui Shi

机构 * Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies(广东省新型安全智能技术重点实验室) School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) Peng Cheng Laboratory(鹏城实验室) School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) School of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系)

AI总结 本文提出多方免疫算法(MPIA),通过引入基于不同决策者视角的非支配排序排名的跨方引导交叉策略和基于多方覆盖度量(MCM)的自适应激活策略,以解决多方多目标优化问题,实验表明其优于其他算法。

Comments \c{opyright} 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

Journal ref IEEE Transactions on Emerging Topics in Computational Intelligence, 9(2), 1238-1252 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27228 2026-03-31 cs.CV

NimbusGS: Unified 3D Scene Reconstruction under Hybrid Weather

NimbusGS: 一种在混合天气下统一的3D场景重建框架

Yanying Li, Jinyang Li, Shengfeng He, Yangyang Xu, Junyu Dong, Yong Du

机构 * School of Computer Science and Technology, Ocean University of China(中国海洋大学计算机科学与技术学院) Singapore Management University(新加坡管理大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Sanya Oceanographic Institution, Ocean University of China(中国海洋大学三亚海洋研究院)

AI总结 NimbusGS通过建模天气的双重特性,统一处理多视角输入下的高质量3D场景重建,提出几何引导梯度缩放机制以提升几何重建质量。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27115 2026-03-31 cs.CV

SJD-VP: Speculative Jacobi Decoding with Verification Prediction for Autoregressive Image Generation

SJD-VP:带有验证预测的推测雅可比解码

Bingqi Shan, Baoquan Zhang, Xiaochen Qi, Xutao Li, Yunming Ye, Liqiang Nie

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Institute of Perceptual Intelligence, Pengcheng Laboratory, Shenzhen(鹏城实验室感知智能研究所)

AI总结 本文提出SJD-VP,通过利用token概率变化指导采样,提升验证通过率,加速自回归生成并提高图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26746 2026-03-31 cs.CV cs.LG

TDEC: Deep Embedded Image Clustering with Transformer and Distribution Information

TDEC:基于Transformer和分布信息的深度嵌入图像聚类

Ruilin Zhang, Haiyang Zheng, Hongpeng Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出TDEC,通过结合Transformer和分布信息,改进图像聚类中的特征表示和维度偏好,提升聚类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26744 2026-03-31 cs.CV

CNMBI: Determining the Number of Clusters Using Center Pairwise Matching and Boundary Filtering

CNMBI:利用中心配对匹配和边界过滤确定簇数

Ruilin Zhang, Haiyang Zheng, Hongpeng Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出CNMBI方法,通过中心配对匹配和边界过滤确定簇数,无需依赖完整聚类结果和复杂有效性指标,适用于高维和大规模数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26179 2026-03-30 cs.CV

Consistency Beyond Contrast: Enhancing Open-Vocabulary Object Detection Robustness via Contextual Consistency Learning

超越对比:通过上下文一致性学习增强开放词汇物体检测的鲁棒性

Bozhao Li, Shaocong Wu, Tong Shao, Senqiao Yang, Qiben Shan, Zhuotao Tian, Jingyong Su

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) CUHK(香港中文大学)

AI总结 本文提出上下文一致性学习框架,通过上下文自举数据生成和上下文一致性损失提升开放词汇物体检测在不同场景下的鲁棒性,实验表明其在OmniLabel和D3数据集上分别提升16.3和14.9 AP。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26174 2026-03-30 cs.CV

CREval: An Automated Interpretable Evaluation for Creative Image Manipulation under Complex Instructions

CREval: 一种自动化可解释的评估方法用于复杂指令下的创意图像操纵

Chonghuinan Wang, Zihan Chen, Yuxiang Wei, Tianyi Jiang, Xiaohe Wu, Fan Li, Wangmeng Zuo, Hongxun Yao

机构 * Harbin Institute of Technology(哈尔滨工业大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Pengcheng Lab, Guangzhou(广州鹏城实验室)

AI总结 本文提出CREval,一种基于问答的自动化评估框架,用于评估复杂指令下的创意图像编辑任务,通过CREval-Bench基准测试揭示模型在复杂创意任务中的表现及挑战。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15702 2026-03-30 cs.IT cs.CV cs.NI math.IT

Editable-DeepSC: Reliable Cross-Modal Semantic Communications for Facial Editing

可编辑的深度语义通信:面向面部编辑的可靠跨模态语义通信

Bin Chen, Wenbo Yu, Qinshan Zhang, Tianqu Zhuang, Hao Wu, Yong Jiang, Shu-Tao Xia

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出Editable-DeepSC,一种用于面部编辑的跨模态语义通信方法,通过联合编辑-信道编码和SNR感知信道编码,提升传输效率与编辑质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25791 2026-03-30 cs.CV

ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions

ArtHOI:通过基础模型驯化实现单目4D手-物体交互重建

Zikai Wang, Zhilu Zhang, Yiqing Wang, Hui Li, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出ArtHOI框架,通过整合多基础模型先验知识,解决单目视频中手-物体交互的4D重建问题,引入自适应采样细化和多模态大语言模型引导对齐方法,构建两个新数据集并验证方法有效性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25442 2026-03-27 cs.CV

DC-Reg: Globally Optimal Point Cloud Registration via Tight Bounding with Difference of Convex Programming

DC-Reg: 通过紧密边界与凸优化编程实现全局最优点云配准

Wei Lian, Fei Ma, Hang Pan, Zhesen Cui, Wangmeng Zuo

机构 * Department of Computer Science, Changzhi University(长治大学计算机科学系) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

AI总结 本文提出DC-Reg框架,通过紧密的分支限界搜索和凸优化编程,解决点云配准中的全局最优问题,实验显示其在速度和鲁棒性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25388 2026-03-27 cs.CV

Multimodal Dataset Distillation via Phased Teacher Models

通过分阶段教师模型进行多模态数据集蒸馏

Shengbin Guo, Hang Zhao, Senqiao Yang, Chenyang Jiang, Yuhang Cheng, Xiangru Peng, Rui Shao, Zhuotao Tian

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出PTM-ST框架,通过分阶段教师建模和快捷路径轨迹构建策略,解决多模态数据集蒸馏中的跨阶段性能差距和教师轨迹不稳定问题,提升蒸馏过程的稳定性和表达性。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25250 2026-03-27 cs.CV cs.AI cs.LG

Activation Matters: Test-time Activated Negative Labels for OOD Detection with Vision-Language Models

激活至关重要:基于视觉语言模型的测试时激活负标签用于分布外检测

Yabin Zhang, Maya Varma, Yunhe Gao, Jean-Benoit Delbrouck, Jiaming Liu, Chong Wang, Curtis Langlotz

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Stanford University(斯坦福大学)

AI总结 本文提出测试时激活负标签(TANL)方法,通过动态评估激活水平和测试批次内的激活信息,提升分布外检测的性能和鲁棒性,实验表明其在ImageNet基准上显著降低FPR95。

Comments CVPR 2026 main track, Codes are available at https://github.com/YBZh/OpenOOD-VLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05631 2026-03-27 cs.CV

OFFSET: Segmentation-based Focus Shift Revision for Composed Image Retrieval

OFFSET: 基于分割的聚焦偏移修正用于复合图像检索

Zhiwei Chen, Yupeng Hu, Zixu Li, Zhiheng Fu, Xuemeng Song, Liqiang Nie

机构 * Shandong University(山东大学) City University of Hong Kong(香港城市大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文提出OFFSET网络,通过分割模块和双聚焦映射模块修正复合图像检索中的视觉和文本焦点偏差,提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11441 2026-03-27 cs.CL

Is Compression Really Linear with Code Intelligence?

压缩与代码智能之间的真实关系是否线性?

Shijie Xuyang, Xianzhen Luo, Zheng Chu, Houyi Li, Siming Huang, Qiufeng Wang, Wanxiang Che, Qingfu Zhu, Shuigeng Zhou

机构 * Fudan University(复旦大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文通过评估多种开源代码LLM在多语言多任务基准上的表现,发现代码智能与压缩效率之间存在对数关系,挑战了此前线性假设。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24382 2026-03-26 cs.LG cs.AI cs.CE

MolEvolve: LLM-Guided Evolutionary Search for Interpretable Molecular Optimization

MolEvolve: 基于大语言模型的可解释分子优化进化搜索

Xiangsen Chen, Ruilong Wu, Yanyan Lan, Ting Ma, Yang Liu

机构 * Hong Kong University of Science(香港科技大学) Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 MolEvolve通过大语言模型引导进化搜索,实现可解释的分子优化,优于传统方法在属性预测和分子优化任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08720 2026-03-26 cs.CL

How Many Code and Test Cases Are Enough? Evaluating Test Cases Generation from a Binary-Matrix Perspective

生成多少代码和测试用例足够?从二进制矩阵视角评估测试用例生成

Xianzhen Luo, Jinyang Huang, Wenzhen Zheng, Qingfu Zhu, Mingzheng Xu, Yiheng Xu, Yuantao Fan, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学) Chinese Academy of Sciences(中国科学院) Peking University(北京大学) Beijing University of Posts and Telecommunications(北京邮电大学)

AI总结 本文从二进制矩阵视角评估测试用例生成,提出TC-Bench基准,通过寻找最优诊断基来确定最小错误代码和测试用例集,揭示现有方法在诊断能力上的不足。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24134 2026-03-26 cs.CV

Spectral Scalpel: Amplifying Adjacent Action Discrepancy via Frequency-Selective Filtering for Skeleton-Based Action Segmentation

频谱手术刀:通过频率选择性过滤放大相邻动作差异以实现基于骨架的动作分割

Haoyu Ji, Bowen Chen, Zhihao Yang, Wenze Huang, Yu Gao, Xueting Liu, Weihong Ren, Zhiyong Wang, Honghai Liu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shenzhen H&T Intelligent Control Co., Ltd.(深圳H&T智能控制有限公司) Southern University of Science and Technology(南方科技大学) Southeast University(东南大学)

AI总结 本文提出Spectral Scalpel方法,通过频率选择性过滤增强相邻动作差异,改进基于骨架的动作分割性能,实验表明其在多个数据集上达到最优效果。

Comments CVPR Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24130 2026-03-26 cs.RO cs.SY eess.SY

Equivariant Filter Transformations for Consistent and Efficient Visual--Inertial Navigation

等价滤波变换用于一致且高效的视觉-惯性导航

Chungeng Tian, Fenghua He, Ning Hao

机构 * School of Astronautics, Harbin Institute of Technology(哈尔滨工程大学航天学院)

AI总结 本文提出了一种等价滤波变换方法,通过建立不同对称性的等价滤波器之间的分析联系,实现系统一致性设计和高效实现。

Comments 28 papes, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24097 2026-03-26 cs.CV

LaDy: Lagrangian-Dynamic Informed Network for Skeleton-based Action Segmentation via Spatial-Temporal Modulation

LaDy:基于空间-时间调制的拉格朗日-动态网络用于基于骨骼的动作分割

Haoyu Ji, Xueting Liu, Yu Gao, Wenze Huang, Zhihao Yang, Weihong Ren, Zhiyong Wang, Honghai Liu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Southern University of Science and Technology(南方科技大学) Southeast University(东南大学)

AI总结 本文提出LaDy网络,通过整合拉格朗日动力学原理,提升骨骼动作分割的精度与边界定位能力,实验表明其在挑战性数据集上取得最优性能。

Comments CVPR Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24047 2026-03-26 cs.RO

PCHC: Enabling Preference Conditioned Humanoid Control via Multi-Objective Reinforcement Learning

PCHC:通过多目标强化学习实现基于偏好的人形机器人控制

Huanyu Li, Dewei Wang, Xinmiao Wang, Xinzhe Liu, Peng Liu, Chenjia Bai, Xuelong Li

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学) Harbin Engineering University(哈尔滨工程大学) ShanghaiTech University(上海科技大学) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院(TeleAI))

AI总结 本文提出PCHC框架,利用多目标强化学习实现人形机器人基于偏好的控制,通过偏好向量调节专家混合模块,使单一策略能展现多样行为,实验证明机器人可实时调整优先级。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏