arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2601.07208 2026-04-14 cs.LG cs.CL

MAESTRO: Meta-learning Adaptive Estimation of Scalarization Trade-offs for Reward Optimization

MAESTRO:元学习适应性标量化贸易-offs估计用于奖励优化

Yang Zhao, Hepeng Wang, Xiao Ding, Yangou Ouyang, Bibo Cai, Kai Xiong, Jinglong Gao, Zhouhao Sun, Li Du, Bing Qin, Ting Liu

机构 * Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology(哈尔滨工业大学社会计算与交互机器人研究中心) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 MAESTRO通过引入元认知协调层,动态处理奖励标量化问题,优于单奖励和静态多目标基线,在保持GRPO效率的同时减少冗余生成。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10023 2026-04-14 cs.CV cs.AI

FREE-Switch: Frequency-based Dynamic LoRA Switch for Style Transfer

FREE-Switch: 基于频率的动态LoRA切换用于风格迁移

Shenghe Zheng, Minyu Zhang, Tianhao Liu, Hongzhi Wang

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出FREE-Switch方法,通过频率域重要性驱动动态LoRA切换,结合不同对象和风格的适配器,降低高质量定制生成的训练成本。

Comments CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09748 2026-04-14 cs.CR cs.AI

Backdoors in RLVR: Jailbreak Backdoors in LLMs From Verifiable Reward

在RLVR中存在后门:从可验证奖励中对LLM的后门攻击

Weiyang Guo, Zesheng Shi, Zeen Zhu, Yuan Zhou, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 本文提出了一种在RLVR框架中通过注入污染数据植入后门的新方法,展示了该攻击在不同模型规模上高效且具有泛化能力,导致安全性能下降73%。

Comments 20 pages,8 figures, publish in acl2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09688 2026-04-14 cs.CV

Immunizing 3D Gaussian Generative Models Against Unauthorized Fine-Tuning via Attribute-Space Traps

通过属性空间陷阱免疫3D高斯生成模型以防止未经授权的微调

Jianwei Zhang, Sihan Cao, Chaoning Zhang, Ziming Hong, Jiaxin Huang, Pengcheng Zheng, Caiyan Qin, Wei Dong, Yang Yang, Tongliang Liu

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Sydney AI Centre, The University of Sydney(悉尼大学悉尼人工智能中心) Machine Learning Department, Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学机器学习系) School of Robotics and Advanced Manufacture, Harbin Institute of Technology(哈尔滨工业大学(深圳)机器人技术与先进制造学院)

AI总结 本文提出GaussLock,一种轻量级参数空间免疫框架,通过属性感知陷阱损失保护3D生成模型免受微调攻击,有效破坏结构完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20567 2026-04-14 cs.CL

KCS: Diversify Multi-hop Question Generation with Knowledge Composition Sampling

KCS: 通过知识组合采样多样化多跳问题生成

Yangfan Wang, Jie Liu, Chen Tang, Lian Yan, Jingchi Jiang

机构 * Harbin Institute of Technology(哈尔滨工业大学) MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司) National Key Laboratory of Smart Farm Technologies and Systems(智慧农场技术与系统全国重点实验室)

AI总结 本文提出KCS框架,通过采样不同知识组合提升多跳问题生成的多样性,改进知识组合选择的准确率,并在HotpotQA和2WikiMultihopQA数据集上提升数据增强效果。

Comments Accept by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11871 2026-04-14 cs.CL cs.AI

MegaFake: A Theory-Driven Dataset of Fake News Generated by Large Language Models

MegaFake:一种由大型语言模型生成的理论驱动的虚假新闻数据集

Lionel Z. Wang, Ka Chung Ng, Yiming Ma, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出MegaFake数据集,通过理论框架指导生成虚假新闻,提升虚假新闻检测的理论和实践能力。

Comments Decision Support Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09455 2026-04-13 cs.AI

E3-TIR: Enhanced Experience Exploitation for Tool-Integrated Reasoning

E3-TIR: 增强经验利用以实现工具集成推理

Weiyang Guo, Zesheng Shi, Liye Zhao, Jiayuan Ma, Zeen Zhu, Junxian He, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Huawei Technologies Co., Ltd.(华为技术有限公司) Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出E3-TIR方法,通过整合专家前缀、专家引导和自探索三种经验类型,提升工具集成推理的效率与性能,实验显示在工具使用任务中性能提升6%,数据成本降低。

Comments 22 pages 10 figures, published in acl2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09159 2026-04-13 cs.LG

Truncated Rectified Flow Policy for Reinforcement Learning with One-Step Sampling

截断修正流策略用于具有一步采样的强化学习

Xubin Zhou, Yipeng Yang, Zhan Li

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出TRFP框架,通过混合确定性-随机性架构解决MaxEnt RL中连续时间生成策略的可微性问题,实现稳定训练和有效一步采样,实验表明其在多目标环境和MuJoCo基准中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09064 2026-04-13 cs.LG

Feature-Label Modal Alignment for Robust Partial Multi-Label Learning

特征-标签模态对齐用于鲁棒的半多标签学习

Yu Chen, Weijun Lv, Yue Huang, Xiaozhao Fang, Jie Wen, Yong Xu, Guanbin Li

机构 * School of Automation, Guangdong University of Technology(广东工业大学自动化学院) Shenzhen Key Laboratory of Visual Object Detection and Recognition, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)深圳市视觉目标检测与识别重点实验室) School of Computer Science and Engineering, Sun Yat-Sen University(中山大学计算机科学与工程学院)

AI总结 本文提出PML-MA方法,通过特征-标签模态对齐恢复一致性,利用低秩正交分解生成伪标签并增强判别性,实验表明在真实和合成数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08617 2026-04-13 cs.LG cs.AI cs.CV

From Selection to Scheduling: Federated Geometry-Aware Correction Makes Exemplar Replay Work Better under Continual Dynamic Heterogeneity

从选择到调度:联邦几何感知修正使示例回放在持续动态异质性下表现更佳

Zhuang Qi, Ying-Peng Tang, Lei Meng, Guoqing Chao, Lei Wu, Han Yu, Xiangxu Meng

机构 * School of Software, Shandong University(山东大学软件学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

AI总结 本文提出FEAT方法,通过几何结构对齐模块和能量基几何修正模块,解决联邦持续学习中示例回放在持续动态异质性下的性能问题。

Comments CVPR 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08613 2026-04-13 cs.CV

ViSAGE @ NTIRE 2026 Challenge on Video Saliency Prediction

在NTIRE 2026上视频显著性预测挑战中的ViSAGE

Kun Wang, Yupeng Hu, Zhiran Li, Hao Liu, Qianlong Xiang, Liqiang Nie

机构 * Shandong University(山东大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) City University of Hong Kong(香港城市大学) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 本文提出ViSAGE框架,通过多专家集合方法融合互补的归纳偏置,提升视频显著性预测性能,在私人测试集上取得优异成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08605 2026-04-13 cs.CV

SelfHVD: Self-Supervised Handheld Video Deblurring

SelfHVD:基于自身监督的手持视频去模糊

Honglei Xu, Zhilu Zhang, Junjie Fan, Xiaohe Wu, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出SelfHVD方法,通过提取视频中的清晰线索进行自监督学习,结合SEVD和SCSCM技术提升手持视频去模糊性能,实验表明其优于现有方法。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14075 2026-04-13 cs.CV cs.CL

Growing a Multi-head Twig via Distillation and Reinforcement Learning to Accelerate Large Vision-Language Models

通过蒸馏和强化学习生长多头Twig以加速大视觉-语言模型

Zhenwei Shao, Mingyang Wang, Weijun Zhang, Zhou Yu, Wenwen Pan, Yan Yang, Tao Wei, Hongyuan Zhang, Jun Yu

机构 * Zhejiang Key Laboratory of Space Information Sensing and Transmission, School of Computer Science, Hangzhou Dianzi University(浙江省空间信息感知与传输重点实验室,计算机学院,杭州电子科技大学) Li Auto Inc.(理想汽车) School of Intelligence Science and Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)智能科学与工程学院)

AI总结 本文提出TwigVLM,通过在基础VLM早期层上生长轻量模块Twig,结合 Twig 引导的 token 剪枝和自推测解码策略,实现更高的准确性和速度。实验表明, TwigVLM 在剪枝88.9%的视觉token后仍保持96%的原始性能,并在生成长响应时达到154%的速度提升。

Comments An extended version of our ICCV paper at ICCV2025/html/Shao_Growing_a_Twig_to_Accelerate_Large_Vision-Language_Models_ICCV_2025_paper.html" target="_blank" rel="noopener">https://openaccess.thecvf.com/content/ICCV2025/html/Shao_Growing_a_Twig_to_Accelerate_Large_Vision-Language_Models_ICCV_2025_paper.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07963 2026-04-10 cs.CL cs.AI cs.LG

Rethinking Data Mixing from the Perspective of Large Language Models

从大语言模型视角重新思考数据混合

Yuanjian Xu, Tianze Sun, Changwei Xu, XinLong Zhao, Jianing Hao, Ran Chen, Yang Liu, Ruijie Xu, Stephen Chen, Guang Zhang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) OpenCSG Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文从理论角度探讨数据混合策略对大语言模型训练的影响,提出DoGraph框架,通过图约束优化提升模型泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07957 2026-04-10 cs.AI cs.CV cs.RO

WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models

WorldMAP: 通过生成世界模型提升视觉-语言导航轨迹预测

Hongjin Chen, Shangyun Jiang, Tonghua Su, Chen Gao, Xinlei Chen, Yong Li, Zhibo Chen

机构 * Harbin Institute of Technology(哈尔滨工业大学) Shandong University(山东大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy(中关村学院)

AI总结 WorldMAP通过生成世界模型与教师-学生框架,将生成的未来场景转化为语义空间结构和规划监督,提升导航轨迹预测的稳定性与准确性,取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07922 2026-04-10 cs.AI cs.CL

SAT: Balancing Reasoning Accuracy and Efficiency with Stepwise Adaptive Thinking

SAT:通过分步自适应思维平衡推理准确性和效率

Weiyang Huang, Xuefeng Bai, Kehai Chen, Xinyang Chen, Yibin Chen, Weili Guan, Min Zhang

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Huawei Technologies(华为技术有限公司)

AI总结 本文提出SAT框架,通过分步自适应思维在保持核心推理结构的同时实现推理步骤的动态剪枝,从而在减少推理token数量的同时维持或提升准确率。

Comments accepted to ACL2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06932 2026-04-09 cs.RO

Towards Multi-Object Nonprehensile Transportation via Shared Teleoperation: A Framework Based on Virtual Object Model Predictive Control

通过共享遥控实现多物体非抓取运输:基于虚拟物体模型预测控制的框架

Xinyang Fan, Zhaoyang Chen, Shu Xin, Yi Ren, Zainan Jiang, Fenglei Ni, Hong Liu

机构 * State Key Laboratory of Robotics and System, Harbin Institute of Technology(哈尔滨工业大学机器人技术与系统国家重点实验室) Advanced Manufacturing Laboratory, Huawei Technologies(华为技术有限公司先进制造实验室)

AI总结 本文提出一种基于虚拟物体模型预测控制的共享遥控框架,解决多物体非抓取运输中的轨迹跟踪和托盘姿态控制问题,通过动态约束分析和轨迹平滑算法实现稳定操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06793 2026-04-09 cs.SE cs.AI

Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development

通过问答和基于特征的开发评估仓库级软件文档

Xinchen Wang, Ruida Hu, Cuiyun Gao, Pengfei Gao, Chao Peng

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Independent Researcher, China(独立研究者)

AI总结 本文提出SWD-Bench基准,通过功能驱动的问答任务评估仓库级文档质量,揭示现有方法局限,并展示高质量文档对SWE-Agent问题解决率的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06739 2026-04-09 cs.CV

DOC-GS: Dual-Domain Observation and Calibration for Reliable Sparse-View Gaussian Splatting

DOC-GS:双域观测与校准以实现可靠的稀疏视角高斯点云法

Hantang Li, Qiang Zhu, Xiandong Meng, Debin Zhao, Xiaopeng Fan

机构 * Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室)

AI总结 本文提出DOC-GS框架,通过优化域归纳偏差和观测域证据的协同作用,解决稀疏视角3DGS中高斯点云可靠性不可观测的问题,提升重建稳定性与图像质量。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06620 2026-04-09 cs.LG

PD-SOVNet: A Physics-Driven Second-Order Vibration Operator Network for Estimating Wheel Polygonal Roughness from Axle-Box Vibrations

PD-SOVNet:一种基于物理的第二阶振动运算网络,用于从轴箱振动估计轮廓粗糙度

Xiancheng Wang, Lin Wang, Rui Wang, Zhibo Zhang, Minghang Zhao, Xiaoheng Zhang, Zhongyue Tan, Kaitai Mao

机构 * School of Ocean Engineering, Harbin Institute of Technology(哈尔滨工业大学海洋工程学院) Technical Center, Bogie Development Department, CRRC Qingdao Sifang Locomotive and Rolling Stock Co., Ltd(中车青岛四方机车车辆股份有限公司转向架开发部技术中心)

AI总结 本文提出PD-SOVNet,结合第二阶振动核、MIMO耦合模块和物理修正分支,用于从轴箱振动估计轮廓粗糙度,实验显示其在实际数据中表现优异,尤其在Dataset III中效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01840 2026-04-09 cs.AI

Not All Tokens See Equally: Perception-Grounded Policy Optimization for Large Vision-Language Models

并非所有token都同等重要:基于感知的策略优化方法用于大型视觉-语言模型

Zekai Ye, Qiming Li, Xiaocheng Feng, Ruihan Chen, Ziming Li, Haoyu Ren, Kun Chen, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本文提出基于感知的策略优化方法PGPO,通过动态调整token级别的优势,提升多模态推理的鲁棒性与稳定性,实验显示在多个基准上提升18.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05857 2026-04-08 cs.LG

Weight-Informed Self-Explaining Clustering for Mixed-Type Tabular Data

考虑权重的自解释聚类用于混合类型表格数据

Lehao Li, Qiang Huang, Yihao Ang, Bryan Kian Hsiang Low, Anthony K. H. Tung, Xiaokui Xiao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) School of Intelligence Science and Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)智能科学与工程学院)

AI总结 本文提出WISE框架,通过二进制编码与填充对齐异构特征,结合LOFO策略和两阶段加权聚类,提升混合类型表格数据的聚类质量和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05557 2026-04-08 cs.CL

EpiBench: Benchmarking Multi-turn Research Workflows for Multimodal Agents

EpiBench:多轮研究工作流的多模态代理基准测试

Xuan Dong, Huanyang Zheng, Tianhao Niu, Zhe Han, Pengzhan Li, Bofei Liu, Zhengyang Liu, Guancheng Li, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 EpiBench通过多轮多模态任务评估代理在文献检索、证据整合和跨论文比较中的能力,揭示现有基准在多证据整合和持续证据使用方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05484 2026-04-08 cs.RO cs.CV

CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment

CoEnv:通过组合环境驱动具身体验多智能体协作

Li Kang, Yutao Fan, Rui Li, Heng Zhou, Yiran Qin, Zhemeng Zhang, Songtao Huang, Xiufeng Song, Zaibin Zhang, Bruno N. Y. Chen, Zhenfei Yin, Dongzhan Zhou, Wangmeng Zuo, Lei Bai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学) CUHK-Shenzhen(香港中文大学(深圳)) Fudan University(复旦大学) Dalian University of Technology(大连理工大学) Carnegie Mellon University(卡内基梅隆大学) University of Oxford(牛津大学)

AI总结 本文提出CoEnv框架,通过模拟与现实结合的组合环境,实现多智能体协作的高效执行与安全部署,提升任务成功率和效率。

Comments 31 pages, 8 figures, including supplementary material. Project page: https://faceong.github.io/CoEnv/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05396 2026-04-08 cs.AI

Reason Analogically via Cross-domain Prior Knowledge: An Empirical Study of Cross-domain Knowledge Transfer for In-Context Learning

通过跨领域先验知识进行类比推理:一项跨领域知识转移用于上下文学习的实证研究

Le Liu, Zhiming Li, Jianzhi Yan, Zike Yuan, Shiwei Chen, Youcheng Pan, Buzhou Tang, Qingcai Chen, Yang Xiang, Danny Dongning Sun

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室)

AI总结 本文通过实证研究验证了跨领域知识转移在上下文学习中的可行性,发现通过检索跨领域示例可提升推理性能,且示例吸收阈值后正向转移更明显。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05383 2026-04-08 cs.AI

Towards Effective In-context Cross-domain Knowledge Transfer via Domain-invariant-neurons-based Retrieval

通过领域不变神经元的检索实现有效的跨领域知识转移

Jianzhi Yan, Zhiming Li, Le Liu, Zike Yuan, Shiwei Chen, Youcheng Pan, Buzhou Tang, Yang Xiang, Danny Dongning Sun

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Pengcheng Laboratory, Shenzhen, China(鹏城实验室)

AI总结 本文提出领域不变神经元检索方法,用于提升大语言模型在跨领域推理中的性能,实验表明方法在数学和逻辑推理迁移中平均提升1.8。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04972 2026-04-08 cs.CV

RCP: Representation Consistency Pruner for Mitigating Distribution Shift in Large Vision-Language Models

RCP:一种用于缓解大视觉-语言模型中分布偏移的表示一致性剪枝方法

Jianwei Zhang, Chaoning Zhang, Sihan Cao, Wang Liu, Pengcheng Zheng, Jiaxin Huang, Caiyan Qin, Yalan Ye, Wei Dong, Yang Yang

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Machine Learning Department, Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学机器学习系) School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机器人与先进制造学院)

AI总结 本文提出RCP框架,通过累积视觉token剪枝与延迟修复机制,有效缓解大视觉-语言模型中的分布偏移问题,实验表明可剪除高达88.9%的视觉token并减少85.7%的FLOPs,同时保持较低的精度损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04942 2026-04-08 cs.CL cs.AI

TDA-RC: Task-Driven Alignment for Knowledge-Based Reasoning Chains in Large Language Models

TDA-RC:基于任务驱动的知识推理链对齐方法

Jiaquan Zhang, Qigan Sun, Chaoning Zhang, Xudong Wang, Zhenzhen Huang, Yitian Zhou, Pengcheng Zheng, Chi-lok Andy Tai, Sung-Ho Bae, Zeyu Ma, Caiyan Qin, Jinyu Guo, Yang Yang, Hengtao Shen

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) College of Professional and Continuing Education, The Hong Kong Polytechnic University(香港理工大学专业及持续教育学院) School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机电工程与自动化学院) School of Computing, Kyung Hee University(庆熙大学计算机学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

AI总结 本文提出TDA-RC方法,通过拓扑学优化提升大语言模型推理效率与准确性,结合持久同调将不同推理范式统一到拓扑空间中,实现高效且精准的推理链优化。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01955 2026-04-08 cs.CV

MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization

MotionAdapter: 通过内容感知注意力定制实现视频动作迁移

Zhexin Zhang, Yangyang Xu, Yifeng Zhu, Long Chen, Yong Du, Shengfeng He, Jun Yu

机构 * Hangzhou Dianzi University(杭州电子科技大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) The Hong Kong University of Science and Technology(香港科技大学) Ocean University of China(中国海洋大学) Singapore Management University(新加坡管理大学)

AI总结 本文提出MotionAdapter框架,通过解耦动作与外观并自适应定制动作,实现DiT视频扩散模型中的稳健动作迁移,实验表明其在质量和定量评估中优于现有方法,支持复杂动作迁移与编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03863 2026-04-08 cs.RO cs.LG

STAR: Learning Diverse Robot Skill Abstractions through Rotation-Augmented Vector Quantization

STAR:通过旋转增强的向量量化学习多样化的机器人技能抽象

Hao Li, Qi Lv, Rui Shao, Xiang Deng, Yinchuan Li, Jianye Hao, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)计算机科学与技术学院) Huawei Noah's Ark Lab(华为诺亚方舟实验室)

AI总结 STAR通过旋转增强的向量量化和因果技能变压器,提升机器人技能学习与组合,实现复杂行为完成,在LIBERO基准和现实任务中表现优越。

Comments Accepted by ICML 2025 Spotlight

Journal ref Proceedings of the 42st International Conference on Machine Learning, PMLR 267, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏