arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

共收录 1226
2603.12788 2026-03-23 cs.CV

Think and Answer ME: Benchmarking and Exploring Multi-Entity Reasoning Grounding in Remote Sensing

思考并回答ME:基准测试和探索遥感中的多实体推理 grounding

Shuchang Lyu, Haiquan Wen, Guangliang Cheng, Meng Li, Zheng Zhou, You Zhou, Dingding Yao, Zhenwei Shi

机构 * Beihang University, Beijing, China(北京航空航天大学) University of Liverpool, Liverpool, UK(利物浦大学) Institute of Acoustics, Chinese Academy of Sciences, Beijing, China(中国科学院声学研究所)

AI总结 本文提出ME-RSRG基准数据集,通过Entity-Aware Reasoning框架提升遥感多实体推理能力,验证了该框架的有效性。

Comments 22 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15160 2026-03-23 cs.CV

EagleVision: A Dual-Stage Framework with BEV-grounding-based Chain-of-Thought for Spatial Intelligence

EagleVision:基于BEV的双阶段框架用于空间智能

Jiaxu Wan, Xu Wang, Mengwei Xie, Hang Zhang, Mu Xu, Yang Han, Hong Zhang, Ding Yuan, Yifan Yang

机构 * Atlas Lab(Atlas实验室) School of Aerospace, BUAA(北京航空航天大学航空学院) School of Software, BUAA(北京航空航天大学软件学院) State Key Laboratory of HERATT(HERATT国家重点实验室) Key Laboratory of SDODS (MOE) Project(SDODS重点实验室(教育部))

AI总结 EagleVision通过结合几何感知帧选择与主动BEV推理,提升视频空间推理能力,实现空间感知与验证的闭环循环。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19206 2026-03-20 cs.CV

RPiAE: A Representation-Pivoted Autoencoder Enhancing Both Image Generation and Editing

RPiAE:一种基于表示的自编码器,同时增强图像生成和编辑

Yue Gong, Hongyu Li, Shanyuan Liu, Bo Cheng, Yuhang Ma, Liebucha Wu, Xiaoyu Wu, Manyuan Zhang, Dawei Leng, Yuhui Yin, Lijun Zhang

机构 * Beihang University(北航大学) AI Research(360人工智能研究院) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出RPiAE,一种基于表示的自编码器,通过引入表示偏转正则化和变分桥梁,提升图像生成和编辑的性能,实验表明其在文本到图像生成和图像编辑中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11101 2026-03-20 cs.RO cs.AI cs.DC

Thousand-GPU Large-Scale Training and Optimization Recipe for AI-Native Cloud Embodied Intelligence Infrastructure

千GPU大规模训练与优化方案用于AI原生云具身智能基础设施

Yongjian Guo, Yunxuan Ma, Haoran Sun, Zhong Guan, Shuai Di, Jing Long, Wanting Xu, Xiaodong Bai, Wen Huang, Yucheng Guo, Chen Zhou, Qiming Yang, Mingxi Luo, Tianyun Zhao, Hedan Yang, Song Wang, Xiaomeng Tian, Xiaolong Xiang, Zhen Sun, Yu Wei, Luqiao Wang, Yuzhen Li, Chenfeng Gu, Junwu Xiong, Yicheng Gong

机构 * AI Infra Team at JDT(JDT人工智能基础设施团队) Tsinghua University(清华大学) Peking University(北京大学) Tianjin University(天津大学) Beihang University(北洋大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出一种基于LeRobot框架的千GPU分布式训练平台,通过优化数据流程、训练效率和基础设施,实现具身智能模型训练速度提升40倍,推动下一代自主智能机器人发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16426 2026-03-20 cs.CV

DynamicVis: Dynamic Visual Perception for Efficient Remote Sensing Foundation Models

DynamicVis: 面向高效遥感基础模型的动态视觉感知

Keyan Chen, Chenyang Liu, Bowen Chen, Wenyuan Li, Zhengxia Zou, Shijian Lu, Zhenwei Shi

机构 * Beihang University(北航大学) Nanyang Technological University(南洋理工大学) University of Hong Kong(香港大学)

AI总结 本文提出DynamicVis,针对遥感图像稀疏性设计,通过动态区域感知SSM和元嵌入MIL预训练,提升稀疏目标感知性能,尤其在小目标检测和变化检测中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17809 2026-03-19 cs.CV cs.AI

Fine-Grained Post-Training Quantization for Large Vision Language Models with Quantization-Aware Integrated Gradients

细粒度后训练量化用于大型视觉语言模型的量化感知集成梯度

Ziwei Xiang, Fanhu Zeng, Hongjian Fang, Rui-Qi Wang, Renxing Chen, Yanan Zhu, Yi Chen, Peipei Yang, Xu-Yao Zhang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(多模态人工智能系统国家重点实验室,中国科学院自动化所) School of Artificial Intelligence, UCAS(人工智能学院,中国科学院大学) Beijing National Research Center for Information Science and Technology(北京信息科学研究中心) Institute of Artificial Intelligence, USTB(信息科学技术大学人工智能学院) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Zhongguancun Academy(中关村学院)

AI总结 本文提出细粒度后训练量化方法,通过量化感知集成梯度评估token敏感性,提升大型视觉语言模型的精度与效率。

Comments Accepted by CVPR 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17161 2026-03-19 cs.CV

GazeOnce360: Fisheye-Based 360° Multi-Person Gaze Estimation with Global-Local Feature Fusion

GazeOnce360:基于鱼眼的360°多人凝视估计与全局-局部特征融合

Zhuojiang Cai, Zhenghui Sun, Feng Lu

机构 * State Key Laboratory of VR Technology and Systems, School of CSE, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学计算机科学与工程学院)

AI总结 本文提出GazeOnce360,一种端到端模型,用于从单个桌面安装的向上鱼眼摄像头估计多人凝视方向。通过引入MPSGaze360大规模合成数据集,融合全局低分辨率上下文与高分辨率局部眼区,解决鱼眼图像的严重失真和视角变化问题。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10489 2026-03-19 cs.LG cs.AI

Learning Adaptive Distribution Alignment with Neural Characteristic Function for Graph Domain Adaptation

基于神经特征函数的自适应分布对齐用于图域适应

Wei Chen, Xingyu Guo, Shuang Li, Zhao Zhang, Yan Zhong, Fuzhen Zhuang, Deqing wang

机构 * School of Artificial Intelligence, Beihang University(北航人工智能学院) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) School of Mathematical Sciences, Peking University(北大数学系) Zhongguancun Laboratory(中关村实验室)

AI总结 本文提出ADAlign框架,通过自适应分布对齐解决图域适应中的分布偏移问题,利用神经谱差异衡量跨图偏移,实现灵活且鲁棒的域适应。

Comments Accepted by ICLR 2026, 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23728 2026-03-19 cs.CV cs.AI

M3DLayout: A Multi-Source Dataset of 3D Indoor Layouts and Structured Descriptions for 3D Generation

M3DLayout:一个多源的3D室内布局及结构描述数据集用于3D生成

Yiheng Zhang, Zhuojiang Cai, Mingdao Wang, Meitong Guo, Tianxiao Li, Li Lin, Yuwang Wang

机构 * Tsinghua University(清华大学) Beihang University(北京航空航天大学) Migu Beijing Research Institute(咪咕北京研究院)

AI总结 本文提出M3DLayout数据集,包含21367个布局和433k个物体实例,整合真实扫描、专业CAD设计和程序生成场景,为3D生成模型提供多样化的空间和语义学习基础。

Comments CVPR 2026; Project Page: https://graphic-kiliani.github.io/M3DLayout/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06231 2026-03-19 cs.CV

RSRefSeg 2: Decoupling Referring Remote Sensing Image Segmentation with Foundation Models

RSRefSeg 2: 解耦引用遥感图像分割与基础模型

Keyan Chen, Chenyang Liu, Bowen Chen, Jiafan Zhang, Zhengxia Zou, Zhenwei Shi

机构 * Beihang University(北京航空航天大学)

AI总结 RSRefSeg 2通过解耦传统三阶段流程,提出双阶段协作框架,结合CLIP的跨模态对齐与SAM的分割泛化能力,提升遥感图像分割精度与复杂语义解释能力。

Journal ref IEEE Transactions on Geoscience and Remote Sensing, vol. 64, pp. 1-20, 2026, Art no. 4700420

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16495 2026-03-18 cs.AI

ExpressMind: A Multimodal Pretrained Large Language Model for Expressway Operation

ExpressMind:一种用于高速公路运营的多模态预训练大语言模型

Zihe Wang, Yihuan Wang, Haiyang Yu. Zhiyong Cui, Xiaojian Liao, Chengcheng Wang, Yonglin Tian, Yongxin Tong

机构 * Beihang University(北航) Shandong Hi-speed Group Co., Ltd(山东高速集团有限公司) Institute of automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本文提出ExpressMind,一种针对高速公路运营的多模态预训练大语言模型,通过构建全栈数据集和双层预训练方法,提升事件检测、安全响应生成和复杂交通分析能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16223 2026-03-18 cs.LG

Dual Consensus: Escaping from Spurious Majority in Unsupervised RLVR via Two-Stage Vote Mechanism

双重共识:通过两阶段投票机制摆脱无监督RLVR中的虚假多数

Kaixuan Du, Meng Cao, Hang Zhang, Yukun Wang, Xiangzhou Huang, Ni Li

机构 * School of Automation Science and Electrical Engineering, Beihang University(北航自动化科学与电气工程学院)

AI总结 本文提出DCRL,通过两阶段共识机制生成更可靠的训练信号,提升大语言模型在复杂推理任务中的表现,避免陷入主导模式。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15011 2026-03-18 cs.CV

Molecular Identifier Visual Prompt and Verifiable Reinforcement Learning for Chemical Reaction Diagram Parsing

分子标识视觉提示与可验证强化学习用于化学反应图解析

Jiahe Song, Chuang Wang, Yinfan Wang, Hao Zheng, Rui Nie, Bowen Jiang, Xingjian Wei, Junyuan Gao, Yubin Wang, Bin Wang, Lijun Wu, Jiang Wu, Qian Yu, Conghui He

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Peking University(北京大学) South China Normal University(华南师范大学)

AI总结 本文提出IdtVP和Re3-DAPO方法,通过视觉提示和强化学习提升化学反应图解析的准确性和泛化能力,同时发布ScannedRxn基准数据集以评估模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10376 2026-03-18 cs.CV cs.RO

MSGNav: Unleashing the Power of Multi-modal 3D Scene Graph for Zero-Shot Embodied Navigation

MSGNav: 释放多模态3D场景图在零样本具身导航中的潜力

Xun Huang, Shijia Zhao, Yunxiang Wang, Xin Lu, Wanfa Zhang, Rongsheng Qu, Weixin Li, Yunhong Wang, Chenglu Wen

机构 * Fujian Key Laboratory of Urban Intelligent Sensing and Computing(福建智能感知与计算重点实验室) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China(多媒体可信感知与高效计算重点实验室) Beihang University(北航) Nanyang Technological University(南洋理工大学) University of Chinese Academy of Sciences(中国科学院大学) Zhongguancun Academy(中关村学院)

AI总结 MSGNav通过多模态3D场景图实现零样本具身导航,引入关键子图选择模块、自适应词汇更新模块和闭环推理模块,解决开放词汇和视觉证据保留问题,实验表明其在GOAT-Bench和HM3D-ObjNav基准上表现优异。

Comments 18 pages, Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.02007 2026-03-18 cs.RO cs.SY eess.SY

Mixed Cloud Control Testbed: Validating Vehicle-Road-Cloud Integration via Mixed Digital Twin

混合云控制测试床:通过混合数字孪生验证车辆-道路-云集成

Jianghong Dong, Qing Xu, Jiawei Wang, Chunying Yang, Mengchi Cai, Chaoyi Chen, Jianqiang Wang, Keqiang Li

机构 * Tsinghua University-Didi Joint Research Center for Future Mobility(清华大学-滴滴未来移动联合研究中心) Beihang University(北航) Beijing Idriverplus Technology Co., Ltd.(北京 Idriverplus 技术有限公司) Dongfeng Automobile Co., Ltd.(东风汽车有限公司)

AI总结 本文提出混合云控制测试床,通过混合数字孪生技术验证车辆-道路-云集成,展示了多车辆协同的灵活性和可扩展性。

Comments 13 pages, 13 figures

Journal ref 2023 in IEEE Transactions on Intelligent Vehicles

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15696 2026-03-18 cs.LG cs.AI

Tackling Over-smoothing on Hypergraphs: A Ricci Flow-guided Neural Diffusion Approach

应对超图上的过平滑问题:一种基于里奇流的神经扩散方法

Mengyao Zhou, Zhiheng Zhou, Xiao Han, Xingqin Qi, Guanghui Wang, Guiying Yan

机构 * Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) University of Chinese Academy of Sciences(中国科学院大学) School of Mathematics and Statistics, Shandong University(山东大学数学与统计学院) School of Artificial Intelligence, Beihang University(北航人工智能学院) School of Mathematics, Shandong University(山东大学数学学院)

AI总结 本文提出基于里奇流的超图神经扩散方法,通过调节节点特征演化缓解过平滑问题,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15054 2026-03-17 cs.AI

Interference-Aware K-Step Reachable Communication in Multi-Agent Reinforcement Learning

考虑干扰的多智能体强化学习中的K步可达通信

Ziyu Cheng, Jinsheng Ren, Zhouxian Jiang, Chenzhihang Li, Rongye Shi, Bin Liang, Jun Yang

机构 * School of Software, Beihang University(软件学院,北航) School of Artificial Intelligence, Beihang University(人工智能学院,北航)

AI总结 本文提出IA-KRC框架,通过K步可达协议和干扰预测模块提升多智能体协作效率,克服环境干扰,实现更持久高效的协作。

Comments multi-agent reinforcement learning, communication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13427 2026-03-17 cs.CV cs.AI

MIBench: Evaluating LMMs on Multimodal Interaction

MIBench: 评估大多模态模型在多模态交互中的能力

Yu Miao, Zequn Yang, Yake Wei, Ziheng Chen, Haotian Ni, Haodong Duan, Kai Chen, Di Hu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学人工智能学院,北京,中国) Beijing Key Laboratory of Research on Large Models(大型模型研究关键实验室) Beihang University, Beijing, China(北京航空航天大学,北京,中国) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)

AI总结 MIBench通过多模态交互三元组评估大模型在多模态任务中的能力,发现模型在多模态交互上存在局限性,易受文本干扰,且在基础协同能力上表现不足。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02090 2026-03-17 cs.CV

All-weather Multi-Modality Image Fusion: Unified Framework and 100k Benchmark

全天候多模态图像融合:统一框架与10万基准

Xilai Li, Wuyang Liu, Xiaosong Li, Fuqiang Zhou, Huafeng Li, Feiping Nie

机构 * Guangdong-HongKong-Macao Joint Laboratory for Intelligent MicroNano Optoelectronic Technology(粤港澳联合智能微纳光电子技术实验室) School of Physics and Optoelectronic Engineering, Foshan University(佛山大学物理与光电工程学院) Guangdong Provincial Key Laboratory of Industrial Intelligent Inspection Technology(广东省工业智能检测技术重点实验室) School of Instrumentation and Optoelectronic Engineering, Beihang University(北京航空航天大学仪器与光电工程学院) School of Information Engineering and Automation, Kunming University of Science and Technology(昆明理工大学信息工程与自动化学院) School of Artificial Intelligence, Optics and Electronics (i0PEN), School of Computer Science, Northwestern Polytechnical University(人工智能、光学与电子学院(i0PEN),西北工业大学计算机学院)

AI总结 本文提出统一的全天候多模态图像融合框架,通过联合特征融合与恢复提升关键场景信息表征,构建10万张图像对的多模态数据集,实验证明在真实和合成场景中图像融合及下游任务表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00304 2026-03-16 cs.LG

Invariant Graph Transformer for Out-of-Distribution Generalization

不变式图变换器用于分布外泛化

Tianyin Liao, Ziwei Zhang, Yufei Sun, Chunyu Hu, Jianxin Li

机构 * Nankai University(南开大学) Beihang University(北京航空航天大学)

AI总结 本文提出GOODFormer,通过联合优化三个模块学习通用图表示,旨在解决分布偏移下的图结构泛化问题。

Comments Accepted by ACM SIGKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18632 2026-03-16 cs.CV cs.AI

Think with 3D: Geometric Imagination Grounded Spatial Reasoning from Limited Views

用3D思考:从有限视角出发的几何想象引导的空间推理

Zhangquan Chen, Manyuan Zhang, Xinlei Yu, Xufang Luo, Mingze Sun, Zihao Pan, Xiang An, Yan Feng, Peng Pei, Xunliang Cai, Ruqi Huang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Meituan(美团) National University of Singapore(新加坡国立大学) Beihang University(北航) LMMs-Lab(LMMs实验室)

AI总结 本文提出3DThinker框架,通过利用图像中的丰富几何信息实现空间推理,无需3D先验输入或显式标注3D数据,在多个基准测试中优于现有方法。

Comments 25 pages, 17 figures

Journal ref CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12193 2026-03-13 cs.RO cs.CV

SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics

SaPaVe:迈向视觉-语言-动作模型中的主动感知与操作

Mengzhen Liu, Enshen Zhou, Cheng Chi, Yi Han, Shanyu Rong, Liming Chen, Pengwei Wang, Zhongyuan Wang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息多媒体国家重点实验室,计算机科学学院,北京大学) School of Software, Beihang University(软件学院,北航) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 SaPaVe通过解耦相机与操作动作,结合自下而上训练策略,实现高效且可推广的主动感知与操作,在现实任务中成功率达31.25%。

Comments Accepted to CVPR 2026. See project page at https://lmzpai.github.io/SaPaVe

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11125 2026-03-13 stat.ML cs.LG

Co-Diffusion: An Affinity-Aware Two-Stage Latent Diffusion Framework for Generalizable Drug-Target Affinity Prediction

Co-Diffusion:一种面向亲和力的两阶段潜在扩散框架用于通用化药物-靶点亲和力预测

Yining Qian, Pengjie Wang, Yixiao Li, An-Yang Lu, Cheng Tan, Shuang Li, Lijun Liu

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) College of Information Science and Engineering, Northeastern University(东北大学信息科学与工程学院) Westlake University(西湖大学) School of Artificial Intelligence, Beihang University(北航人工智能学院) Key Laboratory of Bioresource Research and Development of Liaoning Province, College of Life and Health Sciences, Northeastern University(辽宁省生物资源研究开发重点实验室,东北大学生命与健康科学学院)

AI总结 Co-Diffusion通过两阶段潜在扩散框架提升药物-靶点亲和力预测的泛化能力,解决冷启动问题并增强零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09774 2026-03-11 cs.AI

World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Models

World2Mind: 用于基础模型的方位认知工具包

Shouwei Ruan, Bin Wang, Zhenyu Wu, Qihui Zhu, Yuxiang Zhang, Hang Su, Yubin Wang

机构 * Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学人工智能院计算机科学与技术系、清华大学-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学)

AI总结 World2Mind通过构建空间认知地图和三阶段推理链,提升基础模型的空间推理能力,使纯文本模型也能实现复杂3D空间推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09541 2026-03-11 cs.CV cs.MM

Memory-Guided View Refinement for Dynamic Human-in-the-loop EQA

动态人机交互EQA中的记忆引导视角细化

Xin Lu, Rui Li, Xun Huang, Weixin Li, Chuanqing Zhuang, Jiayuan Li, Zhengda Lu, Jun Xiao, Yunhong Wang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Zhongguancun Academy(中关村学院) Beihang University(北京航空航天大学) Ministry of Education of China, Xiamen University(中华人民共和国教育部、厦门大学) School of Automation, Beijing Institute of Technology(北京理工大学自动化学院)

AI总结 DynHiL-EQA数据集提出动态人机交互EQA的挑战,DIVRR框架通过相关性引导的视角细化和选择性记忆选择,提升遮挡鲁棒性和推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09113 2026-03-11 cs.RO cs.AI

PM-Nav: Priori-Map Guided Embodied Navigation in Functional Buildings

PM-Nav:基于先验图的功能性建筑中具身导航

Jiang Gao, Xiangyu Dong, Haozhou Li, Haoran Zhao, Yaoming Zhou, Xiaoguang Ma

机构 * Faculty of Robot Science and Engineering at Northeastern University(东北大学机器人科学与工程学院) Foshan Graduate School of Innovation at Northeastern University(东北大学佛山创新研究生学院) School of Aeronautic Science and Engineering at Beihang University(北航航空科学与工程学院)

AI总结 PM-Nav通过构建先验图和多模型协作机制,提升了功能性建筑中的导航精度和效率。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00097 2026-03-11 cs.LG cs.AI

GraphKeeper: Graph Domain-Incremental Learning via Knowledge Disentanglement and Preservation

GraphKeeper: 通过知识解耦与保留实现图领域增量学习

Zihao Guo, Qingyun Sun, Ziwei Zhang, Haonan Yuan, Huiping Zhuang, Xingcheng Fu, Jianxin Li

机构 * SKLCCSE, School of Computer Science and Engineering, Beihang University(信息与通信工程学院,北京航空航天大学) Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(智能工程学院,华南理工大学) Key Lab of Education Blockchain and Intelligent Technology, Guangxi Normal University(教育区块链与智能技术重点实验室,广西师范大学)

AI总结 GraphKeeper通过知识解耦与保留解决图领域增量学习中的灾难性遗忘问题,实现跨多领域稳定学习。

Comments Accepted by the Main Track of NeurIPS-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08817 2026-03-11 cs.RO

HMR-1: Hierarchical Massage Robot with Vision-Language-Model for Embodied Healthcare

HMR-1: 基于视觉-语言模型的分层按摩机器人用于具身医疗

Rongtao Xu, Mingming Yu, Xiaofeng Han, Yu Zhang, Kaiyi Hu, Zhe Feng, Zenghuang Fu, Changwei Wang, Weiliang Meng, Xiaopeng Zhang

机构 * The State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences, China(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) Spatiotemporal AI, China(时空人工智能,中国) Hangzhou International Innovation Institute, Beihang University, China(杭州国际创新研究院,北航,中国) Georgia Institute of Technology, China(佐治亚理工学院,中国) Key Laboratory of Computing Power Network and Information Security, Ministry of Education(计算功率网络与信息安全重点实验室,教育部;山东省计算机科学中心,齐鲁工业大学(山东省科学院),中国) Shandong Computer Science Center, Qilu University of Technology (Shandong Academy of Sciences), China

AI总结 HMR-1提出基于视觉-语言模型的分层按摩机器人框架,通过构建多模态数据集和微调Qwen-VL模型,实现了具身医疗任务的评估与应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08321 2026-03-10 cs.AI

CORE-Acu: Structured Reasoning Traces and Knowledge Graph Safety Verification for Acupuncture Clinical Decision Support

CORE-Acu: 结构化推理轨迹与知识图谱安全验证用于针灸临床决策支持

Liuyi Xu, Yun Guo, Ming Chen, Zihan Dun, Yining Qian, An-Yang Lu, Shuang Li, Lijun Liu

机构 * College of Information Science and Engineering, Northeastern University, Shenyang 110819, China(信息科学与工程学院,东北大学,沈阳110819,中国) School of Information Science and Engineering, Yanshan University, Qinhuangdao, Hebei 066000, China(信息科学与工程学院,燕山大学,秦皇岛,河北省066000,中国) School of Computer Science and Engineering, Northeastern University, Shenyang 110819, China(计算机科学与工程学院,东北大学,沈阳110819,中国) School of Artificial Intelligence, Beihang University, Beijing 100000, China(人工智能学院,北航,北京100000,中国) Key Laboratory of Bioresource Research and Development of Liaoning Province, Northeastern University, Shenyang 110169, China(辽宁省生物资源研究开发重点实验室,东北大学,沈阳110169,中国) College of Life and Health Sciences, Northeastern University, Shenyang 110169, China(生命与健康科学学院,东北大学,沈阳110169,中国)

AI总结 CORE-Acu通过结构化推理轨迹与知识图谱安全验证,提升针灸临床决策支持的可解释性与安全性。

Comments 19 pages, 5 figures, 18 tables. Includes the Acu-Reasoning dataset and TCM knowledge graph schema

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07896 2026-03-10 cs.CL

ACE: Attribution-Controlled Knowledge Editing for Multi-hop Factual Recall

ACE:基于多跳事实回忆的归因控制知识编辑

Jiayu Yang, Yuxuan Fan, Songning Lai, Shengen Wu, Jiaqi Tang, Chun Kang, Zhijiang Guo, Yutao Yue

机构 * HKUST(GZ) Deep Interdisciplinary Intelligence Lab(香港科技大学(广州)深 interdisciplinary 智能实验室) BUAA(北京航空航天大学) HKUST(GZ) Institute of Deep Perception Technology, JITRI Deep Interdisciplinary Intelligence Lab(香港科技大学(广州)深度感知技术研究所,JITRI 深 interdisciplinary 智能实验室)

AI总结 ACE通过神经元归因控制实现多跳事实回忆中的知识编辑,提升KE性能。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏