arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3042
2510.18876 2026-03-06 cs.CV cs.AI cs.CL

Grasp Any Region: Towards Precise, Contextual Pixel Understanding for Multimodal LLMs

抓取任意区域:迈向多模态大语言模型的精确、上下文像素理解

Haochen Wang, Yuhao Wang, Tao Zhang, Yikang Zhou, Yanwei Li, Jiacong Wang, Jiani Zheng, Ye Tian, Jiahao Meng, Zilong Huang, Guangcan Mai, Anran Wang, Yunhai Tong, Zhuochen Wang, Xiangtai Li, Zhaoxiang Zhang

机构 * New Laboratory of Pattern Recognition (NLPR), State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences (CASIA)(模式识别新实验室、多模态人工智能系统国家重点实验室、自动化研究所、中国科学院(CASIA)) University of Chinese Academy of Sciences(中国科学院大学) Peking University(北京大学) Wuhan University(武汉大学) ByteDance(字节跳动)

AI总结 GAR通过RoI对齐特征重放技术实现多区域精准理解与复杂推理,提升多模态大语言模型的上下文感知能力。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16714 2026-03-06 cs.CV cs.AI

SceneCOT: Eliciting Grounded Chain-of-Thought Reasoning in 3D Scenes

SceneCOT: 在3D场景中引导链式推理

Xiongkun Linghu, Jiangyong Huang, Ziyu Zhu, Baoxiong Jia, Siyuan Huang

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Peking University(北京大学) Tsinghua University(清华大学)

AI总结 本文提出SCENECOT框架,通过分解复杂任务并构建视觉线索,首次在3D场景中实现 grounded 链式推理,提升场景理解的推理能力。

Comments Accepted by ICLR 2026. Project page: https://scenecot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08966 2026-03-06 cs.AI cs.CL

Beyond Prefixes: Graph-as-Memory Cross-Attention for Knowledge Graph Completion with Large Language Models

超越前缀:基于图记忆的交叉注意力用于大型语言模型的知识图谱补全

Ruitong Liu, Boxu Lin, Peize Li, Siyuan Li, Yunjia Wu, Te Sun, Chaohan Wu

机构 * Peking University(北京大学) Dalian University of Technology(大连理工大学) King’s College London(伦敦国王学院) Peng Cheng Laboratory(鹏城实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出图记忆调优方法,通过深度交叉注意力机制提升大型语言模型在知识图谱补全任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09769 2026-03-06 eess.SY cs.FL cs.RO cs.SY

Risk-Aware Autonomous Driving with Linear Temporal Logic Specifications

具有线性时序逻辑规范的风险感知自主驾驶

Shuhao Qi, Zengjie Zhang, Zhiyong Sun, Sofie Haesaert

机构 * Department of Electrical Engineering, Eindhoven University of Technology(电子工程系,埃因霍温理工大学) College of Engineering, Peking University(工程学院,北京大学)

AI总结 本文提出一种基于线性时序逻辑规范的风险感知自动驾驶方法,通过扩展风险度量方法以涵盖更复杂的驾驶场景,结合线性规划解决控制合成问题,从而平衡碰撞风险和交通违规风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04379 2026-03-05 cs.CV

Helios: Real Real-Time Long Video Generation Model

Helios:实时长视频生成模型

Shenghai Yuan, Yuanyang Yin, Zongjian Li, Xinwei Huang, Xiao Yang, Li Yuan

机构 * Peking University(北京大学)

AI总结 Helios是首个无需并行框架、能实时生成长视频且质量媲美基线模型的14B视频生成模型。

Comments Page: pku-yuangroup.github.io/Helios-Page

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04289 2026-03-05 cs.LG cs.AI

IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning

IPD: 通过离线规划蒸馏提升序列策略

Yihao Qin, Yuanfei Wang, Hang Zhou, Peiran Liu, Hao Dong, Yiding Ji

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学)

AI总结 IPD通过引入离线规划蒸馏技术,提升离线强化学习中序列策略的决策稳定性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03995 2026-03-05 cs.LG cs.AI

Spectral Surgery: Training-Free Refinement of LoRA via Gradient-Guided Singular Value Reweighting

谱手术:通过梯度引导的奇异值重新加权实现LoRA的训练免费优化

Zailong Tian, Yanzhe Chen, Zhuoheng Han, Lizi Liao

机构 * School of Computing(计算学院) Information Systems, Singapore Management University(信息系统,新加坡管理大学) School of Computing, National University of Singapore(计算学院,新加坡国立大学) State Key Laboratory for Multimedia Information Processing, Peking University(多媒体信息处理国家重点实验室,北京大学)

AI总结 Spectral Surgery通过梯度引导的奇异值重新加权优化LoRA适配器,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03615 2026-03-05 cs.CV

Parallax to Align Them All: An OmniParallax Attention Mechanism for Distributed Multi-View Image Compression

视差对齐所有内容:一种用于分布式多视图图像压缩的 OmniParallax 注意机制

Haotian Zhang, Feiyue Long, Yixin Yu, Jian Xue, Haocheng Tang, Tongda Xu, Zhenning Shi, Yan Wang, Siwei Ma, Jiaqi Zhang

机构 * The National Engineering Laboratory for Video Technology, School of Computer Science, Peking University(国家视频技术工程实验室,计算机科学学院,北京大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

AI总结 ParaHydra通过OmniParallax注意机制和多信息融合模块,实现了分布式多视图图像压缩的高效编码与解码,显著提升压缩效率并降低计算开销

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24065 2026-03-05 cs.CV

EvalMVX: A Unified Benchmarking for Neural 3D Reconstruction under Diverse Multiview Setups

EvalMVX: 一种用于神经3D重建的统一基准测试,适用于多样化的多视角设置

Zaiyan Yang, Jieji Ren, Xiangyi Wang, zonglin li, Xu Cao, Heng Guo, Zhanyu Ma, Boxin Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院) Xiong’an Aerospace Information Research Institute(雄安航空航天信息研究所) State Key Laboratory of Multimedia Information Processing, School of Computer Science Peking University(北京大学计算机科学学院多媒体信息处理国家重点实验室)

AI总结 EvalMVX是一个包含25个物体的真实世界数据集,用于评估神经3D重建方法在不同多视角设置下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18707 2026-03-05 cs.RO

CLASH: Collision Learning via Augmented Sim-to-real Hybridization to Bridge the Reality Gap

CLASH:通过增强的仿真到现实混合化进行碰撞学习以弥合现实差距

Haotian He, Ning Guo, Siqi Shi, Qipeng Liu, Wenzhao Lian

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) School of Mathematical Sciences, Beijing Normal University(北京师范大学数学科学学院)

AI总结 CLASH通过增强的仿真到现实混合化方法,有效提升碰撞预测精度并减少仿真计算时间,增强机器人策略在现实中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10619 2026-03-05 cs.CV cs.AI

Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation

通过感知与推理增强改进医疗视觉强化微调

Guangjing Yang, ZhangYuan Yu, Ziyuan Qin, Xinyuan Song, Huahui Yi, Qingbo Kang, Jun Gao, Yiyue Li, Chenlin Du, Qicheng Lao

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Emory University(埃默里大学) Sichuan University(四川大学) Peking University(北京大学)

AI总结 本研究提出VRFT-Aug框架,通过增强感知与推理能力,改进医疗影像领域的强化微调效果,提升模型在医学应用中的可靠性与推理能力。

Comments CPAL 2026

Journal ref 2026 Conference on Parsimony and Learning (CPAL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07181 2026-03-05 cs.RO cs.AI cs.CV

TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics

TIGeR: 视觉-语言模型中集成工具的几何推理

Yi Han, Enshen Zhou, Shanyu Rong, Jingkun An, Pengwei Wang, Zhongyuan Wang, Cheng Chi, Lu Sheng, Shanghang Zhang

机构 * Beihang University(北洋大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机科学学院多媒体信息处理国家重点实验室)

AI总结 TIGeR通过集成工具实现视觉-语言模型的几何推理,提升机器人操作的精确度。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03284 2026-03-05 cs.AI

ToolVQA: A Dataset for Multi-step Reasoning VQA with External Tools

ToolVQA: 一个用于多步推理VQA的外部工具数据集

Shaofeng Yin, Ting Lei, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机科学技术研究院)

AI总结 ToolVQA是一个用于多步推理VQA的外部工具数据集,通过真实场景和复杂推理任务提升模型在现实工具使用中的泛化能力。

Comments Project page: https://fugtemypt123.github.io/ToolVQA-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15963 2026-03-05 cs.LG

On the Limits of Sparse Autoencoders: A Theoretical Framework and Reweighted Remedy

稀疏自编码器的局限性:一种理论框架和加权修复方法

Jingyi Cui, Qi Zhang, Yifei Wang, Yisen Wang

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(1 人工智能通用基础研究实验室,智能科学与技术学院,北京大学) Amazon AGI SF Lab(2 亚马逊人工智能实验室) Institute for Artificial Intelligence, Peking University(3 人工智能研究院,北京大学)

AI总结 本文提出了一种理论框架和加权修复方法,以解决稀疏自编码器在恢复真实单义特征时的局限性,通过改进特征恢复能力提升可解释性。

Comments Accepted to ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01317 2026-03-05 cs.LG cs.AI

Difficult Examples Hurt Unsupervised Contrastive Learning: A Theoretical Perspective

困难示例损害无监督对比学习:一种理论视角

Yi-Ge Zhang, Jingyi Cui, Qiran Li, Yisen Wang

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院人工智能国家重点实验室) School of Engineering, Hong Kong University of Science and Technology(香港科技大学工程学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 本文从理论角度探讨了困难示例对无监督对比学习的影响,发现移除困难示例可提升下游分类性能,并通过理论分析和实验证明了其有效性。

Comments Accepted to ICLR 2026 as an Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01654 2026-03-05 cs.LG

FSMLP: Modelling Channel Dependencies With Simplex Theory Based Multi-Layer Perceptions In Frequency Domain

FSMLP: 基于简单理论的多层感知机在频域中建模通道依赖性

Zhengnan Li, Haoxuan Li, Hao Wang, Jun Fang, Yuting Tan, Xilong Cheng Yunxiao Qin

机构 * Communication University of China(通信大学) Peking University(北京大学) Zhejiang University(浙江大学) Tsinghua University(清华大学)

AI总结 FSMLP通过引入简单体MLP层,有效缓解时间序列预测中通道依赖的过拟合问题,提升预测精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03195 2026-03-04 cs.CV cs.AI cs.RO

Chain of World: World Model Thinking in Latent Motion

链式世界:潜在运动中的世界模型思维

Fuxiang Yang, Donglin Di, Lulu Tang, Xuancheng Zhang, Lei Fan, Hao Li, Chen Wei, Tonghua Su, Baorui Ma

机构 * Harbin Institute of Technology(哈尔滨工业大学) Li Auto Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) University of New South Wales(新南威尔士大学) Chongqing Research Institute of HIT(哈尔滨工业大学重庆研究院) Peking University(北京大学)

AI总结 CoWVLA通过统一世界模型的时间推理与解耦的潜在运动表示,提升视觉-运动学习效率。

Comments Accepted by CVPR2026. Project page: https://fx-hit.github.io/cowvla-io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02908 2026-03-04 cs.AI

SAE as a Crystal Ball: Interpretable Features Predict Cross-domain Transferability of LLMs without Training

SAE作为水晶球:可解释特征预测LLM在跨领域迁移性无需训练

Qi Zhang, Yifei Wang, Xiaohan Wang, Jiajun Chai, Guojun Yin, Wei Lin, Yisen Wang

机构 * State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) Meituan(美团) Amazon AGI SF Lab(亚马逊人工智能SF实验室) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)

AI总结 本文提出基于SAE的迁移性评分(STS),通过识别模型偏移维度预测LLM在跨领域迁移性,无需训练即可评估迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02893 2026-03-04 cs.CV

Intrinsic Geometry-Appearance Consistency Optimization for Sparse-View Gaussian Splatting

内在几何-外观一致性优化用于稀疏视角高斯点绘制

Kaiqiang Xiong, Rui Peng, Jiahao Wu, Zhanke Wang, Jie Liang, Xiaoyun Zheng, Feng Gao, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(广东超高清沉浸媒体技术省重点实验室,深圳大学,北京大学) Peng Cheng Laboratory(鹏城实验室) Migu Culture Technology Co., Ltd(咪咕文化技术有限公司) Alibaba Group(阿里巴巴集团) School of Arts, Peking University(北京大学艺术学院)

AI总结 MVD-HuGaS通过多视角扩散模型实现从单张图像生成自由视角3D人体,结合几何-外观一致性优化提升重建保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02866 2026-03-04 cs.CV

Multimodal-Prior-Guided Importance Sampling for Hierarchical Gaussian Splatting in Sparse-View Novel View Synthesis

多模态先验引导的重要性采样用于稀疏视图新视图合成中的分层高斯点云

Kaiqiang Xiong, Zhanke Wang, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东超高清沉浸媒体技术重点实验室) Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Peng Cheng Laboratory(鹏城实验室) Migu Culture Technology Co., Ltd.(米果文化科技有限公司)

AI总结 本文提出多模态先验引导的重要性采样方法,用于稀疏视图新视图合成中的分层高斯点云,通过融合光度残差、语义和几何先验,提升重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25015 2026-03-04 cs.SE cs.AI

VeriStruct: AI-assisted Automated Verification of Data-Structure Modules in Verus

VeriStruct:基于AI的Verus数据结构模块自动化验证框架

Chuyue Sun, Yican Sun, Daneshvar Amrollahi, Ethan Zhang, Shuvendu Lahiri, Shan Lu, David Dill, Clark Barrett

机构 * Stanford University(斯坦福大学) School of Computer Science, Peking University(北京大学计算机学院) Microsoft Research(微软研究院)

AI总结 VeriStruct通过AI辅助自动化验证技术,实现了对数据结构模块的高效验证,成功验证了99.2%的函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08946 2026-03-04 q-bio.BM cs.LG

Physically Valid Biomolecular Interaction Modeling with Gauss-Seidel Projection

基于高斯-塞德尔投影的物理有效生物分子相互作用建模

Siyuan Chen, Minghao Guo, Caoliwen Wang, Anka He Chen, Yikun Zhang, Jingjing Chai, Yin Yang, Wojciech Matusik, Peter Yichen Chen

机构 * University of British Columbia(不列颠哥伦比亚大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) NVIDIA(英伟达) Peking University(北京大学) Foundry Biosciences(Foundry 生物科技) University of Utah(犹他大学)

AI总结 本文提出了一种基于高斯-塞德尔投影的生物分子相互作用建模方法,通过强制物理有效性约束提升结构准确性,实现高效且稳定的去噪过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22613 2026-03-04 cs.AI cs.CL cs.LG stat.ML

Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective

强化学习在语言模型规划中的利弊:一种理论视角

Siwei Wang, Yifei Shen, Haoran Sun, Shi Feng, Shang-Hua Teng, Li Dong, Yaru Hao, Wei Chen

机构 * Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Harvard University(哈佛大学) University of Southern California(南加州大学)

AI总结 本文从理论角度分析强化学习在语言模型规划中的利弊,揭示探索的重要性及Q学习在多样性保持方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14337 2026-03-04 eess.IV cs.CV

Unsupervised Deformable Image Registration with Local-Global Attention and Image Decomposition

无监督可变形图像配准与局部-全局注意力及图像分解

Zhengyong Huang, Xingwen Sun, Xuting Chang, Ning Jiang, Yao Wang, Jianfei Sun, Hongbin Han, Yao Sui

机构 * Institute of Medical Technology, Peking University Health Science Center(北京大学医学部医学技术研究所) National Institute of Health Data Science, Peking University(北京大学国家健康数据科学研究院) Department of Radiology, Peking University Third Hospital(北京大学第三医院放射科) Department of Pediatrics, Peking University First Hospital(北京大学第一医院儿科) Pediatric Epilepsy Center, Peking University First Hospital(北京大学第一医院儿童癫痫中心) School of Biological Science and Medical Engineering, Southeast University(东南大学生物科学与医学工程学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 本文提出LGANet++,通过局部-全局注意力机制和图像分解技术,实现更准确、鲁棒的无监督可变形图像配准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03027 2026-03-04 cs.LG

Lightweight Transformer for EEG Classification via Balanced Signed Graph Algorithm Unrolling

基于平衡符号图展开的轻量级变换器用于EEG分类

Junyi Yao, Parham Eftekhar, Gene Cheung, Xujin Chris Liu, Yao Wang, Wei Hu

机构 * Peking University(北京大学) York University(约克大学) New York University(纽约大学)

AI总结 本文提出基于平衡符号图展开的轻量级变换器,用于高效分类EEG信号,通过频谱去噪算法实现低通滤波,减少参数量同时保持分类性能。

Comments Accepted by ICLR2026, 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01984 2026-03-03 cs.SD cs.SC

ViTex: Visual Texture Control for Multi-Track Symbolic Music Generation via Discrete Diffusion Models

ViTex: 通过离散扩散模型实现多轨符号音乐生成的视觉纹理控制

Xiaoyu Yi, Qi He, Gus Xia, Ziyu Wang

机构 * School of EECS, Peking University(电子工程系,北京大学) Music X Lab, MBZUAI(音乐X实验室,MBZUAI) Courant Institute of Mathematical Sciences, New York University(数学科学学院,纽约大学)

AI总结 ViTex通过离散扩散模型实现多轨符号音乐生成的视觉纹理控制,结合乐器选择、音高时间及笔触属性,生成高质量音乐并支持纹理级操控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01951 2026-03-03 cs.LG math.OC stat.ML

Accelerating Single-Pass SGD for Generalized Linear Prediction

加速通用线性预测的单次SGD

Qian Chen, Shihong Ding, Cong Fang

机构 * Peking University(北京大学)

AI总结 本文提出了一种新型算法,通过数据依赖性近端方法实现双动量加速,解决了流式环境下一般线性预测中动量加速的有效性问题。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01948 2026-03-03 cs.CV

PreSight: Preoperative Outcome Prediction for Parkinson's Disease via Region-Prior Morphometry and Patient-Specific Weighting

PreSight:通过区域先验形态学和患者特异性加权进行帕金森病术前预后预测

Yand Wang, Chen Zhang, Lanyun Zhu, Yixin Chen, Qunbo Wang, Yutong Bai, Jurgen Germann, Yinghong Wen, Shuai Shao

机构 * Beijing Jiaotong University(北京交通大学) Nanyang Technological University(南洋理工大学) Institute of Medical Technology, Peking University(北京大学医学技术研究院) Beijing Tiantan Hospital, Capital Medical University(北京天坛医院) University Health Network, University of Toronto(多伦多大学健康网络) Suzhou Institute for Advanced Research, University of Science and Technology of China(中国科学技术大学苏州研究院)

AI总结 PreSight通过结合临床先验与区域自适应形态学,实现帕金森病术前预后预测,提升术后运动改善预测的准确性和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22948 2026-03-03 cs.CV

ToProVAR: Efficient Visual Autoregressive Modeling via Tri-Dimensional Entropy-Aware Semantic Analysis and Sparsity Optimization

ToProVAR:通过三维熵感知语义分析和稀疏优化实现高效的视觉自回归建模

Jiayu Chen, Ruoyu Lin, Zihao Zheng, Jingxin Li, Maoliang Li, Guojie Luo, Xiang Chen

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院) National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)

AI总结 ToProVAR通过三维熵感知语义分析和稀疏优化,提升视觉自回归模型的生成效率和质量。

Comments ToProVAR is honored to be accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18726 2026-03-03 cs.CV cs.LG

WiCompass: Oracle-driven Data Scaling for mmWave Human Pose Estimation

WiCompass:基于Oracle的数据扩展用于毫米波人体姿态估计

Bo Liang, Chen Gong, Haobo Wang, Qirui Liu, Rungui Zhou, Fengzhi Shao, Yubo Wang, Wei Gao, Kaichen Zhou, Guolong Cui, Chenren Xu

机构 * School of Computer Science, Peking University(北京大学计算机科学系) University of Electronic Science and Technology of China(电子科技大学) University of Pittsburgh(匹兹堡大学) Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电子工程与计算机科学系) Key Laboratory of High Confidence Software Technologies, Ministry of Education (PKU)(教育部高可信软件技术重点实验室(北京大学))

AI总结 WiCompass通过构建通用姿态空间oracle,实现基于覆盖意识的数据采集,提升毫米波人体姿态估计在分布偏移下的鲁棒性与泛化能力。

Comments This paper has been accepted by The 32nd Annual International Conference on Mobile Computing and Networking (MobiCom'26)

详情

展开后加载摘要…

URL PDF HTML 收藏