arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Beihang University(北京航空航天大学)

2026-03-24 至 2026-03-24 共收录 14
2603.22212 2026-03-24 cs.CV

Omni-WorldBench: Towards a Comprehensive Interaction-Centric Evaluation for World Models

Omni-WorldBench:迈向全面的交互导向的世界模型评估

Meiqi Wu, Zhixin Cai, Fufangchen Zhao, Xiaokun Feng, Rujing Dang, Bingze Song, Ruitian Tian, Jiashu Zhu, Jiachen Lei, Hao Dou, Jing Tang, Lei Sun, Jiahong Wu, Xiangxiang Chu, Zeming Liu, Kaiqi Huang

机构 * School of Computer Science and Technology, UCAS(UCAS计算机科学与技术学院) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, CASIA(复杂系统认知与决策智能重点实验室) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) State Key Laboratory of Networking and Switching Technology, BUPT(网络与交换技术国家重点实验室) AMAP, Alibaba Group(阿里妈妈实验室,阿里巴巴集团)

AI总结 本文提出Omni-WorldBench,一个针对4D世界模型交互响应能力的综合评估基准,通过Omni-WorldSuite和Omni-Metrics评估交互动作对状态转移的影响,分析现有模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21978 2026-03-24 cs.CV cs.GR

GeoFusion-CAD: Structure-Aware Diffusion with Geometric State Space for Parametric 3D Design

GeoFusion-CAD:基于几何状态空间的结构感知扩散模型用于参数化3D设计

Xiaolei Zhou, Chuangjie Fang, Jie Wu, Jingyi Yang, Boyi Lin, Jianwei Zheng

机构 * Zhejiang University of Technology(之江大学) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北航)

AI总结 本文提出GeoFusion-CAD,一种端到端扩散框架,通过几何状态空间建模实现长序列参数化3D设计生成,解决了传统方法在复杂几何拓扑依赖下的扩展性问题。

Comments Accepted to CVPR 2026 (Findings). Includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21669 2026-03-24 cs.RO cs.CV

PRM-as-a-Judge: A Dense Evaluation Paradigm for Fine-Grained Robotic Auditing

PRM-as-a-Judge:细粒度机器人审计的密集评估范式

Yuheng Ji, Yuyang Liu, Huajie Tan, Xuchuan Huang, Fanding Huang, Yijie Xu, Cheng Chi, Yuting Zhao, Huaihai Lyu, Peterson Co, Mingyu Cao, Qiongyu Zhang, Zhe Li, Enshen Zhou, Pengwei Wang, Zhongyuan Wang, Shanghang Zhang, Xiaolong Zheng

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学系,北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tsinghua University(清华大学) University of Sydney(悉尼大学) Beihang University(北航大学)

AI总结 本文提出PRM-as-a-Judge方法,通过过程奖励模型对轨迹视频进行密集评估,引入OPD指标系统,验证了宏一致性与微分辨率特性,揭示了主流策略在长周期任务中的行为特征与失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21663 2026-03-24 cs.CL

TAMTRL: Teacher-Aligned Reward Reshaping for Multi-Turn Reinforcement Learning in Long-Context Compression

TAMTRL:教师对齐的奖励重塑用于长上下文压缩中的多轮强化学习

Li Wang, Yandong Wang, Xin Yu, Kui Zhang, Tianhao Peng, Wenjun Wu

机构 * School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, Beihang University(北京航空航天大学未来区块链与隐私计算先进创新中心)

AI总结 针对多轮强化学习中长上下文压缩的信用分配问题,TAMTRL通过教师信号对齐和自监督奖励分配提升记忆更新质量,实验显示其在多个基准测试中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21577 2026-03-24 cs.AI

Mind over Space: Can Multimodal Large Language Models Mentally Navigate?

心灵超越空间:多模态大语言模型能否进行心理导航?

Qihui Zhu, Shouwei Ruan, Xiao Yang, Hao Jiang, Yao Huang, Shiji Zhao, Hanwei Fan, Hang Su, Xingxing Wei

机构 * Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学计算机科学与技术系) School of Automation Science and Electrical Engineering , Beihang University(北京航空航天大学自动化科学与电气工程学院) college of AI, Tsinghua University(清华大学人工智能学院) Department of Computer Science and Technology , Tsinghua University(清华大学计算机科学与技术系)

AI总结 本文提出Video2Mental基准测试,评估多模态大语言模型的空间导航能力,发现标准预训练模型无法自然生成空间表示,NavMind通过显式认知地图提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21574 2026-03-24 cs.AI

Adaptive Robust Estimator for Multi-Agent Reinforcement Learning

自适应稳健估计器用于多智能体强化学习

Zhongyi Li, Wan Tian, Jingyu Chen, Kangyao Huang, Huiming Zhang, Hui Yang, Tao Ren, Jinyang Jiang, Yijie Peng, Yikun Ban, Fuzhen Zhuang

机构 * Beihang University(北京理工大学) Peking University(北京大学) Chinese Academy of Sciences(中国科学院) Tsinghua University(清华大学) Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)

AI总结 本文提出自适应稳健估计器和双智能体回答-批判-重写框架,解决多智能体协作中的信用分配和奖励噪声问题,提升训练稳定性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21541 2026-03-24 cs.LG cs.AI

Sharper Generalization Bounds for Transformer

更精确的Transformer泛化界限

Yawen Li, Tao Hu, Zhouhui Lian, Wan Tian, Yijie Peng, Huiming Zhang, Zhongyi Li

机构 * School of Mathematical Sciences, Capital Normal University, 100048 Beijing, China(首都师范大学数学学院) Advanced Institute of Information Technology, Peking University(北京大学信息科学技术高级研究院) Wangxuan Institute of Computer Technology, Peking University, China, 100871(北京大学王先计算机技术研究所) PKU-Wuhan Institute for Artificial Intelligence(北大-武汉人工智能研究所) Xiangjiang Laboratory, Changsha 410000, China(湘江实验室) Guanghua School of Management, Peking University, Beijing, China, 100871(北京大学光华管理学院) School of Artificial Intelligence, Beihang University, 100191 Beijing, China(北航人工智能学院)

AI总结 本文基于偏移Rademacher复杂性,推导了不同Transformer架构的更精确泛化界限,通过覆盖数和矩阵秩推导出最优收敛率的泛化界限,并扩展到无界特征分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21155 2026-03-24 cs.AI

Can LLMs Fool Graph Learning? Exploring Universal Adversarial Attacks on Text-Attributed Graphs

大语言模型能否欺骗图学习?探索文本属性图上的通用对抗攻击

Zihui Chen, Yuling Wang, Pengfei Jiao, Kai Wu, Xiao Wang, Xiang Ao, Dalin Zhang

机构 * School of Cyberspace, Hangzhou Dianzi University(杭州电子科技大学信息学院) Hangzhou Dianzi University(杭州电子科技大学) Beihang University(北京航空航天大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

AI总结 本文提出BadGraph框架,通过联合扰动节点拓扑和文本语义,实现对文本属性图模型的通用对抗攻击,实验显示攻击效果显著,性能下降达76.3%。

Comments Accepted by TheWebConf (WWW) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20828 2026-03-24 cs.CV

EruDiff: Refactoring Knowledge in Diffusion Models for Advanced Text-to-Image Synthesis

EruDiff:在扩散模型中重构知识以实现高级文本到图像合成

Xiefan Guo, Xinzhu Ma, Haoxiang Ma, Zihao Zhou, Di Huang

机构 * Beihang University(北航大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文提出EruDiff,通过Diffusion Knowledge Distribution Matching和Negative-Only Reinforcement Learning提升扩散模型处理隐式提示的能力,增强科学和世界知识生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20611 2026-03-24 cs.CV

GaussianPile: A Unified Sparse Gaussian Splatting Framework for Slice-based Volumetric Reconstruction

GaussianPile:一种统一的稀疏高斯散射框架用于基于切片的体积分离重建

Di Kong, Yikai Wang, Wenjie Guo, Yifan Bu, Boya Zhang, Yuexin Duan, Xiawei Yue, Wenbiao Du, Yiman Zhong, Yuwen Chen, Cheng Ma

机构 * Tsinghua University(清华大学) Zhongguancun Academy(中关村学院) Beijing Normal University(北京师范大学) Nankai University(南开大学) Beijing Institute of Technology(北京理工大学) Beihang University(北航)

AI总结 本文提出GaussianPile框架,结合3D高斯散射与成像系统感知的聚焦模型,通过切片感知堆叠策略、可微投影算子和紧凑编码优化流程,实现高效体积分离重建,提升压缩效率与诊断精度。

Comments Accepted by IEEE/CVF Conference on Computer Vision and Pattern Recognition 2026 (CVPR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24955 2026-03-24 cs.LG cs.AI cs.RO cs.SY eess.SY

MSACL: Multi-Step Actor-Critic Learning with Lyapunov Certificates for Exponentially Stabilizing Control

MSACL:具有李雅普诺夫证书的多步actor-critic学习用于指数稳定控制

Yongwei Zhang, Yuanzhe Xing, Quanyi Liang, Quan Quan, Zhikun She

机构 * School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院) School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Fujian Key Laboratory of Financial Information Processing, Putian University(福建金融信息处理重点实验室)

AI总结 本文提出MSACL,结合指数稳定性与最大熵强化学习,通过多步样本和李雅普诺夫证书提升稳定控制性能,实验表明其在多个基准任务中优于传统RL和Lyapunov基方法。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20390 2026-03-24 cs.LG cs.AI

CAMA: Exploring Collusive Adversarial Attacks in c-MARL

CAMA:探索c-MARL中的共谋对抗攻击

Men Niu, Xinxin Fan, Quanliang Jing, Shaoye Luo, Yunfeng Lu

机构 * Institute of Computing Technology, CAS(中国科学院计算技术研究所) UCAS(中国科学技术大学) Beihang University(北京航空航天大学)

AI总结 本文提出CAMA框架,研究c-MARL中的共谋对抗攻击,提出三种新型攻击模式,从理论和实践角度分析攻击效果,并通过实验验证其协同效应和隐蔽性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20348 2026-03-24 cs.CV

Toward a Multi-View Brain Network Foundation Model: Cross-View Consistency Learning Across Arbitrary Atlases

迈向多视角脑网络基础模型:跨视角一致性学习在任意脑图谱上的应用

Jiaxing Xu, Jingying Ma, Xin Lin, Yuxiao Liu, Kai He, Qika Lin, Yiping Ke, Yang Li, Dinggang Shen, Mengling Feng

机构 * Saw Swee Hock School of Public Health at National University of Singapore(国立新加坡大学 Saw Swee Hock 公共卫生学院) School of Biomedical Engineering & State Key Laboratory of Advanced Medical Materials and Devices, ShanghaiTech University(上海科技大学 生物医学工程学院及先进医学材料与设备国家重点实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学 计算与数据科学学院) School of Automation Science and Electrical Engineering, Beihang University(北航自动化科学与电气工程学院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北航虚拟现实技术与系统国家重点实验室) Shanghai United Imaging Intelligence(上海联合影像智能有限公司) Shanghai Clinical Research and Trial Center(上海临床研究与试验中心)

AI总结 本文提出MV-BrainFM多视角脑网络基础模型,通过跨视角一致性学习在任意脑图谱上学习通用且可扩展的表示,提升跨图谱的鲁棒性和一致性,实验表明其在20000+受试者数据集上优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20213 2026-03-24 cs.AI cs.CL cs.LG cs.NE

AgenticGEO: A Self-Evolving Agentic System for Generative Engine Optimization

AgenticGEO: 一种自演化代理系统用于生成引擎优化

Jiaqi Yuan, Jialu Wang, Zihan Wang, Qingyun Sun, Ruijie Wang, Jianxin Li

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

AI总结 本文提出AgenticGEO,通过将优化问题建模为内容条件控制问题,提升内容质量以适应生成引擎的不可预测行为,采用MAP-Elites档案进化多样策略,并引入Co-Evolving Critic降低交互成本,实验证明其在多个数据集上优于14个基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏