arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

2026-04-15 至 2026-04-15 共收录 14
2604.12666 2026-04-15 cs.LG cs.CL cs.HC

From Imitation to Discrimination: Progressive Curriculum Learning for Robust Web Navigation

从模仿到鉴别:面向鲁棒网络导航的渐进课程学习

Chuang Peng, Wei Zhang, Renshuai Tao, Xinhao Zhang, Jian Yang

机构 * Beijing Jiaotong University(北京交通大学) Beihang University(北京航空航天大学)

AI总结 本文提出Triton数据集和渐进训练课程,通过结构-语义硬负样本挖掘和双代理共识流程构建,提升网络导航中对复杂页面的鉴别能力与泛化能力,最终在Mind2Web上验证了专用数据课程优于单纯参数规模的优势。

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12565 2026-04-15 cs.RO cs.CV

Scalable Trajectory Generation for Whole-Body Mobile Manipulation

可扩展的全身体态移动操作轨迹生成

Yida Niu, Xinhai Chang, Xin Liu, Ziyuan Jiao, Yixin Zhu

机构 * Institute for AI, Peking University(人工智能研究院,北京大学) Institute of Unmanned System, Beihang University(无人系统研究院,北航) School of Psychological and Cognitive Sciences, Peking University(心理学与认知科学学院,北京大学) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京行为与心理健康重点实验室,北京大学) Yuanpei College, Peking University(元培学院,北京大学) Embodied Intelligence Lab, PKU-Wuhan Institute for Artificial Intelligence(具身智能实验室,PKU-武汉人工智能研究所)

AI总结 本文提出AutoMoMa框架,通过GPU加速整合运动学模型与并行轨迹优化,生成大规模物理有效轨迹数据,解决全身体态移动操作中规模、多样性和运动学精度的瓶颈问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10992 2026-04-15 cs.CV

ArtiCAD: Articulated CAD Assembly Design via Multi-Agent Code Generation

ArtiCAD: 通过多智能体代码生成实现可动CAD装配设计

Yuan Shui, Yandong Guan, Zhanwei Zhang, Juncheng Hu, Jing Zhang, Dong Xu, Qian Yu

机构 * School of Software, Beihang University(北京航空航天大学软件学院) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

AI总结 ArtiCAD通过多智能体系统从文本或图像生成可编辑的可动CAD装配,利用连接器定义连接点和关节参数,提升空间推理能力,通过验证步骤和回滚机制确保输出质量,验证了其在概念设计、物理原型和AI训练资产生成中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02830 2026-04-15 cs.CL

GRADE: Probing Knowledge Gaps in LLMs through Gradient Subspace Dynamics

GRADE: 通过梯度子空间动态探测语言模型中的知识差距

Yujing Wang, Yuanbang Liang, Yukun Lai, Hainan Zhang, Hanqi Yan

机构 * Beihang University(北航) Cardiff University(卡迪夫大学) King’s College London(伦敦国王学院)

AI总结 GRADE通过梯度子空间动态探测语言模型中的知识差距,量化知识缺口并验证其在多个基准上的有效性及抗扰性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12502 2026-04-15 cs.CV cs.AI

SEATrack: Simple, Efficient, and Adaptive Multimodal Tracker

SEATrack: 简单、高效且自适应的多模态跟踪器

Junbin Su, Ziteng Xue, Shihui Zhang, Kun Chen, Weiming Hu, Zhipeng Zhang

机构 * School of Artificial Intelligence (School of Software), Yanshan University(燕山大学人工智能学院(软件学院)) School of Software, Beihang University(北航软件学院) Hebei Key Laboratory of Computer Virtual Technology and System Integration(河北省计算机虚拟技术与系统集成重点实验室) State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), CASIA(多模态人工智能系统国家重点实验室(MAIS),CASIA) School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院) AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院自动化实验室)

AI总结 SEATrack通过跨模态对齐和层次混合专家机制,在RGB-T、RGB-D和RGB-E跟踪任务中实现性能与效率的平衡。

Comments Accepted as a CVPR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12308 2026-04-15 cs.CL

ContextLens: Modeling Imperfect Privacy and Safety Context for Legal Compliance

ContextLens:建模不完美隐私和安全上下文以满足法律合规

Haoran Li, Yulin Chen, Huihao Jing, Wenbin Hu, Tsz Ho Li, Chanhou Lou, Hong Ting Tsang, Sirui Han, Yangqiu Song

机构 * Beihang University(北京航空航天大学) HKUST(香港科技大学) National University of Singapore(新加坡国立大学) Faculty of Law, University of Macau(澳门大学法学院)

AI总结 本文提出ContextLens框架,利用LLM建模法律领域上下文,识别已知和未知因素以提升合规评估,实验表明其能有效提升LLM合规性评估性能。

Comments Accepted by ACL 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12191 2026-04-15 cs.AI

Beyond Scores: Diagnostic LLM Evaluation via Fine-Grained Abilities

超越分数:通过细粒度能力进行诊断LLM评估

Xu Zhang, Xudong Gong, Jiacheng Qin, Qiang Wang, JiaQi Liao, Zhe Wang, Dawei Feng, Bo Ding

机构 * College of Computer Science Technology, National University of Defense Technology, Changsha, Hunan, China State Key Laboratory of Complex \& Critical Software Environment, Changsha, Hunan, China National Key Laboratory of Parallel School of Humanities Social Sciences, School of Public Administration, Beihang University, Beijing, China

AI总结 本文提出一种基于细粒度能力的诊断框架,通过多维项目反应理论估计模型能力,实现对不同任务的精准评估,提升模型改进和任务选择的针对性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23061 2026-04-15 cs.IR cs.AI cs.CL cs.DB cs.LG

MoDora: Tree-Based Semi-Structured Document Analysis System

MoDora:基于树的半结构化文档分析系统

Bangrui Xu, Qihang Yao, Zirui Tang, Xuanhe Zhou, Yeye He, Shihan Yu, Qianqian Xu, Bin Wang, Guoliang Li, Conghui He, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Microsoft Research(微软研究院) Beihang University(北航) Shanghai AI Lab(上海人工智能实验室) Tsinghua University(清华大学) Institute for Clarity in Documentation(文档清晰性研究所) Inria Paris-Rocquencourt(Inria巴黎-罗quentcourt研究中心) East China Normal University(华东师范大学) Scientific Writing Academy(科学写作学院)

AI总结 MoDora通过局部对齐聚合策略和组件相关树结构,提升半结构化文档的分析能力,实验表明其在准确性上优于基线方法。

Comments Extension of our SIGMOD 2026 paper. Please refer to source code available at https://github.com/weAIDB/MoDora

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00412 2026-04-15 cs.CR cs.AI

Red Teaming Large Reasoning Models

对大型推理模型进行红队测试

Jiawei Chen, Yang Yang, Chao Yu, Yu Tian, Zhi Cao, Xue Yang, Linghao Li, Hang Su, Zhaoxia Yin

机构 * Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University(上海多维信息处理关键实验室,东华大学) Zhongguancun Academy(中关村学院) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Dept. of Comp. Sci. and Tech., THBI Lab, Tsinghua University(计算机科学与技术系,清华THBI实验室) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出RT-LRM基准,评估大型推理模型的可信度,揭示其在面对推理风险时的脆弱性,并发布工具箱支持未来研究。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10073 2026-04-15 cs.CR cs.CV

SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents

SecureWebArena: 一个针对基于大视觉-语言模型的Web代理的综合安全评估基准

Zonghao Ying, Yangguang Shao, Jianle Gan, Gan Xu, Wenxin Zhang, Quanchen Zou, Junzheng Shi, Zhenfei Yin, Mingchuan Zhang, Aishan Liu, Xianglong Liu

机构 * SKLCCSE, Beihang University(北京航空航天大学安全实验室) Institute of Information Engineering, CAS(中国科学院信息工程研究所) China University of Petroleum (East China)(中国石油大学(华东)) Zhejiang University of Technology(浙江工业大学) University of Chinese Academy of Science(中国科学院大学) AI Security Lab(360人工智能安全实验室) The University of Sydney(悉尼大学) Henan University of Science and Technology(河南理工大学)

AI总结 本文提出SecureWebArena,首个针对基于大视觉-语言模型的Web代理安全性的综合评估基准,通过六个真实模拟的Web环境和2970条高质量轨迹,分析代理在内部推理、行为轨迹和任务结果三个维度上的安全风险。

Comments ACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19742 2026-04-15 cs.CL cs.AI cs.IR

HiCoLoRA: Addressing Context-Prompt Misalignment via Hierarchical Collaborative LoRA for Zero-Shot DST

HiCoLoRA:通过分层协作LoRA解决上下文提示对齐问题

Shuyu Zhang, Yifan Wei, Xinru Wang, Yanmin Zhu, Yangfan He, Yixuan Weng, Bin Li, Yujie Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学) University of Sydney(悉尼大学) University of Minnesota Twin Cities(明尼苏达大学双城分校) Westlake University(西湖大学) SIAT, CAS(中国科学院软件研究所)

AI总结 本文提出HiCoLoRA框架,通过增强零样本槽位推理实现上下文提示对齐,采用分层LoRA架构、谱联合领域-槽位聚类和语义增强SVD初始化,在多领域数据集上取得最优性能。

Comments Accepted in ACL2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19695 2026-04-15 cs.CL cs.AI cs.IR

DyBBT: Dynamic Balance via Bandit-inspired Targeting for Dialog Policy with Cognitive Dual-Systems

DyBBT:通过老虎机启发式目标实现对话策略的动态平衡

Shuyu Zhang, Yifan Wei, Jialuo Yuan, Xinru Wang, Yanmin Zhu, Bin Li, Yujie Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学) Stanford University(斯坦福大学) University of Sydney(悉尼大学) SIAT, CAS(中国科学院上海硅酸盐研究所) Beijing Institute of Graphic Communication(北京印刷学院)

AI总结 本文提出DyBBT框架,通过结构化认知状态空间解决对话探索挑战,结合快速直觉推理与慢速 deliberative 推理,提升对话策略的成功率、效率和泛化能力。

Comments Accepted in ACL2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01620 2026-04-15 cs.LG cs.CR cs.CV

IMU: Influence-guided Machine Unlearning

IMU: 基于影响的机器遗忘

Xindi Fan, Jing Wu, Mingyi Zhou, Pengwei Liang, Mehrtash Harandi, Dinh Phung

机构 * Harbin Institute of Technology(哈尔滨工业大学) Monash University(墨尔本大学) Beihang University(北航大学) City University of Hong Kong(香港城市大学)

AI总结 IMU通过利用影响函数作为优先信号,基于遗忘集进行机器遗忘,提升模型效用并减少对保留知识的扰动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05481 2026-04-15 cs.RO

Relative Pose Estimation for Nonholonomic Robot Formation with UWB-IO Measurements (Extended version)

非holonomic机器人编队的相对位姿估计(扩展版)

Kunrui Ze, Wei Wang, Shuoyu Yue, Guibin Sun, Kexin Liu, Jinhu Lü

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Cavendish Laboratory, University of Cambridge(剑桥大学卡文迪许实验室) Zhongguancun Laboratory(中关村实验室)

AI总结 本文研究利用机载超宽带距离和惯性里程计测量实现多机器人分布式编队控制问题,提出局部帧下的并发学习估计器和协作定位算法,设计分布式编队跟踪控制器,通过实验证明方法有效性。

Comments 17 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏