arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

共收录 1226
2602.20057 2026-02-24 cs.RO cs.AI

AdaWorldPolicy: World-Model-Driven Diffusion Policy with Online Adaptive Learning for Robotic Manipulation

AdaWorldPolicy:基于世界模型的扩散策略与在线自适应学习的机器人操控

Ge Yuan, Qiyuan Qiao, Jing Zhang, Dong Xu

机构 * The University of Hong Kong(香港大学) Beihang University(北航大学)

AI总结 AdaWorldPolicy通过结合世界模型和在线自适应学习,实现机器人操控的高效动态适应。

Comments Homepage: https://AdaWorldPolicy.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26518 2026-02-24 cs.RO

Memory-Efficient 2D/3D Shape Assembly of Robot Swarms

记忆高效的机器人群2D/3D形状组装

Shuoyu Yue, Pengpeng Li, Yang Xu, Kunrui Ze, Xingjian Long, Huazi Cao, Guibin Sun

机构 * Cavendish Laboratory, University of Cambridge(剑桥大学卡文迪许实验室) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) College of Artificial Intelligence, Zhejiang University(浙江大学人工智能学院)

AI总结 本文提出了一种记忆高效的树表示方法和基于行为的分布式控制器,用于实现机器人群在2D和3D中的高效形状组装,显著降低了内存使用并提升了速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19822 2026-02-24 cs.CV cs.AI

Efficient endometrial carcinoma screening via cross-modal synthesis and gradient distillation

通过跨模态合成与梯度蒸馏实现高效的子宫内膜癌筛查

Dongjing Shan, Yamei Luo, Jiqing Xuan, Lu Huang, Jin Li, Mengchu Yang, Zeyu Chen, Fajin Lv, Yong Tang, Chunxiang Zhang

机构 * School of Medical Information and Engineering, Southwest Medical University(西南医科大学医学信息与工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Department of Ultrasound, Affiliated Hospital of Southwest Medical University(西南医科大学附属医院超声科) Department of Functional Examination Unit, Zibo Hospital of Traditional Chinese Medicine(淄博中医药医院功能检查科) Key Laboratory of Medical Electrophysiology, Ministry of Education& Medical Electrophysiological Key Laboratory of Sichuan Province, Institute of Cardiovascular Research, Southwest Medical University(教育部医学电生理重点实验室、四川省医学电生理重点实验室、西南医科大学心血管研究所) Department of Radiology, the First Affiliated Hospital of Chongqing Medical University(重庆医科大学第一附属医院放射科) Department of Cardiology, Affiliated Hospital of Southwest Medical University(西南医科大学附属医院心内科) International Research Center for Complexity Sciences, Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院复杂科学研究中心) Institute of Intelligent Chinese Medicine, Chongqing University of Chinese Medicine(重庆中医药大学智能中药研究院) Basic Medicine Research Innovation Center for Cardiometabolic Diseases, Ministry of Education, Southwest Medical University(教育部心脑血管疾病基础医学研究创新中心、西南医科大学)

AI总结 本文提出一种高效的两阶段深度学习框架,通过跨模态合成与梯度蒸馏技术,在低计算成本下实现高灵敏度和特异度的子宫内膜癌筛查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15690 2026-02-24 cs.CV cs.CL

MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping

通过动态专家跳过加速混合专家多模态大语言模型

Yushi Huang, Zining Wang, Zhihang Yuan, Yifu Ding, Ruihao Gong, Jinyang Guo, Xianglong Liu, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Beihang University(北航) Peking University(北京大学)

AI总结 MoDES通过动态专家跳过机制提升多模态大语言模型的推理效率和准确性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08318 2026-02-24 cs.CV

LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation

LinVideo: 一种面向高效视频生成的O(n)注意力后训练框架

Yushi Huang, Xingtong Ge, Ruihao Gong, Chengtao Lv, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Beihang University(北航) Sensetime Research(商汤科技研究院) Nanyang Technological University(南洋理工大学)

AI总结 LinVideo提出一种高效的无数据后训练框架,通过选择性迁移将部分自注意力模块替换为线性注意力,从而在保持性能的同时显著提升视频生成效率。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10040 2026-02-24 cs.RO

Diffusion Trajectory-guided Policy for Long-horizon Robot Manipulation

用于长时程机器人操作的扩散轨迹引导策略

Shichao Fan, Quantao Yang, Yajie Liu, Kun Wu, Zhengping Che, Qingjie Liu, Min Wan

机构 * School of Mechanical Engineering and Automation, BeiHang University(机械工程与自动化学院,北航) School of Computer Science and Engineering, BeiHang University(计算机科学与工程学院,北航) Beijing Innovation Center of Humanoid Robotics(人形机器人创新中心) Division of Robotics, Perception and Learning (RPL), KTH Royal Institute of Technology(机器人、感知与学习 division,皇家理工学院)

AI总结 本文提出DTP框架,通过生成轨迹减少模仿学习中的误差累积,提升长时程机器人任务的性能。

Comments 8 pages, 5 figures, accepted to IEEE Robotics and Automation Letters (RAL)

Journal ref IEEE Robotics and Automation Letters (Volume: 10, Issue: 12, December 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18749 2026-02-24 cs.AI

Federated Reasoning Distillation Framework with Model Learnability-Aware Data Allocation

联邦推理蒸馏框架与模型可学习性感知的数据分配

Wei Guo, Siyuan Lu, Xiangdong Ran, Yiqi Tong, Yikun Ban, Zelong Xu, Jing Fan, Zixuan Huang, Xiao Zhang, Zhaojun Hu, Fuzhen Zhuang

机构 * Beihang University(北航) Heilongjiang University(黑龙江大学) Beijing University of Civil Engineering and Architecture(北京建筑大学) Yanshan University(燕山大学) Shandong University(山东大学) Renmin University of China(中国人民大学)

AI总结 LaDa是一种联邦推理蒸馏框架,通过模型可学习性感知的数据分配和领域自适应推理蒸馏方法,解决双向模型可学习性差距和领域无关推理迁移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18283 2026-02-23 cs.IR cs.AI

HyTRec: A Hybrid Temporal-Aware Attention Architecture for Long Behavior Sequential Recommendation

HyTRec:一种用于长行为序列推荐的混合时间感知注意力架构

Lei Xin, Yuhao Zheng, Ke Cheng, Changjiang Jiang, Zifan Zhang, Fanhu Zeng

机构 * Shanghai Dewu Information Group(上海德 Wu 信息集团) Wuhan University(武汉大学) USTC Beihang University(北航大学)

AI总结 HyTRec通过混合注意力架构和时间感知delta网络,提升长行为序列推荐的精度与效率,实现工业级场景下的高命中率改进。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02089 2026-02-23 cs.CV

UrbanGS: A Scalable and Efficient Architecture for Geometrically Accurate Large-Scene Reconstruction

UrbanGS: 一种适用于几何准确大规模场景重建的可扩展高效架构

Changbai Li, Haodong Zhu, Hanlin Chen, Xiuping Liang, Tongfei Chen, Shuwei Shao, Linlin Yang, Huobin Tan, Baochang Zhang

机构 * Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) School of Software, Beihang University(北京航空航天大学软件学院) State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室) Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) Control Science and Engineering, Shandong University(山东大学控制科学与工程学院) Artificial Intelligence Research Center, Lobachevsky State University(洛夫奇夫斯基国立大学人工智能研究中心)

AI总结 UrbanGS通过深度一致的D-正则化模块和空间自适应高斯剪枝策略,实现了大规模城市场景的高精度重建。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11471 2026-02-23 cs.CR cs.AI

TrapFlow: Controllable Website Fingerprinting Defense via Dynamic Backdoor Learning

TrapFlow: 通过动态后门学习实现可控的网站指纹攻击防御

Siyuan Liang, Jiajun Gong, Tianmeng Fang, Aishan Liu, Tao Wang, Xiaochun Cao, Dacheng Tao, Ee-Chien Chang

机构 * National University of Singapore(新加坡国立大学) Pengcheng Laboratory(鹏城实验室) Beihang University(北航) Simon Fraser University(Simon Fraser大学)

AI总结 TrapFlow通过动态后门学习实现网站指纹攻击防御,通过注入触发序列使攻击者模型产生错误关联,显著降低攻击准确率。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16444 2026-02-20 cs.RO cs.AI cs.LG

RoboGene: Boosting VLA Pre-training via Diversity-Driven Agentic Framework for Real-World Task Generation

RoboGene: 通过多样性驱动的代理框架提升VLA预训练以生成现实任务

Yixue Zhang, Kun Wu, Zhi Gao, Zhen Zhao, Pei Ren, Zhiyuan Xu, Fei Liao, Xinhua Wang, Shichao Fan, Di Wu, Qiuxuan Feng, Meng Li, Zhengping Che, Chang Liu, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) The School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Beijing Institute of Technology(北京理工大学) The School of Mechanical Engineering and Automation, Beihang University(北航机械工程与自动化学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室)

AI总结 RoboGene通过多样性驱动的代理框架生成多样化、物理合理的机器人操作任务,提升VLA预训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15329 2026-02-18 cs.CV

EventMemAgent: Hierarchical Event-Centric Memory for Online Video Understanding with Adaptive Tool Use

EventMemAgent: 基于分层事件中心记忆的在线视频理解与自适应工具使用

Siwei Wen, Zhangcheng Wang, Xingjian Zhang, Lei Huang, Wenjun Wu

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算先进创新中心,人工智能学院,北京航空航天大学) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北京航空航天大学) Paradigm Inc.(4Paradigm公司)

AI总结 EventMemAgent通过分层事件中心记忆和自适应工具使用,解决在线视频理解中长程推理与细粒度细节的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14166 2026-02-17 cs.CR cs.AI

IntentMiner: Intent Inversion Attack via Tool Call Analysis in the Model Context Protocol

IntentMiner: 通过模型上下文协议中的工具调用分析进行意图倒置攻击

Yunhao Yao, Zhiqiang Wang, Haoran Cheng, Yihang Cheng, Haohua Du, Xiang-Yang Li

机构 * University of Science and Technology of China(中国科学技术大学) Beijing University of Aeronautics and Astronautics(北京航空航天大学)

AI总结 IntentMiner通过分析模型上下文协议中的工具调用,揭示了意图倒置攻击的机制,实现了超过85%的语义对齐,挑战了AI代理的隐私基础。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12385 2026-02-17 cs.CV

Car-1000: A New Large Scale Fine-Grained Visual Categorization Dataset

Car-1000:一个新的大规模细粒度视觉分类数据集

Yutao Hu, Sen Li, Jincheng Yan, Wenqi Shao, Xiaoyan Luo

机构 * Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(新一代人工智能技术及交叉应用国家重点实验室(东南大学)) School of Astronautics, Beihang University(北航航天学院) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 Car-1000是一个大规模细粒度视觉分类数据集,包含1000种不同汽车型号,旨在提升自动驾驶和交通监控等领域的识别性能。

Comments accepted to The Eleventh Workshop on Fine-Grained Visual Categorization in CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04419 2026-02-17 cs.RO

Integrated Exploration and Sequential Manipulation on Scene Graph with LLM-based Situated Replanning

基于场景图的LLM定位再规划集成探索与顺序操作

Heqing Yang, Ziyuan Jiao, Shu Wang, Yida Niu, Si Liu, Hangxin Liu

机构 * Beihang University(北航大学) State Key Laboratory of General Artificial Intelligence(一般人工智能国家重点实验室) University of California, Los Angeles(加州大学洛杉矶分校) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 EPoG通过结合基于图的全局规划器与LLM的定位局部规划器,实现探索与顺序操作规划的无缝结合,有效提升机器人在部分已知环境中的任务执行效率。

Comments 8 pages, 7 figures; accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12032 2026-02-13 cs.RO

When would Vision-Proprioception Policies Fail in Robotic Manipulation?

视觉-本体感觉策略在机器人操作中何时会失败?

Jingxian Lu, Wenke Xia, Yuxuan Wu, Zhiwu Lu, Di Hu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学光明学院人工智能学院) Beijing Key Laboratory of Research on Large Models(北京大模型与智能治理研究重点实验室) School of Artificial Intelligence, Beihang University(北航人工智能学院)

AI总结 研究提出GAP算法,通过动态调节本体感觉优化,解决视觉-本体感觉策略在运动转换阶段的泛化问题。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11877 2026-02-13 cs.CL cs.AI

Towards Fair and Comprehensive Evaluation of Routers in Collaborative LLM Systems

迈向协作大语言模型系统中路由器的公平且全面评估

Wanxing Wu, He Zhu, Yixia Li, Lei Yang, Jiehui Zhao, Hongru Wang, Jian Yang, Benyou Wang, Bingyi Jing, Guanhua Chen

机构 * Southern University of Science and Technology(南方科技大学) Institut Polytechnique de Paris(巴黎政治学院) Peking University(北京大学) Deepexi Technology Co. Ltd.(深醒科技有限公司) University of Edinburgh(爱丁堡大学) Beihang University(北航) Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))

AI总结 本文提出RouterXBench框架和ProbeDirichlet路由器,通过内部隐藏状态提升路由能力与跨领域鲁棒性,实现对协作大语言模型系统中路由器的公平全面评估。

Comments Our code is publicly available at https://github.com/zhuchichi56/RouterXBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11845 2026-02-13 cs.CV

WorldTree: Towards 4D Dynamic Worlds from Monocular Video using Tree-Chains

WorldTree: 从单目视频构建4D动态世界

Qisen Wang, Yifan Zhao, Jia Li

机构 * State Key Laboratory of Virtual Reality Technology and Systems(虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering(计算机科学与工程学院) Qingdao Research Institute(青岛研究院) Beihang University(北航大学)

AI总结 WorldTree通过时间分区树和空间祖先链构建4D动态世界,提升单目视频的动态重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11215 2026-02-13 cs.LG

Charting Empirical Laws for LLM Fine-Tuning in Scientific Multi-Discipline Learning

绘制LLM微调的实证定律以用于科学多学科学习

Lintao Wang, Zhuqiang Lu, Yilin Zhu, Kun Hu, Zhenfei Yin, Shixiang Tang, Zhiyong Wang, Wanli Ouyang, Xinzhu Ma

机构 * The University of Sydney(悉尼大学) Shanghai AI Laboratory(上海人工智能实验室) Edith Cowan University(埃德温·考文大学) University of Oxford(牛津大学) The Chinese University of Hong Kong(香港中文大学) Beihang University(北航大学)

AI总结 本研究通过构建五学科语料库,揭示了多学科LLM微调的四个实证定律,为科学领域通用LLM的发展提供了可操作的指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10997 2026-02-12 cs.RO

Multi-Task Reinforcement Learning of Drone Aerobatics by Exploiting Geometric Symmetries

利用几何对称性进行无人机空翻的多任务强化学习

Zhanyu Guo, Zikang Yin, Guobin Zhu, Shiliang Guo, Shiyu Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) WINDY Lab, School of Engineering, Westlake University(西湖大学工程学院WINDY实验室) School of Automation Science and Electrical Engineering, Beihang University(北航自动化科学与电气工程学院)

AI总结 GEAR通过利用几何对称性,提出了一种端到端多任务强化学习框架,实现高效且灵活的无人机空翻控制,成功率达98.85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10982 2026-02-12 cs.LG cs.AI

RiemannGL: Riemannian Geometry Changes Graph Deep Learning

RiemannGL:黎曼几何变化图深度学习

Li Sun, Qiqi Wan, Suyang Zhou, Zhenhao Huang, Philip S. Yu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beihang University(北航) East China Normal University(华东师范大学) North China Electric Power University(华北电力大学) University of Illinois Chicago(伊利诺伊大学香槟分校)

AI总结 本文提出黎曼几何作为图深度学习的基础框架,强调为图神经网络赋予内在流形结构的重要性,并探讨了流形类型、神经架构和学习范式等研究方向。

Comments 34 pages, 11 figures, position paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10884 2026-02-12 cs.CV

ResWorld: Temporal Residual World Model for End-to-End Autonomous Driving

ResWorld: 用于端到端自动驾驶的时序残差世界模型

Jinqing Zhang, Zehua Fu, Zelin Xu, Wenying Dai, Qingjie Liu, Yunhong Wang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室,北京航空航天大学) Zhongguancun Laboratory, Beijing, China(中关村实验室) Beijing Jingwei Hirain Technologies Co., Inc.(北京京wei Hirain科技有限公司) Hangzhou Innovation Institute, Beihang University, Hangzhou, China(杭州创新研究院,北京航空航天大学)

AI总结 ResWorld通过时序残差世界模型和未来引导轨迹细化模块,提升端到端自动驾驶的规划性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10675 2026-02-12 cs.CV cs.AI

TwiFF (Think With Future Frames): A Large-Scale Dataset for Dynamic Visual Reasoning

TwiFF (Think With Future Frames): 一个大规模动态视觉推理数据集

Junhua Liu, Zhangcheng Wang, Zhike Han, Ningli Wang, Guotao Liang, Kun Kuang

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院) School of Computer and Computing Science, Hangzhou City University, Hangzhou, China(杭州市城市大学计算机与计算科学学院) Henan Academy of Innovations in Medical Science (AIMS), Zhengzhou, China(河南省医学创新研究院) School of Software, Beihang University, Beijing, China(北京航空航天大学软件学院)

AI总结 TwiFF提出一个大规模动态视觉推理数据集及模型,通过整合视频生成与图像理解能力,提升动态场景下的视觉问答性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10659 2026-02-12 cs.CV

Multimodal Priors-Augmented Text-Driven 3D Human-Object Interaction Generation

多模态先验增强的文本驱动3D人-物交互生成

Yin Wang, Ziyao Zhang, Zhiying Leng, Haitian Liu, Frederick W. B. Li, Mu Li, Xiaohui Liang

机构 * State Key Laboratory of Virtual Reality Technology and Systems(虚拟现实技术与系统国家重点实验室) Beihang University(北京航空航天大学) Department of Computer Science, University of Durham(杜伦大学计算机科学系) Zhongguancun Laboratory(中关村实验室)

AI总结 本文提出MP-HOI框架,通过多模态先验、增强物体表示、模态感知MoE模型和级联扩散技术,提升文本驱动的3D人-物交互生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10506 2026-02-12 cs.LG cs.AI

Learning Structure-Semantic Evolution Trajectories for Graph Domain Adaptation

学习结构-语义演进轨迹用于图域适应

Wei Chen, Xingyu Guo, Shuang Li, Yan Zhong, Zhao Zhang, Fuzhen Zhuang, Hongrui Liu, Libang Zhang, Guo Ye, Huimei He

机构 * School of Artificial Intelligence, Beihang University, Beijing, China(北京航空航天大学人工智能学院) School of Mathematical Sciences, Peking University, Beijing, China(北京大学数学科学学院) School of Computer Science and Engineering, Beihang University, Beijing, China(北京航空航天大学计算机科学与工程学院) Zhongguancun Laboratory, Beijng, China(中关村实验室) Independent Researcher, Beijing, China(独立研究者)

AI总结 DiffGDA通过建模连续时间生成过程,以结构和语义转换的联合建模方式解决图域适应中的连续非线性演进问题,实验表明其在多个数据集上优于现有方法。

Comments accepted by ICLR 2026, 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22777 2026-02-12 cs.LG

SeeDNorm: Self-Rescaled Dynamic Normalization

SeeDNorm: 自适应动态归一化

Wenrui Cai, Defa Zhu, Qingjie Liu, Qiyang Min

机构 * School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航大学)

AI总结 SeeDNorm通过动态调整缩放系数提升模型表示能力,在保持输入范数信息的同时实现自适应动态归一化,有效提升大语言模型及计算机视觉任务的性能。

Comments Accepted to ICLR 2026, 32 pages, 14 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24975 2026-02-12 cs.SE cs.CL

DiffuTester: Accelerating Unit Test Generation for Diffusion LLMs via Mining Structural Pattern

DiffuTester: 通过挖掘结构模式加速扩散大语言模型的单元测试生成

Lekang Yang, Yuetong Liu, Yitong Zhang, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院) School of Software, Beihang University(北航软件学院) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院)

AI总结 DiffuTester通过挖掘结构模式提升扩散大语言模型在单元测试生成中的效率,实现高质量测试用例生成。

Comments Update format and add some experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17667 2026-02-12 cs.AI

PhysUniBench: A Multi-Modal Physics Reasoning Benchmark at Undergraduate Level

PhysUniBench: 一个面向本科生层面的多模态物理推理基准测试

Lintao Wang, Encheng Su, Jiaqi Liu, Pengze Li, Jiabei Xiao, Wenlong Zhang, Xinnan Dai, Xi Chen, Yuan Meng, Lei Bai, Wanli Ouyang, Shixiang Tang, Aoran Wang, Xinzhu Ma

机构 * The University of Sydney(悉尼大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) Michigan State University(密歇根州立大学) Tsinghua University(清华大学) Beihang University(北航大学)

AI总结 PhysUniBench是一个面向本科生层面的多模态物理推理基准测试,旨在评估和提升多模态大语言模型在物理问题上的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09973 2026-02-11 cs.RO

RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation

RoboInter: 一种面向机器人操控的综合中间表示套件

Hao Li, Ziqin Wang, Zi-han Ding, Shuai Yang, Yilun Chen, Yang Tian, Xiaolin Hu, Tai Wang, Dahua Lin, Feng Zhao, Si Liu, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北航) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 RoboInter通过统一的中间表示套件,提升机器人操控中视觉-语言-动作系统的泛化能力和推理能力。

Comments Published to ICLR 2026, 69 pages, 40 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09538 2026-02-11 cs.CL

UniARM: Towards a Unified Autoregressive Reward Model for Multi-Objective Test-Time Alignment

UniARM: 向多目标测试时间对齐的统一自回归奖励模型迈进

Hongyan Xie, Yikun Ban, Ruiyu Fang, Zixuan Huang, Deqing Wang, Jianxin Li, Yitong Yao, Chao Wang, Shuangyong Song

机构 * School of Computer, Beihang University(北京航空航天大学计算机学院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院)

AI总结 UniARM通过统一自回归奖励模型实现多目标测试时间对齐,通过共享特征和偏好调节模块减少特征纠缠,提升对偏好权衡的控制能力。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏