arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3038
2603.21145 2026-03-24 cs.DC cs.AI cs.LG cs.SC

NeSy-Edge: Neuro-Symbolic Trustworthy Self-Healing in the Computing Continuum

NeSy-Edge:神经符号可信自愈在计算连续体中的应用

Peihan Ye, Alfreds Lapkovskis, Alaa Saleh, Qiyang Zhang, Praveen Kumar Donta

机构 * Department of Computer Systems and Sciences(计算机系统与科学系) University of Oulu(奥卢大学) Peking University(北京大学)

AI总结 本文提出NeSy-Edge框架,通过边缘优先设计,在资源受限的边缘节点进行本地感知与推理,结合云模型进行最终诊断,实现计算连续体中的可信自愈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20650 2026-03-24 cs.AI cs.CY

From 50% to Mastery in 3 Days: A Low-Resource SOP for Localizing Graduate-Level AI Tutors via Shadow-RAG

从50%到精通:一种低资源SOP,通过影子RAG本地化研究生级AI导师

Zonglin Yang, J. -H. Xie, Lining Zhang, Jiyou Jia, Zhi-X. Chen

机构 * School of Mechanics and Engineering Science, Peking University, Beijing, 100871, China(北京理工大学机械与工程科学学院) Readraft Intelligent Technology Co., Ltd., China(读raft智能科技有限公司) Graduate School of Education, Peking University, Beijing, 100871, China(北京大学教育学院) AI for Science Institute, Beijing, 100080, China(AI for Science研究院)

AI总结 本文提出一种低成本SOP,利用影子RAG架构和数据清洗策略,在3人天内本地化研究生级AI导师,使32B模型性能从74%提升至90%。

Comments 9 pages, 3 figures, practitioner report

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20632 2026-03-24 cs.LG

Optimal low-rank stochastic gradient estimation for LLM training

最优低秩随机梯度估计用于大语言模型训练

Zehao Li, Tao Ren, Zishi Zhang, Xi Chen, Yijie Peng

机构 * Guanghua School of Management, Peking University(北京大学光华管理学院) Stern School of Business, New York University(纽约大学 Stern 商学院)

AI总结 本文提出一种低秩矩阵估计器,通过随机低维子空间投影减少内存占用并控制均方误差,实验证明在RoBERTa-large微调和LLaMA-20M/60M/100M预训练中均取得优异效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20616 2026-03-24 cs.LG

Beyond Token Eviction: Mixed-Dimension Budget Allocation for Efficient KV Cache Compression

超越令牌驱逐:面向高效KV缓存压缩的混合维度预算分配

Ruijie Miao, Zhiming Wang, Wang Li, Shiwei Wu, Shufan Liu, Yanbing Jiang, Tong Yang

机构 * Peking University(北京大学)

AI总结 本文提出混合维度KV缓存压缩方法,通过更细粒度的维度分配提升效率,实验显示其在长上下文任务中表现优于现有方法,仅用6.25%的缓存即可达到全注意力性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00431 2026-03-24 cs.CV cs.AI

Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models

面向层次视觉识别的分类意识表示对齐

Hulingxiao He, Zhi Tan, Yuxin Peng

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机系王轩研究所)

AI总结 本文提出TARA方法,通过生物基础模型的层次对比学习将分类知识注入大模态模型,提升层次视觉识别中对已知和新类别的识别性能。

Comments Published as a conference paper at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19402 2026-03-24 cs.RO cs.CV cs.GR

Real2Edit2Real: Generating Robotic Demonstrations via a 3D Control Interface

Real2Edit2Real:通过3D控制界面生成机器人演示

Yujie Zhao, Hongwei Fan, Di Chen, Shengcong Chen, Liliang Chen, Xiaoqi Li, Guanghui Ren, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学) PKU-AgiBot Lab(北大AgiBot实验室) AgiBot

AI总结 本文提出Real2Edit2Real框架,通过3D可编辑性与2D视觉数据结合,减少重复数据收集,提升空间泛化能力,实验表明其数据效率提升显著。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11026 2026-03-24 cs.CV

GIR-Bench: Versatile Benchmark for Generating Images with Reasoning

GIR-Bench:用于生成图像的多功能基准

Hongxiang Li, Yaowei Li, Bin Lin, Yuwei Niu, Yuhang Yang, Xiaoshuang Huang, Jiayin Cai, Xiaolong Jiang, Yao Hu, Long Chen

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Peking University(北京大学) University of Science and Technology of China(中国科学技术大学) Xiaohongshu Inc.(小红书公司)

AI总结 本文提出GIR-Bench,从理解-生成一致性、文本到图像生成和多步骤编辑三个角度评估统一模型,揭示其在复杂视觉任务中的表现与不足。

Comments ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03097 2026-03-24 stat.ML cs.LG math.PR math.ST stat.TH

A Computational Transition for Detecting Multivariate Shuffled Linear Regression by Low-Degree Polynomials

通过低次多项式检测多变量洗牌线性回归的计算转变

Zhangsong Li

机构 * Peking University(北京大学)

AI总结 研究多变量洗牌线性回归中低次多项式算法的性能转变,揭示在不同维度和噪声水平下算法区分能力的变化。

Comments 27 pages; improved exposition

Journal ref IEEE Transactions on Information Theory, 72(4):2444-2456 (April 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01396 2026-03-24 cs.CV

All Patches Matter, More Patches Better: Enhance AI-Generated Image Detection via Panoptic Patch Learning

所有补丁都重要,更多补丁更好:通过全景补丁学习增强AI生成图像检测

Zheng Yang, Ruoxin Chen, Zhiyuan Yan, Ke-Yue Zhang, Xinghe Fu, Shuang Wu, Xiujun Shu, Taiping Yao, Shouhong Ding, Zequn Qin, Xi Li

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Youtu Lab, Tencent(腾讯优图实验室) Peking University(北京大学) Wechat Pay, Tencent(腾讯微信支付) School of Software Technology, Zhejiang University(浙江大学软件技术学院)

AI总结 本文提出全景补丁学习框架,通过随机补丁替换和补丁级对比学习,解决AI生成图像检测中的Few-Patch偏差问题,提升检测鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10413 2026-03-24 stat.ML cs.LG math.ST stat.AP stat.TH

On Consistency of Signature Using Lasso

关于使用Lasso回归的签名一致性

Xin Guo, Binnan Wang, Ruixun Zhang, Chaoyi Zhao

机构 * UC Berkeley Department of Industrial Engineering and Operations Research(伯克利大学工业工程与运筹学系) Peking University School of Mathematical Sciences and Laboratory for Mathematical Economics and Quantitative Finance(北京大学数学科学学院及数学经济学与量化金融实验室) Peking University School of Mathematical Sciences, Center for Statistical Science, National Engineering Laboratory for Big Data Analysis and Applications, and Laboratory for Mathematical Economics and Quantitative Finance(北京大学数学科学学院、统计科学中心、大数据分析与应用国家工程实验室及数学经济学与量化金融实验室) MIT Sloan School of Management and Laboratory for Financial Engineering(麻省理工学院斯隆管理学院及金融工程实验室)

AI总结 本文研究了使用Lasso回归的签名一致性,理论和数值分析表明,Lasso在有限样本和渐近情况下的一致性取决于时间序列过程与布朗运动的接近程度及维度相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20422 2026-03-24 cs.CV cs.AI cs.IR

PEARL: Personalized Streaming Video Understanding Model

PEARL:个性化流视频理解模型

Yuanhong Zheng, Ruichuan An, Xiaopeng Lin, Yuxing Liu, Sihan Yang, Huanyu Zhang, Haodong Li, Qintong Zhang, Renrui Zhang, Guopeng Li, Yifan Zhang, Yuheng Li, Wentao Zhang

机构 * Peking University(北京大学) Adobe CASIA Stepfun CUHK(香港中文大学) Zhongguancun Academy(中关村学院)

AI总结 本文提出个性化流视频理解任务PSVU,并引入PEARL-Bench基准测试,通过帧级和视频级两种模式评估模型对个性化概念的响应能力,提出无需训练的PEARL策略,实现先进性能。

Comments Arxiv Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20303 2026-03-24 cs.CV cs.AI

InjectFlow: Weak Guides Strong via Orthogonal Injection for Flow Matching

InjectFlow: 通过正交注入实现弱引导强,用于流匹配

Dayu Wang, Jiaye Yang, Weikang Li, Jiahui Liang, Yang Li

机构 * Baidu Inc.(百度公司) Peking University(北京大学)

AI总结 本文提出InjectFlow,通过在初始速度场计算中注入正交语义,解决流匹配模型对数据集偏见敏感的问题,提升生成质量与公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20194 2026-03-23 cs.CV

MME-CoF-Pro: Evaluating Reasoning Coherence in Video Generative Models with Text and Visual Hints

MME-CoF-Pro:基于文本和视觉提示评估视频生成模型中的推理一致性

Yu Qi, Xinyi Xu, Ziyu Guo, Siyuan Ma, Renrui Zhang, Xinyan Chen, Ruichuan An, Ruofan Xing, Jiayi Zhang, Haojie Huang, Pheng-Ann Heng, Jonathan Tremblay, Lawson L. S. Wong

机构 * Northeastern University(东北大学) The Chinese University of Hong Kong(香港中文大学) Westlake University(西湖大学) ByteDance Seed(字节跳动种子) Peking University(北京大学) NVIDIA(英伟达)

AI总结 本文提出MME-CoF-Pro视频推理基准,评估视频模型的推理一致性,发现生成模型推理一致性弱,文本提示提升正确性但导致不一致,视觉提示在结构化任务中表现较好但难以处理细粒度感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19765 2026-03-23 cs.CV

FREAK: A Fine-grained Hallucination Evaluation Benchmark for Advanced MLLMs

FREAK:一种用于高级MLLMs细粒度幻觉评估的基准测试

Zhihan Yin, Jianxin Liang, Yueqian Wang, Yifeng Yao, Huishuai Zhang, Dongyan Zhao

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王学苑计算机技术研究所) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室)

AI总结 本文提出FREAK基准测试,通过高质量图像评估MLLMs在细粒度视觉感知中的幻觉问题,揭示了现有模型在详细视觉感知上的严重幻觉问题。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19678 2026-03-23 cs.CV

Vision-Language Attribute Disentanglement and Reinforcement for Lifelong Person Re-Identification

视觉-语言属性解耦与强化用于终身人物重识别

Kunlun Xu, Haotong Cheng, Jiangmeng Li, Xu Zou, Jiahuan Zhou

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(北京大学王轩计算机技术研究院,北京,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology, Wuhan, China(华中科技大学人工智能与自动化学院,武汉,中国)

AI总结 本文提出VLADR方法,通过视觉-语言属性解耦与强化提升跨域知识迁移,增强抗遗忘与泛化能力,实验表明在抗遗忘和泛化能力上优于现有方法。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19598 2026-03-23 cs.CV

FlowScene: Style-Consistent Indoor Scene Generation with Multimodal Graph Rectified Flow

FlowScene: 多模态图校正流驱动的风格一致室内场景生成

Zhifei Yang, Guangyao Zhai, Keyang Lu, YuYang Yin, Chao Zhang, Zhen Xiao, Jieyi Long, Nassir Navab, Yikai Wang

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Technical University of Munich(慕尼黑技术大学) Beijing Jiaotong University(北京交通大学) Beijing Digital Native Digital City Research Center(北京数字原生数字城市研究院) Theta Labs, Inc.(Theta Labs公司) Beijing Normal University(北京师范大学)

AI总结 FlowScene通过多模态图校正流模型生成风格一致的室内场景,实现对布局、形状和纹理的精细控制,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07451 2026-03-23 cs.CL

DLLM Agent: See Farther, Run Faster

DLLM Agent: 看得更远,跑得更快

Huiling Zhen, Weizhe Lin, Renxi Liu, Kai Han, Yiming Li, Yuchuan Tian, Hanting Chen, Xiaoguang Li, Xiaosong Li, Chen Chen, Xianzhi Yu, Mingxuan Yuan, Youliang Yan, Peifeng Qin, Jun Wang, Yu Wang, Dacheng Tao, Yunhe Wang

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司) UCL(伦敦大学学院) Tsinghua University(清华大学) NTU(国立新加坡大学) Peking University(北京大学)

AI总结 本文研究了扩散大语言模型(DLLM)在代理多步决策中的表现,发现其在准确率相当的情况下,整体效率比自回归模型(AR)高30%以上,并提出部署扩散骨架的两个实用考虑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21349 2026-03-23 cs.CV eess.IV

Electromagnetic Inverse Scattering from a Single Transmitter

单发射机的电磁反散射

Yizhe Cheng, Chunxun Tian, Haoru Wang, Wentao Zhu, Xiaoxuan Ma, Yizhou Wang

机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(前沿计算研究中心,计算机科学学院,北京大学) Institute of Digital Twin, Eastern Institute of Technology, Ningbo(数字孪生研究所,东部技术研究所,宁波) Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)

AI总结 本文提出了一种端到端的数据驱动框架,用于从单发射机测量数据中预测散射体的相对介电常数,提升了稀疏发射条件下的反散射精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10985 2026-03-23 cs.CL

Taking a Deep Breath: Enhancing Language Modeling of Large Language Models with Sentinel Tokens

深呼吸:通过哨兵令牌增强大语言模型的语言建模

Weiyao Luo, Suncong Zheng, Heming Xia, Weikang Wang, Yan Lei, Tianyu Liu, Shuang Chen, Zhifang Sui

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,北京大学计算机学院) School of Software & Microelectronics, Peking University(北京大学软件与微电子学院) Tencent Hunyuan(腾讯文言) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Alibaba Group(阿里巴巴集团)

AI总结 本文提出通过插入哨兵令牌使大语言模型能够总结离散文本块信息,提升长文本建模能力,实验验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19268 2026-03-23 cs.CL cs.AI

Full-Stack Domain Enhancement for Combustion LLMs: Construction and Optimization

面向燃烧科学的全栈领域增强:构建与优化

Quanjia Xiao, Weimin Ouyang, Zonglin Yang, Tianhao Wu, Qingguo Zhou, Runze Mao, Zhi X. Chen

机构 * Peking University(北京大学) AI for Science Institute, Beijing(AI for Science研究院,北京)

AI总结 本文提出首个针对燃烧科学的全栈领域增强LLM工作流程,整合自动领域语料构建、增量预训练、指令微调及可验证奖励强化学习,构建标准化评估基准FlameBench,显著提升燃烧科学推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19218 2026-03-20 cs.CV

Rethinking Vector Field Learning for Generative Segmentation

重新思考生成分割中的向量场学习

Chaoyang Wang, Yaobo Liang, Boci Peng, Fan Duan, Jingdong Wang, Yunhai Tong

机构 * Peking University(北京大学) Baidu(百度)

AI总结 本文从向量场学习角度重新审视扩散分割,解决梯度消失和轨迹遍历问题,提出改进的向量场重塑策略和高效类别编码方案,提升分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18736 2026-03-20 cs.LG cs.AI cs.CL stat.ML

CausalRM: Causal-Theoretic Reward Modeling for RLHF from Observational User Feedbacks

CausalRM:基于观察性用户反馈的因果理论奖励建模用于RLHF

Hao Wang, Licheng Pan, Zhichao Chen, Chunyuan Zheng, Zhixuan Chu, Xiaoxi Li, Yuan Lu, Xinggao Liu, Haoxuan Li, Zhouchen Lin

机构 * Peking University(北京大学) Xiaohongshu Inc.(小红书公司) Zhejiang University(浙江大学)

AI总结 本文提出CausalRM框架,通过因果理论处理观察性用户反馈中的噪声和偏见问题,提升RLHF任务性能,实验显示在WildGuardMix和HarmBench上分别提升49.2%和32.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18714 2026-03-20 eess.SP cs.LG

Holter-to-Sleep: AI-Enabled Repurposing of Single-Lead ECG for Sleep Phenotyping

Holter-to-Sleep: 基于单导联ECG的AI赋能睡眠表型分析

Donglin Xie, Qingshuo Zhao, Jingyu Wang, Shijia Geng, Jiarui Jin, Jun Li, Rongrong Guo, Guangkun Nie, Gongzheng Tang, Yuxi Zhou, Thomas Penzel, Shenda Hong

机构 * National Institute of Health Data Science, Peking University, Beijing, China(北京大学国家健康数据科学研究院) Department of Computer Science, Tianjin University of Technology, Tianjin, China(天津理工大学计算机学院) Department of Respiratory and Critical Care Medicine, Binzhou Medical University Hospital, Binzhou, China(滨州医学院附属医院呼吸与危重症医学科) Heart Voice Medical Technology, Hefei, Anhui(合肥心声医疗科技) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) Institute of Medical Technology, Peking University Health Science Center, Beijing, China(北京大学医学部医学技术研究院) Department of Respiratory, The Second Hospital of Tianjin Medical University, Tianjin, China(天津医科大学第二医院呼吸科) Interdisciplinary Center of Sleep Medicine, Charité - Universitätsmedizin Berlin, Berlin, Germany(柏林夏里特大学医学院睡眠医学跨学科中心) Institute for Artificial Intelligence(人工智能研究院)

AI总结 本文提出一种利用单导联ECG进行睡眠表型和心脏表型联合分析的框架,通过AI技术实现家庭场景下的睡眠与心脏监测,为大规模研究提供可行方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18680 2026-03-20 cs.LG cs.CR

Revisiting Label Inference Attacks in Vertical Federated Learning: Why They Are Vulnerable and How to Defend

重新审视垂直联邦学习中的标签推断攻击:为什么它们易受攻击以及如何防御

Yige Liu, Dexuan Xu, Zimai Guo, Yongzhi Cao, Hanpin Wang

机构 * Key Laboratory of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术重点实验室(北京大学)) School of Computer Science, Peking University(北京大学计算机学院) Zhongguancun Laboratory, Beijing, China(中关村实验室,北京,中国)

AI总结 本文研究垂直联邦学习中标签推断攻击的脆弱性,揭示模型补偿现象,提出任务重新分配和层调整防御方法,提升对抗性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18662 2026-03-20 cs.AI

Thinking with Constructions: A Benchmark and Policy Optimization for Visual-Text Interleaved Geometric Reasoning

通过构造进行思考:一种用于视觉-文本交错几何推理的基准和策略优化

Haokun Zhao, Wanshi Xu, Haidong Yuan, Songjun Cao, Long Ma, Yanghua Xiao

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) School of ECE, Peking University(北京大学电子工程学院) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) Tencent Youtu Lab(腾讯优图实验室)

AI总结 本文提出GeoAux-Bench基准和A2PO策略优化框架,通过交错视觉-文本辅助工具提升几何推理性能,实验表明有效构造能降低推理困惑度,使MLLMs在选择性辅助构造上获得3.51%的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17847 2026-03-20 cs.LG cs.AI cs.SY eess.SY

Time-o1: Time-Series Forecasting Needs Transformed Label Alignment

Time-o1: 时间序列预测需要转换标签对齐

Hao Wang, Licheng Pan, Zhichao Chen, Xu Chen, Qingyang Dai, Lei Wang, Haoxuan Li, Zhouchen Lin

机构 * Xiaohongshu Inc(小红书公司) Zhejiang University(浙江大学) Renmin University of China(中国人民大学) Peking University(北京大学) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学通用人工智能国家重点实验室,智能科学与技术学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Department of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Center for Data Science, Peking University(北京大学数据科学中心) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Pazhou Laboratory (Huangpu), Guangzhou, Guangdong, China(广州黄埔实验室(华南))

AI总结 本文提出Time-o1,通过转换标签对齐缓解时间序列预测中的标签自相关和任务过多问题,提升模型性能。

Comments Accepted as poster in NeurIPS 2025

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18010 2026-03-20 cs.CL cs.AI cs.CY

Agentic Framework for Political Biography Extraction

政治传记提取的代理框架

Yifei Zhu, Songpo Yang, Jiangnan Zhu, Junyan Jiang

机构 * Department of Politics and Public Administration, The University of Hong Kong(政治与公共行政系,香港大学) School of International Studies, Peking University(国际关系学院,北京大学) Department of Political Science, Columbia University(政治学系,哥伦比亚大学)

AI总结 本文提出一种两阶段的合成-编码框架,利用大语言模型自动化提取多维精英传记,提升政治科学研究的效率和准确性。

Comments 70 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11101 2026-03-20 cs.RO cs.AI cs.DC

Thousand-GPU Large-Scale Training and Optimization Recipe for AI-Native Cloud Embodied Intelligence Infrastructure

千GPU大规模训练与优化方案用于AI原生云具身智能基础设施

Yongjian Guo, Yunxuan Ma, Haoran Sun, Zhong Guan, Shuai Di, Jing Long, Wanting Xu, Xiaodong Bai, Wen Huang, Yucheng Guo, Chen Zhou, Qiming Yang, Mingxi Luo, Tianyun Zhao, Hedan Yang, Song Wang, Xiaomeng Tian, Xiaolong Xiang, Zhen Sun, Yu Wei, Luqiao Wang, Yuzhen Li, Chenfeng Gu, Junwu Xiong, Yicheng Gong

机构 * AI Infra Team at JDT(JDT人工智能基础设施团队) Tsinghua University(清华大学) Peking University(北京大学) Tianjin University(天津大学) Beihang University(北洋大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出一种基于LeRobot框架的千GPU分布式训练平台,通过优化数据流程、训练效率和基础设施,实现具身智能模型训练速度提升40倍,推动下一代自主智能机器人发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11052 2026-03-20 cs.RO

AdaptPNP: Integrating Prehensile and Non-Prehensile Skills for Adaptive Robotic Manipulation

AdaptPNP: 集成抓取与非抓取技能以实现适应性机器人操控

Jinxuan Zhu, Chenrui Tie, Xinyi Cao, Yuran Wang, Jingxiang Guo, Zixuan Chen, Haonan Chen, Junting Chen, Yangyu Xiao, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) RoboScience(机器人科学) East China Normal University(华东师范大学) Peking University(北京大学) Nanjing University(南京大学)

AI总结 本文提出AdaptPNP框架,通过视觉-语言模型整合抓取与非抓取技能,实现复杂机器人操控任务的规划与执行。

Journal ref ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00053 2026-03-20 cs.LG cs.AI stat.ML

Quadratic Direct Forecast for Training Multi-Step Time-Series Forecast Models

二次直接预报用于训练多步时间序列预测模型

Hao Wang, Licheng Pan, Yuan Lu, Zhichao Chen, Tianqiao Liu, Shuting He, Zhixuan Chu, Qingsong Wen, Haoxuan Li, Zhouchen Lin

机构 * Xiaohongshu Inc.(小红书公司) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室,北京大学智能科学与技术学院) College of Engineering, Purdue University(普渡大学工程学院) School of Computing and Artificial Intelligence, Shanghai University of Finance and Economics(上海财经大学计算机与人工智能学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Squirrel AI Center for Data Science, Peking University(北京大学数据科学中心) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Pazhou Laboratory (Huangpu), Guangzhou, Guangdong, China(琶洲实验室(黄埔),广州,广东,中国)

AI总结 本文提出二次加权训练目标,解决多步时间序列预测中标签自相关和任务权重不均的问题,通过Quadratic Direct Forecast算法提升模型性能。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏