arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3020
2511.13391 2026-06-04 cs.LG cs.AI math.CO math.MG

Finding Kissing Numbers with Game-theoretic Reinforcement Learning

用博弈论强化学习寻找亲吻数

Chengdong Ma, Théo Tao Zhaowei, Pengyu Li, Minghao Liu, Haojun Chen, Zihao Mao, Bo Li, Yuan Cheng, Yuan Qi, Yaodong Yang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Shanghai Academy of AI for Science(上海人工智能科学研究院) Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)

AI总结 将亲吻数问题转化为合作矩阵补全博弈,利用强化学习系统PackingStar在极值配置空间中探索,改进了15个长期未突破的亲吻数上界,并发现了新的可解释几何结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08498 2026-06-04 cs.CL

Characterizing, Evaluating, and Optimizing Complex Reasoning

表征、评估与优化复杂推理

Haoran Zhang, Yafu Li, Zhi Wang, Zhilin Wang, Shunkai Zhang, Xiaoye Qu, Yu Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) University of Science and Technology of China, Hefei, Anhui, China(中国科学技术大学) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) Nanjing University, Suzhou, Jiangsu, China(南京大学) Peking University, Beijing, China(北京大学)

AI总结 本文提出ME$^2$原则来表征推理质量,基于有向无环图(DAG)的成对评估方法,并构建TRM-Preference数据集训练Thinking Reward Model(TRM),以优化推理过程。

Comments Code and data are available at https://github.com/Simplified-Reasoning/TRM

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16919 2026-06-04 cs.CV cs.AI cs.RO

DVGT: Driving Visual Geometry Transformer

DVGT: 驾驶视觉几何变换器

Sicheng Zuo, Zixun Xie, Wenzhao Zheng, Shaoqing Xu, Fang Li, Shengyin Jiang, Long Chen, Zhi-Xin Yang, Jiwen Lu

机构 * Tsinghua University(清华大学) University of Macau(澳门大学) Xiaomi EV(小米电动车) Peking University(北京大学)

AI总结 提出DVGT,一种从无位姿多视角图像序列重建全局稠密3D点图的视觉几何变换器,通过交替注意力机制学习几何关系,无需相机参数和后处理对齐,在多个驾驶数据集上显著优于现有模型。

Comments Code is available at https://github.com/wzzheng/DVGT

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.05963 2026-06-04 math.NA cs.LG cs.NA cs.NE math.PR stat.ML

Machine learning approximation algorithms for high-dimensional fully nonlinear partial differential equations and second-order backward stochastic differential equations

基于机器学习的近似算法用于高维非线性偏微分方程和二阶反向随机微分方程

Christian Beck, Weinan E, Arnulf Jentzen

机构 * ETH Zurich(苏黎世联邦理工学院) Beijing Institute of Big Data Research(北京大数据研究院) Princeton University(普林斯顿大学) Peking University(北京大学)

AI总结 本文提出了一种基于机器学习的高维非线性二阶偏微分方程的求解方法,通过将非线性偏微分方程与二阶反向随机微分方程联系起来,并利用深度神经网络进行空间近似和随机梯度下降优化,展示了该方法在高维Black-Scholes-Barenblatt方程、Hamilton-Jacobi-Bellman方程和非线性期望问题中的高效性和准确性。

Comments 56 pages, 12 figures

Journal ref J. Nonlinear Sci. 29, 1563-1619 (2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.04702 2026-06-04 math.NA cs.LG cs.NA cs.NE math.PR stat.ML

Deep learning-based numerical methods for high-dimensional parabolic partial differential equations and backward stochastic differential equations

基于深度学习的高维抛物型偏微分方程和反向随机微分方程的数值方法

Weinan E, Jiequn Han, Arnulf Jentzen

机构 * Beijing Institute of Big Data Research (China)(北京大数据研究院(中国)) Princeton University (USA)(普林斯顿大学(美国)) Peking University (China)(北京大学(中国)) ETH Zurich (Switzerland)(苏黎世联邦理工学院(瑞士))

AI总结 本文提出了一种基于深度学习的算法,通过将反向随机微分方程与强化学习类比,利用解的梯度作为策略函数,采用神经网络近似策略函数,有效解决了高维非线性偏微分方程和反向随机微分方程的问题。

Comments 39 pages, 15 figures

Journal ref Commun. Math. Stat. 5, 349-380 (2017)

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.07661 2026-06-04 cs.LG cs.NA math.NA stat.ML

Efficient Recurrent Neural Networks using Structured Matrices in FPGAs

在FPGA上使用结构化矩阵实现高效的循环神经网络

Zhe Li, Shuo Wang, Caiwen Ding, Qinru Qiu, Yanzhi Wang, Yun Liang

机构 * Department of Electrical Engineering and Computer Science, Syracuse University, USA(Syracuse大学电气工程与计算机科学系) Center for Energy-efficient Computing and Applications (CECA), Peking University, China(北京大学能源高效计算与应用中心)

AI总结 本文提出在FPGA上使用块循环矩阵实现RNN,以提高模型压缩和加速,实验显示比ESE提升35.7倍的能效。

Comments To appear in International Conference on Learning Representations 2018 Workshop Track

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.09668 2026-06-04 math.NA cs.LG cs.NA cs.NE stat.ML

PDE-Net: Learning PDEs from Data

PDE-Net:从数据中学习偏微分方程

Zichao Long, Yiping Lu, Xianzhong Ma, Bin Dong

机构 * School of Mathematical Sciences(数学科学学院) School of Mathematical Sciences, Peking University(北京大学数学科学学院) Peking University, Beijing, China(北京大学北京中国) Beijing Computational Science Research Center(北京计算科学研究中心) Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心) Center for Data Science, Peking University(北京大学数据科学中心) Beijing Institute of Big Data Research(北京大数据研究院)

AI总结 本文提出PDE-Net,通过学习卷积核来获取微分算子,同时近似未知非线性响应,灵活地揭示复杂系统的动力学和隐藏的PDE模型。

Comments 15 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1701.07158 2026-06-04 math.NA cs.CV cs.NA math.FA

An Edge Driven Wavelet Frame Model for Image Restoration

基于边缘驱动的小波框架模型图像修复

Jae Kyu Choi, Bin Dong, Xiaoqun Zhang

机构 * Institute of Natural Sciences, Shanghai Jiao Tong University, 200240 Shanghai China(上海交通大学自然科学研究院) Beijing International Center for Mathematical Research, Peking University, 100871 Beijing China(北京大学北京国际数学研究中心) School of Mathematical Sciences(数学科学学院) MOE-LSC, Shanghai Jiao Tong University, 200240 Shanghai China(上海交通大学教育部重点实验室)

AI总结 本文提出一种边缘驱动的小波框架模型,通过将图像近似为分段光滑函数,对光滑和奇异区域施加不同强度的正则化,实现鲁棒的图像修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
1310.5035 2026-06-04 math.NA cs.LG cs.NA math.OC stat.ML

Linearized Alternating Direction Method with Parallel Splitting and Adaptive Penalty for Separable Convex Programs in Machine Learning

线性化交替方向法与并行分裂及自适应惩罚用于机器学习中的可分离凸程序

Zhouchen Lin, Risheng Liu, Huan Li

机构 * Key Lab. of Machine Perception (MOE), School of EECS, Peking University(机器感知重点实验室(教委)、电子工程学院、北京大学) School of Software and Microelectronics, Peking University(软件与微电子学院、北京大学)

AI总结 本文提出LADMPSAP方法,用于高效求解多块可分离凸程序,通过并行分裂和自适应惩罚改进传统ADM方法,实现更强的收敛性和更快的收敛速度,适用于稀疏表示和低秩恢复问题。

Comments Preliminary version published on Asian Conference on Machine Learning 2013

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03985 2026-06-03 cs.RO cs.AI cs.CV

Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking

Humanoid-GPT:扩展数据与结构以实现零样本运动跟踪

Zekun Qi, Xuchuan Chen, Dairu Liu, Chenghuai Lin, Yunrui Lian, Sikai Liang, Zhikai Zhang, Yu Guan, Jilong Wang, Wenyao Zhang, Xinqiang Yu, He Wang, Li Yi

机构 * Tsinghua University(清华大学) Galbot Inc.(Galbot公司) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Shanghai Qi Zhi Institute(上海启智研究院)

AI总结 提出Humanoid-GPT,一种基于GPT风格的因果Transformer,在十亿级运动语料上预训练,实现全身控制,通过扩展数据和模型容量达到对未见运动和任务的零样本泛化。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03980 2026-06-03 cs.LG cs.CL

Skill-RM: Unifying Heterogeneous Evaluation Criteria via Agent Skill

Skill-RM: 通过智能体技能统一异构评估标准

Tao Chen, Gangwei Jiang, Pengyu Cheng, Siyuan Huang, Yihao Liu, Jingwei Ni, Jiaqi Guo, Mengyu Zhou, Kai Tang, Junling Liu, Qinliang Su, Xiaoxi Jiang, Guanjun Jiang

机构 * Qwen Large Model Application Team, Alibaba(通义千问大模型应用团队,阿里巴巴) Sun Yat-sen University(中山大学) The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学) ETH Zürich University of Zurich(苏黎世联邦理工学院)

AI总结 提出Skill-RM框架,将奖励建模重构为可重用的奖励评估技能执行,通过动态选择和聚合证据统一异构评估标准,在奖励基准和下游任务中优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03971 2026-06-03 cs.CV

Video-Mirai: Autoregressive Video Diffusion Models Need Foresight

Video-Mirai: 自回归视频扩散模型需要远见

Yonghao Yu, Lang Huang, Runyi Li, Zerun Wang, Toshihiko Yamasaki

机构 * The University of Tokyo(东京大学) National Institute of Informatics(信息处理研究所) Peking University(北京大学)

AI总结 提出Video-Mirai训练方法,通过冻结的远见编码器从完整生成序列中提取未来信息并蒸馏到因果状态,在不改变推理过程的情况下弥合表示层面的规划差距,提升长视频生成的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03915 2026-06-03 cs.CV

PatchScene: Patch-based Voxel Diffusion for Large-Scale Scene Completion

PatchScene:基于体素块扩散的大规模场景补全

Qingdong Xu, Jiajun Zhu, Shilin Zhu, Xinjing He, Chao Lu, Huanran Wang, Jiyao Zhang

机构 * MEGVII Technology(MEGVII技术有限公司) Qianli Technology(千利技术) Peking University(北京大学) Northeastern University, China(中国东北大学) Northwest Polytechnical University, Xi’an(西北工业大学西安校区)

AI总结 提出PatchScene,一种基于体素块扩散的框架,通过局部3D区域细粒度生成、置信度引导的时空融合和环形流扩散策略,实现大规模LiDAR场景补全,在SemanticKITTI上达到最优性能并展现强泛化能力。

Comments 10 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03909 2026-06-03 cs.CV

SparseStreet: Sparse Gaussian Splatting for Real-Time Street Scene Simulation

SparseStreet: 用于实时街景模拟的稀疏高斯泼溅

Qingpo Wuwu, Xiaobao Wei, Peng Chen, Nan Huang, Zhongyu Zhao, Hao Wang, Ming Lu, Ningning Ma, Shanghang Zhang

机构 * Peking University(北京大学) Chinese Academy of Sciences(中国科学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Autonomous Driving Development, NIO(蔚来自动驾驶开发)

AI总结 针对街景重建中高斯原语冗余问题,提出节点可学习剪枝与背景压缩框架,实现高达80%压缩比且质量损失极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03743 2026-06-03 cs.AI

Proof-Refactor: Refactoring Generated Formal Proofs into Modular Artifacts

Proof-Refactor: 将生成的形式化证明重构为模块化工件

Yiming Fu, Peixuan Liu, Zichen Wang, Kun yuan

机构 * Department of Mathematics, Southern University of Science and Technology(南方科技大学数学系) School of Mathematical Sciences, Peking University(北京大学数学科学学院) Center for Machine Learning Research, Peking University(北京大学机器学习研究中心)

AI总结 提出一个名为 Proof-Refactor 的智能体框架,通过四阶段流程(提取候选证明片段、设计辅助声明、形式化证明提取和设计的组件、使用验证组件修复原始证明)将大语言模型生成的形式化证明重构为更模块化、可读、可维护和可重用的工件,在 PutnamBench 和 Putnam2025 上的 Lean 证明重构中优于基线。

Comments 21 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03532 2026-06-03 cs.LG cs.AI

When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillation

教师何时应该移动?自在线策略蒸馏中的时间耦合与稳定性

Haowei Guo, Baolong Bi, Ruicheng Zhang, Bingqian Sun, Wentao Zhang

机构 * Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) Tsinghua University(清华大学)

AI总结 研究自在线策略蒸馏中教师更新调度对稳定性的影响,提出基于隔离期和门控机制的CGTR方法,实现零崩溃和最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03467 2026-06-03 cs.AI

StepFinder: A Temporal Semantic Framework for Failure Attribution in Multi-Agent Systems

StepFinder:多智能体系统中故障归因的时间语义框架

Taiyu Zhu, Yifan Wu, Weilin Jin, Ying Li, Gang Huang

机构 * Peking University(北京大学)

AI总结 提出StepFinder框架,通过将执行日志编码为时间语义序列并利用时序建模与注意力模块,高效准确地定位多智能体系统中的故障根因步骤。

Comments 12 pages, 5 figures. Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03262 2026-06-03 cs.LG cs.NA math.NA

Let There Be Light: Reflection, Refraction and Scattering for Neural Operators

Let There Be Light: 面向神经算子的反射、折射与散射

Keke Wu, Yixuan Zhang, Jingrun Chen

机构 * Suzhou Institute for Advanced Research, University of Science and Technology of China, Suzhou(苏州先进研究院,中国科学技术大学,苏州) School of Artificial Intelligence and Data Science, University of Science and Technology of China, Hefei(人工智能与数据科学学院,中国科学技术大学,合肥) Suzhou Big Data & AI Research and Engineering Center, Suzhou(苏州大数据与人工智能研究与工程中心,苏州) School of Mathematical Science, Peking University, Beijing(数学科学学院,北京大学,北京) School of Mathematical Sciences, University of Science and Technology of China, Hefei(数学科学学院,中国科学技术大学,合肥)

AI总结 提出一种受光传输启发的神经算子LiNO,通过反射、折射和散射三种机制分解潜在演化,实现局部特征调制与全局空间通信的结构化分离,并开发高效散射变体将空间复杂度从二次降至线性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03239 2026-06-03 cs.CL

ARBOR: Online Process Rewards via a Reusable Rubric Buffer for Search Agents

ARBOR: 通过可复用评分标准缓冲区的在线过程奖励用于搜索智能体

Zheng Liu, Longxiang Zhang, Xintong Wang, Zhiang Xu, Shaoxiong Zhan, Xin Shan, Wen Huang, Tao Dai, Shu-Tao Xia, Chengfu Huo, Liang Ding

机构 * Tsinghua University(清华大学) Alibaba Group(阿里巴巴集团) Peking University(北京大学) Shenzhen University(深圳大学)

AI总结 针对基于LLM的搜索智能体训练中结果奖励缺乏过程监督的问题,提出ARBOR框架,通过维护跨查询共享的评分标准记忆库,利用对比轨迹生成局部草案并整合为通用评分标准,以稀疏成对判断提供过程级梯度,在四个多跳QA基准上优于GRPO和DAPO基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03234 2026-06-03 cs.LG

Right Makes Might: Aligning Verified Hidden States Empowers RL Reasoning

正确即力量:对齐验证的隐藏状态增强强化学习推理

Ziyue Wang, Aomufei Yuan, Yongfu Zhu, Shuai Dong, Wenpu Liu, Yiran Yao, Weichu Xie, Yuqi Xu, Caoyuan Ma, Wenqi Shao, Xiaoying Zhang, Nan Duan, Jiaqi Wang

机构 * Peking University(北京大学) JINGDONG(京东) Shanghai Innovation Institute(上海创新研究院) The University of Tokyo(东京大学) Tianjin University(天津大学)

AI总结 提出Hidden-Align辅助损失函数,在强化学习训练中对齐正确rollout在锚点token处的最后一层隐藏状态,提升数学推理性能。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03223 2026-06-03 cs.RO cs.AI

BotDirector: Robot Storytelling Across the Symmetrical Reality with Multi-modal Interactions

BotDirector:跨对称现实的多模态交互机器人讲故事

Zhe Sun, Meng Wang, Lei Wang, Yuxi Wang, Wanxin Li, Yujia Peng, Zhenliang Zhang

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI, Beijing, China(国家一般人工智能重点实验室,BIGAI,北京,中国) Peking University, Beijing, China(北京大学,北京,中国)

AI总结 提出一个结合具身交互和自然语言交互的机器人讲故事系统,利用LLM代理将儿童创建的叙事转化为自导航群体机器人的运动序列,支持灵活场景和日常物品。

Journal ref 2026 IEEE Conference on Virtual Reality and 3D User Interfaces Abstracts and Workshops (VRW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03209 2026-06-03 cs.LG

DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data

DECA: 去中心化逐块Adam优化器用于非独立同分布数据上的高效大语言模型全参数微调

Yunsheng Yuan, Shaowei Li, Kai Wang, Zhongyuan Sun, Zheng Zhang, Kai Han, Jun Luo, Feng Li

机构 * School of Computer Science and Technology, Shandong University, Qingdao China(山东大学计算机科学与技术学院,青岛中国) School of Mathematical Science, Peking University, China(北京大学数学科学学院,中国) IEIT SYSTEM, China(IEIT SYSTEM,中国) School of Computer Science and Artificial Intelligence, Shanghai University of Finance and Economics, Shanghai, China(上海财经大学计算机科学与人工智能学院,上海中国) College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院,新加坡)

AI总结 针对隐私敏感和资源受限环境中的大语言模型微调,提出DECA框架,通过逐块Adam优化和去中心化共识机制,在非独立同分布数据上实现高效的全参数微调,兼顾收敛速度、下游性能和资源效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03204 2026-06-03 cs.RO eess.SP

Toward Gripper-Integrated Active Electrosense for Pre-Contact Sensing in Underwater Soft Grippers

面向水下软体夹爪预接触感知的夹爪集成主动电感知

Ahsan Tanveer, Muhammad Hamza, Waqar Hussain Afridi, Chen Wang, Guangming Xie

机构 * Intelligent Biomimetic Design Lab, School of Advanced Manufacturing and Robotics, State Key Laboratory for Turbulence and Complex Systems, College of Engineering, Peking University(智能仿生设计实验室,先进制造与机器人学院,湍流与复杂系统国家重点实验室,北京大学) National Engineering Research Center of Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) Institute of Ocean Research, Peking University(海洋研究所,北京大学)

AI总结 针对水下视觉受限问题,提出一种集成于软体夹爪的主动电感知方法,通过测量导电介质中电场扰动实现预接触信号检测,实验表明多电极电压读数可检测物体引起的结构化变化。

Comments Extended abstract accepted to the IEEE ICRA 2026 Workshop on Manipulation Robustness

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03197 2026-06-03 cs.CL

MemTrain: Self-Supervised Context Memory Training

MemTrain:自监督上下文记忆训练

Ziheng Li, Xingrun Xing, Haoqing Wang, Zhi-Hong Deng, Yehui Tang

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) Samsung Research, Beijing, China(三星研究院,北京,中国)

AI总结 提出自监督框架MemTrain,通过两个耦合代理任务(端到端掩码重建和中间记忆召回)利用无标签维基百科语料增强LLM代理的上下文记忆能力,显著提升下游长文本推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03094 2026-06-03 cs.LG

FGRPO: Federated GRPO with Adaptive Aggregation on Non-IID Data

FGRPO:非独立同分布数据上具有自适应聚合的联邦GRPO

Pengyu Chen, Shaowei Li, Kai Wang, Yunsheng Yuan, Kai Han, Jun Luo, Feng Li

机构 * School of Computer Science and Technology, Shandong University(山东大学计算机科学与技术学院) School of Mathematical Science, Peking University(北京大学数学科学学院) School of Computer Science and Artificial Intelligence, Shanghai University of Finance and Economics(上海财经大学计算机科学与人工智能学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 提出联邦GRPO(FGRPO)框架,通过基于相对性能增益的自适应聚合机制,在非独立同分布数据上实现去中心化推理模型微调,兼顾数据隐私与鲁棒收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02964 2026-06-03 cs.AR cs.CL cs.LG

Multi-Segment Attention: Enabling Efficient KV-Cache Management for Faster Large Language Model Serving

多段注意力:实现高效KV缓存管理以加速大型语言模型服务

Chunan Shi, Yilei Chen, Yilin Chen, Xupeng Miao, Bin Cui

机构 * Peking University(北京大学)

AI总结 提出AsymCache,一种计算延迟感知的KV缓存管理系统,通过多段注意力、缓存驱逐策略和自适应分块调度器,在保持无损精度的同时显著降低TTFT和TPOT。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02638 2026-06-03 cs.SD cs.AI eess.AS

SegTune: Structured and Fine-Grained Control for Song Generation

SegTune:歌曲生成的结构化与细粒度控制

Yuejiao Wang, Zihao Ji, Pengfei Cai, Xu Li, Haorui Zheng, Zewen Song, Zhongliang Liu, Chen Zhang, Pengfei Wan

机构 * Kling Team, Kuaishou Technology(快手科技 Kling 团队) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

AI总结 提出基于扩散Transformer的SegTune框架,通过用户或LLM指定局部音乐描述实现结构化细粒度控制,并引入LLM时长预测器实现精确歌词-音乐对齐,在音乐性和可控性上超越现有基线。

Comments This paper has been accepted to ACL 2026 as an oral presentation and has been nominated for the Best Paper Award. This work is a revised and extended version of an earlier technical report (arXiv:2510.18416). arXiv admin note: text overlap with arXiv:2510.18416

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02091 2026-06-03 cs.CL

DFlare: Scaling Up Draft Capacity for Block Diffusion Speculative Decoding

DFlare: 扩展块扩散推测解码的草稿容量

Jiebin Zhang, Zhenghan Yu, Song Liu, Eugene J. Yu, Zheng Li, Dawei Zhu, Jiangshan Duo, Weimin Xiong, Yifan Song, Guanghua Yu, Jianchen Zhu, Sujian Li

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Tencent(腾讯)

AI总结 提出DFlare方法,通过轻量级逐层融合机制扩展草稿模型容量,在多个基准上实现平均5.52倍加速。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01241 2026-06-03 cs.RO

OneVLA: A Unified Framework for Embodied Tasks

OneVLA:面向具身任务的统一框架

Lingfeng Zhang, Xiaoshuai Hao, Yingbo Tang, Lei Zhou, Shuyi Zhang, Jinkun Liu, Hongsheng Li, Chenhao Zhang, Qiang Zhang, Hangjun Ye, Xiaojun Liang, Long Chen, Wenbo Ding

机构 * Tsinghua University(清华大学) Pengcheng Laboratory(鹏城实验室) Xiaomi EV(小米电动车) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peking University(北京大学) HKUST(GZ)(香港科技大学(广州))

AI总结 提出统一架构OneVLA,通过设计统一动作头和渐进式训练策略(含数据构建和思维链微调),在导航与操作任务上实现跨任务正迁移,达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30166 2026-06-03 cs.SI cs.LG

SAHG: Sector-Anisotropic Hyperbolic Graph Model for Social Bot Detection

SAHG:用于社交机器人检测的扇区各向异性双曲图模型

Hanning Lu, Yingguang Yang, Jinwei Su, Yang Liu, Zhaoqian Yao, Yaoming Li, Taoran Liang, Ziyi Zhang, Ran Ran, Kefu Xu, Bin Chong

机构 * University of Leeds(利兹大学) University of Science and Technology of China(中国科学技术大学) South China Normal University(华南师范大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Harbin University of Commerce(哈尔滨商业大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 提出扇区各向异性双曲图模型SAHG,通过方向依赖曲率场和扇区原型解决欧几里得GNN在层次无标度社交图中的失真问题以及异质连接导致的信号污染问题,在三个基准上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏