FreqNav: Stage-Wise Frequency Routing for Object-Oriented Aerial Vision-Language Navigation
FreqNav:面向面向对象空中视觉语言导航的分阶段频率路由
专题命中 可控生成 :diffusion(abstract)
AI总结 针对现有空中VLN方法的感知干扰问题,提出FreqNav框架,通过动态分配视觉令牌实现分阶段频率路由,提升性能并加快推理速度,验证了其实际应用潜力。
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
FreqNav:面向面向对象空中视觉语言导航的分阶段频率路由
专题命中 可控生成 :diffusion(abstract)
AI总结 针对现有空中VLN方法的感知干扰问题,提出FreqNav框架,通过动态分配视觉令牌实现分阶段频率路由,提升性能并加快推理速度,验证了其实际应用潜力。
通用多层网络上演化博弈的节点级动态最优控制
专题命中 可控生成 :diffusion(abstract)
AI总结 针对通用多层网络中演化博弈的最优控制问题,通过求解哈密尔顿-雅可比-贝尔曼方程得到节点级动态最优激励的解析解,经数值验证后与现有文献结果对比,为促进种群合作提供了新方案。
Comments 17 pages, 5 figures, 2 tables
学习操控一切:揭示在边界框引导策略中的数据扩展定律
机构 * Center for Intelligent Control and Telescience, Tsinghua Shenzhen International Graduate School(智能控制与遥科学中心,清华大学深圳国际研究生院) ; Beijing Xiaomi Robot Technology Co., Ltd(北京小米机器人科技有限公司)
专题命中 可控生成 :diffusion(abstract)
AI总结 本文提出利用边界框指令提升语义操控的泛化能力,并揭示数据扩展定律,通过高效数据收集和解耦框架实现85%的成功率。
面向平均场博弈与平均场控制问题的统一连续时间Q学习方法
专题命中 可控生成 :diffusion(abstract)
AI总结 本文针对环境模拟器无法直接获取群体分布的场景,提出解耦Iq函数,设计统一参数化Q学习算法,验证其在MFG与MFC学习任务中的有效性。
LeapBot-WA:通过预测性潜在对齐实现的世界锚定动作模型
专题命中 可控生成 :diffusion(abstract)
AI总结 研究针对世界动作模型依赖像素级视频生成的瓶颈,提出LeapBot-WA,通过预测性潜在对齐建立新范式,引入ISAE弥合模态差距,设计MoT架构,在多数据集上表现出色,实现高效强大的潜在中心范式及零样本鲁棒性和现实世界迁移。
声子分布函数在光滑晶体界面处的边界条件及界面角动量转移
专题命中 可控生成 :diffusion(abstract)
AI总结 本文提出声子在光滑晶体界面处的边界条件,揭示了界面角动量转移机制,阐明了自旋角动量与轨道角动量在声子传输中的作用。
Comments Revised version. Main text (35 pages, 9 figures, 1 table) + supplementary material (4 pages, 2 figures, no tables). This manuscript provides a detailed analysis of an accompanying Letter (latest version of arXiv:2409.08874)
语言模型语义空间中的关系几何
专题命中 可控生成 :diffusion(abstract)
AI总结 本文研究语言模型语义空间中关系几何的表征情况,通过三类语言模型在6种语义关系上的实验,发现非对称关系的表征更清晰,且不同模型依赖的信息来源存在差异。
Comments Manuscript under review
弥合形态差距:通过意图条件微调使VLA模型适应灵巧操作
机构 * Beihang University(北京航空航天大学) ; China Academy of Space Technology(中国空间技术研究院)
专题命中 可控生成 :diffusion(abstract)
AI总结 提出InDex框架,通过将预训练的1-DoF平行抓取输出重用作宏观虚拟抓取意图代理,结合两阶段解耦学习架构,实现VLA模型从低自由度夹爪到高自由度灵巧手的适应,有效缓解灾难性遗忘和动作流形坍缩。
PRISM:用于交互结构运动控制的多项式表示
机构 * University of Michigan(密歇根大学)
专题命中 可控生成 :diffusion(abstract)
AI总结 研究针对机器人观察中物理变量交互作用问题,提出PRISM策略表示,通过因式分解多项式模块展现高阶交互特征,在强化和模仿学习中应用,提升了人形机器人运动等性能,还能产生无传感器柔顺行为,表明多项式表示应成运动控制标准选择。
临床多智能体语言模型网络中语义漂移的谱动力学
专题命中 可控生成 :diffusion(abstract)
AI总结 研究临床多智能体语言模型网络中语义漂移的谱动力学,通过映射多智能体通信不确定性轨迹到嵌入空间,揭示结构瓶颈危害。提出动态谱监测技术,经图拉普拉斯算子特征分解确保全局状态扩散,保障自主医疗诊断可靠性。
EventOD:通过大语言模型引导的语义调制实现事件感知的OD流生成
机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) ; Zhongguancun Academy(中关村科学城研究院) ; Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工学院科研与技术联盟) ; Xiuzhong College, Tsinghua University(清华大学致理书院) ; Department of Automation, Central South University(中南大学自动化学院)
专题命中 可控生成 :diffusion(abstract)
AI总结 研究在破坏性事件下估计OD流的问题,提出EventOD框架,利用大语言模型和轻量级适应模块,通过输入级调制实现事件感知适应,实验表明该方法能提高重建精度和分布保真度。
SeT-Diff:面向高性能计算遥测和时间序列的语义基础模型
机构 * University of Bologna(博洛尼亚大学) ; CINECA(意大利国家科研计算中心)
专题命中 可控生成 :diffusion(abstract)
AI总结 针对数据中心计算节点建模需求,提出SeT-Diff基础模型,采用基于扩散的方法,在真实超级计算机数据集实验中,其重建任务平均绝对误差为0.0470,有零样本排列稳定性,单个模型可有效执行多种任务,是高性能计算系统有效的数据驱动数字孪生。
在用于格心离散化的多重网格公理下,对称V循环可能发散
专题命中 可控生成 :diffusion(abstract)
AI总结 研究格心离散化下多重网格方法中标准对称V循环的收敛性,通过两种构造表明其可能发散,即使满足相关公理假设,而W循环仍一致收缩,还给出了平滑计数阈值与相关常数的关系及具体离散化中的发散情况。
Comments 26 pages, 6 figures
基于有限维跟踪误差控制的线性抛物型系统输出调节
专题命中 可控生成 :diffusion(abstract)
AI总结 研究一维扩散反应系统在干扰和参考信号由不稳定外系统生成时的输出调节问题,提出基于有限维跟踪误差的调节器设计方法,通过推导组合装置转化问题,利用模态分解法刻画可观测性,证明观测器增益性质并给出LMI条件,分析了含未知时变测量延迟的情况。
Comments 16 pages, 3 figures
分支形态发生晶格模型中形态和拓扑的控制
专题命中 可控生成 :diffusion(abstract)
AI总结 该研究提出结合非平衡物理与发育生物学思想的晶格模型,用于形态发生素控制的分支形态发生。通过局部算子控制拓扑,研究分支模式动力学,发现拓扑保持稳态簇的回转半径与簇大小呈幂律缩放,给出了不同晶格中的指数。
Comments Main text and appendix: 11 pages, 6 figures, 2 tables
次黎曼流形上的反射薛定谔桥问题
专题命中 可控生成 :diffusion(abstract)
AI总结 研究次黎曼流形上反射薛定谔桥问题,针对几何和退化性困难,引入内在斜反射机制,证明相关过程有光滑正转移密度,通过正反向偏微分方程系统及基于偏微分方程的Sinkhorn迭代求解最优控制并举例说明。
作为最优控制的随机量子化
专题命中 可控生成 :diffusion(abstract)
AI总结 研究将随机量子化表述为有限时间随机最优控制问题,利用可处理参考过程及参考校正终端成本,通过神经网络学习残余控制实现最优随机量子化,在多峰势和二维晶格标量\(\phi^4\)理论中取得成果,将量子化表述为控制。
Comments 7 pages, 4 figures
VPWEM:非马尔可夫视觉-运动策略与工作记忆与事件记忆
机构 * School of Computing and Data Science, University of Hong Kong(计算与数据科学学院,香港大学)
专题命中 可控生成 :diffusion(abstract)
AI总结 VPWEM通过引入工作记忆和事件记忆,提升机器人在非马尔可夫任务中的动作生成性能。
Comments Accepted to IEEE Robotics and Automation Letters (RA-L). \textcopyright 2026 IEEE
语义空间的几何:Transformer架构的连续几何框架
机构 * INFN, Sezione di Cagliari(意大利国家核物理研究所,卡利亚里分部)
专题命中 可控生成 :diffusion(abstract)
AI总结 该研究提出连续几何框架,将Transformer架构运算建模为积分 - 微分方程,从几何公理出发转化其核心组件。通过实验验证,此框架能为大语言模型的稳定性、上下文及优化动态提供预测性描述词汇。
分数阶正则化双曲方程组的局部适定性
专题命中 可控生成 :diffusion(abstract)
AI总结 针对具有分数阶耗散和非局部交换子的双曲拟线性演化系统,利用分数阶拉普拉斯的自伴性和傅里叶乘子交换子的代数恒等式,结合非齐次Littlewood-Paley理论建立局部适定性,并通过Schauder不动点定理克服Banach收缩原理失效的困难。
不定随机线性二次最优控制问题:带有随机系数和泊松跳跃的闭环表示法
专题命中 可控生成 :diffusion(abstract)
AI总结 本文研究了具有随机系数和泊松跳跃的有限时间随机线性二次最优控制问题,证明了在均匀凸性条件下,带跳跃的随机黎曼-西格纳方程有唯一强正则解,从而得到开环最优控制的闭环表示。
Comments 26 pages
一种用于对流主导状态方程的椭圆分布最优控制问题的单调有限元方法
专题命中 可控生成 :diffusion(abstract)
AI总结 本文提出了一种单调有限元方法,用于求解对流主导的椭圆分布最优控制问题,通过保持离散最大原理和最优收敛阶次,确保数值稳定性与鲁棒性。
InertialAR:基于惯性框架的自回归3D分子生成
机构 * The Chinese University of Hong Kong(香港中文大学) ; Alibaba DAMO Academy(阿里巴巴达摩院) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; University of Ottawa(渥太华大学)
专题命中 可控生成 :diffusion(abstract)
AI总结 研究探索基于Transformer的自回归模型在3D分子生成上的应用。提出InertialAR,通过规范标记化、几何位置编码及分层自回归范式应对挑战,在无条件和可控生成任务中表现出色,多个指标达领先水平。
Comments Accepted at ICML 2026
变指数次扩散的最优控制
专题命中 可控生成 :diffusion(abstract)
AI总结 研究变指数次扩散的最优控制问题,采用卷积方法将模型转化为更易处理的形式,证明最优控制相关性质,通过离散卷积核方法得到状态方程和伴随方程格式的精度,经数值实验证实理论发现。
AeroAct:用于语言条件四旋翼飞行的以动作中心的世界-动作模型
机构 * School of Automation, Beijing Institute of Technology(北京理工大学自动化学院) ; School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院)
专题命中 可控生成 :diffusion(abstract)
AI总结 研究语言条件下四旋翼飞行问题,提出AeroAct模型,利用预训练视频扩散Transformer,结合相关采集设备和程序获取数据,经实验验证该模型能提升四旋翼飞行的目标跟踪和物体搜索性能,且对应策略可在实体四旋翼上执行。
长期平均冲击控制与均场交互
专题命中 可控生成 :diffusion(abstract)
AI总结 本文研究了具有均场交互的长期平均冲击控制问题,通过建立均衡策略和解决均场控制问题,探讨了个体合作实现长期平均利润的方法。
具有仅可测漂移的随机微分方程的最优控制:一种HJB方法
专题命中 可控生成 :diffusion(abstract)
AI总结 研究具有仅可测漂移的随机微分方程最优控制问题,通过分析HJB方程,利用偏微分方程技术和策略迭代方案,证明方程有唯一强解且与值函数一致,恢复贝尔曼最优性原理,还研究了平滑方案及控制集条件对收敛性的影响。
有限时间随机$H_2/H_\infty$控制:连续时间均场系统中的泊松跳跃
专题命中 可控生成 :diffusion(abstract)
AI总结 本文提出了一种针对连续时间均场系统中泊松跳跃的有限时间随机$H_2/H_\infty$控制方法,通过推导均场随机跳跃有界现实引理,解决了四组交叉耦合广义微分Riccati方程的可解性问题,从而实现了对交互粒子系统的鲁棒性和最优性能的控制。
Comments 12 pages, 6 figures
分数阶时空SIR模型的区域控制
专题命中 可控生成 :diffusion(abstract)
AI总结 研究有界区域上含分数阶扩散的非线性时空流行病学模型的区域最优控制问题,考虑疾病传播及两种控制方式,建立解的性质,证明最优控制存在并推导条件,发现集中接种疫苗可减轻疾病传播,给出数值模拟。
SANTS:面向世界动作模型的状态自适应调度器
机构 * Fudan University(复旦大学) ; Harbin Institute of Technology(哈尔滨工业大学) ; Deep Computing Era Technology Co., Ltd(深计算时代科技有限公司)
专题命中 可控生成 :diffusion(abstract)
AI总结 提出状态自适应噪声轨迹调度器(SANTS),通过根据视频状态动态选择去噪深度来优化视频到动作的扩散策略,在保持控制性能的同时大幅降低推理延迟。
Comments 17 pages, 5 figures, 8 tables. Project page: https://advanced-robotics-lab.github.io/SANTS/