arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 193
2606.25503 2026-06-25 cs.RO cs.CV 新提交

AISPO: Enhancing Depth Reliability for Robotic Manipulation of Non-Lambertian Objects via Affine-Invariant Shape Prior

AISPO: 通过仿射不变形状先验增强非朗伯体物体机器人操作的深度可靠性

Zhiming Chen, Linfang Zheng, Kun Zhang, Hyung Jin Chang, Wei Zhang, Hongyu Yu, Hua Chen

机构 * The Hong Kong University of Science & Technology(香港科技大学) The University of Hong Kong(香港大学) Southern University of Science & Technology(南方科技大学) Zhejiang University(浙江大学) LimX Dynamics

AI总结 提出AISPO深度补全框架,结合多尺度RGB-D特征融合与仿射不变形状先验,提升非朗伯体物体(如透明、高反光表面)的深度可靠性,显著提高机器人抓取成功率。

Comments Published in IEEE Robotics and Automation Letters. 8 pages. Accepted April 2026

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 7996-8003, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19190 2026-06-25 cs.RO 新提交

FAST-LIVGO: A Degeneracy-Robust LiDAR-Inertial-Visual-GNSS Fusion Odometry

FAST-LIVGO:一种退化鲁棒的LiDAR-惯性-视觉-GNSS融合里程计

Zhiyu Chen, Chunran Zheng, Jiayu Wen, XiaoLei Zhang, Jiaming Xu, Feng Pan, Yukang Cui

机构 * College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院) Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系) College of Automation, Harbin Engineering University(哈尔滨工程大学自动化学院)

AI总结 提出一种基于误差状态迭代卡尔曼滤波的紧耦合LiDAR-惯性-视觉-GNSS融合框架,通过动态时间规整的时空对齐模块、多普勒和时差载波相位观测模型以及退化感知的双模式异常值拒绝策略,在长期大尺度动态环境中实现高精度鲁棒的状态估计。

Comments Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24849 2026-06-24 cs.CV cs.AI 新提交

IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation

IV-CoT: 面向结构感知文本到图像生成的隐式视觉思维链

Zixuan Li, Haokun Lin, Yicheng Xiao, Zhiwei Li, Xinyang Song, Zelong Zheng, Yong He, Heng Yao, Ke Ding, Chao Yu, Chuan Yuan, Qi Li, Zhenan Sun

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) Ant Group(蚂蚁集团) The University of Hong Kong(香港大学)

AI总结 提出隐式视觉思维链(IV-CoT)框架,通过结构到语义的级联分解和训练时草图监督,在不增加推理开销的情况下提升文本到图像生成的结构感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24466 2026-06-24 cs.RO 新提交

FT-WBC: Learning Fault-Tolerant Whole-Body Control for Legged Loco-Manipulation

FT-WBC:学习腿式操作任务的容错全身控制

Yudong Zhong, Pengfei Mai, Sikai Guo, Jiahang Cao, Zhihai Bi, Qiuyue Liu, Ziyan Feng, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学)

AI总结 针对腿式机械臂在致动器故障下易失稳的问题,提出FT-WBC框架,通过故障估计器和姿态适应模块实现容错全身控制,提升生存率和操作空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24231 2026-06-24 cs.AI 新提交

FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning

FlowR2A: 学习奖励到动作分布用于多模态驾驶规划

Xirui Li, Zhe Liu, Xiaoqing Ye, Wenhua Han, Yifeng Pan, Junyu Han, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Changan Automobile(长安汽车)

AI总结 提出FlowR2A,通过流匹配解码器学习奖励条件动作分布,统一了基于评分和基于锚点的方法,实现密集监督与动态生成,在NAVSIM基准上取得最优结果。

Comments Project page: https://lixirui142.github.io/flowr2a-ad

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24225 2026-06-24 cs.CV 新提交

Geometry-Instructed Video Editing

几何指导的视频编辑

Chirui Chang, Xiaoyang Lyu, Yi-Hua Huang, Haoru Tan, Shizhen Zhao, Yikang Ding, Jianmin Bao, Xin Tao, Pengfei Wan, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Kuaishou Technology(快手科技)

AI总结 提出GIVE框架,通过深度框和方向框统一描述对象状态变化,实现物体级几何编辑(平移、旋转、缩放等),并保持阴影等二次效果一致,在合成和真实视频上展现良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23848 2026-06-24 cs.RO 新提交

Enforcing Human-like Kinematics in Dexterous Piano Playing via Adversarial Posture Regularization

通过对抗姿态正则化在灵巧钢琴演奏中强制执行类人运动学

Bin Qiu, Yanming Shao, Guanyu Cai, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 提出对抗姿态正则化(APR)方法,利用少量非对齐的人类演奏数据,通过对抗目标匹配策略姿态分布与人类先验,使高自由度灵巧手在物理仿真中弹钢琴时呈现更自然的姿势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20678 2026-06-23 stat.ML cs.LG stat.ME 新提交

Beyond Importance: Interchange-Sobol Sensitivity Reveals Task-Specific Content Channels in Transformer Components

超越重要性:互换-Sobol灵敏度揭示Transformer组件中的任务特定内容通道

Yifeng Guo, Jin-Hong Du, Xiang Chen

机构 * St. Jude Children’s Research Hospital(圣犹大儿童研究医院) The University of Hong Kong(香港大学)

AI总结 提出互换组Sobol分解(IGSD),通过配对干预区分组件的内容传输与计算退化角色,在事实回忆任务中发现标准方法低估的早期层内容通道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23449 2026-06-23 cs.AI cs.OS 新提交

AOHP: An Open-Source OS-Level Agent Harness for Personalized, Efficient and Secure Interaction

AOHP:一个用于个性化、高效和安全交互的开源操作系统级Agent框架

Shanhui Zhao, Jiacheng Liu, Guohong Liu, Jichao Yan, Jialei Ye, Yuhao Yang, Hao Wen, Shizuo Tian, Yizhen Yuan, Yuxuan Chen, Yunxin Liu, Ju Ren, Ya-Qin Zhang, Chao Huang, Yao Guo, Yuanchun Li

机构 * Tsinghua University(清华大学) Peking University(北京大学) The University of Hong Kong(香港大学)

AI总结 提出AOHP,一个基于AOSP的操作系统级Agent框架,通过将Agent视为一等OS参与者,实现个性化服务组合、高效Agent接口和安全信息流,在任务完成率、令牌成本和策略合规性上优于现有系统。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22977 2026-06-23 cs.CL cs.AI 新提交

StatABench: Dataset and Framework for Evaluating Statistical Analysis Capabilities of LLMs

StatABench:评估大语言模型统计分析能力的数据集与框架

Youxin Zhu, Yixuan Ding, Peng Lai, Longyue Wang, Bingyi Jing, Guanhua Chen

机构 * Southern University of Science and Technology(南方科技大学) Alibaba Group(阿里巴巴集团) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) The University of Hong Kong(香港大学)

AI总结 提出StatABench基准,包含404道封闭题和30道开放建模任务,评估LLM在统计分析上的能力,实验显示最佳模型仅达68.6%准确率,揭示工具推理和建模决策等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22353 2026-06-23 cs.CV 新提交

Interest Entanglement: The Hidden Barrier to Blind Super-Resolution Optimization

兴趣纠缠:盲超分辨率优化的隐藏障碍

Junxiong Lin, Xinji Mai, Qianyu Guo, Haoran Wang, Zeng Tao, Xuan Tong, Ivy Pan, Wenqiang Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) The University of Hong Kong(香港大学) Shanghai Institute of Virology, Shanghai Jiao Tong University School of Medicine(上海病毒研究所,同济大学医学院)

AI总结 针对图像超分辨率中保真度与感知质量冲突的问题,提出基于共享特征表示的超分辨率框架(SFR),通过解耦不同优化目标的学习过程并引入InfoSqueeze模块,实现两者有效平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22347 2026-06-23 cs.CV 新提交

Customizing Video Portraits via Identity-ActionDecoupling

通过身份-动作解耦定制视频肖像

Junxiong Lin, Haoran Wang, Xinji Mai, Zeng Tao, Xuan Tong, Ivy Pan, Wenqiang Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) The University of Hong Kong(香港大学)

AI总结 提出身份-动作解耦框架,通过身份解耦损失和文本对齐损失,无需微调即可生成保持身份一致且表情丰富的视频。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22142 2026-06-23 cs.RO 新提交

RoboLineage: Agent-Native Data Lifecycle Governance Across Robot Policy Iterations

RoboLineage:跨机器人策略迭代的智能体原生数据生命周期治理

Qian Luo, Wentao Guo, Zhennan Qin, Nanchun Guo, Yunhan Zhao, Yi Ma, Yanchao Yang

机构 * Transcengram The University of Hong Kong(香港大学) Beijing Institute of Technology(北京理工大学)

AI总结 提出RoboLineage系统,通过将数据收集、审查、训练、评估等步骤表示为类型化谱系工件,实现机器人策略迭代的显式生命周期管理,提升迭代速度与可审计性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21943 2026-06-23 cs.LG cs.AI 新提交

Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning

LLM上的模块化强化学习:从MDP创建到探索与学习

Zhao Yang, Yuxuan Jiang, Ting-Chih Chen, Lincen Yang, Annie Wong, Chao Gao, Jacob E. Kooi, Zhong Li, Jiayang Shi, Kevin Qiu, Qi Huang, Xinrui Zu, Shiping Yang, Hengyuan Zhang, Ngai Wong, Filip Ilievski, Shujian Yu, Aske Plaat, Zhaochun Ren, Mark Hoogendoorn, Vincent François-Lavet

机构 * VU Amsterdam(阿姆斯特丹自由大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校) Leiden University(莱顿大学) University of Warsaw(华沙大学) Simon Fraser University(西蒙菲莎大学) The University of Hong Kong(香港大学)

AI总结 本文系统梳理LLM后训练中的强化学习方法,从MDP构建、探索策略到学习范式,揭示当前方法分布不均,指出价值函数、离策略AC及自举法等领域存在研究空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21753 2026-06-23 cs.GR cs.AI cs.CV 新提交

Scene-Level Heterogeneous Physics Simulation with 3D Gaussian Splats

基于3D高斯散点的场景级异构物理仿真

Xiaoyang Liu, Shangzhe Wu, Kai Han

机构 * The University of Hong Kong(香港大学) University of Cambridge(剑桥大学)

AI总结 提出一种表示抽象框架,将3D高斯散点、虚拟网格和流体等异构资产统一为物理粒子集,实现场景级、多求解器的物理仿真,支持3DGS资产的非刚性变形与复杂双向交互。

Comments Accepted to CVPR 2026 Findings

Journal ref Proc. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Findings, 2026, pp. 6456-6465

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21300 2026-06-23 cs.CV 新提交

SCOPE: Scale-Consistent One-Pass Estimation of 3D Geometry

SCOPE:尺度一致的3D几何单遍估计

Zheng Zhang, Lihe Yang, Tianyu Yang, Chaohui Yu, Yixing Lao, Xiaoyang Guo, Biao Gong, Fan Wang, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团)

AI总结 提出SCOPE方法,通过仿射不变3D点图和三个关键创新(视角不变几何、外观不变学习、频率调制定位),实现从长单目视频序列中高效、一致地估计3D几何,在ScanNet上相对点图误差降低24.2%,时间对齐误差降低34.9%。

Comments SIGGRAPH Conference Papers 2026. 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21240 2026-06-23 cs.CR cs.CV 新提交

DIPBox: A Multi-scale Testing Framework for Tracking Dataset Regeneration

DIPBox:用于追踪数据集再生的多尺度测试框架

Tian Dong, Yan Meng, Shaofeng Li, Guoxing Chen, Yuling Chen, Zhen Liu, Haojin Zhu, Hao Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Southeast University(东南大学) Guizhou University(贵州大学) The University of Hong Kong(香港大学)

AI总结 针对数据集再生威胁,提出多尺度特征相似度指标和DIPBox框架,通过样本级、集合级和分布级特征测试追踪再生数据集,实验验证其有效性。

Comments Accepted by ACM CCS 2026. Please cite this paper as "Tian Dong, Yan Meng, Shaofeng Li, Guoxing Chen, Yuling Chen, Zhen Liu, Haojin Zhu, Hao Chen. DIPBox: A Multi-scale Testing Framework for Tracking Dataset Regeneration. In the Proceedings of ACM Conference on Computer and Communications Security (CCS 2026)."

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21136 2026-06-23 cs.LG cs.RO 新提交

Horizon Adaptive Offline Policy Learning via Value Stitching

通过价值拼接的自适应地平线离线策略学习

Kexin Zheng, Xianyuan Zhan, Xintao Yan

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学)

AI总结 提出VAST方法,通过递归、自适应地平线价值组合替代固定地平线备份,利用未来状态和地平线长度条件辅助价值函数与拼接策略,实现离线策略优化,在长时域任务中优于固定步长和生成价值基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20871 2026-06-23 cs.RO 新提交

Geometric Entropy: When Trajectory Diversity Helps and Hurts in Imitation Learning

几何熵:轨迹多样性在模仿学习中的利弊

Qian Luo, Ruizhe Liu, Pei Zhou, Xunzhe Zhou, Yanchao Yang

机构 * InfoBodied AI Lab, The University of Hong Kong(香港大学信息体人工智能实验室) Transcengram

AI总结 提出几何熵(H_G)量化演示轨迹的几何多样性,发现成功率与H_G呈倒U型关系,且最优熵随任务掌握度增加而降低,可用于数据集审计与校准。

Comments Accepted to IROS 2026. Project page: https://geometric-entropy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20686 2026-06-23 cs.RO cs.AI 新提交

JPPD: Joint Prediction_Planning Diffusion with Differentiable Safety Guidance for Dynamic Obstacle Avoidance in Intelligent Transportation Systems

JPPD:具有可微安全引导的联合预测-规划扩散框架用于智能交通系统中的动态障碍物规避

Jiahao Wu, Shengwen Yu

机构 * The University of Hong Kong(香港大学) Guangzhou College of Commerce(广州商学院)

AI总结 提出联合预测-规划扩散框架,将参与者预测与机器人规划视为条件轨迹生成问题,通过可微安全势引导和条件流匹配提升共享空间中的安全性与效率。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20583 2026-06-23 cs.NI cs.AI 新提交

Physical-AI: From Channel Awareness to Environmental Intelligence in 6G Wireless Networks

Physical-AI: 从信道感知到6G无线网络中的环境智能

Farooque Hassan Kumbhar, Kapal Dev, Sunder Ali Khowaja, Alexandros-Apostolos A. Boulogeorgos, Mehdi Bennis, Yuanwei Liu

机构 * Augmented Cognition Meta-communications ERC Research Center, Korea University, Korea(增强认知元通信ERC研究中心,韩国大学,韩国) Department of Computer Science, Munster Technological University (MTU)(计算机科学系,穆斯特技术大学(MTU)) School of Computing, Faculty of Engineering and Computing, Dublin City University, Ireland(计算学院,工程与计算学院,都柏林城市大学,爱尔兰) Department of Electrical and Computer Engineering of the Democritus University, Greece(德米特里大学电气与计算机工程系,希腊) Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(电气与计算机工程系,香港大学,香港) Department of Electronic Engineering, Kyung Hee University, Yongin-si, Gyeonggi-do 17104, South Korea(电子工程系, Kyung Hee大学, Yongin-si, Gyeonggi-do 17104, 韩国)

AI总结 提出Physical-AI架构,利用自监督时空无线电基础模型将分布式观测转化为共享环境表征,通过多推理头估计阻塞、用户分布等环境属性,并基于神经决策层实现主动控制,降低中断概率和阻塞响应延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15171 2026-06-23 cs.RO 新提交

Seam-to-Graph Reconstruction for Garment Configuration Alignment

用于服装配置对齐的缝到图重建

Xuzhao Huang, Kai Tang, Fuyuki Tokuda, Norman C. Tien, Kazuhiro Kosuge

机构 * JC STEM Lab of Robotics for Soft Materials, Department of Electrical and Electronic Engineering, Faculty of Engineering, The University of Hong Kong(香港大学工程学院电气与电子工程系JC STEM软材料机器人实验室) Unprecedented-scale Data Analytics Center, Tohoku University(东北大学前所未有规模数据分析中心) Graduate School of Information Sciences, Tohoku University(东北大学信息科学研究科) Department of Electrical and Electronic Engineering, Faculty of Engineering, The University of Hong Kong(香港大学工程学院电气与电子工程系)

AI总结 提出基于图神经网络和注意力机制的Seam-to-Graph网络,将部分可观测的缝信息映射为拓扑结构骨架图,用于实时服装状态估计,并设计变形感知分层视觉伺服控制器实现服装配置对齐,在双臂机器人系统上验证了人类级精度和鲁棒性。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20506 2026-06-19 cs.CV cs.AI 新提交

FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining

FreeStyle: 从社区LoRA挖掘中实现风格-内容双参考生成的自由控制

Jinghong Lan, Wei Cheng, Yunuo Chen, Ziqi Ye, Peng Xing, Yixiao Fang, Rui Wang, Yufeng Yang, Xuanyang Zhang, Xianfang Zeng, Difan Zou, Gang Yu, Chi Zhang

机构 * Fudan University(复旦大学) StepFun Westlake University(西湖大学) University of Hong Kong(香港大学)

AI总结 提出FreeStyle框架,利用社区LoRA作为锚点,通过两阶段课程学习(注意力级约束和频率感知RoPE调制)解决双参考生成中的内容泄露问题,并引入新基准和评估指标,实现风格对齐、内容保持与泄露抑制的平衡。

Comments 35 pages, 26figures. Project page: https://github.com/Blue2Giant/FreeStyle

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20424 2026-06-19 cs.RO 新提交

LIT-GS: LiDAR-Inertial-Thermal Gaussian Splatting for Illumination-Robust Mapping

LIT-GS: 面向光照鲁棒建图的激光雷达-惯性-热高斯泼溅

Shikuan Shi, Chunran Zheng, Jiaming Xu, Tianyong Ye, Tao Yu, Yukang Cui

机构 * College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院) Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系)

AI总结 提出LIT-GS框架,利用激光雷达平面几何约束联合优化位姿与高斯,解决光照变化和纹理缺失场景下RGB依赖的脆弱性问题,提升几何精度与渲染质量。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20333 2026-06-19 cs.AI 新提交

SoftSkill: Behavioral Compression for Contextual Adaptation

SoftSkill: 用于上下文适应的行为压缩

Xijia Tao, Yihua Teng, Xinyu Fu, Ziru Liu, Kecheng Chen, Yuzhi Zhao, Suiyun Zhang, Rui Liu, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Huawei Research(华为研究院) City University of Hong Kong(香港城市大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 提出SoftSkill方法,通过可训练的软技能前缀压缩自然语言技能为紧凑连续向量,在冻结基模型上提升问答和数学任务性能,减少标记数量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20092 2026-06-19 cs.CV 新提交

EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies

EventVLA: 面向长程视觉-语言-动作策略的事件驱动视觉证据记忆

Ganlin Yang, Zhangzheng Tu, Yuqiang Yang, Sitong Mao, Junyi Dong, Tianxing Chen, Jiaqi Peng, Jing Xiong, Jiafei Cao, Jifeng Dai, Wengang Zhou, Yao Mu, Tai Wang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Dalian University of Technology(大连理工大学) Huawei Technologies Co., Ltd.(华为技术有限公司) The University of Hong Kong(香港大学) Tsinghua University(清华大学) Peking University(北京大学)

AI总结 针对长程机器人操作中记忆瓶颈问题,提出EventVLA框架,通过动态关键帧证据记忆模块自主捕获任务关键视觉事件,在17个模拟和4个真实任务中平均成功率提升40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19998 2026-06-19 cs.RO cs.AI cs.CV cs.LG 新提交

Tri-Info: Generalizable, Interpretable Failure Prediction for VLA Models via Information Theory

Tri-Info: 基于信息论的VLA模型可泛化、可解释的故障预测

Jinghan Yang, Yunchao Zhang, Wang Yuan, Haolun Wan, Jiaming Zhang, Zhengyang Hu, Yanchao Yang

机构 * InfoBodied AI Lab, The University of Hong Kong(香港大学信息具身人工智能实验室) HKU Musketeers Foundation Institute of Data Science(香港大学赛马会数据科学研究院)

AI总结 提出Tri-Info方法,通过信息论信号捕捉动作多样性、时间一致性和状态耦合,实现跨架构、环境及仿真到现实的零样本故障检测,准确率达83%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19836 2026-06-19 cs.RO cs.CV 新提交

World Engine: Towards the Era of Post-Training for Autonomous Driving

World Engine:迈向自动驾驶后训练时代

Tianyu Li, Li Chen, Caojun Wang, Haochen Liu, Kashyap Chitta, Zhenjie Yang, Yuhang Lu, Naisheng Ye, Yihang Qiu, Yufei Wang, Luoxi Zou, Jiaxin Peng, Jin Pan, Zhaoyu Su, Andrei Bursuc, Shengbo Eben Li, Andreas Geiger, Peng Su, Hongyang Li

机构 * The University of Hong Kong(香港大学) Huawei(华为) Shanghai Innovation Institute(上海创新研究院) Archon Robotics(Archon机器人) KE:SAI NVIDIA Research(NVIDIA研究) NTU(南洋理工大学) Tsinghua University(清华大学)

AI总结 提出World Engine生成式框架,通过从真实日志重建高保真交互环境并外推安全关键变体,利用强化后训练对齐策略与安全约束,显著减少罕见安全关键场景故障,提升自动驾驶安全性。

Comments Technical Report. Project Page: https://opendrivelab.com/WorldEngine/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17832 2026-06-19 cs.LG 新提交

From Drift to Coherence: Stabilizing Beliefs in LLMs

从漂移到一致:稳定LLM中的信念

SongEun Kim, Seungyoo Lee, Edwin Fong, Hyungi Lee, Juho Lee

机构 * Department of Statistics, Seoul National University Korea Advanced Institute of Science \& Technology Department of AI, Kookmin University University of Hong Kong

AI总结 研究LLM在多项选择问答中的信念漂移问题,提出提示式预测重采样(PPR)方法,发现信念过程会自稳定并收敛,进而提出种子答案提示策略和自一致性损失以加速稳定并提高预测一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19257 2026-06-18 cs.CL 新提交

DreamReasoner-8B: Block-Size Curriculum Learning for Diffusion Reasoning Models

DreamReasoner-8B:面向扩散推理模型的块大小课程学习

Zirui Wu, Lin Zheng, Jiacheng Ye, Shansan Gong, Xueliang Zhao, Yansong Feng, Wei Bi, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Peking University(北京大学)

AI总结 提出块大小课程学习,通过从细粒度到粗粒度的渐进训练,解决块扩散语言模型在长链推理中性能差距问题,DreamReasoner-8B在数学和代码推理上达到与Qwen3-8B相当的水平。

详情

展开后加载摘要…

URL PDF HTML 收藏