arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 1511
2606.22347 2026-06-23 cs.CV 新提交

Customizing Video Portraits via Identity-ActionDecoupling

通过身份-动作解耦定制视频肖像

Junxiong Lin, Haoran Wang, Xinji Mai, Zeng Tao, Xuan Tong, Ivy Pan, Wenqiang Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) The University of Hong Kong(香港大学)

AI总结 提出身份-动作解耦框架,通过身份解耦损失和文本对齐损失,无需微调即可生成保持身份一致且表情丰富的视频。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22142 2026-06-23 cs.RO 新提交

RoboLineage: Agent-Native Data Lifecycle Governance Across Robot Policy Iterations

RoboLineage:跨机器人策略迭代的智能体原生数据生命周期治理

Qian Luo, Wentao Guo, Zhennan Qin, Nanchun Guo, Yunhan Zhao, Yi Ma, Yanchao Yang

机构 * Transcengram The University of Hong Kong(香港大学) Beijing Institute of Technology(北京理工大学)

AI总结 提出RoboLineage系统,通过将数据收集、审查、训练、评估等步骤表示为类型化谱系工件,实现机器人策略迭代的显式生命周期管理,提升迭代速度与可审计性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21943 2026-06-23 cs.LG cs.AI 新提交

Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning

LLM上的模块化强化学习:从MDP创建到探索与学习

Zhao Yang, Yuxuan Jiang, Ting-Chih Chen, Lincen Yang, Annie Wong, Chao Gao, Jacob E. Kooi, Zhong Li, Jiayang Shi, Kevin Qiu, Qi Huang, Xinrui Zu, Shiping Yang, Hengyuan Zhang, Ngai Wong, Filip Ilievski, Shujian Yu, Aske Plaat, Zhaochun Ren, Mark Hoogendoorn, Vincent François-Lavet

机构 * VU Amsterdam(阿姆斯特丹自由大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校) Leiden University(莱顿大学) University of Warsaw(华沙大学) Simon Fraser University(西蒙菲莎大学) The University of Hong Kong(香港大学)

AI总结 本文系统梳理LLM后训练中的强化学习方法,从MDP构建、探索策略到学习范式,揭示当前方法分布不均,指出价值函数、离策略AC及自举法等领域存在研究空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21753 2026-06-23 cs.GR cs.AI cs.CV 新提交

Scene-Level Heterogeneous Physics Simulation with 3D Gaussian Splats

基于3D高斯散点的场景级异构物理仿真

Xiaoyang Liu, Shangzhe Wu, Kai Han

机构 * The University of Hong Kong(香港大学) University of Cambridge(剑桥大学)

AI总结 提出一种表示抽象框架,将3D高斯散点、虚拟网格和流体等异构资产统一为物理粒子集,实现场景级、多求解器的物理仿真,支持3DGS资产的非刚性变形与复杂双向交互。

Comments Accepted to CVPR 2026 Findings

Journal ref Proc. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Findings, 2026, pp. 6456-6465

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21300 2026-06-23 cs.CV 新提交

SCOPE: Scale-Consistent One-Pass Estimation of 3D Geometry

SCOPE:尺度一致的3D几何单遍估计

Zheng Zhang, Lihe Yang, Tianyu Yang, Chaohui Yu, Yixing Lao, Xiaoyang Guo, Biao Gong, Fan Wang, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团)

AI总结 提出SCOPE方法,通过仿射不变3D点图和三个关键创新(视角不变几何、外观不变学习、频率调制定位),实现从长单目视频序列中高效、一致地估计3D几何,在ScanNet上相对点图误差降低24.2%,时间对齐误差降低34.9%。

Comments SIGGRAPH Conference Papers 2026. 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21240 2026-06-23 cs.CR cs.CV 新提交

DIPBox: A Multi-scale Testing Framework for Tracking Dataset Regeneration

DIPBox:用于追踪数据集再生的多尺度测试框架

Tian Dong, Yan Meng, Shaofeng Li, Guoxing Chen, Yuling Chen, Zhen Liu, Haojin Zhu, Hao Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Southeast University(东南大学) Guizhou University(贵州大学) The University of Hong Kong(香港大学)

AI总结 针对数据集再生威胁,提出多尺度特征相似度指标和DIPBox框架,通过样本级、集合级和分布级特征测试追踪再生数据集,实验验证其有效性。

Comments Accepted by ACM CCS 2026. Please cite this paper as "Tian Dong, Yan Meng, Shaofeng Li, Guoxing Chen, Yuling Chen, Zhen Liu, Haojin Zhu, Hao Chen. DIPBox: A Multi-scale Testing Framework for Tracking Dataset Regeneration. In the Proceedings of ACM Conference on Computer and Communications Security (CCS 2026)."

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21136 2026-06-23 cs.LG cs.RO 新提交

Horizon Adaptive Offline Policy Learning via Value Stitching

通过价值拼接的自适应地平线离线策略学习

Kexin Zheng, Xianyuan Zhan, Xintao Yan

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学)

AI总结 提出VAST方法,通过递归、自适应地平线价值组合替代固定地平线备份,利用未来状态和地平线长度条件辅助价值函数与拼接策略,实现离线策略优化,在长时域任务中优于固定步长和生成价值基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20871 2026-06-23 cs.RO 新提交

Geometric Entropy: When Trajectory Diversity Helps and Hurts in Imitation Learning

几何熵:轨迹多样性在模仿学习中的利弊

Qian Luo, Ruizhe Liu, Pei Zhou, Xunzhe Zhou, Yanchao Yang

机构 * InfoBodied AI Lab, The University of Hong Kong(香港大学信息体人工智能实验室) Transcengram

AI总结 提出几何熵(H_G)量化演示轨迹的几何多样性,发现成功率与H_G呈倒U型关系,且最优熵随任务掌握度增加而降低,可用于数据集审计与校准。

Comments Accepted to IROS 2026. Project page: https://geometric-entropy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20686 2026-06-23 cs.RO cs.AI 新提交

JPPD: Joint Prediction_Planning Diffusion with Differentiable Safety Guidance for Dynamic Obstacle Avoidance in Intelligent Transportation Systems

JPPD:具有可微安全引导的联合预测-规划扩散框架用于智能交通系统中的动态障碍物规避

Jiahao Wu, Shengwen Yu

机构 * The University of Hong Kong(香港大学) Guangzhou College of Commerce(广州商学院)

AI总结 提出联合预测-规划扩散框架,将参与者预测与机器人规划视为条件轨迹生成问题,通过可微安全势引导和条件流匹配提升共享空间中的安全性与效率。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20583 2026-06-23 cs.NI cs.AI 新提交

Physical-AI: From Channel Awareness to Environmental Intelligence in 6G Wireless Networks

Physical-AI: 从信道感知到6G无线网络中的环境智能

Farooque Hassan Kumbhar, Kapal Dev, Sunder Ali Khowaja, Alexandros-Apostolos A. Boulogeorgos, Mehdi Bennis, Yuanwei Liu

机构 * Augmented Cognition Meta-communications ERC Research Center, Korea University, Korea(增强认知元通信ERC研究中心,韩国大学,韩国) Department of Computer Science, Munster Technological University (MTU)(计算机科学系,穆斯特技术大学(MTU)) School of Computing, Faculty of Engineering and Computing, Dublin City University, Ireland(计算学院,工程与计算学院,都柏林城市大学,爱尔兰) Department of Electrical and Computer Engineering of the Democritus University, Greece(德米特里大学电气与计算机工程系,希腊) Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(电气与计算机工程系,香港大学,香港) Department of Electronic Engineering, Kyung Hee University, Yongin-si, Gyeonggi-do 17104, South Korea(电子工程系, Kyung Hee大学, Yongin-si, Gyeonggi-do 17104, 韩国)

AI总结 提出Physical-AI架构,利用自监督时空无线电基础模型将分布式观测转化为共享环境表征,通过多推理头估计阻塞、用户分布等环境属性,并基于神经决策层实现主动控制,降低中断概率和阻塞响应延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15171 2026-06-23 cs.RO 新提交

Seam-to-Graph Reconstruction for Garment Configuration Alignment

用于服装配置对齐的缝到图重建

Xuzhao Huang, Kai Tang, Fuyuki Tokuda, Norman C. Tien, Kazuhiro Kosuge

机构 * JC STEM Lab of Robotics for Soft Materials, Department of Electrical and Electronic Engineering, Faculty of Engineering, The University of Hong Kong(香港大学工程学院电气与电子工程系JC STEM软材料机器人实验室) Unprecedented-scale Data Analytics Center, Tohoku University(东北大学前所未有规模数据分析中心) Graduate School of Information Sciences, Tohoku University(东北大学信息科学研究科) Department of Electrical and Electronic Engineering, Faculty of Engineering, The University of Hong Kong(香港大学工程学院电气与电子工程系)

AI总结 提出基于图神经网络和注意力机制的Seam-to-Graph网络,将部分可观测的缝信息映射为拓扑结构骨架图,用于实时服装状态估计,并设计变形感知分层视觉伺服控制器实现服装配置对齐,在双臂机器人系统上验证了人类级精度和鲁棒性。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09781 2026-06-23 cs.NE cs.AI cs.CL cs.LG 版本更新

Parameter-Efficient Neuroevolution for Diverse LLM Generation: Quality-Diversity Optimization via Prompt Embedding Evolution

参数高效神经进化用于多样化大语言模型生成:通过提示嵌入进化实现质量-多样性优化

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong(香港大学) Stellaris AI Limited(Stellaris AI有限公司)

AI总结 本文提出QD-LLM框架,通过进化提示嵌入实现参数高效神经进化,提升大语言模型生成质量与多样性,实验显示其在多个基准测试中表现优异。

Comments 11 pages, 3 figures, 7 tables, 1 algorithm, 1 theorem. Accepted to GECCO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09777 2026-06-23 cs.NE cs.AI cs.CL cs.LG 版本更新

EvoPref: Multi-Objective Evolutionary Optimization Discovers Diverse LLM Alignments Beyond Gradient Descent

EvoPref:多目标进化优化发现超越梯度下降的多样化大语言模型对齐

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong(香港大学) Stellaris AI Limited(Stellaris AI有限公司)

AI总结 EvoPref通过多目标进化算法在帮助性、无害性和诚实性目标上优化LoRA适配器,发现比梯度下降更丰富的对齐方式,实验显示其在偏好覆盖和崩溃率上均有显著提升。

Comments 10 pages, 2 figures, 6 tables, 1 algorithm. Accepted to GECCO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00528 2026-06-23 cs.DC cs.AI cs.LG cs.OS 版本更新

SAGA: Workflow-Atomic Scheduling for AI Agent Inference on GPU Clusters

SAGA:面向GPU集群的AI代理推理工作流原子调度

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong(香港大学) Brain Investing Limited(脑投有限公司) Stellaris AI Limited(Stellaris AI有限公司)

AI总结 SAGA通过工作流级调度减少任务完成时间1.64倍,提升GPU内存利用率1.22倍,同时在多租户环境下达成99.2%的服务水平目标,但牺牲了30%的峰值吞吐量。

Comments 15 pages, 3 figures, 11 tables. Accepted to HPDC '26 (35th International Symposium on High-Performance Parallel and Distributed Computing), July 13-16, 2026, Cleveland, OH, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25214 2026-06-23 cs.LG cs.AI 版本更新

On-the-Fly Adaptation to Quantization: Configuration-Aware LoRA for Efficient Fine-Tuning of Quantized LLMs

即时适应量化:面向量化大语言模型高效微调的配置感知LoRA

Rongguang Ye, Ming Tang, Edith C. H. Ngai

机构 * Southern University of Science and Technology(南方科技大学) The University of Hong Kong(香港大学)

AI总结 提出CoA-LoRA方法,通过配置感知模型动态调整LoRA适配器以适应任意量化配置,无需重复微调,并设计基于Pareto的配置搜索优化训练集,实现与逐配置微调相当或更优的性能且无额外时间成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15555 2026-06-23 cs.MA cs.CE cs.LG cs.NE cs.SE 版本更新

HEAS: Hierarchical Evolutionary Agent-Based Simulation Framework for Multi-Objective Policy Search

HEAS:面向多目标策略搜索的层次化进化智能体仿真框架

Ruiyu Zhang, Lin Nie, Xin Zhao

机构 * Department of Politics and Public Administration(政治与公共行政系) The University of Hong Kong(香港大学) Department of Applied Social Sciences(应用社会科学系) The Hong Kong Polytechnic University(香港理工大学)

AI总结 提出HEAS框架,结合智能体仿真、进化搜索与场景评估,通过“度量契约”统一优化、评估和验证,支持多目标策略搜索。

Comments 6 pages, 2 figures. Python package: https://pypi.org/project/heas/ | Web playground: https://ryzhanghason.github.io/heas/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01501 2026-06-23 cs.LG cs.AI 版本更新

GAC: Stabilizing Asynchronous RL Training for LLMs via Gradient Alignment Control

GAC: 通过梯度对齐控制稳定大语言模型的异步RL训练

Haofeng Xu, Junwei Su, Yukun Tian, Lansong Diao, Zhengping Qian, Chuan Wu

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) Alibaba Group(阿里巴巴集团) Southeast University(东南大学)

AI总结 针对异步策略梯度训练中梯度高余弦相似性导致的训练不稳定问题,提出梯度对齐控制(GAC)方法,通过梯度投影调节陈旧对齐方向,恢复稳定训练并匹配同步基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22126 2026-06-23 cs.RO 版本更新

EasyUUV: An LLM-Enhanced Universal and Lightweight Sim-to-Real Reinforcement Learning Framework for UUV Attitude Control

EasyUUV:一种用于UUV姿态控制的LLM增强通用轻量级仿真到现实强化学习框架

Guanwen Xie, Jingzehua Xu, Jiwei Tang, Yubo Huang, Zixi Wang, Shuai Zhang, Dongfang Ma, Juntian Qu, Xiaofan Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系) School of Civil Engineering, Southwest Jiaotong University(西南交通大学土木工程学院) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系) Ocean College, Zhejiang University(浙江大学海洋学院)

AI总结 提出EasyUUV框架,结合并行强化学习与混合控制架构,并集成多模态大语言模型自适应调整参数,实现UUV姿态控制的鲁棒性和泛化性,经仿真与实船验证。

Comments 12 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03719 2026-06-23 cs.IT cs.AI cs.LG math.IT 版本更新

Over-the-Air Federated Learning: Rethinking Edge AI Through Signal Processing

空中联邦学习:通过信号处理重新思考边缘AI

Seyed Mohammad Azimi-Abarghouyi, Carlo Fischione, Kaibin Huang

机构 * School of Electrical Engineering and Computer Science, KTH Royal Institute of Technology(皇家理工学院电气工程与计算机科学学院) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系)

AI总结 本文从信号处理角度综述空中联邦学习(AirFL),将其分为三类(CSIT感知、盲、加权),并分析其假设、性能折衷、复杂度和部署限制,为无线边缘AI系统提供设计指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05098 2026-06-23 cs.CR cs.AI 版本更新

TIF: Learning Temporal Invariance in Android Malware Detectors

TIF:学习安卓恶意软件检测器的时间不变性

Xinran Zheng, Shuo Yang, Edith C. H. Ngai, Suman Jana, Lorenzo Cavallaro

机构 * University College London(伦敦大学学院) The University of Hong Kong(香港大学) Columbia University(哥伦比亚大学)

AI总结 针对恶意软件变种和新家族导致的分布漂移,提出时间不变训练框架TIF,通过多代理对比学习和不变梯度对齐学习稳定表征,提升检测器时间鲁棒性。

Comments Manuscript has been accepted by IEEE Transactions on Software Engineering (TSE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13514 2026-06-23 cs.CL cs.AI 版本更新

ProMed: Shapley Information Gain Guided Reinforcement Learning for Proactive Medical LLMs

ProMed:基于Shapley信息增益引导的强化学习用于主动式医疗大语言模型

Hongxin Ding, Baixiang Huang, Yue Fang, Weibin Liao, Xinke Jiang, Jinyang Zhang, Yinghao Zhu, Zheng Li, Liantao Ma, Junfeng Zhao, Yasha Wang

机构 * National Engineering Research Center of Software Engineering, Peking University, China(软件工程国家工程研究中心,北京大学,中国) School of Computer Science, Peking University, Beijing, China(北京大学计算机学院,北京,中国) Key Laboratory of High Confidence Software Technologies, Ministry of Education(教育部高可信软件技术重点实验室) Peking University Information Technology Institute, Tianjin Binhai, China(北京大学信息技术研究所,天津滨海,中国) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院)

AI总结 提出ProMed框架,通过Shapley信息增益奖励引导强化学习,使医疗大语言模型从被动回答转向主动提问,在部分信息医疗基准上平均提升6.29%。

Comments Accepted to ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08048 2026-06-23 cs.CV 版本更新

S^2VG: 3D Stereoscopic and Spatial Video Generation via Denoising Frame Matrix

S^2VG:基于去噪帧矩阵的3D立体与空间视频生成

Peng Dai, Feitong Tan, Qiangeng Xu, Yihua Huang, David Futschik, Ruofei Du, Sean Fanello, Yinda Zhang, Xiaojuan Qi

机构 * Department of Electrical and Electronic Engineering at The University of Hong Kong(香港大学电子与电气工程系) Google(谷歌)

AI总结 提出一种无需姿态和训练的方法,利用现成单目视频生成模型,通过深度图扭曲和帧矩阵修复框架,生成时空一致的3D立体与空间视频。

Comments immersive video generation, 4D scene, spatial video, stereo video

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14792 2026-06-23 cs.CY cs.AI cs.CL 版本更新

Measuring Human Contribution in AI-Assisted Content Generation

衡量AI辅助内容生成中的人类贡献

Yueqi Xie, Tao Qi, Jingwei Yi, Xiyuan Yang, Ryan Whalen, Junming Huang, Qian Ding, Yu Xie, Xing Xie, Fangzhao Wu

机构 * Princeton University(普林斯顿大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) The University of Hong Kong(香港大学) Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学)

AI总结 针对AI辅助内容生成中人类贡献度难以量化的问题,提出基于信息论的框架,通过互信息与自信息之比计算人类信息贡献比例,实验证明能有效区分不同创意领域的人类贡献程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20034 2026-06-23 cs.CV 版本更新

Maintain Plasticity in Long-timescale Continual Test-time Adaptation

长时间尺度连续测试时自适应中的可塑性保持

Yanshuo Wang, Xuesong Li, Jinguang Tong, Jie Hong, Jun Lan, Weiqiang Wang, Huijia Zhu, Haoxing Chen

机构 * Australian National University(澳大利亚国立大学) Tiansuan Lab, Ant Group(蚂蚁集团天算实验室) Data61-CSIRO The University of Hong Kong(香港大学)

AI总结 针对连续测试时域自适应中模型可塑性随时间下降的问题,提出基于标签翻转变化的自适应收缩-恢复策略,通过自适应间隔权重重初始化保持可塑性,在多个基准上取得优异性能。

Comments Newest version at arXiv:2602.06328

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20506 2026-06-19 cs.CV cs.AI 新提交

FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining

FreeStyle: 从社区LoRA挖掘中实现风格-内容双参考生成的自由控制

Jinghong Lan, Wei Cheng, Yunuo Chen, Ziqi Ye, Peng Xing, Yixiao Fang, Rui Wang, Yufeng Yang, Xuanyang Zhang, Xianfang Zeng, Difan Zou, Gang Yu, Chi Zhang

机构 * Fudan University(复旦大学) StepFun Westlake University(西湖大学) University of Hong Kong(香港大学)

AI总结 提出FreeStyle框架,利用社区LoRA作为锚点,通过两阶段课程学习(注意力级约束和频率感知RoPE调制)解决双参考生成中的内容泄露问题,并引入新基准和评估指标,实现风格对齐、内容保持与泄露抑制的平衡。

Comments 35 pages, 26figures. Project page: https://github.com/Blue2Giant/FreeStyle

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20424 2026-06-19 cs.RO 新提交

LIT-GS: LiDAR-Inertial-Thermal Gaussian Splatting for Illumination-Robust Mapping

LIT-GS: 面向光照鲁棒建图的激光雷达-惯性-热高斯泼溅

Shikuan Shi, Chunran Zheng, Jiaming Xu, Tianyong Ye, Tao Yu, Yukang Cui

机构 * College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院) Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系)

AI总结 提出LIT-GS框架,利用激光雷达平面几何约束联合优化位姿与高斯,解决光照变化和纹理缺失场景下RGB依赖的脆弱性问题,提升几何精度与渲染质量。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20333 2026-06-19 cs.AI 新提交

SoftSkill: Behavioral Compression for Contextual Adaptation

SoftSkill: 用于上下文适应的行为压缩

Xijia Tao, Yihua Teng, Xinyu Fu, Ziru Liu, Kecheng Chen, Yuzhi Zhao, Suiyun Zhang, Rui Liu, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Huawei Research(华为研究院) City University of Hong Kong(香港城市大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 提出SoftSkill方法,通过可训练的软技能前缀压缩自然语言技能为紧凑连续向量,在冻结基模型上提升问答和数学任务性能,减少标记数量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20092 2026-06-19 cs.CV 新提交

EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies

EventVLA: 面向长程视觉-语言-动作策略的事件驱动视觉证据记忆

Ganlin Yang, Zhangzheng Tu, Yuqiang Yang, Sitong Mao, Junyi Dong, Tianxing Chen, Jiaqi Peng, Jing Xiong, Jiafei Cao, Jifeng Dai, Wengang Zhou, Yao Mu, Tai Wang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Dalian University of Technology(大连理工大学) Huawei Technologies Co., Ltd.(华为技术有限公司) The University of Hong Kong(香港大学) Tsinghua University(清华大学) Peking University(北京大学)

AI总结 针对长程机器人操作中记忆瓶颈问题,提出EventVLA框架,通过动态关键帧证据记忆模块自主捕获任务关键视觉事件,在17个模拟和4个真实任务中平均成功率提升40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19998 2026-06-19 cs.RO cs.AI cs.CV cs.LG 新提交

Tri-Info: Generalizable, Interpretable Failure Prediction for VLA Models via Information Theory

Tri-Info: 基于信息论的VLA模型可泛化、可解释的故障预测

Jinghan Yang, Yunchao Zhang, Wang Yuan, Haolun Wan, Jiaming Zhang, Zhengyang Hu, Yanchao Yang

机构 * InfoBodied AI Lab, The University of Hong Kong(香港大学信息具身人工智能实验室) HKU Musketeers Foundation Institute of Data Science(香港大学赛马会数据科学研究院)

AI总结 提出Tri-Info方法,通过信息论信号捕捉动作多样性、时间一致性和状态耦合,实现跨架构、环境及仿真到现实的零样本故障检测,准确率达83%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19836 2026-06-19 cs.RO cs.CV 新提交

World Engine: Towards the Era of Post-Training for Autonomous Driving

World Engine:迈向自动驾驶后训练时代

Tianyu Li, Li Chen, Caojun Wang, Haochen Liu, Kashyap Chitta, Zhenjie Yang, Yuhang Lu, Naisheng Ye, Yihang Qiu, Yufei Wang, Luoxi Zou, Jiaxin Peng, Jin Pan, Zhaoyu Su, Andrei Bursuc, Shengbo Eben Li, Andreas Geiger, Peng Su, Hongyang Li

机构 * The University of Hong Kong(香港大学) Huawei(华为) Shanghai Innovation Institute(上海创新研究院) Archon Robotics(Archon机器人) KE:SAI NVIDIA Research(NVIDIA研究) NTU(南洋理工大学) Tsinghua University(清华大学)

AI总结 提出World Engine生成式框架,通过从真实日志重建高保真交互环境并外推安全关键变体,利用强化后训练对齐策略与安全约束,显著减少罕见安全关键场景故障,提升自动驾驶安全性。

Comments Technical Report. Project Page: https://opendrivelab.com/WorldEngine/

详情

展开后加载摘要…

URL PDF HTML 收藏