arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2801
2503.22349 2026-01-29 cs.CV

GCRayDiffusion: Pose-Free Surface Reconstruction via Geometric Consistent Ray Diffusion

GCRayDiffusion:基于几何一致射线扩散的无姿态表面重建

Li-Heng Chen, Zi-Xin Zou, Chang Liu, Tianjiao Jing, Yan-Pei Cao, Shi-Sheng Huang, Hongbo Fu, Hua Huang

机构 * Beijing Normal University(北京师范大学) VAST(中国科学院软件研究所) Hong Kong University of Science and Technology(香港科技大学)

AI总结 GCRayDiffusion通过几何一致射线扩散实现无姿态表面重建,提升稀疏视角下的3D一致性与精度。

Journal ref Proc. IEEE/CVF Conf. Comput. Vis. Pattern Recognit. (ICCV), 2025, pp. 25335-25345

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06382 2026-01-29 eess.IV cs.CV

X-LRM: X-ray Large Reconstruction Model for Extremely Sparse-View Computed Tomography Recovery in One Second

X-LRM:用于极稀疏视图计算层析成像恢复的X射线大重建模型(1秒内)

Guofeng Zhang, Ruyi Zha, Hao He, Yixun Liang, Alan Yuille, Hongdong Li, Yuanhao Cai

机构 * Johns Hopkins University(约翰霍普金斯大学) Australian National University(澳大利亚国立大学) HKUST(香港科技大学)

AI总结 X-LRM通过X-former和X-triplane实现极稀疏视图CT重建,1.5 dB优于现有方法并提升27倍速度。

Comments 3DV 2026; A large reconstruction model and the largest dataset (16K samples) for sparse-view CT recovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20846 2026-01-29 cs.CL

Are LLMs Really Not Knowledgeable? Mining the Submerged Knowledge in LLMs' Memory

LLMs真的不具有知识性吗?挖掘LLMs记忆中的潜藏知识

Xingjian Tao, Yiwei Wang, Yujun Cai, Zhicheng Yang, Jing Tang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) University of California, Merced(加州大学默塞德分校) The University of Queensland(昆士兰大学)

AI总结 本文研究LLMs在问答任务中保留潜藏知识的现象,提出Hits@k指标评估潜在知识保留,发现LLMs实际知识量远超标准QA准确率,揭示提示策略对正确答案的抑制效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19536 2026-01-28 cs.RO

Enhancing Inverse Perspective Mapping for Automatic Vectorized Road Map Generation

增强逆透视映射以实现自动向量化的道路地图生成

Hongji Liu, Linwei Zheng, Yongjian Li, Mingkai Tang, Xiaoyang Yan, Ming Liu, Jun Ma

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统方向,香港科技大学(广州)) Division of Emerging Interdisciplinary Areas, The Hong Kong University of Science and Technology(新兴交叉领域部门,香港科技大学)

AI总结 本文提出了一种利用增强逆透视映射提升道路地图生成精度的低成本统一框架,通过优化IPM单应矩阵和车辆姿态,实现厘米级高精度自动制图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18548 2026-01-28 cs.RO

Fast and Safe Trajectory Optimization for Mobile Manipulators With Neural Configuration Space Distance Field

用于移动机械臂的快速且安全的轨迹优化与神经配置空间距离场

Yulin Li, Zhiyuan Song, Yiming Li, Zhicheng Song, Kai Chen, Chunxin Zheng, Zhihai Bi, Jiahang Cao, Sylvain Calinon, Fan Shi, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学机器人与自主系统研究组) Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系) Idiap Research Institute(Idiap研究所) Institute of Data Science, The University of Hong Kong(香港大学数据科学研究所)

AI总结 本文提出广义配置空间距离场(GCDF)用于移动机械臂的快速且安全轨迹优化,通过神经网络生成连续距离场并结合高效的凸优化框架实现高精度碰撞推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17835 2026-01-28 cs.CV

Geometry-Grounded Gaussian Splatting

基于几何的高斯散射

Baowen Zhang, Chenxing Jiang, Heng Li, Shaojie Shen, Ping Tan

机构 * Hong Kong University of Science and Technology(香港理工大学)

AI总结 本文提出基于几何的高斯散射方法,通过理论推导将高斯原语确立为随机固体,从而提升多视角一致性和细粒度几何提取效果。

Comments 16 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21778 2026-01-28 cond-mat.mtrl-sci cs.AI

Beyond Structure: Invariant Crystal Property Prediction with Pseudo-Particle Ray Diffraction

超越结构:基于伪粒子射线衍射的不变晶体性质预测

Bin Cao, Yang Liu, Longhan Zhang, Yifan Wu, Zhixun Li, Yuyu Luo, Hong Cheng, Yang Ren, Tong-Yi Zhang

机构 * Guangzhou Municipal Key Laboratory of Materials Informatics, Advanced Materials Thrust, The Hong Kong University of Science and Technology (Guangzhou)(广州材料信息重点实验室,先进材料方向,香港科技大学(广州)) The Chinese University of Hong Kong(香港中文大学) Data Science and Analytics Thrust, The Hong Kong University of Science and Technology (Guangzhou)(数据科学与分析方向,香港科技大学(广州)) Department of physics, The City University of Hong Kong(香港城市大学物理系) Materials Genome Institute, Shanghai University(材料基因组研究所,上海大学)

AI总结 PRDNet通过结合伪粒子射线衍射与图表示,实现了对晶体性质的不变预测,展示了在材料科学中的高效性能。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10498 2026-01-28 cs.CV

TweezeEdit: Consistent and Efficient Image Editing with Path Regularization

TweezeEdit: 通过路径正则化实现一致且高效的图像编辑

Jianda Mao, Kaibo Wang, Yang Xiang, Kani Chen

机构 * Department of Mathematics, The Hong Kong University of Science and Technology, Hong Kong SAR(数学系,香港科学与技术大学)

AI总结 TweezeEdit通过路径正则化实现高效一致的图像编辑,无需调优和倒置,提升语义保留和实时性能。

Journal ref AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19514 2026-01-28 cs.CL cs.AI cs.LG

SIPDO: Closed-Loop Prompt Optimization via Synthetic Data Feedback

SIPDO:通过合成数据反馈实现闭环提示优化

Yaoning Yu, Ye Yu, Peiyan Zhang, Kai Wei, Haojing Luo, Haohan Wang

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Hong Kong University of Science and Technology(香港科学与技术大学) University of South Florida(佛罗里达州立大学)

AI总结 SIPDO通过合成数据反馈闭环优化提示,提升提示性能并优于传统提示微调方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18320 2026-01-27 cs.CL cs.AI cs.DB

MultiVis-Agent: A Multi-Agent Framework with Logic Rules for Reliable and Comprehensive Cross-Modal Data Visualization

MultiVis-Agent:一种带有逻辑规则的多智能体框架,用于可靠且全面的跨模态数据可视化

Jinwei Lu, Yuanfeng Song, Chen Zhang, Raymond Chi-Wing Wong

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science(香港科学大学)

AI总结 MultiVis-Agent通过引入逻辑规则的多智能体框架,提升多模态数据可视化的可靠性与全面性,实现高评分和高完成率。

Comments Accepted to SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09394 2026-01-27 cs.CL cs.AI

Beyond Single-Granularity Prompts: A Multi-Scale Chain-of-Thought Prompt Learning for Graph

超越单一粒度提示:用于图的多尺度链式思考提示学习

Ziyu Zheng, Yaming Yang, Ziyu Guan, Wei Zhao, Xinyan Huang, Weigang Lu

机构 * School of Computer Science and Technology(计算机科学与技术学院) Xidian University(西安电子科技大学) School of Artificial Intelligence(人工智能学院) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出多尺度图链式思考提示框架,通过多尺度信息增强图提示学习,提升少样本场景下的性能。

Comments Accepted by WWW2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02567 2026-01-27 cs.CV

Unified Multimodal Understanding and Generation Models: Advances, Challenges, and Opportunities

统一的多模态理解和生成模型:进展、挑战与机遇

Shanshan Zhao, Xinjie Zhang, Jintao Guo, Jiakui Hu, Lunhao Duan, Minghao Fu, Yong Xien Chng, Guo-Hua Wang, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang

机构 * Alibaba Group(阿里巴巴集团) Hong Kong University of Science and Technology(香港科学与技术大学) Nanjing University(南京大学) Peking University(北京大学) Tsinghua University(清华大学)

AI总结 本文探讨了多模态理解和生成模型的统一进展、挑战与机遇,分析了不同架构范式及未来研究方向。

Comments In this version, we incorporate new papers (after Aug. 2025), datasets, and benchmarks. This work is still in progress; Github project: https://github.com/AIDC-AI/Awesome-Unified-Multimodal-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17673 2026-01-27 cs.CV cs.AI

Uni-RS: A Spatially Faithful Unified Understanding and Generation Model for Remote Sensing

Uni-RS: 一种用于遥感的具有空间忠实性的统一理解和生成模型

Weiyu Zhang, Yuan Hu, Yong Li, Yu Liu

机构 * Institute of Remote Sensing and Geographic Information System, School of Earth and Space Sciences, Peking University(遥感与地理信息系统研究所,地球与空间科学学院,北京大学) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(土木与环境工程系,香港科学与技术大学)

AI总结 Uni-RS通过空间布局规划、空间感知查询监督和图像描述空间布局变化,提升遥感文本到图像生成的空间忠实性,同时保持多模态理解任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17420 2026-01-27 cs.CV

CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction

CoT-Seg:重新思考基于链式推理的分割

Shiu-hong Kao, Chak Ho Huang, Huaiqian Liu, Yu-Wing Tai, Chi-Keung Tang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Dartmouth College(达特茅斯学院)

AI总结 CoT-Seg通过结合链式推理和自我纠正,提升复杂分割任务的可靠性与鲁棒性,适用于模糊或错误多发的场景。

Comments Project page: https://danielshkao.github.io/cot-seg.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17399 2026-01-27 cs.CV cs.AI

ReLE: A Scalable System and Structured Benchmark for Diagnosing Capability Anisotropy in Chinese LLMs

ReLE:一种可扩展的系统和结构化基准,用于诊断中文大语言模型的能力异质性

Rui Fang, Jian Li, Wei Chen, Bin Hu, Ying-Cong Chen, Xin Tang, Liang Diao

机构 * Sun Yat-sen University(中山大学) ReLE Benchmark Team(ReLE基准团队) NSFOCUS Technologies Co., Ltd.(NSFOCUS技术有限公司) HKUST-GZ(香港科技大学-广州) Huawei(华为) Ping An Property & Casualty Insurance Company of China, Ltd(平安财产保险股份有限公司)

AI总结 ReLE通过可扩展系统和结构化基准诊断中文大语言模型的能力异质性,提升评估效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10461 2026-01-27 q-fin.ST cs.AI cs.LG

Momentum-integrated Multi-task Stock Recommendation with Converge-based Optimization

动量整合多任务股票推荐与基于收敛的优化

Hao Wang, Jingshu Peng, Yanyan Shen, Xujia Li, Quanqing Xu, Chuanhui Yang, Lei Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Shanghai Jiao Tong University(上海交通大学) OceanBase, Ant Group(蚂蚁集团OceanBase)

AI总结 本文提出动量整合多任务股票推荐框架MiM-StocR,通过引入动量指标和自适应-k近似NDCG损失函数,提升股票推荐的短期趋势捕捉能力,并采用收敛四边平衡方法缓解过拟合问题,实验证明其在排名和盈利能力上优于现有基线。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00174 2026-01-27 cs.LG cs.AI

MetaCLBench: Meta Continual Learning Benchmark on Resource-Constrained Edge Devices

MetaCLBench: 用于资源受限边缘设备的元持续学习基准测试

Sijia Li, Young D. Kwon, Lik-Hang Lee, Pan Hui

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Samsung AI Center-Cambridge(三星AI中心-剑桥) The Hong Kong Polytechnic University(香港理工大学)

AI总结 MetaCLBench研究了资源受限边缘设备上元持续学习方法的准确性与部署性能,通过真实物联网设备评估六个方法,发现复杂架构未必更优,提供部署指南和框架发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17067 2026-01-27 cs.CV cs.AI

A Mechanistic View on Video Generation as World Models: State and Dynamics

视频生成作为世界模型的机制视角:状态与动态

Luozhou Wang, Zhifei Chen, Yihua Du, Dongyu Yan, Wenhang Ge, Guibao Shen, Xinli Xu, Leyi Wu, Man Chen, Tianshuo Xu, Peiran Ren, Xin Tao, Pengfei Wan, Ying-Cong Chen

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Tongji University(同济大学) Kuaishou Technology(快手科技)

AI总结 本文提出基于状态构建和动态建模的视频生成新分类法,旨在提升视频生成模型的物理持续性和因果推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17058 2026-01-27 cs.DB cs.AI cs.CL cs.LG

Can LLMs Clean Up Your Mess? A Survey of Application-Ready Data Preparation with LLMs

大模型能帮你清理数据吗?基于大模型的应用级数据准备综述

Wei Zhou, Jun Zhou, Haoyu Wang, Zhenghao Li, Qikang He, Shaokun Han, Guoliang Li, Xuanhe Zhou, Yeye He, Chunwei Liu, Zirui Tang, Bin Wang, Shen Tang, Kai Zuo, Yuyu Luo, Zhenzhe Zheng, Conghui He, Jingren Zhou, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Microsoft Research(微软研究院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) Xiaohongshu Inc.(小红书公司) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Alibaba Group(阿里巴巴集团)

AI总结 本文综述了基于大语言模型的应用级数据准备方法,探讨了数据清洗、整合与丰富三大任务的技术、优势与局限,并提出了可扩展的大语言模型-数据系统和稳健评估协议的未来研究方向。

Comments Please refer to our repository for more details: https://github.com/weAIDB/awesome-data-llm

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16519 2026-01-26 cs.LG

DANCE: Dynamic, Available, Neighbor-gated Condensation for Federated Text-Attributed Graphs

DANCE: 动态、可用、邻居门控的联邦文本属性图压缩

Zekai Chen, Haodong Lu, Xunkai Li, Henan Sun, Jia Li, Hongchao Qin, Rong-Hua Li, Guoren Wang

机构 * Department of Computer Science, Beijing Institute of Technology, Beijing, China(北京理工大学计算机科学系) The Hong Kong University of Science and Technology (GZ), Guangzhou, China(香港科技大学(广州))

AI总结 DANCE通过动态、可用、邻居门控的图压缩方法,提升联邦文本属性图学习的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15876 2026-01-26 cs.AI

EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience

EvoCUA:通过可扩展的合成经验学习来进化计算机使用代理

Taofeng Xue, Chong Peng, Mianqiu Huang, Linsen Guo, Tiancheng Han, Haozhe Wang, Jianing Wang, Xiaocheng Zhang, Xin Yang, Dengchang Zhao, Jinrui Ding, Xiandi Ma, Yuchen Xie, Peng Pei, Xunliang Cai, Xipeng Qiu

机构 * Meituan(美团) Fudan University(复旦大学) Tongji University(同济大学) The Hong Kong University of Science and Technology(香港理工大学)

AI总结 EvoCUA通过可扩展的合成经验学习进化计算机使用代理,实现更高性能和通用性。

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11003 2026-01-26 cs.SE cs.AI

EmbedAgent: Benchmarking Large Language Models in Embedded System Development

EmbedAgent: 在嵌入式系统开发中评估大型语言模型

Ruiyang Xu, Jialun Cao, Mingyuan Wu, Wenliang Zhong, Yaojie Lu, Ben He, Xianpei Han, Shing-Chi Cheung, Le Sun

机构 * University of Chinese Academy of Sciences(中国科学院大学) The Hong Kong University of Science and Technology(香港科学与技术大学) Peng Cheng Laboratory(鹏城实验室) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

AI总结 本文提出EmbedAgent和Embedbench,用于评估LLMs在嵌入式系统开发中的能力,发现通用LLMs在特定任务中表现不佳,提出检索增强生成和编译器反馈策略以提升性能。

Comments 12 pages, accepted by International Conference on Software Engineering (ICSE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16214 2026-01-23 cs.CV

CamPilot: Improving Camera Control in Video Diffusion Model with Efficient Camera Reward Feedback

CamPilot: 通过高效的相机奖励反馈提升视频扩散模型的相机控制

Wenhang Ge, Guibao Shen, Jiawei Feng, Luozhou Wang, Hao Lu, Xingye Tian, Xin Tao, Ying-Cong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队)

AI总结 CamPilot通过高效的3D解码器和奖励机制提升视频扩散模型的相机控制能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16125 2026-01-23 cs.CV cs.CL cs.IR

Rethinking Composed Image Retrieval Evaluation: A Fine-Grained Benchmark from Image Editing

重新思考组合图像检索评估:从图像编辑中获得的细粒度基准

Tingyu Song, Yanzhao Zhang, Mingxin Li, Zhuoning Guo, Dingkun Long, Pengjun Xie, Siyue Zhang, Yilun Zhao, Shu Wu

机构 * CASIA(中国科学院自动化研究所) Tongyi Lab, Alibaba Group(阿里云实验室) UCAS(中国科学院大学) HKUST(GZ)(香港科技大学(广州)) NTU(国立新加坡大学) Yale(耶鲁大学)

AI总结 本文提出EDIR细粒度CIR基准,通过图像编辑技术生成多样化查询,揭示现有模型在多模态任务中的能力差距与局限性。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15793 2026-01-23 cs.CL

HumanLLM: Towards Personalized Understanding and Simulation of Human Nature

HumanLLM: 向个性化理解与模拟人类本质迈进

Yuxuan Lei, Tianfu Wang, Jianxun Lian, Zhengyu Hu, Defu Lian, Xing Xie

机构 * University of Science and Technology of China(科学技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Microsoft Research Asia(微软亚洲研究院)

AI总结 HumanLLM通过构建大规模用户数据集和多阶段训练流程,实现了对个体认知与行为的个性化模拟,提升了社会智能和个性化应用的效果。

Comments 12 pages, 5 figures, 7 tables, to be published in KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15729 2026-01-23 cs.RO cs.AI cs.SY eess.SY

DualShield: Safe Model Predictive Diffusion via Reachability Analysis for Interactive Autonomous Driving

DualShield: 通过可达性分析实现交互式自动驾驶的安全模型预测扩散

Rui Yang, Lei Zheng, Ruoyu Yao, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统方向,香港科学与技术大学(广州))

AI总结 DualShield通过可达性分析实现交互式自动驾驶的安全模型预测扩散,结合前瞻性指导和反应性安全防护,提升安全性和任务效率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14629 2026-01-23 cs.CR cs.AI

VMask: Tunable Label Privacy Protection for Vertical Federated Learning via Layer Masking

VMask: 通过层掩码实现可调的标签隐私保护用于垂直联邦学习

Juntao Tan, Lan Zhang, Zhonghao Hu, Kai Yang, Peng Ran, Bo Li

机构 * University of Science and Technology of China(中国科学技术大学) Key Laboratory of Internet and Industrial Integration and Innovation, CAICT, MIIT(互联网与工业融合创新重点实验室) Research Institute of Safety Technology, China Mobile Research Institute(安全技术研究所) Hong Kong University of Science and Technology(香港科技大学)

AI总结 VMask通过层掩码技术实现可调的标签隐私保护,有效防御模型完成攻击,同时保持模型性能,运行效率显著高于传统方法。

Comments Accepted by Frontiers of Computer Science (FCS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14942 2026-01-22 cs.LG eess.SP

Communication-Efficient Multi-Modal Edge Inference via Uncertainty-Aware Distributed Learning

通过不确定性感知的分布式学习实现高效的多模态边缘推断

Hang Zhao, Hongru Li, Dongfang Xu, Shenghui Song, Khaled B. Letaief

机构 * Dept. of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学)

AI总结 本文提出一种三阶段通信感知分布式学习框架,通过减少通信开销和提升稳健性,实现高效的多模态边缘推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14628 2026-01-22 cs.RO cs.AI

A Brain-inspired Embodied Intelligence for Fluid and Fast Reflexive Robotics Control

一种类脑的具身智能用于流体和快速反射式机器人控制

Weiyu Guo, He Zhang, Pengteng Li, Tiefu Cai, Ziyang Chen, Yandong Guo, Xiao He, Yongkui Yang, Ying Sun, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) AI 2 Robotics(AI 2机器人) Shenzhen, China(深圳中国)

AI总结 NeuroVLA是一种类脑具身智能框架,通过生物启发设计实现机器人快速反射和动态稳定性控制,首次在物理机器人上实现先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17160 2026-01-22 cs.CV

Can Synthetic Images Serve as Effective and Efficient Class Prototypes?

合成图像能否作为有效的高效类别原型?

Dianxing Shi, Dingjie Fu, Yuqiao Liu, Jun Wang

机构 * Beijing Research Institute of Uranium Geology(铀矿北京研究机构) Huazhong University of Science and Technology(华中科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Great Bay University(大湾大学)

AI总结 LGCLIP通过大语言模型生成类别特定提示,利用扩散模型合成参考图像,以实现高效的零样本分类。

Comments Accepted by IEEE ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏