arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2778
2606.04172 2026-06-04 cs.RO

Affordance2Action: Task-Conditioned Scene-level Affordance Grounding for Real-Time Manipulation

Affordance2Action: 任务条件下的场景级功能区域定位用于实时操作

Litao Liu, Yifan Han, Pengfei Yi, Wenbo Yu, Hanqing Wang, Haoran Du, Enze Yuan, Zilin Yuan, Ruiding Feng, Michael Liu, Qi Zhang, Jingjin Yu

机构 * Department of Computer Science, Rutgers University-New Brunswick(罗格斯大学新布朗斯维尔回声分校计算机科学系) The Hong Kong University of Science and Technology (GZ)(香港科学与技术大学(GZ)) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 提出Affordance2Action框架,通过构建A2A-Bench基准和A2A-AffordGen标注流程,解决场景级任务条件功能区域定位中的多区域对应问题,并支持实时操作。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04155 2026-06-04 cs.HC cs.CL cs.CY

SocialCoach: Personalized Social Skill Learning with RL-based Agentic Tutoring and Practice

SocialCoach: 基于强化学习的智能辅导与练习的个性化社交技能学习

Tianfu Wang, Max Xiong, Jianxun Lian, Hongyuan Zhu, Zhengyu Hu, Yuxuan Lei, Linxiao Gong, Xiaofang Li, Peiting Tsai, Nicholas Jing Yuan, Qi Zhang

机构 * HKUST (GZ)(香港科技大学(广州)) Duke University(杜克大学) MSRA Beijing(微软研究院北京) Microsoft Beijing(微软北京)

AI总结 提出SocialCoach系统,利用多智能体管道构建知识语料库、强化学习优化自适应练习调度,并结合沉浸式实践与反思辅导,以解决社交技能学习中专家辅导稀缺和知行差距问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04074 2026-06-04 cs.LG cs.AI cs.IT math.IT

Adaptive Patching Is Harder Than It Looks For Time-Series Forecasting

自适应分块在时间序列预测中比看起来更难

Federico Zucchi, Yi Xie, Chao Zhang, Keyuan Luo, Thomas Lampert, Ziyue Li

机构 * ICube, University of Strasbourg, Illkirch-Graffenstaden, France(斯特拉斯堡大学ICube研究所,法国伊尔克里奇-格拉夫芬斯坦德) Technical University of Munich(慕尼黑技术大学) FinTech Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)金融科技研究组) Computer Science Department, Hainan Bielefeld University of Applied Sciences(海南比尔费尔德应用科学大学计算机科学系) Cephalgo, Strasbourg, France(法国斯特拉斯堡Cephalgo公司) Heilbronn Data Science Center, Munich Data Science Institute(慕尼黑数据科学研究所海德堡数据科学中心)

AI总结 本文通过理论分析和实验验证,探讨自适应分块在时间序列Transformer中是否优于调优的均匀分块,发现均匀基线在标准基准上具有竞争力,自适应分块的优势有限且依赖于特定方法和数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03784 2026-06-04 cs.RO

Revisiting Embodied Chain-of-Thought for Generalizable Robot Manipulation

重新审视具身思维链以实现可泛化的机器人操作

Nan Sun, Yuan Zhang, Yongkun Yang, Wentao Zhao, Peiyan Li, Jun Guo, Wenxuan Song, Pengxiang Ding, Runze Suo, Yifei Su, Xin Xiao, Xinghang Li, Huaping Liu

机构 * Tsinghua University(清华大学) Xiaomi Robotics(小米机器人) Peking University(北京大学) CASIA HKUST(GZ)(香港科技大学(广州)) Zhejiang University(浙江大学) Fudan University(复旦大学) Wuhan University(武汉大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文通过构建最大规模具身思维链语料库,提出ERVLA模型,利用思维链作为表征塑造监督而非测试时推理,显著提升了机器人操作的可泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03598 2026-06-04 cs.RO cs.AI cs.CV

PHASER: Phase-Aware and Semantic Experience Replay for Vision-Language-Action Models

PHASER: 面向视觉-语言-动作模型的相位感知与语义经验回放

Ziyang Chen, Shaoguang Wang, Weiyu Guo, Qianyi Cai, He Zhang, Pengteng Li, Yiren Zhao, Yandong Guo

机构 * Thrust of AI, HKUST(Guangzhou)(人工智能 thrust,香港科技大学(广州)) AI 2 Robotics, Shenzhen, China(人工智能与机器人,深圳,中国)

AI总结 提出PHASER框架,通过相位感知容量分配和多模态干扰路由策略,结合自动相位提取管线Auto-PC,解决VLA模型在持续学习中的灾难性遗忘问题,在LIBERO基准上平均成功率提升高达31%。

Comments 20 pages, 8 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22240 2026-06-04 cs.AI

Unlocking Proactivity in Task-Oriented Dialogue

解锁任务导向型对话中的主动性

Azure Zhang, Ning Gao, Yuqin Dai, Ruiyuan Wu, Jinpeng Wang, Rena Wei Gao, Bingdong Tan, Shuzheng Gao, Zongjie Li, Chaozheng Wang

机构 * Keeta AI, Meituan(Keeta AI,美团) Independent Researcher(独立研究者) CUHK(香港中文大学) HKUST(香港科技大学)

AI总结 针对任务导向型对话中主动性问题,提出认知用户模拟器和模拟器诱导的非对称视角策略优化,通过建模用户潜在关注实现主动对话。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19294 2026-06-04 cs.RO cs.AI

DEFLECT: Temporal Counterfactual Preference Learning for Delay-Robust Asynchronous VLAs

DEFLECT: 面向延迟鲁棒异步VLA的时间反事实偏好学习

Yixiang Zhu, Yonghao Chen, Zijie Yang, Yusong Hu, Xinyu Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) One Robotics

AI总结 针对异步视觉-语言-动作(VLA)策略中陈旧观测导致的预测-执行不匹配问题,提出离线后训练框架DEFLECT,通过反事实偏好监督学习偏好与执行时间对齐的动作,无需人工标注、在线部署或架构修改,显著提升高延迟下的任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08564 2026-06-04 cs.CL cs.LG

Attention-Based Sampler for Diffusion Language Models

基于注意力的扩散语言模型采样器

Yuyan Zhou, Kai Syun Hou, Weiyu Chen, James Kwok

机构 * Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科学与技术大学)

AI总结 针对扩散语言模型采样中忽略全局序列结构的问题,提出基于注意力矩阵列和的采样顺序优化方法,实现无训练的高质量并行采样。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16199 2026-06-04 cs.CL

LLM Abstention Can Be a Prompt Artifact, in Addition to Genuine Uncertainty

LLM 的拒绝回答可能既是真实不确定性的体现,也是提示的产物

Zipeng Ling, Shuliang Liu, Yuehao Tang, Junqi Yang, Shenghong Fu, Chen Huang, Kejia Huang, Yao Wan, Zhichao Hou, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Pennsylvania(宾夕法尼亚大学) Huazhong University of Science and Technology(华中科技大学) Nanjing University of Posts and Telecommunications(南京邮电大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文发现大语言模型(LLM)的拒绝回答行为不仅源于真实不确定性,还受提示结构影响,称为“拒绝膨胀”,并通过实验证明该现象由额外选项的结构性存在触发,而非真实不确定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.01629 2026-06-04 stat.ML cs.LG econ.GN q-fin.EC stat.AP

From Live to Recording: Consumer Demand and Response to Price Across the Livestreaming Lifecycle

从直播到录制:消费者对直播生命周期中价格的需求与响应

Ziwei Cong, Jia Liu, Puneet Manchanda

机构 * Georgetown University(乔治·华盛顿大学) Hong Kong University of Science and Technology(香港科学与技术大学) University of Michigan(密歇根大学) Stephen M. Ross School of Business, University of Michigan(密歇根大学罗斯商学院)

AI总结 利用大型直播平台数据,研究消费者在直播前后对价格敏感性的差异,发现直播前需求价格弹性更高,主要由消费者自选择和质量不确定性驱动。

Comments An earlier version of this paper was distributed under the title "The Role of 'Live' in Livestreaming Markets: Evidence Using Orthogonal Random Forest."

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.05519 2026-06-04 cs.IT cs.LG cs.NA math.IT math.NA math.OC

Accelerated Alternating Projections for Robust Principal Component Analysis

加速交替投影用于鲁棒主成分分析

HanQin Cai, Jian-Feng Cai, Ke Wei

机构 * Department of Mathematics, University of California, Los Angeles(加州大学洛杉矶分校数学系) Department of Mathematics, Hong Kong University of Science and Technology(香港理工大学数学系) School of Data Science, Fudan University(复旦大学数据科学学院)

AI总结 本文提出了一种加速交替投影算法,用于鲁棒主成分分析,显著提高了现有交替投影方法在更新低秩因子时的计算效率,并证明了该算法的精确恢复保证和线性收敛性。

Journal ref Journal of Machine Learning Research, 20 (2019): 685-717

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.05926 2026-06-04 cs.NI cs.RO cs.SY eess.SY

Connectivity-Aware UAV Path Planning with Aerial Coverage Maps

具有空中覆盖图的连接意识UAV路径规划

Hongyu Yang, Jun Zhang, S. H. Song, Khaled B. Lataief

机构 * Department of ECE, Hong Kong University of Science and Technology, Hong Kong(香港科技大学电子工程系) Department of EIE, The Hong Kong Polytechnic University, Hong Kong(香港理工大学电子工程系)

AI总结 本文提出了一种利用UAV可控移动来克服地面用户优化的蜂窝网络在空中覆盖不连续问题的连接意识UAV路径规划方法,通过引入两个新指标量化UAV路径的蜂窝连接质量,并利用空中覆盖图提供准确的散射覆盖孔位置,将UAV路径规划问题转化为在连接约束下寻找最短路径的问题。

Comments This paper has been accepted by IEEE WCNC 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.03349 2026-06-04 eess.SY cs.RO cs.SY

A New Hybrid Control Architecture to Attenuate Large Horizontal Wind Disturbance for a Small-Scale Unmanned Helicopter

一种新型混合控制架构用于抑制小型无人驾驶直升机的大水平风扰动

Xiaorui Zhu, Wenwu Zeng, Zexiang Li, Chunyang Zheng

机构 * School of Mechanical Engineering and Automation, Harbin Institute of Technology Shenzhen Graduate School(哈尔滨工业大学机械工程与自动化学院深圳研究生院) Department of Electronic and Computer Engineering, Hong Kong University of Science and Technology(香港理工大学电子与计算机工程系)

AI总结 本文提出了一种结合风洞实验数据和反步算法的新方法,用于抑制小型无人驾驶直升机的大水平风扰动,通过混合控制架构实现更精确快速的扰动抑制。

详情

展开后加载摘要…

URL PDF HTML 收藏
1512.00984 2026-06-04 math.NA cs.LG cs.NA stat.ML

Fast Low-Rank Matrix Learning with Nonconvex Regularization

快速低秩矩阵学习与非凸正则化

Quanming Yao, James T. Kwok, Wenliang Zhong

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Hong Kong University of Science and Technology(香港理工大学)

AI总结 本文提出一种利用非凸正则化快速学习低秩矩阵的方法,通过截断奇异值和幂方法提升效率,实现更准确的矩阵恢复。

Comments Long version of conference paper appeared ICDM 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03736 2026-06-03 stat.ML cs.LG

Resource-Constrained Adaptive Inference for Sequential Pricing

资源约束下的自适应推断用于顺序定价

Ruicheng Ao, Jiashuo Jiang, David Simchi-Levi

机构 * Institute for Data, Systems, and Society, Massachusetts Institute of Technology, Cambridge, MA 02139(数据、系统与社会研究所,麻省理工学院,剑桥,马萨诸塞州,02139) Department of Industrial Engineering and Decision Analytics, Hong Kong University of Science and Technology, Hong Kong(工业工程与决策分析系,香港科技大学,香港) Department of Civil and Environmental Engineering and Operations Research Center, Massachusetts Institute of Technology, Cambridge, MA 02139(土木与环境工程系和运筹中心,麻省理工学院,剑桥,马萨诸塞州,02139)

AI总结 针对资源约束导致固定价格推断不可行的问题,提出一种目标感知定价控制器,通过认证可行目标带并记录连续局部密度,实现基于局部去偏的学生化区间,并分析遗憾-信息核算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03906 2026-06-03 cs.AI

scTranslation: A Comprehensive Benchmark for Single-Cell Multi-Omics Modality Translation

scTranslation:单细胞多组学模态翻译的综合基准

Jiabei Cheng, Jingbo Zhou, Jun Xia, Changkai Li, Zhen Lei, Chang Yu, Stan Z. Li

机构 * Westlake University(西湖大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Xidian University(西安电子科技大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 针对单细胞多组学模态翻译任务,提出了包含多样化数据集、先进模型和全面评估指标的综合基准scTranslation,并系统研究了特征选择、特征质量和少样本设置等影响因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03874 2026-06-03 cs.CV cs.RO

DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction

DyaPlex: 用于二元交互的全双工语音-运动模型

Koki Nagano, Hongyu Liu, Seonwook Park, Tianye Li, Amrita Mazumdar, Christian Jacobsen, Shengze Wang, Michael Stengel, Rajarshi Roy, Ka Chun Cheung, Simon See, Shalini De Mello

机构 * NVIDIA HKUST(香港科技大学)

AI总结 提出DyaPlex,一种流式全双工语音-运动模型,通过双塔Transformer架构和统一二元令牌交织机制,实现同步多模态交互,在单体和二元交互基准上达到最优性能。

Comments Project page: https://research.nvidia.com/labs/amri/projects/DyaPlex

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03841 2026-06-03 cs.AI

EvoDS: Self-Evolving Autonomous Data Science Agent with Skill Learning and Context Management

EvoDS: 具有技能学习和上下文管理的自进化自主数据科学智能体

Zherui Yang, Fan Liu, Yansong Ning, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 提出EvoDS,通过自主技能获取和自适应上下文压缩策略,结合强化学习训练,使数据科学智能体能够自进化并显著提升多阶段迭代任务的性能。

Comments Accepted by KDD2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03644 2026-06-03 cs.LG

Spatial Transcriptomics-Guided Alignment Enhances Molecular Profiling in Pathology Foundation Model

空间转录组学引导的对齐增强病理基础模型中的分子分析

Fengtao Zhou, Yingxue Xu, Zhengyu Zhang, Yihui Wang, Zhengrui Guo, Ling Liang, Jiabo Ma, Cheng Jin, Ziyi Liu, Huajun Zhou, Hongyi Wang, Du Cai, Chenglong Zhao, Xi Wang, Can Yang, Yu Wang, Wenbin Li, Feng Gao, Zhe Wang, Zhenhui Li, Xiuming Zhang, Li Liang, Hao Chen

机构 * Department of Computer Science and Engineering, The Hong Kong University of Science and Technology, Hong Kong SAR, China(计算机科学与工程系,香港科学与技术大学,香港特别行政区,中国) Department of Pathology, Nanfang Hospital, Southern Medical University, Guangzhou, China(pathology department, 南方医科大学南芳医院,广州,中国) Department of Pathology, School of Basic Medical Sciences, Southern Medical University, Guangzhou, China(pathology department, 南方医科大学基础医学学院,广州,中国) Guangdong Province Key Laboratory of Molecular Tumor Pathology, Guangzhou, China(广东省分子肿瘤病理学重点实验室,广州,中国) Jinfeng Laboratory, Chongqing, China(金风实验室,重庆,中国)

AI总结 提出STAMP框架,利用空间转录组数据通过通路感知对齐策略增强病理基础模型的分子感知能力,并在多层级评估中验证其临床效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03335 2026-06-03 cs.RO

GPU-Parallel Multi-Task Reinforcement Learning with Demonstration Guided Policy Optimization

GPU并行多任务强化学习与演示引导的策略优化

Rui Zhang, Qiwei Wu, Zhengyu Zhang, Tao Li, Yunrong Guo, Junjie Lai, Renjing Xu, Weihua Zhang

机构 * NVIDIA The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 提出一种将结构化操作任务族转化为GPU并行多任务强化学习基准的构建方法MT-LIBERO,并设计演示引导策略优化算法DGPO,结合重要性加权PPO与自适应行为克隆,实现异构任务套件的高效并行训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03296 2026-06-03 cs.RO

Bridging Predictive Uncertainty and Safe Action: Sample-Conditioned Differentiable Planning for Autonomous Driving

桥接预测不确定性与安全行动:面向自动驾驶的样本条件可微分规划

Chengzhen Meng, Pei Liu, Zhiyu Huang, Chen Lv, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology(香港科学与技术大学机器人与自主系统方向) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学电子与计算机工程系) Department of Civil and Environmental Engineering, University of California, Los Angeles(加州大学洛杉矶分校土木与环境工程系) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院)

AI总结 提出一种样本条件可微分规划框架,通过扩散模型生成多样未来场景并直接输入可微分规划器,利用条件风险价值约束缓解预测不确定性,实现安全、高效、舒适的自动驾驶运动规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03243 2026-06-03 cs.CV

MemoGen: Can Past Experience Improve Future Text-to-Image Generation?

MemoGen:过去的经验能否改善未来的文本到图像生成?

Wenshuo Chen, Kuimou Yu, Bowen Tian, Jianfei Song, Shaofeng Liang, Haozhe Jia, Kan Cheng, Haosen Li, Kaishen Yuan, Lei Wang, Jiemin Wu, Songning Lai, Yutao Yue

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Scholarly, Guangzhou Ziyan Technology Co., Ltd.(学者,广州智源科技有限公司) LimX Dynamics Technology Co., Ltd.(LimX动力科技有限公司) Shandong University(山东大学) Data61/CSIRO Griffith University(Data61/CSIRO格里菲斯大学) Jiangsu Industrial Technology Research Institute (JITRI)(江苏工业技术研究院(JITRI))

AI总结 提出MemoGen框架,通过代理进化层和可重用经验记忆,在不更新生成器的情况下,利用过去经验改进文本到图像生成,在知识密集和推理基准上超越专有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03188 2026-06-03 cs.RO

GeoSem-WAM: Geometry- and Semantic-Aware World Action Models

GeoSem-WAM:几何与语义感知的世界动作模型

Fulong Ma, Daojie Peng, Wenjun Yue, Jiahang Cao, Bintao Wang, Qiang Zhang, Jun Ma

机构 * HKUST(GZ)(香港科技大学(广州)) HKU(香港大学) USTC(中国科学技术大学) SDU(山东大学) X-Humaniod

AI总结 提出GeoSem-WAM框架,通过几何和语义监督增强潜在表示,在统一潜在空间中联合捕捉场景动态、空间几何和语义上下文,避免测试时显式未来展开或视频生成,提升动作预测准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03073 2026-06-03 cs.LG cs.AI

Efficient Hyperparameter Optimization for LLM Reinforcement Learning

大语言模型强化学习的高效超参数优化

Minping Chen, Bowen Xiao, Du Liang, Chuxuan Zeng, Zeyi Wen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) China United Network Communications Group(中国联合网络通信集团)

AI总结 提出联合保真度超参数优化方法,通过同时调整模型大小和训练预算作为保真度,并集成早停策略和检查点机制,显著提升计算效率(每轮最高14.9倍)且性能提升5.8%-111.6%。

Comments 12 pages, 6 figures, accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03054 2026-06-03 cs.AI

ToolGate: Token-Efficient Pre-Call Control for Tool-Augmented Vision-Language Agents

ToolGate: 面向工具增强视觉语言智能体的令牌高效预调用控制

Anjie Liu, Yan Song, Zhixun Chen, Ziqin Gong, Zhongwei Yu, Jun Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University College London(伦敦大学学院) AI Lab, The Yangtze River Delta(长江三角洲人工智能实验室)

AI总结 针对工具增强视觉语言智能体中工具调用成本高且不必要的问题,提出轻量级外部控制器ToolGate,通过轨迹文本和结构特征预测执行/跳过决策,在降低令牌成本的同时保持或提升准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03038 2026-06-03 cs.LG physics.comp-ph physics.optics

Will Accurate Fields Mislead Photonic Design? FromGlobal Accuracy to Port Readout

精确的场会误导光子设计吗?从全局精度到端口读出

Yitian Zhang, Yonghong chen, Youming Chen, Yiyang Li, Xing Zhe, Renhe Lu, Shaolin Liao, Yuzhe Ma, Zhong Guan

机构 * Sun Yat-sen University(中山大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 针对光子设计中全局场精度高但端口读出不可靠的问题,提出传播对齐神经算子PaNO及其输出感知变体PaNO-R2,在MMI分束器基准上将端口功率误差降低72.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01241 2026-06-03 cs.RO

OneVLA: A Unified Framework for Embodied Tasks

OneVLA:面向具身任务的统一框架

Lingfeng Zhang, Xiaoshuai Hao, Yingbo Tang, Lei Zhou, Shuyi Zhang, Jinkun Liu, Hongsheng Li, Chenhao Zhang, Qiang Zhang, Hangjun Ye, Xiaojun Liang, Long Chen, Wenbo Ding

机构 * Tsinghua University(清华大学) Pengcheng Laboratory(鹏城实验室) Xiaomi EV(小米电动车) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peking University(北京大学) HKUST(GZ)(香港科技大学(广州))

AI总结 提出统一架构OneVLA,通过设计统一动作头和渐进式训练策略(含数据构建和思维链微调),在导航与操作任务上实现跨任务正迁移,达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00555 2026-06-03 cs.AI q-bio.BM

Probe Before You Edit: Probing-Guided Molecular Optimization for LLM Agents in Structure-Based Drug Design

编辑前先探测:基于探测引导的分子优化用于基于结构的药物设计中的LLM代理

Zaifei Yang, Weiyu Chen, Yaqing Wang, James Kwok

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) City University of Hong Kong(香港城市大学) Beijing Institute of Mathematical Sciences and Applications(北京数学科学应用研究所)

AI总结 提出PROBE框架,通过探测口袋-配体复合物的编辑响应来引导LLM代理进行分子优化,解决结合亲和力与成药性之间的冲突,在CrossDocked2020上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31530 2026-06-03 eess.AS cs.SD

UNISON: A Unified Sound Generation and Editing Framework via Deep LLM Fusion

UNISON: 通过深度LLM融合的统一声音生成与编辑框架

Zhaoqing Li, Haoning Xu, Jingran Su, Yaofang Liu, Zhefan Rao, Huimeng Wang, Jiajun Deng, Tianzi Wang, Zengrui Jin, Rui Liu, Haoxuan Che, Xunying Liu

机构 * The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) City University of Hong Kong(香港城市大学) The Hong Kong University of Science and Technology(香港科学与技术大学) Tsinghua University(清华大学) Huawei Research Hong Kong(华为香港研究)

AI总结 提出UNISON,一个基于潜在扩散的统一框架,通过层间深度LLM融合和多任务架构,实现语音生成、声音生成和音频编辑,在多个任务上达到或超越专业模型性能,且参数量减少约4倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30313 2026-06-03 cs.RO

UniLab: A Heterogeneous Architecture for Robot RL Beyond GPU-Dominant Paradigms

UniLab: 超越GPU主导范式的机器人强化学习异构架构

Yufei Jia, Zhanxiang Cao, Mingrui Yu, Heng Zhang, Shenyu Chen, Dixuan Jiang, Meng Li, Xiaofan Li, Yiyang Liu, Junzhe Wu, Zheng Li, XiLin Fang, Ting-Yu Tsui, Shengcheng Fu, Haoyang Li, Anqi Wang, Zifan Wang, Dongjie Zhu, Chenyu Cao, Zhenbiao Huang, Ziang Zheng, Jie Lu, Xin Ma, Zhengyang Wei, Xiang Zhao, Tianyue Zhan, Ye He, Yuxiang Chen, Yizhou Jiang, Yue Li, Haizhou Ge, Yuhang Dong, Fan Jia, Ziheng Zhang, Meng Zhang, Xiwa Deng, Zhixing Chen, Hanyang Shao, Chenxin Dong, Yixuan Li, Yizhi Chen, Bokui Chen, Kaifeng Zhang, Hanqing Cui, Yusen Qin, Ruqi Huang, Lei Han, Tiancai Wang, Xiang Li, Yue Gao, Guyue Zhou

机构 * THU(清华大学) SJTU(上海交通大学) SII(上海信息所) Motphys HITSZ(哈尔滨工业大学) BIT(北京理工大学) NEU(南京大学) SUSTech(四川大学) TJU(天津大学) DISCOVER Robotics HKUST(GZ)(香港科技大学(广州)) Galbot NUS(国立新加坡大学) WTU(武汉理工大学) HBUT(湖南大学) AMD NJU(南京大学) ZJU(浙江大学) Dexmal Sharpa D-Robotics

AI总结 提出UniLab异构CPU-仿真/GPU-学习架构,通过统一运行时解耦CPU并行仿真与GPU策略更新,在相同硬件配置下将端到端训练效率提升3-10倍,并减少对NVIDIA CUDA的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏