arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2801
2512.18321 2026-01-05 cs.CL

CTTA-T: Continual Test-Time Adaptation for Text Understanding via Teacher-Student with a Domain-aware and Generalized Teacher

CTTA-T: 通过教师-学生框架实现文本理解的持续测试时间适应

Tianlun Liu, Zhiliang Tian, Zhen Huang, Xingzhi Zhou, Wanlong Yu, Tianle Liu, Feng Liu, Dongsheng Li

机构 * College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出CTTA-T框架,通过教师-学生结构和动态领域感知机制,解决文本理解中持续测试时间适应的领域偏移问题,提升跨领域适应与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07675 2026-01-05 cs.DB cs.AI

QUITE: A Query Rewrite System Beyond Rules with LLM Agents

QUITE:超越规则的查询重写系统与LLM代理

Yuyang Song, Hanxu Yan, Jiale Lao, Yibo Wang, Yufei Li, Yuanchun Zhou, Jianguo Wang, Mingjie Tang

机构 * Sichuan University(四川大学) Cornell University(康奈尔大学) Purdue University(普渡大学) Hong Kong University of Science and Technology(香港科学与技术大学) Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)

AI总结 QUITE利用LLM代理超越规则,通过多代理框架、中间件和提示注入技术实现更高效的SQL查询重写,提升性能并覆盖更广的查询模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11167 2026-01-05 cs.CL

Cultural Palette: Pluralising Culture Alignment via Multi-agent Palette

文化调色板:通过多智能体调色板实现文化对齐的多元化

Jiahao Yuan, Zixiang Di, Shangzixin Zhao, Zhiqing Cui, Hanqing Wang, Guisong Yang, Usman Naseem

机构 * ECNU(华东师范大学) USST(上海理工大学) BNU(北京师范大学) HKUST–GZ(香港理工大学-广州)

AI总结 Cultural Palette通过多智能体框架实现文化对齐的多元化,利用文化地理和颜色混合机制提升跨文化响应的适应性与准确性。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24138 2026-01-01 cs.LG cs.AI cs.CV

GARDO: Reinforcing Diffusion Models without Reward Hacking

GARDO:无需奖励黑客的扩散模型强化

Haoran He, Yuxiao Ye, Jie Liu, Jiajun Liang, Zhiyong Wang, Ziyang Yuan, Xintao Wang, Hangyu Mao, Pengfei Wan, Ling Pan

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Kuaishou Technology(快手科技) CUHK MMLab(港中文大学MMLab) The University of Edinburgh(爱丁堡大学)

AI总结 GARDO通过自适应正则化和多样性增强,有效缓解扩散模型中的奖励黑客问题,提升生成多样性与样本效率。

Comments 17 pages. Project: https://tinnerhrhe.github.io/gardo_project

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24014 2026-01-01 cs.CL cs.AI

iCLP: Large Language Model Reasoning with Implicit Cognition Latent Planning

iCLP: 基于隐式认知潜在规划的大语言模型推理

Sijia Chen, Di Niu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Alberta(阿尔伯塔大学)

AI总结 iCLP通过隐式认知潜在规划提升大语言模型的推理准确性和效率,实现跨领域泛化与可解释性。

Comments 9 pages, 6 figures. The source code is publicly available at https://github.com/AgenticFinLab/latent-planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23667 2026-01-01 cs.CV

IDT: A Physically Grounded Transformer for Feed-Forward Multi-View Intrinsic Decomposition

IDT: 一种物理基础的Transformer用于前馈多视角内在分解

Kang Du, Yirui Guan, Zeyu Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 IDT通过基于Transformer的注意力机制实现多视角内在图像分解,采用物理基础模型分离材料和照明效应,提升多视角一致性。

Comments 10 pages 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19432 2026-01-01 cs.CL

MobileWorld: Benchmarking Autonomous Mobile Agents in Agent-User Interactive and MCP-Augmented Environments

MobileWorld: 用于Agent-用户交互和MCP增强环境中的自主移动代理基准测试

Quyu Kong, Xu Zhang, Zhenyu Yang, Nolan Gao, Chen Liu, Panrong Tong, Chenglin Cai, Hanzhang Zhou, Jianan Zhang, Liangyu Chen, Zhidan Liu, Steven Hoi, Yue Wang

机构 * Tongyi Lab , Alibaba Group(通义实验室,阿里巴巴集团) HKUST (GZ)(香港科技大学(广州)) University of Florida(佛罗里达大学)

AI总结 MobileWorld通过201个任务和20个应用的挑战性基准测试,评估代理在用户交互和MCP增强环境中的表现,揭示了与AndroidWorld相比的显著性能下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10969 2026-01-01 cs.CV

Bringing The Consistency Gap: Explicit Structured Memory for Interleaved Image-Text Generation

弥合一致性差距:用于交错图像-文本生成的显式结构化记忆

Zeteng Lin, Xingxing Li, Wen You, Xiaoyang Li, Zehan Lu, Yujun Cai, Jing Tang

机构 * Hong Kong University of Science and Technology(Guangzhou)(香港科技大学(广州)) University of Queensland(昆士兰大学)

AI总结 IUT-Plug通过显式结构化记忆机制解决多模态生成中的上下文漂移问题,提升长序列一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03257 2026-01-01 cs.LG cs.AI cs.MA

Triple-BERT: Do We Really Need MARL for Order Dispatch on Ride-Sharing Platforms?

Triple-BERT: 为网约车平台订单调度是否真的需要MARL?

Zijian Zhao, Sen Li

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

AI总结 Triple-BERT通过动作分解和BERT网络提升网约车平台订单调度效率,实现11.95%的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08947 2026-01-01 cs.LG cs.AI

Generalising Traffic Forecasting to Regions without Traffic Observations

面向无交通观测区域的交通预测泛化

Xinyu Su, Majid Sarvi, Feng Liu, Egemen Tanin, Jianzhong Qi

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出GenCast模型,通过整合物理信息神经网络和外部信号学习模块,提升无交通观测区域的交通预测泛化能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01482 2026-01-01 cs.LG cs.AI cs.MM eess.AS

Automatic Stage Lighting Control: Is it a Rule-Driven Process or Generative Task?

自动舞台照明控制:是规则驱动过程还是生成任务?

Zijian Zhao, Dian Jin, Zijing Zhou, Xiaoyu Zhang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学) City University of Hong Kong(香港城市大学)

AI总结 本文提出Skip-BART模型,将自动舞台照明控制视为生成任务,通过学习专业照明工程师经验,生成生动的人类化灯光效果,并创建首个舞台照明数据集以支持模型训练与评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21614 2026-01-01 cs.CL

A Survey of Efficient Reasoning for Large Reasoning Models: Language, Multimodality, and Beyond

大推理模型高效推理的综述:语言、多模态与更远的探索

Xiaoye Qu, Yafu Li, Zhao-Chen Su, Weigao Sun, Jianhao Yan, Dongrui Liu, Ganqu Cui, Daizong Liu, Shuxian Liang, Junxian He, Peng Li, Wei Wei, Jing Shao, Chaochao Lu, Yue Zhang, Xian-Sheng Hua, Bowen Zhou, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) Soochow University(苏州大学) Westlake University(西湖大学) Peking University(北京大学) Tongji University(同济大学) The Hong Kong University of Science and Technology(香港科技大学) Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文综述了大推理模型在提升推理效率方面的最新研究,聚焦于语言、多模态及未来方向,旨在推动该领域的发展。

Comments Update recent RL papers. Project page: https://github.com/XiaoYee/Awesome_Efficient_LRM_Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22881 2025-12-30 cs.CV

Guided Path Sampling: Steering Diffusion Models Back on Track with Principled Path Guidance

引导路径采样:通过原理性路径引导将扩散模型重新引导到正确轨道

Haosen Li, Wenshuo Chen, Shaofeng Liang, Lei Wang, Haozhe Jia, Yutao Yue

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Griffith University\&Data61/CSIRO(格里菲斯大学与Data61/CSIRO)

AI总结 引导路径采样通过原理性路径引导提升扩散模型的稳定性和生成质量,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21003 2025-12-30 cs.CV

MVInverse: Feed-forward Multi-view Inverse Rendering in Seconds

MVInverse: 秒级多视角反向渲染

Xiangzuo Wu, Chengwei Ren, Jun Zhou, Xiu Li, Yuan Liu

机构 * Tsinghua University(清华大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 MVInverse提出一种高效的多视角反向渲染方法,通过前馈框架和一致性微调策略,在秒级内实现高精度的多视角一致性与真实场景泛化能力。

Comments 21 pages, 17 figures, 5 tables, project page: https://maddog241.github.io/mvinverse-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03427 2025-12-30 cs.AI

TPTU: Large Language Model-based AI Agents for Task Planning and Tool Usage

TPTU:基于大型语言模型的AI代理用于任务规划和工具使用

Jingqing Ruan, Yihong Chen, Bin Zhang, Zhiwei Xu, Tianpeng Bao, Guoqing Du, Shiwei Shi, Hangyu Mao, Ziyue Li, Xingyu Zeng, Rui Zhao

机构 * University of Chinese Academy of Sciences(中国科学院大学) SenseTime Research(商汤科技研究院) HKUST(香港科技大学)

AI总结 本文提出基于大型语言模型的AI代理框架,设计两种代理类型以提升任务规划和工具使用能力,并通过实验验证其在复杂任务中的有效性。

Comments Accepted in NeurIPS-2023 Workshop on Foundation Models for Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22733 2025-12-30 cs.LG cs.AI

FoldAct: Efficient and Stable Context Folding for Long-Horizon Search Agents

FoldAct: 长时间 horizon 搜索代理的高效且稳定的上下文折叠

Jiaqi Shao, Yufeng Miao, Wei Zhang, Bing Luo

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Duke Kunshan University(杜克大学昆山学院) Microsoft AI(微软人工智能)

AI总结 FoldAct通过分离损失计算、全上下文一致性损失和选择性段训练,解决长时间 horizon 搜索代理中上下文折叠的非平稳观察问题,提升训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22260 2025-12-30 cs.LO cs.AI

ReVEAL: GNN-Guided Reverse Engineering for Formal Verification of Optimized Multipliers

ReVEAL: 基于图学习的乘法器架构反向工程以提升优化乘法器的代数电路验证

Chen Chen, Daniela Kaufmann, Chenhui Deng, Zhan Song, Hongce Zhang, Cunxi Yu

机构 * University of Maryland, College Park, USA(美国马里兰大学College Park分校) TU Wien, Austria(奥地利维也纳技术大学) NVIDIA(英伟达公司) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

AI总结 ReVEAL通过图学习方法实现乘法器架构反向工程,提升优化乘法器的代数电路验证效率和准确性。

Comments Accepted by TACAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12018 2025-12-30 cs.CL cs.AI cs.LG

Atom of Thoughts for Markov LLM Test-Time Scaling

思想原子用于马尔可夫LLM测试时间扩展

Fengwei Teng, Quan Shi, Zhaoyang Yu, Jiayi Zhang, Yuyu Luo, Chenglin Wu, Zhijiang Guo

机构 * HKUST(GZ)(香港科技大学(广州)) DeepWisdom(DeepWisdom公司) Renmin University of China(中国人民大学)

AI总结 本文提出思想原子(\our),通过马尔可夫链结构与树搜索等技术结合,实现高效推理,提升LLM测试时间扩展性能。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21919 2025-12-29 cs.CL

SWE-RM: Execution-free Feedback For Software Engineering Agents

SWE-RM:无执行反馈用于软件工程代理

KaShun Shum, Binyuan Hui, Jiawei Chen, Lei Zhang, X. W., Jiaxi Yang, Yuzhen Huang, Junyang Lin, Junxian He

机构 * The Hong Kong University of Science and Technology(香港科技大学) Alibaba Group(阿里巴巴集团)

AI总结 SWE-RM通过混合专家架构提升软件工程代理在TTS和RL中的性能,达到新的开源模型最佳水平。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05607 2025-12-29 cs.CL

CC-GSEO-Bench: A Content-Centric Benchmark for Measuring Source Influence in Generative Search Engines

CC-GSEO-Bench: 一种以内容为中心的基准,用于衡量生成搜索引擎中源影响力

Qiyuan Chen, Jiahe Chen, Hongsen Huang, Qian Shao, Jintai Chen, Renjie Hua, Hongxia Xu, Ruijia Wu, Ren Chuan, Jian Wu

机构 * Zhejiang University(浙江大学) Soochow Securities(苏州证券) HKUST(GZ)(香港科技大学(广州)) Shanghai Jiaotong University(上海交通大学)

AI总结 CC-GSEO-Bench通过大规模数据集和创作者导向的评估框架,量化生成搜索引擎中源文章的影响,涵盖曝光、忠实信用、因果影响等核心维度。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13464 2025-12-29 cs.CL cs.AI

Unveiling the Learning Mind of Language Models: A Cognitive Framework and Empirical Study

揭示语言模型的学习心智:一种认知框架与实证研究

Zhengyu Hu, Jianxun Lian, Zheyuan Xiao, Seraphina Zhang, Tianfu Wang, Nicholas Jing Yuan, Xing Xie, Hui Xiong

机构 * Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou), China(香港科学与技术大学人工智能研究所) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology Hong Kong SAR, China(香港科学与技术大学计算机科学与工程系) Microsoft Research Asia(微软亚洲研究院) University of Cambridge(剑桥大学) Microsoft(微软)

AI总结 本文提出一种认知框架,将学习能力分解为三个维度,并通过实证研究揭示LLMs在不同学习场景下的表现与局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17903 2025-12-29 cs.LG cs.AI

GLADMamba: Unsupervised Graph-Level Anomaly Detection Powered by Selective State Space Model

GLADMamba: 一种基于选择性状态空间模型的无监督图级异常检测方法

Yali Fu, Jindong Li, Qi Wang, Qianli Xing

机构 * School of Artificial Intelligence, Jilin University, Changchun, China(吉林大学人工智能学院) Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China(香港科技大学(广州)) College of Computer Science and Technology, Jilin University, Changchun, China(吉林大学计算机科学与技术学院) Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, Ministry of Education, China(知识驱动的人机智能工程研究中心,教育部)

AI总结 GLADMamba通过引入选择性状态空间模型和谱信息,实现了无监督图级异常检测的高效检测与优化。

Comments Published at ECML PKDD 2025 (Research Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01512 2025-12-29 cs.CL

MAD: Multi-Alignment MEG-to-Text Decoding

MAD: 多对齐的MEG到文本解码

Yiqian Yang, Hyejeong Jo, Yiqun Duan, Qiang Zhang, Jinni Zhou, Xuming Hu, Won Hee Lee, Renjing Xu, Hui Xiong

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Department of Software Convergence, Kyung Hee University(软件融合系,庆熙大学)

AI总结 MAD通过多对齐框架实现从MEG信号到未知文本的端到端解码,显著提升BLEU-1分数,推动BCI研究发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21487 2025-12-29 cs.DC cs.AI

Efficient MoE Inference with Fine-Grained Scheduling of Disaggregated Expert Parallelism

高效MoE推理的细粒度调度 disaggregated专家并行性

Xinglin Pan, Shaohuai Shi, Wenxiang Lin, Yuxin Wang, Zhenheng Tang, Wei Wang, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Hong Kong Baptist University(香港 Baptist 大学) The Hong Kong University of Science(香港科学与技术大学)

AI总结 FinDEP通过细粒度任务调度优化disaggregated专家并行性,提升MoE推理吞吐量,实验显示在32-GPU系统上达到1.24倍速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14537 2025-12-29 cs.CV

Personalize Your Gaussian: Consistent 3D Scene Personalization from a Single Image

为Gaussian个性化:从单张图像实现一致的3D场景个性化

Yuxuan Wang, Xuanyu Yi, Qingshan Xu, Yuan Zhou, Long Chen, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出CP-GS框架,通过逐步传播单视角参考外观到新视角,有效缓解视角偏差,实现高质量3D场景个性化。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00476 2025-12-29 cs.RO

PlanScope: Learning to Plan Within Decision Scope for Urban Autonomous Driving

PlanScope: 在决策范围内学习城市自动驾驶中的规划

Ren Xin, Jie Cheng, Hongji Liu, Jun Ma

机构 * Division of Emerging Interdisciplinary Areas, The Hong Kong University of Science and Technology(新兴交叉领域 division, 香港科学与技术大学) Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统 thrust, 香港科学与技术大学(广州)) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程 department, 香港科学与技术大学)

AI总结 PlanScope通过分离短期和长期决策,提升城市自动驾驶规划模型的收敛效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21150 2025-12-25 cs.CV

ORCA: Object Recognition and Comprehension for Archiving Marine Species

ORCA:面向档案化海洋物种的对象识别与理解

Yuk-Kwan Wong, Haixin Liang, Zeyu Ma, Yiwei Chen, Ziqiang Zheng, Rinaldi Gotama, Pascal Sebastian, Lauren D. Sparks, Sai-Kit Yeung

机构 * Hong Kong University of Science and Technology(香港科技大学) University of Electronic Science and Technology of China(电子科学与技术大学) Indo Ocean Foundation Project(印度洋基金会项目)

AI总结 ORCA提出一个多模态基准数据集,用于提升海洋物种识别与理解的研究水平,通过细粒度视觉和文本注释推动领域内方法学进展。

Comments Accepted by The IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21126 2025-12-25 cs.CV cs.DB

MarineEval: Assessing the Marine Intelligence of Vision-Language Models

MarineEval: 评估视觉-语言模型的海洋智能

YuK-Kwan Wong, Tuan-An To, Jipeng Zhang, Ziqiang Zheng, Sai-Kit Yeung

机构 * Hong Kong University of Science and Technology(香港科技大学)

AI总结 MarineEval首次构建大规模海洋VLM数据集和基准,评估现有VLM在回答海洋领域问题上的能力与局限性。

Comments Accepted by The IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21118 2025-12-25 cs.LG cs.AI cs.CV

STLDM: Spatio-Temporal Latent Diffusion Model for Precipitation Nowcasting

STLDM:用于降水现在预测的时空潜在扩散模型

Shi Quan Foo, Chi-Ho Wong, Zhihan Gao, Dit-Yan Yeung, Ka-Hing Wong, Wai-Kin Wong

机构 * The Hong Kong University of Science and Technology(香港科技大学) Hong Kong Observatory(香港天文台)

AI总结 STLDM通过结合变分自编码器和条件网络,提出了一种基于扩散的模型,用于提升降水现在预测的精度和效率。

Comments Accepted by TMLR. Camera-ready submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26226 2025-12-25 cs.LG cs.CL

Thinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient Reasoners

无需思考的策略初始化使蒸馏推理模型更有效和高效

Xin Xu, Cliveb AI, Kai Yang, Tianhao Chen, Yang Wang, Saiyong Yang, Can Yang

机构 * LLM Department, Tencent(腾讯大语言模型部门) The Hong Kong University of Science and Technology(香港科技大学) The University of Hong Kong(香港大学)

AI总结 TFPI通过简化RLVR训练流程,提高了推理模型的效率和性能,实现了更高效的模型训练和更高的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏