arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2801
2602.22609 2026-02-27 cs.AR cs.LG

EvolveGen: Algorithmic Level Hardware Model Checking Benchmark Generation through Reinforcement Learning

EvolveGen: 通过强化学习生成硬件模型检查基准的算法层面

Guangyu Hu, Xiaofeng Zhou, Wei Zhang, Hongce Zhang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 EvolveGen通过强化学习和高级合成生成多样化硬件模型检查基准,解决现有基准不足问题,揭示求解器弱点。

Comments 19 pages, 8 figures. Accepted by TACAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22570 2026-02-27 cs.CV cs.AI

Guidance Matters: Rethinking the Evaluation Pitfall for Text-to-Image Generation

引导至关重要:重新审视文本到图像生成中的评估误区

Dian Xie, Shitong Shao, Lichen Bai, Zikai Zhou, Bojun Cheng, Shuo Yang, Jun Wu, Zeke Xie

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Cogniser Information Technology(Cogniser信息科技)

AI总结 本文重新审视文本到图像生成中的评估误区,提出引导感知评估框架,并设计超越扩散引导方法以提升人类偏好评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22538 2026-02-27 cs.LG cs.CL

RAIN-Merging: A Gradient-Free Method to Enhance Instruction Following in Large Reasoning Models with Preserved Thinking Format

RAIN-Merging: 一种无梯度方法,用于在保持推理格式的前提下提升大推理模型的指令遵循能力

Zhehao Huang, Yuhang Liu, Baijiong Lin, Yixin Lou, Zhengbao He, Hanling Tian, Tao Li, Xiaolin Huang

机构 * Institute of Image Processing and Pattern Recoginition, School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(图像处理与模式识别研究所,自动化与智能感知学院,上海交通大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) MoE Key Laboratory of System Control and Information Processing (Shanghai)(系统控制与信息处理国家重点实验室(上海))

AI总结 RAIN-Merging通过无梯度方法提升大推理模型的指令遵循能力,同时保持推理格式和性能。

Comments 41 pages, ICLR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21992 2026-02-26 cs.CV

PanoEnv: Exploring 3D Spatial Intelligence in Panoramic Environments with Reinforcement Learning

PanoEnv:探索基于强化学习的全景环境中3D空间智能

Zekai Lin, Xu Zheng

机构 * University of Glasgow(格拉斯哥大学) HKUST(GZ)(香港科技大学(广州))

AI总结 PanoEnv通过强化学习框架提升VLMs在全景环境中3D空间推理能力,实现更高准确率和语义评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21967 2026-02-26 cs.RO cs.CV

Dream-SLAM: Dreaming the Unseen for Active SLAM in Dynamic Environments

Dream-SLAM: 为动态环境中的主动SLAM梦见未见

Xiangqi Meng, Pengxu Hou, Zhenjun Zhao, Javier Civera, Daniel Cremers, Hesheng Wang, Haoang Li

机构 * Thrust of Robotics and Autonomous Systems, Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统研究所,香港科学与技术大学(广州)) University of Zaragoza(阿拉瓦大学) School of Computation, Information and Technology, Technical University of Munich(计算、信息与技术学院,慕尼黑技术大学) School of Automation and IntelligentSensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学)

AI总结 Dream-SLAM通过跨时空图像与语义结构的融合,提升动态环境中主动SLAM的定位精度和探索效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21952 2026-02-26 cs.CV

MindDriver: Introducing Progressive Multimodal Reasoning for Autonomous Driving

MindDriver: 引入渐进多模态推理用于自动驾驶

Lingjun Zhang, Yujian Yuan, Changjie Wu, Xinyuan Chang, Xin Cai, Shuang Zeng, Linzhe Shi, Sijin Wang, Hang Zhang, Mu Xu

机构 * Amap, Alibaba Group(阿里集团蚂巴公司) The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong(香港中文大学) Xi’an Jiaotong University(西安交通大学)

AI总结 MindDriver通过渐进多模态推理框架提升自动驾驶系统的推理能力,实现语义到物理空间的转化与轨迹规划,展现优异的性能表现。

Comments CVPR2026; Yujian Yuan and Lingjun Zhang contributed equally with random order

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21864 2026-02-26 cs.CV cs.AI cs.CL cs.GR

DynamicGTR: Leveraging Graph Topology Representation Preferences to Boost VLM Capabilities on Graph QAs

DynamicGTR: 利用图拓扑表示偏好提升视觉语言模型在图问答中的能力

Yanbin Wei, Jiangyue Yan, Chun Kang, Yang Chen, Hua Liu, James Kwok, Yu Zhang

机构 * Southern University of Science and Technology(南方科技大学) Hong Kong University of Science and Technology(香港理工大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Beihang University(北京航空航天大学)

AI总结 DynamicGTR通过动态选择最优图拓扑表示,提升视觉语言模型在图问答中的零样本性能及跨任务迁移能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15715 2026-02-26 cs.CL cs.AI

RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind

反驳代理:通过心理理论实现学术反驳的战略说服

Zhitao He, Zongwei Lyu, Yi R Fung

机构 * Hong Kong University of Science and Technology(香港科技大学)

AI总结 RebuttalAgent通过心理理论框架实现学术反驳的战略说服,利用训练数据和强化学习提升反驳效果,显著优于现有模型。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21552 2026-02-26 cs.CV

Generalizing Visual Geometry Priors to Sparse Gaussian Occupancy Prediction

将视觉几何先验泛化到稀疏高斯占用预测

Changqing Zhou, Yueru Luo, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 GPOcc通过利用可泛化的视觉几何先验进行单目占用预测,在速度和精度上均优于现有方法。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21551 2026-02-26 cs.LG cs.AI

From Basis to Basis: Gaussian Particle Representation for Interpretable PDE Operators

从基到基:用于可解释PDE算子的高斯粒子表示

Zhihao Li, Yu Feng, Zhilu Lai, Wei Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))

AI总结 本文提出基于高斯基的PDE算子,通过高斯粒子表示实现可解释的流体动力学建模,支持不规则几何和2D到3D扩展,取得最佳准确度并提供内在可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21535 2026-02-26 cs.CV

Pseudo-View Enhancement via Confidence Fusion for Unposed Sparse-View Reconstruction

通过置信度融合的伪视图增强用于未定位稀疏视图重建

Beizhen Zhao, Sicheng Yu, Guanzhi Ding, Yu Hu, Hao Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出通过置信度融合的伪视图增强方法,解决稀疏视角下户外场景重建中的几何不一致和伪影问题,提升重建质量和稳定性。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13920 2026-02-26 cs.SI cs.AI

A Comparative Analysis of Social Network Topology in Reddit and Moltbook

对Reddit和Moltbook社交网络拓扑结构的比较分析

Yiming Zhu, Gareth Tyson, Pan Hui

机构 * Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文通过比较Moltbook和Reddit的社交网络拓扑结构,揭示了代理驱动与人类驱动网络在拓扑模式和边形成效率上的差异,为构建更真实的社会系统提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20925 2026-02-25 cs.RO cs.CV

LST-SLAM: A Stereo Thermal SLAM System for Kilometer-Scale Dynamic Environments

LST-SLAM:一种用于公里级动态环境的立体热SLAM系统

Zeyu Jiang, Kuan Xu, Changhao Chen

机构 * PEAK-Lab, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)峰值实验室) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

AI总结 LST-SLAM通过结合自监督学习、立体跟踪和几何优化,实现了在动态大规模环境中高鲁棒性和精度的热SLAM系统。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12876 2026-02-25 cs.AI

BrowseComp-$V^3$: A Visual, Vertical, and Verifiable Benchmark for Multimodal Browsing Agents

BrowseComp-$V^3$:一种视觉、垂直和可验证的多模态浏览代理基准测试

Huanyao Zhang, Jiepeng Zhou, Bo Li, Bowen Zhou, Yanzhe Shan, Haishan Lu, Zhiyong Cao, Jiaoyang Chen, Yuqian Han, Zinan Sheng, Zhengwei Tao, Hao Liang, Jialong Wu, Yang Shi, Yuanpeng He, Jiaye Lin, Qintong Zhang, Guochen Yan, Runhao Zhao, Zhengpin Li, Xiaohan Yu, Lang Mei, Chong Chen, Wentao Zhang, Bin Cui

机构 * PKU(北京大学) HKUST(GZ)(香港科技大学) OUC(华侨大学) CASIA(中国科学院自动化研究所) HITSZ(哈尔滨工业大学) THU(清华大学) Huawei Cloud BU(华为云业务部)

AI总结 BrowseComp-$V^3$提出了一种多模态浏览代理基准测试,通过300个跨模态问题评估深度搜索能力,揭示多模态信息整合的瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23587 2026-02-25 cs.DB cs.AI

A Survey of Data Agents: Emerging Paradigm or Overstated Hype?

数据代理的综述:新兴范式还是过度炒作?

Yizhang Zhu, Liangwei Wang, Chenyu Yang, Xiaotian Lin, Boyan Li, Wei Zhou, Xinyu Liu, Zhangyang Peng, Tianqi Luo, Yu Li, Chengliang Chai, Chong Chen, Shimin Di, Ju Fan, Ji Sun, Nan Tang, Fugee Tsung, Jiannan Wang, Chenglin Wu, Yanwei Xu, Shaolei Zhang, Yong Zhang, Xuanhe Zhou, Guoliang Li, Yuyu Luo

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shanghai Jiao Tong University(上海交通大学) Renmin University of China(中国人民大学) Beijing Institute of Technology(北京理工大学) Southeast University(东南大学) Tsinghua University(清华大学) Huawei(华为) DeepWisdom

AI总结 本文系统梳理了数据代理的分类与演变,提出分层框架并分析其技术发展与未来方向。

Comments Please refer to our paper list and companion materials at: https://github.com/HKUSTDial/awesome-data-agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20718 2026-02-25 cs.CV

Monocular Endoscopic Tissue 3D Reconstruction with Multi-Level Geometry Regularization

单目内窥镜组织三维重建与多级几何正则化

Yangsen Chen, Hao Wang

机构 * HKUST(GZ)(香港科技大学(珠海))

AI总结 本文提出基于3D高斯点的单目内窥镜组织三维重建方法,结合多级几何正则化实现平滑表面与实时渲染。

Comments ijcnn 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02565 2026-02-25 cs.CV cs.AI

A Cognitive Process-Inspired Architecture for Subject-Agnostic Brain Visual Decoding

一种受认知过程启发的无主体脑视觉解码架构

Jingyu Lu, Haonan Wang, Qixiang Zhang, Xiaomeng Li

机构 * The Hong Kong University of Science and Technology(香港科技大学) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 本文提出VCFlow架构,通过建模人类视觉系统结构,实现快速且无主体的脑视觉解码,提升临床应用可行性。

Comments Accepted at the International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07172 2026-02-25 cs.AI

NewtonBench: Benchmarking Generalizable Scientific Law Discovery in LLM Agents

NewtonBench: 在LLM代理中评估可推广的科学定律发现

Tianshi Zheng, Kelvin Kiu-Wai Tam, Newt Hue-Nam K. Nguyen, Baixuan Xu, Zhaowei Wang, Jiayang Cheng, Hong Ting Tsang, Weiqi Wang, Jiaxin Bai, Tianqing Fang, Yangqiu Song, Ginny Y. Wong, Simon See

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) NVIDIA(英伟达)

AI总结 NewtonBench通过反事实定律变化生成科学定律发现任务,评估LLM代理在复杂系统中发现隐藏原理的能力,并揭示其在系统复杂性和观测噪声下的脆弱性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12016 2026-02-25 cs.LG cs.DC

A Survey on Federated Fine-tuning of Large Language Models

大型语言模型联邦微调综述

Yebo Wu, Chunlin Tian, Jingguang Li, He Sun, Kahou Tam, Zhanting Zhou, Haicheng Liao, Jing Xiong, Zhijiang Guo, Li Li, Chengzhong Xu

机构 * State Key Laboratory of IOTSC, University of Macau(物联网科学与技术国家重点实验室,澳门大学) University of Electronic Science and Technology of China(电子科技大学) The University of Hong Kong(香港大学) Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))

AI总结 本文综述了大型语言模型联邦微调的技术、挑战与应用,旨在为隐私保护AI的发展提供指导。

Comments Accepted by Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19622 2026-02-24 cs.LG cs.AI

VecFormer: Towards Efficient and Generalizable Graph Transformer with Graph Token Attention

VecFormer: 向高效且通用的图变换器迈进:基于图标记注意力的图变换器

Jingbo Zhou, Jun Xia, Siyuan Li, Yunfan Liu, Wenjun Wang, Yufei Huang, Changxi Chi, Mutian Hong, Zhuoli Ouyang, Shu Wang, Zhongqi Wang, Xingyu Wu, Chang Yu, Stan Z. Li

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tongji University(同济大学) ShanghaiTech University(上海科技大学) Southern University of Science and Technology(南方科技大学) Jilin University(吉林大学)

AI总结 VecFormer通过两阶段训练和图标记注意力机制,提升图变换器在大规模图和分布外场景中的效率与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19542 2026-02-24 cs.CV

Vinedresser3D: Agentic Text-guided 3D Editing

Vinedresser3D: 基于代理的文本引导3D编辑

Yankuan Chi, Xiang Li, Zixuan Huang, James M. Rehg

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 Vinedresser3D通过多模态大语言模型和潜在空间编辑技术实现高质量文本引导的3D编辑,提升编辑精度与一致性。

Comments CVPR 2026, Project website:https://vinedresser3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19372 2026-02-24 cs.RO cs.CV cs.LG

Seeing Farther and Smarter: Value-Guided Multi-Path Reflection for VLM Policy Optimization

看得更远且更聪明:基于价值引导的多路径反射用于VLM策略优化

Yanting Yang, Shenyuan Gao, Qingwen Bu, Li Chen, Dimitris N. Metaxas

机构 * Rutgers University(罗格斯大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学)

AI总结 本研究提出了一种基于价值引导的多路径反射方法,用于提升VLM在机器人操作任务中的策略优化性能,通过解耦状态评估与动作生成,提高决策鲁棒性并减少推理时间。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19180 2026-02-24 cs.CV

VLM-Guided Group Preference Alignment for Diffusion-based Human Mesh Recovery

基于扩散模型的人体网格恢复中的群体偏好对齐

Wenhao Shen, Hao Wang, Wanqi Yin, Fayao Liu, Xulei Yang, Chao Liang, Zhongang Cai, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) HKUST(GZ)(香港科技大学(广州)) SenseTime Research(商汤科技研究院) A*STAR(新加坡科技研究局)

AI总结 本文提出了一种基于群体偏好的扩散模型微调框架,通过双内存增强的批评代理生成质量评分,提升人体网格恢复的物理合理性和图像一致性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19131 2026-02-24 cs.LG cs.AI

Test-Time Learning of Causal Structure from Interventional Data

测试时从干预数据中学习因果结构

Wei Chen, Rui Ding, Bojun Huang, Yang Zhang, Qiang Fu, Yuxuan Liang, Han Shi, Dongmei Zhang

机构 * HKUST(香港科技大学) HKUST(GZ)(香港科技大学(广州)) Microsoft Research(微软研究院) Sony Research(索尼研究院) NUS(国立新加坡大学)

AI总结 TICL通过结合测试时训练与联合因果推断,有效解决干预数据中因果结构学习的泛化问题,提升因果发现和干预目标检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15690 2026-02-24 cs.CV cs.CL

MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping

通过动态专家跳过加速混合专家多模态大语言模型

Yushi Huang, Zining Wang, Zhihang Yuan, Yifu Ding, Ruihao Gong, Jinyang Guo, Xianglong Liu, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Beihang University(北航) Peking University(北京大学)

AI总结 MoDES通过动态专家跳过机制提升多模态大语言模型的推理效率和准确性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08318 2026-02-24 cs.CV

LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation

LinVideo: 一种面向高效视频生成的O(n)注意力后训练框架

Yushi Huang, Xingtong Ge, Ruihao Gong, Chengtao Lv, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Beihang University(北航) Sensetime Research(商汤科技研究院) Nanyang Technological University(南洋理工大学)

AI总结 LinVideo提出一种高效的无数据后训练框架,通过选择性迁移将部分自注意力模块替换为线性注意力,从而在保持性能的同时显著提升视频生成效率。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04638 2026-02-24 cs.CV cs.AI

Learning Street View Representations with Spatiotemporal Contrast

利用时空对比学习街道视图表示

Yong Li, Yingjing Huang, Gengchen Mai, Fan Zhang

机构 * Institute of Remote Sensing and Geographic Information System, School of Earth and Space Sciences, Peking University(遥感与地理信息系统研究所,地球与空间科学学院,北京大学) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(土木与环境工程系,香港科学与技术大学) SEAI Lab, Department of Geography and the Environment, University of Texas at Austin(SEAI实验室,地理与环境系,德克萨斯大学奥斯汀分校)

AI总结 本文提出一种基于时空对比学习的街道视图表示学习方法,以提升城市环境相关下游任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00339 2026-02-24 cs.CL cs.LG

GRASP: Replace Redundant Layers with Adaptive Singular Parameters for Efficient Model Compression

GRASP: 用自适应奇异参数替代冗余层以实现高效模型压缩

Kainan Liu, Yong Zhang, Ning Cheng, Zhitao Li, Shaojun Wang, Jing Xiao

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

AI总结 GRASP通过自适应奇异参数替代冗余层,实现高效模型压缩并保持高性能。

Comments EMNLP 2025(Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18551 2026-02-24 physics.chem-ph cs.AI

From Static Spectra to Operando Infrared Dynamics: Physics Informed Flow Modeling and a Benchmark

从静态光谱到原位红外动力学:物理指导的流模型与基准

Shuquan Ye, Ben Fei, Hongbin Xu, Jiaying Lin, Wanli Ouyang

机构 * Department of Information Engineering, The Chinese University of Hong Kong(香港中文大学信息工程系) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学计算机科学与工程系) Department of Computer Science(计算机科学系) Engineering, The Hong Kong University of Science(工程,香港科学大学) Shenzhen Loop Area Institute(深圳河套学院) Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出ABCC模型,通过物理指导的流模型预测原位红外光谱动态,实现对SEI形成路径的可解释恢复,提升电化学研究效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00553 2026-02-24 cs.LG cs.AI

On Predictability of Reinforcement Learning Dynamics for Large Language Models

关于大型语言模型强化学习动态的可预测性

Yuchen Cai, Ding Cao, Xin Xu, Zijun Yao, Yuqing Huang, Zhenyu Tan, Benyi Zhang, Guangzhong Sun, Guiquan Liu, Junfeng Fang

机构 * USTC(中国科学技术大学) NUS(新加坡国立大学) HKUST(香港科技大学)

AI总结 本研究发现大型语言模型强化学习动态的两个基本特性,并提出AlphaRL框架实现加速训练,保留高推理性能。

Comments 48 pages, 28 figures;

详情

展开后加载摘要…

URL PDF HTML 收藏