arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

2026-08-04 至 2026-08-04 共收录 12
2608.02603 2026-08-04 cs.CV 新提交

WorldExam: Benchmarking World Models from Apparent Appearance to Inherent Reactivity

WorldExam:从表观外观到内在反应性对世界模型进行基准测试

Yuxue Yang, Shuyao Shang, Jiahe Wang, Zitong Zhou, Liang Tan, Junhan Zeng, Ruizhi Li, Junyan Li, Yu Liu, Xiao Yang, Yong Li, Jun Zhu, Hongsheng Li, Tieniu Tan, Lue Fan, Zhaoxiang Zhang

机构 * CASIA(中国科学院自动化研究所) SLAI(智能科学与技术实验室) CUHK(香港中文大学) AMAP(中国农业科学院) THU(清华大学)

AI总结 该研究推出WorldExam基准,评估20个模型在视觉质量等四层级的表现,发现不同驱动模型能力有明显分化,无模型兼具广泛任务覆盖与稳定性能,高视觉质量不代表内在反应性强。

Comments Project Website: https://WorldExam.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02016 2026-08-04 cs.CV 新提交

Beyond Global Latents: Chunk-Based Sparse Grid VAE for Scalable 3D Modeling

超越全局隐变量:面向可扩展3D建模的基于块的稀疏网格变分自编码器

Kaiyi Zhang, Zhihao Liang, Haolin Liu, Qingxiang Lin, Zeqiang Lai, Yunfei Zhao, Bowen Zhang, Xianghui Yang, Zibo Zhao, Chunchao Guo, Long Quan

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent Hunyuan(腾讯混元) The Chinese University of Hong Kong(香港中文大学)

AI总结 该研究针对稀疏体素网格内存随分辨率快速增长的问题,提出基于块的ChunkVAE,通过局部算子和互补数据算子实现可扩展3D建模,在多基准测试中性能优于或相当基线,且内存与推理效率更优。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01985 2026-08-04 cs.CV 新提交

DiffPrune: differentiable information throttling for token pruning in vision-language models

DiffPrune:用于视觉-语言模型中 token 剪枝的可微信息节流方法

Landi He, Mingde Yao, Shawn Young, Lijian Xu

机构 * Shenzhen University of Advanced Technology(深圳先进技术大学) CUHK MMLab, CPII under InnoHK(香港中文大学MMLab,InnoHK下属CPII)

AI总结 DiffPrune 是一种用于视觉-语言模型的可微 token 剪枝方法,通过信息节流器避免松弛选择的不稳定性,在保留 96.5% 准确率的同时实现 2.85 倍 LLM 预填充加速,推理开销仅 0.69 毫秒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01684 2026-08-04 cs.AI 新提交

GABench: A Comprehensive Benchmark for Evaluating LLM Agents on Graph Analysis Tasks

GABench:用于评估大语言模型智能体图分析任务的综合基准

Jiarui Tan, Zhongjian Zhang, YaBo Guo, Jiawei Liu, Yujie Xing, Muhan Zhang, Cheng Yang, Chuan Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学)

AI总结 本文提出GABench这一综合基准,涵盖多类图类型与任务及84个可执行工具,构建10400个带可验证答案的任务,评估前沿LLM及智能体框架,发现现有智能体应对复杂图任务仍存局限等结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01678 2026-08-04 cs.LG cs.CL 新提交

Progressive Agent Skill Generation via Reinforcement Learning

基于强化学习的智能体技能渐进式生成

Junhao Shen, Zhanqiu Zhang, Yiwen Guo, Hong Cheng

机构 * The Chinese University of Hong Kong(香港中文大学) LIGHTSPEED(光速公司)

AI总结 该研究针对现有技能生成方法的缺陷,提出基于强化学习的Skill-α方法,将技能生成为序列编辑过程并引入回退奖励,在CL-Bench和tau2-bench上均显著提升了下游任务成功率。

Comments Code is available at https://github.com/ejhshen/skill-alpha

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01676 2026-08-04 cs.CL cs.LG 新提交

Understanding Sparse Attention Selectivity in Long-Context Foundation Models via Counterfactual Evaluation

通过反事实评估理解长上下文基础模型中的稀疏注意力选择性

Xingyu Ren, Youran Sun, Chugang Yi, Haizhao Yang

机构 * The Chinese University of Hong Kong(香港中文大学) University of Maryland(马里兰大学)

AI总结 该研究通过反事实评估探究长上下文基础模型的稀疏注意力选择性,证实稀疏化会改变内容影响力,提出开放测量框架,相关结果无法通过聚合准确率检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01565 2026-08-04 cs.CL 新提交

DocNavRAG: Document-Structured Graph RAG with Stateful Evidence Construction for Complex Document Question Answering

DocNavRAG:面向复杂文档问答的、具有状态化证据构建能力的文档结构化图RAG

Dongyang Xie, Yao Tian, Hao Zhang, Yifei Yuan, Tieyun Qian, Ming Zhong, Jiawei Jiang, Yuanyuan Zhu

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) ETH Zurich(苏黎世联邦理工学院)

AI总结 本文提出DocNavRAG,将文档结构组织为可导航图并维护证据状态,在四个文档QA基准上,相比最强基线平均提升答案质量7.8%、上下文充分性17.7%。

Comments 19 pages, 5 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01130 2026-08-04 cs.LG 新提交

When Do Surrogate Updates Improve Decisions? A Local Theory of Trajectory-Wise Transfer

替代更新何时能改进决策?轨迹式迁移的局部理论

Yuyang Shen

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 该研究提出轨迹式迁移的局部理论,探究替代更新改进决策的条件,推导相关梯度、校准等理论结果,通过网格世界和LLM后训练实验验证结论。

Comments 22 pages in total, including references and appendices; 3 composite figures (9 panels) and 4 tables. Code is available at https://github.com/Ethan-Shen-Individual-Lab/surrogate-to-decision-transfer

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00800 2026-08-04 cs.CV 新提交

AIMold: An Autonomous AI-based Pipeline for Complex Mold Design

AIMold:一种用于复杂模具设计的自主AI驱动流水线

Pengyun Qiu, Shuo Wang, Zeyuan Chen, Yihao Zhi, Chongjie Ye, Xiaoguang Han

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院) Guangdong Provincial Key Laboratory of Future Networks of Intelligence(广东省未来网络智能重点实验室) FNii-Shenzhen(深圳未来网络研究院)

AI总结 研究针对复杂模具设计依赖专家知识、缺乏公开数据集的问题,推出含超2.3万个模型的MoldCAD数据集,提出AI流水线实现模具设计自动化,助力制造感知型CAD生成。

Comments Accepted to ECCV 2026. Code is available at https://github.com/tb2-sy/AIMold

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00721 2026-08-04 cs.RO 新提交

OmniAI: A Surface-Adaptive Aerial Projection Interface for Human--Drone Interaction

OmniAI:一种面向人机交互的表面自适应空中投影界面

Nikita Kuzmin, Yuhua Jin, Georgii Demianchuk, Mariya Lezina, Fawad Mehboob, Ivan Valuev, Nikolai Lutsenko, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究院) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院)

AI总结 OmniAI是一种具现化空中智能体,通过自适应投影实现人机交互,采用RGB-D与RANSAC检测投影表面,支持语音、手势控制,为情境感知人机交互提供移动空间AR界面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00415 2026-08-04 cs.CV cs.AI 新提交

Boosting Generalizable Depth Estimation in Endoscopy by Mixture of Lightweight Experts and Intrinsic Image Alignment

基于轻量级专家混合与本征图像对齐的内窥镜可泛化深度估计增强方法

Liangjing Shao, Beilei Cui, Yiming Huang, Changjing Liu, Hongliang Ren

机构 * The Chinese University of Hong Kong(香港中文大学) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 本文提出自监督框架EndoMINI,结合低秩专家混合与本征图像对齐,在多内窥镜数据集上实现了更优的可泛化深度估计性能。

Comments Accepted by MICCAI 2026 @ The Efficient Medical AI (EMA4MICCAI) Workshop (Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01069 2026-08-04 cs.LG math.PR stat.ML 新提交

Characterizing Bias in Post-Bandit Inference under Index Algorithms

索引算法下后-bandit推理中的偏差表征

Lisu Wang, Yilun Chen, Jiaqi Lu

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) School of Management and Economics, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)经管学院)

AI总结 该研究针对UCB1等稳定索引算法,推导后-bandit推理中样本均值偏差和Z统计量的精确表达式,揭示了有效探索率这一偏差起源,发现索引函数选择存在遗憾-偏差权衡,采用新颖经验流体近似开展分析。

详情

展开后加载摘要…

URL PDF HTML 收藏