arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

2026-08-10 至 2026-08-10 共收录 6
2608.07333 2026-08-10 cs.LG 新提交

When GNNs Fail: Quantifying and Overcoming Temporal Correlation Volatility in Time Series

当GNN失效:量化与克服时间序列中的时间相关性波动性

Chen Shao, Yue Wang, Zhenyi Zhu, Zhanbo Huang, Tobias Käfer, Zonghan Wu, Danai Koutra

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) The Hong Kong University of Science and Technology(香港科技大学) East China Normal University(华东师范大学) University of Michigan(密歇根大学)

AI总结 本研究提出时间相关性波动性(TCV)指标,发现高TCV下GNN等模型泛化差,进而提出GLIDE层,在合成与真实基准上使平均性能最高提升45.6%。

Comments 6 figures, 3 tables, 16 pages

Journal ref European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07302 2026-08-10 cs.CV cs.AI 新提交

Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination

相同注意力,不同真相:在视觉注意力上应用Logit-Lens检测并缓解LVLM的物体幻觉

Zichuan Wang, Songlin Yang, Bo Peng, Zhenchen Tang, Yang Li, Beibei Dong, Jing Dong

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) Hong Kong University of Science and Technology(香港科技大学)

AI总结 该研究针对LVLM的物体幻觉问题,通过Logit Lens分析视觉注意力,揭示两种幻觉机制,提出无需训练的Detect-Mitigate框架,在多个基准上实现最优结果。

Comments CVPR2026 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06994 2026-08-10 cs.RO cs.AI 新提交

Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models

将意图与轨迹解耦:面向世界动作模型的表示演绎框架

Xiangkai Ma, Yue Ma, Junjie Wang, Sheng Xu, Mingyang Li, Han Zhang, Yuzheng Zhuang, Wenzhong Li, Zhihao Yuan

机构 * NJU(南京大学) HKUST(香港科技大学) CUHK-SZ(香港中文大学(深圳)) THU(清华大学) Joy Future Academy, JD(京东探索研究院)

AI总结 针对现有世界动作模型的表示纠缠问题,提出PILOT的表示演绎框架,解耦运动语义与轨迹细节,提升复杂机器人操纵任务的性能与可解释性,兼具少样本微调及架构迁移的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06967 2026-08-10 cs.CL 新提交

Can Language Models Imagine Without Seeing? Ekphrasis: Measuring Visual Creative Ideation in Text-Only LLMs

语言模型无需视觉输入即可进行想象?Ekphrasis:测量仅文本大型语言模型的视觉创意构想能力

Hongyu Luo, He Wang, Huihao Jing, Hong Ting Tsang, Yuxuan Liu, Wuganjing Song, Yauwai Yim, Chunyang Li, Yangqiu Song

机构 * The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本研究推出基准Ekphrasis,测量仅文本大型语言模型的视觉创意构想能力,发现该能力与流畅度分离,且其排序可跨模态稳定存在。

Comments 25 pages, 4 main figures, with appendices. Code and data: https://github.com/Imhongyu/Ekphrasis

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06916 2026-08-10 cs.LG 新提交

MiCoPro: End-to-End Mixed Precision HW/SW Co-design with HW-aware Proxy Model

MiCoPro:面向硬件感知代理模型的端到端混合精度硬件/软件协同设计

Zijun Jiang, Yangdi Lyu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 MiCoPro是面向边缘AI的混合精度硬件/软件协同设计框架,通过硬件感知代理模型实现延迟约束下的最优量化配置,在两类硬件上达成最高40%延迟降低、精度下降不足3%的效果。

Comments 14 pages, 9 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06799 2026-08-10 cs.RO cs.CV 新提交

Is Forward Prediction Enough? Physical State Grounding for JEPA World Models

前向预测足够吗?面向JEPA世界模型的物理状态 grounding

Haodong Yan, Jiaguan Zhu, Mingyuan Jia, Ruiqing Yin, Junjie He, Zhide Zhong, Junfeng Li, Jinxuan Lu, Hengtao Li, Tianran Zhang, Jiayi Chen, Wenxuan Song, Wen Chen, Yuxiang Gao, Haoang Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) COCO Matrix

AI总结 针对JEPA世界模型前向预测未明确物理状态可识别性的问题,提出PSG-JEPA模型,通过训练阶段的两个grounding目标提升性能,在三个评估层面均优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏