arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 1511
2604.16325 2026-06-30 cs.LG cs.AI

UniMamba: A Unified Spatial-Temporal Modeling Framework with State-Space and Attention Integration

UniMamba:一种集成状态空间与注意力机制的时空建模框架

Xingsheng Chen, Xianpei Mu, Deyu Yi, Yilin Yuan, Xingwei He, Bo Gao, Regina Zhang, Pietro Lio, Siu-Ming Yiu

机构 * School of Computing and Data Science, The University of Hong Kong, Hong Kong, China(计算与数据科学学院,香港大学,香港,中国) School of Information Engineering, Beijing Institute of Graphic Communication, Beijing, China(信息工程学院,北京印刷学院,北京,中国) Innovation Engineering College, Macau University of Science(创新工程学院,澳门科学技术大学) Department of Computer Science and Technology, University of Cambridge, Cambridge, UK(计算机科学与技术系,剑桥大学,剑桥,英国)

AI总结 UniMamba整合了高效的状态空间动态与注意力依赖学习,通过Mamba变体通道编码层和时空注意力层,提升多变量时间序列预测的准确性和效率。

Comments The authors wish to withdraw this preprint due to a lack of consensus regarding the final authorship list and the order of authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23292 2026-06-30 cs.AI cs.CL

Learning How to Use Tools, Not Just When: Pattern-Aware Tool-Integrated Reasoning

学习如何使用工具,而非仅仅何时:基于模式的工具集成推理

Ningning Xu, Yuxuan Jiang, Shubhashis Roy Dipta, Hengyuan Zhang

机构 * University of Georgia(佐治亚大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩分校) The University of Hong Kong(香港大学)

AI总结 本文提出一种两阶段框架,通过构建代码能力并对齐模式选择与教师偏好,提升工具集成推理的代码使用和准确性,实验显示在数学数据集上显著提升。

Journal ref The 5th Workshop on Mathematical Reasoning and AI at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12784 2026-06-30 cs.CV cs.CL

SRUM: Fine-Grained Self-Rewarding for Unified Multimodal Models

SRUM:细粒度自奖励用于统一多模态模型

Weiyang Jin, Yuwei Niu, Jiaqi Liao, Chengqi Duan, Aoxue Li, Shenghua Gao, Xihui Liu

机构 * HKU MMLab(香港大学多媒体实验室) The University of Hong Kong(香港大学) Peking University(北京大学) Noah’s Ark Lab, Huawei(华为诺亚方舟实验室) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 SRUM通过内部评估模块对生成模块进行自奖励,提升统一多模态模型的视觉生成能力,实验证明在T2I-CompBench和T2I-ReasonBench上性能显著提升。

Comments Accepted to ECCV 2026. 20 pages, 8 figures, webpage can be seen in https://waynejin0918.github.io/srum_web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18060 2026-06-30 cs.CV

Semantic Correspondence: Unified Benchmarking and a Strong Baseline

语义对应:统一的基准测试与强大的基线

Kaiyan Zhang, Xinghui Li, Jingyi Lu, Kai Han

机构 * The University of Hong Kong(香港大学)

AI总结 本文首次全面调研语义对应方法,提出分类体系并汇总多基准结果,提出高性能基线,为未来研究奠定基础。

Comments accepted by TPAMI 2025

Journal ref IEEE Trans. Pattern Anal. Mach. Intell. 48, no. 3 (2026) 3911-3930

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17559 2026-06-30 cs.AI cs.GT

GraphChase: A Platform and Benchmark for Urban Network Security Games

GraphChase:城市网络安全博弈的平台与基准

Shuxin Zhuang, Shuxin Li, Tianji Yang, Muheng Li, Xianjie Shi, Bo An, Youzhi Zhang

机构 * City University of Hong Kong(香港城市大学) CAIR, Hong Kong Institute of Science & Innovation, CAS(中国科学院香港创新研究院人工智能与机器人创新中心) Nanyang Technological University(南洋理工大学) Georgia Institute of Technology(佐治亚理工学院) University of Toronto(多伦多大学) The University of Hong Kong(香港大学)

AI总结 GraphChase为城市网络安全博弈提供统一平台,支持算法开发与评估,揭示现有方法在鲁棒性和可扩展性上的不足,强调仿真到现实的泛化差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00742 2026-06-30 cs.CR cs.LG stat.ML

Federated Graph Learning for EV Charging Demand Forecasting with Personalization Against Cyberattacks

联邦图学习在对抗网络攻击中的电动汽车充电需求预测与个性化

Yi Li, Renyou Xie, Chaojie Li, Yi Wang, Zhaoyang Dong

机构 * College of Electronic and Information Engineering, Southwest University(西南大学电子信息工程学院) School of Electrical Engineering and Telecommunications, the University of New South Wales(新南威尔士大学电气工程与电信学院) Department of Electrical Engineering, City University of Hong Kong(香港城市大学电气工程系) Department of Electrical and Electronic Engineering, the University of Hong Kong(香港大学电气与电子工程系)

AI总结 本文提出联邦图学习方法,通过捕捉不同站点的空间相关性,提升电动汽车充电需求预测的鲁棒性,以应对网络攻击带来的数据异质性问题。

Comments 19 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28133 2026-06-29 cs.RO cs.CV 新提交

Translation as a Bridging Action: Transferring Manipulation Skills from Humans to Robots

翻译作为桥接动作:将操作技能从人类迁移到机器人

Sijin Chen, Kaixuan Jiang, Haixin Shi, Yanhui Wang, Weiheng Zhong, Haosheng Li, Bo Jiang, Yuxiao Liu, Xihui Liu

机构 * HKU-MMLab(香港大学多媒体实验室) ByteDance Seed(字节跳动Seed)

AI总结 提出以相对手腕平移作为桥接动作表示,结合π₀类视觉-语言-动作模型,从人类数据中迁移操作技能到双臂平行夹爪机器人,有效提升迁移效果并随数据量扩展。

Comments Project Page: https://translation-as-a-bridging-action.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27696 2026-06-29 cs.LG cs.AI cs.CV 新提交

Class-frequency Guided Noise Schedule for Diffusion Models

面向扩散模型的类别频率引导噪声调度

Jiequan Cui, Beier Zhu, Qingshan Xu, Xiaojuan Qi, Bei Yu, Hanwang Zhang

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学)

AI总结 针对低频类别在扩散模型中因低密度区域导致评分估计不准和生成质量差的问题,提出类别频率引导的噪声调度(CFRG),为低频类别分配更大尺度噪声,在CIFAR-100-LT和ImageNet-LT上显著提升生成质量。

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27676 2026-06-29 cs.RO 新提交

CWI: Composite Humanoid Whole-Body Imitation System for Loco-manipulation

CWI: 复合型人形机器人全身模仿系统用于移动操作

Wenqi Ge, Junde Guo, Zhen Fu, Shunpeng Yang, Jiayu Chen, Hua Chen

机构 * LimX Dynamics The University of Hong Kong(香港大学) School of Automation and Intelligent Manufacturing, Southern University of Science and Technology(南方科技大学自动化与智能制造学院) Hong Kong University of Science and Technology(香港科技大学) ZJU-UIUC Institute, Zhejiang University(浙江大学伊利诺伊大学厄巴纳香槟校区联合学院)

AI总结 提出CWI框架,通过解耦上下半身动作捕捉数据,结合对抗性运动先验和多评论家架构,实现人形机器人稳定移动与灵巧操作的全身协调控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21970 2026-06-29 cs.RO 版本更新

StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision

StereoVLA:利用立体视觉增强视觉-语言-动作模型

Shengliang Deng, Mi Yan, Yixin Zheng, Jiayi Su, Wenhao Zhang, Yitao Zeng, Xiaoguang Zhao, Heming Cui, Zhizheng Zhang, He Wang

机构 * Galbot CFCS, School of CS, Peking University(北京大学计算机学院CFCS) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) The University of Hong Kong(香港大学) Xiamen University Malaysia(厦门大学马来西亚分校) Southern University of Science and Technology(南方科技大学)

AI总结 提出StereoVLA,首个利用大规模合成立体数据引入丰富几何线索的VLA模型,通过几何与语义联合编码和协同训练目标,在真实实验中成功率绝对提升33.4%,并展现出对近半球视角的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27277 2026-06-26 cs.AI cs.CV 新提交

EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting

EO-WM: 一种用于概率性地球观测预测的物理信息世界模型

Junwei Luo, Shuai Yuan, Zhenya Yang, Yansheng Li, Zhe Liu, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Wuhan University(武汉大学)

AI总结 提出EO-WM,一种视频扩散变换器,通过物理信息条件框架(气候基线、天气异常和累积应力)实现多光谱地球观测的概率性预测,在极端天气和季节匹配基准上优于现有方法。

Comments 28 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26928 2026-06-26 cs.RO cs.SI 新提交

UAV-MapFusion: RTK-Aligned Uncertainty-Aware Coarse-to-Fine Multi-Session UAV Mapping

UAV-MapFusion: RTK对齐的不确定性感知粗到细多会话无人机建图

Feng Pan, Chunran Zheng, Bing Xue, Yukang Cui, Jiayu Wen, Zhiyu Chen, Wei Wang

机构 * College of Automation, Harbin Engineering University(哈尔滨工程大学自动化学院) Department of Mechanical Engineering, University of Hong Kong(香港大学机械工程系) College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院)

AI总结 提出一种不确定性感知的多会话点云地图合并与粗到细优化系统,通过RTK时空对齐和迭代平面因子优化,在抑制长距离漂移的同时保持局部几何精度。

Comments 8 pages, 5 figures, accepted by IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26800 2026-06-26 cs.RO 新提交

SSI-Policy: Learning Structured Scene Interfaces for Vision-Language Robotic Manipulation

SSI-Policy: 学习用于视觉语言机器人操作的结构化场景接口

Kaijun Wang, Zikai Ouyang, Xuping Wu, Jinyi Hong, Wei Pan, Haibo Lu, Jia Pan, Wei Zhang, Linfang Zheng

机构 * Southern University of Science and Technology(南方科技大学) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学) LimX Dynamics

AI总结 提出SSI-Policy框架,通过统一的结构化场景接口(SSI)联合编码单目深度、语言锚定的物体布局和指令条件化的2D运动轨迹,实现从少量演示中学习机器人操作,在LIBERO基准上仅用10个演示即提升15%性能。

Comments Accepted by 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26201 2026-06-26 cs.RO 新提交

OmniContact: Chaining Meta-Skills via Contact Flow for Generalizable Humanoid Loco-Manipulation

OmniContact: 通过接触流链接元技能实现可泛化的人形移动操作

Runyi Yu, Xiaoyi Lin, Ji Ma, Yinhuai Wang, Koukou Luo, Jiahao Ji, Huayi Wang, Wenjia Wang, Runhan Zhang, Ping Tan, Ting Wu, Ruoli Dai, Qifeng Chen, Lei Han

机构 * Noitom Robotics(诺亦腾机器人) The Hong Kong University of Science and Technology(香港科技大学) Wuhan University(武汉大学) The University of Hong Kong(香港大学)

AI总结 提出以接触流为核心的分层框架,通过低层策略学习统一技能库、高层模块合成未来接触流序列,实现人形机器人长时程任务的鲁棒执行与自主恢复,在搬运箱子和推叠箱子任务上分别达到98.7%和76.5%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25534 2026-06-25 cs.CV 新提交

PatchINR: Patch-Based Implicit Neural Representations for Efficient and Scalable Inference

PatchINR: 基于块的隐式神经表示实现高效可扩展推理

Jiachen Ren, Wenyong Zhou, Taiqiang Wu, Yuxin Cheng, Xincheng Feng, Zhengwu Liu, Ngai Wong

机构 * The Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong.(香港大学电子与计算机工程系)

AI总结 提出基于块的隐式神经表示方法,以非重叠块为处理单元单次预测整块像素,减少推理查询次数,结合FPGA硬件加速实现75%推理延迟降低且参数仅增0.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25503 2026-06-25 cs.RO cs.CV 新提交

AISPO: Enhancing Depth Reliability for Robotic Manipulation of Non-Lambertian Objects via Affine-Invariant Shape Prior

AISPO: 通过仿射不变形状先验增强非朗伯体物体机器人操作的深度可靠性

Zhiming Chen, Linfang Zheng, Kun Zhang, Hyung Jin Chang, Wei Zhang, Hongyu Yu, Hua Chen

机构 * The Hong Kong University of Science & Technology(香港科技大学) The University of Hong Kong(香港大学) Southern University of Science & Technology(南方科技大学) Zhejiang University(浙江大学) LimX Dynamics

AI总结 提出AISPO深度补全框架,结合多尺度RGB-D特征融合与仿射不变形状先验,提升非朗伯体物体(如透明、高反光表面)的深度可靠性,显著提高机器人抓取成功率。

Comments Published in IEEE Robotics and Automation Letters. 8 pages. Accepted April 2026

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 7996-8003, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19190 2026-06-25 cs.RO 新提交

FAST-LIVGO: A Degeneracy-Robust LiDAR-Inertial-Visual-GNSS Fusion Odometry

FAST-LIVGO:一种退化鲁棒的LiDAR-惯性-视觉-GNSS融合里程计

Zhiyu Chen, Chunran Zheng, Jiayu Wen, XiaoLei Zhang, Jiaming Xu, Feng Pan, Yukang Cui

机构 * College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院) Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系) College of Automation, Harbin Engineering University(哈尔滨工程大学自动化学院)

AI总结 提出一种基于误差状态迭代卡尔曼滤波的紧耦合LiDAR-惯性-视觉-GNSS融合框架,通过动态时间规整的时空对齐模块、多普勒和时差载波相位观测模型以及退化感知的双模式异常值拒绝策略,在长期大尺度动态环境中实现高精度鲁棒的状态估计。

Comments Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20183 2026-06-25 cs.CV 版本更新

MSAVBench: Towards Comprehensive and Reliable Evaluation of Multi-Shot Audio-Video Generation

MSAVBench:面向多镜头音频-视频生成的全面可靠评估

Yujie Wei, Yujin Han, Zhekai Chen, Yongming Li, Kaixun Jiang, Zhihang Liu, Quanhao Li, Zhiwu Qing, Xiang Wang, Zhen Xing, Ruihang Chu, Lingyi Hong, Yefei He, Junjie Zhou, Junqiu Yu, Yang Shi, Difan Zou, Kai Zhu, Shiwei Zhang, Yingya Zhang, Yu Liu, Xihui Liu, Hongming Shan

机构 * Fudan University(复旦大学) The University of Hong Kong(香港大学) Tongyi Lab, Alibaba Group(阿里集团通义实验室) Zhejiang University(浙江大学) Peking University(北京大学)

AI总结 提出首个多镜头音频-视频生成基准MSAVBench,通过自适应混合评估框架在四个维度上系统评估19个模型,发现当前系统在导演级控制和细粒度音视频同步上仍存在挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22822 2026-06-25 cs.AI cs.LG 版本更新

FlexMS: A Unified Public Benchmark for Molecule Tandem Mass Spectrum Prediction

FlexMS:分子串联质谱预测的统一公共基准

Yunhua Zhong, Yixuan Tang, Yifan Li, Pan Liu, Zhiwen Yang, Zanyi Wang, Jie Yang, Jun Xia

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学) Yangzhou University(扬州大学) Fudan University(复旦大学)

AI总结 提出FlexMS基准框架,通过标准化预处理、元数据条件和评估协议,实现跨公共资源的公平比较,并引入难度感知诊断指导模型选择。

Comments preprint version v4

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17796 2026-06-25 cs.CV cs.AI 版本更新

CustomX: Unified Character, Action, and Scene Customization in Video World Models

CustomX: 视频世界模型中的统一角色、动作与场景定制

Yitong Wang, Fangyun Wei, Hongyang Zhang, Bo Dai, Yan Lu

机构 * Fudan University(复旦大学) Microsoft Research(微软研究院) University of Waterloo(滑铁卢大学) The University of Hong Kong(香港大学)

AI总结 提出CustomX,结合静态世界生成与可控实体模型,支持用户指定角色在3D场景中执行开放动作,通过条件自回归视频生成保持视觉保真度。

Comments Accepted to ECCV 2026. Project page: https://snowflakewang.github.io/CustomX_Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24849 2026-06-24 cs.CV cs.AI 新提交

IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation

IV-CoT: 面向结构感知文本到图像生成的隐式视觉思维链

Zixuan Li, Haokun Lin, Yicheng Xiao, Zhiwei Li, Xinyang Song, Zelong Zheng, Yong He, Heng Yao, Ke Ding, Chao Yu, Chuan Yuan, Qi Li, Zhenan Sun

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) Ant Group(蚂蚁集团) The University of Hong Kong(香港大学)

AI总结 提出隐式视觉思维链(IV-CoT)框架,通过结构到语义的级联分解和训练时草图监督,在不增加推理开销的情况下提升文本到图像生成的结构感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24466 2026-06-24 cs.RO 新提交

FT-WBC: Learning Fault-Tolerant Whole-Body Control for Legged Loco-Manipulation

FT-WBC:学习腿式操作任务的容错全身控制

Yudong Zhong, Pengfei Mai, Sikai Guo, Jiahang Cao, Zhihai Bi, Qiuyue Liu, Ziyan Feng, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学)

AI总结 针对腿式机械臂在致动器故障下易失稳的问题,提出FT-WBC框架,通过故障估计器和姿态适应模块实现容错全身控制,提升生存率和操作空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24231 2026-06-24 cs.AI 新提交

FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning

FlowR2A: 学习奖励到动作分布用于多模态驾驶规划

Xirui Li, Zhe Liu, Xiaoqing Ye, Wenhua Han, Yifeng Pan, Junyu Han, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Changan Automobile(长安汽车)

AI总结 提出FlowR2A,通过流匹配解码器学习奖励条件动作分布,统一了基于评分和基于锚点的方法,实现密集监督与动态生成,在NAVSIM基准上取得最优结果。

Comments Project page: https://lixirui142.github.io/flowr2a-ad

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24225 2026-06-24 cs.CV 新提交

Geometry-Instructed Video Editing

几何指导的视频编辑

Chirui Chang, Xiaoyang Lyu, Yi-Hua Huang, Haoru Tan, Shizhen Zhao, Yikang Ding, Jianmin Bao, Xin Tao, Pengfei Wan, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Kuaishou Technology(快手科技)

AI总结 提出GIVE框架,通过深度框和方向框统一描述对象状态变化,实现物体级几何编辑(平移、旋转、缩放等),并保持阴影等二次效果一致,在合成和真实视频上展现良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23848 2026-06-24 cs.RO 新提交

Enforcing Human-like Kinematics in Dexterous Piano Playing via Adversarial Posture Regularization

通过对抗姿态正则化在灵巧钢琴演奏中强制执行类人运动学

Bin Qiu, Yanming Shao, Guanyu Cai, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 提出对抗姿态正则化(APR)方法,利用少量非对齐的人类演奏数据,通过对抗目标匹配策略姿态分布与人类先验,使高自由度灵巧手在物理仿真中弹钢琴时呈现更自然的姿势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00814 2026-06-24 cs.RO 版本更新

RTFF: Random-to-Target Fabric Flattening Policy using Dual-Arm Manipulator

RTFF:使用双臂机械手的随机到目标织物展平策略

Kai Tang, Dipankar Bhattacharya, Hang Xu, Fuyuki Tokuda, Norman C. Tien, Kazuhiro Kosuge

机构 * Department of Electrical and Electronic Engineering, Faculty of Engineering, The University of Hong Kong(香港大学电子与电气工程系) Dyson School of Design Engineering, Imperial College London(帝国理工学院设计工程学院) Unprecedented-scale Data Analytics Center, Tohoku University(东北大学大规模数据分析中心) Graduate School of Information Sciences, Tohoku University(东北大学信息科学研究生院) Department of Mechanical Engineering, City University of Hong Kong(香港城市大学机械工程系)

AI总结 提出随机到目标织物展平任务,通过模板网格对齐和混合模仿学习-视觉伺服策略,实现双臂机器人对任意目标姿态的织物展平与对齐。

Comments 8 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20678 2026-06-23 stat.ML cs.LG stat.ME 新提交

Beyond Importance: Interchange-Sobol Sensitivity Reveals Task-Specific Content Channels in Transformer Components

超越重要性:互换-Sobol灵敏度揭示Transformer组件中的任务特定内容通道

Yifeng Guo, Jin-Hong Du, Xiang Chen

机构 * St. Jude Children’s Research Hospital(圣犹大儿童研究医院) The University of Hong Kong(香港大学)

AI总结 提出互换组Sobol分解(IGSD),通过配对干预区分组件的内容传输与计算退化角色,在事实回忆任务中发现标准方法低估的早期层内容通道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23449 2026-06-23 cs.AI cs.OS 新提交

AOHP: An Open-Source OS-Level Agent Harness for Personalized, Efficient and Secure Interaction

AOHP:一个用于个性化、高效和安全交互的开源操作系统级Agent框架

Shanhui Zhao, Jiacheng Liu, Guohong Liu, Jichao Yan, Jialei Ye, Yuhao Yang, Hao Wen, Shizuo Tian, Yizhen Yuan, Yuxuan Chen, Yunxin Liu, Ju Ren, Ya-Qin Zhang, Chao Huang, Yao Guo, Yuanchun Li

机构 * Tsinghua University(清华大学) Peking University(北京大学) The University of Hong Kong(香港大学)

AI总结 提出AOHP,一个基于AOSP的操作系统级Agent框架,通过将Agent视为一等OS参与者,实现个性化服务组合、高效Agent接口和安全信息流,在任务完成率、令牌成本和策略合规性上优于现有系统。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22977 2026-06-23 cs.CL cs.AI 新提交

StatABench: Dataset and Framework for Evaluating Statistical Analysis Capabilities of LLMs

StatABench:评估大语言模型统计分析能力的数据集与框架

Youxin Zhu, Yixuan Ding, Peng Lai, Longyue Wang, Bingyi Jing, Guanhua Chen

机构 * Southern University of Science and Technology(南方科技大学) Alibaba Group(阿里巴巴集团) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) The University of Hong Kong(香港大学)

AI总结 提出StatABench基准,包含404道封闭题和30道开放建模任务,评估LLM在统计分析上的能力,实验显示最佳模型仅达68.6%准确率,揭示工具推理和建模决策等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22353 2026-06-23 cs.CV 新提交

Interest Entanglement: The Hidden Barrier to Blind Super-Resolution Optimization

兴趣纠缠:盲超分辨率优化的隐藏障碍

Junxiong Lin, Xinji Mai, Qianyu Guo, Haoran Wang, Zeng Tao, Xuan Tong, Ivy Pan, Wenqiang Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) The University of Hong Kong(香港大学) Shanghai Institute of Virology, Shanghai Jiao Tong University School of Medicine(上海病毒研究所,同济大学医学院)

AI总结 针对图像超分辨率中保真度与感知质量冲突的问题,提出基于共享特征表示的超分辨率框架(SFR),通过解耦不同优化目标的学习过程并引入InfoSqueeze模块,实现两者有效平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏