arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2796
2512.06306 2026-03-09 cs.CV cs.AI

Exploiting Spatiotemporal Properties for Efficient Event-Driven Human Pose Estimation

利用时空特性实现高效事件驱动的人体姿态估计

Haoxian Zhou, Chuanzhi Xu, Langyi Chen, Pengfei Ye, Haodong Chen, Yuk Ying Chung, Qiang Qu

机构 * The University of Sydney(悉尼大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出利用事件流的时空特性,结合点云框架提升人体姿态估计性能,实验显示在DHP19数据集上平均MPJPE减少4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20739 2026-03-09 cs.RO cs.CV

Decision-Driven Semantic Object Exploration for Legged Robots via Confidence-Calibrated Perception and Topological Subgoal Selection

通过置信度校准感知与拓扑子目标选择实现决策驱动的语义对象探索

Guoyang Zhao, Yudong Li, Weiqing Qi, Kai Zhang, Bonan Liu, Kai Chen, Haoang Li, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou), China(机器人与自主系统方向,香港科技大学(广州)) Department of Mechanical and Energy Engineering, Southern University of Science and Technology, China(机械与能源工程系,南方科技大学)

AI总结 本文提出了一种基于视觉的决策驱动语义对象探索方法,通过置信度校准感知与拓扑子目标选择机制提升腿部机器人在开放环境中的探索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09864 2026-03-09 cs.CV

AuthFace: Towards Authentic Blind Face Restoration with Face-oriented Generative Diffusion Prior

AuthFace: 向真实盲脸修复迈进的面向面部生成扩散先验

Guoqiang Liang, Qingnan Fan, Bingtao Fu, Jinwei Chen, Hong Gu, Lin Wang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司) Nanyang Technological University(南洋理工大学)

AI总结 AuthFace通过面向面部的生成扩散先验和摄影引导标注,实现高质量盲脸修复,提升面部细节还原和减少关键区域伪影。

Comments ACM MM 25, Codes and datasets are available at https://github.com/EthanLiang99/AuthFace

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04290 2026-03-06 cs.CV cs.GR

Gaussian Wardrobe: Compositional 3D Gaussian Avatars for Free-Form Virtual Try-On

高斯服装:用于自由形式虚拟试穿的组合式3D高斯虚拟人物

Zhiyi Chen, Hsuan-I Ho, Tianjian Jiang, Jie Song, Manuel Kaufmann, Chen Guo

机构 * Department of Computer Science, ETH Zürich(苏黎世联邦理工学院计算机科学系) ETH AI Center, ETH Zürich(苏黎世联邦理工学院人工智能中心) HKUST(GZ)(香港科技大学(广州))

AI总结 Gaussian Wardrobe通过组合式3D高斯表示,实现从多视角视频中生成高保真虚拟人物,并支持自由形式服装的跨个体重用,提升虚拟试穿的实用性

Comments 3DV 2026, 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05232 2026-03-06 cs.LG

SlideSparse: Fast and Flexible (2N-2):2N Structured Sparsity

SlideSparse: 快速且灵活的(2N-2):2N结构稀疏

Hanyong Shao, Yingbo Hao, Ting Song, Yan Xia, Di Zhang, Shaohan Huang, Xun Wu, Songchen Xu, Le Xu, Li Dong, Zewen Chi, Yi Zou, Furu Wei

机构 * Peking University(北京大学) South China University of Technology(南方科技大学) Microsoft Research(微软研究院) Shanghai Jiao Tong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 SlideSparse通过滑动窗口分解和激活提升技术,在通用GPU上实现(2N-2):2N结构稀疏的高效加速,提升LLM推理效率的同时保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04945 2026-03-06 cs.CL

Federated Heterogeneous Language Model Optimization for Hybrid Automatic Speech Recognition

联邦异构语言模型优化用于混合自动语音识别

Mengze Hong, Yi Gu, Di Jiang, Hanlin Gu, Chen Jason Zhang, Lu Wang, Zhiyang Su

机构 * Hong Kong Polytechnic University(香港理工大学) Ant Group(蚂蚁集团) Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科学与技术大学) Shenzhen University(深圳大学)

AI总结 本文提出了一种联邦异构语言模型优化方法,通过遗传算法和强化学习实现高效合并,提升混合自动语音识别系统的性能和可扩展性。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04898 2026-03-06 cs.LG cs.NI

U-Parking: Distributed UWB-Assisted Autonomous Parking System with Robust Localization and Intelligent Planning

U-Parking:基于UWB的分布式自主泊车系统,具备稳健定位与智能规划

Yiang Wu, Qiong Wu, Pingyi Fan, Kezhi Wang, Wen Chen, Guoqiang Mao, Khaled B. Letaief

机构 * Jiangnan University(江南大学) Zhuhai Fudan Innovation Institute(珠海复旦创新研究院) Tsinghua University(清华大学) Brunel University of London(布鲁内尔大学) Shanghai Jiao Tong University(上海交通大学) Southeast University(东南大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 U-Parking通过整合大语言模型辅助规划、稳健定位与轨迹跟踪,实现具有挑战性的室内环境中的可靠自动化泊车。

Comments This paper has been accepted by infocom. The source code has been released at: https://github.com/qiongwu86/U-Parking

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04790 2026-03-06 cs.LG cs.RO

Diffusion Policy through Conditional Proximal Policy Optimization

通过条件近端策略优化实现扩散策略

Ben Liu, Shunpeng Yang, Hua Chen

机构 * Southern University of Science and Technology, Shenzhen, China(南方科技大学) Hong Kong University of Science and Technology, Hongkong, China(香港科技大学) Zhejiang University-University of Illinois Urbana-Champaign Institute, Haining, China(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所)

AI总结 本文提出了一种基于条件近端策略优化的高效方法,用于在在线强化学习中训练多模态扩散策略,解决了计算动作对数似然的难题,并在多个基准任务中取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02573 2026-03-06 cs.CV

Track4World: Feedforward World-centric Dense 3D Tracking of All Pixels

Track4World: 基于馈送的世界中心密集3D追踪所有像素

Jiahao Lu, Jiayi Xu, Wenbo Hu, Ruijie Zhu, Chengfeng Zhao, Sai-Kit Yeung, Ying Shan, Yuan Liu

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) ARC Lab, Tencent PCG Project(腾讯PCG项目ARC实验室)

AI总结 Track4World提出一种高效的世界中心坐标系下所有像素密集3D追踪方法,通过新颖的3D相关方案实现优于现有方法的2D/3D流估计和追踪性能。

Comments Project Page: https://jiah-cloud.github.io/Track4World.github.io/ Code: https://github.com/TencentARC/Track4World

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00405 2026-03-06 cs.CV cs.AI cs.RO

EgoTraj-Bench: Towards Robust Trajectory Prediction Under Ego-view Noisy Observations

EgoTraj-Bench: 向在第一人称视角噪声观测下实现稳健轨迹预测迈进

Jiayi Liu, Jiaming Zhou, Ke Ye, Kun-Yu Lin, Allan Wang, Junwei Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学) Miraikan – The National Museum of Emerging Science and Innovation(Miraikan——新兴科学与创新国家博物馆)

AI总结 EgoTraj-Bench通过引入BiFlow模型,解决第一人称视角噪声观测下的轨迹预测问题,实现更鲁棒的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19916 2026-03-06 cs.RO

GUIDE: A Diffusion-Based Autonomous Robot Exploration Framework Using Global Graph Inference

GUIDE: 一种基于扩散的自主机器人探索框架,使用全局图推断

Zijun Che, Yinghong Zhang, Shengyi Liang, Boyu Zhou, Jun Ma, Jinni Zhou

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Southern University of Science and Technology(南方科技大学)

AI总结 GUIDE通过结合全局图推断与扩散决策,提升机器人在复杂环境中的自主探索效率,实现更快的覆盖完成和更少的冗余运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01785 2026-03-06 cs.CL cs.AI cs.LG

MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining

MuRating: 一种用于多语言大语言模型预训练的高质量数据选择方法

Zhixun Chen, Ping Guo, Wenhan Han, Yifan Zhang, Binbin Liu, Haobin Lin, Fengze Liu, Yan Zhao, Bingni Zhang, Taifeng Wang, Yin Zheng, Trevor Cohn, Meng Fang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) ByteDance(字节跳动) Eindhoven University of Technology(埃因霍温理工大学) University of Melbourne(墨尔本大学) University of Liverpool(利物浦大学)

AI总结 MuRating通过多语言评估器选择高质量数据,提升多语言大语言模型的预训练效果。

Comments NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04289 2026-03-05 cs.LG cs.AI

IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning

IPD: 通过离线规划蒸馏提升序列策略

Yihao Qin, Yuanfei Wang, Hang Zhou, Peiran Liu, Hao Dong, Yiding Ji

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学)

AI总结 IPD通过引入离线规划蒸馏技术,提升离线强化学习中序列策略的决策稳定性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03839 2026-03-05 cs.CV

All-in-One Image Restoration via Causal-Deconfounding Wavelet-Disentangled Prompt Network

通过因果去混淆小波解耦提示网络实现一站式图像恢复

Bingnan Wang, Bin Qin, Jiangmeng Li, Fanjiang Xu, Fuchun Sun, Hui Xiong

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Software, Chinese Academy of Science(中国科学院软件研究所) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) National Research Center for Information Science and Technology (BNRist)(国家信息科学与技术研究中心(BNRist)) Artificial Intelligence Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向)

AI总结 本文提出CWP-Net,通过因果去混淆和小波解耦技术解决图像恢复中退化模式偏差和虚假相关性问题,提升恢复效果。

Comments Accepted by IEEE TIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03739 2026-03-05 cs.CV cs.AI

PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation

PROSPECT:通过语义-空间融合和潜在预测表示实现统一的流式视觉-语言导航

Zehua Fan, Wenqi Lyu, Wenxuan Song, Linge Zhao, Yifei Yang, Xi Wang, Junjie He, Lida Huang, Haiyan Liu, Bingchuan Sun, Guangjun Bao, Xuanyao Mao, Liang Xu, Yan Wang, Feng Gao

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) University of Adelaide(阿德莱德大学) Wuhan University(武汉大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Jiaotong University(北京交通大学) AIR Wuxi Innovation Center, Tsinghua University(清华大学无锡创新中心) Lenovo(联想集团)

AI总结 PROSPECT通过语义-空间融合和潜在预测表示,实现统一的流式视觉-语言导航,提升环境动态和空间结构的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04755 2026-03-05 cs.CL cs.AI

When Silence Is Golden: Can LLMs Learn to Abstain in Temporal QA and Beyond?

沉默即是黄金:大语言模型能否在时间问答中学会退避?

Xinyu Zhou, Chang Jin, Carsten Eickhoff, Zhijiang Guo, Seyed Ali Bahrainian

机构 * HKUST (GZ)(香港科技大学) Tongji University(同济大学) University of Tübingen(图宾根大学) HKUST(香港科技大学)

AI总结 本文探讨了如何通过强化学习训练大语言模型在时间问答中学会退避,发现RL在推理和可靠性方面优于SFT。

Comments Accepted to ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01317 2026-03-05 cs.LG cs.AI

Difficult Examples Hurt Unsupervised Contrastive Learning: A Theoretical Perspective

困难示例损害无监督对比学习:一种理论视角

Yi-Ge Zhang, Jingyi Cui, Qiran Li, Yisen Wang

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院人工智能国家重点实验室) School of Engineering, Hong Kong University of Science and Technology(香港科技大学工程学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 本文从理论角度探讨了困难示例对无监督对比学习的影响,发现移除困难示例可提升下游分类性能,并通过理论分析和实验证明了其有效性。

Comments Accepted to ICLR 2026 as an Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17505 2026-03-05 cs.CV cs.AI cs.CL

Catch Me If You Can Describe Me: Open-Vocabulary Camouflaged Instance Segmentation with Diffusion

捕捉我如果你能描述我:基于扩散的开放词汇伪装实例分割

Tuan-Anh Vu, Duc Thanh Nguyen, Qing Guo, Nhat Chung, Binh-Son Hua, Ivor W. Tsang, Sai-Kit Yeung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) CFAR & IHPC, A*STAR(CFAR与IHPC,A*STAR) Deakin University(德克萨斯大学) Nankai University(南开大学) National University of Singapore(新加坡国立大学) Trinity College Dublin(都柏林大学)

AI总结 本文提出基于扩散模型的开放词汇伪装实例分割方法,通过多尺度文本-视觉特征学习,提升伪装对象和新类别分割的性能。

Comments Accepted to IJCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02681 2026-03-04 cs.CV

VisionCreator: A Native Visual-Generation Agentic Model with Understanding, Thinking, Planning and Creation

VisionCreator: 一种具有理解、思考、规划和创作能力的原生视觉生成智能体模型

Jinxiang Lai, Zexin Lu, Jiajun He, Rongwei Quan, Wenzhe Zhao, Qinyu Yang, Qi Chen, Qin Lin, Chuyue Li, Tao Gao, Yuhao Shan, Shuai Shao, Song Guo, Qinglin Lu

机构 * Tencent Hunyuan(腾讯文言) Hong Kong University of Science and Technology(香港科技大学)

AI总结 VisionCreator是一种结合理解、思考、规划和创作能力的原生视觉生成智能体模型,通过创新方法提升复杂创作任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02602 2026-03-04 cs.RO

Wukong-Omni: Design, Modeling and Control of a Multi-mode Robot for Air, Land, and Underwater Exploration with All-in-One Propulsion Unit

Wukong-Omni: 多模式机器人设计、建模与控制,用于空气、陆地和水下探索的多功能推进单元

Yufan Liu, Rixi Yu, Junjie Li, Yishuai Zeng, Zhenting Wen, Cheng Li, Haifei Zhu, Shikang Lian, Wei Meng, Fumin Zhang

机构 * School of Automation, Guandong University of Technology(广东技术大学自动化学院) School of Electromechanical Engineering, Guangdong University of Technology(广东技术大学机电工程学院) Department of Electronic and Computer Engineering, Hong Kong University of Science and Technology(香港科技大学电子与计算机工程系)

AI总结 Wukong-Omni是一种多模式机器人,通过统一推进系统实现陆地、空气和水下环境的无缝切换,提升救援任务效率和适应性。

Comments 19 pages, 27 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02582 2026-03-04 cs.CV eess.SP

Neural Electromagnetic Fields for High-Resolution Material Parameter Reconstruction

神经电磁场用于高分辨率材料参数重建

Zhe Chen, Peilin Zheng, Wenshuo Chen, Xiucheng Wang, Yutao Yue, Nan Cheng

机构 * Xidian University(西安电子科技大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 NEMF通过非侵入式物理反演构建功能数字孪生,实现高精度材料参数重建与物理模拟。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02522 2026-03-04 cs.CV

NeighborMAE: Exploiting Spatial Dependencies between Neighboring Earth Observation Images in Masked Autoencoders Pretraining

NeighborMAE: 利用邻近遥感图像间的空间依赖性在掩码自编码器预训练中进行建模

Liang Zeng, Valerio Marsocci, Wufan Zhao, Andrea Nascetti, Maarten Vergauwen

机构 * KU Leuven(卢森堡大学) ESA Φ \Phi -lab(欧洲航天局Φ实验室) HKUST(GZ)(香港科技大学(珠海)) KTH(皇家理工学院)

AI总结 NeighborMAE通过联合重建邻近遥感图像,利用空间依赖性提升掩码自编码器在遥感图像预训练中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02215 2026-03-04 cs.LG cs.AI

RxnNano:Training Compact LLMs for Chemical Reaction and Retrosynthesis Prediction via Hierarchical Curriculum Learning

RxnNano:通过层次化课程学习训练紧凑的LLM用于化学反应和逆合成预测

Ran Li, Shimin Di, Haowei LI, Luanshi Bu, Jiachuan Wang, Wangze Ni, Lei Chen

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Southeast University(东南大学) Zhejiang University(浙江大学)

AI总结 RxnNano通过层次化课程学习训练紧凑LLM,提升化学反应和逆合成预测性能,实现23.5%准确率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23191 2026-03-04 cs.CV

Uni-Animator: Towards Unified Visual Colorization

Uni-Animator:迈向统一的视觉着色

Xinyuan Chen, Yao Xu, Shaowen Wang, Pengjie Song, Bowen Deng

机构 * Mississippi State University(密苏里州立大学) UIUC(伊利诺伊大学香槟分校) Hunan University(湖南大学) HKUST(香港科技大学)

AI总结 Uni-Animator通过视觉参考增强、物理细节强化和动态RoPE编码,实现了统一的图像和视频草图着色,兼顾高细节保真度和时间一致性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18833 2026-03-04 cs.SD cs.CV eess.AS eess.IV

PrismAudio: Decomposed Chain-of-Thoughts and Multi-dimensional Rewards for Video-to-Audio Generation

PrismAudio:分解的思维链与多维奖励用于视频到音频生成

Huadai Liu, Kaicheng Luo, Wen Wang, Qian Chen, Peiwen Sun, Rongjie Huang, Xiangang Li, Jieping Ye, Wei Xue

机构 * Hong Kong University of Science and Technology (HKUST)(香港科技大学) Tongyi Fun Team, Alibaba Group(通义Fun团队,阿里巴巴集团) The Chinese University of Hong Kong (CUHK)(香港中文大学)

AI总结 PrismAudio通过分解思维链与多维奖励,解决视频到音频生成中的目标纠缠问题,实现更高质量的生成效果。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18560 2026-03-04 cs.SE cs.AI

WebDevJudge: Evaluating (M)LLMs as Critiques for Web Development Quality

WebDevJudge: 评估 (M)LLMs 作为 Web 开发质量的批评者

Chunyang Li, Yilun Zheng, Xinting Huang, Tianqing Fang, Jiahao Xu, Lihui Chen, Yangqiu Song, Han Hu

机构 * Tencent AI Lab(腾讯AI实验室) The Hong Kong University of Science and Technology(香港科学与技术大学) Nanyang Technological University(南洋理工大学)

AI总结 WebDevJudge 提出了一种评估 LLM 作为 Web 开发质量批评者的基准,揭示了 LLM 与人类专家之间的显著差距,指出了模型在功能等价性识别、任务可行性验证和偏见缓解方面的根本性限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07218 2026-03-04 cs.LG cs.AI cs.CV

Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward

Perception-R1: 通过视觉感知奖励提升多模态大语言模型的多模态推理能力

Tong Xiao, Xin Xu, Zhenya Huang, Hongyu Gao, Quan Liu, Qi Liu, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) iFLYTEK AI Research(iFLYTEK人工智能研究院) Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 Perception-R1通过引入视觉感知奖励提升多模态大语言模型的多模态推理能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01966 2026-03-03 cs.CL cs.AI

AMemGym: Interactive Memory Benchmarking for Assistants in Long-Horizon Conversations

AMemGym:用于长时对话中助手的交互式记忆基准测试

Cheng Jiayang, Dongyu Ru, Lin Qiu, Yiyang Li, Xuezhi Cao, Yangqiu Song, Xunliang Cai

机构 * The Hong Kong University of Science and Technology(香港科技大学) Meituan(美团)

AI总结 AMemGym通过交互式环境实现长时对话中助手的内存管理优化,揭示现有内存系统性能差距并推动策略自我进化。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01941 2026-03-03 cs.LG

BAED: a New Paradigm for Few-shot Graph Learning with Explanation in the Loop

BAED: 一种新的少样本图学习范式,具有循环解释

Chao Chen, Xujia Li, Dongsheng Hong, Shanshan Lin, Xiangwen Liao, Chuanyi Liu, Lei Chen

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) The Hong Kong University of Science and Technology(香港科学与技术大学) Fuzhou University(福州大学)

AI总结 BAED提出了一种新的少样本图学习范式,通过循环解释机制提升模型的鲁棒性和可解释性,实验显示其在预测准确性、训练效率和解释质量上均优于现有方法。

Comments Accepted to Neural Networks 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01912 2026-03-03 cs.CL cs.AI

Demonstrating ViviDoc: Generating Interactive Documents through Human-Agent Collaboration

展示ViviDoc:通过人机协作生成交互式文档

Yinghao Tang, Yupeng Xie, Yingchaojie Feng, Tingfeng Lan, Wei Chen

机构 * State Key Lab of CAD&CG(CAD与CG国家重点实验室) HKUST(GZ)(香港科技大学(广州)) National University of Singapore(新加坡国立大学) University of Virginia(弗吉尼亚大学)

AI总结 ViviDoc通过人机协作生成交互式教育文档,采用多代理流水线和文档规范提升生成质量和编辑体验。

详情

展开后加载摘要…

URL PDF HTML 收藏