arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-04-28 至 2026-04-28 共收录 20
2604.24441 2026-04-28 cs.CV

AutoGUI-v2: A Comprehensive Multi-Modal GUI Functionality Understanding Benchmark

AutoGUI-v2:一个全面的多模态GUI功能理解基准

Hongxin Li, Xiping Wang, Jingran Su, Zheng Ju, Yuntao Chen, Qing Li, Zhaoxiang Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) New Laboratory of Pattern Recognition(模式识别新实验室) State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室) Hong Kong Institute of Science & Innovation(香港科学创新研究院) PolyU Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 AutoGUI-v2通过多平台截图递归解析生成多样化任务,评估深度GUI功能理解和交互预测能力,揭示VLMs在功能接地与描述上的差异及复杂交互逻辑的挑战。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24328 2026-04-28 cs.CV

Monocular Depth Estimation via Neural Network with Learnable Algebraic Group and Ring Structures

通过神经网络学习可学习的代数群和环结构进行单目深度估计

Qianlei Wang, Kexun Chen, Shaolin Zhang, Hongli Gao, Chaoning Zhang, Xiaolin Qin

机构 * Chengdu Institute of Computer Applications, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院) School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机科学与人工智能学院) School of Mechanical Engineering, Southwest Jiaotong University(西南交通大学机械工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院)

AI总结 LAGRNet通过在深度学习流程中显式嵌入可学习的群、环和sheaf结构,将单目深度估计基础代数几何,提升精度与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24312 2026-04-28 cs.CV cs.AI

Unconstrained Multi-view Human Pose Estimation with Algebraic Priors

无约束多视角人体姿态估计与代数先验

Xiaolin Qin, Qianlei Wang, Jiacen Liu, Chaoning Zhang, Fei Zhu, Zhang Yi

机构 * Chengdu Institute of Computer Applications, Chinese Academy of Sciences, Chengdu 610213, China School of Computer Science Technology, University of Chinese Academy of Sciences, Beijing 101408, China Engineering, University of Electronic Science Centre for Artificial Intelligence Robotics at Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences, Hong Kong 999077, China. School of Computer Science, Sichuan University, Chengdu 610065, China

AI总结 本文提出无约束框架,结合深度学习、代数先验和时间动态,解决无标定多视角人体姿态估计问题,通过三角化变换器、格罗布纳基正确器和时间等价修正器提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24088 2026-04-28 cs.DC cs.AI

TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training

TACO:用于可扩展张量并行LLM训练的高效中间张量通信压缩

Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkay Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao

机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出TACO框架,通过FP8压缩技术减少大规模张量并行训练中的通信开销,提升训练吞吐量并保持高精度。

Comments Accepted by HPDC'26, 12 pages, 17 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24053 2026-04-28 cs.CV

Light 'em Up: Enabling Few-Shot Low-Light 3D Gaussian Splatting with Multi-Scale Explicit Retinex Illumination Decoupling

点亮它们:通过多尺度显式Retinex照明解耦实现少样本低光3D高斯点溅射

YuHao Yin, Zongji Wang, Yuanben Zhang, Biqing Li, Jiesong Bai, Junyi Liu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) Key Laboratory of Target Cognition and Application Technology (TCAT)(目标认知与应用技术重点实验室) University of Chinese Academy of Sciences(中国科学院大学) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出MERID-GS框架,通过多尺度显式Retinex照明解耦和3D高斯点溅射,实现低光环境下少样本高质量360度视图合成,同时提升跨场景泛化能力与视图一致性。

Comments 19 pages, 5 figures. Code available at https://github.com/YhuoyuH/MERID-GS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24020 2026-04-28 cs.CR cs.AI

Poster: ClawdGo: Endogenous Security Awareness Training for Autonomous AI Agents

Poster: ClawdGo: 内生安全意识训练用于自主AI代理

Jiaqi Li, Yang Zhao, Bin Sun, Yang Yu, Jian Chang, Lidong Zhai

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Network Management Center, China Mobile Group Liaoning Company Limited(中国移动集团辽宁公司网络管理中心) Tencent Security Xuanwu Lab(腾讯安全宣武实验室) China Unicom Online Information Technology Co., Ltd.(中国联通在线信息技术有限公司)

AI总结 本文提出ClawdGo框架,通过内生训练提升自主AI代理的安全意识,引入TLDT、ASAT、CSMA和SACP四种贡献,实验显示ASAT在16次会话中提升TLDT得分,CSMA保持完整收益,SACP在高训练代理中观察到精度-召回权衡。

Comments 4 pages, including 1 poster page. Poster abstract and poster version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23974 2026-04-28 cs.CL

Propagation Structure-Semantic Transfer Learning for Robust Fake News Detection

传播结构-语义迁移学习用于鲁棒虚假新闻检测

Mengyang Chen, Lingwei Wei, Han Cao, Wei Zhou, Zhou Yan, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) State Key Laboratory of Communication Content Cognition, People’s Daily Online(人民日报通讯内容认知国家重点实验室)

AI总结 本文提出PSS-TL框架,通过双教师模型和多通道知识蒸馏损失,解决虚假新闻检测中语义与结构噪声干扰问题,验证了方法的有效性和鲁棒性。

Comments Accepted by ECML-PKDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23702 2026-04-28 cs.RO

QuietWalk: Physics-Informed Reinforcement Learning for Ground Reaction Force-Aware Humanoid Locomotion Under Diverse Footwear

QuietWalk: 基于物理的强化学习用于不同鞋类下的足部反作用力感知人形机器人运动

Hanze Hu, Luying Feng, Silu Chen, Tianjiang Zheng, Dexin Jiang, Wei Chen, Chi Zhang, Guilin Yang, Yaochu Jin

机构 * Ningbo Institute of Materials Technology and Engineering, Chinese Academy of Sciences(宁波材料技术与工程研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang Key Laboratory of Precision Actuation and Intelligent Robotics(浙江精密作动与智能机器人重点实验室) School of Engineering, Westlake University(西湖大学工程学院)

AI总结 本文提出QuietWalk,一种基于物理的强化学习框架,通过逆动力学约束神经网络估计足部垂直反作用力,提升不同鞋类下的机器人运动稳定性与静音性能。

Comments 8 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15768 2026-04-28 cs.DC cs.AI cs.CE

A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States

一个完全GPU加速的高性能量子配置选择框架:基于神经网络量子态

Daran Sun, Bowen Kan, Haoquan Long, Hairui Zhao, Haoxu Li, Yicheng Liu, Pengyu Zhou, Ankang Feng, Wenjing Huang, Yida Gu, Zhenyu Li, Honghui Shang, Yunquan Zhang, Dingwen Tao, Ninghui Sun, Guangming Tan

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出QiankunNet-cuSCI框架,通过全GPU加速解决传统CPU-GPU混合架构的限制,提升大规模量子系统计算效率和精度。

Comments Accepted by HPDC'2026, 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25562 2026-04-28 cs.LG cs.AI cs.CL

Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes

重新审视在线策略蒸馏:经验性失败模式及简单修复

Yuqian Fu, Haohuan Huang, Kaiwen Jiang, Jiacai Liu, Zhuo Jiang, Yuanheng Zhu, Dongbin Zhao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(多模态人工智能系统国家重点实验室,中科院自动化所) School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) Fudan University(复旦大学) Independent Researcher(独立研究者)

AI总结 本文研究了在线策略蒸馏的失败模式,提出改进方法提升训练稳定性,实验显示改进方法在多个任务中提升性能19.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02018 2026-04-28 cs.CV

Towards Any-Quality Image Segmentation via Generative and Adaptive Latent Space Enhancement

通过生成性和自适应潜在空间增强实现任意质量图像分割

Guangqian Guo, Aixi Ren, Yong Guo, Xuehui Yu, Jiacheng Tian, Wenli Li, Chaowei Wang, Yaoxing Wang, Shan Gao

机构 * Northwestern Polytechnical University(西北工业大学) Max Planck Institute for Informatics(马克斯·普朗克研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出GleSAM++,通过生成性潜在空间增强和自适应增强机制提升低质量图像分割鲁棒性,同时保持对清晰图像的泛化能力。

Comments Diffusion-based latent space enhancement helps improve the robustness of SAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16182 2026-04-28 cs.CR cs.CL

DualGuard: Dual-stream Large Language Model Watermarking Defense against Paraphrase and Spoofing Attack

DualGuard: 双流大语言模型水印防御对抗同义词和伪装攻击

Hao Li, Yubing Ren, Yanan Cao, Yingjie Li, Fang Fang, Shi Wang, Li Guo

机构 * Institute of Information Engineering, Chinese Academy of Sciences(信息工程研究所,中国科学院) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络与信息安全学院) Institute of Computing Technology, Chinese Academy of Sciences(计算技术研究所,中国科学院)

AI总结 DualGuard通过双流水印机制有效防御同义词和伪装攻击,提升水印检测的可靠性与可追溯性,实验表明其在多数据集和语言模型上的检测性、鲁棒性和文本质量均表现优异。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14295 2026-04-28 cs.RO cs.MA

Aegis: Automated Error Generation and Attribution for Multi-Agent Systems

Aegis:多智能体系统的自动化错误生成与归因

Fanqi Kong, Ruijie Zhang, Huaxiao Yin, Guibin Zhang, Xiaofei Zhang, Ziang Chen, Zhaowei Zhang, Xiaoyuan Zhang, Song-Chun Zhu, Xue Feng

机构 * Peking University Beijing Institute of General Artificial Intelligence(北京大学北京通用人工智能研究院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出Aegis框架,通过自动化生成大规模多智能体系统错误数据,提升错误归因能力,实验表明其模型性能可与专有模型媲美。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05330 2026-04-28 cs.DC cs.AI

Cloudless-Training: A Framework to Improve Efficiency of Geo-Distributed ML Training

无云训练:一种提升地理分布式机器学习训练效率的框架

Wenting Tan, Xiao Shi1, Cunchi Lv, Xiaofang Zhao

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出Cloudless-Training框架,通过两层架构和弹性调度策略提升地理分布式机器学习训练效率,减少通信开销并提高资源利用率。

Comments 11 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23134 2026-04-28 cs.LG

h-MINT: Modeling Pocket-Ligand Binding with Hierarchical Molecular Interaction Network

h-MINT:基于分层分子相互作用网络的口袋-配体结合建模

Yanru Qu, Yijie Zhang, Wenjuan Tan, Xiangzhe Kong, Xiangxin Zhou, Chaoran Cheng, Mathieu Blanchette, Jiaxuan You, Ge Liu

机构 * Department of Computer Science, UIUC(伊利诺伊大学厄巴纳-香槟分校计算机科学系) DOE Center for Advanced Bioenergy and Bioproducts Innovation, UIUC(美国能源部先进生物能源与生物产品创新中心,伊利诺伊大学厄巴纳-香槟分校) School of Computer Science, McGill University(麦吉尔大学计算机科学系) MILA-Québec AI Institute(魁北克AI研究所) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究 institute) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 本文提出h-MINT模型,通过重叠BPE分词和分层分子相互作用网络,改进分子表示以提升结合亲和力预测和虚拟筛选性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22888 2026-04-28 cs.CR cs.AI

RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

RouteGuard: LLM代理中技能中毒的内部信号检测

Wenjie Xiao, Xuehai Tang, Biyu Zhou, Songlin Hu, Jizhong Han

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

AI总结 本文提出RouteGuard,通过响应条件注意力和隐藏状态对齐检测LLM代理中的技能中毒,实验证明其在真实和合成数据上表现优异,有效恢复被词法筛选遗漏的攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24143 2026-04-28 cs.LG cs.NA math.NA

Linear-Nonlinear Fusion Neural Operator for Partial Differential Equations

线性-非线性融合神经算子用于偏微分方程

Heng Wu, Junjie Wang, Benzhuo Lu

机构 * SKLMS, ICMSEC, NCMIS, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing(系统科学研究院、中国科学院数学与系统科学研究院、中国科学院计算数学与工程科学研究所、中国科学院北京研究院) School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing(中国科学院大学数学科学学院)

AI总结 本文提出线性-非线性融合神经算子,通过分离线性和非线性效应提升学习效率,适用于多种PDE问题,训练速度快且精度高。

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05212 2026-04-28 cs.LG cs.AI

Early Warning of Intraoperative Adverse Events via Transformer-Driven Multi-Label Learning

术中不良事件早期预警的Transformer驱动多标签学习

Xueyao Wang, Xiuding Cai, Honglin Shang, Yaoyao Zhu, Yu Yao

机构 * Chengdu Institute of Computer Application, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) University of Chinese Academy of Sciences(中国科学院大学) China Zhenhua Research Institute Co., Ltd.(中国振华研究院有限公司)

AI总结 本文提出IAENet框架,结合改进的TAFiLM模块和Label-Constrained Reweighting Loss,有效解决术中不良事件预测中的依赖性、数据异质性和类别不平衡问题,实验表明在不同时间窗口下均优于基线模型。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01188 2026-04-28 cs.CL cs.AI

ZoFia: Zero-Shot Fake News Detection with Entity-Guided Retrieval and Multi-LLM Interaction

ZoFia:基于实体引导检索和多LLM交互的零样本假新闻检测

Lvhua Wu, Xuefeng Jiang, Sheng Sun, Yan Lei, Tian Wen, Yuwei Wang, Min Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出ZoFia框架,通过实体引导检索和多LLM交互解决假新闻检测中的知识截止和事实幻觉问题,实验表明其优于现有零样本基线和多数少样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10599 2026-04-28 cs.AI

Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models

自适应多子空间表示引导用于大语言模型中的属性对齐

Xinyan Jiang, Lin Zhang, Jiayi Zhang, Qingsong Yang, Guimin Hu, Di Wang, Lijie Hu

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫扎德·本·泽德人工智能大学) Data Analytics (PRADA) Lab(数据分析(PRADA)实验室) King Abdullah University of Science(卡瓦尔大学) Shanghai Advanced Research Institute, Chinese Academy of Sciences, Shanghai, China(上海先进研究院,中国科学院,上海,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) University of Copenhagen, Copenhagen, Denmark(哥本哈根大学,哥本哈根,丹麦) University of Science(科学大学)

AI总结 本文提出MSRS框架,通过子空间表示微调实现多属性引导,减少属性干扰并提升行为控制精度。

详情

展开后加载摘要…

URL PDF HTML 收藏