arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

共收录 1952
2604.25161 2026-04-29 cs.MA cs.AI

Where Did It Go Wrong? Capability-Oriented Failure Attribution for Vision-and-Language Navigation Agents

哪里出错了?面向视觉-语言导航代理的能力导向故障归因

Jianming Chen, Yawen Wang, Junjie Wang, Xiaofei Xie, Shoubin Li, Qing Wang, Fanjiang Xu

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Science & Technology on Integrated Information System Laboratory(信息集成信息系统实验室) State Key Laboratory of Complex System Modeling and Simulation Technology(复杂系统建模与仿真技术国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Singapore Management University(新加坡管理大学)

AI总结 本文提出一种能力导向的测试方法,通过自适应测试用例生成、能力 oracle 和反馈机制,准确归因视觉-语言导航代理的故障原因,提升系统可解释性和改进效果。

Journal ref ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25122 2026-04-29 cs.CV cs.AI

M$^3$-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering

M$^3$-VQA:多模态、多实体、多跳视觉问答的基准测试

Jiatong Ma, Longteng Guo, Yuchen Liu, Zijia Zhao, Dongze Hao, Xuanxu Lin, Jing Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 M$^3$-VQA引入了多实体问题,要求模型在多个文档间进行顺序和并行多跳推理,揭示了多模态大语言模型在知识获取和推理方面的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25109 2026-04-29 cs.CR cs.AI

Structured Security Auditing and Robustness Enhancement for Untrusted Agent Skills

结构化安全审计与不信任代理技能的鲁棒性增强

Lijia Lv, Xuehai Tang, Jie Wen, Jizhong Han, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

AI总结 本文提出SkillGuard-Robust,通过角色感知证据提取、选择性语义验证和一致性保持裁决,解决代理技能预加载审计中语义保持重写下恶意意图识别不一致的问题,实验结果显示其在不同数据集上的高准确率和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24819 2026-04-29 cs.SE cs.AI

Programming with Data: Test-Driven Data Engineering for Self-Improving LLMs from Raw Corpora

用数据编程:面向自改进大语言模型的测试驱动数据工程

Chenkai Pan, Xinglong Xu, Yuhang Xu, Yujun Wu, Siyuan Li, Jintao Chen, Conghui He, Jingxuan Wei, Cheng Tan

机构 * Zhejiang University(浙江大学) University of Chinese Academy of Sciences(中国科学院大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 本文提出通过数据编程方法,将数据工程生命周期映射到软件开发生命周期,实现对大语言模型的可靠训练与改进,通过数据修复提升模型性能。

Comments 57 pages, 28 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18445 2026-04-29 cs.LG cs.AR

AutoPPA: Automated Circuit PPA Optimization via Contrastive Code-based Rule Library Learning

AutoPPA:通过对比代码基于的规则库学习实现自动电路PPA优化

Chongxiao Li, Pengwei Jin, Di Huang, Guangrun Sun, Husheng Han, Jianan Mu, Xinyao Zheng, Jiaguo Zhu, Shuyi Xing, Hanjun Wei, Tianyun Ma, Shuyao Cheng, Rui Zhang, Ying Wang, Zidong Du, Qi Guo, Xing Hu

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所处理器重点实验室,北京,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) University of Science and Technology of China, Hefei, China(中国科学技术大学,合肥,中国) Institute of AI for Industries, Chinese Academy of Sciences, Nanjing, China(中国科学院工业人工智能研究所,南京,中国)

AI总结 本文提出AutoPPA框架,通过对比生成的代码对自动生成优化规则,提升RTL设计中PPA优化效率,实验表明优于手动优化和现有方法SymRTLO和RTLRewriter。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24441 2026-04-28 cs.CV

AutoGUI-v2: A Comprehensive Multi-Modal GUI Functionality Understanding Benchmark

AutoGUI-v2:一个全面的多模态GUI功能理解基准

Hongxin Li, Xiping Wang, Jingran Su, Zheng Ju, Yuntao Chen, Qing Li, Zhaoxiang Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) New Laboratory of Pattern Recognition(模式识别新实验室) State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室) Hong Kong Institute of Science & Innovation(香港科学创新研究院) PolyU Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 AutoGUI-v2通过多平台截图递归解析生成多样化任务,评估深度GUI功能理解和交互预测能力,揭示VLMs在功能接地与描述上的差异及复杂交互逻辑的挑战。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24328 2026-04-28 cs.CV

Monocular Depth Estimation via Neural Network with Learnable Algebraic Group and Ring Structures

通过神经网络学习可学习的代数群和环结构进行单目深度估计

Qianlei Wang, Kexun Chen, Shaolin Zhang, Hongli Gao, Chaoning Zhang, Xiaolin Qin

机构 * Chengdu Institute of Computer Applications, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院) School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机科学与人工智能学院) School of Mechanical Engineering, Southwest Jiaotong University(西南交通大学机械工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院)

AI总结 LAGRNet通过在深度学习流程中显式嵌入可学习的群、环和sheaf结构,将单目深度估计基础代数几何,提升精度与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24312 2026-04-28 cs.CV cs.AI

Unconstrained Multi-view Human Pose Estimation with Algebraic Priors

无约束多视角人体姿态估计与代数先验

Xiaolin Qin, Qianlei Wang, Jiacen Liu, Chaoning Zhang, Fei Zhu, Zhang Yi

机构 * Chengdu Institute of Computer Applications, Chinese Academy of Sciences, Chengdu 610213, China School of Computer Science Technology, University of Chinese Academy of Sciences, Beijing 101408, China Engineering, University of Electronic Science Centre for Artificial Intelligence Robotics at Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences, Hong Kong 999077, China. School of Computer Science, Sichuan University, Chengdu 610065, China

AI总结 本文提出无约束框架,结合深度学习、代数先验和时间动态,解决无标定多视角人体姿态估计问题,通过三角化变换器、格罗布纳基正确器和时间等价修正器提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24088 2026-04-28 cs.DC cs.AI

TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training

TACO:用于可扩展张量并行LLM训练的高效中间张量通信压缩

Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkay Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao

机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出TACO框架,通过FP8压缩技术减少大规模张量并行训练中的通信开销,提升训练吞吐量并保持高精度。

Comments Accepted by HPDC'26, 12 pages, 17 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24053 2026-04-28 cs.CV

Light 'em Up: Enabling Few-Shot Low-Light 3D Gaussian Splatting with Multi-Scale Explicit Retinex Illumination Decoupling

点亮它们:通过多尺度显式Retinex照明解耦实现少样本低光3D高斯点溅射

YuHao Yin, Zongji Wang, Yuanben Zhang, Biqing Li, Jiesong Bai, Junyi Liu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) Key Laboratory of Target Cognition and Application Technology (TCAT)(目标认知与应用技术重点实验室) University of Chinese Academy of Sciences(中国科学院大学) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出MERID-GS框架,通过多尺度显式Retinex照明解耦和3D高斯点溅射,实现低光环境下少样本高质量360度视图合成,同时提升跨场景泛化能力与视图一致性。

Comments 19 pages, 5 figures. Code available at https://github.com/YhuoyuH/MERID-GS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24020 2026-04-28 cs.CR cs.AI

Poster: ClawdGo: Endogenous Security Awareness Training for Autonomous AI Agents

Poster: ClawdGo: 内生安全意识训练用于自主AI代理

Jiaqi Li, Yang Zhao, Bin Sun, Yang Yu, Jian Chang, Lidong Zhai

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Network Management Center, China Mobile Group Liaoning Company Limited(中国移动集团辽宁公司网络管理中心) Tencent Security Xuanwu Lab(腾讯安全宣武实验室) China Unicom Online Information Technology Co., Ltd.(中国联通在线信息技术有限公司)

AI总结 本文提出ClawdGo框架,通过内生训练提升自主AI代理的安全意识,引入TLDT、ASAT、CSMA和SACP四种贡献,实验显示ASAT在16次会话中提升TLDT得分,CSMA保持完整收益,SACP在高训练代理中观察到精度-召回权衡。

Comments 4 pages, including 1 poster page. Poster abstract and poster version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23974 2026-04-28 cs.CL

Propagation Structure-Semantic Transfer Learning for Robust Fake News Detection

传播结构-语义迁移学习用于鲁棒虚假新闻检测

Mengyang Chen, Lingwei Wei, Han Cao, Wei Zhou, Zhou Yan, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) State Key Laboratory of Communication Content Cognition, People’s Daily Online(人民日报通讯内容认知国家重点实验室)

AI总结 本文提出PSS-TL框架,通过双教师模型和多通道知识蒸馏损失,解决虚假新闻检测中语义与结构噪声干扰问题,验证了方法的有效性和鲁棒性。

Comments Accepted by ECML-PKDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23702 2026-04-28 cs.RO

QuietWalk: Physics-Informed Reinforcement Learning for Ground Reaction Force-Aware Humanoid Locomotion Under Diverse Footwear

QuietWalk: 基于物理的强化学习用于不同鞋类下的足部反作用力感知人形机器人运动

Hanze Hu, Luying Feng, Silu Chen, Tianjiang Zheng, Dexin Jiang, Wei Chen, Chi Zhang, Guilin Yang, Yaochu Jin

机构 * Ningbo Institute of Materials Technology and Engineering, Chinese Academy of Sciences(宁波材料技术与工程研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang Key Laboratory of Precision Actuation and Intelligent Robotics(浙江精密作动与智能机器人重点实验室) School of Engineering, Westlake University(西湖大学工程学院)

AI总结 本文提出QuietWalk,一种基于物理的强化学习框架,通过逆动力学约束神经网络估计足部垂直反作用力,提升不同鞋类下的机器人运动稳定性与静音性能。

Comments 8 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15768 2026-04-28 cs.DC cs.AI cs.CE

A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States

一个完全GPU加速的高性能量子配置选择框架:基于神经网络量子态

Daran Sun, Bowen Kan, Haoquan Long, Hairui Zhao, Haoxu Li, Yicheng Liu, Pengyu Zhou, Ankang Feng, Wenjing Huang, Yida Gu, Zhenyu Li, Honghui Shang, Yunquan Zhang, Dingwen Tao, Ninghui Sun, Guangming Tan

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出QiankunNet-cuSCI框架,通过全GPU加速解决传统CPU-GPU混合架构的限制,提升大规模量子系统计算效率和精度。

Comments Accepted by HPDC'2026, 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25562 2026-04-28 cs.LG cs.AI cs.CL

Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes

重新审视在线策略蒸馏:经验性失败模式及简单修复

Yuqian Fu, Haohuan Huang, Kaiwen Jiang, Jiacai Liu, Zhuo Jiang, Yuanheng Zhu, Dongbin Zhao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(多模态人工智能系统国家重点实验室,中科院自动化所) School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) Fudan University(复旦大学) Independent Researcher(独立研究者)

AI总结 本文研究了在线策略蒸馏的失败模式,提出改进方法提升训练稳定性,实验显示改进方法在多个任务中提升性能19.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02018 2026-04-28 cs.CV

Towards Any-Quality Image Segmentation via Generative and Adaptive Latent Space Enhancement

通过生成性和自适应潜在空间增强实现任意质量图像分割

Guangqian Guo, Aixi Ren, Yong Guo, Xuehui Yu, Jiacheng Tian, Wenli Li, Chaowei Wang, Yaoxing Wang, Shan Gao

机构 * Northwestern Polytechnical University(西北工业大学) Max Planck Institute for Informatics(马克斯·普朗克研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出GleSAM++,通过生成性潜在空间增强和自适应增强机制提升低质量图像分割鲁棒性,同时保持对清晰图像的泛化能力。

Comments Diffusion-based latent space enhancement helps improve the robustness of SAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16182 2026-04-28 cs.CR cs.CL

DualGuard: Dual-stream Large Language Model Watermarking Defense against Paraphrase and Spoofing Attack

DualGuard: 双流大语言模型水印防御对抗同义词和伪装攻击

Hao Li, Yubing Ren, Yanan Cao, Yingjie Li, Fang Fang, Shi Wang, Li Guo

机构 * Institute of Information Engineering, Chinese Academy of Sciences(信息工程研究所,中国科学院) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络与信息安全学院) Institute of Computing Technology, Chinese Academy of Sciences(计算技术研究所,中国科学院)

AI总结 DualGuard通过双流水印机制有效防御同义词和伪装攻击,提升水印检测的可靠性与可追溯性,实验表明其在多数据集和语言模型上的检测性、鲁棒性和文本质量均表现优异。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14295 2026-04-28 cs.RO cs.MA

Aegis: Automated Error Generation and Attribution for Multi-Agent Systems

Aegis:多智能体系统的自动化错误生成与归因

Fanqi Kong, Ruijie Zhang, Huaxiao Yin, Guibin Zhang, Xiaofei Zhang, Ziang Chen, Zhaowei Zhang, Xiaoyuan Zhang, Song-Chun Zhu, Xue Feng

机构 * Peking University Beijing Institute of General Artificial Intelligence(北京大学北京通用人工智能研究院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出Aegis框架,通过自动化生成大规模多智能体系统错误数据,提升错误归因能力,实验表明其模型性能可与专有模型媲美。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05330 2026-04-28 cs.DC cs.AI

Cloudless-Training: A Framework to Improve Efficiency of Geo-Distributed ML Training

无云训练:一种提升地理分布式机器学习训练效率的框架

Wenting Tan, Xiao Shi1, Cunchi Lv, Xiaofang Zhao

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出Cloudless-Training框架,通过两层架构和弹性调度策略提升地理分布式机器学习训练效率,减少通信开销并提高资源利用率。

Comments 11 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23134 2026-04-28 cs.LG

h-MINT: Modeling Pocket-Ligand Binding with Hierarchical Molecular Interaction Network

h-MINT:基于分层分子相互作用网络的口袋-配体结合建模

Yanru Qu, Yijie Zhang, Wenjuan Tan, Xiangzhe Kong, Xiangxin Zhou, Chaoran Cheng, Mathieu Blanchette, Jiaxuan You, Ge Liu

机构 * Department of Computer Science, UIUC(伊利诺伊大学厄巴纳-香槟分校计算机科学系) DOE Center for Advanced Bioenergy and Bioproducts Innovation, UIUC(美国能源部先进生物能源与生物产品创新中心,伊利诺伊大学厄巴纳-香槟分校) School of Computer Science, McGill University(麦吉尔大学计算机科学系) MILA-Québec AI Institute(魁北克AI研究所) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究 institute) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 本文提出h-MINT模型,通过重叠BPE分词和分层分子相互作用网络,改进分子表示以提升结合亲和力预测和虚拟筛选性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22888 2026-04-28 cs.CR cs.AI

RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

RouteGuard: LLM代理中技能中毒的内部信号检测

Wenjie Xiao, Xuehai Tang, Biyu Zhou, Songlin Hu, Jizhong Han

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

AI总结 本文提出RouteGuard,通过响应条件注意力和隐藏状态对齐检测LLM代理中的技能中毒,实验证明其在真实和合成数据上表现优异,有效恢复被词法筛选遗漏的攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24143 2026-04-28 cs.LG cs.NA math.NA

Linear-Nonlinear Fusion Neural Operator for Partial Differential Equations

线性-非线性融合神经算子用于偏微分方程

Heng Wu, Junjie Wang, Benzhuo Lu

机构 * SKLMS, ICMSEC, NCMIS, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing(系统科学研究院、中国科学院数学与系统科学研究院、中国科学院计算数学与工程科学研究所、中国科学院北京研究院) School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing(中国科学院大学数学科学学院)

AI总结 本文提出线性-非线性融合神经算子,通过分离线性和非线性效应提升学习效率,适用于多种PDE问题,训练速度快且精度高。

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05212 2026-04-28 cs.LG cs.AI

Early Warning of Intraoperative Adverse Events via Transformer-Driven Multi-Label Learning

术中不良事件早期预警的Transformer驱动多标签学习

Xueyao Wang, Xiuding Cai, Honglin Shang, Yaoyao Zhu, Yu Yao

机构 * Chengdu Institute of Computer Application, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) University of Chinese Academy of Sciences(中国科学院大学) China Zhenhua Research Institute Co., Ltd.(中国振华研究院有限公司)

AI总结 本文提出IAENet框架,结合改进的TAFiLM模块和Label-Constrained Reweighting Loss,有效解决术中不良事件预测中的依赖性、数据异质性和类别不平衡问题,实验表明在不同时间窗口下均优于基线模型。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01188 2026-04-28 cs.CL cs.AI

ZoFia: Zero-Shot Fake News Detection with Entity-Guided Retrieval and Multi-LLM Interaction

ZoFia:基于实体引导检索和多LLM交互的零样本假新闻检测

Lvhua Wu, Xuefeng Jiang, Sheng Sun, Yan Lei, Tian Wen, Yuwei Wang, Min Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出ZoFia框架,通过实体引导检索和多LLM交互解决假新闻检测中的知识截止和事实幻觉问题,实验表明其优于现有零样本基线和多数少样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10599 2026-04-28 cs.AI

Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models

自适应多子空间表示引导用于大语言模型中的属性对齐

Xinyan Jiang, Lin Zhang, Jiayi Zhang, Qingsong Yang, Guimin Hu, Di Wang, Lijie Hu

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫扎德·本·泽德人工智能大学) Data Analytics (PRADA) Lab(数据分析(PRADA)实验室) King Abdullah University of Science(卡瓦尔大学) Shanghai Advanced Research Institute, Chinese Academy of Sciences, Shanghai, China(上海先进研究院,中国科学院,上海,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) University of Copenhagen, Copenhagen, Denmark(哥本哈根大学,哥本哈根,丹麦) University of Science(科学大学)

AI总结 本文提出MSRS框架,通过子空间表示微调实现多属性引导,减少属性干扰并提升行为控制精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22558 2026-04-27 cs.LG cs.AI

SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning

SOLAR-RL:半在线长 horizon 分配强化学习

Jichao Wang, Liuyang Bian, Yufeng Zhou, Han Xiao, Yue Pan, Guozhi Wang, Hao Wang, Zhaoxiong Wang, Yafei Wen, Xiaoxin Chen, Shuai Ren, Lingfang Zeng

机构 * vivo AI Lab(vivo人工智能实验室) Zhejiang Lab(浙江实验室) CUHK MMLab(香港大学多模态实验室) Hubei University(湖北省大学) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)

AI总结 SOLAR-RL通过整合全局轨迹信息到离线学习中,提升GUI任务的长horizon完成率和鲁棒性,提供高效样本利用的自主导航方案。

Comments 14 pages, 11 figures. Accepted to Findings of the Association for Computational Linguistics: ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22239 2026-04-27 cs.CL cs.AI

Navigating Large-Scale Document Collections: MuDABench for Multi-Document Analytical QA

在大规模文档集合中导航:MuDABench用于多文档分析问答

Zhanli Li, Yixuan Cao, Lvzhou Luo, Ping Luo

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Wenlan School of Business, Zhongnan University of Economics and Law(中南财经政法大学文澜商学院)

AI总结 本文提出在大规模半结构化文档集合上进行分析问答的任务,介绍了MuDABench多文档分析问答基准,要求跨多个文档提取和综合信息以进行定量分析,实验发现标准RAG系统表现不佳,提出多代理工作流以提升性能。

Comments Findings of ACL 2026. The camera-ready version corrects some labeling errors. The accompanying repository is continuously updated based on community feedback; for the most up-to-date implementation and results, please refer to the repository

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13847 2026-04-27 cs.LG cs.AI

SparseBalance: Load-Balanced Long Context Training with Dynamic Sparse Attention

SparseBalance: 基于动态稀疏注意力的负载平衡长上下文训练

Hongtao Xu, Jianchao Tan, Yuxuan Hu, Pengju Lu, Hongyu Wang, Pingwei Sun, Yerui Sun, Yuchen Xie, Xunliang Cai, Mingzhen Li, Weile Jia

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) Meituan(美团) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出SparseBalance算法系统协同设计框架,通过动态稀疏调整和稀疏感知批处理策略,解决长上下文训练中的负载不平衡问题,提升模型精度与系统效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14287 2026-04-27 cs.LG

Chain-of-Memory: Lightweight Memory Construction with Dynamic Evolution for LLM Agents

链式记忆:轻量级记忆构建与动态演化用于大语言模型代理

Xiucheng Xu, Bingbing Xu, Xueyun Tian, Zihe Huang, Rongxin Chen, Yunfan Li, Huawei Shen

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出CoM框架,通过轻量级记忆构建与动态演化机制,提升LLM代理的持久知识维护与长周期决策能力,实验显示在LongMemEval和LoCoMo基准上准确率提升7.5%-10.4%,计算开销降低2.7%-6.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21285 2026-04-27 cs.AI cs.CL

When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models

当模型超越安全限制:揭示并缓解大推理模型的自我突破

Yingzhi Mao, Chunkang Zhang, Junxiang Wang, Xinyan Guan, Boxi Cao, Yaojie Lu, Hongyu Lin, Xianpei Han, Le Sun

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 研究揭示大推理模型存在自我突破现象,提出CoG框架通过分步干预缓解安全问题,平衡安全与推理性能。

Comments ACL 2026. The first two authors contributed equally. The main text is 9 pages, with an appendix of 28 pages. The paper contains 20 figures and 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏