arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2226
2602.06159 2026-02-10 cs.CV

Driving with DINO: Vision Foundation Features as a Unified Bridge for Sim-to-Real Generation in Autonomous Driving

驾驶用DINO:作为自动驾驶仿真到现实生成的统一桥梁的视觉基础特征

Xuyang Chen, Conglang Zhang, Chuanheng Fu, Zihao Yang, Kaixuan Zhou, Yizhi Zhang, Jianan He, Yanfeng Zhang, Mingwei Sun, Zengmao Wang, Zhen Dong, Xiaoxiao Long, Liqiu Meng

机构 * Technical University of Munich(慕尼黑技术大学) Huawei Hilbert Research Center(华为希利伯特研究中心) Huawei Riemann Lab(华为里曼实验室) Wuhan University(武汉大学) University of Science and Technology of China(中国科学技术大学) Nanjing University(南京大学)

AI总结 DwD通过利用视觉基础模块特征作为统一桥梁,解决自动驾驶仿真到现实生成中的现实性与真实性困境,提升控制精度与时间稳定性。

Comments Project website https://albertchen98.github.io/DwD-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04093 2026-02-10 cs.CL

SearchAttack: Red-Teaming LLMs against Knowledge-to-Action Threats under Online Web Search

SearchAttack: 对知识到行动威胁下对LLM进行红队攻击

Yu Yan, Sheng Sun, Mingfeng Li, Zheming Yang, Chiwei Zhu, Fei Ma, Benfeng Xu, Min Liu, Qi Li

机构 * Institute of Computing Technology, CAS(计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) People's Public Security University of China(中国人民公安大学) University of Science and Technology of China(中国科学技术大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy(广东人工智能与数字经济实验室) Tsinghua University(清华大学)

AI总结 SearchAttack通过重新表述有害语义和测试奖励追逐偏差,揭示LLM在搜索增强任务中的安全漏洞。

Comments Misusing LLM-driven search for harmful information-seeking poses serious risks. We characterize its usability and impact through a comprehensive red-teaming and evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08036 2026-02-10 cs.LG

TAAM:Inductive Graph-Class Incremental Learning with Task-Aware Adaptive Modulation

TAAM:基于任务感知自适应调制的归纳图类增量学习

Jingtao Liu, Xinming Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 TAAM通过任务感知自适应调制模块实现高效的图类增量学习,避免灾难性遗忘并提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08031 2026-02-10 cs.CL

Beyond Raw Detection Scores: Markov-Informed Calibration for Boosting Machine-Generated Text Detection

超越原始检测分数:基于马尔可夫的校准以提升机器生成文本检测

Chenwang Wu, Yiu-ming Cheung, Shuhai Zhang, Bo Han, Defu Lian

机构 * Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系) School of Software Engineering, South China University of Technology(华南理工大学软件工程学院) School of Computer Science, University of Science and Technology of China(中国科学技术大学计算机科学学院)

AI总结 本文提出一种基于马尔可夫随机场的校准策略,用于提升机器生成文本检测的准确性,通过减少token级检测分数的偏差,提高检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08007 2026-02-10 cs.LG cs.AI

From $O(mn)$ to $O(r^2)$: Two-Sided Low-Rank Communication for Adam in Distributed Training with Memory Efficiency

从O(mn)到O(r²):为分布式训练中的Adam引入双侧低秩通信以提高内存效率

Sizhe Dang, Jiaqi Shao, Xiaodong Zheng, Guang Dai, Yan Song, Haishan Ye

机构 * Xi’an Jiaotong University(西安交通大学) SGIT AI Lab(SGIT人工智能实验室) University of Science and Technology of China(中国科学技术大学)

AI总结 TSR-Adam通过双侧低秩通信将Adam优化器的通信开销从O(mn)降至O(r²),在保持低维核心状态的同时减少通信量,提升分布式训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07594 2026-02-10 cs.CL cs.AI

Learning to Self-Verify Makes Language Models Better Reasoners

学习自我验证使语言模型更擅长推理

Yuxin Chen, Yu Wang, Yi Zhang, Ziang Ye, Zhengzhou Cai, Yaorui Shi, Qi Gu, Hui Su, Xunliang Cai, Xiang Wang, An Zhang, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Beijing University of Posts and Telecommunications(北京邮电大学)

AI总结 通过自我验证学习提升语言模型的推理能力,有效提高生成和验证性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15476 2026-02-10 cs.CV cs.AI

LGMSNet: Thinning a medical image segmentation model via dual-level multiscale fusion

LGMSNet: 通过双级多尺度融合来简化医学图像分割模型

Chengqi Dong, Fenghe Tang, Rongge Mao, Xinpei Gao, S. Kevin Zhou

机构 * School of Biomedical Engineering, Division of Life Sciences Medicine, University of Science Center for Medical Imaging, Robotics, Analytic Computing \& Learning (MIRACLE), Suzhou Institute for Advance Research, USTC, Suzhou, 215123, China Key Laboratory of Intelligent Information Processing of Chinese Academy of Sciences (CAS), Institute of Computing Technology, CAS, Beijing, 100190, China Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology, Suzhou, 215123, China State Key Laboratory of Precision \& Intelligent Chemistry, USTC, Hefei, China

AI总结 LGMSNet通过双级多尺度融合技术,实现轻量级医学图像分割模型的高效性能与高泛化能力。

Comments Accepted by ECAI 2025

Journal ref Frontiers in Artificial Intelligence and Applications, 413, 739-746 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03442 2026-02-10 cs.CV

MAMBO-G: Magnitude-Aware Mitigation for Boosted Guidance

MAMBO-G:基于幅度的提升引导抑制

Shangwen Zhu, Qianyu Peng, Zhilei Shu, Yuting Hu, Zhantao Yang, Han Zhang, Zhao Pu, Andy Zheng, Xinyu Cui, Jian Zhao, Ruili Feng, Fan Cheng

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学) University of Waterloo(滑铁卢大学) Chinese Academy of Sciences(中国科学院) Zhongguancun Academy(中关村学院)

AI总结 MAMBO-G通过动态优化引导幅度,显著降低计算成本,实现视频生成任务的高效加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08390 2026-02-10 cs.AI

On Reasoning Strength Planning in Large Reasoning Models

在大推理模型中关于推理强度规划的研究

Leheng Sheng, An Zhang, Zijian Wu, Weixiang Zhao, Changshuo Shen, Yi Zhang, Xiang Wang, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本研究揭示了大推理模型通过预先分配方向向量来规划推理强度,为控制其推理行为提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07022 2026-02-10 cs.LG cs.AI cs.CR

AlphaSteer: Learning Refusal Steering with Principled Null-Space Constraint

AlphaSteer: 通过原理性零空间约束学习拒绝引导

Leheng Sheng, Changshuo Shen, Weixiang Zhao, Junfeng Fang, Xiaohao Liu, Zhenkai Liang, Xiang Wang, An Zhang, Tat-Seng Chua

机构 * National University of Singapore(国立新加坡大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 AlphaSteer 通过原理性零空间约束学习拒绝引导,提升大语言模型的安全性与效用平衡。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10830 2026-02-10 cs.CV

View-Centric Multi-Object Tracking with Homographic Matching in Moving UAV

视点中心多目标跟踪与透视匹配在移动无人机中的应用

Deyi Ji, Lanyun Zhu, Siqi Gao, Qi Zhu, Yiru Zhao, Peng Xu, Yue Ding, Hongtao Lu, Jieping Ye, Feng Wu, Feng Zhao

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知教育部重点实验室,中国科学技术大学) Singapore University of Technology and Design(新加坡科技设计大学) Alibaba Group(阿里巴巴集团) Department of Computer Science and Engineering, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系)

AI总结 本文提出HomView-MOT框架,利用视角仿射变换解决移动无人机场景下的多目标跟踪问题,通过快速仿射估计和多视角特征学习实现最先进的跟踪性能。

Comments TGRS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06445 2026-02-09 cs.RO

ECO: Energy-Constrained Optimization with Reinforcement Learning for Humanoid Walking

ECO:基于强化学习的人形机器人能量受限优化

Weidong Huang, Jingwen Zhang, Jiongye Li, Shibowen Zhang, Jiayang Wu, Jiayi Wang, Hangxin Liu, Yaodong Yang, Yao Su

机构 * State Key Laboratory of General Artificial Intelligence, Beijing Institute for General Artificial Intelligence (BIGAI)(通用人工智能国家重点实验室,北京通用人工智能研究院(BIGAI)) Department of Automation, Tsinghua University(自动化系,清华大学) Department of Automation, University of Science and Technology of China(自动化系,中国科学技术大学) Department of Computer Science, Harbin Institute of Technology(计算机科学系,哈尔滨工业大学) Institute for Artificial Intelligence and School of Artificial Intelligence, Peking University(人工智能研究院和人工智能学院,北京大学)

AI总结 ECO通过将能量指标作为约束而非奖励,提升人形机器人行走的能效与稳定性。

Comments IEEE TRANSACTIONS ON AUTOMATION SCIENCE AND ENGINEERING. PREPRINT VERSION. ACCEPTED FEB, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06300 2026-02-09 cs.CV cs.AI

Accelerating Vision Transformers on Brain Processing Unit

加速视觉变换器在大脑处理单元上的应用

Jinchi Tang, Yan Guo

机构 * Suzhou Institute for Advanced Research,USTC University of Science and Technology of China(苏州先进研究所,中国科学技术大学)

AI总结 本文提出了一种方法,通过将视觉变换器中的线性层替换为卷积运算符,使其能够充分利用BPUs的加速能力,从而在ImageNet上实现了80.4%的准确率和3.8倍的推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05386 2026-02-09 cs.CR cs.AI

Spider-Sense: Intrinsic Risk Sensing for Efficient Agent Defense with Hierarchical Adaptive Screening

Spider-Sense: 基于内在风险感知的高效代理防御方法与分层自适应筛查

Zhenxiong Yu, Zhi Yang, Zhiheng Jin, Shuhe Wang, Heng Zhang, Yanlin Fei, Lingfeng Zeng, Fangqi Lou, Shuo Zhang, Tu Hu, Jingping Liu, Rongze Chen, Xingyu Zhu, Kunyi Wang, Chaofa Yuan, Xin Guo, Zhaowei Liu, Feipeng Zhang, Jie Huang, Huacan Wang, Ronghao Chen, Liwen Zhang

机构 * SUFE(上海财经大学) NUS(新加坡国立大学) QuantaAlpha(量子阿尔法) CMU(卡内基梅隆大学) SYSU(南方科技大学) USTC(中国科学技术大学) XJTU(西安交通大学)

AI总结 Spider-Sense通过内在风险感知实现高效代理防御,结合分层自适应筛查机制,有效降低攻击成功率和误报率,仅引入微小延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18226 2026-02-09 cs.AI

Yunjue Agent Tech Report: A Fully Reproducible, Zero-Start In-Situ Self-Evolving Agent System for Open-Ended Tasks

yunjue代理技术报告:一种完全可重现、零起点现场自我进化代理系统用于开放性任务

Haotian Li, Shijun Yang, Weizhen Qi, Silei Zhao, Rui Hua, Mingzhu Song, Xiaojian Yang, Chao Peng

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学)

AI总结 Yunjue代理系统通过现场自我进化范式实现零起点环境下开放性任务的可重现、自适应能力扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15772 2026-02-09 cs.CV cs.MM

Visual Autoregressive Modeling for Instruction-Guided Image Editing

用于指导图像编辑的视觉自回归建模

Qingyang Mao, Qi Cai, Yehao Li, Yingwei Pan, Mingyue Cheng, Ting Yao, Qi Liu, Tao Mei

机构 * University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

AI总结 VAREdit通过自回归框架实现高效精准的图像编辑,优于扩散模型并在速度和质量上取得显著提升。

Comments ICLR 2026; Source codes and models are available at https://github.com/HiDream-ai/VAREdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05403 2026-02-06 cs.AI cs.CY cs.SI

Advancing Opinion Dynamics Modeling with Neural Diffusion-Convection-Reaction Equation

用神经扩散-对流-反应方程推进意见动力学建模

Chenghua Gong, Yihang Jiang, Hao Li, Rui Sun, Juyuan Zhang, Tianjun Gu, Liming Pan, Linyuan Lü

机构 * University of Science and Technology of China(科学技术大学) Wuhan University(武汉大学) East China Normal University(华东师范大学)

AI总结 本文提出OPINN框架,通过整合物理信息与神经网络,提升意见动力学建模的预测性能和物理可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17059 2026-02-06 cs.CV

REArtGS++: Generalizable Articulation Reconstruction with Temporal Geometry Constraint via Planar Gaussian Splatting

REArtGS++: 通过平面高斯散射的时序几何约束实现通用的关节重建

Di Wu, Liu Liu, Anran Huang, Yuyan Liu, Qiaojun Yu, Shaofan Liu, Liangtu Song, Cewu Lu

机构 * Hefei Institutes of Physical Science, Chinese Academy of Sciences(合肥物理科学研究院,中国科学院) University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学) RoboticsX, Tencent(腾讯机器人院) Shanghai Jiao Tong University(上海交通大学)

AI总结 REArtGS++通过引入时序几何约束和平面高斯散射,提升关节物体在不同状态下的通用表面重建和参数估计能力。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05262 2026-02-06 cs.CV

ReGLA: Efficient Receptive-Field Modeling with Gated Linear Attention Network

ReGLA:基于门控线性注意力网络的高效感受野建模

Junzhou Li, Manqi Zhao, Yilin Gao, Zhiheng Yu, Yin Li, Dongsheng Jiang, Li Xiao

机构 * University of Science and Technology of China(中国科学技术大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 ReGLA通过结合高效卷积与门控线性注意力,实现了高分辨率图像的高效建模,在ImageNet-1K上达到80.85%的Top-1精度,同时保持低延迟和优越的下游任务性能。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05257 2026-02-06 cs.CV cs.RO

RFM-Pose:Reinforcement-Guided Flow Matching for Fast Category-Level 6D Pose Estimation

RFM-Pose:强化引导的流匹配用于快速的类别级6D位姿估计

Diya He, Qingchen Liu, Cong Zhang, Jiahu Qin

机构 * Department of Automation, University of Science and Technology of China(自动化系,中国科学技术大学)

AI总结 RFM-Pose通过强化学习框架提升类别级6D位姿估计效率,结合流匹配生成模型与近端策略优化实现快速且高效的位姿生成与假设评估。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16241 2026-02-06 cs.CR cs.AI

Adaptive Attribute-Decoupled Encryption for Trusted Respiratory Monitoring in Resource-Limited Consumer Healthcare

自适应属性解耦加密用于受限资源消费者医疗的可信呼吸监测

Xinyu Li, Jinyang Huang, Feng-Qi Cui, Meng Wang, Peng Zhao, Meng Li, Dan Guo, Meng Wang

机构 * Anhui Province Key Laboratory of Affective Computing and Advanced Intelligence Machine, School of Computer and Information, Hefei University of Technology(安徽省情感计算与先进智能机器重点实验室,计算机与信息学院,合肥工业大学) Institute of Advanced Technology, University of Science and Technology of China(先进技术研究院,中国科学技术大学)

AI总结 本文提出Tru-RM范式,通过自适应属性解耦加密技术实现受限资源下的可信呼吸监测,有效匿名化用户敏感信息并提升呼吸检测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11007 2026-02-06 cs.CV cs.AI cs.LG

VisMem: Latent Vision Memory Unlocks Potential of Vision-Language Models

VisMem: 通过潜在视觉记忆解锁视觉-语言模型的潜力

Xinlei Yu, Chengming Xu, Guibin Zhang, Zhangquan Chen, Yudong Zhang, Yongbo He, Peng-Tao Jiang, Jiangning Zhang, Xiaobin Hu, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) Fudan University(复旦大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) vivo

AI总结 VisMem通过引入动态潜在视觉记忆模块,提升视觉-语言模型在复杂视觉任务中的性能,实现感知准确性和语义一致性之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17767 2026-02-06 cs.CL

Position: The Real Barrier to LLM Agent Usability is Agentic ROI

位置:LLM代理可用性的真正障碍是代理的ROI

Weiwen Liu, Jiarui Qin, Xu Huang, Xingshan Zeng, Yunjia Xi, Jianghao Lin, Chuhan Wu, Yasheng Wang, Lifeng Shang, Ruiming Tang, Defu Lian, Yong Yu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出LLM代理可用性的核心问题在于其投资回报率,主张通过Z字型发展路径提升其在日常应用中的可用性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10322 2026-02-05 cs.AI

User-Feedback-Driven Adaptation for Vision-and-Language Navigation

基于用户反馈的视觉-语言导航适应

Yongqiang Yu, Xuhui Li, Hazza Mahmood, Jinxing Zhou, Haodong Hong, Longtao Jiang, Zhiqiang Xu, Qi Wu, Xiaojun Chang

机构 * Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed大学人工智能学院) School of Electrical Engineering and Computer Science, The University of Queensland(电气工程与计算机科学学院,昆士兰大学) University of Science and Technology of China(中国科学技术大学) School of Computer Science, The University of Adelaide(计算机科学学院,阿德莱德大学)

AI总结 本文提出基于用户反馈的视觉-语言导航适应方法,通过拓扑感知轨迹构建和持久记忆库机制,提升代理对用户指令的响应能力,实现高效模仿学习和跨指令风格的强适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04271 2026-02-05 cs.CV cs.AI cs.GR

SkeletonGaussian: Editable 4D Generation through Gaussian Skeletonization

SkeletonGaussian: 通过高斯骨架化实现可编辑的4D生成

Lifan Wu, Ruijie Zhu, Yubo Ai, Tianzhu Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 SkeletonGaussian通过高斯骨架化实现可编辑的4D生成,利用分层可动表示和六平面细化提升生成质量与编辑能力。

Comments Accepted by CVM 2026. Project page: https://wusar.github.io/projects/skeletongaussian

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21610 2026-02-05 cs.CV

WMVLM: Evaluating Diffusion Model Image Watermarking via Vision-Language Models

WMVLM:通过视觉-语言模型评估扩散模型图像水印

Zijin Yang, Yu Sun, Kejiang Chen, Jiawei Zhao, Jun Jiang, Weiming Zhang, Nenghai Yu

机构 * University of Science and Technology of China(中国科学技术大学) Anhui Province Key Laboratory of Digital Security(安徽省数字安全重点实验室) National University of Singapore(新加坡国立大学)

AI总结 WMVLM通过视觉-语言模型提出首个统一且可解释的扩散模型图像水印评估框架,重新定义了残差和语义水印的评估指标,并通过三阶段训练策略提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20272 2026-02-04 cs.CV

Ground-R1: Incentivizing Grounded Visual Reasoning via Reinforcement Learning

Ground-R1: 通过强化学习激励基于地面的视觉推理

Meng Cao, Haoze Zhao, Can Zhang, Xiaojun Chang, Ian Reid, Xiaodan Liang

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Peking University(北京大学) University of Science and Technology of China(中国科学技术大学) Sun Yat-sen University(中山大学)

AI总结 Ground-R1 通过 Scale Relative Policy Optimization 方法,解决 LVLM 在视觉证据 grounding 方面的偏差问题,提升推理准确性和证据 grounding 能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03442 2026-02-04 cs.CL

A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces

A-RAG:通过分层检索接口扩展代理检索增强生成

Mingxuan Du, Benfeng Xu, Chiwei Zhu, Shaohan Wang, Pengyu Wang, Xiaorui Wang, Zhendong Mao

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(metastone技术公司)

AI总结 A-RAG通过分层检索接口提升检索增强生成效果,有效利用模型能力并适应不同任务。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03242 2026-02-04 cs.CV

InstaDrive: Instance-Aware Driving World Models for Realistic and Consistent Video Generation

InstaDrive: 为真实和一致的视频生成实例感知的驾驶世界模型

Zhuoran Yang, Xi Guo, Chenjing Ding, Chiyu Wang, Wei Wu, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) SenseAuto(感etime) Tsinghua University(清华大学)

AI总结 InstaDrive通过实例感知机制提升驾驶视频生成质量,增强自动驾驶任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03100 2026-02-04 cs.AI

Risky-Bench: Probing Agentic Safety Risks under Real-World Deployment

Risky-Bench: 探索现实部署中智能体安全风险

Jingnan Zheng, Yanzhen Luo, Jingjun Xu, Bingnan Liu, Yuxin Chen, Chenhang Cui, Gelei Deng, Chaochao Lu, Xiang Wang, An Zhang, Tat-Seng Chua

机构 * National University of Singapore(国立新加坡大学) University of Science and Technology of China(中国科学技术大学) Southern University of Science and Technology(南方科技大学) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 Risky-Bench通过基于现实部署的安全原则,系统评估智能体在复杂任务中的安全风险,适用于多种部署场景。

详情

展开后加载摘要…

URL PDF HTML 收藏