arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15729 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15729 篇

2605.19341 2026-05-20 cs.CL cs.AI cs.LG stat.ML 67%

HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models

HalluWorld: 一个用于通过参考世界模型控制幻觉的基准

Emmy Liu, Varun Gangal, Michael Yu, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng

机构 * Carnegie Mellon University(卡内基梅隆大学) Patronus AI Independent Researcher(独立研究者) Stanford University(斯坦福大学) The Ohio State University(俄亥俄州立大学) DegenAI Labs(DegenAI实验室)

专题命中 Agent评测 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出HalluWorld基准,通过显式参考世界模型研究语言模型的幻觉问题,发现不同任务中幻觉表现不一致,表明幻觉源于多种失败模式而非单一能力。

Comments HalluWorld benchmark (code and data) at github.com/DegenAI-Labs/HalluWorld

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17912 2026-05-19 cs.RO cs.CV 67%

WorldArena 2.0: Extending Embodied World Model Benchmarking on Modality, Functionality and Platform

WorldArena 2.0: 扩展模态、功能和平台的具身世界模型基准测试

Yu Shang, Yinzhou Tang, Yiding Ma, Zhuohang Li, Lei Jin, Weikang Su, Xin Jin, Zhaolu Wang, Ziyou Wang, Xin Zhang, Haisheng Su, Weizhen He, Wei Wu, Haoyi Duan, Gordon Wetzstein, Xihui Liu, Dhruv Shah, Zhaoxiang Zhang, Zhibo Chen, Jun Zhu, Yonghong Tian, Tat-Seng Chua, Wenwu Zhu, Chen Gao, Yong Li

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Stanford University(斯坦福大学) The University of Hong Kong(香港大学) Princeton University(普林斯顿大学) Chinese Academy of Sciences(中国科学院) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) National University of Singapore(新加坡国立大学)

专题命中 Agent评测 :planning(abstract,abstract_cn)

AI总结 本文提出WorldArena 2.0,扩展了具身世界模型的评估,涵盖模态、功能和平台三个维度,提供全面的测试平台以评估具身世界模型的进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17259 2026-05-19 cs.HC 67%

CLARA: An AI-Augmented Analytics Dashboard for Collaboration Literacy

CLARA: 一个增强分析仪表盘,用于协作素养

Dawei Xie, Khalil Anderson, Tochukwu Eze, Chenghong Lin, Bookyung Shin, Marcelo Worsley

专题命中 Agent评测 :agent(abstract);agentic(abstract)

AI总结 本文提出CLARA,一种基于语义推理和增强的智能分析系统,通过提取转录文本的语义表示作为分析工具,提升协作质量评估和检索性能。

Comments 15 pages, 1 figure. Accepted at AIED 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26904 2026-05-19 cs.CL cs.AI cs.LG 67%

ClawGym: A Scalable Framework for Building Effective Claw Agents

ClawGym:一种构建有效Claw代理的可扩展框架

Fei Bai, Huatong Song, Shuang Sun, Daixuan Cheng, Yike Yang, Chuan Hao, Renyuan Li, Feng Chang, Yuan Wei, Ran Tao, Bryan Dai, Jian Yang, Wayne Xin Zhao, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence(人工智能学院) Renmin University of China(中国人民大学) IQuest Research(IQuest研究) Beihang University(北航)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出ClawGym框架,用于构建Claw式个人代理的全生命周期,通过合成可验证训练数据和强化学习方法提升代理效能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10755 2026-05-14 cs.CV 67%

MMRareBench: A Rare-Disease Multimodal and Multi-Image Medical Benchmark

MMRareBench: 一种罕见疾病多模态和多图像医学基准

Junzhi Ning, Jiashi Lin, Yingying Fang, Wei Li, Jiyao Liu, Cheng Tang, Chenglong Ma, Wenhao Tang, Tianbin Li, Ziyan Huang, Guang Yang, Junjun He

机构 * Shanghai AI Laboratory(上海人工智能实验室) Imperial College London(帝国理工学院) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

专题命中 Agent评测 :planning(abstract);workflow(abstract)

AI总结 本文提出MMRareBench,首个评估多模态和多图像临床能力的罕见疾病基准,包含1756个问题-答案对和7958张医学图像,揭示23个MLLMs在多图像任务中表现低下,存在能力稀释效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24649 2026-05-14 cs.CV 67%

MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows

MedOpenClaw 和 MedFlowBench:在完整研究流程中审计医疗代理

Weixiang Shen, Chengzhi Shen, Yanzhu Hu, Che Liu, Junde Wu, Jiayuan Zhu, Xiao Han, Zongyue Li, Jingpei Wu, Min Xu, Daguang Xu, Yueming Jin, Benedikt Wiestler, Daniel Rueckert, Jiazhen Pan

机构 * Technical University of Munich(慕尼黑技术大学) TUM University Hospital(TUM大学医院) LMU Munich(慕尼黑大学) Imperial College London(伦敦帝国理工学院) University of Oxford(牛津大学) Carnegie Mellon University(卡内基梅隆大学) NVIDIA(NVIDIA公司) National University of Singapore(新加坡国立大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 Agent评测 :agent(abstract);workflow(abstract)

AI总结 本文提出 MedFlowBench 和 MedOpenClaw,用于评估医疗影像代理在完整研究流程中生成可审计证据的能力,发现仅依赖答案评分不够,需结合正确证据验证。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12799 2026-05-14 cs.MA cs.CY cs.MM 67%

Synthesizing the Expert: A Validated Multimodal Dataset for Trustworthy AI-Assisted Swimming Coaching

合成专家:一个经过验证的多模态数据集用于可信的人工智能辅助游泳教练

Ahmad Al-Kabbany, Esraa Kassem

专题命中 Agent评测 :agent(abstract);multi-agent(abstract)

AI总结 本文提出一个多模态数据集,用于构建可信的人工智能游泳教练系统,通过多代理LLM架构生成1864个验证的'问题-上下文-答案'三元组,提升自动化指导的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12272 2026-05-13 cs.IR cs.DB 67%

BatchBench: Toward a Workload-Aware Benchmark for Autoscaling Policies in Big Data Batch Processing -- A Proposed Framework

BatchBench: 一种面向工作负载的自动扩展策略基准测试框架

Venkata Krishna Prasanth Budigi, Siri Chandana Sirigiri

专题命中 Agent评测 :agent(abstract);agentic(abstract)

AI总结 本文提出BatchBench框架,旨在为大数据批处理中的自动扩展策略提供统一的基准测试平台,通过工作负载分类、参数化工作负载生成器和五维评估体系,实现不同策略的公平比较。

Comments 5 pages, 1 table, position paper. Reference implementation in active development. Empirical follow-up to appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12251 2026-05-13 cs.GT 67%

Social Welfare under Heterogeneous Time Preferences

社会福利在异质时间偏好下的研究

Sarvin Bahmani, Soumyajit Paul, Sven Schewe, Shadi Tasdighi Kalat, Ashutosh Trivedi

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 本文研究了在异质时间偏好下,如何通过社会福利最大化来制定最优策略,展示了即使所有主体获得相同奖励,最优策略也不再是位置性的,但策略结构仍保持简单。

Comments 14 pages including appendices, Accepted to IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12178 2026-05-13 cs.AI cs.CL cs.LG 67%

Do Enterprise Systems Need Learned World Models? The Importance of Context to Infer Dynamics

企业系统需要学习的世界模型吗?上下文对推断动态的重要性

Jishnu Sethumadhavan Nair, Patrice Bechard, Rishabh Maheshwary, Surajit Dasgupta, Sravan Ramachandran, Aakash Bhagat, Shruthan Radhakrishna, Pulkit Pattnaik, Johan Obando-Ceron, Shiva Krishna Reddy Malay, Sagar Davasam, Seganrasan Subramanian, Vipul Mittal, Sridhar Krishna Nemala, Christopher Pal, Srinivas Sunkara, Sai Rajeswar

机构 * ServiceNow Mila

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文探讨了在可配置的企业环境中,代理是否仍需学习动态规则,通过实验表明运行时发现动态比离线训练更鲁棒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27418 2026-05-13 physics.med-ph 67%

MAAS-SFRThelper: An Integrated ESAPI Plugin for Structure Generation, Optimization, and Evaluation of Spatially Fractionated Radiation Therapy

MAAS-SFRThelper:一种集成的ESAPI插件,用于空间分数化放射治疗的结构生成、优化和评估

Japan K. Patel, Todd A. Wareing, Tenzin Kunkyab, Caleb Raman, Ilias Sachpazidis, Peter Szentivanyi, Ryan Clark, Gregory Gill, Pierre Lansonneur, Arjun Karnwal, Michael Kudla, Sergejs Unterkirhers, Junqi Song, Jun Yang, Anthony Magliari, Matthew C. Schmidt

专题命中 Agent评测 :planning(abstract);workflow(abstract)

AI总结 本文提出MAAS-SFRThelper插件,整合了空间分数化放射治疗的结构生成、几何感知优化和峰谷剂量比评估,通过Eclipse治疗计划系统实现统一工作流。

Comments Manuscript is being submitted to JACMP for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08687 2026-05-12 cs.ET 67%

Data Product MCP: Chat with your Enterprise Data

数据产品MCP:与企业数据对话

Marco Tonnarelli, Filippo Scaramuzza, Simon Harrer, Linus W. Dietz

专题命中 Agent评测 :AI agent(abstract);agentic(abstract)

AI总结 本文提出数据产品MCP,通过整合数据产品市场,实现企业数据的自动发现和访问,同时保障数据合同的实时执行,提升数据治理效率。

Comments Author Accepted Manuscript SummerSoc 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00149 2026-05-12 physics.comp-ph 67%

Towards Verifiable and Self-Correcting AI Physicists for Quantum Many-Body Simulations

迈向量子多体模拟的可验证和自校正人工智能物理学家

Ken Deng, Xiangfei Wang, Guijing Duan, Chen Mo, Junkun Huang, Runqing Zhang, Ling Qian, Zhiguo Huang, Jize Han, Di Luo

专题命中 Agent评测 :agent(abstract);multi-agent(abstract)

AI总结 本文提出QMP-Bench基准和PhysVEC框架,通过自验证和纠错机制提升AI在量子多体模拟中的可靠性与准确性,显著优于现有LLM基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07630 2026-05-11 cs.CL cs.AI cs.LG 67%

Safe, or Simply Incapable? Rethinking Safety Evaluation for Phone-Use Agents

安全,还是仅仅无能?重新思考手机使用代理的安全性评估

Zhengyang Tang, Yi Zhang, Chenxin Li, Xin Lai, Pengyuan Lyu, Yiduo Guo, Weinong Wang, Junyi Li, Yang Ding, Huawen Shen, Zhengyao Fang, Xingran Zhou, Liang Wu, Fei Tang, Sunqi Fan, Shangpin Peng, Zheng Ruan, Anran Zhang, Benyou Wang, Chengquan Zhang, Han Hu

机构 * Tencent Hunyuan(腾讯文言) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Tsinghua University(清华大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出PhoneSafety基准,通过700个关键安全时刻评估手机使用代理的安全性,发现更强的通用能力不等于更安全的选择,且无能行为更像是能力信号而非安全信号。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07447 2026-05-11 cs.CV cs.AI cs.CL cs.LG 67%

Sparse Autoencoders as Plug-and-Play Firewalls for Adversarial Attack Detection in VLMs

稀疏自编码器作为视觉语言模型中对抗攻击检测的即插即用防火墙

Hao Wang, Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh, Daisuke Kawahara

机构 * Magellan Technology Research Institute (MTRI)(马杰伦技术研究 institute) Waseda University(早稻田大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出基于稀疏自编码器的轻量级对抗攻击检测框架SAEgis,通过插入预训练VLM中的稀疏自编码模块,利用学习到的稀疏潜在特征检测对抗扰动输入,实验显示其在跨领域和跨攻击设置中表现优异,且无需额外对抗训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18991 2026-05-11 q-fin.TR cs.GT econ.GN q-fin.EC 67%

Who Restores the Peg? A Mean-Field Game Approach to Model Stablecoin Market Dynamics

谁恢复了锚定物?一种用于稳定币市场动态的均场博弈方法

Hardhik Mohanty, Bhaskar Krishnamachari

专题命中 Agent评测 :agent(abstract,abstract_cn)

AI总结 本文通过均场博弈框架研究稳定币脱锚事件中市场参与者行为,揭示了 arbitrage 和 retail traders 在恢复锚定物中的作用,并通过历史案例验证了主市场 arbitrage 对系统性压力的缓解作用。

Comments 9 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26220 2026-04-30 cs.MA econ.GN q-fin.EC 67%

When Agents Shop for You: Role Coherence in AI-Mediated Markets

当代理为你购物:AI中介市场中的角色一致性

Soogand Alavi, Salar Nozari

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 研究探讨了AI代理在购物决策中如何通过角色一致性推断消费者支付意愿,发现这种推断导致偏好泄露,提出通过架构干预平衡个性化与隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02731 2026-04-30 cs.SD cs.CV cs.MM 67%

Omni2Sound: Towards Unified Video-Text-to-Audio Generation

Omni2Sound:迈向统一的视频-文本到音频生成

Yusheng Dai, Zehua Chen, Yuxuan Jiang, Baolong Gao, Qiuhong Ke, Jianfei Cai, Jun Zhu

机构 * Tsinghua University(清华大学) Monash University(莫纳什大学) Shengshu AI(盛数人工智能)

专题命中 Agent评测 :agent(abstract);agentic(abstract)

AI总结 本文提出Omni2Sound模型,解决视频-音频、文本-音频及联合视频-文本-音频生成中的数据稀缺与任务竞争问题,通过SoundAtlas数据集和三阶段训练策略实现统一生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01553 2026-04-29 cs.IR 67%

IoDResearch: Deep Research on Private Heterogeneous Data via the Internet of Data

IoDResearch:通过互联网的数据进行私有异构数据的深度研究

Zhuofan Shi, Zijie Guo, Xinjian Ma, Gang Huang, Yun Ma, Xiang Jing

专题命中 Agent评测 :agent(abstract);multi-agent(abstract)

AI总结 本文提出IoDResearch框架,通过将异构资源转化为FAIR合规的数字对象,提升私有数据的检索效率和可重用性,实验表明其在检索、问答和报告生成任务中优于现有基线方法。

Comments Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24184 2026-04-28 cs.CR 67%

Dynamic Cyber Ranges

动态网络攻防范围

Víctor Mayoral-Vilches, María Sanz-Gómez, Francesco Balassone, Maite Del Mundo De Torres, George Nicolaou, Samuel Rodriguez Borines, Almerindo Graziano, Paul Zabalegui, Endika Gil-Uriarte

专题命中 Agent评测 :agent(abstract);agentic(abstract)

AI总结 本文提出动态网络攻防范围,通过LLM驱动的防御代理提升网络安全评估效果,减少攻击成功率,展现其在不同配置下的防护能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22602 2026-04-27 cs.CR 67%

PASS: A Provenanced Access Subaccount System for Blockchain Wallets

PASS:一种用于区块链钱包的可追溯访问子账户系统

Jay Yu, Shunfan Zhou, Hang Yin, Brian Seong

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 PASS通过可追溯性控制替代传统角色或身份控制,确保资产只能由能追溯 custody 的子账户使用,实现隐私保护和高效管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21287 2026-04-24 quant-ph 67%

StabilizerBench: A Benchmark for AI-Assisted Quantum Error Correction Circuit Synthesis

StabilizerBench:一个用于人工智能辅助量子误差校正电路合成的基准测试

Andres Paz, Christian Tarta, Cordelia Yuqiao Li, Mayee Sun, Sarju Patel, Sylvie Lausier

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 StabilizerBench通过192种稳定子码提供了一个基准,涵盖12种家族、4-196个量子比特和距离2-21的代码,分为三个递增难度任务:状态准备电路生成、电路优化和容错电路合成,采用统一评分系统评估AI在量子误差校正中的能力与质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20197 2026-04-23 physics.chem-ph 67%

How is a gas sensor poisoned by volatile methylsiloxanes?

气体传感器为何会被挥发性甲基硅氧烷中毒?

Heng Liu, Bingxin Yang, Yiming Lu, Yuan Wang, Xue Jia, Long Luo, Hao Li

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 研究通过理论分析揭示了甲基硅氧烷中毒的机制,开发了基于描述符的微动力学火山模型,预测抗中毒材料,展示了AI驱动的材料发现方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.15158 2026-04-23 q-fin.MF math.PR 67%

Relative Arbitrage Opportunities with Interactions among $N$ Investors

相对套利机会与N名投资者之间的相互作用

Tomoyuki Ichiba, Nicole Tianjiao Yang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract)

AI总结 本文研究了N名投资者间相互作用下的相对套利机会优化,通过Fichera漂移条件保证套利机会,并推导出投资者最优策略和纳什均衡。

Comments 30 pages, Accepted by Mathematical Finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18046 2026-04-21 cs.CE cs.MA 67%

EvoMarket: A High-Fidelity and Scalable Financial Market Simulator

EvoMarket:一种高保真且可扩展的金融市场模拟器

Muyao Zhong, Zhenhua Yang, Yuxiang Liu, Ke Tang, Peng Yang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract)

AI总结 本文提出EvoMarket,一种多资产和跨日环境下的多智能体金融市场模拟器,通过高吞吐量执行核心和显式机构机制,实现高保真度、可扩展性和计算可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16818 2026-04-21 cs.HC 67%

Beyond Serendipity: From Exposing the Unknown to Fostering Engagement through Peer Recommendation

超越偶然性:通过同伴推荐暴露未知并促进参与

Sosui Moribe, Taketoshi Ushiama

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 本文提出Peer Recommendation框架,通过用户与AI代理基于对话的协作探索未知内容,发现偏好距离对用户兴趣扩展和参与价值有显著影响。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16538 2026-04-21 cs.SE cs.AI cs.LG cs.PL 67%

Understanding Tool-Augmented Agents for Lean Formalization: A Factorial Analysis

理解用于精益形式化的工具增强代理:因子分析

Ke Zhang, Patricio Gallardo, Maziar Raissi, Sudhir Murthy

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文通过因子分析评估三种工具类型在自然语言数学自动转换为Lean 4代码中的有效性,发现工具增强代理在编译成功率和语义等价性上有显著提升。

Comments 15 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16024 2026-04-17 cs.CV 67%

Speak, Segment, Track, Navigate: An Interactive System for Video-Guided Skull-Base Surgery

说话、分割、跟踪、导航:一种用于视频引导的颅底手术交互系统

Jecia Z. Y. Mao, Francis X. Creighton, Russell H. Taylor, Manish Sahu

机构 * IEEE

专题命中 Agent评测 :agent(abstract);workflow(abstract)

AI总结 本文提出一种基于语音引导的嵌入式代理框架,用于视频引导的颅底手术,通过实时视觉感知和图像引导任务响应外科医生的查询,提高手术流程整合性和部署速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12626 2026-04-15 cs.RO cs.CV 67%

Habitat-GS: A High-Fidelity Navigation Simulator with Dynamic Gaussian Splatting

Habitat-GS:一种高保真导航仿真器与动态高斯点云

Ziyuan Xia, Jingyi Xu, Chong Cui, Yuanhong Yu, Jiazhao Zhang, Qingsong Yan, Tao Ni, Junbo Chen, Xiaowei Zhou, Hujun Bao, Ruizhen Hu, Sida Peng

机构 * Zhejiang University(浙江大学) Peking University(北京大学) XGRIDS UDeer AI Shenzhen University(深圳大学)

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 本文提出Habitat-GS,通过整合3D高斯点云渲染和可驾驶高斯化身,提升导航仿真的视觉真实性和动态人类建模能力,实验表明其在跨领域泛化和人类感知导航中表现优异。

Comments Project page: https://zju3dv.github.io/habitat-gs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01241 2026-04-14 cs.CR 67%

Peering Behind the Shield: Guardrail Identification in Large Language Models

窥视屏障之后:大型语言模型中的屏障识别

Ziqing Yang, Yixin Wu, Rui Wen, Michael Backes, Yang Zhang

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 本文提出AP-Test方法,通过对抗性提示检测黑盒AI代理中的屏障,解决安全对齐LLM和缺乏决策策略的问题,实验显示其在多种场景下实现完美分类准确率。

Comments To Appear in the 64th Annual Meeting of the Association for Computational Linguistics, July 2-7, 2026. ACL Findings

详情

展开后加载摘要…

URL PDF HTML 收藏