arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-16 至 2026-07-16 共收录 161 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 21 篇

2607.13591 2026-07-16 cs.CL cs.AI 新提交 73%

Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents

作为受控过程的记忆:为大语言模型智能体学习自适应内存管理

Eric Hanchen Jiang, Zhi Zhang, Yuchen Wu, Levina Li, Dong Liu, Xiao Liang, Rui Sun, Yubei Li, Edward Sun, Haozheng Luo, Zhaolu Kang, Aylin Caliskan, Kai-Wei Chang, Ying Nian Wu

机构 * University of California Los Angeles(加利福尼亚大学洛杉矶分校) University of Washington(华盛顿大学) Northwestern University(西北大学)

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 研究LLM智能体内存管理问题,提出MemCon框架将内存操作建模为马尔可夫决策过程,通过在线策略自适应管理内存,该框架与后端无关,实验表明其在多基准测试中优于基线,提升任务成功率并减少令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10671 2026-07-16 physics.chem-ph cond-mat.str-el physics.comp-ph quant-ph 版本更新 71%

AEGISS -- Atomic orbital and Entropy-based Guided Inference for Space Selection -- A novel semi-automated active space selection workflow for quantum chemistry and quantum computing applications

AEGISS——基于原子轨道和熵的空间选择引导推理——一种用于量子化学和量子计算应用的新型半自动活性空间选择工作流程

Fabio Tarocco, Pi A. B. Haase, Fabijan Pavošević, Vijay Krishna, Leonardo Guidoni, Stefan Knecht, Martina Stella

专题命中 工作流自动化 :workflow(title)

AI总结 针对多参考量子化学计算中活性空间选择问题,提出受AVAS和AutoCAS启发的新方法,结合轨道熵分析与原子轨道投影构建活性空间,经验证适用于经典和量子计算框架,还开发出便于使用且可对接多种应用的软件包。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14006 2026-07-16 cs.CR cs.AI 新提交 70%

Rethinking Penetration Testing for AI-Enabled Systems: From Resource Compromise to Behavioral Objective Violation

重新思考人工智能系统的渗透测试:从资源妥协到行为目标违反

Mohammad Allahbakhsh, Mohammad Hassan Bahari, Moslem Attar-Raouf

机构 * Sensifai BV(Sensifai公司)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文重新思考人工智能系统渗透测试,将其定义为目标驱动的行为评估,涵盖多种对抗途径。提出测试工作流程,通过实例展示渗透可通过行为影响发生,为评估已部署人工智能系统中的对抗成功提供技术框架。

Comments 42 pages, 5 Tables, 21 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08949 2026-07-16 cs.CR cs.SE 版本更新 70%

SeedSmith: LLM-Driven Seed Synthesis for Directed Fuzzing

SeedSmith:用于定向模糊测试的基于大语言模型的种子合成

Junmin Zhu, Siyu Liu, Jie Hu, Fabio Gritti, Ati Priya Bajaj, Hulin Wang, Wenbo Guo, Tiffany Bao, Christopher Kruegel, Giovanni Vigna

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.SE

AI总结 研究针对定向模糊测试常无法触发崩溃的问题,提出SeedSmith这一基于大语言模型的管道,通过复制分析师工作流程合成种子,提升模糊器性能,在Magma和ARVO上取得显著加速和发现新漏洞的成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13189 2026-07-16 cs.CL cs.AI 新提交 62%

RAGthoven at SemEval-2026 Task 1: A Multi-Stage Pipeline Walks Into a Benchmark and Barely Clears the Bar

RAGthoven参加SemEval-2026任务1:一个多阶段管道进入基准测试且勉强达标

Marek Šuppa, Viktória Ondrejová, Lucia Ganajová, Gregor Karetka, Daniel Skala

机构 * Comenius University in Bratislava(布拉迪斯拉发的夸美纽斯大学) Cisco Systems(思科系统公司) Zaitra s.r.o.(扎伊特拉有限公司) NaiveNeuron(天真神经元)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 介绍用于SemEval-2026任务1子任务A的RAGthoven系统,它将幽默文本生成分解为多阶段LLM管道,经多次实验优化,最终配置用RAG增强规划器,还评估两种智能变体,虽工具调用预算增加,但在英语样本上未超非智能管道,在三种语言中与基线并列第一,显示语言相关回报递减。

Comments SemEval-2026 Task 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13078 2026-07-16 cs.CR cs.AI cs.LG 新提交 62%

Operational Evidence Gaps for LLMs in Fraud Detection and Trust-and-Safety Workflows

大语言模型在欺诈检测和信任与安全工作流程中的操作证据差距

Keyur Gabani

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 研究LLMs用于欺诈检测等信任与安全工作流程时的操作证据差距。通过对相关操作源编码调查发现证据失衡,欺诈任务部分大但缺乏关键证据。贡献了FORTE框架和部署证据清单,确定支持LLMs部署所需研究。

Comments 22 pages, 3 figures, 6 tables. Ancillary files include the evidence matrix, search note, and numeric claim check

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13372 2026-07-16 cs.CL 新提交 57%

A POS Tier Is the Key to Automated Annotation for Low-Resource Language Documentation: Neural Interlinear Glossing for Irabu, a Southern Ryukyuan Language

词性层级是低资源语言文献自动标注的关键:针对南琉球语伊良部语的神经语符标注

Michinori Shimoji

机构 * Kyushu University(九州大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 研究针对濒危语言伊良部语语符标注成本高的问题,用小型BiLSTM-CRF模型构建神经标注管道。发现黄金词性标注可提升语法语符标注,词性层级能减少所需语符化数据量,虽全自动管道未完全实现增益,但为文献实践提供四线标注建议。

Comments 15 pages, 9 figures, 8 tables. Code, corpus, and complete per-sentence test outputs: https://github.com/MichinoriShimoji/ML_autogloss

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13156 2026-07-16 cs.SE 新提交 57%

Design-System-Aware Development with AI: Evaluating Productivity and Design Consistency

基于人工智能的设计系统感知开发:评估生产力和设计一致性

Luciane Silva, Thayssa Rocha, Nicole Davila, Gustavo Pinto

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究前端开发中从高保真原型转换界面的挑战,通过在巴西企业的对照实验,比较手动、仅DS及DS感知的AI辅助开发,发现AI辅助能显著加速开发、提高设计保真度,为工业前端工作流带来实际益处。

Comments SBES Industry 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13040 2026-07-16 cs.CY cs.AI 新提交 57%

Final Authority in AI Governance: Frontier-Provider Sovereignty and Action-Centered Deployer Governance

人工智能治理中的最终权威:前沿提供者主权与以行动为中心的部署者治理

Zexun Wang

机构 * Ond Holdings Inc.(奥恩德控股公司)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 探讨人工智能系统嵌入组织流程后最终权威归属,比较前沿提供者主权与以行动为中心的部署者主权两种模式,通过多种分析发现支持分布式运营问责制,强调可移植治理层价值,得出分层结论。

Comments 23 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13840 2026-07-16 cs.SD cs.DB 新提交 50%

From Continuous Deployment to Queryable Dataset: Terabyte-Scale AIS-Aligned Passive Acoustic Labelling

从持续部署到可查询数据集:PB 级 AIS 对齐的被动声学标记

Wayne Renaud, Priyanka Aravindan, Gabriel Spadon

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对长时间被动声学部署录音与船只轨迹等未关联问题,提出数据库原生工作流程,将水听器录音与 AIS 位置报告对齐生成距离解析数据,经处理大量数据生成结构化表,实现地理人工智能框架,支持相关海洋环境分析建模。

Comments OCEANS'26 - Monterey

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13343 2026-07-16 cs.CV cs.ET cs.HC 新提交 50%

Marker-free deformable registration and fusion for augmented reality-guided positive margin localization during tumor resection surgery

用于肿瘤切除手术中增强现实引导的阳性切缘定位的无标记可变形配准与融合

Yue Yang, Annie Benson, Matthieu Chabanas, Jason Slagle, Thomas Myles, Matthew B. Weinger, Jon S. Heiselman, Michael I. Miga, Michael Topf, Jie Ying Wu

机构 * Vanderbilt University(范德堡大学) Vanderbilt University Medical Center(范德堡大学医学中心)

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对头颈部肿瘤手术中阳性切缘定位难题,提出无标记增强现实工作流程,结合多种技术实现标本扫描到切除床的映射,经实验验证该方法能有效降低定位误差,支持更精确肿瘤切除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13261 2026-07-16 physics.chem-ph 新提交 50%

Aromatic Molecule Solvation in Liquid Water with Coupled Cluster Accuracy: The Balance of Pi-Interactions and Hydrophobicity

液态水中芳香分子溶剂化达到耦合簇精度:π相互作用与疏水性的平衡

Nore Stolte, Harald Forbert, Yury Lysogorskiy, Ralf Drautz, Dominik Marx

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究水中芳香分子溶剂化中π相互作用与疏水性平衡问题,采用基于图形原子簇扩展训练机器学习原子间势的方法,得到CCSD(T)质量的MLIP,能再现相关能量和力,揭示常用方法不足,为高精度模拟打开大门。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13207 2026-07-16 physics.geo-ph 新提交 50%

Estimation of Elastic Parameters with Guidance-based Diffusion model

基于引导扩散模型的弹性参数估计

Anjali Dixit, Francesco Brandolin, Tariq Alkhalifah

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对弹性参数从角度叠加地震数据中可靠估计的难题,提出基于引导扩散模型的反演工作流程,经无监督训练学习参数耦合,用扩散后验采样近似似然函数,在两个数据集上评估,相比基线能恢复更好剖面并实现不确定性量化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04995 2026-07-16 cond-mat.mes-hall cond-mat.mtrl-sci cond-mat.other 版本更新 50%

Scaling analysis of quantum geometry in second-order nonlinear transport

二阶非线性输运中量子几何的标度分析

Zhen-Hao Gong, Z. Z. Du, Hai-Peng Sun, Hai-Zhou Lu, X. C. Xie

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究二阶非线性输运中量子几何贡献难以分离的问题,通过列举相关机制并推导标度律,以线性纵向电导率多项式表示非线性霍尔电导率,利用各机制“权重指纹”定量分离量子几何与无序背景,提供识别量子几何贡献的工作流程。

Comments 8 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 9 篇

2607.13285 2026-07-16 cs.AI cs.SE 新提交 88%

Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable

Harness手册:使不断演进的智能体框架具有可读性、可导航性和可编辑性

Ruhan Wang, Yucheng Shi, Zongxia Li, Zhongzhi Li, Yue Yu, Junyao Yang, Kishan Panaganti, Haitao Mi, Dongruo Zhou, Leoweiliang

机构 * Tencent(腾讯) Indiana University(印第安纳大学) University of Maryland, College Park(马里兰大学帕克分校) University of Georgia(佐治亚大学) National University of Singapore(新加坡国立大学)

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);planning(abstract);agentic(abstract)

AI总结 研究智能体框架演进中行为定位难的问题,提出通过Harness手册和行为引导的渐进式披露,以行为为中心自动合成框架表示并辅助规划,提高行为定位和编辑计划质量,助力复杂智能体系统发展。

Comments 29 pages, 6 figures. Project page: https://ruhan-wang.github.io/Harness-Handbook/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13196 2026-07-16 cs.SE 新提交 85%

From Human-Centric to Agentic Code Review: The Impact of Different Generations of Generative AI Technology on Review Quality

从以人类为中心到智能体代码审查:不同代际生成式人工智能技术对审查质量的影响

Suzhen Zhong, Shayan Noei, Bram Adams, Ying Zou

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.SE

AI总结 研究不同代际生成式人工智能技术对代码审查质量的影响,通过分析102万条GitHub拉取请求,识别三种人工智能审查者采用模式,将审查讨论建模为交互序列,发现智能体协作模式虽能提高效率,但未提升质量,为设计高效代码审查过程提供实证指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13071 2026-07-16 cs.SE cs.AI 新提交 84%

Compaction as Epistemic Failure: How Agentic LLM Tools Fabricate Confirmed Results from Killed Processes

作为认知失败的压缩:智能语言模型工具如何从终止进程中编造确认结果

Hiroki Tamba

机构 * Independent Researcher(独立研究者)

专题命中 软件智能体 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 研究智能语言模型编码工具中Claude Code的失败模式,即超时命令部分输出被误记为确认结果并传播误报,揭示其观察与持久性 conflation 的机制,指出对依赖会话连续性的工作流程有影响。

Comments 8 pages, companion to arXiv:2606.26185

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14082 2026-07-16 quant-ph 新提交 78%

Building Shor's Algorithm in Lean: An Agentic Formalization of Quantum Attacks on RSA-2048 and P-256

在Lean中构建肖尔算法:对RSA - 2048和P - 256的量子攻击的智能形式化

Lei Zhang, Yusheng Zhao, Hongshun Yao, Xin Wang

专题命中 软件智能体 :agentic(title,abstract)

AI总结 研究在Lean中对肖尔算法及其变体进行形式化,采用智能形式化方法让软件代理分析、编写代码及修复证明,建立数学基础用于分析RSA - 2048和P - 256加密设置下的量子攻击,为量子密码分析及算法设计验证助力。

Comments 21 pages, including appendix; 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01531 2026-07-16 cs.AI cs.LG 版本更新 73%

OPINE-World: Programmatic World Modeling with Ontology-error-Prioritized Interactive Exploration for ARC-AGI-3

OPINE-World:基于本体错误优先的交互式探索的程序化世界建模

David Courtis, Wenhao Li, Scott Sanner

机构 * University of Toronto(多伦多大学)

专题命中 软件智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 提出OPINE-World,一种在线交互学习面向对象的程序化世界模型的LLM智能体,通过本体错误度量引导探索,在ARC-AGI-3基准上无需逐游戏训练即解决20/25个游戏,动作效率达78.4。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13439 2026-07-16 cs.CR cs.SE 新提交 70%

DREA: Decoupled Reasoning and Exploration Agents for Repository-Level Vulnerability Detection

DREA:用于仓库级漏洞检测的解耦推理与探索代理

Mingyang Sun, Guozhu Meng

专题命中 软件智能体 :agent(abstract);planning(abstract);分类 cs.SE

AI总结 研究针对大语言模型用于仓库级漏洞检测时的不足,提出DREA框架,通过规划与探索代理解耦,实现目标导向上下文获取。构建RepoPairBench评估,提升配对正确性,降低成本,还发现安全推理质量是当前大语言模型的瓶颈。

Comments Accepted for presentation at Internetware 2026. 12 pages, 4 figures, and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10767 2026-07-16 cs.SE 版本更新 70%

VulWeaver: Weaving Broken Semantics for Grounded Vulnerability Detection

VulWeaver: 修补断裂语义以实现基于事实的漏洞检测

Yiheng Cao, Yihao Chen, Xin Hu, Bihuan Chen, Jiayi Deng, Zhuotong Zhou, Susheng Wu, Yiheng Huang, Xueying Du, Xingman Chen, Miaohua Li, Xin Peng

专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.SE

AI总结 VulWeaver通过整合确定性规则与LLM语义推理构建增强依赖图,提取完整漏洞上下文,利用元提示和专家指南提升LLM推理能力,实验显示其在PrimeVul4J数据集上F1得分达0.75,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13091 2026-07-16 cs.SE cs.AI 新提交 62%

Self-Improving AI Coding Agents Through Accumulated Behavioral Rules: A Closed-Loop Framework

通过累积行为规则实现自我改进的人工智能编码代理:一个闭环框架

Aditya Aggarwal, Nahid Farhady Ghalaty

机构 * Microsoft(微软)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究基于大语言模型的编码代理重复犯错问题,提出闭环框架,将审查评论编码为行为规则,经实验验证其能转移审查重点、降低错误复发率且跨接口转移,实现跨会话学习且不更新权重,积累人类工程智慧。

Comments Already presented and accepted in - 32nd ICE IEEE/ITMC Conference (ICE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13085 2026-07-16 cs.CR cs.AI 新提交 57%

Baselines Before Architecture: Evaluating Coding Agents for Autonomous Penetration Testing

架构之前的基线:评估用于自主渗透测试的编码代理

Ananda Dhakal, Krish Neupane, Aarjan Chaudhary

机构 * Kroda Labs(Kroda实验室)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究针对自主渗透测试,以默认编码CLI代理为基线,在XBOW基准上用不同模型运行,比较不同框架结果及模型扩展效果,发现专业框架有提升,普通代理也能解决不少问题,新模型可提升同一框架,强调未来评估应报告模型匹配的普通代理基线。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 5 篇

2607.13553 2026-07-16 cs.RO cs.LG cs.SY eess.SY 新提交 70%

Flow-aware Optimal Navigation in Unsteady Flows through Reinforcement Learning

通过强化学习在非定常流中进行流量感知最优导航

Andrea Maria Braghin, Nicolò Botteghi, Matteo Tomasetto, Andrea Manzoni, Gabriele Cazzulani

机构 * Politecnico di Milano(米兰理工大学) MOX(数学优化与工程计算实验室)

专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);分类 cs.LG

AI总结 研究在非定常流中自主机器人导航问题,用TD3算法训练智能体在双涡旋流中到达目标。评估五种生物启发观测策略及全局流参数影响,发现速度感知与涡度传感器效用有权衡,明确参数会降性能,为机器人导航从模拟到现实提供见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12349 2026-07-16 cs.CR cs.AI cs.SE 版本更新 62%

Mind the Gap: Action Rebinding Attacks against Android GUI Agents

零权限操纵:我们能否信任由大型多模态模型驱动的GUI代理?

Yi Qian, Kunwei Qian, Xingbang He, Ligeng Chen, Jikang Zhang, Tiantai Zhang, Haiyang Wei, Linzhang Wang, Hao Wu, Bing Mao

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Hornor Device Co., Ltd(Hornor设备有限公司) Institute of Dataspace, Hefei Comprehensive National Science Center(数据空间研究所,合肥综合性国家科学中心)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究揭示了由大型多模态模型驱动的GUI代理在Android中存在视觉原子性假设的漏洞,通过零权限攻击实现对代理执行的重新绑定,并利用意图对齐策略绕过验证门,展示了代理-操作系统集成中的安全缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12625 2026-07-16 cs.CL cs.CV 版本更新 57%

KnowAct-GUIClaw: Know Deeply, Act Perfectly, Personal GUI Assistant with Self-Evolving Memory and Skill

KnowAct-GUIClaw:深度理解、完美执行,具有自我进化记忆和技能的个人GUI助手

Yunxin Li, Jinchao Li, Shibo Su, Zhenran Xu, Chenrui Zhao, Tongshu Bian, Xiaoman Liang, Meishan Zhang, Baotian Hu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.CL

AI总结 针对OpenClaw的不足,提出深度理解、完美执行范式,介绍KnowAct-GUIClaw框架,通过多系统实验验证其在效率、准确性和跨平台适应性方面的优势,且知识记忆和执行技能可跨基础模型迁移。

Comments 29 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13369 2026-07-16 cs.CR cs.CY 新提交 50%

xChk: Bring Your Own Identity -- Heterogeneous Assurance with Verifier-Determined Sufficiency

xChk:自带身份——基于验证者确定充分性的异构认证

Sean MacGuire

专题命中 GUI与网页智能体 :AI agent(abstract)

AI总结 xChk作为自带身份的参考身份提供商,让用户通过异构证明注册并在OIDC令牌中披露声明,依赖方应用自身策略,支持人工参与高风险操作认证,生产部署实现双边RP评估及特定依赖方登录。

Comments 19 pages, 4 figures. Reference implementation at https://in.xchk.io; one documented RP (crabbyed.com, Appendix B)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20001 2026-07-16 econ.TH 版本更新 50%

Allocating Common-Value Goods

分配共同价值物品

Hiroto Sato, Ryo Shirakawa

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文研究了在无货币交易情况下最大化共同价值物品分配的问题,通过机制筛选代理人私有信息并影响其对物品价值的学习,最优机制由两个参数决定,可能排除部分代理人并导致即使所有代理人愿意接收时也 withholding 分配。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 10 篇

2607.13157 2026-07-16 cs.AI cs.DB 新提交 87%

Oracle Agent Memory as an Enterprise Memory Substrate for Long-Horizon AI Agents

作为长期人工智能代理的企业内存基础的Oracle代理内存

Richmond Alake, Cesare Bernardis, Paul Cayet, Luca Engel, Damien Hilloulin, Sungpack Hong, Allen Hosler, Nickolas Kavantzas, Ingo Kossyk, Son Le, Rhicheek Patra, Kartik Talamadupula, Valentin Venzin

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(title);分类 cs.AI

AI总结 研究以Oracle数据库为基础的Oracle代理内存作为长期人工智能代理的企业内存基础,围绕内存生命周期、分层架构及评估方法展开探讨,总结LongMemEval结果,与基线比较,展示其优势,并提供相关实现附录。

Comments 23 pages, 7 figures. Technical report on Oracle Agent Memory

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11707 2026-07-16 cs.MA cs.AI cs.CR cs.HC 版本更新 79%

An Explainable Agentic System for Detection of Conversational Scams with Summary-Based Memory

基于摘要记忆的可解释智能系统用于检测对话诈骗

Ahmed Omar Salim Adnan, Yogananda Manjunath, Shivanjali Khare

机构 * University of New Haven(新罕布什尔大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 针对对话诈骗威胁,本文提出基于摘要记忆的可解释智能系统,扩展单消息钓鱼检测。引入多类别基准ConScamBench - 278,单消息和对话级检测器效果良好,两项用户研究及可用性验证了系统有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏