arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-15 至 2026-04-15 共收录 133 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 10 篇

2603.05044 2026-04-15 cs.AI 81%

WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents

WebFactory:自动化将基础语言智能压缩为 grounded Web agents

Sicheng Fan, Qingyun Shi, Shengze Xu, Shengbo Cai, Tieyong Zeng, Li Ling, Yanyi Shang, Dehan Kong

机构 * Fudan University(复旦大学) IMean AI The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学)

专题命中 GUI与网页智能体 :agent(summary_cn,abstract);分类 cs.AI

AI总结 WebFactory 提出了一种自动化闭环强化学习流程,将大语言模型的潜在知识高效压缩为可操作的 agent 行为,实现了数据效率和泛化能力的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07267 2026-04-15 cs.RO 67%

Bio-Inspired Topological Autonomous Navigation with Active Inference in Robotics

生物启发的拓扑自主导航与主动推断在机器人中的应用

Daria de Tinguy, Tim Verbelen, Emilio Gamba, Bart Dhoedt

机构 * Ghent University(根特大学) Verses Flanders Make(佛兰德斯制造)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 本文提出一种基于主动推断框架的生物启发代理,实现环境拓扑地图的实时生成与更新,通过概率推理框架实现可解释的导航,并在动态和未知环境中表现出鲁棒适应性。

Comments Conference ICCAS 2025 - accepted (in processing)

Journal ref Communications in Computer and Information Science, vol 2857, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12666 2026-04-15 cs.LG cs.CL cs.HC 62%

From Imitation to Discrimination: Progressive Curriculum Learning for Robust Web Navigation

从模仿到鉴别:面向鲁棒网络导航的渐进课程学习

Chuang Peng, Wei Zhang, Renshuai Tao, Xinhao Zhang, Jian Yang

机构 * Beijing Jiaotong University(北京交通大学) Beihang University(北京航空航天大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出Triton数据集和渐进训练课程,通过结构-语义硬负样本挖掘和双代理共识流程构建,提升网络导航中对复杂页面的鉴别能力与泛化能力,最终在Mind2Web上验证了专用数据课程优于单纯参数规模的优势。

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22364 2026-04-15 cs.RO cs.AI 57%

BINDER: Instantly Adaptive Mobile Manipulation with Open-Vocabulary Commands

BINDER: 基于开放词汇命令的即时自适应移动操作

Seongwon Cho, Daechul Ahn, Donghyun Shin, Hyeonbeom Choi, San Kim, Jonghyun Choi

机构 * Seoul National University(首尔国立大学) ECE, ASRI and IPAI in SNU(SNU的电子工程系、先进机器人研究所和智能感知与人工智能实验室)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 BINDER通过分离战略规划与连续环境监控,结合多模态大语言模型和视频大语言模型,实现动态环境下的高效移动操作,提升鲁棒性和适应性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12208 2026-04-15 cs.RO cs.AI 57%

Unveiling the Surprising Efficacy of Navigation Understanding in End-to-End Autonomous Driving

揭示端到端自动驾驶中导航理解的惊人效能

Zhihua Hua, Junli Wang, Pengfei LI, Qihao Jin, Bo Zhang, Kehua Sheng, Yilun Chen, Zhongxue Gan, Wenchao Ding

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) Didi Chuxing(滴滴出行) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出SNG框架,通过真实导航模式高效表示全局导航信息,结合导航路径与分步信息,提升自动驾驶的全局与局部规划能力,实现无需辅助损失函数的高精度导航建模。

Comments 8 pages, 6 figures. ICRA 2026. Code available at https://fudan-magic-lab.github.io/SNG-VLA-web

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05295 2026-04-15 cs.AI cs.CV 57%

WebChain: A Large-Scale Human-Annotated Dataset of Real-World Web Interaction Traces

WebChain:一个大规模的人工标注的真实世界网页交互轨迹数据集

Sicheng Fan, Rui Wan, Yifei Leng, Gaoning Liang, Li Ling, Yanyi Shang, Dehan Kong

机构 * Fudan University(复旦大学) IMean AI WebAgentLab

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出WebChain数据集,包含31,725条轨迹和318k步,通过视觉、结构和动作数据的三元对齐提供多模态监督,提出双中层训练方法,实现了WebChainBench等公开GUI基准的最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12872 2026-04-15 cs.RO 50%

OVAL: Open-Vocabulary Augmented Memory Model for Lifelong Object Goal Navigation

OVAL: 开放词汇增强记忆模型用于终身物体目标导航

Jiahua Pei, Yi Liu, Guoping Pan, Yuanhao Jiang, Houde Liu, Xueqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 OVAL提出一种开放词汇增强记忆框架,解决长期目标导航中的记忆限制问题,通过内存描述符和概率探索策略提升导航效率与鲁棒性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12565 2026-04-15 cs.RO cs.CV 50%

Scalable Trajectory Generation for Whole-Body Mobile Manipulation

可扩展的全身体态移动操作轨迹生成

Yida Niu, Xinhai Chang, Xin Liu, Ziyuan Jiao, Yixin Zhu

机构 * Institute for AI, Peking University(人工智能研究院,北京大学) Institute of Unmanned System, Beihang University(无人系统研究院,北航) School of Psychological and Cognitive Sciences, Peking University(心理学与认知科学学院,北京大学) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京行为与心理健康重点实验室,北京大学) Yuanpei College, Peking University(元培学院,北京大学) Embodied Intelligence Lab, PKU-Wuhan Institute for Artificial Intelligence(具身智能实验室,PKU-武汉人工智能研究所)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出AutoMoMa框架,通过GPU加速整合运动学模型与并行轨迹优化,生成大规模物理有效轨迹数据,解决全身体态移动操作中规模、多样性和运动学精度的瓶颈问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11920 2026-04-15 physics.geo-ph 50%

pDSurfTomo: A High-Performance Parallel Computing Package for Direct Surface Wave Tomography

pDSurfTomo:一种高性能并行计算包用于直接表面波反演

Shaohang Zhu, Junlun Li, Guoyi Chen, Hongjian Fang, Huajian Yao

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本文提出pDSurfTomo,通过混合CPU-GPU加速提升大规模高分辨率表面波反演效率,采用并行设计优化敏感核计算,结合OpenMP实现快速Marching方法并行化,利用GPU加速稀疏线性最小二乘问题求解,显著提升计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 记忆与上下文管理 13 篇

2604.12237 2026-04-15 cs.LG cs.AI cs.CL 82%

MolMem: Memory-Augmented Agentic Reinforcement Learning for Sample-Efficient Molecular Optimization

MolMem:基于记忆的代理强化学习用于样本高效的分子优化

Ziqing Wang, Yibo Wen, Abhishek Pandy, Han Liu, Kaize Ding

机构 * Northwestern University(西北大学) AbbVie(阿比维)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 MolMem通过双记忆系统提升分子优化的样本效率,利用静态示例记忆和进化技能记忆,实现90%的成功率和52%的多属性任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12016 2026-04-15 cs.AI cs.LG 81%

Identity as Attractor: Geometric Evidence for Persistent Agent Architecture in LLM Activation Space

身份作为吸引子:LLM激活空间中持久代理架构的几何证据

Vladimir Vasilenko

机构 * Independent Researcher(独立研究者) Rapallo, Italy(意大利拉帕洛)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 研究通过对比不同条件下的隐藏状态,发现语义相似的提示在LLM激活空间中呈现吸引子行为,证明代理身份文档在激活空间中诱导吸引子几何结构。

Comments 16 pages, 5 figures. Code and data: https://github.com/b102e/yar-attractor-experiment

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12999 2026-04-15 cs.CV 78%

Agentic Discovery with Active Hypothesis Exploration for Visual Recognition

具有主动假设探索的代理发现用于视觉识别

Jaywon Koo, Jefferson Hernandez, Ruozhen He, Hanjie Chen, Chen Wei, Vicente Ordonez

机构 * Rice University(里士大学)

专题命中 记忆与上下文管理 :agentic(title,abstract)

AI总结 本文提出HypoExplore框架,通过进化分支发现视觉识别的神经网络架构,通过大语言模型生成假设并评估改进,最终在CIFAR-10上实现94.11%的准确率,并在其他数据集上展示出优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12231 2026-04-15 cs.CL cs.IR 74%

Thought-Retriever: Don't Just Retrieve Raw Data, Retrieve Thoughts for Memory-Augmented Agentic Systems

Thought-Retriever: 不只是检索原始数据,为记忆增强型智能体检索思想

Tao Feng, Pengrui Han, Guanyu Lin, Ge Liu, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Carnegie Mellon University(卡内基梅隆大学)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.CL

AI总结 本文提出Thought-Retriever,一种无需受上下文长度限制的算法,使LLM能基于任意长外部数据生成输出。通过利用历史查询生成的中间响应,构建长期记忆,提升回答能力。

Journal ref Transactions on Machine Learning Research (TMLR), 04/2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12357 2026-04-15 cs.AI cs.CV 70%

ReflectCAP: Detailed Image Captioning with Reflective Memory

ReflectCAP: 基于反思记忆的详细图像描述

Kyungmin Min, Minbeom Kim, Kang-il Lee, Seunghyun Yoon, Kyomin Jung

机构 * IPAI, Seoul National University(首尔国立大学IPAI) Dept. of ECE, Seoul National University(首尔国立大学电子与计算机工程系) Adobe Research(Adobe研究)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 ReflectCAP通过反思笔记指导生成详细且准确的图像描述,平衡事实性和覆盖性,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07248 2026-04-15 cs.MA cs.HC 67%

DarwinTOD: LLM-driven Lifelong Self-evolution for Task-oriented Dialog Systems

DarwinTOD: 基于LLM的持续自我进化任务导向对话系统

Shuyu Zhang, Yujie Liu, Xinru Wang, Cheng Zhang, Yanmin Zhu, Bin Li

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 DarwinTOD通过整合进化计算与LLM驱动的自我改进,提出一种持续自我进化对话框架,实现零样本基础下的持续策略优化,无需任务特定微调。

Comments Accepted in ACL2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12948 2026-04-15 cs.AI 57%

Drawing on Memory: Dual-Trace Encoding Improves Cross-Session Recall in LLM Agents

基于记忆的绘制:双轨迹编码提升LLM代理跨会话回忆

Benjamin Stern, Peter Nadel

机构 * Tufts University(塔夫茨大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出双轨迹编码方法,通过将事实与具体场景描述结合,提升LLM代理在跨会话中的回忆能力,实验显示在时间推理、知识更新追踪和多会话聚合方面有显著提升。

Comments 16 pages, 2 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07238 2026-04-15 cs.CL q-bio.NC 57%

Speaker effects in language comprehension: An integrative model of language and speaker processing

说话者效应在语言理解中的作用:语言与说话者处理的整合模型

Hanlin Wu, Zhenguang G. Cai

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.CL

AI总结 本文提出整合语言与说话者处理的模型,探讨说话者效应通过感知和预期调节语言理解,并讨论其在语言发展和社会认知中的应用。

Journal ref Psychon Bull Rev 33, 138 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12179 2026-04-15 cs.CL cs.IR 57%

AgenticAI-DialogGen: Topic-Guided Conversation Generation for Fine-Tuning and Evaluating Short- and Long-Term Memories of LLMs

AgenticAI-DialogGen:基于主题引导的对话生成用于微调和评估LLM的短期和长期记忆

Manoj Madushanka Perera, Adnan Mahmood, Kasun Eranda Wijethilake, Quan Z. Sheng

机构 * School of Computing, Macquarie University(麦考瑞大学计算机学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 本文提出AgenticAI-DialogGen框架,通过生成基于角色和主题的对话来微调和评估LLM的短期和长期记忆,引入了TopicGuidedChat数据集以提升对话质量和模型性能。

Comments 13 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12034 2026-04-15 cs.AI 57%

Memory as Metabolism: A Design for Companion Knowledge Systems

记忆作为代谢:一种陪伴知识系统的 设计

Stefan Miteski

机构 * CODE University Berlin(CODE大学柏林)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出一种针对单用户知识维基的治理框架,通过五项操作处理记忆中的矛盾证据,以避免固化问题。

Comments 41 pages, 1 table. Preprint v3.642. Concept DOI: 10.5281/zenodo.19501651

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12007 2026-04-15 cs.AI 57%

When to Forget: A Memory Governance Primitive

何时遗忘:一种记忆治理原语

Baris Simsek

机构 * Baris Simsek(巴里·西姆塞克)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出Memory Worth,一种通过跟踪记忆与成功/失败结果共现次数来评估记忆质量的机制,为动态管理提供理论基础,并在实验中验证其有效性。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10815 2026-04-15 cs.SD cs.AI cs.MA 57%

MeloTune: On-Device Arousal Learning and Peer-to-Peer Mood Coupling for Proactive Music Curation

MeloTune:设备端唤醒学习与点对点情绪耦合用于主动音乐编曲

Hongwei Xu

机构 * Hongwei Xu(许洪伟)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 MeloTune通过设备端唤醒学习与点对点情绪耦合,实现基于情绪感知的主动音乐编曲,采用闭式连续时间网络和认知记忆块整合,提升音乐推荐准确性与用户满意度。

Comments 31 pages, 1 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12699 2026-04-15 physics.chem-ph physics.comp-ph 50%

Transferable excited-state dynamics enable screening of fluorescent protein chromophores

可迁移的激发态动力学使荧光蛋白色素的筛选成为可能

Rhyan Barrett, Sophia Wesely, Julia Westermayr

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本文提出X-MACE机器学习势能,结合曲率驱动表面跃迁,实现高效筛选光化学路径,通过荧光色素示例展示结构修饰对激发态弛豫、寿命和光异构化产率的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Agent评测 21 篇

2604.09121 2026-04-15 cs.CL cs.AI cs.SD 84%

Interactive ASR: Towards Human-Like Interaction and Semantic Coherence Evaluation for Agentic Speech Recognition

交互式语音识别:迈向人样交互和语义连贯性评估的代理语音识别

Peng Wang, Yanqiao Zhu, Zixuan Jiang, Qinyuan Chen, Xingjian Zhao, Xipeng Qiu, Wupeng Wang, Zhifu Gao, Xiangang Li, Kai Yu, Xie Chen

机构 * X-LANCE Lab, Shanghai Jiao Tong University(上海交通大学X-LANCE实验室) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Xi'an Jiaotong University(西安交通大学) Fudan University(复旦大学) Tongyi Fun Team, Alibaba Group(阿里巴巴集团 Tongyi 团队)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出基于LLM的代理框架,通过语义反馈提升语音识别的语义准确性和交互修正能力,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07674 2026-04-15 q-fin.GN 83%

The relationship between general equilibrium models with infinite-lived agents and overlapping generations models, and some applications

一般均衡模型中无限寿命 agent 与重叠世代模型的关系及其一些应用

Ngoc-Sang Pham

专题命中 Agent评测 :agent(title_cn,summary_cn)

AI总结 本文研究了无限寿命 agent 一般均衡模型与重叠世代模型的关系,证明了两者在均衡条件下的相互转化,并探讨了其在经济应用中的意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12986 2026-04-15 cs.CR cs.AI 83%

Parallax: Why AI Agents That Think Must Never Act

Parallax:为什么具有思考能力的AI代理必须永不行动

Joel Fokou

机构 * Independent Researcher(独立研究者)

专题命中 Agent评测 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出Parallax框架,通过认知-执行分离、对抗验证与渐进确定性、信息流控制和可逆执行四大原则,解决具有执行能力的AI代理安全问题,实验显示其在98.9%的攻击中有效阻止。

Comments 20 pages, 1 figure, 5 tables. Open-source reference implementation: https://github.com/openparallax/openparallax. Documentation: https://docs.openparallax.dev. Feedback welcome via email or GitHub issues

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12717 2026-04-15 cs.AI 83%

Transferable Expertise for Autonomous Agents via Real-World Case-Based Learning

通过现实世界案例学习实现自主代理的可迁移专业技能

Zhenyu Ma, Yuyang Song, Chunyi Yang, Jingyi Zhu, Letian Yang, Xukai Jiang

机构 * National Glycoengineering Research Center, Shandong University(山东大学糖工程研究中心) State Key Laboratory of Microbial Technology, Shandong University(山东省微生物技术重点实验室)

专题命中 Agent评测 :autonomous agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出基于案例学习的框架,通过将过往任务经验转化为可重用的知识资产,使自主代理能迁移先前经验以执行更结构化的分析,在六个复杂任务类别基准测试中表现优异,尤其在复杂任务上优势显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09729 2026-04-15 cs.CV cs.AI 83%

LOLGORITHM: Funny Comment Generation Agent For Short Videos

LOLGORITHM:短视频 funny 评论生成代理

Xuan Ouyang, Bouzhou Wang, Senan Wang, Siyuan Xiahou, Jinrong Zhou, Yuekang Li

机构 * University of New South Wales(新南威尔士大学) University of Sydney(悉尼大学) The University of Hong Kong(香港大学) University of Southern California(南加州大学)

专题命中 Agent评测 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出LOLGORITHM框架,通过视频摘要、分类和语义检索生成符合平台文化的短视频评论,实验显示其在YouTube和抖音上的人类偏好选择率高达80.46%和84.29%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05206 2026-04-15 cs.CR cs.AI cs.CL cs.CV 81%

Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety

大规模安全:大型模型和智能体安全的全面综述

Xingjun Ma, Yifeng Gao, Yixu Wang, Ruofan Wang, Xin Wang, Ye Sun, Yifan Ding, Hengyuan Xu, Yunhao Chen, Yunhan Zhao, Hanxun Huang, Yige Li, Yutao Wu, Jiaming Zhang, Xiang Zheng, Yang Bai, Zuxuan Wu, Xipeng Qiu, Jingfeng Zhang, Yiming Li, Xudong Han, Haonan Li, Jun Sun, Cong Wang, Jindong Gu, Baoyuan Wu, Siheng Chen, Tianwei Zhang, Yang Liu, Mingming Gong, Tongliang Liu, Shirui Pan, Cihang Xie, Tianyu Pang, Yinpeng Dong, Ruoxi Jia, Yang Zhang, Shiqing Ma, Xiangyu Zhang, Neil Gong, Chaowei Xiao, Sarah Erfani, Tim Baldwin, Bo Li, Masashi Sugiyama, Dacheng Tao, James Bailey, Yu-Gang Jiang

机构 * Fudan University(复旦大学) The University of Melbourne(墨尔本大学) Singapore Management University(新加坡国立大学) Deakin University(德肯大学) Hong Kong University of Science and Technology(香港科学与技术大学) City University of Hong Kong(香港城市大学) University of Oxford(牛津大学) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) The University of Sydney(悉尼大学) Griffith University(格里菲斯大学) University of California, Santa Cruz(加州大学圣克鲁兹分校) Sea AI Lab(Sea AI实验室) Tsinghua University(清华大学) Virginia Tech(弗吉尼亚理工大学) CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全部) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Purdue University(普渡大学) Duke University(杜克大学) University of Wisconsin - Madison(威斯康星大学麦迪逊分校) RIKEN(理化学研究所) The University of Tokyo(东京大学)

专题命中 Agent评测 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文综述了大型模型和智能体的安全性,分析了各类攻击威胁及防御策略,指出安全评估、防御机制和数据实践的重要性,强调研究社区和国际合作的必要性。

Comments 706 papers, 60 pages, 3 figures, 14 tables; GitHub: https://github.com/xingjunm/Awesome-Large-Model-Safety

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11767 2026-04-15 cs.PL cs.MA cs.SE 79%

$λ_A$: A Typed Lambda Calculus for LLM Agent Composition

$λ_A$: 一种用于LLM代理组合的类型lambda演算

Qin Liu

专题命中 Agent评测 :agent(title,abstract);分类 cs.SE

AI总结 本文提出$λ_A$类型lambda演算,通过引入oracle调用、有界固定点、概率选择和可变环境扩展简单类型lambda演算,证明类型安全性和终止性,并展示其在代理配置检测中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12513 2026-04-15 cs.LG 79%

Agentic Control in Variational Language Models

变分语言模型中的代理控制

Yves Ruffenach

机构 * Conservatoire National des Arts et Métiers(法国国立艺术与工艺学院)

专题命中 Agent评测 :agentic(title,abstract);分类 cs.LG

AI总结 本文研究变分语言模型能否通过内部证据实现最小化的代理控制,提出结合局部变分隐藏计算、结构感知检查点保留和校准的不确定性控制器,实验证明其在语言建模任务中优于确定性模型,并展示了更丰富的不确定性特征。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏