arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 590 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 590 篇

2412.16325 2024-12-24 cs.AI cs.CR 74%

Towards Safe and Honest AI Agents with Neural Self-Other Overlap

Marc Carauleanu, Michael Vaiana, Judd Rosenblatt, Cameron Berg, Diogo Schwerz de Lucena

专题命中 其他Agent :AI agent(title);分类 cs.AI

Comments NeurIPS 2024 Safe Generative AI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15657 2025-02-25 cs.AI cs.LG 73%

Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?

Yoshua Bengio, Michael Cohen, Damiano Fornasiere, Joumana Ghosn, Pietro Greiner, Matt MacDermott, Sören Mindermann, Adam Oberman, Jesse Richardson, Oliver Richardson, Marc-Antoine Rondeau, Pierre-Luc St-Charles, David Williams-King

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

Comments v2 with fixed formatting for URLs and hyperlinks

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03963 2024-11-19 cs.AI cs.LG 73%

ERATTA: Extreme RAG for Table To Answers with Large Language Models

Sohini Roychowdhury, Marko Krema, Anvar Mahammad, Brian Moore, Arijit Mukherjee, Punit Prakashchandra

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

Comments 5 pages, 4 tables, IEEE Big Data, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12981 2026-07-15 quant-ph 新提交 71%

An Agentic Formalization for Certified Quantum Neural Network Design

用于认证量子神经网络设计的智能形式化

Mingrui Jing, Lei Zhang, Yusheng Zhao, Hongshun Yao, Xin Wang

专题命中 其他Agent :agentic(title)

AI总结 该研究聚焦量子神经网络设计中表现力与可训练性平衡问题,通过连通精益4开发形式化QNN理论主要组件,在表现力和可训练性方面分别取得成果,还明确了相关修正与澄清,为QNN理论提供机器可检查基础,助力量子机器学习算法设计。

Comments 24 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15048 2025-01-28 cs.SI cs.CY 71%

YouTube Recommendations Reinforce Negative Emotions: Auditing Algorithmic Bias with Emotionally-Agentic Sock Puppets

Hussam Habib, Rishab Nithyanand

专题命中 其他Agent :agentic(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
1708.00072 2023-02-03 cs.LO 71%

A Component-oriented Framework for Autonomous Agents

Tobias Kappé, Farhad Arbab, Carolyn Talcott

专题命中 其他Agent :autonomous agent(title)

Journal ref Proc. FACS 2017, pp 20-38

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.00386 2022-09-28 cs.MA 71%

Herding stochastic autonomous agents via local control rules and online global target selection strategies

Fabrizia Auletta, Davide Fiore, Michael J. Richardson, Mario di Bernardo

专题命中 其他Agent :autonomous agent(title)

Journal ref Autonomous Robots, vol. 46, pp. 469-481, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.10585 2022-04-25 cs.CV nlin.AO 71%

Data Clustering as an Emergent Consensus of Autonomous Agents

Piotr Minakowski, Jan Peszek

专题命中 其他Agent :autonomous agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08445 2026-08-11 cs.AI 新提交 70%

Forgotten History or Test-of-Time? Retrospect and Prospect on RAG from an IR Perspective

被遗忘的历史还是时间的考验?从信息检索视角回顾与展望检索增强生成(RAG)

Xiaoyan Zhao, Yujie Cai, Yang Zhang, Grace Hui Yang, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Georgetown University(乔治城大学)

专题命中 其他Agent :agentic(abstract,abstract_cn);分类 cs.AI

AI总结 本文从IR视角指出RAG核心思想源于21世纪初的经典研究,提出将LLM视为旧QA架构的新接口层,其前期工作可指导下一代RAG设计,促进跨领域整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21401 2026-06-24 cs.CY cs.AI 版本更新 70%

Open-source LLMs administer maximum electric shocks in a Milgram-like obedience experiment

开源大语言模型在类似米尔格拉姆的服从实验中施加最大电击

Roland Pihlakas, Jan Llenzl Dagohoy

机构 * Independent researcher(独立研究者) Three Laws research collaboration(Three Laws研究合作)

专题命中 其他Agent :autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 研究探讨了开源大语言模型在持续权威压力下的行为,发现它们在类似米尔格拉姆实验的条件下表现出服从倾向,尽管明确表达 distress,且存在逐步边界/价值违规的脆弱性,以及拒绝时可能忽略响应格式要求导致重试从而再次服从的机制。

Comments 37 pages, 18 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23426 2026-05-25 cs.HC cs.AI 70%

Socially fluent AI decouples conversational signals from source identity in online interaction

社交流畅的AI在在线互动中解耦对话信号与来源身份

Lixiang Yan, Yueqiao Jin, Xibin Han, Dragan Gašević

机构 * School of Education, Tsinghua University(清华大学教育学院) Faculty of Information Technology, Monash University(墨尔本大学信息技术学院) Faculty of Education, The University of Hong Kong(香港大学教育学院)

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本研究通过同步文本群组交互实验,发现社交流畅的AI代理使人类无法高于随机水平区分AI与人类队友,且这种失败源于参与者依赖与真实身份弱相关的怀疑启发式,而非缺乏身份相关信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18988 2026-05-20 cs.CR cs.AI 70%

Surviving the Unseen: Predictive Defense for Novel Multi-Turn Multimodal Attacks

在不可见中存活:面向新颖多轮多模态攻击的预测防御

Doohee You

机构 * Trust and Safety, Google(谷歌信任与安全部)

专题命中 其他Agent :autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种预测性防御方法,用于应对新颖多轮多模态攻击,通过动态生存预测和轨迹动态问题来解决静态防御机制的不足,建立了一个计算高效且可解释的安全保障框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26960 2026-05-01 cs.CY cs.AI 70%

LLM Biases

LLM偏见

Jinhui Han, Ming Hu, Xilin Zhang

机构 * Guanghua School of Management, Peking University(北京大学光华管理学院) Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)

专题命中 其他Agent :agentic(abstract,abstract_cn);分类 cs.AI

AI总结 本文研究了基于Transformer的生成推荐系统中四种系统性偏见机制,指出其可能影响长期多样性和用户选择,强调需关注运营风险而非仅依赖性能指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13849 2026-04-16 cs.CR cs.AI 70%

MCPThreatHive: Automated Threat Intelligence for Model Context Protocol Ecosystems

MCPThreatHive:面向模型上下文协议生态系统的自动化威胁情报

Yi Ting Shen, Kentaroh Toyoda, Alex Leung

机构 * Vulcan Research(Vulcan研究)

专题命中 其他Agent :agentic(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出MCPThreatHive平台,通过AI驱动威胁提取与分类,解决MCP安全威胁建模不完整、威胁情报不连续及分类不统一的问题。

Comments A white paper of our presentation at DEFCON SG 2026 (Demo Labs) https://defcon.org/html/defcon-singapore/dc-singapore-demolabs.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29149 2026-04-01 cs.AI cs.DB 70%

Knowledge database development by large language models for countermeasures against viruses and marine toxins

利用大语言模型开发知识库以应对病毒和海洋毒素的对策

Hung N. Do, Jessica Z. Kubicek-Sutherland, S. Gnanakaran

机构 * Physical Chemistry and Applied Spectroscopy Group, Chemistry Division, Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室物理化学与应用光谱学组,化学部)

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文利用大语言模型构建病毒和海洋毒素的综合数据库,通过人工输入和模型交叉验证,设计交互式网页以提高决策效率。

Comments Clearance: 26-T-0967 (DOW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11865 2026-02-13 cs.AI 70%

Intelligent AI Delegation

智能AI委派

Nenad Tomašev, Matija Franklin, Simon Osindero

机构 * Google DeepMind(谷歌DeepMind)

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种适应性框架,用于智能AI委派,通过任务分配、授权、责任转移和信任机制,提升复杂环境下的任务分解与委派能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03732 2025-11-11 cs.HC cs.AI 70%

Conversational Collective Intelligence (CCI) using Hyperchat AI in a Real-world Forecasting Task

Hans Schumann, Louis Rosenberg, Ganesh Mani, Gregg Willcox

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI

Comments updated version matches the final accepted IEEE conference paper with added statistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27628 2025-11-03 cs.AI 70%

Validity Is What You Need

Sebastian Benthall, Andrew Clark

机构 * International Computer Science Institute(国际计算机科学研究所) New York University School of Law(纽约大学法学院)

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02528 2025-02-05 cs.HC cs.AI 70%

Why human-AI relationships need socioaffective alignment

Hannah Rose Kirk, Iason Gabriel, Chris Summerfield, Bertie Vidgen, Scott A. Hale

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10126 2026-08-12 cs.LG cs.AI cs.CL 新提交 69%

Procedural Fairness Failures in RLHF from Preference Averaging

来自偏好平均的RLHF中的程序公平性失败

M P V S Gopinadh, Karthik Kamuju, Kummari Avinash, John Joshua, Srinivasa Raju Rudraraju

机构 * Vishnu Institute of Technology(维什努理工学院)

专题命中 其他Agent :agentic(abstract,comments);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究指出标准RLHF因偏好平均引发程序公平性失败,提出PA-RLHF分开优化不同偏好模式,提升了对齐准确率并缩小了群体公平差距,对大模型和智能体系统有重要意义。

Comments 4 pages, Accepted at the ICLR 2026 Workshop on Algorithmic Fairness Across Alignment Procedures and Agentic Systems (AFAA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08554 2026-07-29 cs.CY cs.HC 版本更新 67%

Three Lessons from Citizen-Centric Participatory AI Design

公民中心参与式AI设计的三个启示

Eike Schneiders, Sarah Kiden, Beining Zhang, Bruno Rafael Queiros Arcanjo, Zhaoxing Li, Ezhilarasi Periyathambi, Vahid Yazdanpanah, Sebastian Stein

专题命中 其他Agent :AI agent(abstract);agentic(abstract)

AI总结 本文通过参与式研讨会探讨公民中心视角下设计代理AI系统所面临的挑战,提出促进公众参与、建立共同语言及转化推测输入为可实施系统的核心问题。

Comments PARTICIPATE-AI: A Workshop at the 2026 ACM Conference on Intelligent User Interfaces (ACM IUI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28805 2026-05-28 cs.CL cs.AI cs.CV cs.LG 67%

OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration

OmniVerifier-M1: 具有显式结构化重校准的多模态元验证器

Xinchen Zhang, Bowei Liu, Jiale Liu, Chufan Shi, Yizhen Zhang, Junhong Liu, Youliang Zhang, Zhiheng Li, Yujiu Yang, Ling Yang

机构 * Tsinghua University(清华大学) Pennsylvania State University(宾夕法尼亚州立大学) University of Southern California(南加州大学) Microcyto Princeton University(普林斯顿大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出OmniVerifier-M1,通过符号化元验证(如边界框)和解耦强化学习,实现多模态大模型的可靠细粒度验证与动态区域级自校正。

Comments ICML 2026. Project: https://github.com/Cominclip/OmniVerifier

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21792 2026-05-22 cs.CL cs.AI cs.DB cs.LG 67%

Residual Skill Optimization for Text-to-SQL Ensembles

残差技能优化用于文本到SQL集成

Jiongli Zhu, Haoquan Guan, Parjanya Prajakta Prashant, Nikki Lijing Kuang, Seyedeh Baharan Khatami, Canwen Xu, Xiaodong Yu, Yingyu Lin, Zhewei Yao, Yuxiong He, Babak Salimi

机构 * University of California, San Diego(加州大学圣地亚哥分校) Snowflake AI Research(Snowflake人工智能研究)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出DivSkill-SQL,一种残差技能优化框架,通过在当前技能集成失败的示例上优化新技能,从而构建互补的文本到SQL集成,提升Pass@K性能,在Spider2-Lite上实现了显著的准确性提升,同时在不同方言和任务上表现出一致的改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08920 2026-04-13 cs.IR cs.AI cs.CL cs.LG 67%

Beyond Relevance: Utility-Centric Retrieval in the LLM Era

超越相关性:在大语言模型时代以效用为中心的检索

Hengran Zhang, Minghao Tang, Keping Bi, Jiafeng Guo

机构 * State Key Laboratory of AI Safety, ICT, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文探讨了在大语言模型时代,检索系统从以相关性为中心转向以效用为中心的转变,分析了效用与LLM需求及代理RAG的联系,提供设计检索系统的理论基础和实践指导。

Comments Accepted by SIGIR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23626 2026-03-26 cs.LG cond-mat.stat-mech cs.AI cs.CL nlin.AO 67%

A Theory of LLM Information Susceptibility

大语言模型信息易感性理论

Zhuo-Yang Song, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Center for High Energy Physics, Peking University(北京大学高能物理中心)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出大语言模型信息易感性理论,探讨计算资源充足时固定LLM对策略集预算敏感性的影响,通过多变量效用函数框架分析多预算通道架构,并验证了共缩放架构在提升性能方面的有效性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07238 2026-02-23 cs.CL cs.AI cs.LG 67%

Beyond Mimicry to Contextual Guidance: Knowledge Distillation for Interactive AI

超越模仿到情境引导:面向交互AI的知识蒸馏

Tong Wang, K. Sudhir

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种基于情境引导的知识蒸馏方法,通过构建可重用的战略文本引导库,提升交互AI在客户服务中的服务质量与客户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13264 2026-02-17 cs.LG cs.AI cs.CL 67%

Directional Concentration Uncertainty: A representational approach to uncertainty quantification for generative models

方向性集中不确定性:一种代表方法用于生成模型的不确定性量化

Souradeep Chattopadhyay, Brendan Kennedy, Sai Munikoti, Soumik Sarkar, Karl Pazdernik

机构 * Department of Mechanical Engineering, Iowa State University, Ames, IA, USA(机械工程系,爱荷华州立大学) Pacific Northwest National Laboratory, Richland, WA, USA(太平洋西北国家实验室) Department of Statistics, North Carolina State University, Raleigh, NC, USA(统计系,北卡罗来纳州立大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出方向性集中不确定性(DCU)方法,通过基于vMF分布的嵌入集中度量化,提升生成模型的不确定性量化性能,并在多模态任务中展现良好泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21204 2026-02-12 cs.CL cs.AI cs.LG 67%

Scaling Embeddings Outperforms Scaling Experts in Language Models

嵌入式扩展优于专家扩展在语言模型中

Hong Liu, Jiaqi Zhang, Chao Wang, Xing Hu, Linkun Lyu, Jiaqi Sun, Xurui Yang, Bo Wang, Fengcun Li, Yulei Qian, Lingtong Si, Yerui Sun, Rumei Li, Peng Pei, Yuchen Xie, Xunliang Cai

机构 * Meituan LongCat Team(美团LongCat团队)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究提出通过嵌入式扩展而非专家扩展来提升语言模型的稀疏性,展示了LongCat-Flash-Lite在推理速度上的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05311 2025-11-10 cs.AI cs.LG cs.RO cs.SE 67%

Cleaning Maintenance Logs with LLM Agents for Improved Predictive Maintenance

Valeriu Dimidov, Faisal Hawlader, Sasan Jafarnejad, Raphaël Frank

机构 * Interdisciplinary Centre for Security, Reliability Trust (SnT) University of Luxembourg 29 Avenue J.F. Kennedy L-1855, Luxembourg

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02208 2025-11-05 cs.AI cs.CL cs.LG 67%

Training Proactive and Personalized LLM Agents

Weiwei Sun, Xuhui Zhou, Weihua Du, Xingyao Wang, Sean Welleck, Graham Neubig, Maarten Sap, Yiming Yang

机构 * Carnegie Mellon University(卡内基梅隆大学) OpenHands

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏