arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 590 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 590 篇

2407.12856 2025-08-12 cs.CL cs.AI cs.CY cs.LG 67%

AI-AI Bias: large language models favor communications generated by large language models

Walter Laurito, Benjamin Davis, Peli Grietzer, Tomáš Gavenčiak, Ada Böhm, Jan Kulveit

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 8 pages, 4 figures

Journal ref Proc. Natl. Acad. Sci. U.S.A. 122 (31) e2415697122 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07161 2025-08-05 cs.CL cs.AI cs.HC cs.LG 67%

Towards Actionable Pedagogical Feedback: A Multi-Perspective Analysis of Mathematics Teaching and Tutoring Dialogue

Jannatun Naim, Jie Cao, Fareen Tasneem, Jennifer Jacobs, Brent Milne, James Martin, Tamara Sumner

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) University of Oklahoma(俄克拉荷马大学) University of Chittagong(奇塔格昂大学) Saga Education(Saga教育)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments Accepted to EDM'2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01887 2025-06-10 cs.LG cs.AI cs.CL 67%

Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents

Fanzeng Xia, Hao Liu, Yisong Yue, Tongxin Li

机构 * The Chinese University of Hong Kong Shenzhen(香港中文大学(深圳)) California Institute of Technology(加州理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09024 2025-05-15 cs.AI cs.CL cs.LG 67%

Automated Meta Prompt Engineering for Alignment with the Theory of Mind

Aaron Baughman, Rahul Agarwal, Eduardo Morales, Gozde Akay

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 9 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11844 2025-04-17 cs.AI cs.CL cs.LG 67%

Evaluating the Goal-Directedness of Large Language Models

Tom Everitt, Cristina Garbacea, Alexis Bellot, Jonathan Richens, Henry Papadatos, Siméon Campos, Rohin Shah

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08640 2025-02-20 cs.LG cs.AI cs.CL cs.CV cs.CY 67%

Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs

Mantas Mazeika, Xuwang Yin, Rishub Tamirisa, Jaehyuk Lim, Bruce W. Lee, Richard Ren, Long Phan, Norman Mu, Adam Khoja, Oliver Zhang, Dan Hendrycks

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

Comments Website: https://www.emergent-values.ai

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10300 2024-06-21 cs.SE cs.CL cs.LG 67%

Large Language Models as Software Components: A Taxonomy for LLM-Integrated Applications

Irene Weber

专题命中 其他Agent :autonomous agent(abstract);分类 cs.CL、cs.LG、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04219 2024-05-08 cs.CL cs.AI cs.MA cs.SE 67%

Iterative Experience Refinement of Software-Developing Agents

Chen Qian, Jiahao Li, Yufan Dang, Wei Liu, YiFei Wang, Zihao Xie, Weize Chen, Cheng Yang, Yingli Zhang, Zhiyuan Liu, Maosong Sun

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.SE

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14717 2024-01-29 cs.CL cs.AI cs.LG cs.SD eess.AS 67%

Turn-taking and Backchannel Prediction with Acoustic and Large Language Model Fusion

Jinhan Wang, Long Chen, Aparna Khare, Anirudh Raju, Pranav Dheram, Di He, Minhua Wu, Andreas Stolcke, Venkatesh Ravichandran

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments To appear in IEEE ICASSP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07587 2023-11-17 cs.CL cs.AI cs.CY cs.LG 67%

Frontier Language Models are not Robust to Adversarial Arithmetic, or "What do I need to say so you agree 2+2=5?

C. Daniel Freeman, Laura Culp, Aaron Parisi, Maxwell L Bileschi, Gamaleldin F Elsayed, Alex Rizkowsky, Isabelle Simpson, Alex Alemi, Azade Nova, Ben Adlam, Bernd Bohnet, Gaurav Mishra, Hanie Sedghi, Igor Mordatch, Izzeddin Gur, Jaehoon Lee, JD Co-Reyes, Jeffrey Pennington, Kelvin Xu, Kevin Swersky, Kshiteej Mahajan, Lechao Xiao, Rosanne Liu, Simon Kornblith, Noah Constant, Peter J. Liu, Roman Novak, Yundi Qian, Noah Fiedel, Jascha Sohl-Dickstein

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.00416 2023-04-04 cs.AI cs.CL cs.CY cs.HC cs.LG 67%

Towards Healthy AI: Large Language Models Need Therapists Too

Baihan Lin, Djallel Bouneffouf, Guillermo Cecchi, Kush R. Varshney

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.01134 2023-01-16 cs.AI cs.CL cs.LG 67%

Language and Culture Internalisation for Human-Like Autotelic AI

Cédric Colas, Tristan Karch, Clément Moulin-Frier, Pierre-Yves Oudeyer

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

Journal ref Nature Machine Intelligence 4, 1068-1076 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.06414 2019-09-17 cs.CL cs.AI cs.LG 67%

Learning Household Task Knowledge from WikiHow Descriptions

Yilun Zhou, Julie A. Shah, Steven Schockaert

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments IJCAI 2019 Workshop on Semantic Deep Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.04386 2019-09-11 cs.AI cs.CL 66%

Attesting Biases and Discrimination using Language Semantics

Xavier Ferrer Aran, Jose M. Such, Natalia Criado

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL;autonomous agent(comments)

Comments Author's copy of the manuscript accepted in the Responsible Artificial Intelligence Agents workshop of the International Conference on Autonomous Agents and Multiagent Systems (AAMAS'19)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26418 2026-08-11 cs.AI cs.LG 版本更新 62%

Unbiased Canonical Set-Valued Oracles Via Lattice Theory

通过格论的无偏规范集值预言机

Jobst Heitzig

机构 * Pik-Potsdam(皮克-波茨坦)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对预言机自指问题,提出基于Knaster-Tarski不动点定理的规范集值预言机,输出无偏且自洽的credal集,并证明其存在性与非空性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05490 2026-08-07 cs.AI cs.LG stat.ML 新提交 62%

Innovation-Residual Auditing of Autonomous Analysis Agents: Localization, Detection Limits, Error Control, and Identifiability

自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性

Ahmed Hassoon, Mark Dredze

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21612 2026-07-27 cs.AI cs.LG 新提交 62%

Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures

过程性知识不是低秩的:为什么LoRA无法内化多步骤过程

Simon Dennis, Kevin Shabahang, Hao Guo, Rivaan Patil

机构 * University of Melbourne(墨尔本大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17883 2026-07-21 cs.CL cs.AI 新提交 62%

Zero Hallucination, by Construction: Hallucination-Aware Layered Oversight for Trustworthy Enterprise AI

通过构建实现零幻觉:用于可信企业人工智能的幻觉感知分层监督

Bogdan Raduta, Horia Velicu, Alexandru Preda, Serban Chiricescu

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 研究企业AI因幻觉难以被信任的问题时,提出HALO架构,通过六层防御将幻觉视为可控制故障模式,详细介绍各层并关注基于证据的置信度,以实现可信企业AI,在索赔提取工作负载上进行了架构说明。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13162 2026-07-20 cs.CL cs.AI 版本更新 62%

What Models Express, Suppress, and Resist: Auditing Open-Weight LLMs with Persona Vectors

模型表达、抑制和抗拒的内容:使用角色向量审计开放权重语言模型

Winston Zeng, Ali Emami, Jinho D. Choi

机构 * Emory University(埃默里大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL

AI总结 研究通过大规模系统应用角色向量审计开放权重语言模型,编制特征清单并标记其性质,发现模型默认行为特点,引导在默认外特征效果好,且角色向量可探测行为组织。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14141 2026-07-17 cs.AI cs.LG 新提交 62%

Human AI Construction of Bayesian Networks for Operational Decision Support -- A Virtual Survey Approach

用于运营决策支持的贝叶斯网络的人工AI构建——一种虚拟调查方法

Kumar Rahul, Shovan Chowdhury

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究如何构建贝叶斯网络用于运营决策支持,提出利用大语言模型的新方法,通过人工智能代理估计概率并去噪,开发六步框架,以客户咨询医生意图建模为例,揭示因素影响,得出有效策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30543 2026-07-07 cs.CL cs.AI 版本更新 62%

TRACE: Temporal Relationship-Aware Conversational Entrainment Detection in Dyadic Speech

TRACE: 双人语音中基于时间关系的对话韵律同步检测

Sathvik Manikantan Napa Ugandhar, Hao Zhang, Alison Gunzler, Yuzhe Wang, Thomas Thebaud, Georgi Tinchev, Venkatesh Ravichandran, Laureano Moro-Velázquez

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) Department of Electrical and Computer Engineering, Johns Hopkins University(约翰霍普金斯大学电气与计算机工程系) Amazon Research(亚马逊研究院) Amazon(亚马逊)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 提出TRACE框架,通过窗口级声学嵌入建模双人交互的时间序列,结合对话上下文和关系信息,在DyadEE数据集上实现97.01%的情感韵律同步检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26071 2026-06-29 cs.LG cs.AI 新提交 62%

Model Forensics: Investigating Whether Concerning Behavior Reflects Misalignment

模型取证:调查令人担忧的行为是否反映对齐失败

Aditya Singh, Gerson Kroiz, Senthooran Rajamanoharan, Neel Nanda

机构 * MATS

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出一个两步基线协议,通过读取思维链生成假设并编辑环境测试假设,以区分模型行为是出于恶意意图还是良性原因,并在六个环境中验证了该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24899 2026-06-25 cs.LG cs.AI quant-ph 新提交 62%

From Meta Idea to Advanced Mathematical Discovery -- Human-AI Co-Discovery of Sign-Embedding Quantum Algorithms

从元想法到高级数学发现——符号嵌入量子算法的人机协同发现

Yanqiao Wang, Jin-Peng Liu, Peng Li, Yang Liu

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过符号嵌入量子算法的案例,展示了人机协同发现如何将模糊研究直觉转化为具体问题、可行路线和定理族,其中AI辅助探索(包括AIM系统)在路线扩展、方案比较和框架收敛中发挥关键作用,而人类保留最终科学判断。

Comments 35 pasges, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23094 2026-06-23 cs.AI cs.CL 新提交 62%

Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind

认知数字孪生:模拟心智的AI系统的伦理风险与治理

Vamshi Krishna Bonagiri, Juan Nicolas Sepulveda-Arias, Abdoul Jalil Djiberou Mahamadou, Monojit Choudhury

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文定义认知数字孪生(CDT)为动态计算表示个体认知的系统,提出5A治理框架,识别CDT特有风险,并分析治理差距,强调需在认知表示层面进行治理。

Comments Work under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09563 2026-06-09 cs.AI cs.LG 新提交 62%

PRISM: Recovering Instruction Sets from Language Model Activations

PRISM:从语言模型激活中恢复指令集

Gilad Gressel, Rahul Pankajakshan, Julia Diament, Efim Hudis, Krishnashree Achuthan, Yisroel Mirsky

机构 * Center for Cybersecurity Systems & Networks, Amrita Vishwa Vidyapeetham(阿姆里塔·维什瓦·维迪亚佩瑟姆网络安全系统与网络中心) Microsoft(微软) Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出PRISM方法,通过激活条件解码从冻结目标模型隐藏状态中恢复活跃指令集,利用法官引导的GRPO优化,在多种场景下优于基线方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04433 2026-06-04 cs.CV cs.CL cs.LG 62%

Stateful Visual Encoders for Vision-Language Models

用于视觉-语言模型的有状态视觉编码器

Zirui Wang, Junwei Yu, Adam Yala, David M. Chan, Joseph E. Gonzalez, Trevor Darrell

机构 * University of California, Berkeley(加州大学伯克利分校) UC Berkeley(加州大学伯克利分校)

专题命中 其他Agent :agentic(abstract);分类 cs.CL、cs.LG

AI总结 提出有状态视觉编码器,通过将每个视觉表示条件于先前的视觉特征,增强视觉-语言模型在多图像、多轮交互中的视觉变化感知能力,在跨图像空间聚合、多目标视觉差异和轨迹行为克隆等任务上取得一致改进。

Comments Project page: https://statefulvisualencoders.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01212 2026-06-04 cs.CL cs.AI cs.CR cs.IR 62%

DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation

DiscourseFlip: 面向黑盒检索增强生成的非直述式语篇级观点操纵攻击

Yuyang Gong, Miaokun Chen, Jiawei Liu, Zhuo Chen, Guoxiu He, Wei Lu, XiaoFeng Wang, Xiaozhong Liu

机构 * Wuhan University(武汉大学) East China Normal University(华东师范大学) Nanyang Technological University(南洋理工大学) Worcester Polytechnic Institute(沃思堡理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出一种基于图引导的代理攻击方法DiscourseFlip,通过语义查询网络中的协同影响在有限预算下最大化语篇级观点偏差,实验证明其有效性和隐蔽性,并揭示现有防御的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01019 2026-06-02 cs.CL cs.AI 62%

Hybrid Verified Decoding: Learning to Allocate Verification in Speculative Decoding

混合验证解码:在推测解码中学习分配验证

Xin Su, Dawid Majchrowski, Fangyuan Yu, Vanshil Atul Shah, Sebastian Rogawski, Pawel Morkisz, Anahita Bhiwandiwalla, Phillip Howard

机构 * Thoughtworks Nvidia

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出混合验证解码方法,通过预测缓存草稿的接受长度并在缓存验证与模型草稿之间动态选择,在代理工作流中平均加速2.73倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28920 2026-05-29 cs.LG cs.AI stat.ML 62%

Conf-Gen: Conformal Uncertainty Quantification for Generative Models

Conf-Gen: 生成模型的共形不确定性量化

Gabriel Loaiza-Ganem, Kevin Zhang, Wei Cui, Marc T. Law, Kin Kwan Leung

机构 * layer6ai-labs(layer6ai实验室)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 提出Conf-Gen框架,通过共形风险控制适配生成任务,统一并扩展了共形预测在大型语言模型等生成模型中的应用,并在图像生成、对话AI和AI代理等新领域提供了形式化保证。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28255 2026-05-28 cs.AI cs.CL cs.HC 62%

AI, Take the Wheel: What Drives Delegation and Trust in Human-Computer Cooperative Question Answering?

AI,掌舵吧:是什么驱动人机协作问答中的委托与信任?

Maharshi Gor, Yoo Yeon Sung, Yu Hou, Eve Fleisig, Irene Ying, Tianyi Zhou, Jordan Boyd-Graber

机构 * University of Maryland(马里兰大学) University of California(加州大学) MBZUAI

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 通过问答游戏实验,研究人类在何时以及为何选择委托AI或采纳其建议,发现人类存在对AI正确建议的低依赖(3.9%)和错误建议的过度依赖(1.7%),并受确认偏见影响,建议通过校准置信度、基于证据的解释和信任细化机制来改进人机协作。

Comments Findings of the Association for Computational Linguistics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏