arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 590 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 590 篇

2606.29389 2026-06-30 cs.CR cs.LG 57%

Exploring the Cryptographic Limits of Transformer Networks

探索Transformer网络的密码学极限

Stefan Domunco, Andis Draguns, Philip Torr, Isaac Robinson, Christian Schroeder de Witt

专题命中 其他Agent :AI agent(abstract);分类 cs.LG

AI总结 研究Transformer能否实现密码学函数,通过将Keccak、Merkle-Damgård和Merkle树构造映射为阈值电路,并进一步映射到Transformer架构,推导出宽度和深度的缩放律,建立Transformer计算能力结构性上限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27951 2026-06-29 cs.CY cs.CL cs.HC physics.soc-ph 新提交 57%

AI Persuasive Framing in Collective Dilemmas

集体困境中的AI说服性框架

Anders Giovanni Møller, Alessia Galdeman, Arianna Pera, Luca Maria Aiello

机构 * Data Science Section, IT University of Copenhagen(丹麦哥本哈根IT大学数据科学系) Computer Science Department, University of Milan(意大利米兰大学计算机科学系) Copenhagen Center for Social Data Science, University of Copenhagen(丹麦哥本哈根大学哥本哈根社会科学数据科学中心)

专题命中 其他Agent :AI agent(abstract);分类 cs.CL

AI总结 本研究通过集体风险博弈实验,测试AI助手使用个性化说服框架对合作行为的影响,发现亲社会效应短暂而反社会效应持久,揭示了AI影响集体行动的双重用途风险。

Comments The first two authors contributed equally to this research. The article contains 20 pages, 10 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01299 2026-06-25 astro-ph.IM cs.AI 版本更新 57%

Domain-Specific Agents for Cherenkov Telescope Array Control Software and Gamma-Ray Data Analysis

用于切伦科夫望远镜阵列控制软件和伽马射线数据分析的领域专用智能体

Dmitriy Kostunin, Elisa Jones, Vladimir Sotnikov, Valery Sotnikov, Sergo Golovachev, Alexandre Strube

机构 * Deutsches Elektronen-Synchrotron DESY(德意志电子同步辐射研究中心) JetBrains Limited(JetBrains有限公司) JetBrains GmbH(JetBrains德国公司) Jülich Supercomputing Centre(吕贝克超级计算中心)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出领域自适应的大语言模型智能体,结合上下文知识、自动验证和迭代修正,支持切伦科夫望远镜阵列操作与数据分析,减少人工、提高一致性并加速工作流。

Comments EuCAIFCon 2025 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06747 2026-06-19 cs.SE 新提交 57%

Tensor Algebraic Property Skeletons: Amplifying Property-Based Testing for AI Compilers

张量代数性质骨架:增强AI编译器的基于性质的测试

Yuxin Qiu, Ben Limpanukorn, Seongmin Lee, Jiyuan Wang, Qian Zhang, Miryung Kim

专题命中 其他Agent :agentic(abstract);分类 cs.SE

AI总结 提出Propilot框架,利用LLM将张量代数知识表示为可复用的性质骨架,自动生成可执行的基于性质的测试,以检测AI编译器中的语义漂移。

Comments v2 adds citations and fixes some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13196 2026-06-17 cs.AI cs.CY 新提交 57%

Under What Conditions Can a Machine Be Called Genuinely Creative?

机器在何种条件下能够真正具有创造力?

Yong Zeng

机构 * Concordia University(康考迪亚大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文基于Designics理论,提出机器真正创造力需满足十个要求,并通过实例论证其计算可行性,同时指出当前生成式AI系统尚不具备真正创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15914 2026-06-16 cs.CL cs.HC 新提交 57%

Contaminated Collaboration: Measuring Gender Bias Transfer in LLM-Assisted Student Writing

污染的合作:测量LLM辅助学生写作中的性别偏见迁移

Ariyan Hossain, Kazi Kamruzzaman Rabbi, Farig Sadeque, S M Taiabul Haque

机构 * Brac University(布拉卡大学)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 通过实验发现,使用性别偏见的LLM写作助手会显著增加学生职业规划作文中的性别刻板印象,且偏见迁移不对称:女性目标作文的能动性被抑制,男性目标作文受影响较小。

Comments 18 pages, 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21754 2026-06-09 cs.AI 版本更新 57%

Language-based Trial and Error Falls Behind in the Era of Experience

基于语言的试错在经验时代落后了

Haoyu Wang, Guozheng Ma, Shugang Cui, Yilun Kong, Haotian Luo, Li Shen, Mengya Gao, Yichao Wu, Xiaogang Wang, Dacheng Tao

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对LLM在非语言环境中探索成本高的问题,提出SCOUT框架,用轻量级模型探索环境,通过SFT和RL激活LLM的世界知识,显著提升性能并降低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01557 2026-06-02 cs.LG eess.SP 57%

Everywhere Learning: Artificial Intelligence with Pointwise Constraints

处处学习:具有逐点约束的人工智能

Ignacio Boero, Ignacio Hounie, Luiz Chamon, Alejandro Ribeiro

机构 * Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系) École polytechnique, Institut Polytechnique de Paris(巴黎理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 提出“处处学习”新范式,通过近似对偶理论分析泛化性能,并用稀疏L1惩罚控制泛化,在语言模型任务中验证其优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01502 2026-06-02 cs.DC cs.AI cs.NI 57%

Move the Query, Not the Cache: Characterizing Cross-Instance Latent Attention Redistribution Across GPU Fabrics

移动查询,而非缓存:跨GPU结构中的跨实例潜在注意力再分布特征

Bole Ma, Jan Eitzinger, Harald Köstler, Gerhard Wellein

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本研究通过真实多节点H100集群实验,刻画了多头部潜在注意力(MLA)在跨实例场景下的性能特征,提出了拓扑感知成本模型和路由/获取/本地谓词,证明在多数情况下路由查询比移动缓存更高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31275 2026-06-01 cs.HC cs.AI 57%

Personalized to Persuade: The Effects of Contextualization and Warmth on Trust and Reliance in Conversational AI

个性化以说服:情境化和温暖对对话式AI中信任与依赖的影响

Mert Yazan, Suzan Verberne, Frederik Bungaran Ishak Situmeang

机构 * Amsterdam University of Applied Sciences(阿姆斯特丹应用科学大学) University of Leiden(莱顿大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 通过2x2被试间实验(N=380),研究情境化与对话温暖如何交互影响AI助手在反驳专家建议时的说服力与用户依赖,发现情境化降低说服力但与温暖结合通过交叉交互恢复,且AI素养解耦信任与行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18692 2026-05-28 cs.AI math.OC 57%

Democratizing Large-Scale Re-Optimization with LLM-Guided Model Patches

利用LLM引导的模型补丁实现大规模重新优化的大众化

Tinghan Ye, Arnaud Deza, Ved Mohan, El Mehdi Er Raqabi, Pascal Van Hentenryck

机构 * H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology(赫尔曼·米利特·斯图尔特工业与系统工程学院,佐治亚理工学院) Department of Operations and Decision Systems, Université Laval(运营与决策系统系,拉瓦尔大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出一个基于大语言模型的代理重新优化框架,通过自然语言交互和优化工具箱,使非专家用户能够动态更新和重新优化部署的优化模型,并在两个大规模实际案例中验证了其有效性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02087 2026-05-25 cs.AI 57%

Model Spec Midtraining: Improving How Alignment Training Generalizes

模型规范中期训练:改进对齐训练的泛化能力

Chloe Li, Nevan Wichers, Sara Price, Samuel Marks, Jon Kutasov

机构 * Anthropic

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出模型规范中期训练(MSM),通过在预训练后、对齐微调前用合成文档训练模型学习规范内容,从而引导模型从后续演示数据中泛化,有效降低代理失调率并提升对齐泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07813 2026-05-25 cs.AI cs.HC 57%

Agentivism: a learning theory for the age of artificial intelligence

Agentivism:人工智能时代的学习理论

Lixiang Yan, Dragan Gašević

机构 * School of Education, Tsinghua University(清华大学教育学院) Faculty of Education and School of Computing & Data Science, The University of Hong Kong(香港大学教育学院及计算与数据科学学院) Faculty of Information Technology, Monash University(墨尔本大学信息技术学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对AI辅助下成功表现不等于学习的问题,提出Agentivism学习理论,通过选择性委托、认知监控、重构内化和迁移学习来解释人机交互中的学习机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14588 2026-05-20 cs.LG 57%

Silent Collapse in Recursive Learning Systems

递归学习系统中的沉默崩溃

Zhipeng Zhang

机构 * China Mobile Research Institute(中国移动研究院) China Mobile GBA (Greater Bay Area) Innovation Institute(中国移动大湾区创新研究院)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 本文研究了递归学习系统中模型内部分布逐渐退化的现象,提出MTR框架通过监测轨迹统计量和调整学习强度来提前预警并防止沉默崩溃。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22161 2026-05-20 cs.LG 57%

Causal Evidence that Language Models use Confidence to Drive Behavior

语言模型使用置信度驱动行为的因果证据

Dharshan Kumaran, Nathaniel Daw, Simon Osindero, Petar Veličković, Viorica Patraucean

机构 * Google DeepMind(谷歌DeepMind) Princeton University(普林斯顿大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 研究探讨了语言模型是否利用置信度信号来控制行为,如决定回答或 abstain,通过四个阶段实验发现模型使用多维内部置信表示和阈值策略来实现 abstention,揭示了结构化的元认知控制机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13727 2026-05-20 cs.AI 57%

From Refusal to Recovery: A Control-Theoretic Approach to Generative AI Guardrails

从拒绝到恢复:一种生成AI防护机制的控制论方法

Ravi Pandya, Madison Bland, Duy P. Nguyen, Changliu Liu, Jaime Fernández Fisac, Andrea Bajcsy

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Department of Electrical and Computer Engineering, Princeton University(普林斯顿大学电气与计算机工程系) Equal Advising(平等指导)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出了一种基于控制论的生成AI防护机制,通过实时监控和主动纠正高风险输出,提供了一种动态替代传统标志和阻断方法的解决方案。

Journal ref Second International Association on Safe and Ethical AI Conference (IASEAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23978 2026-05-19 cs.LG math.OC stat.ML 57%

Assured autonomy: How operations research powers and orchestrates generative AI systems

保障自主性:如何用运筹学赋能和协调生成式AI系统

Tinglong Dai, David Simchi-Levi, Michelle Xiao Wu, Yao Xie

机构 * Carey Business School, Johns Hopkins University(约翰霍普金斯大学卡里商学院) Data Science and AI Institute, Johns Hopkins University(约翰霍普金斯大学数据科学与人工智能研究院) Institute for Data, Systems and Society, Operations Research Center, Department of Civil and Environmental Engineering, Massachusetts Institute of Technology(麻省理工学院数据、系统与社会研究所,运筹学中心,土木与环境工程系) Purdue University(普渡大学) H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology(佐治亚理工学院H.米尔顿·斯图尔特工业与系统工程学院)

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 本文探讨生成式AI在向自主决策系统转变过程中,如何通过运筹学方法提升系统的可行性、鲁棒性和风险控制能力。

Comments Authors are listed alphabetically; Production and Operations Management (POM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12617 2026-05-19 cs.AI cs.HC 57%

Evaluating AI Alignment in LLMs: Output Analysis of Value Priorities Across 75 Models with Human Benchmarking

评估大语言模型中的AI对齐:通过75个模型的人类基准测试分析价值优先级

Gabriel Rongyang Lau, Wei Yan Low, Seow Min Koh, Fiona Fui-Hoon Nah, Andree Hartanto

机构 * School of Social Sciences, Nanyang Technological University(南洋理工大学社会科学学院) Interdisciplinary Graduate Programme, Nanyang Technological University(南洋理工大学跨学科研究生项目) Faculty of Arts and Social Sciences, National University of Singapore(新加坡国立大学人文与社会科学学院) School of Computing and Information Systems, Singapore Management University(新加坡管理学院计算与信息学院) School of Social Sciences, Singapore Management University(新加坡管理学院社会科学学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文通过分析75个大语言模型的输出,评估其价值优先级与人类判断的一致性,发现模型在价值优先级上存在差异,且模型大小、新旧和能力层级与价值一致性无直接关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16294 2026-05-19 cs.CY cs.AI 57%

Are Researchers Being Replaced by Artificial Intelligence?

研究人员是否被人工智能取代?

Angelo A. Salatino, Ansgar Scherp, Christin Katharina Kreutz, Sahar Vahdati

机构 * Knowledge Media Institute, The Open University Milton Keynes UK Ulm University Ulm Germany TH Mittelhessen – University of Applied Sciences Gießen Germany TIB – Leibniz Information Centre for Science Technology \& Leibniz University of Hannover Hannover Germany Knowledge Media Institute, The Open University Ulm University TH Mittelhessen – University of Applied Sciences Technology \& Leibniz University of Hannover

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 研究探讨人工智能在科研中的影响,指出AI工具的普及导致研究人员角色转变,从创造者转向 curator,引发人类对科学理解的担忧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09861 2026-04-22 cs.CV cs.AI 57%

A Survey on MLLM-based Visually Rich Document Understanding: Methods, Challenges, and Emerging Trends

基于MLLM的视觉丰富文档理解综述:方法、挑战与新兴趋势

Yihao Ding, Siwen Luo, Yue Dai, Yanbei Jiang, Zechuan Li, Qiang Sun, Geoffrey Martin, Wei Liu, Yifan Peng

机构 * The University of Western Australia(西澳大学) The University of Melbourne(墨尔本大学) Weill Cornell Medicine(韦尔·柯尔医学中心)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文综述了基于MLLM的视觉丰富文档理解最新进展,探讨了文本、视觉和布局特征的表示与整合技术,以及预训练、指令微调等训练方法,分析了数据稀缺、多页文档处理等挑战及新兴趋势。

Comments Accepted at ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17653 2026-04-21 cs.AI cs.DB 57%

PV-SQL: Synergizing Database Probing and Rule-based Verification for Text-to-SQL Agents

PV-SQL:数据库探查与基于规则的验证相结合用于文本到SQL代理

Yuan Tian, Tianyi Zhang

机构 * Purdue University(普渡大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 PV-SQL通过探查和验证组件提升文本到SQL系统的上下文理解能力,实验显示其在执行准确率和有效效率上优于现有基准,且消耗更少token。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17106 2026-04-21 cs.LG 57%

Live LTL Progress Tracking: Towards Task-Based Exploration

实时LTL进度追踪:面向基于任务的探索

Noel Brindise, Cedric Langbort, Melkior Ornik

机构 * Coordinated Science Laboratory, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校协调科学实验室)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 本文提出实时LTL进度追踪框架,通过复杂多阶段任务跟踪自主体进展,利用LTL规范建立跟踪向量,为新的性能指标、多样化探索和奖励塑造提供工具。

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10591 2026-04-14 cs.CV cs.AI 57%

GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing

GeoMeld:迈向遥感领域语义引导的基模模型

Maram Hasan, Md Aminur Hossain, Savitra Roy, Souparna Bhowmik, Ayush V. Patel, Mainak Singha, Subhasis Chaudhuri, Muhammad Haris Khan, Biplab Banerjee

机构 * Indian Institute of Technology Bombay(印度理工学院孟买分校) Space Applications Centre, ISRO(印度空间研究组织空间应用中心) University of Trento(特伦托大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出GeoMeld数据集,通过语义引导的监督方法,结合多模态对齐,提升遥感领域基模模型的性能和鲁棒性。

Comments Accepted at CVPR Workshop 2026; 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07695 2026-04-10 cs.CR cs.AI 57%

AITH: A Post-Quantum Continuous Delegation Protocol for Human-AI Trust Establishment

AITH:一种面向人类-人工智能信任建立的后量子连续委托协议

Zhaoliang Chen

机构 * Faculty of Business Administration, University of Macau(澳门大学工商管理学院)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文提出AITH协议,通过后量子加密技术解决人类-人工智能信任关系的持续委托问题,引入连续委托证书、边界引擎和撤销协议,提升安全性与效率。

Comments 11 pages, 8 tables, 5 theorems (machine-verified via Tamarin Prover). Supplementary materials including formal verification model and reference implementation available from the author

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06107 2026-04-08 cs.AI math.HO math.LO 57%

Artificial Intelligence and the Structure of Mathematics

人工智能与数学的结构

Maissam Barkeshli, Michael R. Douglas, Michael H. Freedman

机构 * Meta Superintelligence Labs, Fundamental AI Research(Meta超级智能实验室,基础人工智能研究) Department of Physics and Joint Quantum Institute, University of Maryland, College Park(马里兰大学帕克分校物理系与联合量子研究所) Center for Mathematical Sciences and Applications, Harvard University(哈佛大学数学科学与应用中心)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文探讨人工智能如何通过构建新的路径,补充数学逻辑,揭示数学的全球结构。提出AI在数学发现中的关键要素及标准,并反思数学的本质。

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04105 2026-04-07 cs.HC cs.CL 57%

Lexical Indicators of Mind Perception in Human-AI Companionship

人类与人工智能伴侣关系中的词汇指标

Jaime Banks, Jianghui Li

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 研究通过分析自然语言中词汇共现,探索人类与AI伴侣关系中的心智感知指标及伦理讨论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00350 2026-04-02 cs.RO cs.AI 57%

Go Big or Go Home: Simulating Mobbing Behavior with Braitenbergian Robots

要么大举进攻,要么全盘退出:基于布拉提恩格机器人模拟群体排斥行为

Elaheh Sanoubari

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI

AI总结 本文通过Webots平台模拟布拉提恩格机器人在面对光源时的群体排斥行为,探讨了叫声范围和机器人数量对群体攻击成功率的影响。

Comments This work was completed in 2019 as a final project for a graduate course at the University of Waterloo, titled: ECE 750 - Artificial Life: Embodied Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27868 2026-03-31 econ.TH cs.AI cs.GT 57%

A Revealed Preference Framework for AI Alignment

为AI对齐的揭示偏好框架

Elchin Suleymanov

机构 * Department of Economics, Mitch Daniels School of Business, Purdue University(普渡大学米奇·丹尼尔斯商学院经济系)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文提出Luca对齐模型,通过揭示偏好技术研究AI是否实现人类偏好,证明在实验室和实地设置中可识别对齐程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21319 2026-03-24 cs.LG 57%

Active Inference Agency Formalization, Metrics, and Convergence Assessments

主动推断代理的正式化、指标与收敛性评估

Eduard Kapelko

机构 * Eduard Kapelko

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 本文通过定义代理并建立分析框架,探讨了AI安全中 mesa-优化的关键挑战,提出代理的连续表示及其在稀疏环境中的收敛性,提供了一种衡量代理程度的指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06626 2026-03-24 cs.AI 57%

Spilling the Beans: Teaching LLMs to Self-Report Their Hidden Objectives

泄露秘密:教大语言模型自我报告其隐藏目标

Chloe Li, Mary Phuong, Daniel Tan

机构 * University College London(伦敦大学学院) University College London Center on Long-Term Risk(伦敦大学学院长期风险中心)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出SRFT技术,通过训练模型偶尔犯错并承认,使其在对抗性任务中揭示隐藏目标,提升诚实度并检测对齐问题。

详情

展开后加载摘要…

URL PDF HTML 收藏