arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 54 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 54 篇

2607.26352 2026-07-30 cs.NI cs.AI cs.MA 新提交 57%

Pramana: A Composable, Domain-Specific Backend for Empirical Networking Research

Pramana:面向实证网络研究的可组合领域专用后端

Jaber Daneshamooz, Eugene Vuong, Alagappan Ramanathan, Manni Moghimi, Haarika Manda, Satyam Kumar, Snithik Thode, Satyandra Guthula, Sylee Beltiukov, Dongsu Han, Tarun Mangla, Sangeetha Abdu Jyothi, Walter Willinger, Arpit Gupta

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出面向实证网络研究的可组合领域专用后端Pramana,其通过单一意图规范实现跨载体运行,概念验证可满足34%的数据生成意图,为加速网络研究提供了支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22959 2026-07-28 cs.CV cs.AI 新提交 57%

HALLELUAI: A Hallucination-Aware AI System for Ultra-Realistic Image-to-Video Generation at Scale

HALLELUAI:一个用于大规模超逼真图像到视频生成的幻觉感知人工智能系统

Aniket Sakpal, Yang Jiang, Rouzbeh Davoudi, Shayan Hassantabar, Mani Najmabadi

机构 * Expedia Group(亿客行集团)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对AI生成视频时质量控制难的问题,HALLELUAI系统集成视频调节与智能再生模块,能评估风险并迭代修复。经人工参与评估,该系统可输出超逼真视频,推动了可信AI视频内容发展,实现大规模图像到视频生成。

Comments 10 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21625 2026-07-27 cs.AI 新提交 57%

Trajectory-Aware Retrieval Agents for Temporal Decision- Making

用于时间决策的轨迹感知检索代理

Jing Wang, Jie Shen, Xing Niu

机构 * Amazon(亚马逊)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19213 2026-07-22 cs.RO cs.AI 新提交 57%

Computing on the Fly: Navigating a Vision for the Future of Drone Computing

即时计算:展望无人机计算的未来

Kevin Butler, Christopher Stewart, Nils Aschenbruck, Alina Gerall, Weisong Shi, Deborah Silver, Ufuk Topcu

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 报告设想无人机大规模运输货物等的未来,指出需弥合能力差距,确定了实现无人机技术变革潜力的十二个技术挑战及应对方法,为无人机技术发展规划了多方面的前进路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16680 2026-07-21 cs.SE 新提交 57%

Specification-Driven Development as the Foundation of AI-Native Enterprise Software Engineering

规范驱动开发作为人工智能原生企业软件工程的基础

Mamdouh Alenezi

专题命中 其他Agent :agentic(abstract);分类 cs.SE

AI总结 研究大语言模型和智能人工智能推动下软件工程范式转变,介绍规范驱动开发,提出规范治理参考模型,经评估能减少安全缺陷、缩短上市时间,证明企业软件需规范治理,vibe编码适用于构思和快速原型制作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14553 2026-07-17 cs.AI cs.MA 新提交 57%

Towards an Intention Abstraction Layer for Autonomous Industrial Systems

迈向自主工业系统的意图抽象层

Artan Markaj, Raphael Höfer, Felix Gehlhoff

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI

AI总结 针对自主工业系统中各子系统运行目标冲突难以及时发现的问题,提出意图抽象层(IAL),通过大型语言模型等将自然语言目标解析为结构化意图,检测并解释冲突,实现执行前意图级检查,保障协作自主系统行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11039 2026-07-14 cs.HC cs.AI 新提交 57%

Same Stories, Different Journeys: From Social Comparison to Sensemaking in AI-Mediated Peer Career Exploration

相同的故事,不同的旅程:从社交媒体比较到人工智能介导的同伴职业探索中的意义建构

Pengping Tan, Baoquan Zhao, Zhenhui Peng

机构 * Sun Yat-sen University(中山大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 研究针对年轻求职者在社交媒体职业探索时被动浏览的问题,开发JobMate交互式系统,将真实帖子转化为对话式AI代理,通过对比研究发现其能引导社会比较转向建设性自我重构并促进意义建构,还探讨了相关AI系统设计启示。

Comments 10 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05132 2026-07-08 cs.CY cs.CL 新提交 57%

When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games

智能体何时撒谎:重复博弈中的预谋、持续性与可利用性研究

Jerick Shi, Terry Jingcheng Zhang, Bernhard Schölkopf, Vincent Conitzer, Zhijing Jin

机构 * Carnegie Mellon University(卡内基梅隆大学) Vector Institute(向量研究所) University of Toronto(多伦多大学) EuroSafeAI

专题命中 其他Agent :autonomous agent(abstract);分类 cs.CL

AI总结 本文针对大语言模型智能体行动前公示意图的诚信问题,设计三阶段n人重复博弈协议,评测前沿模型,发现其偏离公示行为多属预谋,不同模型对公示的语义理解不兼容。

Comments Best Paper Award at ICML NExT-Game Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02121 2026-07-03 cs.CR cs.AI 新提交 57%

Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring

拒绝背后:通过行为监控确定护栏激活

William Hackett, Peter Garraghan

机构 * Mindgard Lancaster University(兰卡斯特大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。

Comments 19 pages, 13 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01964 2026-07-03 cs.CL 新提交 57%

Beyond Supervised Clarification: Input Rewriting with LLMs for Dialogue Discourse Parsing

超越有监督澄清:基于LLM的输入重写用于对话篇章解析

Yiming Liu, Ziyue Zhang, Zhichao Xu, Xin Yu, Yingheng Tang, Tianyu Jiang, Jie Cao

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 研究在无监督条件下利用LLM零样本或基于解析器反馈重写输入以提升对话篇章解析性能,发现重写常引入回归,提出选择性干预问题并识别可重写性预测为关键缺失能力。

Comments Accepted to SIGDIAL 2026. 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31755 2026-07-01 cs.CY cs.AI 新提交 57%

A Technical Typology of AI Systems in Public Administration

公共管理中AI系统的技术类型学

Jonathan Rystrøm, Chris Schmitz, Nathan Davies, Gerhard Hammerschmid, Albert Meijer, Chris Russell

机构 * University of Oxford(牛津大学) Hertie School(赫蒂学院) Utrecht University(乌得勒支大学) Harvard University(哈佛大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对公共管理研究将AI视为单一类别的问题,提出五类AI系统类型学(手编、玻璃箱、黑箱、通用、代理系统),通过分析91篇高引论文发现技术精度不足,并给出改进建议。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30653 2026-07-01 cs.CY cs.AI 新提交 57%

The Consistency Dilemma in LLMs: Generator-Evaluator Agreement and Vulnerability to Mistakes

LLMs中的一致性困境:生成器-评估器一致性与对错误的脆弱性

Marina Mancoridis, Zoë Hitzig

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出生成器-评估器自一致性度量,发现模型自一致性越高,在临床环境中对已验证错误的脆弱性越大,揭示LLMs中的一致性困境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27951 2026-06-29 cs.CY cs.CL cs.HC physics.soc-ph 新提交 57%

AI Persuasive Framing in Collective Dilemmas

集体困境中的AI说服性框架

Anders Giovanni Møller, Alessia Galdeman, Arianna Pera, Luca Maria Aiello

机构 * Data Science Section, IT University of Copenhagen(丹麦哥本哈根IT大学数据科学系) Computer Science Department, University of Milan(意大利米兰大学计算机科学系) Copenhagen Center for Social Data Science, University of Copenhagen(丹麦哥本哈根大学哥本哈根社会科学数据科学中心)

专题命中 其他Agent :AI agent(abstract);分类 cs.CL

AI总结 本研究通过集体风险博弈实验,测试AI助手使用个性化说服框架对合作行为的影响,发现亲社会效应短暂而反社会效应持久,揭示了AI影响集体行动的双重用途风险。

Comments The first two authors contributed equally to this research. The article contains 20 pages, 10 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06747 2026-06-19 cs.SE 新提交 57%

Tensor Algebraic Property Skeletons: Amplifying Property-Based Testing for AI Compilers

张量代数性质骨架:增强AI编译器的基于性质的测试

Yuxin Qiu, Ben Limpanukorn, Seongmin Lee, Jiyuan Wang, Qian Zhang, Miryung Kim

专题命中 其他Agent :agentic(abstract);分类 cs.SE

AI总结 提出Propilot框架,利用LLM将张量代数知识表示为可复用的性质骨架,自动生成可执行的基于性质的测试,以检测AI编译器中的语义漂移。

Comments v2 adds citations and fixes some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13196 2026-06-17 cs.AI cs.CY 新提交 57%

Under What Conditions Can a Machine Be Called Genuinely Creative?

机器在何种条件下能够真正具有创造力?

Yong Zeng

机构 * Concordia University(康考迪亚大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文基于Designics理论,提出机器真正创造力需满足十个要求,并通过实例论证其计算可行性,同时指出当前生成式AI系统尚不具备真正创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15914 2026-06-16 cs.CL cs.HC 新提交 57%

Contaminated Collaboration: Measuring Gender Bias Transfer in LLM-Assisted Student Writing

污染的合作:测量LLM辅助学生写作中的性别偏见迁移

Ariyan Hossain, Kazi Kamruzzaman Rabbi, Farig Sadeque, S M Taiabul Haque

机构 * Brac University(布拉卡大学)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 通过实验发现,使用性别偏见的LLM写作助手会显著增加学生职业规划作文中的性别刻板印象,且偏见迁移不对称:女性目标作文的能动性被抑制,男性目标作文受影响较小。

Comments 18 pages, 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08238 2026-08-11 cs.DS 新提交 50%

A Near-Optimal Lower Bound for Prefix-Matrix Factorizations

前缀矩阵分解的近最优下界

Honghao Lin, Vahab Mirrokni, David P. Woodruff

专题命中 其他Agent :agentic(abstract)

AI总结 该研究针对下三角全1矩阵Q,利用Gemini智能体系统证明了前缀矩阵分解的近最优下界,其结果可应用于转置流估计与差分隐私计数的相关界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07515 2026-08-11 cs.CY 新提交 50%

Bridging AI Risk Frameworks: Reconciling ISO/IEC 42001, the NIST AI Risk Management Framework, and the EU AI Act into a Uni ed Governance Taxonomy

衔接AI风险框架:将ISO/IEC 42001、美国国家标准与技术研究院AI风险管理框架(NIST AI RMF 1.0)及欧盟AI法案整合为统一治理分类体系

Vinod Dhiman

专题命中 其他Agent :agentic(abstract)

AI总结 本文整合ISO/IEC 42001、NIST AI RMF和欧盟AI法案,构建统一AI治理分类体系,提出实施模型与示例,助力组织同时满足三者要求且无需重复付出。

Comments 17 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04033 2026-08-06 cs.CR 新提交 50%

SoK: How Frontier AI Reshapes System-Level Security Risk Dynamics in Critical Infrastructure

SoK:前沿人工智能如何重塑关键基础设施中的系统级安全风险动态

Chandra Thapa, Mohan Baruwal Chhetri, Marthie Grobler, Shahroz Tariq, Tooba Aamir

专题命中 其他Agent :agentic(abstract)

AI总结 本研究提出五维风险动态框架,分析前沿人工智能重塑关键基础设施系统级安全风险的机制,指出学术研究与运营约束的错配,推动系统级安全保证研究。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18506 2026-07-22 cs.CY 新提交 50%

AI Value Alignment for Evolving Social Norms

用于不断演变的社会规范的人工智能价值对齐

Nenad Tomašev, Matija Franklin, Simon Osindero

专题命中 其他Agent :agentic(abstract)

AI总结 研究人工智能价值对齐对社会规范演变的影响,引入基于社会物理学的数学建模框架,通过解析与模拟分析长期后果,强调价值锁定等风险,倡导用此模型作认知桥梁助力社会技术预见及大规模智能体评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18152 2026-07-21 cs.IR 新提交 50%

jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation

jina-reranker-v3.5:一种具有混合注意力和自蒸馏的高效列表式重排器

Christina Nasika, Feng Wang, Antonis Krasakis, Han Xiao

专题命中 其他Agent :agentic(abstract)

AI总结 研究提出jina-reranker-v3.5列表式重排器,通过混合注意力改进、多领域训练及三阶段自蒸馏方法,在满足效率等需求同时提升性能,如在BEIR上表现出色,在半结构化检索中有显著提升,还降低了推理延迟,并开源模型权重。

Comments 13 pages, 2 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15051 2026-07-17 cs.CY 新提交 50%

SCITUS: A Multi-Jurisdictional Framework for Adapting NIST AI RMF to the Canadian Regulatory Context

SCITUS:将美国国家标准与技术研究院人工智能风险管理框架(NIST AI RMF)适配到加拿大监管环境的多辖区框架

Mohammad Etemad

专题命中 其他Agent :agentic(abstract)

AI总结 针对加拿大人工智能监管碎片化问题,提出SCITUS框架,它能将NIST AI RMF 1.0同时适配到加联邦和省级法规,整合多种要素,通过多场景展示适用性,为多辖区合规提供了更优模式及可复制模型。

Comments 74 pages, 1 figure. SCITUS Framework v2.0 (July 2026). Framework documentation: https://scitus.ca/scitus-framework

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13087 2026-07-16 cs.CR 新提交 50%

GDM AI Control Roadmap

GDM人工智能控制路线图

Mary Phuong, Erik Jenner, Laurent Simon, Lewis Ho, Rohin Shah, Sebastian Farquhar, Scott Coull

专题命中 其他Agent :AI agent(abstract)

AI总结 研究如何保障人工智能代理融入系统时的安全,提出GDM人工智能控制路线图,通过保守威胁建模、基于能力的缓解措施及一系列实际防御构建多层防御体系,平衡安全与开发者速度,为内部安全提供蓝图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08914 2026-06-09 cs.HC 新提交 50%

Vibe Visualizing: How Visualization Novices Try (and Fail) to Generate and Interpret Visualizations with Conversational AI

Vibe 可视化:可视化新手如何尝试(并失败)使用对话式 AI 生成和解读可视化

Sam Yu-Te Lee, Yun-Hsin Kuo, Chifang Chou, Matthew Ward, Xiwei Xuan, Kwan-Liu Ma

专题命中 其他Agent :agentic(abstract)

AI总结 通过用户研究发现,可视化新手在使用 ChatGPT 等对话式 AI 生成和解读可视化时面临执行错误、误解和信任问题,并提出了改进 AI 辅助可视化系统的设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏