arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-11 至 2026-08-11 共收录 440 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 79 篇

2608.09842 2026-08-11 cs.CV 新提交 50%

From Diagnosis to Correction: Benchmarking and Improving Real-World Table Parsing

从诊断到修正:真实世界表格解析的基准测试与改进

Jutao Xiao, Yuan Qu, Dongsheng Ma, Fan Wu, Tianyao He, Weihong Li, Jie Yang, Yu Qiao, Bin Wang, Conghui He

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Peking University(北京大学)

专题命中 Agent评测 :agentic(abstract)

AI总结 本文针对真实世界表格解析的缺陷,构建诊断基准TableParseMap,提出DEC框架,无需重训即可提升冻结解析器性能,在TableParseMap上TEDS获显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09724 2026-08-11 eess.SY cs.SI cs.SY 新提交 50%

Analysis and Consensus Control of Emergent Dynamic Polarization in Minimally-Nonlinear Opinion Dynamics

最小非线性观点动力学中涌现动态极化的分析与共识控制

Rajul Kumar, Ningshi Yao

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出M-NOD框架解析社交网络观点演化产生的动态极化,证明其稳定性条件,开发局部控制策略仅锚定单个智能体即可消除振荡分歧、恢复共识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09061 2026-08-11 cs.GT 新提交 50%

Breaking the 4-Approximation Barrier in Strategyproof Two-Facility Location

策略proof双设施选址问题中突破4近似比障碍

Mengfan Ma, Bo Peng

专题命中 Agent评测 :agent(abstract)

AI总结 该研究在Ptolemaic度量空间中提出随机策略proof双设施选址机制,将最优近似比从4降至约3.667,同时将最优下界从1.045提升至约1.207,突破了此前的4近似比障碍。

Comments 23 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08299 2026-08-11 math.PR math.OC q-fin.MF 新提交 50%

Non-linear optimal stopping with Bermudan strategies: the infinite horizon case

基于百慕大策略的非线性最优停止:无限时域情形

Miryana Grigorova, Ohood Aldalbahi

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对无限时域下带非线性评估的最优停止问题,基于百慕大策略证明动态规划原理、ε-最优停时与最优停时的存在性,给出Doob型收敛结果并提供BSDEs相关示例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09545 2026-08-11 physics.optics 新提交 50%

Direct Laser Interference Patterning of Functional Metal Surfaces: From Written Geometry to Functional Interfaces

功能金属表面的直接激光干涉图案化:从写入几何到功能界面

Petr Hauschwitz

专题命中 Agent评测 :agent(abstract)

AI总结 本综述以DLIP为模型系统,指出仅靠几何无法预测金属表面功能,需分离写入几何与形成的界面,明确跨领域变量可转移性,为DLIP表面工程提供预测框架。

Comments Review article, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24676 2026-08-11 cs.GT 版本更新 50%

The Degree of Strategy-Proofness for Risk-Averse Committee Selection

风险规避委员会选择的防策略性程度

Dael Sinay, Rica Gonen

专题命中 Agent评测 :agent(abstract)

AI总结 研究风险规避委员会选择的防策略性程度,将RAT程度框架扩展到基于批准的委员会选择,聚焦比例批准投票规则,通过建立界限表明其在不同选民选票知晓数量下对安全操纵的敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23539 2026-08-11 cs.CY 版本更新 50%

Private Again: Artificial Intelligence Agents Restore Anonymity---Foreclosing Discrimination and Its Proof

再次私密:人工智能代理恢复匿名性——消除歧视及其证据

Anirban Mukherjee, Hannah Hanwen Chang

专题命中 Agent评测 :agent(abstract)

AI总结 研究人工智能代理恢复匿名性以消除歧视及证据问题,核心方法是代理介导交易使歧视缺乏输入信息与证据,主要贡献是促使法律将代理介导匿名性作为民权基础设施管理,应对相关挑战。

Comments Forthcoming, Stetson Law Review Forum (Summer 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07018 2026-08-11 cs.HC 版本更新 50%

Designing Youth Social Media through Problem Space Attunement

青少年社交媒体设计中的问题空间调适

JaeWon Kim

专题命中 Agent评测 :agent(abstract)

AI总结 本文通过三种问题空间失调(概念性、定义性、评价性)分析青少年社交媒体设计中的权力失衡,并提出虚构探究工作坊、Discord异步社区和LLM代理模拟沙盒等干预方法,以建立以青少年为中心的关系支持型社交媒体设计准则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14162 2026-08-11 physics.geo-ph physics.ao-ph physics.data-an 版本更新 50%

An Attention-Based Stochastic Simulator for Multisite Extremes to Evaluate Nonstationary, Cascading Flood Risk

基于注意力机制的多站点极端事件随机模拟器用于评估非平稳级联洪水风险

Adam Nayak, Pierre Gentine, Upmanu Lall

专题命中 Agent评测 :planning(abstract)

AI总结 本文提出一种结合注意力机制的多站点洪水模拟框架,通过随机生成多变量洪水频率、强度和持续时间序列,评估非平稳级联洪水风险,为保险和财务规划提供可行的洪水风险模拟。

Journal ref Nayak, A., Gentine, P., and Lall, U. (2026). "Attention-Based Stochastic Simulation of Climate-Informed Spatiotemporal Flood Risk for Multisite Insurance Portfolios." Geophysical Research Letters, 53 (15)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20087 2026-08-11 econ.TH 版本更新 50%

Screening Frontiers

筛选前沿

Frank Yang

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了盈余弹性前沿在最优菜单中的作用,证明其在不同机制下的最优性,并应用于多个经济领域。

Comments 75 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08552 2026-08-11 nlin.AO math.DS 版本更新 50%

Extreme vulnerability to intruder attacks destabilizes network dynamics

极端的入侵攻击对网络动态的脆弱性

Amirhossein Nazerian, Sahand Tangerami, Malbor Asllani, David Phillips, Hernan Makse, Francesco Sorrentino

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了网络中单个低度节点的入侵攻击如何破坏动态稳定性,挑战了传统对枢纽节点脆弱性的假设,并揭示了非线性网络中的脆弱性特征。

Comments Accepted for publication in Nature Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06586 2026-08-11 cs.CY 版本更新 50%

Simulating Dispute Mediation with LLM-Based Agents for Legal Research

基于大语言模型智能体的争议调解模拟:面向法律研究

Junjie Chen, Haitao Li, Minghao Qin, Yujia Zhou, Yanxue Ren, Wuyue Wang, Yiqun Liu, Yueyue Wu, Qingyao Ai

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对法律争议调解实证研究的局限,提出首个基于LLM的AgentMediation框架模拟争议调解,通过可控实验发现符合社会学理论的模式,为社科与AI在法律研究的融合提供平台。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03638 2026-08-11 cs.DS 版本更新 50%

Stability Notions for Hospital Residents with Sizes

带容量的医院住院医生问题的稳定性概念

Haricharan Balasundaram, J B Krishnashree, Girija Limaye, Meghana Nasre

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对带容量的医院住院医生问题(HRS)研究基于容量的稳定性,证明该类问题必存在对应稳定匹配,给出严格优于3的近似算法,还证明最大规模该匹配问题及稳定匹配判定问题的NP难性,并提出受限场景下的稳定匹配高效算法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 7 篇

2608.08445 2026-08-11 cs.AI 新提交 70%

Forgotten History or Test-of-Time? Retrospect and Prospect on RAG from an IR Perspective

被遗忘的历史还是时间的考验?从信息检索视角回顾与展望检索增强生成(RAG)

Xiaoyan Zhao, Yujie Cai, Yang Zhang, Grace Hui Yang, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Georgetown University(乔治城大学)

专题命中 其他Agent :agentic(abstract,abstract_cn);分类 cs.AI

AI总结 本文从IR视角指出RAG核心思想源于21世纪初的经典研究,提出将LLM视为旧QA架构的新接口层,其前期工作可指导下一代RAG设计,促进跨领域整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26418 2026-08-11 cs.AI cs.LG 版本更新 62%

Unbiased Canonical Set-Valued Oracles Via Lattice Theory

通过格论的无偏规范集值预言机

Jobst Heitzig

机构 * Pik-Potsdam(皮克-波茨坦)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对预言机自指问题,提出基于Knaster-Tarski不动点定理的规范集值预言机,输出无偏且自洽的credal集,并证明其存在性与非空性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08240 2026-08-11 cs.AI cs.GT cs.MA econ.TH 新提交 57%

A Fair Objective for Human-Empowerment-Preserving AI: Desiderata, Design, and Likely Behavioral Consequences

一种保留人类赋能的公平AI目标: desiderata、设计及可能的行为后果

Jobst Heitzig, Ram Potham

机构 * Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文设计了一种保留人类赋能的AI公平目标函数,通过公理化方法兼顾人类权力的不平等与风险规避,明确AI需赋能人类并管理人机权力平衡,还验证了其在典型场景的行为后果。

Comments Slightly extended version of paper accepted for Algorithmic Decision Theory 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22038 2026-08-11 cs.CL 版本更新 57%

Source-Modality Monitoring in Vision-Language Models

视觉-语言模型中的源模态监控

Etha Tianze Hua, Tian Yun, Ellie Pavlick

机构 * Department of Computer Science, Brown University(布朗大学计算机科学系)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 研究探讨了多模态模型追踪并沟通信息来源的能力,分析了语法与语义信号在绑定提示词与输入组件中的作用,发现语义信号在模态分布差异大时更占主导。

Comments Accepted at COLM 2026. All resources will be available at https://github.com/ethahtz/source-modality-monitoring

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06582 2026-08-11 cs.AI cs.SY eess.SY 57%

A Convex Hull Cheapest Insertion Heuristic for the Non-Euclidean TSP

Mithun Goutham, Ethan David Rosati, Hollis Schuler, Meghna Menon, Sarah Garrow, Stephanie Stockar

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI

Comments Accepted manuscript: Robotics and Autonomous Systems [Elsevier]

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08238 2026-08-11 cs.DS 新提交 50%

A Near-Optimal Lower Bound for Prefix-Matrix Factorizations

前缀矩阵分解的近最优下界

Honghao Lin, Vahab Mirrokni, David P. Woodruff

专题命中 其他Agent :agentic(abstract)

AI总结 该研究针对下三角全1矩阵Q,利用Gemini智能体系统证明了前缀矩阵分解的近最优下界,其结果可应用于转置流估计与差分隐私计数的相关界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07515 2026-08-11 cs.CY 新提交 50%

Bridging AI Risk Frameworks: Reconciling ISO/IEC 42001, the NIST AI Risk Management Framework, and the EU AI Act into a Uni ed Governance Taxonomy

衔接AI风险框架:将ISO/IEC 42001、美国国家标准与技术研究院AI风险管理框架(NIST AI RMF 1.0)及欧盟AI法案整合为统一治理分类体系

Vinod Dhiman

专题命中 其他Agent :agentic(abstract)

AI总结 本文整合ISO/IEC 42001、NIST AI RMF和欧盟AI法案,构建统一AI治理分类体系,提出实施模型与示例,助力组织同时满足三者要求且无需重复付出。

Comments 17 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏