arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-07 至 2026-08-07 共收录 218 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 43 篇

2608.05539 2026-08-07 cs.CV 新提交 50%

OmniMech: All-in-one Multimodal Mechanical Benchmark for 3D Reconstruction

OmniMech:面向3D重建的全合一多模态机械基准

Taiting Lu, Runze Liu, Ziwei Dong, Sisong Bei, Jingying Zeng, Mingjia Wang, Zhenghao Li, Kaiyuan Lin, Yi-Shan Wu, Yangshoudu Zheng, Hongxing Pan, Kai Zhang, Guoliang Shi, Ling Ma, Yifan Yang, Jiaying Lu, Qi He, Sung-Liang Chen, Yi-Chao Chen, Yincheng Jin, Mahanth Gowda

专题命中 Agent评测 :agentic(abstract)

AI总结 研究人员提出OmniMech——首个百万级多模态机械基准,针对工业制造数据的可执行CAD生成任务,含四类任务,实验发现现有模型在相关任务中存在不足,将发布资源支持后续研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00364 2026-08-07 cs.GT cs.SI 版本更新 50%

Understanding Federated Learning Through the Lens of Mechanism Design: The Role of Data Heterogeneity

通过机制设计视角理解联邦学习:数据异质性的作用

Lina Alkarmi, Po-Yen Chen, Mingyan Liu

专题命中 Agent评测 :agent(abstract)

AI总结 该研究通过将经典外部性机制适配联邦学习场景,对比了夏普利值机制与外部性机制在社会最优性、个体理性等维度的表现,揭示了互惠公平与社会效率的权衡关系。

Comments Extended version (with full proofs) of a paper accepted at GameSec 2026. 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02450 2026-08-07 math.CO 版本更新 50%

Lower bounds for multivariate independence polynomials and their generalisations

多重独立多项式的下界及其推广

Joonkyung Lee, Jaehyeon Seo

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了多重独立多项式的下界及其推广,提出并证明了关于图的独立集的不等式,并推测该结果可推广至其他反铁磁模型。

Comments 17 pages. Clarify Section 3 and add a Lean formalisation of Theorem 1.4. See https://github.com/thegreatseo/multivar-indep-formalize for the GitHub repo

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22884 2026-08-07 econ.EM 版本更新 50%

Complementarities in Sparse Two-Sided Interaction Models

稀疏双边交互模型中的互补性

Federico Crippa

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对仅实现潜在匹配稀疏子集的双边交互模型,引入含互补性参数的Tukey模型,提出基于周期的估计量并应用于世界银行经理-国家匹配,发现负向互补性,验证了能力强的经理在复杂环境中更具价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01013 2026-08-07 quant-ph cond-mat.str-el hep-th 版本更新 50%

Running Quantum Computers in Discovery Mode

以发现模式运行量子计算机

Aydin Deger, Benedikt Placke, G. J. Sreejith, Alessio Lerose, S. L. Sondhi

专题命中 Agent评测 :agent(abstract)

AI总结 研究展示量子计算机与经典机器学习智能体协同运行,可通过定义兴趣函数调整电路,以高概率发现离散时间晶体等量子多体动力学新现象,确立了混合设备中兴趣函数设计的研究范式。

Comments 10 + 8 pages, 4+6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2608.05490 2026-08-07 cs.AI cs.LG stat.ML 新提交 62%

Innovation-Residual Auditing of Autonomous Analysis Agents: Localization, Detection Limits, Error Control, and Identifiability

自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性

Ahmed Hassoon, Mark Dredze

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06137 2026-08-07 cs.LG 新提交 57%

SkillTFM: Gated Skill Evolution for Training-Free Adaptation of Tabular Foundation Models

SkillTFM:用于表格基础模型无训练适应的门控技能演化

Yi He, Zhengkang Guan, Anpeng Wu, Peng Cui, Fei Wu, Kun Kuang

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00059 2026-08-07 cs.CY cs.AI 版本更新 57%

Stochastic Parrots or Singing in Harmony? Testing Five Leading LLMs for their Ability to Replicate a Human Survey with Synthetic Data

随机鹦鹉还是和谐合唱?测试五种领先的大语言模型在复制人类调查响应方面的能力

Jason Miklian, Kristian Hoelscher, John E. Katsos

机构 * Centre for Global Sustainability, University of Oslo(全球可持续发展中心,奥斯陆大学) Peace Research Institute Oslo(奥斯陆和平研究所) American University of Sharjah(阿联酋沙迦美国大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文比较了420名硅谷程序员和开发者的调查数据与五种大语言模型生成的合成数据,发现AI生成的数据在技术上合理但无法捕捉人类调查的非直观洞察,表明合成调查数据在组织研究中存在局限。

Comments V2

详情

展开后加载摘要…

URL PDF HTML 收藏