arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-23 至 2026-07-23 共收录 6 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 6 篇

2508.21302 2026-07-23 cs.CR cs.AI cs.SE 81%

Locus: Agentic Predicate Synthesis for Directed Fuzzing

Locus:面向定向模糊测试的代理谓词合成

Jie Zhu, Chihao Shen, Ziyang Li, Jiahao Yu, Yizheng Chen, Kexin Pei

机构 * University of Chicago(芝加哥大学) University of Maryland(马里兰大学) Johns Hopkins University(约翰霍普金斯大学) Northwestern University(西北大学)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 Locus通过合成语义谓词提升定向模糊测试效率,发现多个未修补漏洞。

Journal ref ICSE '26: 2026 IEEE/ACM 48th International Conference on Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19653 2026-07-23 cs.SE cs.AI 新提交 73%

PerfAgent: Profiler-Guided Iterative Refinement for Repository-Level Code Optimization

PerfAgent:用于仓库级代码优化的分析器引导迭代优化

Ryan Deng, Yuanzhe Liu, Bastian Lipka, Yao Ma, Xuhao Chen, Tim Kaler, Jatin Ganhotra

机构 * Massachusetts Institute of Technology(麻省理工学院) Rensselaer Polytechnic Institute(罗切斯特理工学院) IBM(IBM公司) Michigan State University(密歇根州立大学)

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 研究针对仓库级代码优化难题,提出PerfAgent分析器引导迭代优化方法,该方法能让编码代理找到热点并改进,在两个优化基准测试中大幅提升专家匹配补丁率,且以低成本超越基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18543 2026-07-23 cs.AI cs.CL cs.SE 版本更新 67%

CEO-Bench: Can Agents Play the Long Game?

CEO-Bench:智能体能否玩转长期博弈?

Haozhe Chen, Karthik Narasimhan, Zhuang Liu

机构 * Princeton University(普林斯顿大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 提出CEO-Bench,通过模拟500天运营初创公司的任务,评估语言模型智能体在长期、不确定、动态环境下的综合决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19682 2026-07-23 cs.SE 新提交 57%

Context Matters: Improving the Practical Reliability of LLM-Based Unit Test Generation

上下文很重要:提高基于大语言模型的单元测试生成的实际可靠性

Junjie Chen, Ziqi Wang, Lin Yang, Chen Yang, Xiao Chu, Jianyi Zhou, Guangtai Liang, Qianxiang Wang, Dong Wang

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 研究基于大语言模型的单元测试生成在实际应用中的问题,提出上下文感知工作流程CATGen,通过明确依赖、稳定框架、静态分析等改进设计,经评估在实际项目和基准测试中提升编译成功率与覆盖率,减少生成时间和消耗。

Comments 23 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29108 2026-07-23 cs.CR cs.PL cs.SE 版本更新 57%

Symbolon: Symbolic Execution by Learning Code Transformation

Symbolon: 通过学习代码变换进行符号执行

Jie Zhu, Penghui Li, Zhongxuan Li, Chihao Shen, Ziyang Li, Yizheng Chen, Kexin Pei

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 提出Symbolon框架,自动学习多样化的代码变换并上下文敏感地应用,以缓解符号执行的路径爆炸和复杂约束问题,在32个真实程序上平均行覆盖率提升3.69倍,内存和求解时间分别降低29.2倍和123倍,并在Linux内核中发现21个新漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19501 2026-07-23 astro-ph.SR astro-ph.GA astro-ph.IM 新提交 50%

A Probabilistic Framework for Population Studies of the Solar Neighborhood: Application to SDSS-V and Gaia

太阳邻域种群研究的概率框架:应用于SDSS-V和盖亚

Ilija Medan, Keivan G. Stassun, Zachary Way, Guy S. Stringfellow, Alexandre Roman-Lopes, Jiadong Li, Madeline Lucey, Andrew R. Casey, Bárbara Rojas-Ayala, Ricardo López-Valdivia, José G. Fernández-Trincado

专题命中 软件智能体 :planning(abstract)

AI总结 该研究针对SDSS-V太阳邻域普查样本选择效应问题,提出概率框架及正向建模方法,通过模拟数据集验证,利用盖亚数据发布19的数据展示其科学效用,公开代码为未来研究提供重要工具。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏