AgentForge: Execution-Grounded Multi-Agent LLM Framework for Autonomous Software Engineering
AgentForge: 基于执行的多智能体LLM框架用于自主软件工程
机构 * International Research Center for Complexity Sciences(复杂科学国际研究中心) ; Hangzhou International Innovation Institute(杭州国际创新研究院) ; Beihang University(北京航空航天大学) ; College of Science, Mathematics and Technology(科学、数学与技术学院) ; Wenzhou-Kean University(温州-凯恩大学) ; Fakulti Teknologi Maklumat dan Komunikasi(信息技术与通信学院) ; Universiti Teknikal Malaysia Melaka(马来西亚Melaka理工大学) ; Computer Systems Engineering Department(计算机系统工程系) ; Sukkur IBA University(苏库尔IBA大学) ; University of Electronic Science and Technology of China(电子科学与技术大学)
专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 AgentForge通过引入执行验证原则,提升代码正确性验证,实现40.0%的SWE-BENCH Lite解决率,优于单智能体基线。