ResearchEnvBench: Benchmarking Agents on Environment Synthesis for Research Code Execution
ResearchEnvBench: 为研究代码执行环境合成的基准测试
机构 * Institute of Trustworthy Embodied AI(可信具身AI研究院) ; Shanghai Innovation Institution(上海创新机构) ; Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身AI重点实验室) ; College of Computer Science and Artificial Intelligence(计算机科学与人工智能学院) ; OpenMOSS ; Wuhan University(武汉大学) ; Nanjing University(南京大学) ; Jilin University(吉林大学)
专题命中 软件智能体 :autonomous agent(abstract);分类 cs.AI、cs.SE
AI总结 ResearchEnvBench 是一个用于评估自主代理在研究代码执行中环境合成能力的基准测试,旨在解决当前代理在依赖解析和版本耦合方面的不足。