CoRL: Environment Creation and Management Focused on System Integration
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG
Comments for code, see CoRL" target="_blank" rel="noopener">https://github.com/act3-ace/CoRL
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG
Comments for code, see CoRL" target="_blank" rel="noopener">https://github.com/act3-ace/CoRL
专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG
Comments ICLR 2023 Camera Ready
专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI、cs.LG
Comments NeurIPS 2022. Code and agents at https://agarwl.github.io/reincarnating_rl
专题命中 软件智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG
Comments Accepted to ICLR 2022
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG
Comments ICCV 2021
专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI、cs.LG
Comments Builds on preliminary work presented at ICML 2020 (WHI) arXiv:2007.05577. An interactive demo of the system can be at https://tinyurl.com/y5gv5t4m
专题命中 软件智能体 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.SE
Comments 4 pages, EMIP 2019
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE
机构 * Computer Science, University of Toronto(计算机科学,多伦多大学) ; University of Toronto(多伦多大学) ; King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)
专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI;planning(comments)
Comments accepted at The First Workshop on the Application of LLM Explainability to Reasoning and Planning (XLLM-Reason-Plan) @ COLM 2025
双人乐器:一种改进云服务基准测试灵敏度的代理方法
专题命中 软件智能体 :agentic(title)
AI总结 本文提出了一种名为duet instrumentation的新基准测试方法,利用大型语言模型的代码理解能力,通过分析两个连续应用版本之间的代码变更,提高云服务基准测试的灵敏度。
对代理基于市场碎片化和延迟套利模型的复制性检验
专题命中 软件智能体 :agent(title)
AI总结 本文通过复制Wah和Wellman 2016年的延迟套利模型,发现原论文中缺失的实现细节和有限的定量报告阻碍了准确复制。通过增加模拟次数生成置信区间,弥补了分布信息的不足,并指出模型复杂性与对齐难度成正比。
基于大语言模型的代理边缘智能框架
专题命中 软件智能体 :agentic(title)
AI总结 本文提出LEI框架,利用云托管的大语言模型协调设备端逻辑的生成与更新,通过生成轻量级程序并部署以适应变化条件,提升边缘计算的灵活性与资源效率。
Comments 35 pages, 22 Figures, Journal version
SkeletonAgent: 一种基于骨架的动作识别代理交互框架
机构 * NLPR, Institute of Automation, Chinese Academy of Sciences(神经信息处理研究室,自动化研究所,中国科学院) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 软件智能体 :agentic(title)
AI总结 SkeletonAgent通过Questioner和Selector两个代理连接识别模型与LLM,提升基于骨架的动作识别性能。
专题命中 软件智能体 :agent(title)
专题命中 软件智能体 :agent(title)
专题命中 软件智能体 :agent(title)
Comments CoRL 2024 Camera Ready. 25 pages. A novel zero-shot 3D visual grounding framework based solely on 2D images
专题命中 软件智能体 :agent(title)
Comments Accepted in the 37th Annual ACM Symposium on User Interface Software and Technology (UIST'24)
专题命中 软件智能体 :agent(title)
Comments 6 pages, 3 figures; Accepter for publication in MNRAS
专题命中 软件智能体 :agent(title)
专题命中 软件智能体 :workflow(title)
专题命中 软件智能体 :planning(title)
专题命中 软件智能体 :agent(title)
比较 vibe 编码工具生成代码的质量
专题命中 软件智能体 :agent(abstract_cn);AI agent(abstract);分类 cs.SE
AI总结 本研究对比 Lovable、v0、Replit 三种 vibe 编码工具生成代码的结构质量,发现三者存在不同质量特征,选择工具需考量结构层面的权衡。
理解编码智能体的架构:一项使用研究原型的探索性研究
专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.SE
AI总结 本研究通过推出编码智能体Ark及基准ArkBench,探索了编码智能体的架构,用gpt-5.4-mini测试Ark解决10项任务中的8项,还对比了其与先进编码智能体的架构,为相关研究提供基础。
编码智能体能通过渲染代码解决仓库级问题吗?一项关于视觉表示的探索性研究
专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI
AI总结 本研究探索将渲染代码作为编码智能体的操作上下文,基于 SWE-bench Verified 实验发现其可降低提示 token 成本但受模型架构限制,仅在原始代码读取为瓶颈时有用,是可行但有条件的压缩机制。
Comments 8 pages of main content
SkillSentry:基于运行时保障的大语言模型智能体可靠技能执行方案
专题命中 软件智能体 :agent(abstract);tool use(abstract);分类 cs.AI
AI总结 SkillSentry是基于DSL的技能运行时保障框架,通过初始化、监控引导与迭代优化提升LLM智能体技能执行可靠性,在15项技能上平均提升任务成功率24.1%且降低变异性。
基于双向重构-验证框架的代码智能体独立补丁验证
专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.SE
AI总结 本研究针对代码智能体生成补丁后缺乏独立验证的问题,提出无需训练的RETRACE双向重构-验证框架,在SWE-bench Verified等基准上显著提升了代码补丁的正确性。
Comments 8 pages
FailForge:从持续失败中提取过程能力到代码智能体
专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI
AI总结 FailForge 框架将代码智能体的失败案例转化为训练信号,以边际成本恢复超26%失败实例,使 Qwen3.5-4B 在 SWE-bench Verified 上的解决率提升6.6个百分点,增益集中于最难问题。
F(AI)2R:谁做了什么,谁进行了检查?可验证的人工智能溯源作为一项可执行技能
专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 研究将F(AI)2R实验的溯源模型扩展为aiprov,涵盖任何含人工智能工件。方法被打包为可执行技能,由人工智能代理操作,能解析操作员身份,把关图一致性并发布论文版本,以自身为例展示溯源记录。
自进化编码智能体
专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.SE
AI总结 本综述系统梳理自进化编码智能体领域,明确其与传统智能体的区别,提出分类法,分析该领域的挑战,为设计更优智能系统奠定基础。