OA0
OA0 是一个探索 AI 的社区
现在注册
已注册用户请  登录
OA0  ›  论文  ›  abs/2402.01030v3

CodeAct:把代码执行当作行动空间的智能体框架

 
  kindle ·  2026-08-17 11:01:15 · 9 次点击  · 0 条评论  

可执行代码动作提升 LLM 智能体性能

基本信息

  • 标题:Executable Code Actions Elicit Better LLM Agents(可执行代码动作提升 LLM 智能体性能)
  • 作者:Xingyao Wang, Yangyi Chen, Lifan Yuan, Yizhe Zhang, Yunzhu Li, Hao Peng, Heng Ji
  • 所属分类:计算机科学 > 计算与语言(cs.CL);人工智能(cs.AI)
  • 提交时间:2024年2月1日(v1);2024年5月24日(本版本 v3);最新版本为 2024年6月7日(v4)
  • 发表情况:已被 ICML 2024 接收

摘要

大语言模型(LLM)智能体能够执行广泛的操作,如调用工具和控制机器人,在解决现实世界挑战方面展现出巨大潜力。LLM 智能体通常被提示以预定义格式生成 JSON 或文本形式的动作,但这种方式往往受限于受限的动作空间(例如,预定义工具的范围)和受限的灵活性(例如,无法组合多个工具)。

本工作提出使用可执行的 Python 代码将 LLM 智能体的动作整合到统一的动作空间(CodeAct)中。与 Python 解释器集成后,CodeAct 能够执行代码动作,并通过多轮交互在新观察出现时动态修订先前动作或发出新动作。

研究团队在 API-Bank 和一个新构建的基准上对 17 个 LLM 进行了广泛分析,结果显示 CodeAct 显著优于广泛使用的替代方案(成功率最高提升 20%)。基于 CodeAct 的优异表现,团队构建了一个开源 LLM 智能体,通过与执行可解释代码的环境交互,并使用自然语言与用户协作。为此,他们收集了一个指令微调数据集 CodeActInstruct,包含 7k 次多轮交互。实验表明,该数据集可与现有数据结合使用,在面向智能体的任务中提升模型性能,同时不损害其通用能力。

最终发布的 CodeActAgent 基于 Llama2 和 Mistral 微调而成,集成了 Python 解释器,专为使用现有库执行复杂任务(如模型训练)和自主自我调试而定制。

关键资源

  • 代码、数据、模型和演示可在 GitHub 获取:https://github.com/xingyaoww/code-act
9 次点击  ∙  0 人收藏  
登录后收藏  
0 条回复
关于 ·  帮助 ·  PING ·  隐私 ·  条款   
OA0 - Omni AI 0 一个探索 AI 的社区
沪ICP备2024103595号-2
耗时 31 ms
Developed with Cursor