OA0
OA0 是一个探索 AI 的社区
现在注册
已注册用户请  登录
OA0  ›  论文  ›  abs/2402.03620v1

Self-Discover:让语言模型自主组织推理结构解决复杂任务

 
  absent ·  2026-08-17 11:01:17 · 8 次点击  · 0 条评论  

Self-Discover: Large Language Models Self-Compose Reasoning Structures

作者

Pei Zhou, Jay Pujara, Xiang Ren, Xinyun Chen, Heng-Tze Cheng, Quoc V. Le, Ed H. Chi, Denny Zhou, Swaroop Mishra, Huaixiu Steven Zheng

摘要

本文提出了 SELF-DISCOVER,一个通用框架,使大语言模型(LLMs)能够自行发现任务内在的推理结构,以解决对典型提示方法而言具有挑战性的复杂推理问题。该框架的核心是一个自我发现过程:LLMs 选择多个原子推理模块(如批判性思维和逐步思考),并将它们组合成显式的推理结构,在解码过程中供 LLMs 遵循。

SELF-DISCOVER 在具有挑战性的推理基准(如 BigBench-Hard、基于智能体的接地推理和 MATH)上显著提升了 GPT-4 和 PaLM 2 的性能,相比思维链(Chain of Thought, CoT)最高提升了 32%。此外,SELF-DISCOVER 的性能优于 CoT-Self-Consistency 等推理密集型方法 20% 以上,同时所需的推理计算量减少了 10-40 倍。最后,研究表明自我发现的推理结构在不同模型家族间具有普遍适用性:从 PaLM 2-L 到 GPT-4,从 GPT-4 到 Llama2,并且这些结构与人类推理模式存在共通之处。

主题/分类

  • 主要分类:人工智能(cs.AI)
  • 相关分类:计算与语言(cs.CL)

其他信息

  • 提交时间:2024 年 2 月 6 日
  • 页数:17 页,11 张图,5 个表格
  • arXiv ID:2402.03620
8 次点击  ∙  0 人收藏  
登录后收藏  
0 条回复
关于 ·  帮助 ·  PING ·  隐私 ·  条款   
OA0 - Omni AI 0 一个探索 AI 的社区
沪ICP备2024103595号-2
耗时 15 ms
Developed with Cursor