ReAct:把「想一步、做一步、看结果」写成循环
想一步、做一步、看结果

这件事对外公布: 这个日期指的是:arXiv 预印本首次公开的日期 · Shunyu Yao 等,普林斯顿大学,Google Research

一篇论文提出让模型交替进行「推理」和「行动」,每次行动后看结果再想下一步。这个循环成了后来智能体的基本结构。

此刻在看:静态解释,这一页的 4 个部分都是这一种。

主张依据 2 类:原始论文、编辑解释。

核实状态:这一页没有需要核实的结论,所以这一维是空的。

三个维度分别看:演示方式、主张依据、核实状态

演示方式

表示此刻展示方式,不是准确性等级。

  • 顶部三秒卡与日期含义 静态解释
  • 当时想解决什么/为什么当时卡住/后来什么变了 静态解释
  • 主张与依据 静态解释
  • 正文与关系说明 静态解释

主张依据

可多选,每种都有实际引用;「本站实验」需有记录。

  • 原始论文 ReAct: Synergizing Reasoning and Acting in Language Models
    2022 年 10 月 6 日这个日期与「arXiv 预印本首次公开」这句含义来自这篇论文的题录。
    这一条转述论文的题目与它提出的「交替生成推理轨迹和行动」;本站的记录说不出读到了它的哪一层。
  • 编辑解释
    本站自己写的,没有外部引用。
    「想一步、做一步、看结果」这句三秒卡是本站给论文标题那两个词起的中文说法。
    三段是本站的解释;「后来的智能体软件普遍沿用」那句已就地写明本站没有统计过它们各自的出处。
    两段正文(一个简单的想法、为什么这一步没有立刻带来智能体产品)与 precedes 关系说明是本站的解释。

核实状态

附范围、时间及必要原因,不等于全页绝对正确。

这一页没有需要核实的结论,所以这一维是空的——不会因为它挂着论文就替它标一个「已核对」。

当时想解决什么

让模型不只在「脑子里」推理,而是能查东西、做动作,再根据结果继续想。

为什么当时卡住

当时的模型只会输出文字。要让它「行动」,得靠程序去解析它写的文字里哪一段是动作,再执行。格式稍微不对,整个流程就断。

后来什么变了

论文给出了「想、做、看、再想」这个结构的可行做法。后来的智能体软件普遍沿用这种循环,不过本站没有统计过它们各自的出处,「沿用」是策展解释,不是引用。

一个简单的想法

在这之前,让模型解决问题的主流做法是让它「多想几步」再回答。ReAct 加了一件事:想到一半可以去查、去做,然后带着结果回来接着想。

为什么这一步没有立刻带来智能体产品

因为模型输出的是一整段文字,程序要从里面猜哪一句是「我要做什么」。模型稍微换个写法,程序就认不出来。这个问题要等到工具调用有了正式格式才算解决。

它和其他事件、概念的关系

谁指向了这件事

主张与依据

档案目录

  1. 论文英文

    react-paper-2022

    ReAct: Synergizing Reasoning and Acting in Language Models

    出版方/保存方
    arXiv
    原页语言
    英文
    来源发布
    本站访问
    核对程度:没有记录,说不出读到哪一层没有记录具体读到哪一层,因此不能把这条记录当作全文核对。
    访问结果:正常取到

    把“想一步、做一步、看结果”写成一个循环的论文。

    打开原始来源