论文英文
react-paper-2022
ReAct: Synergizing Reasoning and Acting in Language Models
把“想一步、做一步、看结果”写成一个循环的论文。
打开原始来源这件事对外公布: 这个日期指的是:arXiv 预印本首次公开的日期 · Shunyu Yao 等,普林斯顿大学,Google Research
一篇论文提出让模型交替进行「推理」和「行动」,每次行动后看结果再想下一步。这个循环成了后来智能体的基本结构。
此刻在看:静态解释,这一页的 4 个部分都是这一种。
主张依据 2 类:原始论文、编辑解释。
核实状态:这一页没有需要核实的结论,所以这一维是空的。
表示此刻展示方式,不是准确性等级。
可多选,每种都有实际引用;「本站实验」需有记录。
附范围、时间及必要原因,不等于全页绝对正确。
这一页没有需要核实的结论,所以这一维是空的——不会因为它挂着论文就替它标一个「已核对」。
让模型不只在「脑子里」推理,而是能查东西、做动作,再根据结果继续想。
当时的模型只会输出文字。要让它「行动」,得靠程序去解析它写的文字里哪一段是动作,再执行。格式稍微不对,整个流程就断。
论文给出了「想、做、看、再想」这个结构的可行做法。后来的智能体软件普遍沿用这种循环,不过本站没有统计过它们各自的出处,「沿用」是策展解释,不是引用。
在这之前,让模型解决问题的主流做法是让它「多想几步」再回答。ReAct 加了一件事:想到一半可以去查、去做,然后带着结果回来接着想。
因为模型输出的是一整段文字,程序要从里面猜哪一句是「我要做什么」。模型稍微换个写法,程序就认不出来。这个问题要等到工具调用有了正式格式才算解决。
react-paper-2022
把“想一步、做一步、看结果”写成一个循环的论文。
打开原始来源