OBJECT RECORD / 藏品档案 / AIM-DOC-2016-001
《以深度神经网络与树搜索掌握围棋》
一篇 Nature 论文记录了把学习得到的策略网络、价值网络与树搜索结合起来的围棋系统。
CURATORIAL READING
为什么收藏
Silver 等人描述了先用专家棋局、再用自我对弈训练策略网络,从自我对弈局面学习价值网络,并让两者共同引导蒙特卡洛树搜索。
证据边界
把结论限制在这篇论文与围棋任务内。论文报告的对 Fan Hui 五局比赛结果不能证明通用智能;本记录也不涵盖后来与李世石的比赛,不复制论文图表。
10 / 学习与搜索
在引导路线中的位置
从写下规则,到学出表征
策略网络与价值网络在围棋范围内引导树搜索。
返回藏品室 →PROVENANCE
来源路径
Nature / Google DeepMind ·