“别挤,稍等一下!”
几个工作人员忙前忙后地招待记者媒体。
里面。
几十个职业棋手们围在那里,脸色都不太好看,在陈瑛的复盘和向荣九段与李义九段的解说分析下,众人终于看完了peter和陈池九段的那两盘对弈,结果,全都有些被那peter的“智力”吓住了!
徐晗络(policy-work),给定当前局面,预测采样下一步的走棋。
2快速走子(fast-rollout),目标和1一样,但在适当牺牲走棋质量的条件下,速度要比1快1000倍。
3估值网络(vae-work),给定当前局面,估计是白胜还是黑胜。
4蒙特卡罗树搜索(onte-carlo-tree-search,cts),把以上这三个部分连起来,形成一个完整的系统。
它的主要工作原理是深度学习。深度学习是指多层的人工神经网络和训练它的方法。一层神经网络会把大量矩阵数字作为输入,通过非线性激活方法取权重,再产生另一个数据集合作为输出。这就像生物神经大脑的工作机理一样,通过合适的矩阵数量,多层组织链接一起,形成神经网络‘大脑’进行精准复杂的处理,就像人们识别物体标注图片一样。它有两个“大脑”,是通过两个不同神经网络“大脑”合作来改进下棋。这些大脑是多层神经网络跟那些图片搜索引擎识别图片在结构上是相似的。它们从多层启发式二维过滤器开始,去处理围棋棋盘的定位,就像图片分类器网络处理图片一样。经过过滤,13个完全连接的神经网络层产生对它们看到的局面判断。这些层能够做分类和逻辑推理。
第一大脑:落子选择器(ove-picker)。
第二大脑:棋局评估器(position-evaator)。
等等等等!