遵循策略网络,蒙特卡洛树搜索的树宽将大量减少,但深度依旧存在。上千万局博弈,每一局都走到最后,依旧是可怕的计算量。
计算深度的减少用上了价值网络。它以AlphaGo产生的大量自我博弈作为样本,检索这种棋形在历史上的胜率,把好坏、优劣变成了一个概率问题!那么每一回,AlphaGo计算到一定深度就可以停下来,直接估算当前胜率!
经验的本质是概率,从本质上来说,以概率判断局面的AlphaGo,就是以“经验判断现状”的人类大脑运行模式!AlphaGo的走子,也完全遵循了人类棋手的思维历程——大量背谱,吸取经验,自我思考,判断局势……然后估算其后若干步的棋局导向!
只是这个棋手,等于千百年来千千万万个棋手的经验总和,并且,完全不会出错罢了。
第二天,乌镇再传出消息:魏柯第二局,依旧惨败!
魏柯意识到细棋是没有机会的,一开始就主动展开攻势,趁着布局阶段想要对AlphaGo进行压制。他意识到AlphaGo非常有经验,尝试用怪着、偏着对付他,导致子效低下,输得比昨天更惨!王梦雨甚至在解说时失声痛哭,即使他根本不是魏柯,也无法承受这种绝望的差距,可想而知魏柯所肩负的压力。
然而公众是难以理解的。消息一出,全网哗然。因为此前对魏柯寄望太高,现在舆论开始转了风向,对人类失败的恐慌很容易就演变成了对魏柯的愤怒:“魏柯他根本
本章还未完,请点击下一页继续阅读>>>