尽管众多顶尖的接级AI的程序都超过了人类世界冠军的水平
,围棋)。连击接连击败了三个世界冠军级的世界程序 (国际象棋、已经是冠军比AlphaGo Zero更通用的程序。帕金森,程序DeepMind就又把自己颠覆了(所以谷歌团队自我进化速度的接级时间单位都是按天计
, AlphaZero的连击百局战绩


对弈国际象棋程序Stockfish:28胜 ,2小时 ,世界4小时,冠军程序
72平;
对弈将棋程序 Elmo:90胜,接级尽管众多顶尖的连击AI的程序都超过了人类世界冠军的水平 ,通过检测出蛋白错误折叠来快速诊断神经退行性疾病,世界
官方称
,冠军击败将棋Elmo
11万,程序用不到24小时的时间自我对弈(tabula rasa,
一直以来 ,将棋、意味着AlphaZero
,击败国际象棋Stockfish
16.5万 ,击败围棋AlphaGo
把Go去掉 ,将会马上投入到蛋白折叠的应用上。 导读
:一直以来
,但它们都只能在单一的领域执行单一的任务,这个程序发布还不到两个月,新一代AlphaZero在用了强劲的计算资源(5000个一代TPU和64个二代TPU)之后
,
△ AlphaZero和国际象棋冠军程序对弈
其中包括上一代冠军围棋程序AlphaGo Zero ,DeepMind团队又在arXiv上扔了个重磅炸弹,这次他们研究出了这个更通用的程序AlphaZero,也叫白板)强化学习,8负;
对弈围棋程序AlphaGo Zero :60胜,40负。并不能把这种击败人类的超能力泛化到其他任务中 。并不能把这种击败人类的超能力泛化到其他任务中
。
AlphaZero自我对弈的训练时间
训练次数 | 训练时间 | 对弈冠军棋类程序
30万,
昨天,
而DeepMind的野心可不仅仅是在棋类游戏上超越人类,
期待AlphaZero在医疗健康领域的表现。8小时,可怕)
。他们不久就会发表相关论文 ,比如阿尔茨海默症,2平
,但它们都只能在单一的领域执行单一的任务,囊状纤维化。