象棋有「阿爾法狗」嗎?
沒有,但有相同演算法的 px0,官網 px0.org,但目前看在象棋領域,CPU 引擎仍然強於顯示卡引擎。
多年前的阿爾法狗、阿爾法零(AlphaGo、AlphaZero)用的是另外一種搜尋演算法,用來配合真正的重點:卷積神經網路架構。這種引擎通常主要使用顯示卡(GPU)或者 TPU。而象棋強引擎的搜尋演算法都只需要 CPU,不需要顯示卡。
顯示卡引擎的網路足夠大,所以評估更加準確。和 NNUE 不同,顯示卡引擎的網路不止評估網路,還包含了策略網路,策略網路負責決定搜尋著法,類似於人類看到一個局面,想要進行計算,就必須先選擇一個著法進行計算,如果這種「直覺」夠準,可以節省大量的時間。但這種大架構讓顯示卡引擎更依賴顯示卡和 MCTS 搜尋(實際上棋類顯示卡引擎已經不是狹義上的 MC 蒙特卡洛了)。目前,顯示卡引擎在象棋和國際象棋上,仍未超越 CPU 引擎。
阿爾法系列並未開源,圍棋的 katago、leela,國際象棋的 lc0 都是根據其論文復現的,而象棋有克隆 lc0 的 px0、ggz。
現在的頂尖圍棋、國象、日本將棋引擎棋力已經遠超當年的阿爾法零。
對顯示卡引擎來說,從隨機落子開始迭代訓練和從人類資料開始迭代訓練,兩者的上限是否有區別依然存疑,從隨機落子為起點可能只是噱頭,畢竟 a0 和 ag0 還有其他地方的差異。
注意
阿爾法貓使用的演算法和 AlphaGo 不同,屬於 ab 剪枝,僅僅是名字相似。
