各个引擎的打分为什么不一样?甚至相同引擎不同版本也不一样?
现在引擎打分没有标准,没有谁规定什么局面就等于固定多少分,所以不同引擎不同版本的分数不能互相比较。分数只能和同版本同引擎的分数内部比较。
所以不同版本不同引擎的分数不一样很正常。
引擎的分数如何,和所谓“敏感度”“虚高”没有丝毫关系。如果把皮卡鱼的分数乘以 10 变成一个“新引擎”,你会认为新引擎会对分数更敏感或者分数虚高吗?显然两个引擎相同,只是外在表现看起来不同而已。引擎棋力的唯一指标是科学的测试数据。
胜率模型
但有一种统一的标准是:根据测试数据做出一个胜率模型,把引擎输出的原始分数转换成胜率分数。
目前皮卡鱼的胜率分是和 ELO 分差挂钩,例如一方优势 200 分代表 76% 胜率(象棋界常说的胜率,也就是胜局加上一半的和局,例如 4 胜 4 和 2 负就是 60% 胜率,3 胜 4 和 3 负就是 50% 胜率)。
但是网页版和其他非正式发布的皮卡鱼引擎,分数可能不是这种,而是原始分除以一个常数。


皮卡鱼的胜率模型,拟合了引擎自我测试的实际胜率(相当于 1 线程 60 秒+0.6 秒)。
在本意上,引擎的非绝杀分都不代表必胜,这些分数只是“评估”,引擎认为当前局面谁优,类似于人类认为这局面谁好走、大优、胜势,只不过引擎会细分成分数。
