← Back to Articles

为什么你的准确率在不同平台上对不上

各家平台如何计算准确率,以及这些数字为什么很少一致

ChessOnyx·2026-03-20·6 min read

你在 Chess.com 下了一盘棋,它告诉你准确率是 87%。把同一盘棋导入 Lichess,分析标出的失误却是另一批。再放到自己电脑上用 Stockfish 跑一遍,结果又不一样。到底哪个才对?

答案是:没有哪一个在客观意义上「对」。每家平台都有自己的算法、引擎版本、分析深度和分类标准。弄清这些差异,才能把准确率当作有用的参考,而不是死盯着一组本来就没打算精确的数字。

准确率是怎么算出来的

基本思路很简单:把你的每一步和引擎的最佳着法比对,量出差距。但具体怎么比,各平台的做法差别相当大。

有的平台用「厘兵损失」模型——衡量你每一步相对最佳着法「丢掉」了多少评分,再折算成百分比。有的用「胜率」模型——把评分换算成获胜概率,再衡量你损失了多少胜率。对同一盘棋,这两种做法可能得出明显不同的结果。

厘兵模型在已经分出胜负的局面里惩罚更重。假如你领先 +5.0,走了一步把评分压到 +3.0,那就是 200 厘兵的损失——按这个标准算是不小——可你依然赢定了。胜率模型在这里宽容得多,因为 +5.0 和 +3.0 之间的获胜概率几乎没有变化。

反过来,胜率模型对均势附近的变化更敏感。从 +0.3 掉到 -0.3 只有 60 厘兵的损失,却意味着获胜概率的明显偏移。

深度带来的问题

造成准确率差异的最大因素,也许就是分析深度。正如我们在讲引擎评分的那篇文章里提到的,引擎对同一局面的判断,在第 18 层和第 28 层之间可能变化很大。

多数平台采用中等深度分析,一般在 18 到 22 层,因为每天以 30 层以上的深度处理数百万盘棋,需要惊人的算力。可在这样的深度上,引擎给出的「最佳着法」并不总是真正的最佳。你那步被判为「不精确」的棋,在更深的层数下反而可能更好。

这就带来一个不太舒服的事实:准确率是在拿一把并不完美的尺子量你的棋。第 20 层的引擎不是神谕,它是一位很强但会出错的分析者。把它的判断当成板上钉钉的真理,等于把系统性误差写进了准确率的计算里。

分类的门槛

不同平台把一步棋判为「最佳」「优秀」「良好」「不精确」「错着」还是「Blunder」,用的门槛各不相同。这些门槛多少带点随意,却极大地左右着复盘讲给你听的那个故事。

有的平台把 50 厘兵的损失就叫「错着」,另一家则要到 100 厘兵才肯这么标。有的只把引擎排第一的那一步算作「最佳」,有的则把与第一名相差 10 厘兵以内的着法统统算作「最佳」。

这些分类选择是产品设计上的取舍,不是棋理上的真相。它们决定了你的复盘里冒出多少个「错着」、哪些棋被拎出来强调,最终也决定了你怎么看待自己的水平。一盘在这家平台上显得干净利落的棋,换一家可能满屏都是问题——底下的棋其实一模一样。

引擎版本和网络

就算两家平台都说自己用「Stockfish」,跑的也可能是不同版本、搭配不同的 NNUE 网络。Stockfish 15 的评分方式不同于 Stockfish 17,Stockfish 17 又不同于 Stockfish 18。这些差别通常很小,但在某些类型的局面里会相当明显。

有些平台使用自研引擎,或是开源引擎的修改版。相比标准 Stockfish,它们的评估特点、长处和短板都可能不同。当一家平台压根不公开自己用的是哪个引擎、哪个版本时,比较准确率就更没有意义了。

在 ChessOnyx,我们跑的是搭配 NNUE 的 Stockfish 18,也就是最新的稳定版本,并且我们把这一点讲明白。每当我们发布分析功能时,你都会清楚知道是哪个引擎、哪套设置在产出这些评分。

游戏化这一层

有必要承认,准确率承担着双重身份:它一半是分析工具,一半是留住用户的功能。让分析显得有成就感、让用户不断回来,对平台而言有实实在在的经济好处。

这会以很微妙的方式体现出来:慷慨的准确率让人心情舒畅,戏剧化的标签制造出值得回味的瞬间,表现分暗示你比实际水平更强。这些做法未必称得上不诚实,但看清背后的动机很重要。

最有价值的分析不是让你最舒服的那一种,而是告诉你哪里可以变强的那一种。有时候最有用的反馈恰恰让人难受,因为它点出了你自己都没察觉的错误习惯。

怎样用好准确率

尽管有这些局限,只要方法得当,准确率还是能派上用场:

在同一个平台上长期跟踪自己的准确率。绝对数值也许说明不了什么,但同一套体系内部的走势是有意义的。如果几个月里你在同一平台上的平均准确率从 75% 升到 82%,那就是实打实的进步——哪怕这些数字本身带有几分随意。

不要跨平台比准确率。这家的 85% 不等于那家的 85%。只在同一套体系内部比较。

把注意力放在分析上,而不是分数上。赛后复盘真正的价值,在于弄懂自己在哪些具体局面里走偏了,并从中学到东西。百分比只是一个概括性数字,遮住的比揭示的多。

对特别高的准确率保持怀疑。如果一个平台总是告诉你打出了 95% 的准确率,那可能是它的门槛比较宽松,而不是你真的接近完美。把它当成去寻找更严格分析的动力,而不是自己毫无破绽的证明。

记住下棋的是人,不是引擎。按引擎标准只排第二的着法,在真实对局里可能才是最实际的选择,尤其在时间紧张的时候。准确率无法涵盖国际象棋里属于人的那一部分——时间分配、心理压力、实战中的纠缠——而这些和纯粹的棋艺同样重要。

Further Reading

More Articles

读懂 Stockfish 的层数,以及它对你棋局的意义

关于搜索深度、时间分配,以及深挖分析何时才真正有用的实用指南

7 min read

怎样把引擎分析用到极致

用引擎真正提高棋力的方法,而不是只对着棋谱一步步核对

8 min read

国际象棋如何进步

诚实地看看哪些做法真正有用,哪些只是在消耗时间

9 min read
← Back to Articles