---
title: "Poker Sense如何给你的决策打分"
description: "从GREAT到BLUNDER：Poker Sense如何用求解器频率而不是EV损失来给扑克决策打分，以及一个真正接近的局面到底意味着什么。"
date: "2026-08-10"
author: "The Poker Sense Team"
category: "应用与你的训练"
tags: ["gto training", "poker verdicts", "mixed strategy", "expected value", "poker feedback", "home game"]
canonical: "https://pokersense.app/zh-CN/blog/how-poker-sense-grades-your-decisions"
---

# Poker Sense如何给你的决策打分

从GREAT到BLUNDER：Poker Sense如何用求解器频率而不是EV损失来给扑克决策打分，以及一个真正接近的局面到底意味着什么。

- The Poker Sense Team
- 2026年8月10日
- 阅读时间：10 分钟

你刚在[Poker Sense](https://app.pokersense.app)里打完一手训练手牌。你在大盲位 -- 也就是在任何牌发出之前，就要投入两个强制注里较大那个的座位 -- 你用黑桃J和黑桃T跟注了一个翻前加注。翻牌，也就是最先发出的三张公共牌，是黑桃Q、黑桃9、红心4。你过牌，对手下注了大约半池，你盘算了一下：一个两头顺子听牌（任意K或8能凑成顺子）加上一个同花听牌（再来一张黑桃就是同花）。跟注感觉很稳。你跟注了。

判定出来了：GOOD。下面只有一行字："加注是主要打法（68%）。"

GOOD？为什么不是GREAT？你手里握着一个怪兽听牌，走了一条谨慎的线路，而电脑显然想让你加注 -- 但也只是68%的时候想让你这么做，不管那意味着什么。这就引出了真正的问题。给一个扑克决定打分，到底能意味着什么？扑克是一个靠运气的游戏，而数学本身也经常说同一手牌可以有两种不同的正确打法。一个单独的决定，真的能被打分吗？

它可以，但不是大多数人以为的那种方式。走一遍Poker Sense实际是怎么做的，结果会是一次相当不错的、关于该如何思考扑克决策的巡礼 -- 我们从为什么那个显而易见的打分方式会失败开始讲起。

## 那个显而易见的打分方式，以及它为什么会失败

给一个扑克决定打分最显而易见的方式，是衡量它的代价。现代扑克策略来自求解器：这些程序让一个局面跟自己对打上百万次，直到收敛到一个博弈论最优策略 -- 简称GTO -- 也就是一个不管对手怎么试，都无法被利用的策略。对任何一个局面，求解器都能告诉你每个行动的[期望值](/zh-CN/blog/what-is-expected-value)：那个行动长期平均下来赢或输多少钱，把任何一手牌里的运气成分都平均掉之后的结果。那就直接把你选的打法，和最好的可用打法比一比。平均利润的差距，就是你的分数。很简单。

问题就在这里，而这正是这整篇文章的数学核心。在大多数翻牌上，求解器不会只选一个动作。它会打一个[混合策略](/zh-CN/blog/understanding-mixed-strategies)：同一手牌，同一个局面，它有时加注，有时跟注，各自按特定的频率。而在均衡状态下 -- 也就是双方都打得完美、谁都无法通过改变什么来获利的状态 -- 求解器在一个混合局面里实际会用到的每一个动作，期望值都完全相等。

这不是巧合。这正是混合存在的原因。如果加注比跟注赚的钱哪怕多一点点，求解器也不会68%的时候加注；它会100%的时候加注，因为求解器对利润是不留情面的。一个混合，只有在其中的动作被精确地绑定在一起时才能存在。博弈论学者把这个叫做无差异原则：在均衡状态下，你对混合里的这些动作是无差异的，因为它们赚的钱完全一样。

现在看看这对那个显而易见的打分方案做了什么。你在J-T那手牌里的跟注？零期望值损失。应用称之为主要打法的那个加注？同样是零。弃牌 -- 那手牌里求解器绝不会采取的唯一动作 -- 才是唯一有代价的选择。只用EV损失打分，几乎每一个大致合理的翻牌后决定都会被判"完美"。一份几乎全是A的成绩单不是反馈。它是壁纸。

## EV损失看不到的信号

所以Poker Sense针对的是EV损失看不见的东西：求解器的频率。

当求解器68%的时候加注、32%的时候跟注时，两个动作都没问题 -- 但作为习惯，它们并不相同。你的对手从来不是在跟你的某一个决定较量；他们较量的是你的整个[范围](/zh-CN/blog/introduction-to-ranges)，也就是你在做出某个动作时，可能持有的每一手牌。一个在这类局面里用每一个大听牌都跟注的玩家，正在一次又一次看似不花钱的决定里，构建出一个和求解器不同的范围。他们的加注里只剩下强成牌，这让那些加注变得很容易应付。他们的跟注里塞满了听牌，这让他们后面的下注在顺子或同花补上的那一刻就很容易被读穿。每一次单独的跟注，在均衡状态下都没有代价。但这个习惯，悄悄把他们挪到了一个不同的策略上 -- 一个"零代价"这份保证从来没有为它开出过的策略。

这正是整套判定系统所建立的洞见。频率的对齐程度，是EV损失看不到的信号。当你的动作在求解器策略之内时，值得问的问题不是"这付出了什么代价"（没有），而是"这个动作在整套策略里有多核心"。当你的动作在求解器策略之外时，代价才终于变成了正确的问题，因为这时才真的存在一个代价。

## 六种判定

Poker Sense把每一个决定归到六种判定中的一种。前三种意味着你在求解器策略之内，它们只在求解器采用这个动作的频率上有区别。后三种意味着你在策略之外，它们只在这次绕路的代价上有区别。代价用大盲计量 -- 也就是你下的那个强制注的大小，是扑克里的标准计量单位，通常简写为bb。

**GREAT** 意味着你选择了主要打法，也就是求解器最常采用的那个动作 -- 或者一个求解器采用频率与主要打法相差不到10个百分点的动作。第二条很重要。当求解器52%的时候加注、48%的时候跟注时，跟注不是一个次一等的选择；它是一次真正的对半开的抛硬币，评分时也会按这个来对待。

**GOOD** 意味着你选择了求解器采用了相当一部分时间的动作：15%或更多。你在J-T那手牌里的跟注，就落在这里。求解器大多数时候加注这手牌，剩下的大多数时候跟注，所以跟注是这套策略里真实的一部分。只是不是标题动作。

**OKAY** 意味着你的动作在求解器的策略之内，但很少见：低于15%。没有损失，没什么好愧疚的。但如果你在同一类局面里一直落在这里，说明这套策略的重心不在你所在的地方。

**IFFY** 意味着你离开了这套策略，但代价很小：损失不到1.5个大盲的期望值。长期来看是真金白银，但今天不算紧急。

**MISTAKE** 意味着这次绕路的代价是1.5到3个大盲。这些正是专注学习回报最快的那类决定。

**BLUNDER** 意味着损失了3个大盲或更多。在J-T那手牌里，如果面对一个半池下注，弃掉那个十五张补牌的怪兽听牌，会烧掉好几个大盲，落在这个档位。每个人身上都有BLUNDER，而在训练里找到你的BLUNDER的意义在于，训练用的筹码是免费的。

还有一个数字把这一切串起来：你的对局准确率，就是被判定为GREAT或GOOD的决定所占的百分比。它是一个快速的读数，告诉你有多经常停留在策略的中心附近。

## "接近的局面"到底意味着什么

有些局面一点都不接近 -- 求解器几乎总是采用一个动作，其他任何选择都是漏洞。但相当多的局面是真正混合的，有两个或更多近乎相等的动作。如果求解器45%的时候下注、55%的时候过牌，这两个打法几乎是双胞胎。无差异原则说它们赚的钱一样多，而频率说求解器几乎不偏向任何一边。

想象一下被告知你因为在那个局面下注而"失败"了。那不是教学；那是噪音。更糟的是，它会训练你在那种整个数学要点就是不存在唯一正确答案的局面里，去寻找一个唯一正确答案。

所以当一个局面很接近时，Poker Sense会这么说。GREAT里那10个百分点的窗口正是为此存在，而这条洞察语句会紧随其后一起出现："接近的局面 -- 两种打法都站得住脚。"这句话是应用在告诉你不该把担心浪费在哪里。真正值得在开车回家路上反复回味的手牌，是那些你和求解器真正产生分歧的手牌 -- 不是那些抛硬币的局面。

## 为什么判定是一句话，而不是一个数字

有些训练工具直接抛出原始数字：下注值2.31个大盲，过牌值2.28个大盲。Poker Sense也会计算所有这些 -- IFFY、MISTAKE和BLUNDER的边界正是这么画出来的，那些大的偏差按精确烧掉了多少个大盲来打分 -- 但判定本身从来不会以小数的形式出现。原因有两个。

第一，虚假的精确度。求解器的输出是收敛后的近似值：求解器运行到它的策略不再移动超过一个容差值，然后停止。合理打法之间的差距，常常只是千分之一个大盲，淹没在这个近似本身的噪音里。第三位小数看起来像信息。它不是。

第二，在这里，词语比数字教得更好。"你损失了0.03bb"会让你眯起眼睛，猜这算不算多。一句话会告诉你该拿刚刚发生的事怎么办。所以每一个决定得到的，是一句简明的大白话洞察，而不是一个小数："加注是主要打法（68%）"，当存在一个明确的主要动作时。"接近的局面 -- 两种打法都站得住脚"，当没有明确主要动作时。"重大失误 -- 这里该过牌"，当你走偏到了一个代价不小的地方时。一句话，你就知道该继续前进，还是该深入研究一下。

需要说清楚的是，没有任何细节被藏起来。做完一个决定之后，你可以打开范围视图，看到完整的求解器分解 -- 你可能持有的每一手牌、每个动作的频率，以及，没错，那些EV数字。区别在于什么先出现：判定先给你一句话，把小数留给好奇的人自己去找，而不是要求你自己去做那份解读工作。

## 一个判定不能告诉你什么

这是任何打分系统老实的局限：一个判定能定位一次分歧，但它没法解释这次分歧。GOOD配上"加注是主要打法（68%）"，告诉你你的直觉和这套策略在哪里分了岔。它没有告诉你，为什么求解器那么喜欢加注那个听牌。

"为什么"，正是学习真正发生的地方，也正是"问为什么"教练功能存在的原因。在那手J-T的手牌之后点一下它，AI教练会解释推荐打法背后的推理：你的听牌强到即便面对会继续跟进的牌，你也接近一个抛硬币的局面，所以加注给了你两种赢法 -- 对手现在就弃牌，或者你十五张牌里的一张到来 -- 而在你的牌有这么大潜力的时候把底池做大，意味着那些你真的赢到的时候，你会赢得更多。这份推理会迁移到你下一次拿到的大听牌，在一个你从没见过的牌面上。判定找到了分歧；对话把它填满。免费层级每天给你20手练习加3次教练对话，足够让"问为什么"在那些让你意外的手牌上，变成一个习惯。

## 总结

一个判定是一面镜子，不是对你作为玩家的一个判决。它把一个决定，拿去和一套策略比较：在策略之内，它告诉你你的动作有多核心；在策略之外，它告诉你这次绕路用大盲计算付出了什么代价。这就是它所声称知道的全部 -- 而正因为无差异原则，这也是任何一个诚实的判定所能声称的全部。

你的准确率数字，也应该被同样诚实地对待。被判定为GREAT或GOOD的决定所占的百分比，是一个练习指标，不是你的胜率。方差依然会决定你周五晚上的结果；你可以打出85%的准确率，却照样输掉三个买入，而那个来者不拒的人拖走了那一年最大的底池。

所以，没错 -- 即便在一个充满运气和混合策略的游戏里，一个决定也是可以被打分的。不是看它赢没赢，也不是靠一个假装比数学本身更精确的小数，而是看它相对于一个无法被摆布的策略站在哪个位置。这个判定，一手牌接一手牌地，向你展示你和那套策略在哪里出现了分歧。你拿这个信息去做什么，才是真正的训练。

标签

- gto training
- poker verdicts
- mixed strategy
- expected value
- poker feedback
- home game

## 20 手牌，每天免费

今天就开始用经过验证的策略和 AI 教练训练。你的前 20 手牌每天免费。

[免费开始训练](https://app.pokersense.app/signup)

无需信用卡。永久免费。
