别给对手命名——给范围重新加权

2026年7月4日

读牌是贝叶斯式再加权:保留先验,按各牌桶走出这条线的频率相乘,再归一化。封顶是删除;没有基数率的故事会骗人。

  • Bayesian inference
  • range reading
  • hand reading
  • probability
  • range updating
  • base rate

「他拿着 KK」不是读牌,是冻结。RiverOdds 的读牌笔记把同一类失误放在最前面:过早锁死单一组合,随后每条街的反证都被忽略。Deep Poker 与 VIP-Grinders 用更朴素的说法给出修法——维护一篮子带权重的手牌,让每次行动当过滤器。贝叶斯更新不过是承认这些权重是概率时,给这套过滤起的名字。

桌上不需要小数点。你需要三个对象、诚实的先验,以及线告诉你该改主意时真的改主意。

三个对象,不是一堂课

扑克里的贝叶斯公式可以压成「相乘再归一化」。学术上的对手建模笔记(以及更早的贝叶斯扑克程序,如 Korb 等人的 BPP)写成:后验范围 ∝ 先验范围 × 观测行动的似然。用人话讲:

  1. 先验质量——行动发生前,这个牌桶在范围里占多少(位置 + 此前街 + 已知死牌)。
  2. 似然——该牌桶实际走出你刚看到的行动的频率(下注、过牌、加注、尺度)。
  3. 归一化权重——相乘之后除一下,让存活牌桶加总到 100%。

很少走出该行动的牌丢掉质量;经常走出的牌获得质量。引擎就这么多。白板上的公式不会让你变强;拒绝跳过归一化这一步才会。

命名才是漏洞

把经典陷阱走一遍,然后别再犯。

Cutoff 开池,你大盲防守。翻前你认定「他拿 KK」。翻牌 A♠7♦2♣,他小注持续。KK 仍可能,但 Ax 已吃掉可信继续范围的大块——正是 RiverOdds 用来示范的再加权。转牌配了 7,他再开火。KK 成了少数派故事,不是「那手牌」。若脑子里还在回响「KK」,你已经不是在更新,而是在保卫执念。

改成把范围说出口:偏重 Ax,一些恨这张 A 的超对,一些继续开火的空气。 命名一个组合会压扁分布;再加权保留决策真正需要的比例——你领先多频、被碾压多频。

封顶是删除;软线只是再加权

不是每次行动都是同一种证据。

硬删除(封顶)。 翻前加注后,位置上在干燥翻牌过牌回,通常会剥掉大部分想堆池的坚果价值。翻牌 C-bet 后转牌过牌,下一街干同样的活:本该继续下注的强价值以高频率离开范围。把这些当成对后来「代表」的怪物的近删除——不是轻微提示。VIP-Grinders 的范围笔记反复敲:开池之后范围不是静态的;后期过牌往往才是钱所在,因为价值桶变薄了。

软再加权。 干燥 K 高面的小额翻牌 C-bet 仍保留很宽的中间带。价值常打;中等牌(对子、听牌)有时打;纯空气较少打。质量向中间移动,但空气并未被清空。这是再加权,不是清洗。把两者搞混,就会在一次小额开火后发明「他永远有牌」。

口诀:强价值几乎从不走的行动——先删除。强价值仍经常走的行动——只再加权。

基数率打败漂亮故事

忽略基数率是那种「感觉很聪明」的贝叶斯翻车。「这条线完美适合暗三」作为似然可以成立,作为后验仍可能错——因为暗三在多数开池范围里先验切片极薄。能走出同一条三街故事的空气与未中听牌,往往从多得多的组合起步。

买故事之前先问两句:

  • 去掉公共牌与阻断后,坚果类牌在先验里还剩多少组合?
  • 中等/空气里,能以非零频率走出同线的组合有多少?

若坚果类只剩 8 个组合、会讲故事的空气有 40 个,即使暗三似然很高,也不自动等于下注范围里暗三占多数。Korb 式贝叶斯扑克程序吃过同样的亏:没有诚实先验的行动似然,只会产出自信的错误后验。

似然是猜测——请标明

这类文章的旧写法爱发明表格:价值 C-bet 90%、中等 50%、空气 15%,再把后验打到一位小数。那是伪精度。人群河牌诈唬偏少;有人过度连打;solver 会混合。你的似然是估计,不是测量。

用档位校准,别用假小数:

证据质量 用法
摊牌库 / HUD 先调空气似然:对 C-bet 弃牌率、转牌连打、河牌激进度
人群默认 多数池子多街诈唬偏少;相对 solver 混合,压低空气的河牌似然
陌生对手 用宽而保守的带(「很少 / 有时 / 经常」),并把误差条拉宽

当河牌价签要求诈唬抓约 30% 权益时,你不需要「24.1% 诈唬」。你需要方向判断:以这个池子、这条线,诈唬份额大概能不能清到三分之一——还是下注范围仍偏价值? 诚实答案是「大概不够」就弃;摊牌与激进度显示他乱喷就跟。同一手牌、不同似然表、不同后验。框架的意义正在于此。

一条完整回路(先定性,再标价)

6-max 现金约 100bb。Cutoff 开池;你大盲用 T♠9♠ 防守。翻牌 K♥T♦5♣ 彩虹。你过牌;他小注持续(约 ⅓ 池);你跟。转牌 2♦ 空白;你过;他加大(约 ⅔–¾ 池);你跟。河牌 7♣ 砖;你过;他打约 ¾–1× 池。

开池后的先验(粗略,不是圣经): CO 范围宽但不如按钮——对子、大牌、同花连张。在 K-T-5 上分成价值(暗三、KT、强 Kx)、中等(Tx、弱 Kx、听牌)、空气(空气 + 弱高张)。

翻牌小注: 软再加权。干燥面上价值与中等都常打;空气较少。后验偏中等+价值,空气变薄但未消失。第二对继续没问题——你不是「盼他拿 KK」,而是对着仍偏宽的下注范围买到了价。

转牌更大注: 更硬的过滤。许多弱中等放弃;顽固空气再缩;想收税的价值继续打。相对翻牌,后验向价值倾斜,但「还有故事」的未中听牌仍留在中等/空气混合里。别跳到「他坚果了」。

砖面后的河牌下注: 现在问基数率。哪些价值乐意三街开火——暗三、两对、从未慢打的强 Kx?还剩哪些诈唬——像 QJ/J9/98 这类跟了两街、现在零摊牌价值的未中顺子听?你的 T9 是纯诈唬抓:赢未中的,输给价值桶。

标价。若他往约 22 里打 18,跟注打平大约需要 18 / (22 + 36) ≈ 31% 权益。这个数来自底池赔率,是精确的。诈唬份额不是。在几乎从不三连打空气的池子里,空气似然贴地 → 后验诈唬份额很可能过不了 31% → 弃。若对面常摊出未中大牌,抬高空气似然 → 跟。同一手牌,不同似然表,不同后验。这才是框架。

强迫更新的复盘练习

离开牌桌,挑五手摊牌局。河牌行动落定前写下:

  1. 翻前之后的先验桶(一行)。
  2. 翻牌行动删除了什么、再加权了什么。
  3. 转牌行动删除了什么、再加权了什么。
  4. 你估的诈唬份额对照底池赔率数字——跟或弃,一句话理由。

然后揭晓。失误教校准:你高估了故事、忽略了封顶,或把 GTO 空气频率套在 nit 身上。关于策略不确定性下信念更新的研究反复撞上同一类失败——更新幅度跟不上证据强度。这套练习就是用来惩罚那种惯性。

这样读牌故意保持无聊:先验、似然、归一化、尊重封顶、不信没有组合质量的漂亮线。少给手牌命名。多给范围再加权。