十二盘名局横向研究 · 16

十二盘名局共同证明:最难应付的手,不一定是 AI 最佳手

从丈和鬼手、耳赤之妙手到 AlphaGo 第 37 手和李世石白 78,十二篇变化树反复出现同一条分界:客观最优、实战难度与历史勇气不是同一个指标。

  1. 先把一句“妙手”拆成三个不同问题

    第一问是客观价值:面对完美应对,这手与最优候选相差多少目。第二问是实战难度:它要求对手连续解决多少具体问题。第三问是历史勇气:在当时的知识、规则、比赛压力和可见信息下,这个选择突破了什么。KataGo 最适合回答第一问并帮助展开第二问,不能单独裁决第三问。

    价值、对手负担与历史条件构成三轴,任何单轴都不足以定义名局。
  2. 丈和第一鬼手说明实战抵抗可以损失评估

    “吐血之局”白 68 被传为第一鬼手,但当前深搜让黑方评估从约 92.3% 上升到 96.7%,目差也扩大。它仍有价值,因为丈和没有选择最干净的生存,而是把左边与中央拖入必须计算的战斗。历史称赞的是在劣势中持续制造责任,不是一个坐标获得 AI 认证。

    评估下降与实战负担上升可以同时成立,鬼手价值因此需要两条曲线。
  3. 耳赤之妙手说明全局感不等于数值最佳

    秀策黑 127 同时照看多个方向,旁观者从幻庵发红的耳朵读出压力;现代搜索却给出更直接的候选。这里不应把传说推翻成“坏棋”,而应区分一手的形象表达、对人类注意力的冲击和当前模型的细微价值排序。名局的教学重点是它如何组织全盘,不是要求复制天元附近的坐标。

    一手可以成为全盘组织的象征,即使搜索在同一局面偏好别处。
  4. AlphaGo 第 37 手把陌生与正确第一次重叠

    P10 肩冲的震动不只来自高价值,而是它在当时职业策略中几乎不会被优先考虑,却能用压低右边、保留中央弹性的棋理解释。它与古典妙手不同:不是人在压力中选择复杂性,而是机器把人类候选生成的边界向外推。真正的新意是搜索让一个陌生点进入可理解的高价值区域。

    陌生度与价值同时上升,AlphaGo 37 才从奇怪坐标变成新棋理。
  5. 李世石白 78 展示了针对对手的最佳

    现代 KataGo 在 L11 后仍判 AlphaGo 约 98.7% 胜,这手没有在静态数字上瞬间逆转。它做的是在近乎绝望的局面中找到一连串机器必须准确回答的问题。若目标是面对完美防守最大化胜率,模型可能选别处;若目标是在约 1.7% 生存空间里创造真实出错路径,L11 是不可替代的比赛杰作。

    客观最优与针对具体对手的最优在极端劣势中分离得最清楚。
  6. 李世石的征子把局部亏损写成全盘账本

    2003 年的征子名局从黑 67 到黑 97 让一串棋子被追赶,却不断在远处兑换先手收益。只看局部会说征子不利,只看第一节点会漏掉整条路线的账。变化树的意义正在这里:逐手显示某个局部损失是否购买了外部次序、厚味或时间,而不是把格言变成禁止按钮。

    局部损失沿全盘路线分期兑现,必须用变化树而不是第一手标签结算。
  7. 复盘自己的棋时保留两条答案

    先记录 AI 在充分搜索下偏好的客观路线,再保留你或对手在实战中最难处理的路线。比较二者分别减少了什么风险、增加了多少连续选择、是否依赖对方犯错。优势时更接近客观路线,劣势时允许用复杂性购买机会;但不能把“难应付”伪装成“数值最佳”。一盘棋最终留下的应是决策条件,而不是神之一手清单。

    客观路线与实战路线并排保留,最后把差异压缩成下一盘的决策条件。

历史与棋谱入口

  1. Google DeepMind · AlphaGo 官方回顾
  2. 日本棋院 · 本因坊丈和围棋殿堂
  3. AEB/CWI 历史与现代棋谱档案

评价一手名局着法时检查

  • 客观价值与实战难度分开描述
  • 历史处境有独立来源
  • 变化树至少比较完整路线
  • 没有把针对对手写成普遍最优
  • 结论能转成下一盘的判断条件
打开神之一手深读