AI 时代元年 · 第四局
李世石白 78 没有瞬间逆转,却做了更难的事
现代 KataGo 在 L11 落下后仍判 AlphaGo 约 98.7% 胜。那为什么它配得上“神之一手”?因为它不是一个静态数字,而是一连串只要机器答错一次就会改写比赛的具体问题。
AlphaGo(黑)vs 李世石(白) · 2016.03.13 · 五番棋第四局 · 白中盘胜 · 人类唯一一胜
零比三之后,胜负已经结束,人的问题还没有
前三局结束,AlphaGo 已提前赢得五番棋。第四局对总比分不再具有决定意义,却承担了更大的象征压力:李世石面对的是一个已经证明比自己强的系统,仍要寻找它不舒服的局面。
DeepMind 后来把白 78 称为“God's Touch”,并同样给出人类策略概率约万分之一的说法。这个标签容易让人误以为一手落下胜率就翻转;逐手分析显示,真正的故事是 L11 之后 AlphaGo 在复杂中央战连续偏离现代 KataGo 的防守。
李世石去抽烟,AlphaGo 开始犯错?
直播记忆里,白 78、李世石离席、AlphaGo 长考与随后异常着法常被剪成戏剧性蒙太奇。可以确定的是手顺和用时造成的压力;不能从画面直接证明系统内部“慌乱”或“理解了神之一手”。对程序赋予情绪,是好故事,不是技术结论。
更可靠的说法是:L11 把局面推入 AlphaGo 当时较难处理的形状。机器随后仍有可守住优势的道路,却在第 79、89、93、97 手附近连续损失目差,最终由领先转为落后。
L11 为什么对人和机器都难
白 78 是挖:落在黑棋中央联络的缝隙里,让相邻黑子同时面对断点与征子关系。它不给黑棋一个单纯“吃掉这颗白子”的问题,而是让每一种吃法都牵动外侧支援。
现代 KataGo 在第 77 手后判黑约 98.3%、领先约 14.5 目;L11 后仍是黑约 98.7%、领先约 14.4 目。白 78 甚至不在该局面前三候选中。可是黑 79 K10 后领先骤降到约 8.8 目;黑 89 R9 后只剩约 3.3 目;黑 93 S9 后评估翻成白棋领先约 2.1 目。神之一手不是瞬时数学翻盘,而是成功创造了错误走廊。
四条路线:制造难题,与客观最优不是同一件事
TreeView 的所有数值均为黑方视角。实战 L11 使用落子后的评估并接上现代 KataGo 的最佳应对;J11、N7、E8 来自第 77 手后的候选。
点击实战路线看 L10 的防守,你会看到现代模型认为 AlphaGo 可以稳住。再点 J11,会看到白棋先交换 J10、K10、G11,之后才回到 L11 一带——相似构想,手顺完全不同。
神之一手的“神”,在于找到对手会错的世界
如果把最优定义成对完美防守的最高胜率,现代 KataGo 不会选 L11;如果把任务定义成在 1.7% 左右的生存概率里制造一次真实胜利,它就是不可替代的实战杰作。
这也是人类复盘最重要的分层:先承认客观评估,再研究对手模型。TreeView 既保存“机器怎样守住”,也保存“李世石为什么选择让机器最难受”。