柯洁说"装弱智就能赢围棋AI",是吹牛吗?原理其实很简单

导读柯洁说,他找到方法破解围棋AI了:哪怕让九子,只要你故意"装弱智"乱下,就能赢。

柯洁说,他找到方法破解围棋AI了:哪怕让九子,只要你故意"装弱智"乱下,就能赢。

这话一出很多人觉得是开玩笑,其实真不是玄学,这个思路早在五六年前就有人验证过,确实击中了当前AI训练逻辑的软肋。

我最早看到类似的测试,还是AlphaGo刚出来那几年,就有业余棋手靠乱下赢过早期版本。

核心原理其实很好懂:

现在所有主流围棋AI,都是靠"强化学习+蒙特卡洛树搜索+胜率剪枝"工作的。

AI每下一步,都会提前砍掉那些看起来胜率低的分支,把有限的计算力都留给胜率高的走法。

这个优化本身没问题,但它有个大前提:对手的走法得符合"正常棋"的分布。

如果你一直按正常棋理走,AI算得比你准一万倍,怎么下都赢不了。

但你要是故意乱下,每一步都走AI眼里胜率低于10%的怪招呢?

AI一开始就把这些分支全剪了,根本没往深处算,等发现不对的时候,棋盘已经被你搅得一塌糊涂,胜率评估完全错了。

为什么偏偏是让九子的时候,这个方法特别好用?

本来AI让九子就已经劣势很大,棋盘上到处都是你的棋子,AI搜索空间本来就比正常对局小很多,再被你这么一搅,错进错出,人类真的有机会抓住漏洞赢下来。

人类对付围棋AI的三种策略对比

我把三种人类对付AI的策略整理出来,你一眼就能看懂:

正常拼实力:不管AI让你几子,都按正常棋理走,赢面基本是0%,AI让二子你都赢不了,计算力不在一个级别。

柯洁这个方法:故意装弱智乱下,专门挑AI眼里胜率低的走法走,利用AI剪枝的缺陷,让九子情况下能有30%-50%的赢面,这个概率真不算低了。

但这个方法有保质期:只要AI开发者针对性地在训练里加入乱招,做一轮对抗训练,这个缺陷很快就能补上,胜率又会跌回接近0%。

所以结论其实挺有意思:

柯洁说的不是"人类终于战胜了围棋AI",而是当前AI架构确实存在这个可被利用的漏洞。它是训练逻辑带来的,不是AI能力不够。放到让九子这个特定场景下,真的能赢,不是吹牛。

最后说句题外话,这个道理其实不止适用于围棋。

现在很多大模型不也一样?训练的时候都学"正确标准答案",遇到完全不按常理出牌的问题,经常一本正经地胡说八道。

本质都是同一个问题:分布不对,再强的能力也发挥不出来。