【转】申真谞 vs KataGo 人机战 Discord 社区完整解读
围棋吧
全部回复
仅看楼主
level 1
adiossakura 楼主
一、事件背景本次讨论针对 2026 韩经棋神战三番棋:申真谞受让两子对战 KataGo,G1 AI 取胜、G2 申真谞 4 目半翻盘,社区核心争议为第二局 KataGo 被刻意限制算力、配置不透明,赛事宣传与实际运行参数严重不符。
赛事公开配置(宣传口径)
权重:官方宣称使用最强kata1-zhizi-b40c768nbt权重
算力:4 张 RTX3090,每手 10 万次搜索访问(100k visits),20 秒单步时限,关闭预读(ponder)
让子参数:默认 PDA(对手降权系数)0.6~0.7
Discord 社区核心质疑者:medwin0697(ID 原名 Handibot)2019-2022 年 KataGo 社区知名研究者,曾完成人类战胜高配置 KataGo 让子对局,拥有大量 H3/H4 让子棋实测数据,是本次质疑的核心举证者。
二、核心技术术语先释读1. Visit/Playout(搜索访问量)AI 每一步蒙特卡洛模拟次数,数值越高棋力越强:
数千次(mid-k):低算力,官子、复杂战斗大量漏招,落子可复现度极高
10 万次(100k):宣传标准满配算力,复杂变化计算完整
复现率指标:使用相同配置复现对局落子,匹配度越高说明真实算力越低
2. PDA(Player Difference Adjustment,对手棋力衰减系数)KataGo 专门用于让子棋的参数:通过缩放对手搜索访问量,模拟人类棋力不足;
PDA=3:对手搜索量仅为己方 1/3,大幅弱化 AI 对对手强招预判,适合人类挑战
低 PDA(0.6~0.7):几乎不弱化对手,AI 默认双方同等棋力
关键结论:高 visit(100k)会稀释 PDA 的弱化效果,满算力下 PDA 几乎失效,无法制造公平人机让子局
3. 网络权重分级
b40c768:顶级通用权重,均衡强,擅长复杂战斗;
b20c256:攻击性更强,更适配对战人类的让子局;
humanSL:人类监督学习网络,专门模拟人类棋手低水平思路,用于大幅弱化 AI;
双网络方案:己方强权重 + 对手 humanSL 弱网络,比单纯调 PDA 更适合高让子(H3+)对局。
4. Uncertainty(不确定性分值)AI 对局面判断的波动值:正常人类对战让子局,中盘不确定性会显著上升;G2 全程不确定性低于 10,不符合正常对局特征,被视作配置异常佐证。
三、社区完整核心论点拆解(一)medwin0697 三大证据:G2 算力被人为压低
落子高复现率证明真实算力仅数千次导入 G2 棋谱 SGF 复盘:使用仅 2000 次 visit、PDA=0.6~0.7配置,落子匹配度高达 98.6%;若拉满宣传的 30k/100k visit,匹配度仅 90%,无法复现大量劣招。反观 G1:2k visit 仅 88% 匹配,30k visit 可达 95%,符合正常算力梯度规律。结论:第二局 AI 实际运行算力上限仅 1000 次 / 手,远低于宣传的 10 万次。
中盘(169 手后)算力进一步下调,出现低算力专属失误169 手之后,仅需几百次 visit 即可完整复现所有招法;中腹切断局部出现明显低级失误,这类错误仅会在极低算力下出现,小幅提升计算量即可规避。推测赛事方中途刻意削减算力上限,人为制造人类取胜窗口。
不确定性指标反常数百局职业棋手 H3/H4 实测数据:正常让子局中盘不确定性会明显抬升;但 G2 80 手后不确定性从未超过 10,AI 全程判断僵化,是参数被锁死的典型特征。
(二)技术层补充讨论:高 visit 反而不利于人机公平对战(Emerald Lane 核心观点)
满配 100k visits 会抵消 PDA 的弱化作用PDA=3 时,100k 访问下对手仍分到 10k + 模拟量,AI 会预判对手最强应对,失去人类棋手的失误容错空间,人类几乎没有翻盘机会。
高访问量鼓励 AI 走复杂贴身战斗,反而压缩人类发挥空间;低算力 AI 会出现人类可捕捉的官子、定式漏洞。
高让子(H6+)场景,单网络 + PDA 方案效果极差,必须搭配 humanSL 双弱网络才能实现公平对局;仅靠调整 visit 无法平衡棋力差距。
(三)其他社区成员补充观点
Chaoz:韩国棋协(KBA)工作人员不了解 KataGo 配置文件,参数修改大概率来自赛事技术合作方 TyGem;赛事媒体曝光度低,仅职业围棋圈高度关注。
fishku:要求举证者补充 G1 同维度复盘数据,对比两局算力差异,完善证据链;所有人认同赛事必须完整公开全部运行参数,不存在唯一标准的 KataGo 棋力。
kendfrey:赛事最大弊病是参数不透明,普通观众无法认知 AI 真实上限;有猜测认为对局开启了温度(temperature)随机落子参数,人为增加 AI 失误概率。
84847. 披露硬件事实:仅 4 张 3090、关闭预读、单步仅 16~17 秒有效计算时间(20 秒时限含硬件调度开销);甚至无法确认赛事是否使用宣传的 b40c768 权重。
(四)背景动机推测Emerald Lane 提出文化层面猜想:作为韩国全国性直播赛事,若 AI 两局速胜会观感不佳,主办方存在调整参数平衡胜负的动机;medwin0697 回避文化层面评价,仅聚焦技术数据客观举证。
四、关键数据汇总(medwin0697 实测复现结果)表格
对局 复盘算力 落子匹配复现率
G1(AI 胜) 2k visits 88%
G1(AI 胜) 30k visits 95%
G2(申真谞胜) 2k visits 98.6%
G2(申真谞胜) 30k visits 90%
核心反差:G2 低算力下匹配度反常拉高,证明本局 AI 全程运行在极低搜索量限制下。
五、争议双方核心立场总结质疑方(medwin0697、Emerald Lane 等)
赛事宣传 “满配最强 KataGo” 与第二局实际数千次算力运行严重不符,存在刻意压低 AI 棋力、操控对局结果嫌疑;
人机对抗赛事必须完整公开权重、visit、PDA、温度、预读开关等全部配置,否则对局不具备参考价值;
100k 高 visit 不适合用于人类挑战让子局,合理公平对战应采用低 visit + 高 PDA 或双网络 humanSL 方案。
中立 / 审慎方(fishku、Chaoz)
认可数据存在异常,但需要 G1 完整对照复盘才能坐实结论;
韩国棋协无修改参数能力,修改行为大概率由技术承办方执行;
统一诉求:赛事官方完整公示对局全部配置文件,消除外界猜测。
赛事客观限制(事实,非洗地)
硬件仅 4 张 RTX3090,算力上限天然受限;
规则强制关闭预读(Pondering),人类思考时 AI 完全停止计算,天然削弱 AI;
单步 20 秒硬时限,硬件调度占用 3~4 秒,有效计算时间不足。
六、补充行业延伸知识点
为什么让子棋不能单纯拉高算力?标准 KataGo 自弈时双方网络、算力完全均衡;让子棋存在天然棋力差距,高 visit 会让 AI 完美预判对手最强应对,人类失误会被无限惩罚,完全没有翻盘空间。PDA、humanSL 弱网络是官方设计的平衡手段,而高算力会直接抵消平衡参数。
humanSL 双网络方案优势对局时己方使用强权重,对手节点加载人类监督学习弱网络,从底层模仿人类低水平思路,比单纯缩放 visit(PDA)更贴合真实人类棋路,适合高让子职业人机对抗,也是社区公认最公平的配置。
本次事件行业影响赛后全球围棋 AI 社区形成共识:正式人机对战必须完整开源全部运行参数、硬件环境、权重文件;仅标注显卡数量 / 单步时间存在极强误导性,无法反映 AI 真实棋力。
2026年07月20日 10点07分 1
level 9
韩国要是能公开参数就好了
2026年07月20日 10点07分 3
level 7
果然,人机大战不是随便什么单位都能办的,屁股问题。
2026年07月20日 11点07分 5
level 13
看了下,大致意思是,官方宣传每步达到100k计算量(10万),但是根据复刻,发现第二局在只有2k计算量时Ai吻合度高达98.6%,但是到30k计算量时反而只有90%,说明第二局的计算量是用了低计算量,并非官方宣传的100k。
应该说数据还是很有说服力的。所以最好的做法就是比赛过程中直接显示Ai计算量,这样就没有争议了。
至于怎么搭配最适合让子棋,我认为这么专业的问题就不追究了,首先保证计算量,有这个就可以
2026年07月20日 11点07分 7
不过我也怀疑这位统计的人数据的可靠性。因为他说169是失误,但我用Ai1000多K跑,是一选或者二选。见8楼
2026年07月20日 11点07分
level 13
169算失误?100多k计算量下,是二选
2026年07月20日 11点07分 8
更正:是100多万计算量,也就是1000k
2026年07月20日 11点07分
如果按一选走后续变化是什么
2026年07月20日 11点07分
@贴吧用户_a6tt15X 看10楼,和实战一样
2026年07月20日 11点07分
回复 活宝扁你个头 :好的
2026年07月20日 11点07分
level 13
高算力下,实战就是一选,后续到白3和实战完全一样。
这篇文章作者危言耸听
2026年07月20日 11点07分 10
@wholycow 你挺搞笑的,模板有这么大差距?弈客200多万算路居然是问题手?
2026年07月20日 13点07分
这是什么模型版本,你不知道吧?
2026年07月20日 13点07分
@活宝扁你个头 不是 katago 最新权重说服力不大
2026年07月20日 14点07分
@尘印之zero 那你就拿出所谓最新权重来跑跑看啦!
2026年07月20日 15点07分
level 1
不确定性指标和计算量的关联性未建立
2026年07月20日 11点07分 11
他以让3.4子业余棋手的娱乐对局为参照,不确定性指标当然大幅上升啦 这是比赛棋手苟着下不确定性肯定大幅下降
2026年07月20日 12点07分
吧务
level 14
2026年07月20日 12点07分 12
katago大概率是32或者16bit量化,4bit是跑llm的,实际算力大约是两张5090的1/2+
2026年07月25日 14点07分
level 13
我认为,只要计算量有保证,其他都不重要,难道为了赢人类专门调出一个最佳让子方案?这已经说明Ai已经让不动了
2026年07月20日 12点07分 13
文章意思让子棋是视对手棋力弱而不能用最强招法。如果用平手最强,人类任何微小失误都会被惩罚。大概是让子棋不能过分追究低手的失误?
2026年07月20日 12点07分
@zhongl36 不是。大概意思是Ai不能把对手想得太强,这样Ai就不敢下过分手。大概因为让子是调了一个对手水平强度,计算量太大,则对手水平等于也提升了,这样Ai的着法就更本分。
2026年07月20日 12点07分
@活宝扁你个头 他说的效果最好是对被让子方更公平。公平了,AI就不能过强。
2026年07月20日 13点07分
二)技术层补充讨论:高 visit 反而不利于人机公平对战(Emerald Lane 核心观点) 满配 100k visits 会抵消 PDA 的弱化作用PDA=3 时,100k 访问下对手仍分到 10k + 模拟量,AI 会预判对手最强应对,失去人类棋手的失误容错空间,人类几乎没有翻盘机会。
2026年07月20日 13点07分
level 1
这是medwin0697的原文。
他可能没有验证169
2026年07月20日 12点07分 14
多谢。上面是ai总结的,可能有误。
2026年07月20日 12点07分
level 9
干脆,第三局用宣布的硬件配置,用KATAGO最强参数,让三子。
2026年07月20日 12点07分 15
level 1
这步大概是KataGo第二盘后面的问题手
2026年07月20日 12点07分 16
level 1
透明度不够,加上主办方身份相关,给阴谋论提供了发育的土壤。
从让子棋的角度看,马上点角走了个1/4棋盘的大定式大幅缩小棋盘对让子方是非常不利的。当然katago没有这种人类思维
2026年07月20日 13点07分 17
李轩豪战胜申真胥的时候影响阴谋论发生了?不就是别人都下不赢凭什么你能赢的妒忌心理。
2026年07月21日 10点07分
@厉害的膏药 没有第三方监管,遭人质疑是正常的事。就像当年有质疑李阿大战,最后还是放出论文,别人也能复制出强ai后打碎所有质疑
2026年07月21日 11点07分
level 8
仅四张3090[阴险]
2026年07月20日 13点07分 18
把用时抹平,是1/2张3090
2026年07月21日 08点07分
level 12
拿个机器多跑一会儿,截止到135手KATAGO仅仅不下一选就亏出去了4.3目(第一局也跑过就很正常) [滑稽][滑稽][滑稽][阴险][阴险][阴险]
2026年07月20日 13点07分 19
1 2 尾页