算法01
写一个会下中国象棋的 AI(下):当"改进"被 A/B 对弈证伪
评估函数才是棋力天花板。我做了子力动态化、分阶段插值(tapered eval)、残局库三件事,却用 A/B 对弈发现两个"改进"其实让棋力变弱。附真实对弈数据与一个静默上线的严重 bug 教训。
2026-08-30 21:23:423 阅读
共 1 篇文章
评估函数才是棋力天花板。我做了子力动态化、分阶段插值(tapered eval)、残局库三件事,却用 A/B 对弈发现两个"改进"其实让棋力变弱。附真实对弈数据与一个静默上线的严重 bug 教训。