从零写一个麻将引擎,教一个 AI 打牌,再让它自己变强。代码、教程、可以上手玩的游戏,都在这里。
16 章,跟着仓库的真实代码走:引擎 → 规则 bot → 监督学习 → PPO → 评估,以及几次诚实的失败。
观战四个 AI 对局,或者自己坐下打。每一步都能看到神经网络给每张牌的打出概率和规则分析。
训练曲线之外:危险牌打出率、弃听率这些行为探针,以及一局回放里每一步的价值估计、优势和奖励。
Python,不到 3000 行,无 RL 框架。引擎、agent、特征、训练、评估、这个网站,全部开源。
majiang/riichi/