
01 / 项目问题
让智能体学会在牌局中协作
四人协作掼蛋涉及隐藏手牌、组合动作与长期配合。项目围绕合法动作、候选检索和策略学习,探索智能体如何做出出牌决策。
02 / 实现思路
03 / 探索代码
从代码中探索
完整规则引擎
共享 108 张牌的掼蛋规则引擎,提供合法动作生成与牌局状态处理。
三代策略演进
V1 结构检索、V2 学习式选择、V3 记忆策略,按版本阅读和比较实现。
自博弈训练
结合状态与候选动作特征,通过策略与价值模型开展 PPO 训练。
面向四人协作掼蛋的 AI 智能体

01 / 项目问题
四人协作掼蛋涉及隐藏手牌、组合动作与长期配合。项目围绕合法动作、候选检索和策略学习,探索智能体如何做出出牌决策。
02 / 实现思路
03 / 探索代码
共享 108 张牌的掼蛋规则引擎,提供合法动作生成与牌局状态处理。
V1 结构检索、V2 学习式选择、V3 记忆策略,按版本阅读和比较实现。
结合状态与候选动作特征,通过策略与价值模型开展 PPO 训练。