我用 WorkBuddy 的多智能体团队模式搭了一张德州扑克桌:一个荷官引擎加五个 AI 玩家,每人一本人设策略,打了五局。赛果看起来很精彩——松凶型玩家 P2 五局累计 +1260,跟注站 P5 第三局就被打破产(-1000)。
一个诱人的结论几乎是现成的:“松凶碾压跟注站,激进策略赢了。”
这个结论是错的——或者说,是不负责任的。五局牌里两次是所有人弃牌的 walk 局(底池合计只有 60),真正打完的完整牌局只有三手,摊牌更是只发生了两次。为了搞清楚”五局牌到底能说明什么”,我把五个人设翻译成了启发式参数,用同一个引擎跑了 1000 局蒙特卡洛(v1/v2 策略各 500 局)。数据揭示了三件比”谁赢谁输”有意思得多的事。



