Problema
O pôquer de torneio pune uma estratégia estática: os oponentes vão de estações passivas a maníacos hiperagressivos, e alguns mudam de estilo no meio da partida para atrair um contra-ataque fixo.
Contexto
Pablo construiu um bot em camadas sobre o motor do clube, além de um fluxo de trabalho de estudo que estaciona desafiantes em uma trilha separada, de modo que o código de produção permaneça estável enquanto os experimentos rodam.
Método
O modelo de oponente pondera sinais recentes de aposta por street, tamanho de pote e custo de continuação, sinaliza instabilidade e risco de sinal barato, e alimenta um seletor no estilo bandit que roteia entre os modos solid, pressure, trap, showdown, robust, counter, equity e predator. Um desafiante híbrido adiciona roteamento posterior de regime, pontuação empacotada de EV por bucket abrangendo five action buckets, e uma extensão de maior computação da busca no turn condicionada por incerteza que o bot de produção já executa. A promoção passa por estudos orientados por manifesto com reconciliação de baralho duplicado.
Resultado
A âncora congelada se manteve como padrão de produção porque cada desafiante, incluindo a pilha híbrida mais rica, não conseguiu superá-la no portão ponderado mais longo; o registro de laboratório documenta esse veredito junto com os caminhos dos artefatos.
Escopo de verificação
A evidência permanece em autojogo interno contra proxies heurísticos ao longo de amostras curtas a médias; um número principal de torneio público permanece pendente.
Evidência
O documento de estratégia commitado, a documentação de fluxo de trabalho e o registro de laboratório em andamento documentam a pilha de roteamento, os portões de promoção e cada decisão de aceitar ou rejeitar; os scripts de estudo de baralho duplicado que regeneram as comparações permanecem fora da árvore pública.