Di Oleg Ostroumov abbiamo parlato un anno fa, presentandovi così l’inventore del primo solver. Chi meglio di un ex poker player, sviluppatore ed esperto di intelligenze artificiali, per parlare un po’ della teoria alla base di GTO ed Exploitative?
La stessa cosa deve averla pensata Dan Cates, che ha invitato al suo podcast Ostroumov. Ne è nata una chiacchierata interessante, di cui riportiamo un estratto utile a comprendere meglio la teoria dell’adjusting.
| Room | Bonus | Visita |
|---|---|---|
| Welcome Bonus Poker 100% fino a 1.000€ | ||
| Fino a 2.000€ di REAL BONUS | ||
| 1.000 Free Spin + 7.000€ di Bonus SPID |
Jungleman: Non puoi prevedere completamente la strategia del tuo avversario. Io uso decisamente molto la GTO, ma so che ci sono forti tendenze nel mio field, e tendo a prendere più in considerazione quelle. Poi ricorro alla GTO nei casi in cui non so cogliere la situazione.
Ostroumov: Sì, un’altra cosa riguardo alla best response è che la miglior risposta è davvero estrema. Diciamo che riesci a scrivere la strategia del tuo avversario, e viene fuori che lui overfolda leggermente. diciamo un 3% in più in confronto all’ottimale. La miglior risposta è bluffare ogni mano. Questa cosa ha senso per te?
Jungleman: Direi che ha senso… beh no in effetti no. Penserei ‘Ok posso bluffare così ogni volta’, ma magari successivamente overfoldano ancora di più in base alle permutazioni che derivano dopo. Mi direi di overbluffare un po’, ma visto che so che folda molto di più quando va check-check e poi checka ancora, per esempio, allora potrei bluffare più in quei casi. È lì che inizia la strada dell’exploit duro.
| Room | Bonus | Visita |
|---|---|---|
| Welcome Bonus Poker 100% fino a 1.000€ | ||
| fino a 3.500 € | ||
| fino a 1.000 € |
Ostroumov: Sì, non blufferai il 100% al flop necessariamente, ma per esempio al river la miglior risposta è probabilmente bluffare 100%.
Jungleman: Sì, capisco. È perché non ci sono ulteriori possibilità , ma finché ci sono altre strade devi navigare tutti i rami del game tree per vedere che cosa sia effettivamente meglio.
Ostroumov: La best response è utile per misurare la qualità dell’Equilibrio di Nash approssimato, ma per la giocata effettiva non è pratica da applicare. E poi i risultati non sarebbero utili comunque.






