Poker Sense

Miten Poker Sense arvioi päätöksesi

GREATista BLUNDERiin: miten Poker Sense arvioi pokeripäätöksiä solverin taajuuden perusteella EV-tappion sijaan, ja mitä aidosti tiukka spotti oikeasti tarkoittaa.

The Poker Sense TeamLukuaika: 7 min

Sait juuri harjoituskäden valmiiksi Poker Sensessä. Olit big blindissä – paikka joka postaa isomman kahdesta pakotetusta panoksesta ennen kuin yksikään kortti on jaettu – ja maksoit preflop-korotuksen pitäen Jätkää ja Kymppiä patoja. Flop, ensimmäiset kolme jaettua yhteistä korttia, tuli Kuningatar patoja, Ysi patoja, Nelonen hertaa. Checkasit, vastustajasi panosti noin puoli pottia, ja arvioit tilanteen: open-ended suoradraw (mikä tahansa Kuningas tai Kahdeksan täydentää suoran) plus väridraw (yksi lisää pata tekee värin). Maksaminen tuntui hyvältä. Maksoit.

Arvosana palasi: GOOD. Sen alla, yksi rivi: “Raise on ensisijainen siirto (68 %).”

Hyvä? Ei loistava? Sinulla oli hirviödraw, otit varovaisen linjan, ja ilmeisesti tietokone halusi sinun korottavan – mutta vain 68 prosenttia ajasta, mitä ikinä se tarkoittaakaan. Mikä nostaa esiin oikean kysymyksen. Mitä arvosana yhdestä pokeripäätöksestä edes tarkoittaa? Pokeri on tuurin peli, ja matematiikka itse usein sanoo pelaamaan saman käden kahdella eri tavalla. Voiko yksittäistä päätöstä arvioida ollenkaan?

Voi, mutta ei tavalla jonka useimmat olettavat. Sen läpikäyminen miten Poker Sense oikeasti tekee sen, osoittautuu melko hyväksi kierrokseksi siitä miten ajatella pokeripäätöksiä yleensä – alkaen siitä miksi ilmeinen tapa arvioida niitä epäonnistuu.

Ilmeinen tapa arvioida, ja miksi se epäonnistuu

Ilmeinen tapa arvioida pokeripäätös on mitata mitä se maksoi. Moderni pokeristrategia tulee solvereista: ohjelmista jotka pelaavat tilannetta itseään vastaan miljoonia kertoja kunnes ne konvergoituvat Game Theory Optimal -strategiaan – GTO lyhyesti – mikä tarkoittaa strategiaa jota ei voi hyödyntää riippumatta siitä mitä vastustaja yrittää. Mille tahansa spotille solveri voi kertoa sinulle odotetun arvon jokaiselle toiminnolle: keskimääräisen summan jonka toiminto voittaa tai häviää pitkällä aikavälillä, yksittäisen käden tuurin keskiarvoistettuna pois. Vertaa siis valitsemaasi siirtoa parhaaseen saatavilla olevaan siirtoon. Ero keskimääräisessä voitossa on arvosanasi. Yksinkertaista.

Tässä on ongelma, ja se on koko tämän postauksen matemaattinen ydin. Useimmilla flopeilla solveri ei valitse yhtä toimintoa. Se pelaa sekastrategiaa: samalla kädellä samassa spotissa se korottaa joskus ja maksaa joskus, tietyillä taajuuksilla. Ja tasapainossa – tilassa jossa molemmat pelaajat pelaavat täydellisesti eikä kumpikaan voi hyötyä muuttamalla mitään – jokaisella toiminnolla jota solveri oikeasti käyttää sekastrategiaspotissa on täsmälleen sama odotettu arvo.

Se ei ole sattumaa. Se on syy miksi sekoittaminen ylipäätään on olemassa. Jos korottaminen tuottaisi edes hieman enemmän rahaa kuin maksaminen, solveri ei korottaisi 68 prosenttia ajasta; se korottaisi 100 prosenttia ajasta, koska solverit ovat armottomia voiton suhteen. Sekoitus voi säilyä vain kun sen sisältämät toiminnot ovat täsmällisesti sidottuja toisiinsa. Peliteoreetikot kutsuvat tätä indifferenssiperiaatteeksi: tasapainossa olet indifferentti sekoituksen toimintojen välillä, koska ne tuottavat identtisesti.

Katso nyt mitä se tekee ilmeiselle arviointitavalle. Callisi Jätkä-Kymppi-kädellä? Nolla odotettua arvoa menetetty. Raise jota appi kutsui ensisijaiseksi siirroksi? Myös nolla. Foldaaminen – se ainoa toiminto jota solveri ei koskaan tee tuolla kädellä – on ainoa valinta joka maksaa mitään. Arvioi pelkän EV-tappion perusteella ja lähes jokainen edes suunnilleen järkevä postflop-päätös palaa “täydellisenä.” Todistus jossa lähes kaikki on kympin arvoista, ei ole palautetta. Se on tapettia.

Signaali jota EV-tappio ei näe

Joten Poker Sense arvioi jotain mitä EV-tappio ei näe: solverin taajuuksia.

Kun solveri korottaa 68 prosenttia ja maksaa 32 prosenttia, molemmat toiminnot ovat kunnossa – mutta ne eivät ole identtisiä tapoina. Vastustajasi eivät koskaan pelaa yhtä päätöstä vastaan; he pelaavat koko rangeasi vastaan, eli jokaista kättä jota saatat pitää tehdessäsi tietyn toiminnon. Pelaaja joka maksaa jokaisella isolla draw’lla tällaisissa spoteissa rakentaa, yksi ilmainen päätös kerrallaan, erilaista rangea kuin solveri rakensi. Hänen korotuksensa sisältävät vain vahvoja valmiita käsiä, mikä tekee noista korotuksista helppoja pelata vastaan. Hänen maksunsa ovat täynnä draw’eja, mikä tekee hänen myöhemmistä panoksistaan helppoja lukea heti kun suorakortti tai värikortti laskeutuu. Jokainen yksittäinen maksu ei maksanut mitään tasapainossa. Tapa siirsi hänet hiljaa eri strategialle – sellaiselle jolle “ei maksa mitään” -takuuta ei koskaan myönnetty.

Se on oivallus jonka päälle koko arvostelujärjestelmä on rakennettu. Taajuuden yhdenmukaisuus on signaali jota EV-tappio ei näe. Kun toimintosi on solverin strategian sisällä, hyödyllinen kysymys ei ole “mitä tämä maksoi” (ei mitään) vaan “kuinka keskeinen tämä toiminto on strategialle.” Kun toimintosi on strategian ulkopuolella, kustannuksesta tulee täsmälleen oikea kysymys, koska nyt sellainen aidosti on olemassa.

Kuusi arvostelua

Poker Sense lajittelee jokaisen päätöksen yhteen kuudesta arvostelusta. Kolme ensimmäistä tarkoittavat että olit solverin strategian sisällä, ja ne eroavat toisistaan vain siinä kuinka usein solveri tekee mitä sinä teit. Kolme viimeistä tarkoittavat että olit sen ulkopuolella, ja ne eroavat vain siinä kuinka kallis kiertotie oli. Kustannus mitataan big blindeissä – sen pakotetun panoksen koossa jonka postasit, pokerin standardi mittayksikkö, yleensä lyhennettynä bb.

GREAT tarkoittaa että valitsit ensisijaisen siirron, toiminnon jota solveri tekee useimmin – tai toiminnon jota solveri pelaa 10 prosenttiyksikön sisällä ensisijaisesta yhtä usein. Tuo toinen lause on tärkeä. Kun solveri korottaa 52 prosenttia ja maksaa 48, maksaminen ei ole huonompi valinta; se on puolet aidosta kolikonheitosta, ja se arvioidaan sellaisena.

GOOD tarkoittaa että valitsit toiminnon jota solveri tekee merkittävän osan ajasta: 15 prosenttia tai enemmän. Jätkä-Kymppi-callisi laskeutuu tähän. Solveri korottaa tuota kättä useimmiten ja maksaa useimmiten lopun, joten maksaminen on aito osa strategiaa. Vain ei otsikko.

OKAY tarkoittaa että toimintosi on solverin strategiassa, mutta harvinainen: alle 15 prosenttia. Ei mitään menetettyä, ei mitään anteeksipyydettävää. Mutta jos päädyt tähän jatkuvasti samanlaisessa spotissa, strategian painopiste on jossain missä sinä et ole.

IFFY tarkoittaa että poistuit strategiasta, mutta halvalla: alle 1,5 big blindiä menetettyä odotettua arvoa. Oikeaa rahaa ajan mittaan, ei hätätilanne tänään.

MISTAKE tarkoittaa että kiertotie maksoi 1,5-3 big blindiä. Nämä ovat päätöksiä joissa kohdennettu opiskelu maksaa itsensä takaisin nopeimmin.

BLUNDER tarkoittaa 3 tai enemmän big blindiä menetettyä. Jätkä-Kymppi-kädessä, tuon viidentoista outsin hirviödraw’n foldaaminen puolen potin panosta vastaan polttaisi useita big blindeja ja laskeutuisi tähän. Jokaisella on blundereita sisällään; pointti niiden löytämisessä harjoittelussa on että harjoittelupelimerkit ovat ilmaisia.

Yksi luku vielä sitoo tämän yhteen: sessio-tarkkuutesi on yksinkertaisesti prosenttiosuus päätöksistäsi jotka arvioitiin GREATiksi tai GOODiksi. Se on nopea lukema siitä kuinka usein pysyit lähellä strategian keskustaa.

Mitä “tiukka spotti” oikeasti tarkoittaa

Jotkut spotit eivät ole ollenkaan tiukkoja – solveri tekee yhtä toimintoa lähes aina, ja mikä tahansa muu on vuoto. Mutta paljon spotteja on aidosti sekoitettuja, kahdella tai useammalla toiminnolla jotka ovat lähes tasavertaisia. Jos solveri panostaa 45 prosenttia ja checkaa 55, nuo siirrot ovat käytännössä kaksosia. Indifferenssiperiaate sanoo että ne tuottavat saman verran, ja taajuudet sanovat että solveri tuskin kallistuu kumpaankaan suuntaan.

Kuvittele että sinulle kerrottaisiin että “epäonnistuit” panostamalla tuossa spotissa. Se ei olisi opettamista; se olisi kohinaa. Vielä pahempaa, se opettaisi sinut metsästämään yhtä oikeaa vastausta tilanteissa joissa koko matemaattinen pointti on ettei sellaista ole.

Joten kun spotti on tiukka, Poker Sense sanoo niin. Se 10 pisteen ikkuna GREATin sisällä on olemassa juuri tätä varten, ja insight-rivi tulee suoraan sen mukana: “Tiukka spotti – molemmat siirrot ovat hyviä.” Tuo rivi on appi joka kertoo sinulle mistä ei kannata olla huolissaan. Kädet joita kannattaa käydä uudelleen läpi kotimatkalla, ovat niitä joissa sinä ja solveri aidosti erositte toisistaan – ei kolikonheittoja.

Miksi arvosana on sana, ei numero

Jotkin harjoitteluvälineet aloittavat raakadatalla: bet on 2,31 big blindin arvoinen, check on 2,28 arvoinen. Poker Sense laskee myös kaiken tuon – se on täsmälleen miten IFFY-, MISTAKE- ja BLUNDER-rajat piirretään, isot poikkeamat arvioituna täsmälleen sen mukaan kuinka monta big blindiä ne polttavat – mutta itse arvosana ei koskaan saavu desimaalilukuna. Kaksi syytä.

Ensinnäkin, väärä tarkkuus. Solveridata on konvergoituneita approksimaatioita: solveri ajaa kunnes sen strategiat lakkaavat liikkumasta enemmän kuin toleranssin verran, sitten se pysähtyy. Ero järkevien linjojen välillä on usein tuhannesosia big blindistä, alhaalla itse approksimaation kohinassa. Kolmas desimaali näyttää tiedolta. Se ei ole.

Toiseksi, sanat opettavat paremmin kuin numerot täällä. “Hävisit 0.03bb” saa sinut siristelemään silmiäsi ja miettimään onko se paljon. Lause kertoo mitä tehdä sen kanssa mitä juuri tapahtui. Joten jokainen päätös saa yhden rivin, selkokielisen insightin sen sijaan: “Raise on ensisijainen siirto (68 %)” kun on selkeä ensisijainen valinta. “Tiukka spotti – molemmat siirrot ovat hyviä” kun ei ole. “Iso virhe – Check oli oikea siirto täällä” kun harhauduit jonnekin kalliiseen. Yksi rivi, ja tiedät jatketaanko eteenpäin vai keskitytäänkö tähän.

Yhtään yksityiskohtaa ei piilotettu, selvyyden vuoksi. Päätöksen jälkeen voit avata range-näkymän ja nähdä täyden solveri-erittelyn – jokaisen käden jota olisit voinut pitää, kunkin toiminnon taajuuden, ja kyllä, EV-arvot. Ero on siinä mikä johtaa: arvosana antaa sinulle lauseen ensin ja pitää desimaalit siellä missä uteliaat löytävät ne, sen sijaan että pakottaisi sinut tekemään tulkinnan itse.

Mitä arvosana ei voi kertoa sinulle

Tässä on rehellinen raja mille tahansa arviointijärjestelmälle: arvosana voi paikallistaa poikkeaman, mutta se ei voi selittää sitä. GOOD ja “Raise on ensisijainen siirto (68 %)” kertoo sinulle missä vaistosi ja strategia erosivat. Se ei kerro sinulle miksi solveri rakastaa tuon draw’n korottamista.

Miksi-kysymys on siellä missä oppiminen elää, ja siihen “Kysy miksi” -valmennus on tarkoitettu. Napauta sitä Jätkä-Kymppi-käden jälkeen ja tekoälyvalmentaja selittää suositellun siirron päättelyn: draw’si on tarpeeksi vahva että olet lähellä kolikonheittoa jopa käsiä vastaan jotka jatkavat, joten korottaminen antaa sinulle kaksi tapaa voittaa – vastustajasi foldaa nyt, tai yksi viidestätoista kortistasi saapuu – ja potin rakentaminen kun kädelläsi on tällaista potentiaalia tarkoittaa että ne kerrat kun pääset sinne, voitat enemmän. Tuo päättely siirtyy seuraavaan isoon draw’iin jota pidät, boardilla jota et ole koskaan nähnyt. Arvosana löysi kuilun; keskustelu täyttää sen. Ilmaistasolla saat 20 harjoituskättä ja 3 tekoälyvalmennuskeskustelua päivässä, mikä riittää tekemään miksi-kysymisestä tavan käsille jotka yllättävät sinut.

Yhteenveto

Arvosana on peili, ei tuomio sinusta pelaajana. Se vertaa yhtä päätöstä strategiaan: strategian sisällä se kertoo kuinka keskeinen toimintosi oli; ulkopuolella se kertoo mitä kiertotie maksoi big blindeissä. Se on kaikki mitä se väittää tietävänsä – ja indifferenssiperiaatteen takia, se on kaikki mitä mikä tahansa rehellinen arvosana voi väittää.

Tarkkuuslukusi ansaitsee saman rehellisyyden. Prosenttiosuus päätöksistä jotka arvioitiin GREATiksi tai GOODiksi on harjoittelumittari, ei voittoprosenttisi. Varianssi päättää yhä perjantai-iltasi; voit pelata 85 prosentin tarkkuudella ja silti hävitä kolme buy-inia, samalla kun kaveri joka maksaa kaiken vetää vuoden isoimman potin.

Joten kyllä – yksi päätös voidaan arvioida, jopa tuurin ja sekastrategioiden pelissä. Ei sen perusteella voittiko se, eikä desimaalilla joka teeskentelee enemmän tarkkuutta kuin matematiikka pitää sisällään, vaan sen perusteella missä se sijaitsee suhteessa strategiaan jota ei voi työntää ympäriinsä. Arvosana näyttää sinulle missä sinä ja tuo strategia eroatte toisistaan, käsi käden jälkeen. Se mitä teet sillä tiedolla, on se varsinainen harjoittelu.

Tunnisteet

  • gto training
  • poker verdicts
  • mixed strategy
  • expected value
  • poker feedback
  • home game

20 kättä päivässä, ilmaiseksi

Aloita harjoittelu todistetuilla strategioilla ja AI-valmennuksella tänään. Ensimmäiset 20 kättäsi ovat ilmaisia, joka päivä.

Aloita ilmainen harjoittelu

Luottokorttia ei tarvita. Ilmainen ikuisesti.