Перекладено на замовлення освітнього порталу university.poker
Джерело: GTO Wizard

Перекладено за допомогою ШІ. Просимо вибачення за будь-які помилки та будемо вдячні за допомогу у їх виправленні.
Безліч когнітивних упереджень, ментальних моделей та евристик, які я збираюся обговорити в контексті таких інструментів, як GTO Wizard, впливають на наше сприйняття покеру. Багато чого вже написано про те, як упередження впливають безпосередньо на гру в покер. Зокрема, помилка гравця (Gambler’s Fallacy) та помилка вижилого (Survivor Bias) — обидва ці упередження широко поширені в грі, де велику роль відіграє дисперсія. Однак набагато менше уваги приділяється упередженням, які впливають на вивчення покеру. Сьогодні я починаю серію, присвячену одному з найвідоміших і, можливо, найруйнівніших упереджень, яке може вплинути на використання інструментів для вивчення покеру, — підтверджувальному упередженню (Confirmation Bias).
Підтверджувальне упередження — це наша схильність звертати увагу на інформацію, яка відповідає нашим уже існуючим переконанням, та ігнорувати або недооцінювати інформацію, яка з ними не збігається.
- Простий приклад: якщо ви вірите, що Дональд Трамп має бути президентом, то, швидше за все, ви шукатимете новини на каналах на кшталт Fox. Якщо ж ви вважаєте, що Трамп — втілення зла, то, ймовірно, шукатимете інформацію на CNN. В обох випадках імовірність того, що вам трапиться інформація, яка кидає виклик вашій точці зору, є дуже малою.
У покері підтверджувальне упередження теж зустрічається досить часто, особливо коли йдеться про дисперсію. Якщо ви перебуваєте в даунсвінгу або взагалі вважаєте себе невдахою, ви, швидше за все, пам'ятатимете ті три рази, коли вас “переїхали” (cooler) за одну сесію, і забудете про ті три випадки, коли ви самі переїхали когось іншого. Ви можете навіть сказати собі, що «заслужили» бути на хорошому боці цих кулерів, тому що раніше вам не щастило. У цій статті ми розглянемо ті ж самі динаміки підтверджувального упередження, але в контексті використання інструментів, таких як GTO Wizard, для вивчення гри.
1. Підтверджувальне упередження та вивчення покеру
- Давайте розглянемо приклад з однієї руки, яку я нещодавно грав.
На початку турніру з ефективним стеком 50bb я відкрився з BTN з . Великий блайнд (ВБ) заколірував, і на флоп прийшло
, який ВБ чекнув. Я відчув, що попри те, що 6 і 3 сприяють ВБ, це був хороший борд для ставки, тому що у мене в діапазоні були сильніші руки з Q-x і всі сети. Крім того, я очікував, що ВБ рейзив би такі руки, як AQ, QQ, 66 і 33 на префлопі, як у GTO, так і в реальній грі.
Я вирішив поставити половину поту, хоча знав, що, згідно з моїми дослідженнями, менша ставка була б більш підходящою. Озираючись назад, думаю, що мій інстинкт був: «Це динамічний флоп, став більше», хоча насправді жодне дро не скине свою руку на будь-яку з цих ставок. Ставка призвела до фолду, і я зазначив цю руку, щоб не забути повернутися до неї пізніше в GTO Wizard, коли буду займатися навчанням.


По-перше, сама ставка — це відносно часте явище для цього флопу: ми ставимо близько 63% разів, а чекаємо 37%. BTN має легку перевагу в діапазоні (53%), і як я вже говорив, у нас більше «найкращих рук», але це дуже близько:

Рішення солвера — використовувати суміш різних розмірів ставок. Хоча два менших розміри ставок є кращими, у нас є руки, які ставлять близько 50% поту, і — одна з них. На цьому етапі я міг би гордо випнути груди і заявити, що зіграв руку правильно, а потім перейти до наступної. Так роблять деякі гравці, коли працюють з покерними рішеннями — вони «перевіряють лінію» руки і йдуть далі, не заглиблюючись в аналіз.
Однак при більш ретельному огляді можна побачити, як часто моя рука використовує кожен розмір ставки:

Моя рука використовує ставку в половину поту всього лише 3,5% часу. Тут підтверджувальне упередження може повністю взяти керування на себе. Я міг би продовжувати стверджувати, що зіграв руку правильно, і рухатися далі. Це дійсно було «затверджено GTO». Якби я був досвідченим користувачем, я міг би навіть сказати собі: «Так, це низькочастотна дія, але я знав це і зробив так, щоб збалансувати свою середню ставку». Це підступний аспект підтверджувального упередження: мотивоване міркування та захист ідентичності як основна мотивація. Я міг би бути настільки мотивованим захищати свою ідентичність, що більше не став би замислюватися про низьку частоту.
Насправді, я можу вирішити, озираючись назад, що знав, що це низькочастотний хід, і оскільки мені вдалося знайти його, попри цю рідкість, це робить мене ще розумнішим. Насправді, я повинен більш детально дослідити цю ситуацію. Важливе питання, яке варто собі поставити: чому переважний розмір ставки становить від 20% до 33%, і це розмір, який використовується 58,6% часу з цією конкретною комбінацією? Також є змішані розміри ставок по всьому діапазону. У нас також є середні (55%) і великі (83%) ставки, є навіть овербет (125%). І замість того щоб зосередитися на рідкісному ході, корисніше розглянути, чому існує суміш розмірів ставок і які руки віддають перевагу кожному з них.
2. Малі ставки
Фільтр «Grouped» дозволяє нам групувати розміри ставок в абстрактні категорії (Мала/Середня/Велика ставка або Овербет). Якщо ми наведемо курсор на іконку в правому верхньому кутку групи «Мала ставка», ми зможемо побачити розбивку діапазону ставок за класами рук.
Розбивка діапазону групи «Мала ставка» (Ставка 20% і Ставка 33%):

Малі ставки, наприклад, в основному використовуються руками, які я б назвав середньою частиною діапазону. В основному цей розмір ставки використовують руки від топ-пари до третьої пари. А основний блеф у цьому сайзингу, схоже, А-х. Моє тлумачення цього наступне: мы ставимо маленьку ставку з більш слабкими руками нашого діапазону, щоб достатньо слабких рук могли заколірувати й зробити цей хід прибутковим. Ці руки знаходяться в середині нашого діапазону. Мала ставка, таким чином, дозволяє нам частіше вельюбетити. Потім ми захищаємо цю частину діапазону сильними руками, такими як сети. Ми блефуємо з А-х, тому що ця рука все ще випереджає деякі дро, які можуть заколірувати, і часто продовжуватиме бути попереду, якщо на пізніх вулицях випаде туз. А-х без додаткового дро має близько 50% еквіті, так що коли нас “крутять” (тобто супротивник робить рейз) — це легкий фолд.
3. Середній розмір ставки
Топ-пара — пропорційно більша частина велью діапазону тут. К-х і бекдор флеш-дро — це основні блефи. К-х блефує, ймовірно, тому, що наша ціль — А-х. Ми ніколи не змусимо пару скинути свою руку, але можемо змусити скинути багато А-х, що робить ставку з К-х успішним блефом.
4. Овербет
Нарешті, ми розглядаємо склад діапазону овербетів, який становить 5,6% стратегії для всього діапазону. Ми пропустили групу «Bet Large», тому що вона є занадто маленькою частиною (3,7%) складової стратегії діапазону, і ми отримуємо більш яскравий контраст, розглядаючи більш віддалені частини спектра ставок.
Розбивка діапазону групи «Овербет» (Ставка 125%):

Оверпари та топ-пара складають основну частину велью діапазону. Ми ніколи не використовуємо овербет для двох пар або сильніших рук, як це робимо з іншими ставками. Це класичний поляризований діапазон ставок: ми ставимо велику ставку з руками, які, як правило, попереду і які потребують захисту. K-x — це основний блеф. Знову ж таки, його обирають з тієї ж причини, що й у випадку із середньою ставкою: щоб змусити А-х скинути, і також тому, що ця рука блокує KQo в діапазоні великого блайнда. Повертаючись до нашої конкретної руки , очевидно, є сенс включити її в наш діапазон середньої ставки. Нам потрібно мати А-х, коли на терні або рівері випаде туз.
Також ця рука може скласти бекдор-стріт. Вона блокує QT, A6, A3, T6 і T3, які є в діапазоні ВБ. Ми також не блокуємо флеш-дро, що корисно, коли терн і рівер не дають нічого корисного, і ми шукаємо блефи на рівері. На практиці, однак, наша рука краще працює як блеф для меншого розміру ставки. Вона випереджає дро, які колірують, позбавляє еквіті слабкі непарні руки, які скинуть, і є досить сильною, щоб продовжувати, коли на терні випаде туз. Нарешті, у неї тільки 50% еквіті, так що це досить легкий фолд, якщо нас чек-рейзять (фолд буде складнішим, коли ми поставимо ставку в 55% поту).
Зворотний ефект
Але зачекайте. Що якщо я скажу вам, що гравці в моїх іграх дуже часто колірують і ніколи не скинуть на таку маленьку ставку? Ну, ми можемо скористатися штучним інтелектом (ШІ) GTO Wizard і залочити таку «липку» поведінку, щоб подивитися, якою буде оптимальна відповідь на неї.
Давайте заблокуємо стратегію BB так, щоб він ніколи не скидав А-х, К-х або будь-які бекдор-дро на маленьку ставку:

Ось як BTN коригує свою стратегію контбету:


Ох, схоже, що все пішло не за планом. Тепер ми перестали використовувати середній розмір ставки в цій ситуації, і фактично, ми виключно використовуємо маленьку ставку в 33%, щоб використовувати те, що наш опонент ніколи не скине, роблячи тонкі велью бети з ширшим діапазоном. Насправді, я хотів сказати, що гравці в моїх іграх скористаються такою маленькою ставкою, часто підвищуючи її.
Ось що вони насправді робитимуть, зіткнувшись із маленьким контбетом:

Проти надмірної агресії я повинен буду підлаштуватися так:


Ох, це знову сталося. Ми ставимо ще частіше, при цьому вводячи новий, ще менший розмір ставки. Схоже, що провокування частого чек-рейзу — це добре для нас.
Насправді, я хотів сказати, що опоненти не тільки «крутитимуть» нас частіше, коли ми ставимо маленьку ставку, але вони також будуть перефолжувати на ставку в 56% поту:

Так виглядає наша нова підстройка:


коли він бачить s-bet 33% пот і занадто таємно, коли він бачить s-bet 56% пот)
Фух, нарешті ми дійшли до цього. Пробачте за спробу пожартувати. Те, що я намагався показати вище — це другий аспект когнітивного упередження підтвердження, який, можливо, є ще більш шкідливим: ефект зворотного результату. Це ситуація, коли представлення суперечливої інформації насправді посилює нашу початкову позицію, а не змінює її. Ефект зворотного результату особливо помітний в епоху «фейкових новин» і соціальних мереж. Дуже часто люди стикаються з доказами того, що їхня «сторона» була неправою в якомусь питанні, і це наче ще більше зміцнює їхні переконання. Наприклад, новина про те, що Трамп зробив щось жахливе або був виправданий у якійсь справі, не змінить думки глядачів Fox чи CNN з цього приводу.
Ефект зворотного результату проявляється, коли людина стає більш упевненою у своїй початковій позиції, стикаючись із суперечливою інформацією, замість того щоб змінити свою точку зору.
Я думаю, що ефект зворотного результату також може бути проблемою при використанні GTO Wizard. По-перше, ми можемо повністю відхилити висновки, тому що «ніхто не грає за GTO в реальному житті». Ми можемо також невтомно лочити (тобто блокувати) рішення так, щоб вони відповідали нашому світогляду, і «довести» собі, що ми праві.
5. Висновок
В описаній вище роздачі мені пощастило: я використовував її як відправну точку для обговорення Когнітивного упередження підтвердження, тому мені було легко помітити свої власні упередженості під час вивчення. Це, можливо, найважливіший спосіб боротися з упередженостями загалом: визнати, що вони у нас є. Когнітивне упередження підтвердження часто проявляється, тому що наші переконання пов'язані з нашою ідентичністю. Будь то наша політична ідентичність чи просто наша ідентичність як компетентних гравців у покер, природно відчувати загрозу або біль, коли нам суперечать. Нам потрібно відокремити результати рішення солвера від нашої покерної ідентичності. Набагато корисніше розвивати ідентичність «гравця, який навчається покеру», а не «покерного переможця», коли ми працюємо з інструментами для навчання, які часто можуть нас здивувати.
Розглядайте навчання покеру як пригоду, а не як спосіб довести свою правоту.
Також дуже корисно підходити до висновків солвера з наміром вивчити не тільки конкретну роздачу, з якою ви зіткнулися. Коли ви вивчаєте, як має гратися весь ваш діапазон, а також як грав ваш опонент у світлі того, що для нього теоретично оптимально. Це має зменшити потребу у валідації своєї ідентичності, оскільки ситуація стає менш особистою. Це менше стосується того, що ви зробили з вашою рукою, і більше — того, що кожен гравець повинен робити з усіма своїми руками.






