user-avatar
GTO_Wizard
Author

Як упереджені уявлення про нові ідеї впливають на навчання

2.2K просмотра
18.02.25
16 мин чтения
Як упереджені уявлення про нові ідеї впливають на навчання

Перекладено на замовлення освітнього порталу university.poker
Джерело: GTO Wizard 

Перекладено за допомогою ШІ. Просимо вибачення за будь-які помилки та будемо вдячні за допомогу у їх виправленні.

Безліч когнітивних упереджень, ментальних моделей та евристик, які я збираюся обговорити в контексті таких інструментів, як GTO Wizard, впливають на наше сприйняття покеру. Багато чого вже написано про те, як упередження впливають безпосередньо на гру в покер. Зокрема, помилка гравця (Gambler’s Fallacy) та помилка вижилого (Survivor Bias) — обидва ці упередження широко поширені в грі, де велику роль відіграє дисперсія. Однак набагато менше уваги приділяється упередженням, які впливають на вивчення покеру. Сьогодні я починаю серію, присвячену одному з найвідоміших і, можливо, найруйнівніших упереджень, яке може вплинути на використання інструментів для вивчення покеру, — підтверджувальному упередженню (Confirmation Bias).

Підтверджувальне упередження — це наша схильність звертати увагу на інформацію, яка відповідає нашим уже існуючим переконанням, та ігнорувати або недооцінювати інформацію, яка з ними не збігається.

  • Простий приклад: якщо ви вірите, що Дональд Трамп має бути президентом, то, швидше за все, ви шукатимете новини на каналах на кшталт Fox. Якщо ж ви вважаєте, що Трамп — втілення зла, то, ймовірно, шукатимете інформацію на CNN. В обох випадках імовірність того, що вам трапиться інформація, яка кидає виклик вашій точці зору, є дуже малою.

У покері підтверджувальне упередження теж зустрічається досить часто, особливо коли йдеться про дисперсію. Якщо ви перебуваєте в даунсвінгу або взагалі вважаєте себе невдахою, ви, швидше за все, пам'ятатимете ті три рази, коли вас “переїхали” (cooler) за одну сесію, і забудете про ті три випадки, коли ви самі переїхали когось іншого. Ви можете навіть сказати собі, що «заслужили» бути на хорошому боці цих кулерів, тому що раніше вам не щастило. У цій статті ми розглянемо ті ж самі динаміки підтверджувального упередження, але в контексті використання інструментів, таких як GTO Wizard, для вивчення гри.

1. Підтверджувальне упередження та вивчення покеру

  • Давайте розглянемо приклад з однієї руки, яку я нещодавно грав.

На початку турніру з ефективним стеком 50bb я відкрився з BTN з diamonds-acediamonds-ten . Великий блайнд (ВБ) заколірував, і на флоп прийшло spades-queenhearts-sixspades-three , який ВБ чекнув. Я відчув, що попри те, що 6 і 3 сприяють ВБ, це був хороший борд для ставки, тому що у мене в діапазоні були сильніші руки з Q-x і всі сети. Крім того, я очікував, що ВБ рейзив би такі руки, як AQ, QQ, 66 і 33 на префлопі, як у GTO, так і в реальній грі.

Я вирішив поставити половину поту, хоча знав, що, згідно з моїми дослідженнями, менша ставка була б більш підходящою. Озираючись назад, думаю, що мій інстинкт був: «Це динамічний флоп, став більше», хоча насправді жодне дро не скине свою руку на будь-яку з цих ставок. Ставка призвела до фолду, і я зазначив цю руку, щоб не забути повернутися до неї пізніше в GTO Wizard, коли буду займатися навчанням.

По-перше, сама ставка — це відносно часте явище для цього флопу: ми ставимо близько 63% разів, а чекаємо 37%. BTN має легку перевагу в діапазоні (53%), і як я вже говорив, у нас більше «найкращих рук», але це дуже близько: 

Рішення солвера — використовувати суміш різних розмірів ставок. Хоча два менших розміри ставок є кращими, у нас є руки, які ставлять близько 50% поту, і  diamonds-acediamonds-ten — одна з них. На цьому етапі я міг би гордо випнути груди і заявити, що зіграв руку правильно, а потім перейти до наступної. Так роблять деякі гравці, коли працюють з покерними рішеннями — вони «перевіряють лінію» руки і йдуть далі, не заглиблюючись в аналіз.

Однак при більш ретельному огляді можна побачити, як часто моя рука використовує кожен розмір ставки:

Remove
 
Add item

Моя рука використовує ставку в половину поту всього лише 3,5% часу. Тут підтверджувальне упередження може повністю взяти керування на себе. Я міг би продовжувати стверджувати, що зіграв руку правильно, і рухатися далі. Це дійсно було «затверджено GTO». Якби я був досвідченим користувачем, я міг би навіть сказати собі: «Так, це низькочастотна дія, але я знав це і зробив так, щоб збалансувати свою середню ставку». Це підступний аспект підтверджувального упередження: мотивоване міркування та захист ідентичності як основна мотивація. Я міг би бути настільки мотивованим захищати свою ідентичність, що більше не став би замислюватися про низьку частоту.

Насправді, я можу вирішити, озираючись назад, що знав, що це низькочастотний хід, і оскільки мені вдалося знайти його, попри цю рідкість, це робить мене ще розумнішим. Насправді, я повинен більш детально дослідити цю ситуацію. Важливе питання, яке варто собі поставити: чому переважний розмір ставки становить від 20% до 33%, і це розмір, який використовується 58,6% часу з цією конкретною комбінацією? Також є змішані розміри ставок по всьому діапазону. У нас також є середні (55%) і великі (83%) ставки, є навіть овербет (125%). І замість того щоб зосередитися на рідкісному ході, корисніше розглянути, чому існує суміш розмірів ставок і які руки віддають перевагу кожному з них.

2. Малі ставки

Фільтр «Grouped» дозволяє нам групувати розміри ставок в абстрактні категорії (Мала/Середня/Велика ставка або Овербет). Якщо ми наведемо курсор на іконку в правому верхньому кутку групи «Мала ставка», ми зможемо побачити розбивку діапазону ставок за класами рук.

Розбивка діапазону групи «Мала ставка» (Ставка 20% і Ставка 33%):

Remove
 
Add item

Малі ставки, наприклад, в основному використовуються руками, які я б назвав середньою частиною діапазону. В основному цей розмір ставки використовують руки від топ-пари до третьої пари. А основний блеф у цьому сайзингу, схоже, А-х. Моє тлумачення цього наступне: мы ставимо маленьку ставку з більш слабкими руками нашого діапазону, щоб достатньо слабких рук могли заколірувати й зробити цей хід прибутковим. Ці руки знаходяться в середині нашого діапазону. Мала ставка, таким чином, дозволяє нам частіше вельюбетити. Потім ми захищаємо цю частину діапазону сильними руками, такими як сети. Ми блефуємо з А-х, тому що ця рука все ще випереджає деякі дро, які можуть заколірувати, і часто продовжуватиме бути попереду, якщо на пізніх вулицях випаде туз. А-х без додаткового дро має близько 50% еквіті, так що коли нас “крутять” (тобто супротивник робить рейз) — це легкий фолд.

3. Середній розмір ставки

Порівняйте це з діапазоном середньої ставки:

Розбивка на діапазон групи «середина ставка» (ставка 55%)
Remove
 
Add item

Топ-пара — пропорційно більша частина велью діапазону тут. К-х і бекдор флеш-дро — це основні блефи. К-х блефує, ймовірно, тому, що наша ціль — А-х. Ми ніколи не змусимо пару скинути свою руку, але можемо змусити скинути багато А-х, що робить ставку з К-х успішним блефом.

4. Овербет

Нарешті, ми розглядаємо склад діапазону овербетів, який становить 5,6% стратегії для всього діапазону. Ми пропустили групу «Bet Large», тому що вона є занадто маленькою частиною (3,7%) складової стратегії діапазону, і ми отримуємо більш яскравий контраст, розглядаючи більш віддалені частини спектра ставок.

Розбивка діапазону групи «Овербет» (Ставка 125%):

Remove
 
Add item

Оверпари та топ-пара складають основну частину велью діапазону. Ми ніколи не використовуємо овербет для двох пар або сильніших рук, як це робимо з іншими ставками. Це класичний поляризований діапазон ставок: ми ставимо велику ставку з руками, які, як правило, попереду і які потребують захисту. K-x — це основний блеф. Знову ж таки, його обирають з тієї ж причини, що й у випадку із середньою ставкою: щоб змусити А-х скинути, і також тому, що ця рука блокує KQo в діапазоні великого блайнда. Повертаючись до нашої конкретної руки diamonds-acediamonds-ten , очевидно, є сенс включити її в наш діапазон середньої ставки. Нам потрібно мати А-х, коли на терні або рівері випаде туз.

Також ця рука може скласти бекдор-стріт. Вона блокує QT, A6, A3, T6 і T3, які є в діапазоні ВБ. Ми також не блокуємо флеш-дро, що корисно, коли терн і рівер не дають нічого корисного, і ми шукаємо блефи на рівері. На практиці, однак, наша рука краще працює як блеф для меншого розміру ставки. Вона випереджає дро, які колірують, позбавляє еквіті слабкі непарні руки, які скинуть, і є досить сильною, щоб продовжувати, коли на терні випаде туз. Нарешті, у неї тільки 50% еквіті, так що це досить легкий фолд, якщо нас чек-рейзять (фолд буде складнішим, коли ми поставимо ставку в 55% поту).

Зворотний ефект

Але зачекайте. Що якщо я скажу вам, що гравці в моїх іграх дуже часто колірують і ніколи не скинуть на таку маленьку ставку? Ну, ми можемо скористатися штучним інтелектом (ШІ) GTO Wizard і залочити таку «липку» поведінку, щоб подивитися, якою буде оптимальна відповідь на неї.

Давайте заблокуємо стратегію BB так, щоб він ніколи не скидав А-х, К-х або будь-які бекдор-дро на маленьку ставку:

Стратегія BB Locked (занадто липка) проти 33% ставка на флоп

Ось як BTN коригує свою стратегію контбету:

Скоригована стратегія C-beta на флоп BTN (проти липкої стратегії BB)

Ох, схоже, що все пішло не за планом. Тепер ми перестали використовувати середній розмір ставки в цій ситуації, і фактично, ми виключно використовуємо маленьку ставку в 33%, щоб використовувати те, що наш опонент ніколи не скине, роблячи тонкі велью бети з ширшим діапазоном. Насправді, я хотів сказати, що гравці в моїх іграх скористаються такою маленькою ставкою, часто підвищуючи її.

Ось що вони насправді робитимуть, зіткнувшись із маленьким контбетом:

Заблокована (занадто агресивна) стратегія BB проти 33% ставка на флоп

Проти надмірної агресії я повинен буду підлаштуватися так:

Скоригована стратегія C-beta на флоп BTN (проти надмірно агресивної стратегії BB)

Ох, це знову сталося. Ми ставимо ще частіше, при цьому вводячи новий, ще менший розмір ставки. Схоже, що провокування частого чек-рейзу — це добре для нас.

Насправді, я хотів сказати, що опоненти не тільки «крутитимуть» нас частіше, коли ми ставимо маленьку ставку, але вони також будуть перефолжувати на ставку в 56% поту:

Скоригована стратегія BB (занадто секретна) проти ставка BTN 56 пот

Так виглядає наша нова підстройка:

Скоригована стратегія C-beta на флоп BTN (проти надмірно агресивної стратегії BB,
коли він бачить s-bet 33% пот і занадто таємно, коли він бачить s-bet 56% пот)

Фух, нарешті ми дійшли до цього. Пробачте за спробу пожартувати. Те, що я намагався показати вище — це другий аспект когнітивного упередження підтвердження, який, можливо, є ще більш шкідливим: ефект зворотного результату. Це ситуація, коли представлення суперечливої інформації насправді посилює нашу початкову позицію, а не змінює її. Ефект зворотного результату особливо помітний в епоху «фейкових новин» і соціальних мереж. Дуже часто люди стикаються з доказами того, що їхня «сторона» була неправою в якомусь питанні, і це наче ще більше зміцнює їхні переконання. Наприклад, новина про те, що Трамп зробив щось жахливе або був виправданий у якійсь справі, не змінить думки глядачів Fox чи CNN з цього приводу.

Ефект зворотного результату проявляється, коли людина стає більш упевненою у своїй початковій позиції, стикаючись із суперечливою інформацією, замість того щоб змінити свою точку зору.

Я думаю, що ефект зворотного результату також може бути проблемою при використанні GTO Wizard. По-перше, ми можемо повністю відхилити висновки, тому що «ніхто не грає за GTO в реальному житті». Ми можемо також невтомно лочити (тобто блокувати) рішення так, щоб вони відповідали нашому світогляду, і «довести» собі, що ми праві.

5. Висновок

В описаній вище роздачі мені пощастило: я використовував її як відправну точку для обговорення Когнітивного упередження підтвердження, тому мені було легко помітити свої власні упередженості під час вивчення. Це, можливо, найважливіший спосіб боротися з упередженостями загалом: визнати, що вони у нас є. Когнітивне упередження підтвердження часто проявляється, тому що наші переконання пов'язані з нашою ідентичністю. Будь то наша політична ідентичність чи просто наша ідентичність як компетентних гравців у покер, природно відчувати загрозу або біль, коли нам суперечать. Нам потрібно відокремити результати рішення солвера від нашої покерної ідентичності. Набагато корисніше розвивати ідентичність «гравця, який навчається покеру», а не «покерного переможця», коли ми працюємо з інструментами для навчання, які часто можуть нас здивувати.

Розглядайте навчання покеру як пригоду, а не як спосіб довести свою правоту.

Також дуже корисно підходити до висновків солвера з наміром вивчити не тільки конкретну роздачу, з якою ви зіткнулися. Коли ви вивчаєте, як має гратися весь ваш діапазон, а також як грав ваш опонент у світлі того, що для нього теоретично оптимально. Це має зменшити потребу у валідації своєї ідентичності, оскільки ситуація стає менш особистою. Це менше стосується того, що ви зробили з вашою рукою, і більше — того, що кожен гравець повинен робити з усіма своїми руками. 

Комментарии

Читайте Также.