Модель ROI: что предсказатель видит и чего не видит
Модель и бай-ин
Все строки разреза
Фонд против модели
Строки турниров выбранного тира
Лестница по привычному лимиту — игроки поля рума, не фонд
Все ячейки лестницы
Линейный наклон по корзинам (прежний показ)
Какой показатель кэша описывает фонд
Разложение премии тира и holdout
Ожидаемый ROI
Что это
Исследование предсказателя ROI (ml_predictor, ClickHouse): что модель видит и чего не видит.
Обучающая выборка — 673 тыс. турниров, ростеры восьми румов и живой слепок фонда.
Разделы «Фонд» и «Лестница» на вкладке «Данные» и «Покрытие» на этой вкладке считаются на лету
и меняются вместе с фильтрами; остальное — слепок исследования, который пересчитывается только прогоном
скриптов test_predict по ClickHouse. У каждого числа есть подсказка по наведению
на заголовок (значок ⓘ): что это, как считается и что его искажает.
Выводы
Что делать по итогам исследования, 15.09.2026
- Прогнать
batch-idsпо id без строки вtournament_roi— покрытие денег с 60% до ~85%. Список выгружается кнопкой в разделе «Покрытие» ниже на этой вкладке. - Взвешивать предсказание деньгами, а не средним по турнирам (тумблер в разделе «Фонд» показывает разницу).
- Многодневки — отдельной агрегатной строкой с пометкой «без предсказания»; на тир не разбивать: 126–231 событие слишком лумпи.
- Показывать покрытие деньгами рядом с покрытием турнирами.
- Эталон фонда — смесь по фактическому составу тира (≈0.68·REGs_T + 0.17·REGs_M), оба показателя уже в payload кэша.
- Для Elite и Elite+ показывать
ROI_Elitepool: пул — это Elite + Elite+. - Обучить пуловые модели для MaxEV и Medium — сейчас их нет.
- Признак лестницы вводить только относительный (
r < 1.4) и с гейтомn_prior ≥ 30. Гипотеза: нужен счётчик лагированного ABI на инференсе.
- Не трогать веса бай-инов в
compute_buyin_weighted_roi_maps— смещения там нет. - Не принимать признаки по MAE: на этой грануляции MAE предпочитает заниженный предиктор из-за скошенности факта.
- Не поднимать Other-guard с 65% — фонду он стоит $1 726 в год.
- Не делать пятиступенчатую премию: равна двухступенчатой и переисправляет в тонких корзинах.
Оговорки восемь мест, где числа зависят от устройства данных
- Шкала PokerStars. Корреляция ROI_REGs_T из ростеров с обучающим CSV: Winamax 0.999, PokerStars 0.780 при медиане разницы 0.00 п.п. Абсолютные смещения варианта «модель как есть» частично артефакт шкалы — читать надо дифференциал hi−lo, где она сокращается.
- Привычный ABI считается только по турнирам своего рума. Нижние ступени частично означают «мало истории», кросс-румовый объём невидим. У начала окна истории нет механически.
- Глубина истории по румам разная: PokerStars с 2016, Winamax и iPoker с 2020, PS(FR-ES-PT) с 2018, WPN с 2021, Chico и 888Poker с 2024, CoinPoker с сентября 2025. Абсолютные уровни ступеней между румами сравнивать с этой поправкой; порядок внутри рума она не задевает.
- Тир фонда — текущий, а ростеры и лестница — за всю историю: сменивший тир приписан историей к нынешнему. Отсюда 41.5% фондовых денег MaxEV на ступени $55-109. SCD2-история тиров роли закрыта.
- Выгрузка ников фонда от 25.08.2026 — сентябрьских ников нет; player-level таблицы селекта роли закрыты.
- ROI по ростерам систематически выше фондового у тех же ников (MaxEV 22.8 против 11.3%): ростеры — только Holdem, поле ≥ 40, без сателлитов. Перенос на фондовые турниры приблизительный.
- «Никогда не считался» — снимок на 15.09.2026. Если id уже в очереди бэкфилла, статус мог измениться.
- Фонд за 2026 шумный. SE разрыва по тирам 3.5–7.9 п.п., у малых румов — десятки п.п.; поштучно их не интерпретировать. Усы на графиках именно про это.
Покрытие и многодневки
Источники
Слепок cache/predict/ (собирает build_predict_cache.py
из выгрузок test_predict/) и живой слепок фонда core.load().
Пересобрать исследование можно только прогоном скриптов test_predict по ClickHouse.
Тексты подсказок — словарь HELP в analytics/predict_ui.py.