Бадминтон - это все мы!

Ваш регион: Москва и МО формула рейтинга как получить рейтинг нашли ошибку?
Сборы по бадминтонуSpace Masters

ЛАБ, Elo, Glicko-2: как устроены рейтинги

ЛАБ, Elo, Glicko-2: как устроены рейтинги и что показало моделирование

Мы готовим обновление рейтинговой системы, поэтому честно рассказываем, какие вообще бывают рейтинги, чем они отличаются и почему мы выбрали связку «ЛАБ + Glicko-2». Без формул на доске — но с реальными цифрами: все выводы проверены на нашей же базе, 115 793 матча за 2020–2026 годы.

Как устроен рейтинг ЛАБ

Идея простая и прозрачная. У каждого матча смотрим разницу рейтингов соперников (для пары — средний рейтинг). Если разница 100 и больше — матч «ожидаемый», рейтинг не меняется. Если меньше — победитель забирает у проигравшего дельту: чем ближе соперники, тем она больше (до 10 очков на матч, умножается на коэффициент турнира). Сколько один выиграл — столько другой потерял.

Сильные стороны: понятность («я обыграл того, кто выше, — я вырос»), устойчивость, привычная всем шкала. Слабые: рейтинг зависит от начальной точки (см. нашу статью о нормализации — стартовые значения в регионах разъехались), не отличает «уверенный рейтинг» от «случайного» и не тускнеет при долгих паузах: игрок, не бравший ракетку два года, числится с прежней цифрой.

Как устроен Elo

Дедушка всех рейтингов (шахматы, 1960-е). Перед матчем считается вероятность победы каждого из рейтингов соперников; после матча рейтинг сдвигается на разницу «факт минус ожидание». Обыграл фаворита — большой плюс, обыграл аутсайдера — почти ничего. В отличие от ЛАБ, Elo реагирует на любой матч, а не только на «близкие».

Как устроен Glicko-2

Современное развитие Elo (используется в шахматах онлайн, го, киберспорте). К рейтингу добавляются две величины: надёжность (RD — насколько система уверена в цифре) и волатильность (насколько стабильно играет человек). Новичок получает рейтинг с большой погрешностью — и система быстро его двигает, пока не «поймает» уровень. У ветерана с сотней матчей рейтинг устойчив. А во время пауз надёжность падает — система честно говорит: «за два года без игр я уже не так уверена в этой цифре».

Что показало моделирование на нашей базе

Мы прогнали все три системы через реальную историю матчей ЛАБ и проверили: как часто рейтинг правильно предсказывает победителя матча до его начала.

Система

Точность прогноза

ЛАБ67,7%
Elo69,0%
Glicko-270,9%

Разница кажется небольшой, но на 100 тысячах матчей это тысячи «правильно расставленных» игроков. Важнее другое: там, где системы расходятся в оценке игрока, чаще прав Glicko-2. И ещё одно открытие: Glicko-2, считающий по всему графу матчей страны, автоматически исправляет региональный перекос — сильный игрок из «заниженного» региона у него встаёт на своё настоящее место. Мы проверили это отдельно: у взлетевших в Glicko игроков широкая география соперников, это не артефакт, а восстановленная справедливость.

При этом системы в целом согласны друг с другом (корреляция 0,79): Glicko не «ломает» привычную картину, а уточняет её.

Почему мы выбрали «ЛАБ + Glicko-2», а не замену

ЛАБ остаётся основным рейтингом. По нему — допуски, дивизионы, посев. Он привычен, прозрачен, и после нормализации начальных значений его главная болезнь будет вылечена.

Glicko-2 появится рядом, справочно. Это второй взгляд на ту же историю матчей: с надёжностью, с честной реакцией на паузы, без региональных перекосов. У кого данных мало, увидит не «твёрдую цифру», а диапазон с пометкой «рейтинг уточняется» — и это честно. Пока Glicko-2 ни на что не влияет: не на допуски, не на посев. Поживём с двумя цифрами, сравним, обсудим — и только потом будем решать, менять ли им роли.

Обе шкалы будут показаны в профиле игрока рядом, с объяснением различий. Резких движений не будет — все изменения по опубликованному календарю.