ЛАБ, Elo, Glicko-2: как устроены рейтинги
ЛАБ, Elo, Glicko-2: как устроены рейтинги и что показало моделирование
Мы готовим обновление рейтинговой системы, поэтому честно рассказываем, какие вообще бывают рейтинги, чем они отличаются и почему мы выбрали связку «ЛАБ + Glicko-2». Без формул на доске — но с реальными цифрами: все выводы проверены на нашей же базе, 115 793 матча за 2020–2026 годы.
Как устроен рейтинг ЛАБ
Идея простая и прозрачная. У каждого матча смотрим разницу рейтингов соперников (для пары — средний рейтинг). Если разница 100 и больше — матч «ожидаемый», рейтинг не меняется. Если меньше — победитель забирает у проигравшего дельту: чем ближе соперники, тем она больше (до 10 очков на матч, умножается на коэффициент турнира). Сколько один выиграл — столько другой потерял.
Сильные стороны: понятность («я обыграл того, кто выше, — я вырос»), устойчивость, привычная всем шкала. Слабые: рейтинг зависит от начальной точки (см. нашу статью о нормализации — стартовые значения в регионах разъехались), не отличает «уверенный рейтинг» от «случайного» и не тускнеет при долгих паузах: игрок, не бравший ракетку два года, числится с прежней цифрой.
Как устроен Elo
Дедушка всех рейтингов (шахматы, 1960-е). Перед матчем считается вероятность победы каждого из рейтингов соперников; после матча рейтинг сдвигается на разницу «факт минус ожидание». Обыграл фаворита — большой плюс, обыграл аутсайдера — почти ничего. В отличие от ЛАБ, Elo реагирует на любой матч, а не только на «близкие».
Как устроен Glicko-2
Современное развитие Elo (используется в шахматах онлайн, го, киберспорте). К рейтингу добавляются две величины: надёжность (RD — насколько система уверена в цифре) и волатильность (насколько стабильно играет человек). Новичок получает рейтинг с большой погрешностью — и система быстро его двигает, пока не «поймает» уровень. У ветерана с сотней матчей рейтинг устойчив. А во время пауз надёжность падает — система честно говорит: «за два года без игр я уже не так уверена в этой цифре».
Что показало моделирование на нашей базе
Мы прогнали все три системы через реальную историю матчей ЛАБ и проверили: как часто рейтинг правильно предсказывает победителя матча до его начала.
Система | Точность прогноза |
|---|---|
| ЛАБ | 67,7% |
| Elo | 69,0% |
| Glicko-2 | 70,9% |
Разница кажется небольшой, но на 100 тысячах матчей это тысячи «правильно расставленных» игроков. Важнее другое: там, где системы расходятся в оценке игрока, чаще прав Glicko-2. И ещё одно открытие: Glicko-2, считающий по всему графу матчей страны, автоматически исправляет региональный перекос — сильный игрок из «заниженного» региона у него встаёт на своё настоящее место. Мы проверили это отдельно: у взлетевших в Glicko игроков широкая география соперников, это не артефакт, а восстановленная справедливость.
При этом системы в целом согласны друг с другом (корреляция 0,79): Glicko не «ломает» привычную картину, а уточняет её.
Почему мы выбрали «ЛАБ + Glicko-2», а не замену
ЛАБ остаётся основным рейтингом. По нему — допуски, дивизионы, посев. Он привычен, прозрачен, и после нормализации начальных значений его главная болезнь будет вылечена.
Glicko-2 появится рядом, справочно. Это второй взгляд на ту же историю матчей: с надёжностью, с честной реакцией на паузы, без региональных перекосов. У кого данных мало, увидит не «твёрдую цифру», а диапазон с пометкой «рейтинг уточняется» — и это честно. Пока Glicko-2 ни на что не влияет: не на допуски, не на посев. Поживём с двумя цифрами, сравним, обсудим — и только потом будем решать, менять ли им роли.
Обе шкалы будут показаны в профиле игрока рядом, с объяснением различий. Резких движений не будет — все изменения по опубликованному календарю.

