Metodologia

Jak powstaje prawdopodobieństwo Riftcast, jak jest oceniane po zakończeniu meczu i co oznaczają wynikające z tego liczby. To techniczne uzupełnienie strony O nas.

Zbiór danych: 15,622 zindeksowanych meczów, 35,844 ocenionych prognoz. Liczby na tej stronie wyznaczono o 2026-09-10 04:03 UTC.

1. Czym się zajmujemy

Riftcast publikuje prawdopodobieństwo dla każdej ze stron profesjonalnego meczu League of Legends, wyliczone przez modele uczenia maszynowego wytrenowane na historycznych danych meczowych. Prawdopodobieństwo powstaje przed rozpoczęciem meczu, zostaje zapisane, a po rozegraniu spotkania jest oceniane wobec wyniku. Prognoza nigdy nie jest korygowana po fakcie.

Prawdopodobieństwo nie jest przepowiednią tego, co się wydarzy. To stwierdzenie o długiej serii podobnych meczów: mówiąc, że drużyna wygrywa w 65 procentach przypadków, twierdzimy, że w wielu meczach z taką oceną wygrywa się mniej więcej 65 na 100. Porażka drużyny ocenionej na 65 procent nie jest chybioną prognozą. Chybiona jest sytuacja, w której drużyna oceniana na 65 procent wygrywa tylko połowę spotkań w dużej próbie.

Nie sprzedajemy przewidzianych zwycięzców. Publikujemy skalibrowane prawdopodobieństwa i własny dorobek, łącznie z rynkami, na których ten dorobek jest ujemny.

2. Modele

Przy każdym meczu pracują cztery modele. Są trenowane niezależnie na tych samych danych i często się nie zgadzają, co jest zamierzone: rozrzut między nimi sam w sobie mówi, jak pewne naprawdę jest dane starcie.

FastTree

Drzewo decyzyjne ze wzmocnieniem gradientowym i punkt odniesienia, wobec którego mierzone są wszystkie pozostałe modele. Trenuje się szybko, pozostaje stabilny między kolejnymi treningami i dobrze radzi sobie ze zwykłym przypadkiem: dwiema znanymi drużynami w ustabilizowanej lidze z obszerną świeżą historią. To model dostępny w wersji darmowej i ten, który najłagodniej traci na jakości, gdy drużyna ma skąpe dane.

LightGBM

Implementacja wzmocnienia gradientowego rozwijana liśćmi. Dostosowuje się szybciej niż FastTree, gdy zmienia się sama gra, przez co jest mocniejszym modelem przy zmianach patcha i na turniejach międzynarodowych, gdzie drużyny z różnych regionów spotykają się po raz pierwszy, a forma regionalna jest kiepskim drogowskazem.

PCA Sweep

Potok składowych głównych, którego hiperparametry wybrano w rozległym przeglądzie offline, z redukcją wymiarowości stosowaną przed klasyfikatorem. Ściśnięcie skorelowanych statystyk drużynowych do mniejszej liczby składowych ogranicza przeuczenie na wielu niemal powielonych cechach zawartych w profilu drużyny i zwykle jest to najdokładniejszy z trzech modeli bazowych.

Consensus

Nie czwarty model, lecz ważona mieszanka trzech powyższych, ważona niedawną stratą logarytmiczną każdego z nich, tak by model w słabszym okresie wnosił mniej. Consensus to najbardziej wiarygodna pojedyncza liczba na stronie, a zarazem najbardziej zachowawcza: rzadko generuje skrajne prawdopodobieństwa, jakie czasem podają pojedyncze modele.

Każdy model istnieje w dwóch wariantach. Wariant bazowy prognozuje na podstawie formy drużyny i zawodników przed rozpoczęciem gry. Wariant uwzględniający draft wycenia tę samą grę ponownie, gdy zablokowanych zostanie wszystkich dziesięciu bohaterów, dokładając do formy drużyny współczynniki wygranych bohaterów, synergie w składzie i kontry w starciach. Wariant ten jest dostępny dopiero po zakończeniu wyboru bohaterów i właśnie dlatego prognoza może się zmienić tuż przed startem gry.

3. Dane treningowe

  • 15,622 pojedynczych gier zindeksowanych
  • 450 śledzonych drużyn
  • 230 objętych turniejów
  • 35,844 prognoz ocenionych i zarchiwizowanych

System zasilają dwa źródła. Terminarze, stan gier na żywo i wybór bohaterów pochodzą z oficjalnego API LoL Esports na lolesports.com. Statystyki zakończonych meczów, na których trenowany jest każdy model i wobec których oceniana jest każda prognoza, pochodzą z pobierania danych z gol.gg. Gdy oba źródła podają sprzeczny wynik, za wiążące uznajemy gol.gg, a przekaz na żywo odrzucamy.

Modele widzą formę drużyny w przesuwanych oknach ostatnich spotkań, ocenę siły w stylu Elo skorygowaną o poziom regionu i wyniki międzyregionalne, współczynniki wygranych po każdej stronie mapy, statystyki celów i złota, formę poszczególnych zawodników obecnego składu, a w wariancie uwzględniającym draft także faktycznie wybranych bohaterów. Cechy liczone są symetrycznie dla obu stron, aby model nie mógł niczego wywnioskować z tego, która drużyna jest wymieniona jako pierwsza.

Wszystkie modele trenują się ponownie codziennie o 00:10 UTC na całej dostępnej w danym momencie historii, a prognozy nadchodzących meczów są odtwarzane po zakończeniu treningu. Plik modelu nigdy nie jest modyfikowany pomiędzy treningami.

Żaden turniej nie jest wyłączony z treningu. Wcześniejsze wersje potoku pomijały część mniejszych i międzynarodowych wydarzeń; zrezygnowano z tego w 2026 roku, ponieważ pomijane wydarzenia były dokładnie tymi, przy których modele najbardziej potrzebowały danych.

4. Jak śledzimy skuteczność

Prognozy postawione przed rozpoczęciem meczu pozostają trwale w archiwum i służą do wyliczenia tych liczb. Nie istnieje żaden mechanizm pozwalający usunąć, zmienić lub wstecznie przeliczyć opublikowaną prognozę.

Prognoza jest oceniana dopiero wtedy, gdy mecz pojawi się w pobranych danych wynikowych. Stan gry na żywo nigdy nie służy do rozliczenia prognozy, bo pozyskujemy go w miarę możliwości i bywa błędny; mecz, którego zwycięzcy nie da się jeszcze ustalić z pobranych danych, pozostaje nieoceniony, zamiast być rozstrzygnięty wnioskowaniem. Jest to wolniejsze niż odczyt przekazu na żywo i z tego powodu publikowany dorobek może być o kilka godzin opóźniony wobec wyniku.

Ocena odbywa się przez wyłączenie po dacie: model mierzony jest wyłącznie na meczach, które nie odbyły się jeszcze w chwili jego treningu, i jest to jedyny uczciwy test dla systemu trenowanego codziennie. Każda oceniona prognoza wchodzi do poniższych liczb. Nie istnieje etap redakcyjny, na którym słaby tydzień zostałby wyłączony, ani żaden rynek nie jest ukrywany z powodu słabych wyników.

Co publikujemy

Skuteczność trafień
Udział trafionych typowań, zawsze podawany wraz z liczbą typowań, która za nim stoi. Sam w sobie jest miarą słabą: model wskazujący wyłącznie wyraźnych faworytów może osiągać wysoką skuteczność, nie wnosząc nic ponad zwykłe podążanie za rynkiem.
Wynik Briera
Średnia kwadratowa różnica między podanym prawdopodobieństwem a tym, co się wydarzyło. Im niżej, tym lepiej. Mówienie zawsze 50 procent daje 0,25, więc każda wartość powyżej 0,25 oznacza, że pewność dołączona do typowań była gorsza niż bezużyteczna. To miara, która demaskuje model mylący się z przekonaniem, czego sama skuteczność trafień nie wychwyci.
Strata logarytmiczna
Druga reguła punktacji dla tych samych prognoz, karząca pewne siebie błędy znacznie ostrzej niż wynik Briera. To ona decyduje w mieszance Consensus, na jaką wagę zasługuje obecnie każdy model.
Zwrot z inwestycji
Ile przyniosłaby stała jednostkowa stawka na każde kwalifikujące się typowanie, wyceniona po kursach rynkowych dostępnych przed meczem. Trafione typowanie zwraca kurs pomniejszony o jeden; nietrafione traci jedną jednostkę. Zwrot to wynik netto podzielony przez liczbę typowań. To jedyna miara tutaj, która uwzględnia cenę, i ta, przy której model może być dokładny, a mimo to nierentowny.

Zobacz pełny dorobek według modelu, rynku i ligi

5. Kalibracja

Model jest skalibrowany, gdy deklarowana przez niego pewność odpowiada rzeczywistości w dużej próbie: spośród wszystkich meczów ocenionych na 60 procent około 60 procent powinno zostać wygranych. Model może być jednocześnie dokładny i źle skalibrowany, wybierając właściwą stronę, lecz będąc jej o wiele zbyt pewnym.

Surowy wynik modelu sam w sobie nie jest dobrze skalibrowany, dlatego warstwę kalibracji stosujemy w momencie wyświetlania, dopasowaną wyłącznie do dawnych ocenionych prognoz i nigdy do meczu, który jest właśnie prognozowany. Ponieważ stosuje się ją przy odczycie strony, a nie zapisuje w przechowywanej prognozie, historia pozostaje dokładnie taka, jak ją opublikowano, podczas gdy stojąca za nią kalibracja wciąż się poprawia.

Kalibracja jest łączona w obrębie ligi, więc liga z niewielką liczbą ocenionych meczów czerpie z szerszej próby, zamiast ufać garstce wyników. To także powód, dla którego ligi poniżej minimalnej próby są oznaczane jako mało wiarygodne i pomijane w liczbach głównych: nie dlatego, że ich wyniki są złe, lecz dlatego, że nie ma ich jeszcze dość, by cokolwiek znaczyły.

6. Typy wartościowe

Typ wartościowy to sytuacja, w której nasze prawdopodobieństwo jest wyższe niż prawdopodobieństwo implikowane przez rynek dla tego samego wyniku. To różnica zdań z ceną rynkową, a nie zapowiedź pewnego rezultatu.

wartość oczekiwana = (prawdopodobieństwo modelu x kurs rynkowy) - 1

Gdy ta wartość przekracza zero, rynek oferuje cenę, którą uznajemy za zbyt hojną, i typowanie zostaje zapisane. Każde zapisane typowanie przechowujemy wraz z prawdopodobieństwem, ceną i znacznikiem czasu publikacji, a następnie oceniamy jak każdą inną prognozę. Typowania w ligach oznaczonych jako mało wiarygodne są śledzone, lecz wyłączone z publikowanych zwrotów, bo procent liczony na garstce wyników to szum.

Rynek musi mieć co najmniej 50 ocenionych typowań, zanim będzie mógł cokolwiek firmować. Poniżej tego progu liczby nadal publikujemy w pełnej tabeli wraz z wielkością próby, ale nie traktujemy ich jako wyniku.

Obecnie najmocniejszym rynkiem w zestawieniu jest PCA Sweep na Zwycięzca serii: +10.1 procent zwrotu przy 130 ocenionych typowaniach. Ta liczba jest wyprowadzona, a nie wybrana, i zmienia się wraz z napływem wyników.

Zobacz każdy rynek, także te przynoszące straty

7. Najczęstsze pytania

Czy potraficie prognozować pojedyncze gry w ramach serii?

Tak, i oceniamy je osobno. Prognozy na poziomie gry i na poziomie serii to odrębne rynki o odmiennych mianownikach i nigdy nie łączymy ich w jedną liczbę, ponieważ seria do trzech wygranych zawiera kilka gier, a wspólne uśrednienie po cichu ważyłoby długie serie mocniej niż krótkie.

Czy korzystacie z informacji prywatnych lub poufnych?

Nie. Wszystko, co widzą modele, jest jawne: opublikowane wyniki meczów, oficjalne terminarze i wybór bohaterów w takiej postaci, w jakiej jest transmitowany. Nie mamy sieci skautów, prywatnych informacji o składach ani kontaktu z drużynami czy zawodnikami.

Jak radzicie sobie z nowym patchem?

Modele trenują się codziennie, więc patch wchodzi do nich w miarę rozgrywania na nim meczów, a nie przez ręczne korekty. Oznacza to, że pierwsze dni dużego patcha są najmniej wiarygodnym okresem na stronie, a warianty uwzględniające draft odbudowują się najszybciej, bo statystyki bohaterów przesuwają się wcześniej niż drużynowe. Nie stroimy modeli ręcznie pod patcha, bo uczyniłoby to publikowaną skuteczność niemożliwą do odtworzenia.

Jak rozstrzygane są remisy i nierozegrane gry?

Prognoza dotycząca gry, która nigdy się nie odbyła, jest unieważniana zamiast liczona jako pudło, a unieważnione typowania usuwamy ze wszystkich liczb. Tam, gdzie rynek może zakończyć się zwrotem, na przykład gdy suma trafi dokładnie w linię, typowanie unieważniamy, a jedną jednostkę traktujemy jako zwróconą. Serie, które pojawiają się w pobranych danych z niepełnym rezultatem, pozostają nieocenione do czasu napłynięcia brakujących gier.

Dlaczego nie użyć po prostu najlepszego modelu?

Ponieważ to, który jest najlepszy, zmienia się i wiadomo to dopiero z perspektywy czasu. Każdy z trzech prowadził na innych rynkach i w innych okresach, a kolejność przesuwa się między patchami oraz między rozgrywkami regionalnymi a międzynarodowymi. Zmieszanie ich według niedawnej straty logarytmicznej daje liczbę stabilniejszą niż jakikolwiek pojedynczy model, kosztem tego, że rzadko bywa najlepsza na konkretnym rynku.

Prognozy generują modele uczenia maszynowego i nie gwarantują żadnych rezultatów. Liczby na tej stronie opisują dawne, ocenione już prognozy i nie są przewidywaniem przyszłych wyników. Wyłącznie w celach informacyjnych; nie stanowią porady finansowej.