Hoe onze voorspellingen tot stand komen

We draaien dit niet op een groot taalmodel of een big-data patroonherkenningssysteem, en dat is een bewuste keuze, geen beperking.

Voetbalteams zijn geen stabiele systemen. Een trainer wordt midden in het seizoen vervangen. Een transferwindow bouwt in zes weken de halve selectie om. Een team dat in augustus domineerde, kan er in november onherkenbaar uitzien - andere spelers, andere opstelling, andere vorm. Methodes die zijn gebouwd om patronen te vinden over jaren aan historie, hechten veel gewicht aan een versie van het team die er misschien niet meer is tegen de tijd dat je dit leest. Voor een sport die zichzelf elke zomer en elk transferwindow opnieuw uitvindt, is dat het verkeerde gereedschap voor de klus.

Dus in plaats van patronen te zoeken in jaren aan historie, leunt ons model zwaar op twee dingen: hoe een team op dit moment speelt, en waar ze spelen.

Recente vorm eerst

De coëfficiënt van elk team is vooral gebaseerd op de meest recente wedstrijden, niet op een heel seizoen of een historisch overzicht. Een slechte reeks trekt de cijfers van een team snel naar beneden, en een nieuwe-trainerseffect of de terugkeer van een sleutelspeler is binnen een handvol wedstrijden zichtbaar in het model, in plaats van verwaterd te worden over een jaar aan gegevens.

Een coëfficiënt verschijnt zodra een team zijn eerste wedstrijd in de huidige periode heeft gespeeld - er is dus altijd een vormindicator om naar te kijken, ook vroeg in het seizoen. Voor voorspellingen geldt een hogere lat: we wachten tot een team 3-4 wedstrijden aan actuele gegevens heeft opgebouwd voordat we een echte tip en een betrouwbaarheidspercentage voor die markt genereren. Eén wedstrijd is genoeg om een ruwe vormscore te schetsen, maar niet genoeg signaal om je vast te leggen op een specifieke voorspelling.

Thuis en uit worden als aparte vragen behandeld

De thuisvorm en de uitvorm van een team worden apart berekend en gewogen, niet samengevoegd tot één getal. Sommige teams zijn thuis echt een andere ploeg dan op verplaatsing - sterker met steun van het publiek, voorzichtiger zonder, of andersom. Onze coëfficiënten weerspiegelen dat verschil rechtstreeks: de score voor een thuiswedstrijd is opgebouwd uit de thuisprestaties van dat team, niet verwaterd door hoe ze het uit hebben gedaan.

Wil je meer dan de score in één oogopslag, dan toont de pagina van elke wedstrijd ook de algehele vorm over beide speeltypes.

Wat het model daadwerkelijk voedt

De gegevens achter elke coëfficiënt en elke voorspelling zijn precies dezelfde statistieken die je rechtstreeks vindt in Match Finder - er is geen geavanceerdere versie die achter de schermen verborgen zit:

  • Wedstrijdresultaten - winst-, gelijkspel- en verliespercentages, plus reeksen zonder nederlaag en zonder overwinning
  • Doelpuntenpatronen - gemaakte en tegendoelpunten per wedstrijd, percentage beide teams scoren, percentage clean sheets en niet scoren
  • Over/under-verschillen - over/under-prestaties op de grenzen van 0,5, 1,5, 2,5, 3,5 en 4,5, voor totale, gemaakte en tegendoelpunten
  • Speelgedrag - hoekschoppen, overtredingen, kaarten en balbezit

Dit alles wordt apart berekend voor thuis- en uitvorm, en zwaarder gewogen richting recente wedstrijden zoals hierboven beschreven.

De uitkomst lezen

Er verschijnen twee verschillende dingen op de site, die verschillende vragen beantwoorden:

  • De coëfficiënt van 0 tot 5 op de wedstrijdkaarten is een vormscore per team in één oogopslag, kleurgecodeerd zodat je snel een hele speelronde kunt doornemen. Groen of rood betekent dat de gegevens duidelijk één kant op wijzen. Geel of oranje betekent dat de recente vorm van beide teams dicht genoeg bij elkaar ligt om echt lastig in te schatten te zijn - we laten dat liever eerlijk zien dan een getal te forceren dat zelfverzekerd oogt. Vroeg in de periode van een team (de eerste een of twee wedstrijden) moet je de coëfficiënt met extra voorzichtigheid bekijken - dat is dezelfde reden waarom voorspellingen wachten op 3-4 wedstrijden voordat ze überhaupt worden gegenereerd.
  • Het betrouwbaarheidspercentage bij elke specifieke voorspelling (1X2, over/under, beide teams scoren, hoekschoppen, enzovoort) is de inschatting van het model voor die specifieke markt, op dezelfde manier gegenereerd voor elke wedstrijd, zonder handmatig ingrijpen.

Waarom we bekercompetities overslaan

Dezelfde logica die ons gefocust houdt op recente vorm, is de reden waarom we geen bekerwedstrijden behandelen. Nationale bekers brengen tweede elftallen, sterk uiteenlopende motivatieniveaus tussen clubs, en knock-outformats mee die van "teamvorm" een veel wankeler begrip maken van de ene ronde op de andere. We behandelen liever betrouwbaar competitievoetbal dan onbetrouwbaar bekervoetbal.

Hoe we onszelf eerlijk houden

Elke voorspelling wordt vastgelegd op het moment dat hij wordt gedaan, en gecontroleerd aan de hand van de einduitslag zodra de wedstrijd is afgelopen, telkens volgens dezelfde geautomatiseerde criteria - geen handmatige beoordeling, en er wordt nooit selectief een resultaat verwijderd op basis van de uitkomst. Uitgestelde of gestaakte wedstrijden worden volledig uitgesloten van de administratie in plaats van op de ene of andere manier meegeteld, omdat er geen resultaat is om aan te toetsen.

Het openbare overzicht beslaat de afgelopen 12 maanden op doorlopende basis. Dat is een bekendgemaakte bewaartermijn, geen selectie - elk resultaat blijft even lang staan, ongeacht of het goed of fout was, en dat houdt het overzicht gericht op hoe het model presteert onder zijn huidige aanpak, in plaats van het te verwateren met wedstrijden die jaren geleden zijn beoordeeld onder een eerdere versie van het systeem. Je kunt het volledige overzicht bekijken op onze pagina voorspellingsgeschiedenis.

Statistieken worden elke 12 uur ververst, wat ook het moment is waarop elke voorspelling tegen de uitslag wordt afgezet. Wedstrijdpreviews worden meestal 24-48 uur voor aftrap gepubliceerd, zodra teamnieuws en opstellingen bevestigd zijn.