Aller au contenu
MéthodologieDataIA

Comment fonctionne Elofoot : la méthodologie complète, de la donnée brute à la prédiction IA

Des données API-Football aux buts attendus, à la loi de Poisson et au scénario rédigé par l'IA : la chaîne complète derrière une prédiction Elofoot, limites comprises.

Sarah MercierLead Data Science10 min de lecture
Dashboard d'analyse de données avec graphiques et tableaux

On nous pose souvent la même question : « Concrètement, comment vous prédisez un match ? » La réponse honnête tient en cinq étapes : récupérer les données, estimer les buts attendus, les transformer en probabilités, les confronter au marché, puis laisser l'IA expliquer le résultat en clair. Voici la chaîne complète, telle qu'elle tourne aujourd'hui, zones grises comprises.

Un principe passe avant tout le reste : les chiffres viennent d'un modèle statistique déterministe, jamais de l'IA. Un modèle de langage écrit bien mais calcule mal : livré à lui-même, il peut sortir un pourcentage qui sonne juste et qui est faux. Chez Elofoot, le modèle calcule, l'IA rédige.

La chaîne en cinq étapes

  1. Données : matchs, forme, xG, classement, blessés et compositions, synchronisés et horodatés.
  2. Buts attendus : combien de buts chaque équipe devrait marquer dans ce match.
  3. Probabilités : la loi de Poisson transforme les buts attendus en scores, puis en 1X2, « les deux équipes marquent » et plus/moins de buts.
  4. Confrontation au marché : sur les grosses affiches où un marché de prédiction est liquide, l'avis du marché est intégré.
  5. Rédaction et affichage : l'IA rédige le scénario à partir des chiffres calculés ; la prédiction est revérifiée face aux derniers blessés et compositions avant de t'arriver.

Étape 1 : les données

Tout part de la donnée. Notre fournisseur principal est API-Football. Pour chaque match, on utilise :

  • La forme récente : les résultats des cinq derniers matchs.
  • Les buts attendus (xG) et les stats avancées (tirs, possession, corners) agrégés sur les matchs récents, pour mesurer la performance au-delà du score.
  • Le classement : points, matchs joués, différence de buts.
  • Les blessés et suspendus, ainsi que les compositions : le onze officiel quand il est publié (en général environ une heure avant le coup d'envoi), sinon un onze probable construit à partir des titulaires des cinq derniers matchs de l'équipe.
  • Les confrontations directes (H2H), utilisées comme contexte, jamais comme fondation.

On couvre aujourd'hui 59 compétitions : les grands championnats européens et leurs coupes, les coupes d'Europe, les principaux championnats d'Amérique du Sud et d'Afrique, la MLS, la Liga MX, la Saudi Pro League et les compétitions de sélections.

Les données sont resynchronisées en continu et chaque élément est horodaté. Rien n'est récupéré « à la volée » pendant la génération : le modèle travaille sur ce qui est déjà en base. Une prédiction n'est régénérée que lorsque les données qui la sous-tendent changent, pour rester cohérente avec ce qu'on sait réellement.

Pas d'invention

Deux pièges classiques sont traités en amont. Les homonymes et les joueurs transférés : les blessés et les buteurs potentiels sont croisés avec l'effectif à jour du club, pour ne jamais citer un joueur parti au mercato. Et les données manquantes : certaines compétitions n'ont pas d'xG ou ont des trous dans les listes de blessés. La règle est simple : une donnée absente n'est ni inventée ni citée.

Étape 2 : estimer les buts attendus

Le cœur du modèle, c'est un nombre par équipe : ses buts attendus dans ce match, souvent noté λ (lambda).

  • Le point de départ est l'xG moyen de l'équipe. Quand une compétition n'a pas de données xG, le modèle se replie sur une base neutre.
  • Un facteur de force transfère ensuite des buts d'un camp à l'autre. Il combine les points par match (comparés à une moyenne de milieu de tableau), la forme récente (une série de cinq défaites l'abaisse de 15 %, cinq victoires le relèvent de 15 %) et un prior de division. Ce prior compte dans les matchs de coupe entre divisions : cinq victoires en Ligue 2 ne valent pas cinq victoires en Ligue 1. Deux équipes du même championnat ont le même coefficient, il s'annule, et les matchs de championnat ne sont pas affectés.
  • Pour les sélections africaines, souvent sans classement ni xG disponibles, un prior de niveau fondé sur des paliers du classement FIFA et les résultats CAF récents évite de traiter chaque match d'éliminatoires de la CAN comme un pile ou face.
  • L'avantage du terrain ajoute environ 12 % aux buts attendus de l'équipe qui reçoit et retire la même part aux visiteurs.

Le facteur de force ne fait que transférer des buts entre les deux équipes ; il ne gonfle pas le total. Et les valeurs sont bornées pour que le modèle ne produise jamais de distributions absurdes.

Étape 3 : des buts attendus aux probabilités

Les buts sont des événements rares, et la façon standard de modéliser des événements rares est la loi de Poisson (voir notre fiche lexique). À partir du λ de chaque équipe, elle donne la probabilité de marquer 0, 1, 2, 3… buts. En croisant les deux distributions, on obtient une grille avec la probabilité de chaque score, de 0-0 à 10-10. Tout le reste se lit dans cette grille :

  • Les probabilités 1X2 : la somme de toutes les victoires à domicile, de tous les nuls, de toutes les victoires à l'extérieur. Elles font toujours exactement 100 %, et aucune issue n'est jamais affichée au-dessus de 95 %, parce que rien n'est certain dans le football.
  • Le score exact le plus probable, plus des scores alternatifs tirés des cases suivantes les plus probables.
  • Les deux équipes marquent et plus/moins de 1,5, 2,5 et 3,5 buts.

Un exemple rapide. Deux équipes de même niveau, sans données xG : le modèle donne environ 1,62 but attendu à l'équipe qui reçoit et 1,03 aux visiteurs. La grille donne une victoire à domicile à 51 %, un nul à 25 % et une victoire à l'extérieur à 24 %. Le score le plus probable est 1-1, à 11,8 %, juste devant 1-0 (11,5 %). C'est pour ça que même un score exact bien calculé est loin d'être une certitude (plus de détails dans le score exact fiable à 100 % existe-t-il ?), et tout le calcul est déroulé pas à pas dans comment trouver un score exact.

Pour les matchs à élimination directe, les probabilités sont calculées sur 90 minutes : une vraie probabilité de nul (et donc de prolongation et de tirs au but) est conservée.

Étape 4 : la confrontation au marché

Sur les grosses affiches, un marché de prédiction en argent réel (Polymarket) cote souvent le résultat. Quand ce marché est assez liquide, ses probabilités implicites, marge de l'opérateur retirée, sont combinées à celles du modèle. Un marché où des gens engagent de l'argent réel est un signal fort, qui corrige le modèle là où il est aveugle (un entraîneur sur la sellette, une info que les données n'ont pas encore captée). Sur la longue traîne des matchs sans marché liquide, le modèle de Poisson décide seul.

Des garde-fous s'appliquent : un marché trop mince est ignoré, et le prix du nul n'est utilisé que si suffisamment d'argent a été échangé dessus.

Étape 5 : l'IA rédige, le modèle décide

C'est seulement maintenant que l'IA intervient. Un modèle de langage contraint reçoit les données du match et les chiffres déjà calculés, et il rédige :

  • Le scénario principal : comment le match devrait se dérouler et pourquoi, en langage clair.
  • Les facteurs clés : forme, xG, absents, contexte, duel décisif.

Il ne produit ni les probabilités, ni les buts attendus, ni les marchés de buts : tout cela vient du modèle et reste identique dans toutes les langues. Même les buteurs probables sont choisis dans une liste que le serveur construit à l'avance à partir des joueurs disponibles (blessés et gardiens exclus), avec des probabilités calculées à partir de la part de chaque joueur dans les xG et la production réelle de son équipe. Si une donnée manque, elle n'est pas inventée : elle n'est tout simplement pas mentionnée.

Ce que contient une prédiction

Chaque prédiction contient trois scénarios :

  • Le scénario principal, le plus probable, avec son score exact et les probabilités 1X2. Il est visible par tous.
  • Deux scores exacts alternatifs, avec leur probabilité, réservés à la section Gold. Celle-ci ajoute les buteurs et passeurs probables, la mi-temps, les tirs, les xG et la projection des buts.

Fraîcheur, direct et bilan

  • Revérifiée avant affichage. Un joueur peut se blesser après la génération d'une prédiction. À chaque affichage d'un match à venir, les buteurs estimés sont confrontés à la liste des blessés du moment et aux compositions publiées avant le coup d'envoi, et tout choix devenu invalide est remplacé. Le score prédit, lui, ne bouge pas.
  • Compositions officielles. Quand elles tombent, la prédiction peut être relancée, environ 45 minutes avant le coup d'envoi, pour tenir compte du onze réel.
  • Mode direct. Lance une prédiction pendant un match et le point de départ devient le score et la minute en cours : le score final est estimé comme buts déjà marqués + Poisson sur le temps restant. Une équipe qui mène 2-0 à la 70e n'a pas les mêmes chances qu'au coup d'envoi, et les chiffres en tiennent compte.
  • Match terminé. On ne peut plus générer de prédiction sur un match déjà joué.
  • Un bilan visible. Sur les pages équipes, les derniers matchs joués affichent la prédiction 1X2 à côté du score réel, marquée juste ou manquée. Les ratés restent visibles : c'est le principe. Un bilan n'a de valeur que s'il est complet et publié avant les matchs (on en parle dans nos 7 critères pour choisir un site de pronostics).

Ce que tu obtiens, gratuit et payant

  • Gratuit, sans compte : les prédictions publiques avec probabilités 1X2, score le plus probable, top 5 des scores, les deux équipes marquent, plus/moins de buts, forme et confrontations directes, sur pronostics foot par IA et pronostic du jour.
  • Offert à l'inscription, sans carte : ta première prédiction complète, avec le scénario principal rédigé.
  • Formules payantes (mensuelles, résiliables à tout moment) : Starter à 4,99 € par mois pour 20 prédictions ; Pro à 14,99 € pour 100 prédictions et la section Gold illimitée ; Elite à 24,99 € pour 250 prédictions, la section Gold illimitée et le support prioritaire. Les prix en vigueur sont toujours affichés dans l'application.

Ce qu'on refuse de faire

  • Garantir un gain. Aucun service de prédiction sérieux ne le peut. Si tu vois « 98 % de réussite » quelque part, fuis.
  • Laisser l'IA inventer un chiffre. Chaque nombre vient du modèle ou des données.
  • Cacher les ratés. Les prédictions sont horodatées et les résultats affichés à côté.
  • Faire semblant de savoir. Une compo non publiée ou une blessure non confirmée est signalée, pas devinée.

Elofoot n'est pas un bookmaker et n'a aucune affiliation avec un bookmaker. Les prédictions aident à comprendre les matchs ; ce ne sont pas des conseils de pari.

Les limites qu'on assume publiquement

  • L'hypothèse d'indépendance. Le modèle de Poisson de base traite les buts des deux équipes comme indépendants. En réalité, une équipe qui mène ralentit et une équipe menée pousse : le modèle simple sous-estime un peu certains nuls (0-0, 1-1). Des versions corrigées existent, comme le modèle de Dixon-Coles.
  • Les petits échantillons. En début de saison, ou pour des sélections qui jouent peu, les moyennes sont fragiles.
  • Les données minces. Sur les compétitions peu couvertes, certaines stats manquent ; le modèle se replie sur des bases neutres et la prédiction est moins tranchée.
  • L'imprévisible. Un carton rouge, un penalty ou une erreur de gardien peuvent tout changer, et aucun modèle ne les voit venir.

Jeu responsable. Les prédictions d'Elofoot sont des estimations statistiques, pas des certitudes ni des conseils de pari. Les paris sportifs sont interdits aux mineurs et comportent des risques (endettement, dépendance, isolement). Ne mise jamais d'argent dont tu as besoin et ne cherche pas à te refaire. En France : Joueurs Info Service, 09 74 75 13 13 (appel non surtaxé).

Et ensuite ?

Tu veux voir tout ça en action ? Ta première prédiction complète est offerte, sans carte bancaire. Le résumé de l'approche est aussi sur la page méthodologie et sur analyse de match par IA.

Pour aller plus loin, lis les 7 erreurs courantes en pronostic foot, que cette chaîne est conçue pour éviter, et notre guide des xG.

On accepte les retours critiques. Notre objectif n'est pas d'avoir raison à tous les coups : c'est d'être plus utile, plus transparent et plus facile à vérifier que les alternatives.

Questions fréquentes

L'IA d'Elofoot invente-t-elle les probabilités ?

Non. Les probabilités, le score le plus probable et tous les chiffres viennent d'un modèle statistique (buts attendus + loi de Poisson, avec le signal de marché quand il existe). L'IA ne rédige que le texte qui explique le scénario.

D'où viennent les données ?

Principalement d'API-Football : résultats, statistiques, xG, compositions, blessés et suspendus, classement et confrontations directes. Les données sont synchronisées en continu et horodatées.

Pourquoi la prédiction change-t-elle avant le match ?

Parce que les données changent : une composition officielle, une absence confirmée. La prédiction n'est refaite que lorsque les données qui la sous-tendent changent.

Elofoot a-t-il toujours raison ?

Non. Aucun modèle n'a toujours raison au football. Une équipe à 60 % de chances de victoire ne gagne pas environ 4 fois sur 10. Les prédictions donnent des probabilités, pas des certitudes.