El ColegiadoLes données de l'arbitrage en Liga

Analyses

Méthodologie

Comment chaque chiffre du site est produit, et ce qu'il ne peut pas dire.

  • 2000-01 → 2025-26
  • 9 880 matchs
  • Mis à jour le 3 octobre 2026

Couverture : Liga uniquement (Primera División). Copa del Rey et Ligue des champions : à venir.

Sources

  • football-data.co.uk : scores et cotes avant match de 2000-01 à 2025-26 ; fautes, corners, tirs et cartons à partir de 2005-06. Usage libre ; le téléchargement est fait à la main (le fichier robots.txt du site exclut les agents automatisés).
  • Zenodo 7341037 (données BeSoccer) : arbitre, cartons et penaltys par équipe, jusqu'en 2021-22. Licence CC BY-NC 4.0 : projet non commercial, attribution obligatoire.
  • Zenodo 7831873 (« Dataset with the results and matches of La Liga ») : arbitre de chaque match de 2014-15 à 2022-23 (jusqu'à la 29e journée de 2022-23). Licence CC BY-SA 4.0.
  • Wikipédia (en et es) : arbitres et penaltys de chaque match tirés des articles de saison de chaque club, classements finaux, champions et biographies d'arbitres. Licence CC BY-SA 4.0 ; chaque référence est datée par son numéro de révision.
  • Arbitre retenu : jusqu'à trois sources (Zenodo/BeSoccer, Zenodo 7831873, Wikipédia) votent ; la majorité l'emporte, et un désaccord sans majorité laisse l'arbitre vide (journal des conflits sur la page Données).

Sources écartées : sites dont les conditions d'utilisation interdisent la collecte, ou protégés contre les robots (aucune protection n'a été contournée).

Normalisation

Équipes : une table d'alias relie chaque écriture à un identifiant unique ; un nom inconnu fait échouer la construction.

Arbitres : identifiant = les deux noms de famille sans accents. Les variantes d'écriture rencontrées sont listées sur chaque fiche. 80 arbitres sont identifiés.

Frères Teixeira Vitienes : Fernando Teixeira Vitienes et José Antonio Teixeira Vitienes ont tous deux arbitré en Primera. La source principale les confond à partir de 2010-11 ; quand aucune autre source ne donne le prénom, le match est classé dans une entrée à part, non distinguée (44 matchs), exclue des tests arbitre × club.

Penaltys accordés = penaltys marqués + penaltys manqués de l'équipe. Cotes : moyenne de marché, sinon moyenne des bookmakers disponibles.

Périodes

  • Avant : 2000-01. Les paiements commencent « au moins en 2001 » selon le parquet : cette saison unique sert de contrôle de sensibilité.
  • Pendant : 2001-02 → 2017-18, période des paiements.
  • Après : 2018-19 → 2025-26. Coïncide avec l'arrivée de la VAR (2018-19) : les deux effets ne sont pas séparables.

Cotes : quel chiffre, quelle correction

  • Source : football-data.co.uk, moyenne de marché avant match (colonnes BbAv* de 2005 à 2019, Avg* de 2019 à 2026 ; avant 2005, ou en l'absence de moyenne, moyenne des bookmakers disponibles). Ce ne sont pas des cotes de clôture.
  • Marge retirée par normalisation proportionnelle : p = (1/cote) / Σ(1/cotes) sur les trois issues. La méthode de Shin n'est pas utilisée ; la normalisation proportionnelle peut laisser un léger biais favori-outsider (voir les limites).
  • 2 matchs sur 9 880 sans cotes : exclus des mesures « points − attendus » et des ajustements à la force, conservés partout ailleurs.

Points attendus

Pour chaque match, les probabilités de victoire, nul et défaite tirées des cotes donnent les points attendus.

Points attendus = 3 × P(victoire) + P(nul)

L'écart points obtenus − points attendus neutralise la force de l'équipe : un grand club a beaucoup de points attendus, il n'a donc pas d'écart positif « automatique ». Sur toute la Liga, cet écart va de −1,3 % à +1,8 % selon la saison : les cotes sont un étalon fiable (voir l'étude).

Distribution exacte des points

Le graphique signature du site calcule, dans votre navigateur, la probabilité exacte de chaque total de points sur une série de matchs si seules les cotes comptaient. On part d'une distribution « 0 point avec certitude », puis, match après match, on la combine avec les trois issues possibles : 0 point (défaite), 1 point (nul), 3 points (victoire), chacune avec sa probabilité. Aucun tirage au hasard : le résultat est exact.

La p-valeur bilatérale d'une distribution discrète est définie partout de la même façon :

p = 2 × min( P(X ≤ observé), P(X ≥ observé) ), plafonnée à 1

Dans l'analyse (Python), les probabilités viennent d'une simulation, avec la correction « +1 » habituelle ((k + 1) / (n + 1)) ; sur le site, elles sont calculées exactement. Plus p est petite, plus le total réel est rare au regard des cotes. Dans l'Explorateur et le comparateur, p n'est pas corrigée pour les comparaisons multiples : elle est traduite en « courant » (p ≥ 0,10), « peu courant » (0,01 ≤ p < 0,10) ou « rare » (p < 0,01).

Tests arbitre × club

Chaque paire arbitre × club d'au moins 5 matchs est testée sur cinq mesures (1 325 paires, tous clubs) :

  • Points − attendus : on rejoue des milliers de fois la série de matchs en tirant chaque résultat selon les cotes ; la p-valeur est la fréquence à laquelle le hasard seul produit un écart au moins aussi grand.
  • Soldes de penaltys, rouges, jaunes et fautes (permutation stratifiée) : on compare les matchs de la paire aux autres matchs du même club la même saison, dirigés par d'autres arbitres, en redistribuant au hasard les matchs entre arbitres.

Sous 15 matchs, la paire est marquée « petit échantillon ». Sous 5 matchs, elle n'est pas testée : chip « descriptif ». Une page dédiée existe dès 3 matchs.

Correction de Benjamini-Hochberg

Avec des centaines de comparaisons, environ 5 % donnent p < 0,05 par pur hasard. La correction de Benjamini-Hochberg classe les p-valeurs et les ajuste au nombre de tests : on obtient une q-valeur. On ne parle d'écart notable (« favorable au club » ou « défavorable au club ») que si q < 0,05 ; cela garde la proportion attendue de fausses alertes sous 5 %. Sinon : « non concluant ».

Les familles de tests corrigées ensemble :

  • Arbitre × club : une famille par mesure (points, penaltys, rouges, jaunes, fautes), chacune sur l'ensemble des paires de tous les clubs ayant au moins 5 matchs (1 325 paires ; un peu moins pour les fautes, absentes avant 2005-06).
  • Désignations : une famille (2 094 paires).
  • Matchs importants : une famille (1 297 combinaisons).
  • Différences de différences de l'étude : une famille (18 tests).

Le décompte des « combinaisons notables » cumule les q < 0,05 de toutes les familles arbitre × club.

Pourquoi tant de « non concluant » ?

Ajustement à la force

Un club dominant tire plus de penaltys et reçoit moins de cartons parce qu'il domine, pas forcément à cause de l'arbitre. Chaque match est donc comparé à la moyenne de la Liga pour des matchs de même force selon les cotes (déciles), de la même saison et au même endroit (domicile ou extérieur). Une valeur positive est favorable au club.

Différence de différences

On mesure l'évolution d'un club entre deux périodes, puis on lui retire l'évolution d'un groupe de comparaison sur les mêmes périodes : (A₁ − A₂) − (B₁ − B₂). L'intervalle de confiance à 95 % vient d'un bootstrap en blocs club-saison (on rééchantillonne des saisons entières de clubs, pour respecter la dépendance entre matchs d'une même saison). Dans l'étude, q = correction de Benjamini-Hochberg sur les 18 tests. Le comparateur refait ce calcul dans le navigateur pour n'importe quel club et n'importe quel groupe témoin, avec 2 000 tirages et une graine fixe.

Fréquence de désignation

Nombre attendu de matchs d'un arbitre avec un club = sa part des matchs de Liga chaque saison (parmi les matchs qu'il peut diriger : jamais un club de sa région) × matchs du club. Test de Poisson, correction de Benjamini-Hochberg.

Matchs importants

Un match est « important » pour un club si l'adversaire a terminé dans le top 4 final de la saison (classement recalculé : points, confrontations directes, différence de buts, buts marqués), plus le Clásico pour Barça et Real Madrid. Période : 2000-01 → 2025-26 (arbitres connus pour tous les matchs). Pour chaque club et chaque arbitre (au moins 5 matchs), on compare la part de matchs importants qu'il a dirigés à celle des autres arbitres : test exact de Fisher, puis correction de Benjamini-Hochberg.

Archives 1990-91 → 1999-00

Sources : résultats et classements finaux depuis les pages de saison d'es.wikipedia (complets) ; arbitre, date, penaltys et cartons depuis les pages de saison des clubs sur en.wikipedia, quand elles les donnent (CC BY-SA 4.0).

Couverture : arbitre connu pour 1 112 matchs sur 3 964 ; cette couverture est partielle et dépend des clubs et des contributeurs de Wikipédia, donc non aléatoire. Victoire à 2 points jusqu'à la saison précédant 1995-96.

Noms d'arbitres : consolidation prudente des variantes d'écriture : dans le doute, deux graphies restent séparées plutôt que d'être fusionnées à tort ; quelques doublons peuvent donc subsister.

Pourquoi aucune analyse : il n'existe pas de cotes de bookmakers pour ces saisons, donc pas de points attendus, et les données d'arbitrage sont incomplètes et non aléatoires. Un modèle Elo (points attendus calculés à partir des seuls résultats passés) a été construit et testé contre les cotes sur 2000-01 → 2025-26 ; ses points attendus s'écartent de plusieurs points par club et par saison de ceux tirés des cotes : il a été écarté comme étalon (voir scripts/09_elo.py). Les pages d'archives sont donc purement descriptives : ni test, ni verdict.

Limites

  • Les cotes reflètent ce que le marché savait : si un biais était connu et intégré par les bookmakers, l'écart aux cotes le sous-estimerait.
  • Moyenne de marché avant match plutôt que cotes de clôture, marge retirée proportionnellement (pas de méthode de Shin) : léger biais favori-outsider possible.
  • Liga uniquement : Copa del Rey et compétitions européennes ne sont pas couvertes.
  • Cartons et fautes dépendent du style de jeu (possession, pressing), que l'ajustement par les cotes ne capte pas.
  • La fin des paiements et la VAR coïncident (2018-19) ; matchs à huis clos en 2019-20 et 2020-21.
  • Cartons jaunes : les deux sources concordent sur 85 à 88 % des matchs ; une série d'une seule source sert de contrôle.
  • Les classements finaux affichés sont recalculés à partir des matchs (points, confrontations directes, différence de buts, buts marqués) ; le titre officiel fait foi.
  • Ces tests portent sur des résultats agrégés. Ils ne disent rien d'une décision précise dans un match, et un écart statistique n'est pas une preuve.