# Metodología · El Colegiado

> Fuentes, normalización de nombres, puntos esperados según las cuotas, pruebas estadísticas, corrección para pruebas múltiples, ajuste por fuerza y límites.

Source: https://elcolegiado.com/es/metodologia/

Análisis

# Metodología

Cómo se obtiene cada cifra del sitio y lo que no puede decir.

- 2000-01 → 2025-26

- 9.880 partidos

- Actualizado el 3 de octubre de 2026

**Cobertura:** Solo Liga (Primera División). Copa del Rey y Liga de Campeones: más adelante.

## Fuentes

- **football-data.co.uk**: resultados y cuotas previas al partido de 2000-01 a 2025-26; faltas, córners, tiros y tarjetas desde 2005-06. Uso libre; la descarga se hace a mano (el robots.txt del sitio excluye a los agentes automatizados).

- **Zenodo 7341037** (datos de BeSoccer): árbitro, tarjetas y penaltis por equipo, hasta 2021-22. Licencia CC BY-NC 4.0: proyecto no comercial, atribución obligatoria.

- **Zenodo 7831873** («Dataset with the results and matches of La Liga»): el árbitro de cada partido de 2014-15 a 2022-23 (hasta la jornada 29 de 2022-23). Licencia CC BY-SA 4.0.

- **Wikipedia** (en y es): árbitros y penaltis de cada partido tomados de los artículos de temporada de cada club, clasificaciones finales, campeones y biografías de árbitros. Licencia CC BY-SA 4.0; cada referencia está fechada por su número de revisión.

- **Árbitro retenido**: hasta tres fuentes (Zenodo/BeSoccer, Zenodo 7831873, Wikipedia) votan; gana la mayoría, y un desacuerdo sin mayoría deja el árbitro en blanco (registro de conflictos en la página Datos).

Fuentes descartadas: sitios cuyas condiciones de uso prohíben la recopilación o que están protegidos contra robots (no se ha eludido ninguna protección).

## Normalización

**Equipos**: una tabla de alias vincula cada grafía a un identificador único; un nombre desconocido hace fallar la construcción.

**Árbitros**: identificador = los dos apellidos sin tildes. Las variantes de escritura encontradas figuran en cada ficha. Se identifican 80 árbitros.

**Hermanos Teixeira Vitienes**: Fernando Teixeira Vitienes y José Antonio Teixeira Vitienes arbitraron ambos en Primera. La fuente principal los confunde a partir de 2010-11; cuando ninguna otra fuente da el nombre de pila, el partido se clasifica en una entrada aparte, [no diferenciada](https://elcolegiado.com/es/arbitros/teixeira-vitienes-ambigu/) (44 partidos), excluida de las pruebas árbitro × club.

**Penaltis concedidos** = penaltis marcados + penaltis fallados por el equipo. **Cuotas**: media del mercado; en su defecto, media de las casas de apuestas disponibles.

## Periodos

- **Antes**: 2000-01. Según la Fiscalía, los pagos empiezan «al menos en 2001»: esta única temporada sirve de control de sensibilidad.

- **Durante**: 2001-02 → 2017-18, periodo de los pagos.

- **Después**: 2018-19 → 2025-26. Coincide con la llegada del VAR (2018-19): ambos efectos no se pueden separar.

## Cuotas: qué cifra y qué corrección

- **Fuente**: football-data.co.uk, **media del mercado previa al partido** (columnas `BbAv*` de 2005 a 2019, `Avg*` de 2019 a 2026; antes de 2005, o sin media disponible, media de las casas de apuestas disponibles). **No** son cuotas de cierre.

- **Margen eliminado por normalización proporcional**: p = (1/cuota) / Σ(1/cuotas) sobre los tres resultados. No se usa el método de Shin; la normalización proporcional puede dejar un ligero sesgo favorito-sorpresa (véanse las limitaciones).

- **2 partidos de 9.880 sin cuotas**: excluidos de las medidas «puntos − esperados» y de los ajustes por fuerza, conservados en todo lo demás.

## Puntos esperados

Para cada partido, las probabilidades de victoria, empate y derrota derivadas de las cuotas dan los puntos esperados.

Puntos esperados = 3 × P(victoria) + P(empate)

La desviación puntos obtenidos − puntos esperados neutraliza la fuerza del equipo: un gran club tiene muchos puntos esperados, por lo que no tiene una desviación positiva «automática». En toda la Liga, esta desviación va de −1,3 % a +1,8 % según la temporada: las cuotas son una referencia fiable (véase [el estudio](https://elcolegiado.com/es/estudios/cuotas/)).

## Distribución exacta de los puntos

El gráfico emblemático del sitio calcula, en su navegador, la probabilidad exacta de cada total de puntos en una serie de partidos si solo contaran las cuotas. Se parte de una distribución «0 puntos con certeza» y, partido a partido, se combina con los tres resultados posibles: 0 puntos (derrota), 1 punto (empate), 3 puntos (victoria), cada uno con su probabilidad. Sin sorteos aleatorios: el resultado es exacto.

El **p-valor bilateral de una distribución discreta** se define siempre de la misma manera:

p = 2 × min( P(X ≤ observado), P(X ≥ observado) ), con un máximo de 1

En el análisis (Python), las probabilidades proceden de una simulación, con la corrección habitual «+1» ((k + 1) / (n + 1)); en el sitio se calculan de forma exacta. Cuanto menor es p, más raro es el total real a la luz de las cuotas. En el Explorador y en el comparador, p **no** se corrige por comparaciones múltiples: se expresa como «habitual» (p ≥ 0,10), «poco habitual» (0,01 ≤ p < 0,10) o «raro» (p < 0,01).

## Pruebas árbitro × club

Cada pareja árbitro × club con al menos 5 partidos se somete a cinco medidas (1.325 parejas, todos los clubes):

- **Puntos − esperados**: la serie de partidos se repite miles de veces sorteando cada resultado según las cuotas; el p-valor es la frecuencia con la que el azar por sí solo produce una desviación al menos igual de grande.

- **Saldos de penaltis, rojas, amarillas y faltas** (permutación estratificada): se comparan los partidos de la pareja con los demás partidos del mismo club en la misma temporada dirigidos por otros árbitros, redistribuyendo al azar los partidos entre árbitros.

Por debajo de 15 partidos, la pareja se marca como «muestra pequeña». Por debajo de 5 partidos no se prueba: etiqueta «descriptivo». Existe una página propia a partir de 3 partidos.

## Corrección de Benjamini-Hochberg

Con cientos de comparaciones, alrededor del 5 % da p < 0,05 por puro azar. La corrección de Benjamini-Hochberg ordena los p-valores y los ajusta al número de pruebas: se obtiene un **q-valor**. Solo se habla de desviación notable («favorable al club» o «desfavorable al club») si q < 0,05; así la proporción esperada de falsas alarmas se mantiene por debajo del 5 %. En caso contrario: «no concluyente».

Las **familias** de pruebas corregidas conjuntamente:

- **Árbitro × club**: una familia **por medida** (puntos, penaltis, rojas, amarillas, faltas), cada una sobre todas las parejas de todos los clubes con al menos 5 partidos (1.325 parejas; algo menos para las faltas, no disponibles antes de 2005-06).

- **Designaciones**: una familia (2.094 parejas).

- **Partidos importantes**: una familia (1.297 combinaciones).

- **Diferencias en diferencias del estudio**: una familia (18 pruebas).

El recuento de «resultados notables» suma los q < 0,05 de todas las familias árbitro × club.

## ¿Por qué tantos «no concluyente»?

### ¿Por qué tantos «no concluyente»?

Una pareja árbitro × club tiene una mediana de 11 partidos (244 parejas de 1.325 tienen al menos 20). Con tan pocos partidos, el azar pesa mucho: la desviación típica de los puntos de un club es de unos 1,18 puntos por partido.

Desviación detectable (puntos por partido, potencia del 80 %)

| Partidos | Sin corrección | Tras la corrección |
| --- | --- | --- |
| 10 | ±1,05 | ±1,65 |
| 25 | ±0,66 | ±1,04 |
| 50 | ±0,47 | ±0,74 |
| 100 | ±0,33 | ±0,52 |

Porcentaje de pruebas con p < 0,05 antes de la corrección (el azar por sí solo da alrededor del 5 %)

| Medida | p < 0,05 |
| --- | --- |
| Puntos − esperados | 3,5 % |
| Saldo de penaltis | 2,9 % |
| Saldo de rojas | 3,5 % |
| Saldo de amarillas | 4,7 % |
| Saldo de faltas | 5,1 % |

Por tanto, «no concluyente» no significa «ningún efecto»: pareja a pareja solo se podían detectar desviaciones grandes. Los análisis por periodo (antes / durante / después) agrupan cientos de partidos y son mucho más sensibles.

## Ajuste por fuerza

Un club dominante obtiene más penaltis y recibe menos tarjetas porque domina, no necesariamente por el árbitro. Por eso cada partido se compara con la media de la Liga para partidos de la misma fuerza según las cuotas (deciles), de la misma temporada y en el mismo campo (local o visitante). Un valor positivo es favorable al club.

## Diferencia en diferencias

Se mide la evolución de un club entre dos periodos y se le resta la evolución de un grupo de comparación en los mismos periodos: (A₁ − A₂) − (B₁ − B₂). El intervalo de confianza al 95 % procede de un bootstrap por bloques club-temporada (se remuestrean temporadas completas de clubes, para respetar la dependencia entre partidos de una misma temporada). En el estudio, q = corrección de Benjamini-Hochberg sobre las 18 pruebas. El [comparador](https://elcolegiado.com/es/comparar/) repite este cálculo en el navegador para cualquier club y cualquier grupo de control, con 2.000 extracciones y una semilla fija.

## Frecuencia de designación

Número esperado de partidos de un árbitro con un club = su proporción de partidos de Liga en cada temporada (entre los partidos que puede dirigir: nunca un club de su región) × partidos del club. Prueba de Poisson, corrección de Benjamini-Hochberg.

## Partidos importantes

Un partido es «importante» para un club si el rival terminó entre los **cuatro primeros** de la clasificación final de la temporada (clasificación recalculada: puntos, enfrentamientos directos, diferencia de goles, goles marcados), además del **Clásico** para el Barça y el Real Madrid. Periodo: 2000-01 → 2025-26 (árbitros conocidos para todos los partidos). Para cada club y cada árbitro (al menos 5 partidos), se compara la proporción de partidos importantes que dirigió con la de los demás árbitros: prueba exacta de Fisher y corrección de Benjamini-Hochberg.

## Archivo 1990-91 → 1999-00

**Fuentes**: resultados y clasificaciones finales de las páginas de temporada de es.wikipedia (completos); árbitro, fecha, penaltis y tarjetas de las páginas de temporada de los clubes en en.wikipedia, cuando los indican (CC BY-SA 4.0).

**Cobertura**: árbitro conocido en 1.112 de 3.964 partidos; esta cobertura es parcial y depende de los clubes y de los colaboradores de Wikipedia, por lo que **no es aleatoria**. Victoria a 2 puntos hasta la temporada anterior a 1995-96.

**Nombres de árbitros**: consolidación prudente de las variantes de escritura: ante la duda, dos grafías se mantienen separadas en lugar de fusionarse por error; pueden subsistir algunos duplicados.

**Por qué no hay análisis**: no existen cuotas de casas de apuestas para estas temporadas, por lo que no hay puntos esperados, y los datos arbitrales son incompletos y no aleatorios. Se construyó un modelo **Elo** (puntos esperados calculados solo a partir de resultados pasados) y se contrastó con las cuotas en 2000-01 → 2025-26; sus puntos esperados se desvían varios puntos por club y temporada de los derivados de las cuotas, así que se descartó como referencia (véase `scripts/09_elo.py`). Las páginas del archivo son, por tanto, puramente descriptivas: ni pruebas ni veredictos.

## Limitaciones

- Las cuotas reflejan lo que sabía el mercado: si las casas de apuestas conocieran e incorporaran un sesgo, la desviación respecto a las cuotas lo subestimaría.

- Media del mercado previa al partido en lugar de cuotas de cierre, margen eliminado proporcionalmente (sin método de Shin): posible ligero sesgo favorito-sorpresa.

- Solo Liga: no se cubren la Copa del Rey ni las competiciones europeas.

- Tarjetas y faltas dependen del estilo de juego (posesión, presión), que el ajuste basado en las cuotas no recoge.

- El fin de los pagos y el VAR coinciden (2018-19); partidos a puerta cerrada en 2019-20 y 2020-21.

- Tarjetas amarillas: las dos fuentes coinciden en el 85-88 % de los partidos; una serie de una sola fuente sirve de control.

- Las clasificaciones finales mostradas se recalculan a partir de los partidos (puntos, enfrentamientos directos, diferencia de goles, goles marcados); prevalece el título oficial.

- Estas pruebas se refieren a resultados agregados. No dicen nada de una decisión concreta en un partido, y una desviación estadística no es una prueba.
