EDGE

El terminal

La familia entera de cortes —banda de cuota, umbral y referencia— medida sobre el mismo histórico: 360 celdas sobre 990,085 cotizaciones de 47,462 partidos.

Una rejilla de resultados sobre el mismo histórico invita al sobreajuste. Quien se queda con la mejor celda de 360 no está eligiendo un método: está eligiendo el ruido que más le ayudó. Con 64 contrastes al 5%, cerca de 3.2 celdas salen «significativas» aunque no haya absolutamente nada que encontrar. Esta página está construida para enseñar cuánto cuesta eso, no para esconderlo.
−11.96 pts

es lo que se evapora entre la mejor celda de la tabla y esa misma elección hecha sin haber visto el resultado. La primera rindió +9.88%; la segunda, −2.08%, con un intervalo que cruza cero.

1,450 apuestas de 1,242 partidos · error agrupado por partido

Las dos mitades de la misma pregunta

Viendo el resultado es la mejor celda de la rejilla elegida después de saber cómo salió cada una. Sin verlo es la regla de validación temporal del motor aplicada a la elección de celda: cada temporada se escoge con las anteriores y se mide sobre la siguiente, igual que el modelo elige sus parámetros sin mirar la temporada que va a predecir.

Cómo se eligióApuestasPartidos RendimientoIntervalo 95%t ¿Cruza cero?
Por rendimiento, viendo el resultado552528+9.88%+0.49% a +19.27%+2.06no
Por rendimiento, sin verlo1,4501,242−2.08%−13.40% a +9.24%−0.36sí
Por t, viendo el resultado806744+9.15%+3.84% a +14.45%+3.38no
Por t, sin verlo1,127985+5.75%+0.40% a +11.10%+2.11no

Las dos últimas filas usan el otro criterio: ordenar por t en vez de por rendimiento. Se publican las dos porque enseñar sólo la que sale mejor sería la misma selección a posteriori un piso más arriba. La de t aguanta —+5.75%, t = +2.11— sobre 1,127 apuestas repartidas en 14 temporadas, que son 80 por temporada: muy por debajo de las 300 con las que el resultado de una ventana deja de ser un volado. Es una señal débil medida con cuidado, no un método.

La corrección por multiplicidad

Medir cien cosas y quedarse con la que salió significativa es cómo se fabrica un hallazgo que no existe. La defensa conocida es corregir el umbral por cuántos contrastes se hicieron, y aquí se hacen los dos: Benjamini-Hochberg, que controla qué proporción de los que uno declara son falsos, y Bonferroni, que reparte el 5% entre todos los contrastes.

Sobre las celdas de esta rejillaCeldas
Combinaciones calculadas360
Llegan al mínimo de muestra y se pueden presentar 64
Se esperarían «significativas» por azar, sin corregir 3.2
Sobreviven Benjamini-Hochberg4
Sobreviven Bonferroni3

Bonferroni supone que los contrastes son independientes y aquí no lo son: la celda del umbral 1% contiene a la del 1.5%. Eso la vuelve conservadora, así que una celda que la sobrevive lo hace con holgura.

El mínimo de muestra, y por qué viene puesto

Quita el filtro de abajo y la tabla se encabeza con Total de goles · sharp_book · < 1.80 · umbral 4.0%: un +80.00% sobre 1 apuesta de 1 partido. Es aritméticamente correcto y no significa nada.

Por eso ninguna celda por debajo de 300 apuestas o 5 partidos entra en la ordenación ni en el recuento de contrastes. Siguen apareciendo en la tabla, apagadas y con el motivo al lado: esconderlas haría creer que esa combinación no se probó.

La rejilla

Intervalo 95% ¿Cruza cero? BH Bonferroni

Qué significa cada columna

Cómo está medida cada celda

Nada de esta página dice qué apostar. Dice qué habría rendido cada corte sobre un histórico europeo ya jugado, con su intervalo y con lo que cuesta elegir mirando el resultado. Una temporada son ochenta y tantas apuestas, y con esa muestra el resultado anual de cualquiera de estas celdas es un volado. Solo para mayores de 18 años.