El terminal
La familia entera de cortes —banda de cuota, umbral y referencia— medida sobre el mismo histórico: 360 celdas sobre 990,085 cotizaciones de 47,462 partidos.
es lo que se evapora entre la mejor celda de la tabla y esa misma elección hecha sin haber visto el resultado. La primera rindió +9.88%; la segunda, −2.08%, con un intervalo que cruza cero.
1,450 apuestas de 1,242 partidos · error agrupado por partido
Las dos mitades de la misma pregunta
Viendo el resultado es la mejor celda de la rejilla elegida después de saber cómo salió cada una. Sin verlo es la regla de validación temporal del motor aplicada a la elección de celda: cada temporada se escoge con las anteriores y se mide sobre la siguiente, igual que el modelo elige sus parámetros sin mirar la temporada que va a predecir.
| Cómo se eligió | Apuestas | Partidos | Rendimiento | Intervalo 95% | t | ¿Cruza cero? |
|---|---|---|---|---|---|---|
| Por rendimiento, viendo el resultado | 552 | 528 | +9.88% | +0.49% a +19.27% | +2.06 | no |
| Por rendimiento, sin verlo | 1,450 | 1,242 | −2.08% | −13.40% a +9.24% | −0.36 | sí |
| Por t, viendo el resultado | 806 | 744 | +9.15% | +3.84% a +14.45% | +3.38 | no |
| Por t, sin verlo | 1,127 | 985 | +5.75% | +0.40% a +11.10% | +2.11 | no |
Las dos últimas filas usan el otro criterio: ordenar por t en vez de por rendimiento. Se publican las dos porque enseñar sólo la que sale mejor sería la misma selección a posteriori un piso más arriba. La de t aguanta —+5.75%, t = +2.11— sobre 1,127 apuestas repartidas en 14 temporadas, que son 80 por temporada: muy por debajo de las 300 con las que el resultado de una ventana deja de ser un volado. Es una señal débil medida con cuidado, no un método.
La corrección por multiplicidad
Medir cien cosas y quedarse con la que salió significativa es cómo se fabrica un hallazgo que no existe. La defensa conocida es corregir el umbral por cuántos contrastes se hicieron, y aquí se hacen los dos: Benjamini-Hochberg, que controla qué proporción de los que uno declara son falsos, y Bonferroni, que reparte el 5% entre todos los contrastes.
| Sobre las celdas de esta rejilla | Celdas |
|---|---|
| Combinaciones calculadas | 360 |
| Llegan al mínimo de muestra y se pueden presentar | 64 |
| Se esperarían «significativas» por azar, sin corregir | 3.2 |
| Sobreviven Benjamini-Hochberg | 4 |
| Sobreviven Bonferroni | 3 |
Bonferroni supone que los contrastes son independientes y aquí no lo son: la celda del umbral 1% contiene a la del 1.5%. Eso la vuelve conservadora, así que una celda que la sobrevive lo hace con holgura.
El mínimo de muestra, y por qué viene puesto
Quita el filtro de abajo y la tabla se encabeza con Total de goles · sharp_book · < 1.80 · umbral 4.0%: un +80.00% sobre 1 apuesta de 1 partido. Es aritméticamente correcto y no significa nada.
Por eso ninguna celda por debajo de 300 apuestas o 5 partidos entra en la ordenación ni en el recuento de contrastes. Siguen apareciendo en la tabla, apagadas y con el motivo al lado: esconderlas haría creer que esa combinación no se probó.
La rejilla
| Intervalo 95% | ¿Cruza cero? | BH | Bonferroni |
|---|
Qué significa cada columna
- Referencia — contra qué se mide la desviación de la casa.
Las dos son las que declara el catálogo de estrategias del motor:
peer_consensus— consenso de las demás casas, excluyéndola a ella y a los agregadossharp_book— casa más afilada disponible según anchor_priority del catálogo
- Umbral — cuánto tiene que separarse el precio de la referencia para que una apuesta entre en la celda.
- Intervalo 95% — con el error agrupado por partido. Las filas de un mismo partido no son apuestas independientes: comparten resultado, y contarlas como separadas estrecha el intervalo por la raíz del número de casas.
- ¿Cruza cero? — si el intervalo contiene el cero, la celda es compatible con no tener efecto ninguno. Se dice siempre, también cuando incomoda.
- BH y Bonferroni — si la celda sobrevive la corrección por multiplicidad sobre las 64 que se contrastan.
Cómo está medida cada celda
- La rejilla no ajusta ningún modelo. La desviación es aritmética sobre precios: cuota por la probabilidad de la referencia, menos uno. Lo que sí se valida hacia adelante es la elección de celda, que es la única decisión con riesgo de mirar el futuro.
- Un solo método para quitar el margen en todo el proyecto. Dos métodos sobre el mismo precio dan probabilidades distintas.
- Error agrupado por partido en las 360 celdas, sin excepción.
- La tabla se calcula en el motor, no en tu navegador. Un backtest que corre en el cliente produce un número que nadie puede volver a reproducir; éste sale de un artefacto que tiene su prueba al lado.