Definición
La probabilidad, calculada bajo la suposición de que la hipótesis nula es verdadera, de obtener una estadística de prueba al menos tan extrema como la observada; se usa como medida para evaluar cuán incompatibles son los datos con el modelo nulo.

Principio

Principio
El valor p cuantifica la evidencia contra la nula ubicando la estadística observada dentro de la distribución nula: valores p más pequeños indican resultados más raros bajo la nula, pero no dan directamente la probabilidad de que la nula sea verdadera.

Demostración

Demostración
Una comparación clínica A/B arroja p=0,03 para la diferencia en tasas de conversión; esto sugiere que, si la nula (sin diferencia) fuera cierta, observar un efecto tan extremo ocurriría aproximadamente el 3 % de las veces bajo el modelo de muestreo usado.

Aplicación incorrecta

Aplicación incorrecta
Interpretar el valor p como la probabilidad de que la hipótesis nula sea verdadera, tratar p<0,05 como prueba binaria de importancia práctica, o hurgar en los datos hasta que aparezca un p pequeño sin ajustar por multiplicidad.

Consecuencia

Consecuencia
Una interpretación apropiada ayuda a ponderar la evidencia y guiar decisiones junto con tamaños de efecto e intervalos de confianza; el uso indebido puede conducir a afirmaciones exageradas, sesgo de publicación y hallazgos irreproducibles.

Inversión

Inversión
Invertir el énfasis utiliza razones de verosimilitud, factores de Bayes o probabilidades posteriores para expresar evidencia e incertidumbre; estas alternativas proporcionan escalas distintas y requieren priors o modelos alternativos explícitos.

Límite

Límite
Válido como medida de teoría muestral bajo la nula y la estadística de prueba especificadas; no es medida de importancia clínica o económica, no es una regla de decisión independiente sin contexto y es poco fiable cuando fallan las suposiciones del modelo (independencia, forma de la distribución).

Tensión semántica

Tensión semántica
Los valores p compiten con otras medidas de evidencia (intervalos de confianza, tamaños de efecto, posteriors bayesianos); la tensión surge porque el valor p condensa la extremidad muestral en un solo número que puede ocultar magnitud e incertidumbre.

Síntesis

Síntesis
Un Valor p es un índice de teoría muestral sobre cuán extremos son los datos observados bajo un modelo nulo; es útil para evaluar compatibilidad con la nula pero debe interpretarse junto con el tamaño del efecto, el diseño y las suposiciones.