Cuantario dice que y «son desviaciones típicas, y como toda desviación típica no son propiedades de una medida sino de una distribución». Un contador que registra 1000 sucesos tiene una incertidumbre del 3,2 % sin haber repetido nada. El nitrógeno a 300 K tiene tres velocidades típicas —422, 476 y 517 m/s— y las tres son correctas. Y la distribución de momento que sale de una rendija de bordes duros no tiene desviación típica en absoluto. Los cuatro hechos salen de la misma operación: integrar una distribución contra una potencia.
- Cuantario I.3, artículo 02 — su caja de prerrequisitos pide, literalmente, «que Δx y Δp son desviaciones típicas de una distribución». Es el único prerrequisito puramente estadístico de todo el programa.
- Cuantario I.3, artículo 01 — define la desviación típica dentro del artículo, y menciona que con la rendija dura «el promedio de p² no converge». Esta ficha lo mide.
- Particulario I.5, artículo 04 — «el fondo fluctúa típicamente ±√B (la ley de los sucesos raros)»: invoca a Poisson por su apodo y no la explica en ninguna parte.
- Particulario III.6, artículo 03 — los cinco sigmas, su p = 3 × 10⁻⁷, y por qué con pocos sucesos hay que usar la Poisson exacta y no la gaussiana.
- Termario II.2, artículo 01 — usa la distribución de velocidades «como lo que es, una densidad de probabilidad», y es la única mención de «varianza» de todo el sitio.
- Nucleario I.1, artículo 03 — un artículo entero sobre contadores Geiger en el que no aparece ni una vez «√N»: es el hueco más flagrante de su dominio.
- Atomario I.2, artículo 03 — «el radio medio son 79,4 pm y hace falta llegar a 141 pm para encerrar el 90 % de la probabilidad»: media, mediana y moda de una misma densidad.
El panel integra la distribución elegida por Simpson sobre 4000 intervalos —o la suma término a término, si es discreta— y saca su media y su desviación típica de las integrales, no de una fórmula. Al lado va el valor cerrado cuando existe. Y la última fila compara σ medida con el corte entero y con la mitad del corte: si la varianza existe ese cociente vale 1; si no existe, vale √2. Prueba la lorentziana.
| Momento | Medido | Cerrado | Residuo |
|---|---|---|---|
| normalización ∫f | 1.000000000 | 1 exacto | 2,2 × 10⁻¹⁶ |
| ⟨x⟩ | 5,6509615 × 10⁻¹⁷ | 0 | 5,7 × 10⁻¹⁷ |
| ⟨x²⟩ | 1,0000000 | 1,0000000 | 8,5 × 10⁻¹⁴ |
| σ = √(⟨x²⟩ − ⟨x⟩²) | 1,0000000 | 1,0000000 | 4,2 × 10⁻¹⁴ |
| σ(L) / σ(L/2) | 1.000536 | 1 si la varianza existe | 5,4 × 10⁻⁴ |
Doblar el corte no mueve la desviación típica: el cociente vale 1.000536, y por eso tiene sentido decir «la σ de esta distribución» sin más. Mueve el mando de corte de 2 a 20 y comprueba que las cuatro primeras filas no se enteran — salvo en los cortes más apretados, donde falta cola por integrar y el residuo lo denuncia.
Qué es exactamente una desviación típica
Dada una densidad de probabilidad normalizada, su momento de orden es
El de orden 1 es la media. La desviación típica es la raíz del promedio del cuadrado de las desviaciones respecto de ella, y desarrollando el cuadrado sale la forma que se usa siempre:
Hay dos cosas que decir de esa definición, y las dos importan más que la fórmula. La primera es que σ es una propiedad de la distribución, no de una medida. No mide «lo mal que se ha medido algo»: mide cuánto se reparte la magnitud. Cuando la cuántica escribe , esas dos deltas son estas sigmas, calculadas sobre el estado, y para medir una hacen falta muchas copias del mismo estado medidas una a una.
La segunda es que σ es sólo una de las maneras de decir «lo típico», y no siempre la mejor. Una distribución asimétrica tiene la moda en un sitio, la mediana en otro y la media en un tercero. Atomario lo dice con números para el orbital 1s del hidrógeno: el máximo de la densidad radial está en 52,9 pm, el radio medio en 79,4 pm y hay que llegar a 141 pm para encerrar el 90 % de la probabilidad. Tres respuestas correctas a «cuánto mide un átomo».
Las tres velocidades del nitrógeno
El ejemplo canónico de que «lo típico» no es un número está en la distribución de Maxwell-Boltzmann:
Integrándola —y las tres integrales están hechas con sympy en el guion de verificación, no copiadas— salen tres cantidades distintas:
| Qué | Cómo se define | Fórmula | N₂ a 300 K |
|---|---|---|---|
| Más probable, v_p | el máximo de f | √(2kT/m) | 422,0 m/s |
| Media, v̄ | ⟨v⟩ | √(8kT/πm) | 476,2 m/s |
| Cuadrática media, v_rms | √⟨v²⟩ | √(3kT/m) | 516,8 m/s |
| Dispersión, σ_v | √(⟨v²⟩ − ⟨v⟩²) | √((3 − 8/π)kT/m) | 200,9 m/s |
Sus cocientes son universales —— y no dependen ni del gas ni de la temperatura. La cuarta fila es la que suele faltar y la que más dice: la dispersión es el 42 % de la media. Un gas no tiene «una velocidad»: tiene una campana ancha, y de su cola derecha dependen la evaporación, el escape atmosférico y toda la cinética de Arrhenius.
Por qué v_rms y no v̄ en la teoría cinética. La presión y la energía cinética media dependen de , no de , porque la energía va con el cuadrado. El flujo de moléculas que atraviesa un agujero, en cambio, depende de — ahí está el que usa Termario. La regla general: el momento que hay que usar es el que aparece en la magnitud física, y hay que mirarlo cada vez. Confundir con cuesta un 8,5 %, que es poco para equivocarse y mucho para publicarlo.
La función generatriz: todos los momentos de un tirón
Calcular los momentos uno a uno es trabajo. La función generatriz de momentos los produce todos con una sola integral y luego derivadas:
Que funcione es inmediato: desarrollando , el coeficiente de en es , así que la función generatriz es la serie de Taylor cuyos coeficientes son los momentos. Para la gaussiana sale . Y para la distribución de Poisson, que es la que gobierna cualquier recuento:
Derivando dos veces en salen y , y por tanto
En una Poisson la varianza es la media. Ésa es toda la estadística de conteo, y es de donde sale la regla que usa cualquier laboratorio del mundo: un detector que registra sucesos tiene una incertidumbre estadística de , y no hace falta repetir la medida para saberlo. La medida trae su propia barra de error dentro.
Problema. Un contador Geiger acumula sucesos. ¿Cuántos hacen falta para un 1 % de precisión? ¿Y qué cuesta pasar de ahí al 0,5 %?
Solución. El error relativo es , así que :
| Cuentas | σ = √N | Error relativo |
|---|---|---|
| 100 | 10 | 10 % |
| 1 000 | 31,6 | 3,16 % |
| 10 000 | 100 | 1 % |
| 1 000 000 | 1 000 | 0,1 % |
Resultado. Diez mil cuentas para el 1 %, y cuarenta mil para el 0,5 %: dividir el error por dos cuesta multiplicar el tiempo por cuatro. Ésa es la ley que gobierna el presupuesto de cualquier experimento — y por eso Particulario dice que pasar de 3σ a 5σ exige veces más datos, ni uno menos.
La lección de método está en el rendimiento decreciente. Las primeras cien cuentas te llevan del infinito al 10 %; las siguientes 999 900, del 10 % al 0,1 %. Cuando en un experimento la barra estadística ya es más pequeña que la sistemática, seguir contando no sirve para nada, y eso ocurre antes de lo que parece.
Cinco sigmas, y por qué la gaussiana no siempre vale
Con lo anterior se lee sin más ayuda el número más famoso de la física experimental. Si un experimento espera sucesos de fondo, ese fondo fluctúa con , así que un exceso tiene significancia . Con esperados y 500 contados, : cinco sigmas. Y la probabilidad de que el fondo solo produzca semejante exceso es la cola de la gaussiana,
una entre 3,49 millones. Con el listón de 3σ que se usa en casi todas las demás ciencias, : una entre 740. La diferencia entre los dos listones son 2,8 veces más datos.
Pero la gaussiana es una aproximación, y con pocos sucesos falla del lado peligroso. Particulario da el caso: con esperados, la probabilidad de observar 13 o más vale según la Poisson exacta y según la gaussiana equivalente — un factor ocho de diferencia, y la gaussiana es la optimista. La razón es que la cola discreta de la Poisson es mucho más gruesa que la de la campana. Regla de oficio: con pocos sucesos, cuenta sucesos. La sigma gaussiana es un idioma de traducción, no la matemática.
Cuando la varianza no existe
Toda la ficha ha supuesto que las integrales convergen. No siempre lo hacen, y ése es el contenido menos conocido y más útil de aquí. La lorentziana está perfectamente normalizada:
y sin embargo diverge: el integrando tiende a , una constante, y su integral crece sin parar. Sus colas caen como , lo bastante deprisa para que la distribución se normalice y no lo bastante para que tenga varianza.
Lo que se mide entonces depende de dónde se corte. Cortando en ,
así que : al doblar el corte, la «desviación típica» se multiplica por , y no converge nunca. El interactivo de arriba mide precisamente ese cociente y lo pone en pantalla: vale 1,000000 para la gaussiana, la Maxwell-Boltzmann y la Poisson, y tiende a 1,414214 para la lorentziana. No es una afirmación de la ficha — es una columna que cambia al arrastrar un mando.
Problema. Cuantario I.3 dice que «el estado que sale de una rendija dura tiene una distribución de momento cuyas colas caen como 1/p², y con eso el promedio de p² no converge; calculada con un corte artificial, la Δp crece como la raíz del corte». Compruébalo.
Solución. Una rendija de bordes abruptos y anchura da una función de onda rectangular, cuya transformada es una y cuya densidad de momento va como . Para grande, , así que constante y la integral crece linealmente con el corte. Numéricamente, con el corte en 400 y en 800 unidades salen σ = 11,28 y σ = 15,96, cuyo cociente es 1,4151 — el √2 predicho.
Resultado. La rendija de bordes duros, que es el experimento con el que se enseña el principio de incertidumbre en todos los libros, es justamente el estado para el que no existe. La desigualdad se cumple trivialmente, porque el miembro izquierdo es infinito.
La lección práctica no es que el argumento de la rendija sea inútil — sirve para el orden de magnitud, que es para lo que se cuenta —, sino que una cola gruesa invalida el resumen. Antes de escribir «σ» de cualquier distribución hay que preguntarse cómo caen sus colas, y si caen como una potencia baja, la respuesta correcta no es un número: es «no tiene». La anchura a media altura sí existe siempre, y por eso las rayas espectrales lorentzianas se tabulan con FWHM y nunca con σ.
Ejercicios
En el interactivo, elige la lorentziana y lleva el corte de 2 a 20 anotando σ y el cociente σ(L)/σ(L/2). Después haz lo mismo con la gaussiana. ¿Por qué el cociente de la lorentziana empieza en 1,7 y baja hacia 1,41 en vez de valer 1,41 desde el principio?
Solución
Porque es el comportamiento asintótico, no el exacto. Con la fórmula de arriba, para : en vale 0,806 y en vale 0,273, cuyo cociente de raíces es 1,72. Sólo cuando el arcotangente se queda en y aparece el limpio. La gaussiana, en cambio, da 1,000000 desde .
La segunda lección es de diagnóstico numérico. Si estimas una σ de unos datos y al ampliar el rango de integración la σ sigue creciendo, no tienes un problema de muestreo: tienes una distribución sin varianza. La prueba cuesta treinta segundos —recalcular con la mitad del rango— y ahorra publicar una barra de error inventada.
Un experimento espera 2500 sucesos de fondo y observa 2650. ¿Es un descubrimiento? ¿Cuántos datos más harían falta para que lo fuera, si la señal es real?
Solución
, , así que : tres sigmas, que en física de partículas es «evidencia», no «descubrimiento». Como la significancia crece con —tanto como escalan con la cantidad de datos, así que escala con su raíz—, llegar a 5σ pide veces más datos.
La segunda lección: ese factor 2,78 supone que toda la incertidumbre es estadística. En cuanto hay una sistemática que no baja al acumular datos, la significancia deja de crecer con la raíz y se estanca. Por eso los experimentos maduros dejan de anunciar «más datos» y empiezan a anunciar «mejor calibración»: han llegado al punto en que la raíz cuadrada ya no compra nada.
Demuestra que es siempre , y di qué distribución alcanza la igualdad.
Solución
Es inmediato desde la definición: es el promedio de , que es una cantidad no negativa, y el promedio de algo no negativo no puede ser negativo. La igualdad exige que sea cero en todos los puntos con probabilidad no nula: la distribución tiene que estar concentrada en un solo valor, es decir, ser una delta.
La segunda lección es que esa desigualdad, , es un caso particular de Cauchy-Schwarz, y ése es exactamente el ingrediente del que sale el principio de incertidumbre generalizado. Termario la usa también, sin nombrarla, para justificar que siempre — con igualdad sólo si todas las moléculas fueran a la misma velocidad, que es la delta de antes.
Lo que esta ficha deja utilizable, para volver dentro de seis meses sin releerla.
| Qué | Fórmula o valor | Dónde |
|---|---|---|
| Momento de orden n | ⟨xⁿ⟩ = ∫xⁿf(x)dx, con ∫f = 1 | §1 |
| Desviación típica | σ² = ⟨x²⟩ − ⟨x⟩²; propiedad de la DISTRIBUCIÓN, no de una medida | §1 |
| Maxwell-Boltzmann | v_p = √(2kT/m) · v̄ = √(8kT/πm) · v_rms = √(3kT/m) | §2 |
| N₂ a 300 K | 422,0 · 476,2 · 516,8 m/s; σ_v = 200,9 m/s, el 42 % de v̄ | §2 |
| Cocientes universales | 1 : 1,1284 : 1,2247, sin depender del gas ni de T | §2 |
| Función generatriz | M(t) = ⟨e^(tx)⟩; ⟨xⁿ⟩ = M⁽ⁿ⁾(0) | §3 |
| Gaussiana | M(t) = e^(mt + σ²t²/2) | §3 |
| Poisson | M(t) = e^(µ(e^t − 1)) ⟹ media = varianza = µ | §3 |
| Estadística de conteo | σ = √N; error relativo 1/√N | §3 |
| Cuánto contar | 10⁴ cuentas → 1 %; dividir el error por 2 cuesta ×4 en tiempo | ej. res. 1 |
| Significancia | S/√B; B = 400, S = 100 ⟹ 5σ | §4 |
| Los dos listones | 5σ ⟹ p = 2,87 × 10⁻⁷ (1 entre 3,49 M); 3σ ⟹ 0,135 % | §4 |
| De 3σ a 5σ | (5/3)² = 2,78 veces más datos | §4, ej. 2 |
| Trampa de la gaussiana | µ = 5,3, P(≥13): Poisson 3,3 × 10⁻³, gaussiana 4,1 × 10⁻⁴ (×8) | callout §4 |
| Lorentziana | normalizada pero SIN varianza; ⟨x²⟩_L → 2γL/π | §5 |
| La prueba de 30 segundos | σ(L)/σ(L/2) = 1 si converge, √2 = 1,4142 si no | §5 |
| Rendija dura | colas 1/p²: Δp no existe; medido, σ(800)/σ(400) = 1,4151 | ej. res. 2 |
| Qué usar entonces | anchura a media altura, que existe siempre | ej. res. 2 |
Adónde lleva esta ficha. Con esto ya puedes poner una barra de error a cualquier recuento sin repetirlo, decidir qué promedio pide una magnitud física, y detectar en treinta segundos una distribución que no admite el resumen que le estabas poniendo. Lo que falta a continuación es cuándo se puede sustituir una distribución por otra y con qué error — binomial, Poisson y gaussiana—, y el teorema central del límite que explica por qué la campana está en todas partes; las dos tienen ficha propia pendiente en esta área.
Las fichas hermanas son ST.1, donde la lorentziana aparece como transformada de una exponencial y se explica por qué sus rayas se tabulan con anchura a media altura, y CAL.4, que enseña a leer la σ escondida en una escala de decibelios. Para usarlo ya, Cuantario I.3 monta el principio de incertidumbre entero sobre estas dos sigmas, y Particulario I.5 convierte un √B en un descubrimiento.