Tracks
/
Julia
Julia
/
Temario
/
Estadística
Es

Estadística en Julia

{one: "1 ejercicio", many: "%{count} ejercicios", other: "%{count} ejercicios"}

Acerca de Estadística

«Estadística» es un tema amplio y complejo con muchos aspectos.

Algunos aspectos se trataron en el concepto Randomness, que es un tema aparte pero relacionado.

En su forma más simple, la estadística puede consistir en formas de resumir una colección iterable de datos en un único valor. A quienes se acercan a Julia por primera vez puede sorprenderles lo pocas funciones que trae el lenguaje de serie:

  • sum, para sumar números.
  • min y max, para obtener los valores extremos de los parámetros dados.
  • extrema, para obtener la tupla (min, max) de un iterable.
  • length, para contar todos los valores.
  • count, para contar solo los valores que cumplen algún criterio.
julia> v = collect(1:0.2:3)
11-element Vector{Float64}:
 1.0
 1.2
 ... # display truncated
 3.0

julia> mean(v)
2.0

julia> extrema(v)
(1.0, 3.0)

julia> length(v)
11

julia> min('g', 'a', 'c')
'a': ASCII/Unicode U+0061 (category Ll: Letter, lowercase)

julia> count(isodd, 1:5)  # 1, 3, and 5 are odd
3

Este conjunto limitado de funciones es una decisión deliberada para minimizar el tamaño de la base de Julia, trasladando otras funciones a una cascada de módulos y paquetes adicionales.

El módulo Statistics

Como forma parte de la biblioteca estándar, es probable que Statistics ya esté preinstalado, así que basta con añadir using Statistics al principio del programa para traerlo al espacio de nombres.

Este módulo contiene el siguiente nivel de funciones comunes, que probablemente sean muy usadas por un subconjunto de programadores.

Muchas de las funciones de Statistics dan por supuesto ciertos conocimientos previos del tema. Los ejemplos más sencillos son:

  • mean, que mucha gente llamaría el promedio (el mismo resultado que sum / length).
  • median, el valor central tras ordenar.
  • std, desviación típica: una medida de cuánto se dispersan los valores.
  • var, varianza: el cuadrado de std, que normalmente es más rápido de calcular.

Cada función suele tener varias opciones, y hay muchas más funciones, así que consulta la documentación si te interesa.

Otros paquetes

Como puedes imaginar, la estadística es uno de los grandes usos de Julia, y hay muchos paquetes disponibles que sirven de apoyo para trabajos más especializados.

El grupo JuliaStats mantiene una útil lista en línea.

Editar en GitHub El enlace se abre en una nueva ventana o pestaña