Skip to content

Latest commit

 

History

History
23 lines (15 loc) · 1.58 KB

File metadata and controls

23 lines (15 loc) · 1.58 KB

Nombre del Postwork: Introducción a la visualización de datos: Distribuciones

OBJETIVO

  • Utilizar boxplots para visualizar distribuciones
  • Filtrar valores atípicos usando el Score de Rango Intercuartílico
  • Caracterizar nuestras distribuciones usando tablas de frecuencias, histogramas y gráficas de densidad

REQUISITOS

  • Tener un dataset limpio
  • Tener una serie de preguntas que queremos contestar usando nuestro dataset

DESARROLLO

En este Postwork vamos a explorar las distribuciones de las variables numéricas que tengamos en nuestro dataset. Realiza los siguientes procesos en los casos en los que tenga sentido aplicarlos:

  • Utiliza boxplots para analizar la distribución de tus variables numéricas. Piensa acerca de cuáles son los valores típicos y atípicos y dónde están concentrados el grueso de tus datos.
  • Utiliza el Score de Rango Intercuartílico para filtrar tus valores atípicos. Compara tus medianas, medias y desviaciones estándares antes y después de realizar la filtración y ve cuánto cambiaron.
  • Utiliza tablas de frecuencia e histogramas para observar la distribución de tus variables. Caracteriza cada una de las distribuciones usando los términos que aprendiste durante la sesión. Obtén medidas de asimetría y curtosis para ver qué tan alejadas de la distribución normal están tus variables.
  • Utiliza gráficas de densidad para comparar una variable numérica que pueda ser segmentada en dos o más categorías. Usa esta técnica para entender mejor cómo están distribuidos tus datos en cada uno de los grupos presentes.

¡Mucha suerte!