Este repositorio contiene el trabajo realizado por el equipo "Equipo" para el Data Challenge 2024. A continuación se describen los archivos y el flujo de trabajo seguido para la visualización de datos.
En el drive se puede acceder al video que explica el proyecto por medio de Storytelling de los datos.
-
adjudicaciones.csv y procedimientos.csv: Estos archivos contienen los datos crudos utilizados para el análisis. Debido a su gran tamaño, no se pudieron subir directamente al repositorio. Para obtener estos archivos, por favor consultar la página https://sites.google.com/view/datachallengecostarica/datos-concurso?authuser=0.
-
lineasproc.csv: Este archivo contienen los datos crudos utilizados para el análisis más una columna calculada llamada total.
-
data.ipynb: Este notebook realiza el procesamiento de los datos contenidos en
adjudicaciones.csv,lineasproc.csvyprocedimientos.csv. El resultado de este procesamiento es el archivodf_final.csv, que ya se encuentra incluido en el repositorio. -
df_final.csv: Este archivo es el resultado del procesamiento realizado en
data.ipynb. Contiene los datos listos para ser utilizados en la generación de visualizaciones. -
gráficos.ipynb: Este notebook toma
df_final.csvcomo entrada y genera las visualizaciones que se utilizan en el video de presentación del proyecto.
-
Procesamiento de Datos: Ejecutar el notebook
data.ipynbpara procesar los datos crudos y generardf_final.csv. -
Generación de Visualizaciones: Con
df_final.csvgenerado en el paso anterior, ejecutar el notebookgráficos.ipynbpara producir las visualizaciones.
- Clonar este repositorio.
- Obtener los archivos
adjudicaciones.csvyprocedimientos.csvde la página https://sites.google.com/view/datachallengecostarica/datos-concurso?authuser=0. - Colocar los archivos en el mismo directorio que los notebooks.
- Ejecutar
data.ipynbpara generardf_final.csv. - Ejecutar
gráficos.ipynbpara generar las visualizaciones.
Equipo "Equipo" Data Challenge 2024