Anexo: Datasets del Repositorio#
Este directorio está reservado para almacenar conjuntos de datos (datasets) que se consideren pequeños (estrictamente menores a 20MB) para evitar sobrecargar el repositorio y respetar los límites de GitHub.
Para datasets más grandes, el código dentro de los notebooks se encarga de descargarlos dinámicamente desde fuentes externas, según el caso (Kaggle, Google Drive, etc.).
Reglas#
Límite de tamaño: < 20MB por archivo.
Subdirectorios: Cada dataset debe estar en su propio subdirectorio con un README propio.
Documentación: Cada dataset debe incluir un breve comentario en su README, detallando su origen (referencia a la fuente original), el significado de las columnas y el contexto disponible.
Formato: Preferentemente
.csv,.parquet, o.json. Si amerita, comprimido en.zippara eficiencia en la transferencia.