Uno de los problemas que se nos presentó, fue la falta de tiempo. Esta área de análisis es tan grande que podemos sacar mucha información de muchas partes. Y la falta de tiempo fue una de nuestras limitaciones para no extender nuestro trabajo. En nuestras ideas principales queriamos aprovechar la presencia de datos geograficos y utilizarlos para graficar y visualizar de mejor manera las comunas o regiones sobre el tema objetivo a analizar.
Otro poblema que se presentó durante el desarrollo fue el cambio de escala de las pruebas, lo cual nosotros tuvimos que escalar esos puntajes para poder comparar entre los puntajes de la PSU, PDT y PAES.
Cada proceso tiene alrededor de 250000-300000 datos distintos, en nuestro proyecto trabajamos con todos lo procesos desde el año 2004 hasta el 2025. Son 21 procesos lo que da un aproximado de 5.5 millones de datos. Lo cual hace que la carga de estos .csv se hace muy tardado. Para solucionarlo subimos todos estos archivos de los procesos a un google drive.
Una posible extension a nuestro proyecto, es el vinculo con más datasets relacionadas a temas similares. En algún momento se nos ocurrio unir con el tema de IVM o con los resultados de los sinces. Posibles datos que puedan ayudar a predecir como se comportaran los puntajes.