TY - GEN AU - Molina,Roberto Pedro AU - Hasperué,Waldo TI - D3CAS: un algoritmo de clustering para el procesamiento de flujos de datos en spark KW - ALGORITMOS KW - FLUJO DE DATOS KW - PROCESAMIENTO DE DATOS N1 - Formato de archivo PDF. -- Este documento es producción intelectual de la Facultad de Informática - UNLP (Colección BIPA/Biblioteca); Congreso Argentino de Ciencias de la Computación (24to : 2018 : Tandil, Argentina) N2 - En este trabajo se presenta una prueba de concepto de un algoritmo de clustering basado en densidad, denominado D3CAS, el cual fue implementado para ser ejecutado bajo el framework Spark Streaming y que permite el procesamiento de flujos de datos. La principal característica del algoritmo presentado es que es dinámico, es decir selecciona automáticamente el número de clusters del flujo de datos. El algoritmo fue probado datasets de CLUTO, midiendo la calidad de los clusters obtenidos. Los resultados, obtenidos en un ambiente virtualizado, fueron comparados con otro algoritmo de clustering (CluStream), demostrando que D3CAS arroja mejores resultados ER -