Introducción y modelo vectorial: K-Means vs K-Means++

¿Qué problema aborda el trabajo de investigación?

Toca para voltear
1 / 5(10 total)

Apuntes

Evaluación del algoritmo K-Means en la asignación de centroides: Desarrollo de un prototipo simulador. Osvaldo Spositto, Julio Bossero, Viviana Ledesma, Lorena Matteo, Sebastián Quevedo. Departamento de Ingeniería e Investigaciones Tecnológicas Universidad Nacional de La Matanza spositto@unlam.edu.ar, jbossero@unlam.edu.ar, vledesma@unlam.edu.ar, lmatteo@unlam.edu.ar, jquevedo@unlam.edu.ar. RESUMEN El presente trabajo de investigación se centra en un estudio comparativo de la calidad del agrupamiento obtenido por el algoritmo K-Means respecto a una extensión de este mismo, conocido como K-Means ++ . El trabajo se basa en la resolución del problema que implica segmentar un corpus voluminoso. Aplicar este método ayuda a agrupar documentos similares en conjuntos, o clústers, para facilitar la organización y exploración eficiente de los mismos. Para poder comparar los algoritmos, se desarrolló un prototipo simulador en lenguaje C# que, configurando diferentes parámetros, genera un modelo vectorial. Este modelo se basa en matrices que representan la relación entre términos y documentos, donde cada posición de la matriz (i, j), representa el valor de la frecuencia con la que el término j...

Estudia con juegos interactivos

Sube tus apuntes y genera flashcards, examenes y mas con IA

Empezar gratis