WorksheetsHO - 35 Cuestionario sobre Clustering y K-Means
Total questions: 20
Worksheet time: 3mins
¿Qué librería se usa en Python para la manipulación de datos en DataFrames?
matplotlib
seaborn
pandas
numpy
¿Cuál es la función principal del StandardScaler en el preprocesamiento?
Crear clusters
Normalizar datos
Eliminar filas vacías
Graficar resultados
¿Qué mide la “inercia” en el método del codo?
La media de los datos
La suma de distancias cuadradas a los centroides
El tamaño de cada cluster
La desviación estándar
¿Cuál es el objetivo del método del codo?
Escoger el dataset
Determinar el número óptimo de clusters
Visualizar los resultados
Normalizar las variables
¿Qué dataset se utiliza en el ejemplo inicial del documento?
Iris.csv
Customers.csv
Mall_Customers.csv
Bank_Customers.csv
¿Cuántos clusters se seleccionaron en el ejemplo con el método del codo?
2
3
5
7
¿Qué color representa el Cluster 0 en la visualización?
Verde
Azul
Rojo
Naranja
¿Qué caracteriza al Cluster 1 (verde)?
Ingresos altos y bajo gasto
Ingresos bajos y alto gasto
Ingresos bajos y bajo gasto
Ingresos altos y alto gasto
¿Qué grupo representa a clientes con ingresos altos pero bajo gasto?
Cluster 0
Cluster 2
Cluster 3
Cluster 4
¿Qué clientes se consideran ideales para campañas premium?
Cluster 1
Cluster 2
Cluster 3
Cluster 4
¿Qué significa que los centroides estén representados con “X” negras en la gráfica?
Valores máximos
Puntos atípicos
Promedio de cada grupo
Datos sin cluster
¿Qué tipo de estrategia sería más adecuada para el Cluster 4 (naranja)?
Productos premium
Ofertas de bajo costo
Campañas de lujo
Publicidad masiva
¿Qué variable representa el ingreso anual en el dataset?
Annual Income (k$)
Spending Score (1-100)
Purchases
Balance
¿Qué librería se utiliza en Python para aplicar el algoritmo K-Means?
sklearn.cluster
keras
tensorflow
pytorch
¿Cuál es el rango del Spending Score en el dataset?
0 a 50
0 a 200
1 a 100
1 a 1000
¿Qué se busca lograr al escalar las variables?
Aumentar los ingresos
Dar igual importancia a todas las variables
Eliminar datos duplicados
Cambiar los nombres de columnas
¿Qué cluster describe a los clientes estándar con hábitos de gasto promedio?
Cluster 0
Cluster 1
Cluster 2
Cluster 3
¿Qué grupo muestra clientes con ingresos bajos y gasto bajo?
Cluster 1
Cluster 2
Cluster 3
Cluster 4
¿Qué técnica se utiliza para visualizar la disminución de la inercia con los clusters?
Histograma
Método del Codo
Diagrama de caja
Regresión lineal
¿Qué análisis se pide en la evaluación final del documento?
Predicción con regresión
Clustering con K-Means sobre Balance y Purchases
Clasificación con redes neuronales
Árboles de decisión
