Wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

ML - Tema 8 - Clustering_1

Total questions: 9

Worksheet time: 7mins

Name
Class
Date
1.

¿Para cuales de las siguientes tareas los algortimos de clustering podrían ser adecuados?

a)

Dados los datos de ventas de de productos en un supermercado, estimar las ventas futuras de cada uno de estos productos.

b)

Dada una base de datos de información sobre usuarios, agrupa a los usuarios en diferentes segmentos de mercado.

c)

Dados los registros meteorológicos históricos, predecir si el clima de mañana será soleado o lluvioso.

d)

A partir de los patrones de uso del usuario en un sitio web, identificar diferentes grupos de usuarios.

2.

Los algoritmos de clustering permiten realizar una descripción de los datos.

a)

Falso, unicamente pueden agrupar los datos en grupos os clusteres

b)

Verdadero,ya que asignan una etiqueta adicional sobre los datos (numero de cluster), describen el número de observaciones en cada clúster,....

3.

El resultado del algoritmo de k-means está especialmente influenciado por

a)

La elección de tipo de medida de distancia entre observaciones (euclídea, Manhattan,..)

b)

Las variables (Xs) que caracterizan cada observación.

c)

El número de variables categóricas

d)

Todas son ciertas

4.

La elección de k, el número de clusters para particionar un data-set

a)

es una elección personal

b)

depende del motivo de la clusterización de datos

c)

debe ser tan alto como el ordenador pueda

d)

tiene un máximo de 10

5.

¿cuales de las siguientes afirmaciones son ciertas en relacion a k-means?

a)

Para cada inicialización del cluster, los resultados son siempre los mismos.

b)

Es sensible a outliers.

c)

Los centroids pueden no ser observaciones reales.

d)

Un cluster puede tener más de un centroid.

6.

Señala las afirmación correcta.

a)

El algortimo de clustering es aprendizaje NO supervisado ya que no hay variable objetivo.

b)

El algoritmo de clustering intenta clusterizar datos diferentes en el mismo cluster

c)

El algortimo de clustering tiene numerosas aplicaciones tales como la predicción de variables categóricas.

d)

El agoritmo de clustering tiene numerosas aplicaciones tales como la predicción de variables numéricas.

7.

El tipo de medida de distancia (o similaridad) más utilizada es ...

a)

Lineal

b)

Manhattan

c)

Euclídea

d)

Correlación Pearson

8.

¿que información necesita el algoritmo K-means para inicializarse?

a)

Selección de tipo de distancia

b)

Número de clusters a generar

c)

Numero de asignaciones iniciales de centroids

d)

Todas son correctas

9.

Según el gráfico anexo, el punto con la etiqueta 3 será asignado al cluster ...

a)

... que tiene la etiqueta 14

b)

... que tiene la etiqueta 25

c)

A ninguno de los cluster

d)

A un nuevo cluster