NEW
Font size
WorksheetsКластерный анализ на Python
Total questions: 33
Worksheet time: 1hrs 6mins
Что такое кластерный анализ?
Метод машинного обучения для классификации
Метод группировки данных на основе их схожести
Метод для предсказания значений целевой переменной
Метод фильтрации данных
Какая основная цель кластерного анализа?
Уменьшение размерности данных
Упорядочивание данных в хронологическом порядке
Разделение объектов на группы с похожими характеристиками
Построение предсказательной модели
Как называется группа объектов, объединенных по схожести?
Класс
Кластер
Группа данных
Сегмент
В каком случае можно использовать кластеризацию?
Для предсказания цены квартиры
Для сегментации клиентов по их поведению
Для распознавания текста
Для нахождения зависимостей между двумя переменными
Какой из следующих алгоритмов относится к кластеризации?
Линейная регрессия
K-средних (K-means)
Дерево решений
Метод главных компонент (PCA)
Как работает алгоритм K-means?
Делает случайные прогнозы
Использует древовидную структуру для разбиения данных
Ищет центры кластеров и группирует точки вокруг них
Строит линейные зависимости между переменными
Какой параметр нужно задать перед запуском алгоритма K-means?
Количество деревьев в модели
Количество кластеров
Количество эпох обучения
Скорость обучения
Что делает DBSCAN лучше K-means?
Может работать с шумовыми данными
Работает быстрее на больших данных
Гарантиру
Что делает DBSCAN лучше K-means?
Может работать с шумовыми данными
Работает быстрее на больших данных
Гарантирует равномерное распределение кластеров
Всегда находит оптимальное число кластеров
Какой алгоритм кластеризации строит древовидную структуру?
K-means
DBSCAN
Иерархическая кластеризация
Линейная регрессия
В чем отличие DBSCAN от K-means?
DBSCAN требует заранее заданного числа кластеров
DBSCAN определяет кластеры на основе плотности данных
DBSCAN работает только с двумерными данными
DBSCAN быстрее K-means во всех случаях
Какой модуль Python используется для кластеризации?
tensorflow
pandas
sklearn
keras
Какой метод вызывается для обучения модели K-means?
.predict()
.fit()
.train()
.classify()
Как получить метки кластеров после работы K-means?
.labels_
.predict(X)
.transform(X)
.fit_transform(X)
Как можно визуализировать результаты кластеризации?
Использовать matplotlib для построения графика
Вывести print(labels)
Посчитать среднее значение меток кластеров
Применить pandas.DataFrame.describe()
Как задать количество кластеров для K-means?
KMeans(num_clusters=3)
KMeans(n_clusters=3)
KMeans(clusters=3)
KMeans(set_clusters=3)
Что показывает силуэтный коэффициент?
Насколько хорошо данные сгруппированы
Насколько быстро работает алгоритм
Насколько большая выборка данных
На
Что показывает силуэтный коэффициент?
Насколько хорошо данные сгруппированы
Насколько быстро работает алгоритм
Насколько большая выборка данных
Насколько хорошо работает нейросеть
Как выбрать оптимальное число кластеров в K-means?
Использовать метод локтя
Выбирать случайное число
Использовать логистическую регрессию
Оптимизировать с помощью градиентного спуска
Какие данные плохо подходят для K-means?
Данные с разными плотностями кластеров
Данные с четко выраженными группами
Данные с нормальным распределением
Данные, где кластеры круглые
Какой метод используется для оценки кластеризации без "истинных" меток?
Accuracy
Silhouette Score
Mean Squared Error
ROC-AUC
Какая функция помогает строить дендрограмму?
matplotlib.plot()
seaborn.clustermap()
scipy.cluster.hierarchy.dendrogram()
numpy.hierarchy()
Где можно применять кластерный анализ?
В анализе ДНК
В рекомендациях товаров
В поиске аномалий
Во всех перечисленных случаях
Почему K-means плохо работает с выбросами?
Центры кластеров сильно сдвигаются в сторону выбросов
Алгоритм работает слишком медленно
Алгоритм не умеет разделять данные
Алгоритм создает слишком много кластеров
Что делать, если результаты кластеризации K-means нестабильны?
Запустить алгоритм несколько раз с разными начальными условиями
Уменьшить количество кластеров
Добав
Что делать, если результаты кластеризации K-means нестабильны?
Запустить алгоритм несколько раз с разными начальными условиями
Уменьшить количество кластеров
Добавить больше данных
Переключиться на нейросети
Какой алгоритм можно использовать для кластеризации клиентов интернет-магазина?
K-means
Линейная регрессия
Random Forest
Naïve Bayes
Как можно ускорить работу K-means?
Уменьшить число кластеров
Увеличить размер выборки
Использовать метод MiniBatchKMeans
Запускать алгоритм больше раз
Почему важно нормализовать данные перед кластеризацией?
Чтобы избежать влияния масштабов признаков
Чтобы ускорить вычисления
Чтобы уменьшить число кластеров
Чтобы улучшить визуализацию
Можно ли использовать кластеризацию для выявления мошеннических операций?
Да
Нет
Какой алгоритм лучше для работы с шумными данными?
K-means
DBSCAN
Иерархическая кластеризация
Линейная регрессия
Как определить количество кластеров без метода локтя?
Использовать силуэтный коэффициент
Использовать DBSCAN
Применить логистическую регрессию
Всегда ставить k=5
В каком случае иерархическая кластеризация лучше K-means?
Когда число кластеров неизвестно заранее
Когда данных очень много
Когда данные линейно зависимы
Когда кластеры пересекаются
