wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

перниязова

Total questions: 59

Worksheet time: 30mins

Name
Class
Date
1.

Что из перечисленного не является этапом процесса ETL?

a)

Извлечение данных

b)

Загрузка данных

c)

Преобразование данных

2.

Какое основное отличие MapReduce 2 от MapReduce 1?

a)

Использование JobTracker

b)

Использование YARN для управления ресурсами

c)

Хранение методанных

3.

Какие данные являются примером структурированных данных?

a)

Электронные письма

b)

Sql таблицы

c)

JSON файлы

4.

Какое улучшение введено в MapReduce 2 по сравнению с MapReduce 1?

a)

Улучшенная обработка данных

b)

Разделение ресурсов и управления задачами через YARN

c)

Поддержка SQL

5.

Какие из следующих данных могут быть примером структурированных данных?

a)

JSON-файлы

b)

Таблицы базы данных SQL

c)

Логи серверов

6.

Какая из следующих функций не выполняется NameNode?

a)

Управление метаданными

b)

Мониторинг системы

c)

Хранение данных

7.

Что из перечисленного является преимуществом использования Hadoop YARN?

a)

Высокая доступность данных

b)

Более эффективное использование кластера

c)

Хранение больших объемов данных

8.

Каков основной компонент MapReduce 2, управляющий распределением задач?

a)

TaskTracker

b)

DataNode

c)

ResourceManager

9.

В чем преимущество Apache Spark по сравнению с Hadoop?

a)

Лучшая совместимость с SQL

b)

Более легкая установка

c)

Более высокая скорость обработки данных

10.

Что означает термин "кластеризация данных"?

a)

Разделение данных на группы по схожим признакам

b)

Кэширование данных

c)

Оптимизация хранения данных

11.

Какое преимущество предлагает использование машинного обучения в анализе Больших данных?

a)

Создание SQL-запросов

b)

Обеспечение отказоустойчивости

c)

Автоматизация обработки данных и извлечение скрытых паттернов

12.

Какая из перечисленных технологий чаще всего используется для анализа Больших данных?

a)

MapReduce

b)

Apache Spark

c)

Hadoop HDFS

13.

Что обычно требуется для анализа неструктурированных данных?

a)

Стандартные SQL-запросы

b)

Продвинутые алгоритмы обработки данных

c)

ETL-инструменты

14.

Что такое MapReduce?

a)

Алгоритм распределённой обработки данных

b)

Компонент YARN

c)

Хранилище данных

15.

В каком случае предпочтительно использовать NoSQL базы данных?

a)

Для анализа структурированных данных

b)

Для работы с гибкими и большими данными

c)

При хранение табличных данных

16.

Что из перечисленного является характеристикой Больших данных?

a)

Гибкость хранения

b)

Легкость обработки

c)

Высокая объемность

17.

Какие типы баз данных чаще всего используются для хранения Больших данных?

a)

NoSQL

b)

Реляционные базы данных

c)

Временные базы данных

d)

Ты тупой, если не ответишь тут правильно

18.

Что из перечисленного относится к методам обеспечения безопасности данных?

a)

Оптимизация хранения

b)

Балансировка нагрузки

c)

Аутентификация

d)

Все выше перечисленные

19.

Какое преимущество использования MapReduce 2 по сравнению с MapReduce 1?

a)

Поддержка SQL

b)

Нет преимуществ

c)

Улучшенное использование ресурсов кластера

d)

Улучшенная отказоустойчивость

20.

Какое преимущество предлагает технология Spark Streaming?

a)

Хранение больших объемов данных

b)

Обработка данных в режиме реального времени

c)

Все выше перечисленные

d)

Поддержка NoSQL

21.

Какие из перечисленных технологий являются платформами для работы с Большими данными?

a)

SQL Server

b)

Hadoop и Spark

c)

MongoDB

22.

Какой из типов данных обычно организован в таблицы с четко определенными колонками и строками?


a)

Полуструктурированные данные

b)

Неструктурированные данные

c)

Структурированный данные

23.

Что обычно включает в себя работа с полуструктурированными данными?

a)

Использование NoSQL

b)

Создание индексов

c)

Все выше перечисленное

d)

Создание таблиц

24.

Какой инструмент используется для распределённой обработки данных?

a)

SQL Server

b)

Hadoop

c)

Spark Streaming

25.

Какое преимущество предлагает архитектура HDFS?

a)

Обеспечение высокой доступности данных

b)

Оптимизация SQL-запросов

c)

Поддержка кластеризации

26.

Какой из следующих методов чаще всего используется для работы с структурированными данными?

a)

Все используют одинаково

b)

MapReduce

c)

Я уже так устала делать этот тест

d)

Sql

27.

Какая из следующих задач выполняется TaskTracker в MapReduce 1?

a)

Выполнение задач Map и Reduce

b)

Координация выполнения задач

c)

Управление ресурсами

28.

Какая из следующих задач не выполняется DataNode в HDFS?

a)

Хранение данных

b)

Репликация данных

c)

Выполнение вычислительных задач

29.

Какой из следующих компонентов в MapReduce 2 отвечает за распределение ресурсов?

a)

NameNode

b)

Дизлайк

c)

ResourceManager

d)

TaskTracker

30.

Что делает компонент JobTracker в Hadoop MapReduce 1?

a)

Хранит метаданные

b)

Назначает задачи Map и Reduce

c)

Контролирует DataNode

31.

Какой компонент HDFS отвечает за хранение метаданных о файлах и директориях?

a)

Нахуй нужны компоненты

b)

DataNode

c)

NameNode

d)

TaskTracker

32.

Что означает термин "репликация данных" в HDFS?

a)

Создание копий данных на нескольких DataNode

b)

Удаление устаревших данных

c)

Архивирование данных

33.

Какие из следующих мер используются для обеспечения безопасности данных?

a)

Все вышеперечисленное

b)

Аутентификация

c)

Шифрование данных

34.

Что такое HDFS?

a)

Протокол обмена данными

b)

Распределенная файловая система

c)

SQL-хранилище

35.

Какой тип данных требует гибкости и масштабируемости для эффективного хранения и обработки?

a)

Структурирование данные

b)

Неструктурированные данные

c)

Полуструктурированные данные

d)

Все выше перечисленные

36.

Что из перечисленного является основной задачей NameNode в HDFS?

a)

Управление вычислительными задачами

b)

Управление метаданными

c)

Выполнение задач Map и Reduce

37.

Какая из перечисленных технологий используется для распределённого хранения данных?

a)

Apache Spark

b)

MongoDB

c)

Hadoop HDFS

38.

Какая из следующих характеристик относится к HDFS?

a)

Высокая скорость обработки данных

b)

Высокая отказоустойчивость

c)

Гибкая структура хранения

39.

Что такое YARN в контексте Hadoop MapReduce 2?

a)

Френдлифайер

b)

Хранилище данных

c)

Компонент для шифрования

d)

Фреймворк управления ресурсами

40.

Примером какого типа данных может быть JSON-файл?

a)

Структурированные данные

b)

Неструктурированные данные

c)

Полуструктурированные данные

41.

Каков основной компонент Hadoop YARN, управляющий выполнением конкретной задачи?

a)

ApplicationMaster

b)

NameNode

c)

TaskTracker

42.

В чем преимущество архитектуры MapReduce 2 по сравнению с MapReduce 1?

a)

Улучшенная безопасность данных

b)

Высокая скорость выполнения SQL-запросов

c)

Улучшенная гибкость в управлении ресурсами

43.

Какой из следующих методов используется для обеспечения безопасности данных в HDFS?

a)

Компрессия данных

b)

Если мне это не поможет, я убьюсь

c)

Балансировка нагрузки

d)

Шифрование данных

44.

Что такое кластеризация в контексте Больших данных?

a)

Обработка SQL-запросов

b)

Метод сегментации данных на основе их схожести

c)

Репликация данных

45.

Что произойдет, если один из DataNode выйдет из строя?

a)

Все умруууут

b)

Данные будут доступны из других реплик

c)

Потеря всех данных

d)

Система остановится

46.

Как называется процесс, при котором данные разбиваются на блоки и распределяются по DataNode?

a)

Разбиение данных

b)

Кэширование данных

c)

Кластеризация данных

47.

Что из перечисленного является преимуществом использования технологии HDFS (Hadoop Distributed File System)?

a)

Обработка SQL-запросов

b)

Хранение больших объемов неструктурированных данных

c)

Кластеризация данных

48.

Какой из перечисленных методов чаще всего используется для обработки неструктурированных данных?

a)

Не шарю

b)

SQl

c)

NOSQL

d)

MapReduce

49.

В чем заключается основная функция ApplicationMaster в MapReduce 2?

a)

Хранение данных

b)

Координирует выполнение конкретного приложения

c)

Нет функций

d)

Управление метаданными

50.

Какова основная роль Secondary NameNode в HDFS?

a)

Управление ресурсами

b)

Регулярное создание контрольных точек метаданных

c)

Выполнение вычислительных задач

51.

Что произошло с JobTracker в MapReduce 2?

a)

Он был заменен на ResourceManager и ApplicationMaster

b)

Он выполняет функции DataNode

c)

Он умер, Как и я

d)

Он был улучшен для совместимости

52.

Какие компоненты включены в экосистему Apache Hadoop?

a)

HDFS и MongoDB

b)

HDFS, MapReduce, YARN

c)

Spark и SQL

d)

Все выше перечисленные

53.

Какой тип данных содержит метки или теги для организации, но не соответствует строгой структуре?

a)

Структурированные данные

b)

Неструктурированные данные

c)

Полуструктурированные данные

54.

Какие из следующих данных наиболее вероятно будут неструктурированными?

a)

Электронный письма

b)

Логи серверов

c)

Таблица sql

55.

Какая из следующих задач выполняется ApplicationMaster в MapReduce 2?

a)

Контроль выполнения конкретной задачи

b)

Управление метаданными

c)

Репликация данных

56.

Как называется компонент, который управляет ресурсами в Hadoop YARN?

a)

ResourceManager

b)

TaskTracker

c)

NameNode

57.

В чем преимущество использования YARN в MapReduce 2?

a)

Эффективное управление ресурсами кластера

b)

Упрощение хранения данных

c)

Повышение отказоустойчивости

58.

Какая роль ResourceManager в MapReduce 2?

a)

Хранение данных

b)

Координация управления

c)

Репликация блоков данных

59.

Каков основной компонент MapReduce 1, отвечающий за выполнение задач?


a)

ResourceManager

b)

ApplicationMaster

c)

JobTracker