wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Дәріс 4

Total questions: 75

Worksheet time: 38mins

Name
Class
Date
1.

MapReduce парадигмасын кім әзірледі?

a)

Google компаниясының зерттеушілері

b)

Microsoft корпорациясы

c)

IBM зертханасы

d)

Facebook инженерлері

e)

Oracle компаниясы

2.

MapReduce парадигмасы алғаш қай жылы ұсынылды?

a)

2004 жылы

b)

2010 жылы

c)

1998 жылы

d)

2015 жылы

e)

2000 жылы

3.

MapReduce қандай негізгі екі кезеңнен тұрады?

a)

Map (Карталау) және Reduce (Қысқарту)

b)

Import және Export

c)

Load және Save

d)

Start және Finish

e)

Copy және Paste

4.

Map кезеңінде не орындалады?

a)

Бастапқы деректер бөліктерге бөлініп, <кілт, мән> жұптары түзіледі

b)

Барлық деректер сұрыпталады

c)

Тек нәтиже дискке жазылады

d)

Қысқарту операциялары жүреді

e)

Репликация іске қосылады

5.

Reduce кезеңінің негізгі мақсаты қандай?

a)

Бірдей кілттер бойынша мәндерді жинақтау

b)

Барлық деректерді дискіге жазу

c)

Деректерді сұрыптау

d)

Репликация жасау

e)

Деректерді шифрлау

6.

MapReduce архитектурасының негізгі компоненттері қандай?

a)

JobTracker, TaskTracker және HDFS

b)

Driver, Executor және Cluster Manager

c)

Mapper, Compiler және Loader

d)

Reader, Writer және Optimizer

e)

Master, Worker және SQL Engine

7.

JobTracker қызметі не істейді?

a)

Тапсырмаларды жоспарлап, олардың орындалуын бақылайды

b)

Файлдарды сақтау

c)

Желі трафигін өлшеу

d)

Деректерді шифрлау

e)

Деректерді визуалдау

8.

HDFS жүйесінің рөлі қандай?

a)

Деректерді блоктарға бөліп, түйіндерге таратып сақтау

b)

Деректерді шифрлау

c)

SQL сұраныстарын орындау

d)

Деректерді сығу

e)

Репликацияны өшіру

9.

MapReduce-тің басты артықшылықтарының бірі:

a)

Масштабталу және ақауға төзімділік

b)

Төмен өнімділік

c)

Тек бір серверде жұмыс

d)

Нақты уақыттағы өңдеу

e)

Жаңағы тәуелділік

10.

MapReduce жүйесінің басты шектеулерінің бірі:

a)

Диске тәуелділігі жоғары

b)

Репликация деңгейі төмен

c)

Ақауға төзімділігі жоқ

d)

Мәліметтерді жадта сақтау

e)

Пайдаланушы интерфейсі күрделі

11.

Неліктен MapReduce қайталанатын (iterative) есептер үшін тиімсіз?

a)

A) Себебі әр фаза деректерді дискіге жазып, қайта оқиды

b)

B) Себебі деректер тек жадында сақталады

c)

C) Себебі бір ғана түйін қолданылады

d)

D) Себебі желіге тәуелді

e)

E) Себебі код көп жазады

12.

MapReduce қандай өңдеу түріне негізделген?

a)

Пакеттік (Batch) өңдеу

b)

Ағындық (Streaming)

c)

Реактивті (Reactive)

d)

Интерактивті (Interactive)

e)

Бұлттық (Cloud)

13.

MapReduce жүйесінде кешігу (latency) неліктен жоғары?

a)

Себебі әрбір тапсырма жаңа процесс ретінде іске қосылады

b)

Себебі барлық деректер жадта сақталады

c)

Себебі сервер саны аз

d)

Себебі репликация өшірілген

e)

Себебі желі баяу

14.

MapReduce пен Apache Spark арасындағы негізгі айырмашылық неде?

a)

Spark деректерді жадында (in-memory) өңдейді

b)

MapReduce нақты уақытта жұмыс істейді

c)

Spark тек SQL деректерімен жұмыс істейді

d)

MapReduce жадта есептейді

e)

Spark тек Hadoop-та қолданылады

15.

MapReduce концепциясы неліктен маңызды болып қала береді?

a)

Себебі ол Big Data жүйелерінің негізін қалайды

b)

Себебі ол SQL жүйесін алмастырады

c)

Себебі ол тек бір серверде жұмыс істейді

d)

Себебі ол нақты уақытты өңдеуді қолданады

e)

Себебі ол желі ақауларын болдырмайды

16.

Apache Spark фреймворкі қай жылы және қай жерде әзірленді?

a)

2009 жылы Калифорния университетінде (UC Berkeley)

b)

2004 жылы Google-де

c)

2015 жылы IBM-де

d)

2012 жылы Microsoft-та

e)

2018 жылы Amazon-та

17.

Apache Spark не үшін жасалған?

a)

MapReduce-тің шектеулерін жою және деректерді жылдамырақ өңдеу үшін

b)

SQL серверін алмастыру үшін

c)

Веб-қосымшалар жасау үшін

d)

Машиналық аударма жүйесін құру үшін

e)

Тек графикалық интерфейс үшін

18.

Spark-тағы басты артықшылықтардың бірі қандай?

a)

Деректерді жадында (in-memory) сақтап, тез өңдейді

b)

Барлық деректерді тек дискіде сақтайды

c)

Тек пакеттiк өңдеуді қолдайды

d)

SQL сұраныстарын орындай алмайды

e)

Бір түйінде ғана жұмыс істейді

19.

Apache Spark архитектурасы қандай негізгі компоненттерден тұрады?

a)

Driver, Cluster Manager және Executors

b)

JobTracker, TaskTracker және NameNode

c)

Loader, Mapper және Reducer

d)

Client, Server және Database

e)

FileManager, Scheduler және Optimizer

20.

Spark-тағы Driver Program қандай қызмет атқарады?

a)

Қолданбаның логикасын басқарып, тапсырмаларды бөледі

b)

Барлық деректерді сақтау

c)

Тек SQL сұраныстарын орындау

d)

Серверді қайта іске қосу

e)

Репликация жасау

21.

RDD дегеніміз не?

a)

Төзімді және таралған деректер жиынтығы

b)

Репликацияланған деректер жүйесі

c)

SQL сұраныс модулі

d)

Графикалық визуализация құралы

e)

Тек бір түйінде сақталатын кесте

22.

RDD қандай негізгі қасиеттерге ие?

a)

Таралған, ақауға төзімді және өзгермейтін

b)

Тек SQL сұраныстарын орындайды

c)

Серверді қайта іске қосады

d)

Барлық деректерді дискіде сақтайды

e)

Графикалық интерфейс ұсынады

23.

DataFrame қандай құрылымға ұқсайды?

a)

Реляциялық дерекқордағы кестеге

b)

Бағандық NoSQL базаға

c)

Мәтіндік құжатқа

d)

JSON файлға

e)

Excel парағына

24.

Catalyst Optimizer не үшін қолданылады?

a)

Есептеулерді ең тиімді орындауға мүмкіндік беру үшін

b)

Репликация жасау үшін

c)

Деректерді визуалдау үшін

d)

Файлдарды сақтау үшін

e)

Түйіндерді шифрлау үшін

25.

Spark MapReduce-тен қалай ерекшеленеді?

a)

Spark деректерді жадында өңдеп, жылдамырақ жұмыс істейді

b)

Spark тек дискіде есептейді

c)

Spark тек пакеттік өңдеуді қолдайды

d)

MapReduce нақты уақыт режимінде жұмыс істейді

e)

Spark тек SQL қолданады

26.

Spark SQL қандай мақсатта қолданылады?

a)

Құрылымдалған деректермен жұмыс істеу және SQL сұраныстарын орындау үшін

b)

Тек машиналық оқыту үлгілерін құру үшін

c)

Графтарды талдау үшін

d)

Желі трафигін бақылау үшін

e)

Деректерді визуалдау үшін

27.

Spark SQL қандай негізгі компонентті пайдаланады сұраныстарды оңтайландыру үшін?

a)

Catalyst Optimizer

b)

Tensor Optimizer

c)

SQL Engine

d)

Spark Reducer

e)

Data Combiner

28.

Spark SQL қандай деректер көздерін қолдайды?

a)

Hive, Parquet, JSON, RDBMS

b)

Excel, Word, PDF

c)

FTP, HTML, XML

d)

Video, Audio, Image

e)

Redis, Kafka, MQTT

29.

Spark Streaming қандай мақсатта қолданылады?

a)

Нақты уақыт режимінде деректер ағындарын өңдеу үшін

b)

SQL сұраныстарын орындау үшін

c)

Тек графтарды өңдеу үшін

d)

Деректерді архивтеу үшін

e)

Пайдаланушы интерфейсін жасау үшін

30.

Spark Streaming деректерді қандай құрылым арқылы өңдейді?

a)

D-Streams (Discretized Streams)

b)

JSON Arrays

c)

MapReduce Blocks

d)

DataPipes

e)

Binary Frames

31.

Spark Streaming-тің басты ерекшелігі неде?

a)

Деректерді микро-пакеттерге бөліп, нақты уақытқа жақын өңдеу

b)

Барлық деректерді дискіде сақтау

c)

Репликацияны өшіру

d)

Тек пакеттік өңдеу

e)

SQL сұраныстарын орындамау

32.

MLlib кітапханасы не үшін қолданылады?

a)

Масштабталатын машиналық оқыту алгоритмдерін орындау үшін

b)

Деректерді сақтау үшін

c)

Графтарды визуалдау үшін

d)

SQL сұраныстарын орындау үшін

e)

Деректерді шифрлау үшін

33.

MLlib қандай алгоритм түрлерін қамтиды?

a)

Регрессия, жіктеу, кластерлеу, өлшемділікті азайту

b)

Тек SQL сұраныстары

c)

Тек граф анализі

d)

Визуализация және фильтрация

e)

Репликация және кэштеу

34.

GraphX қандай есептеулерге арналған?

a)

Графтық-параллельді есептеулер мен байланыстарды талдау

b)

SQL және JSON сұраныстар

c)

Машиналық оқыту үлгілерін сақтау

d)

Нейрондық желілерді үйрету

e)

Мультимедиа файлдарын өңдеу

35.

Apache Spark экожүйесінің басты артықшылығы неде?

a)

Әртүрлі деректер түрлері мен өңдеу режимдерін бір платформада біріктіру

b)

Тек пакеттiк өңдеудi қолдау

c)

Тек SQL сұраныстарымен шектеу

d)

Төмен масштабталу

e)

Бір серверде ғана жұмыс істеу

36.

Apache Kafka қандай мақсатта жасалған?

a)

Нақты уақыт режимінде деректер ағындарын тасымалдау және жүйелер арасында хабар алмасуды қамтамасыз ету

b)

Тек SQL сұраныстарын орындау үшін

c)

Веб-қосымшалар жасау үшін

d)

Деректерді визуалдау үшін

e)

Бұлттық сақтау жүйесін құру үшін

37.

Apache Kafka бастапқыда қай компанияда жасалды?

a)

LinkedIn

b)

Google

c)

Facebook

d)

Microsoft

e)

Amazon

38.

Kafka архитектурасы қандай модельге негізделген?

a)

Publish-Subscribe (жариялау-жазылу) моделі

b)

Request-Response моделі

c)

Client-Server моделі

d)

Peer-to-Peer моделі

e)

Master-Slave моделі

39.

Kafka-ның басты артықшылығы неде?

a)

Деректерді жоғалтпай реттелген түрде сақтау және жоғары өткізу қабілеті

b)

Деректерді тек файл түрінде сақтау

c)

Репликацияны өшіру

d)

Тек оффлайн режимінде жұмыс істеу

e)

Деректерді тек JSON форматында сақтау

40.

Apache NiFi қандай мақсатта қолданылады?

a)

Деректер ағындарын басқару, маршрутизация және түрлендіру үшін

b)

SQL сұраныстарын орындау үшін

c)

Тек хабар алмасуды ұйымдастыру үшін

d)

Графикалық деректерді визуалдау үшін

e)

Репликацияны басқару үшін

41.

Apache NiFi жүйесіндегі негізгі элемент не болып табылады?

a)

Процессор (Processor)

b)

Коннектор

c)

Брокер

d)

Контроллер

e)

Хранитель

42.

ETL процесінің негізгі кезеңдері қандай?

a)

Extract, Transform , Load

b)

Extract, Load, Transfer

c)

Evaluate, Transform, Learn

d)

Encode, Test, Log

e)

Execute, Track, Link

43.

ELT процесі ETL-ден несімен ерекшеленеді?

a)

Алдымен деректер қоймаға жүктеліп, кейін трансформация орындалады

b)

Барлық өңдеу жергілікті серверде өтеді

c)

Тек құрылымдалған деректермен жұмыс істейді

d)

Мәліметтер алдымен түрлендіріліп, кейін жүктеледі

e)

Репликацияны өшіреді

44.

Apache Kafka қандай жағдайларда жиі қолданылады?

a)

Мониторинг, ағымдық аналитика және микросервис интеграциясында

b)

Веб-дизайн мен интерфейс жасауда

c)

Графикалық есептеулерде

d)

Мультимедиа файлдарын өңдеуде

e)

Электрондық хат жіберуде

45.

Apache NiFi мен Kafka-ны бірге қолдану не үшін тиімді?

a)

Деректер интеграциясында сенімді және икемді шешімдер құру үшін

b)

SQL сұраныстарын оңтайландыру үшін

c)

Файлдық жүйелерді біріктіру үшін

d)

Веб-қосымшаларды автоматтандыру үшін

e)

Виртуалды машиналарды іске қосу үшін

46.

Үлкен деректерді талдаудың негізгі мақсаты қандай?

a)

Деректерді тек сақтау

b)

Деректерді визуалдау

c)

Деректерді жою

d)

Деректерді көшіру

e)

Болашақты болжауға және шешім қабылдауға көмектесетін заңдылықтарды анықтау

47.

Spark MLlib дегеніміз не?

a)

SQL сұраныстарын орындау құралы

b)

Веб-қосымшалар платформасы

c)

Графикалық интерфейс жүйесі

d)

Файлдарды сақтау жүйесі

e)

Spark-та масштабталатын машиналық оқыту алгоритмдеріне арналған кітапхана

48.

Сипаттамалық аналитика қандай сұраққа жауап береді?

a)

Неліктен болды?

b)

Не болды?

c)

Не болмады?

d)

Не істеу керек?

e)

Қалай болжауға болады?

49.

Диагностикалық аналитиканың мақсаты қандай?

a)

Болашақ оқиғаларды болжау

b)

Автоматты шешім қабылдау

c)

Деректерді сақтау

d)

Графтарды талдау

e)

Оқиғаның себебін анықтау және себеп-салдар байланысын табу

50.

Болжамдық аналитика қандай әдіске негізделеді?

a)

SQL сұраныстарына

b)

Визуализацияға

c)

Қолмен есептеуге

d)

Репликацияға

e)

Машиналық оқыту әдістеріне

51.

Нұсқаулық аналитика (Prescriptive Analytics) не үшін қолданылады?

a)

Өткен оқиғаларды жинақтау үшін

b)

Тек деректерді сақтау үшін

c)

Қателерді түзету үшін

d)

Тек есеп беру үшін

e)

Қандай әрекет жасау керектігін анықтау үшін

52.

MLlib қандай негізгі концепцияны қолданады?

a)

ML Pipelines

b)

Neural Blocks

c)

Data Bridges

d)

JSON Tables

e)

SQL Streams

53.

Классификация (Classification) міндетінің мақсаты қандай?

a)

Нысанды дискретті категориялардың біріне жатқызу

b)

Үздіксіз мәнді болжау

c)

Топтар құру

d)

Өлшемділікті азайту

e)

Деректерді сақтау

54.

Регрессия (Regression) қандай мәнді болжауға бағытталған?

a)

Үздіксіз сандық мәнді

b)

Категориялық мәнді

c)

Бинарлық нәтиже

d)

Сапалық баға

e)

Қарапайым индексі

55.

Кластерлеу (Clustering) қандай типтегі оқытуға жатады?

a)

Бақылаусыз оқыту (Unsupervised Learning)

b)

Бақыланатын оқыту (Supervised Learning)

c)

Күшейтілген оқыту (Reinforcement Learning)

d)

Гибридті оқыту

e)

Сызықтық оқыту

56.

Деректерді визуализациялаудың негізгі мақсаты қандай?

a)

Күрделі ақпаратты көрнекі түрде түсінікті етіп жеткізу

b)

Деректерді сақтау

c)

Деректерді шифрлау

d)

Алгоритмдерді үйрету

e)

Веб-сайт құрастыру

57.

Визуализация принциптерінің бірі – Қарапайымдылық (Simplicity) нені білдіреді?

a)

Артық элементтерді алып тастап, негізгі хабарламаға назар аудару

b)

Барлық түстерді пайдалану

c)

Мәліметтерді көбейту

d)

Диаграммаларды қиындату

e)

Графиктерге фон қосу

58.

Деректер-Сия қатынасы (Data-Ink Ratio) принципінің мәні неде?

a)

Көрсетілген элементтердің көбі деректерді көрсетуге арналуы тиіс

b)

Барлық фон мен рамкаларды күшейту

c)

Суретті көркем безендіру

d)

Түстерді көбейту

e)

Деректерді азайту

59.

Tableau құралының басты артықшылығы неде?

a)

Интуитивті интерфейс және тез дашбордтар жасау мүмкіндігі

b)

Тек локалды қолдану

c)

Тек мәтіндік деректермен жұмыс істеу

d)

Күрделі код жазуды қажет ету

e)

SQL сұраныстарын қолдамау

60.

Power BI құралының ерекшелігі неде?

a)

Microsoft экожүйесімен жақсы интеграцияланған және қолжетімді

b)

Тек графикалық интерфейс жасау үшін

c)

Ашық бастапқы кодты жүйе

d)

Тек веб-қосымшалар үшін

e)

SQL сұраныстарын орындамайды

61.

Matplotlib кітапханасының негізгі рөлі қандай?

a)

2D графиктер мен диаграммалар құруға арналған

b)

Машиналық оқыту модельдерін үйрету

c)

Деректерді сақтау

d)

SQL базасын басқару

e)

Веб-интерфейс жасау

62.

Seaborn кітапханасы Matplotlib-тен несімен ерекшеленеді?

a)

Күрделі статистикалық графиктерді аз кодпен құру мүмкіндігі

b)

Тек кестелерді шығару үшін

c)

SQL синтаксисін қолдануымен

d)

Фондық суреттермен жұмыс істеу

e)

Графиктерді тек 3D форматта салу

63.

Plotly кітапханасының басты ерекшелігі неде?

a)

Интерактивті және веб-негізделген визуализация жасау

b)

Тек оффлайн есептер үшін

c)

Деректерді тек CSV форматында сақтау

d)

Динамикалық элементтерді қолданбау

e)

SQL сұраныстарын орындау

64.

Түс кодтауы (Color Coding) принципі не үшін қажет?

a)

Түстерге ақпараттық мағына беру үшін

b)

Визуалды безендіруді арттыру үшін

c)

Эстетикалық әсер жасау үшін

d)

Барлық элементтерді бір түспен бояу

e)

Көрнекілікті азайту

65.

Үлкен деректер визуализациясының басты нәтижесі қандай?

a)

Аудиторияның деректер негізінде шешім қабылдауын жеңілдету

b)

Тек есеп сақтау

c)

Деректерді жою

d)

Тек диаграмма құру

e)

Алгоритмді баулату

66.

Big Data үшін бұлттық платформаларды қолданудың басты артықшылығы неде?

a)

Есептеу ресурстарын қажеттілікке қарай масштабтау және оңай басқару

b)

Деректерді тек жергілікті серверлерде сақтау

c)

Барлық жүйелерді қолмен конфигурациялау

d)

Тек кіші көлемдегі деректермен жұмыс

e)

Деректерді визуализациясыз өңдеу

67.

Big Data саласындағы ең ірі үш бұлттық платформа қайсылар?

a)

AWS, Azure, GCP

b)

Oracle, IBM, SAP

c)

Google Drive, Dropbox, OneDrive

d)

Hadoop, Spark, Hive

e)

Salesforce, Zoom, Slack

68.

AWS платформасындағы Big Data қызметінің мысалы:

a)

Amazon EMR

b)

Azure HDInsight

c)

BigQuery

d)

Vertex AI

e)

IBM Watson

69.

Azure HDInsight қандай технологияларға негізделген?

a)

Hadoop және Spark

b)

SQL және MongoDB

c)

TensorFlow және PyTorch

d)

Kafka және NiFi

e)

Docker және Kubernetes

70.

GCP платформасындағы аналитикалық дерекқор қызметі:

a)

BigQuery

b)

S3

c)

Redshift

d)

HDInsight

e)

Azure ML

71.

Big Data қауіпсіздігін қамтамасыз етудегі негізгі принциптердің бірі:

a)

Деректерді сақтау және тасымалдау кезінде шифрлау

b)

Тек деректерді визуалдау

c)

Деректерді қолмен көшіру

d)

Деректерді ашық форматта сақтау

e)

Деректерге еркін қолжетімділік

72.

“Principle of Least Privilege” принципі нені білдіреді?

a)

Әр пайдаланушыға тек қажетті ең аз рұқсат беру

b)

Барлық пайдаланушыларға толық қолжетімділік беру

c)

Деректерге тек әкімші ғана кіру

d)

Деректерді тек шифрсыз сақтау

e)

Кіру құпиясөзін өшіру

73.

Анонимизацияның негізгі мақсаты:

a)

Жеке тұлғаны сәйкестендіретін белгілерді жою

b)

Деректерді көбейту

c)

Деректерді визуалдау

d)

Деректерді форматтау

e)

Деректерді архивтеу

74.

ML модельдеріндегі “Bias” ұғымы нені білдіреді?

a)

Әлеуметтік немесе нәсілдік ауытқулардың шешімге әсер етуі

b)

Модельдің жылдамдығының артуы

c)

Мәліметтердің толық болмауы

d)

Шешімдердің кездейсоқ болуы

e)

Нәтижелердің қайталануы

75.

Big Data саласындағы этикалық талаптардың бірі:

a)

Модель шешімдерінің түсініктілігі мен транспаренттілігін қамтамасыз ету

b)

Деректерді барынша құпия ұстау

c)

Барлық деректерді автоматты түрде жою

d)

Барлық алгоритмдерді ашық жариялау

e)

Тек сандық деректермен жұмыс істеу