wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

BigData 2 variant

Total questions: 51

Worksheet time: 26mins

Name
Class
Date
1.

Деректер қоймасының негізгі мақсаты қандай?

a)

Ойындарды сақтау

b)

Күнделікті транзакцияларды жылдам жазу.

c)

Желіні қорғау.

d)

Бизнесті талдау (BI) және шешім қабылдауға қолдау көрсету.

2.

Таратылған файл жүйесі (Distributed File System) дегеніміз не?

a)

Бір ғана флешкадағы деректер.

b)

Файлдарды бірнеше желілік түйіндерде (серверлерде) сақтайтын жүйе.

c)

Тек қана C: дискісіндегі файлдар.

d)

CD-диск жинағы.

3.

Үлестірілген Hadoop файлдық жүйесі не деп аталады?

a)

NTFS.

b)

HDFS.

c)

APFS.

d)

FAT32.

4.

HDFS ерекшелігі қандай?

a)

Үлкен файлдарды блоктарға бөліп, әртүрлі серверлерде сақтау.

b)

Тек кішкентай файлдарды сақтау.

c)

Деректерді өңдей алмайды.

d)

Тек бір серверде ғана жұмыс істейді.

5.

HDFS репликалауы (Replication) нені білдіреді?

a)

Деректерді қысу (архивтеу).

b)

Сенімділік үшін деректердің бірнеше көшірмесін жасау.

c)

Деректерді біржола өшіру.

d)

Деректерді поштамен жіберу.

6.

Қандай HDFS компоненті файл метадеректерін (файл қайда орналасқанын) басқарады?

a)

Client.

b)

DataNode.

c)

NameNode.

d)

TaskTracker.

7.

HDFS-дегі DataNode дегеніміз не?

a)

Нақты деректер блоктары сақталатын жұмысшы түйін.

b)

Жүйенің басқарушы орталығы.

c)

Пайдаланушының компьютері.

d)

Монитордың атауы.

8.

Деректер қоймасының қандай түрі көлденең масштабтауды (Horizontal Scaling) қолдайды?

a)

Деректерді қысқарту

b)

Бір сервердің жадын арттыру.

c)

Тек қағаз архивтері.

d)

Жаңа серверлерді қосу арқылы кеңейетін Big Data жүйелері.

9.

Data Lake дегеніміз не?

a)

Кез келген форматтағы деректерді (өңделмеген) сақтауға арналған икемді қойма.

b)

Тек SQL кестелері сақталатын жер.

c)

Балық аулайтын көл.

d)

Тазартылған есептер жиынтығы.

10.

Таратылған файл жүйелерінің артықшылығы неде?

a)

Орнатудың оңайлығы.

b)

Деректердің тез жоғалуы.

c)

Жоғары қолжетімділік және ақауларға төзімділік (Fault tolerance).

d)

Тек бір адамның пайдалануы.

11.

Data Lake жүйесіне қандай сақтау пішімі тән?

a)

Тек қана .doc.

b)

Raw (бастапқы), Parquet, Avro, JSON.

c)

Тек қана .exe.

d)

Тек қана .mp3.

12.

Жоғарыда аталғандардың қайсысы таратылған файл жүйесі емес?

a)

Amazon S3.

b)

GlusterFS.

c)

HDFS.

d)

NTFS (Жергілікті жүйе).

13.

Бұлттық деректер қоймасын (Cloud Data Warehouse) жасауға не мүмкіндік береді?

a)

Calculator.

b)

Winamp.

c)

Windows 95.

d)

Google BigQuery, Amazon Redshift, Snowflake.

14.

Amazon-да таратылған деректерді сақтау үшін қандай жүйе пайдаланылады?

a)

Amazon S3.

b)

Amazon Music.

c)

Amazon Kindle.

d)

Amazon Prime.

15.

Таратылған қойманы жобалауда қандай принциптер маңызды?

a)

Тек тегін болуы.

b)

Тек әдемі интерфейс.

c)

Бір мезетте өшіру мүмкіндігі

d)

Масштабталу, қауіпсіздік және деректердің тұтастығы.

16.

Apache Hadoop дегеніміз не?

a)

Деректерді таратылған түрде сақтауға және өңдеуге арналған ашық фреймворк.

b)

Антивирустық бағдарлама.

c)

Веб-сайт жасау құралы.

d)

Программалау тілінің атауы.

17.

Деректерді сақтауға қандай Hadoop компоненті жауап береді?

a)

YARN.

b)

MapReduce.

c)

HDFS.

d)

Hive.

18.

HDFS дегеніміз не?

a)

High Data File System.

b)

Hadoop Distributed File System.

c)

Hyper Digital File System.

d)

Home Data File System.

19.

MapReduce дегеніміз не?

a)

Деректерді жою алгоритмі.

b)

Үлкен деректерді параллель өңдеуге арналған модель/бағдарламалау үлгісі.

c)

Карталарды масштабтау құралы.

d)

Чат-бот.

20.

Hadoop-дағы YARN компоненті не үшін жауап береді?

a)

Тек қана шифрлау.

b)

Деректерді визуализациялау.

c)

Кластер ресурстарын басқару (CPU, RAM) және тапсырмаларды кезекке қою.

d)

Тек қана SQL сұраныстар.

21.

NameNode HDFS бағдарламасында қандай рөл атқарады?

a)

Мастер-түйін, файлдардың метадеректерін басқарады.

b)

Тек деректерді сақтайды.

c)

Пайдаланушыға жауап береді.

d)

Интернетке қосылады

22.

DataNode HDFS жүйесінде не істейді?

a)

Метадеректерді басқарады.

b)

Бағдарламаның кодын жазады

c)

Жүйені өшіреді

d)

Нақты файл блоктарын сақтайды және NameNode нұсқауларын орындайды.

23.

MapReduce бағдарламасында JobTracker дегеніміз не (YARN дейінгі нұсқада)?

a)

Тапсырмаларды таратуды және орындалуын бақылайтын орталық.

b)

Күнделік

c)

Күзетші

d)

Видео монтаждау құралы.

24.

Hadoop бағдарламасындағы қандай компонент контейнерлерді басқарады және тораптардағы тапсырмаларды орындайды?

a)

NodeManager (YARN құрамында).

b)

Google Chrome.

c)

Bluetooth.

d)

BIOS.

25.

Hive дегеніміз не?

a)

Hadoop үстіндегі SQL-тәрізді сұраныстарды (HQL) орындауға арналған инфрақұрылым.

b)

Аралар ұясы.

c)

Графикалық редактор.

d)

Ойын сервері.

26.

Hadoop бағдарламасындағы Pig дегеніміз не?

a)

Хакерлік бағдарлама.

b)

Сурет салатын бағдарлама.

c)

Браузер

d)

Деректер ағынын талдауға арналған жоғары деңгейлі платформа (Pig Latin тілі).

27.

HBase компоненті не істейді?

a)

Принтер драйвері.

b)

Тек қана Word файТеклдарын сақтайды.

c)

Hadoop-қа негізделген NoSQL деректер қоры (бағандық бағытталған).

d)

Экран сақтағышы.

28.

Zookeeper дегеніміз не?

a)

Антивирус.

b)

Таратылған жүйелерді үйлестіру және конфигурациялау қызметі.

c)

Хайуанаттар бағының сайты.

d)

Файлдарды қысатын бағдарлама.

29.

Hadoop-та Oozie не істейді?

a)

Интернет браузер.

b)

Музыка ойнатқыш.

c)

Hadoop тапсырмаларының жұмыс ағынын (workflow) жоспарлаушы.

d)

Карта бағдарламасы.

30.

Sqoop компоненті нені қамтамасыз етеді?

a)

Суреттерді форматтау.

b)

Реляциялық деректер қорлары (SQL) мен Hadoop арасында деректер тасымалдау.

c)

Видеоларды монтаждау.

d)

Парольдерді бұзу.

31.

Hadoop экожүйесіндегі Flume дегеніміз не?

a)

Ойын түрі.

b)

Электрондық пошта клиенті.

c)

Лог-файлдар секілді ағындық деректерді жинауға және жылжытуға арналған қызмет.

d)

Принтер түрі.

32.

Apache Spark дегеніміз не?

a)

Үлкен деректерді жедел жадыда (in-memory) өңдеуге арналған жылдам фреймворк.

b)

Файлдарды архивтеуге арналған бағдарлама.

c)

Мәліметтер базасының антивирусы

d)

Мәтіндік редактор

33.

«Қораптан» Spark қандай бағдарламалау тілін қолдамайды?

a)

Swift

b)

Scala

c)

Python

d)

R.

34.

Apache Spark-та RDD дегеніміз не?

a)

Resilient Distributed Dataset (Төзімді таратылған деректер жиыны).

b)

Remote Data Disk.

c)

Rapid Digital Dictionary.

d)

Real Data Driver.

35.

RDD қандай артықшылыққа ие?

a)

Ақауларға төзімділік (fault-tolerance) және параллельді есептеу.

b)

Тек бір ядролы процессорда жұмыс істеуі

c)

Тек мәтіндік форматты қолдауы.

d)

Деректерді автоматты түрде өшіруі.

36.

Spark бағдарламасындағы DataFrame дегеніміз не?

a)

Видео файл форматы.

b)

Тек сандардан тұратын массив

c)

Графикалық интерфейс элементі.

d)

Атаулы бағандары бар кестелік құрылымдағы деректер жиынтығы.

37.

SQL сұрауларына қандай Apache Spark модулі жауап береді?

a)

Spark SQL.

b)

Spark Streaming.

c)

GraphX.

d)

MLlib.

38.

Spark Streaming не істейді?

a)

Видеоларды интернеттен жүктейді

b)

Дыбыстық файлдарды түрлендіреді.

c)

Нақты уақыт режимінде келіп түсетін деректер ағынын өңдейді.

d)

Жүйенің температурасын бақылайды.

39.

Машиналық оқыту үшін қандай Spark компоненті пайдаланылады?

a)

MLlib.

b)

Spark Core.

c)

YARN.

d)

Mesos.

40.

Spark трансформациясы дегеніміз не?

a)

Бар деректерден жаңа RDD/DataFrame жасайтын операция (мысалы, filter, map).

b)

Деректерді экранға бірден шығару.

c)

Деректерді дереу жою.

d)

Программаны қайта іске қосу.

41.

Spark ішіндегі әрекет (action) нені білдіреді?

a)

Жаңа баған қосу.

b)

Кодты сақтау процесі.

c)

Есептеуді бастап, нәтижені қайтаратын операция (мысалы, collect, count).

d)

Компьютерді өшіру.

42.

Spark қандай орындау түрін пайдаланады?

a)

Кездейсоқ таңдау.

b)

Lazy evaluation (жалқау есептеу - әрекет шақырылғанша ештеңе орындалмайды).

c)

Жүйелі (sequential) орындау.

d)

Қолмен басқарылатын орындау

43.

Spark бағдарламасында деректерді кэштеу кезінде не болады?

a)

Деректер қайта пайдалану үшін жедел жадыда (RAM) сақталады.

b)

Деректер автоматты түрде шифрланады.

c)

Деректер бұлтқа (Cloud) жіберіледі.

d)

Файл көлемі кішірейеді.

44.

Spark SQL-мен қандай деректер пішімі жиі қолданылады?

a)

PDF

b)

Parquet.

c)

MP4

d)

TXT.

45.

.collect () командасы Spark ішінде не істеп жатыр?

a)

Деректерді сұрыптайды.

b)

Деректерді кластер бойынша таратады.

c)

Бағдарламаны тоқтатады.

d)

Барлық таратылған деректерді мастер-түйінге (driver) жинап береді.

46.

SparkSession дегеніміз не?

a)

Браузердегі сессия.

b)

Spark-тың барлық функционалдығына қол жеткізудің негізгі нүктесі.

c)

Бір реттік пароль.

d)

Деректерді қысатын алгоритм.

47.

Spark бағдарламасында .filter () әдісі қандай функцияны атқарады?

a)

Берілген шарт бойынша қажетті жолдарды таңдап алады.

b)

Барлық деректерді қосады.

c)

Деректерді файлға жазады.

d)

Бағандардың атын ауыстырады.

48.

Қандай тіл көбінесе деректерді талдау және машиналық оқыту үшін пайдаланылады?

a)

Python.

b)

CSS

c)

HTML.

d)

PHP

49.

Реляциялық дерекқорлармен жұмыста қандай тіл кеңінен қолданылады?

a)

SQL

b)

C++.

c)

JavaScript

d)

Swift

50.

Jupyter Notebook дегеніміз не?

a)

Компьютердің операциялық жүйесі.

b)

Кәдімгі қағаз дәптері.

c)

Кодты, мәтінді және визуализацияны біріктіретін интерактивті орта.

d)

Электрондық пошта клиенті.

51.

Python бағдарламасындағы Pandas кітапханасының негізгі мақсаты қандай?

a)

Деректерді құрылымдау және оларды талдау.

b)

мәнсық

c)

Видео өңдеу.

d)

Веб-сайттарды қорғау.