Wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

Review Big Data Analytics: Session 1-6

Total questions: 19

Worksheet time: 7mins

Name
Class
Date
1.

Berikut ini alur proses Data Science (in general) yang tepat adalah...

a)

Big Data -> Action -> Insight

b)

Insight -> Big Data -> Action

c)

Big Data -> Insight -> Action

d)

Action -> Big Data -> Insight

2.

Dalam pemrosesan Big Data, hal pertama yang harus ditentukan adalah "business objectives".

a)

Benar

b)

Salah

3.

5 P's of Data Science:

a)

People, Passion, Process, Platform, Programmability

b)

Passion, Purpose, Process, Platform, Programmability

c)

People, Purpose, Process, Platform, Programmability

d)

People, Purpose, Process, Performance, Programmability

4.

Di tahap "Prepare" data, ada 2 proses yang perlu dilakukan, yakni ...

a)

Explore

b)

Analisis

c)

Pre-process

d)

Optimasi

5.

Isi database dapat diakses dengan menggunakan ...

a)

Web Services

b)

Scripting languages

c)

XML

d)

SQL

6.

Mengapa kita perlu melakukan data exploration sebelum data tersebut diproses lebih lanjut? (lebih dari 1 jawaban)

a)

Untuk melihat korelasi data

b)

Untuk menyusun laporan data

c)

Untuk menemukan outlier

d)

Untuk melihat trend data

7.

Berikut ini adalah proses transformasi data, kecuali ...

a)

data manipulation

b)

dimensionality reduction

c)

data migration

d)

scaling

8.

Manakah yang BUKAN komponen utama dari file system?

a)

Directory service

b)

Authorization service

c)

Shadow service

d)

System service

9.

Apa manfaat dari "data replication"?

a)

Meningkatkan availability dan performance

b)

Menurunkan performance

c)

Data menjadi konsisten

d)

Meningkatkan kecepatan

10.

Aspek-aspek berikut ini menggambarkan Hadoop dengan tepat, kecuali ...

a)

Open source

b)

Real time

c)

Java-based

d)

Distributed computing approach

11.

Manakah yang merupakan komponen-komponen utama dari Hadoop? (lebih dari 1 jawaban)

a)

HDFS

b)

Map Reduce

c)

HBase

d)

Hive

12.

Hadoop menggunakan programming model yang disebut "MapReduce".

a)

Benar

b)

Salah

13.

Manakah yang BUKAN keuntungan dari partisi dan replikasi data?

a)

data scalability

b)

low concurrency

c)

fault tolerance

14.

Pilihlah tahap-tahap MapReduce yang benar!

a)

Map -> Combine -> Reduce

b)

Reduce -> Combine -> Map

c)

Map -> Reduce -> Combine

d)

Combine -> Map -> Reduce

15.

Untuk mencapai efisiensi pengolahan data, komputasi secara serial perlu diterapkan.

a)

Benar

b)

Salah

16.

Menambah lebih banyak mesin yang saling terhubung melalui jaringan dikenal dengan istilah ...

a)

scale up

b)

scale in

c)

scale down

d)

scale out

17.

Scale out dan scale in merupakan jenis-jenis dari vertical scaling.

a)

Benar

b)

Salah

18.

Enkripsi dan dekripsi meningkatkan level keamanan data dan membuat pengolahan data menjadi lebih murah.

a)

Benar

b)

Salah

19.

Manakah dari komponen-komponen Hadoop ecosystem berikut ini yang TIDAK berperan di aspek data ingestion?

a)

Kafka

b)

Mahout

c)

Sqoop

d)

Flume