wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

Responsi Lab Big Data & Data Mining

Total questions: 40

Worksheet time: 21mins

Name
Class
Date
1.

Apa fungsi untuk menghapus baris dengan nilai kosong dari DataFrame?

a)

df.dropna()

b)

df.remove()

c)

df.clear()

d)

df.delete()

2.

Untuk menghitung jumlah nilai yang hilang (missing values) dalam DataFrame, fungsi apa yang digunakan?

a)

df.isna().sum()

b)

df.missing()

c)

df.count_na()

d)

df.nan_count()

3.

Apa fungsi untuk menampilkan 5 baris pertama dari DataFrame?

a)

df.head(5)

b)
c)

df.first(5)

d)
4.

Untuk membaca file CSV ke dalam DataFrame di Pandas, fungsi apa yang digunakan?

a)

pd.read_csv(')

b)

pd.load_csv()

c)

pd.import_csv()

d)

pd.open_csv()

5.

Library yang biasa digunakan untuk visualisasi data pada python

a)

matplotlib

b)

seaborn

c)

numpy

d)

pandas

6.

Berdasarkan heatmap tersebut, pilih 3 komponen makanan yang ideal yang dapat digunakan untuk memprediksi kesehatan seseorang

a)

sugar

b)

sodium

c)

fat

d)

cholesterol

e)

calories

7.

Berdasarkan gambar tersebut, spesies manakah yang memiliki outlier pada fitur sepal length?

a)

setosa

b)

versicolor

c)

virginica

8.

Ada berapa fitur yang memiliki tipe data numerik?

a)

5

b)

4

c)

1

d)

9

9.

Berdasarkan data tersebut, spesies mana yang memiliki distribusi sepal length yang memusat?

a)

setosa

b)

versicolor

c)

virginica

10.

Berdasarkan data tersebut, spesies manakah yang memiliki sepal length yang paling menyebar?

a)

virginica

b)

setosa

c)

versicolor

11.

Kode tersebut akan mengisi nilai hilang dalam kolom 'Age' dengan rata-rata kolom tersebut. Pilih bagian yang hilang untuk melengkapi sintaks tersebut:

a)

fillna

b)

replace

c)

dropna

d)

fillmean

12.

Fungsi isna().sum() pada DataFrame digunakan untuk:

a)

Menghitung jumlah nilai kosong dalam setiap kolom

b)

Menghapus nilai kosong

c)

Mengisi nilai kosong

d)

Membuat histogram

13.

Fungsi LabelEncoder() digunakan untuk:

a)

Normalisasi data

b)

Standarisasi data

c)

Mengubah variabel kategorikal menjadi numerik

d)

Mengisi nilai kosong

14.

Untuk membagi teks menjadi kata-kata, kita bisa menggunakan metode:

a)

stop_words

b)

tokenize

c)

stemming

d)

lemmatize

15.

Library Python yang umum digunakan untuk pemrosesan teks adalah:

a)

NumPy

b)

Pandas

c)

NLTK

d)

Matplotlib

16.

Tuple dalam Python adalah tipe data yang bersifat:

a)

Mutable

b)

Immutable

c)

Dapat diubah

d)
  • Tidak bisa menampung tipe data berbeda

17.

Sintaks yang benar untuk membuat tuple kosong adalah:

a)

tuple = {}

b)

tuple = []

c)

tuple = ()

d)

tuple = [[]]

18.
a)

(1, 2, 3)

b)

(2, 3)

c)

(3, 4)

d)

Error

19.
a)

1

b)

2

c)

3

d)

Error

20.

List dalam Python ditandai dengan tanda kurung:

a)

{ }

b)

[ ]

c)

( )

d)
  • < >

21.

Manakah pernyataan yang benar tentang list dalam Python?

a)

List bersifat immutable

b)

List hanya bisa berisi integer

c)

List memiliki indeks

d)

List merepresentasikan pasangan key dan value

22.

Untuk menghitung jumlah kemunculan suatu elemen dalam list, kita bisa menggunakan metode:

a)

count()

b)

index()

c)

find()

d)

search()

23.

Fungsi describe() dalam Pandas digunakan untuk:

a)

Menghapus duplikasi

b)

Menghitung nilai rata-rata

c)

Menyediakan statistik deskriptif dari data

d)

Menampilkan data dalam bentuk tabel

24.

Library Python yang paling umum digunakan untuk pemrosesan suara adalah:

a)

NumPy

b)

Seaborn

c)

librosa

d)

NLtk

25.

Apa yang akan terjadi jika kita mengatur min_support ke nilai yang sangat tinggi, seperti 0.9

a)

Akan menemukan lebih banyak itemset

b)

Akan menemukan lebih sedikit itemset

c)

Akan menghasilkan error

d)

Tidak ada pengaruh

26.

Aturan asosiasi yang memenuhi confidence > 0.7 adalah

a)

If buy milk then buy bread

b)

if buy bread then buy milk

c)

if buy coffee then buy sugar

d)

if buy sugar than buy coffee

27.

Dari transaksi tersebut manakah barang yang paling laku

a)

BISCUIT

b)

BOURNVITA

c)

BREAD

d)

COFFEE

28.

Fungsi Python apa yang sering digunakan untuk menghapus baris duplikat dalam DataFrame?

a)

df.remove_duplicates()

b)

df.drop_duplicates()

c)

df.clear_duplicates()

d)

df.delete_duplicates()

29.

Data tersebut Mengandung Missing Value

a)

Benar

b)

Salah

30.

Apa hasil dari perintah tersebut?

a)

1

b)

2

c)

3

d)

4

31.

Jika teks adalah “The car is very fast and red.” dan stop words dihapus, teks menjadi:

a)

['car', 'fast', 'red']

b)

['The', 'car', 'is', 'very', 'fast', 'and', 'red']

c)

['car', 'is', 'fast', 'red']

d)

['car', 'fast', 'and', 'red']

32.

Bagaimana cara kerja algoritma stemming pada dasarnya

a)

Menghapus kata yang tidak penting dari teks

b)

Menghilangkan akhiran kata untuk mendapatkan bentuk dasar kata

c)

Menggabungkan kata-kata yang memiliki arti serupa

d)
  • Mengonversi kata menjadi bentuk pluralnya

33.

Perintah text.lower() dalam Python digunakan untuk:

a)

Menghapus kata-kata yang tidak penting

b)

Mengonversi teks menjadi huruf kecil

c)

Menghapus tanda baca

d)

Memotong Kalimat menjadi kata

34.

Manakah dari berikut ini yang merupakan teknik feature selection yang umum digunakan?

a)

Correlation Coefficient

b)

K-means Clustering

c)

Principal Component Analysis (PCA)

d)

K-Nearest Neighbors (KNN)

35.

Manakah dari metode berikut yang merupakan metode filter dalam feature selection?

a)

Chi Square Test

b)

Decision Trees

c)

Support Vector Machines (SVM)

d)

K-Nearest Neighbors

36.

Metode yang digunakan dalam Feature Selection pada potongan kode tersebut adalah

a)

RFE

b)

Logistic Regression

c)

Linear_model

d)

sklearn

37.

Salah satu teknik yang umum digunakan untuk menghapus noise dalam suara adalah:

a)

Equalization

b)

Filtering

c)

Compression

d)
  • Distortion

38.

Apa tujuan dari analisis spektrum dalam voice preprocessing?

a)

Menentukan waktu terbaik untuk merekam suara

b)

Mengidentifikasi frekuensi dominan dalam sinyal suara

c)

Mengubah semua suara menjadi satu suara

d)

Menghapus suara yang tidak perlu

39.

Jika Anda memiliki DataFrame df, bagaimana cara menghitung matriks korelasi dari semua kolom numerik?

a)

df.corr()

b)

df.correlation()

c)

df.cov()

d)

df.covariance()

40.

Dalam konteks korelasi, apa arti dari nilai 0.8?

a)

Memiliki hubungan yang kuat

b)

Memiliki hubungan yang lemah

c)

Memiliki hubungan yang sedang

d)

Tidak memiliki hubungan