Wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

Quiz Modul 3 Prakstat Shift 2

Total questions: 20

Worksheet time: 10mins

Name
Class
Date
1.

Variabel dependen (terikat) dalam Regresi Logistik harus bersifat...

a)

Selalu berjumlah 3 kategori atau lebih

b)

Semua variabel harus bertipe data float64

c)

Metrik (Numerik) dengan distribusi normal

d)

Kategorik

2.

Apa yang dimaksud dengan Odds Ratio dalam konteks Regresi Logistik?

a)

Perbandingan kemungkinan terjadinya suatu peristiwa dengan kemungkinan tidak terjadinya suatu peristiwa

b)

Rasio yang menggambarkan seberapa besar peningkatan/penurunan odds kejadian untuk setiap kenaikan satu unit pada variabel prediktor

c)

Metrik yang mengukur seberapa baik model dapat membedakan antara dua kelompok hasil

d)

Perbandingan antara probabilitas terjadinya suatu peristiwa dengan probabilitas peristiwa lain yang akan terjadi

3.

Jika variabel terikat (Y) memiliki lebih dari 2 kategorisasi, misalnya memprediksi jenis pekerjaan (manajer, teknisi, administrasi), maka Regresi Logistik yang digunakan adalah...

a)

Regresi Logistik Biner

b)

Regresi Logistik Sederhana

c)

Regresi Logistik Multinomial

d)

Regresi Logistik Berganda

4.

Hasil dari model regresi logistik adalah dalam bentuk...

a)

Persamaan garis linear (Y = β0 + β1 X)

b)

Probabilitas atau kemungkinan

c)

Nilai mean square error (MSE) yang diminimalkan

d)

Variabel biner diskrit (0 atau 1) secara langsung

5.

Pembagian dataset menjadi data latih dan data uji untuk menghindari overfitting dan memvalidasi model pada sampel yang terpisah disebut...

a)

Optimasi Loss Function

b)

Estimasi Kemungkinan Maksimum (MLE)

c)

Normalisasi Data

d)

Cross Validation

6.

Fungsi dari pustaka scikit-learn yang digunakan untuk membagi dataset menjadi data pelatihan dan data pengujian adalah...

a)

data_split_test()

b)

train_split()

c)


train_test_split()

d)

split_data()

7.

Library Python yang digunakan untuk membaca data dari file eksternal (seperti diabetes.xlsx) dan untuk keperluan manipulasi data adalah...

a)

Seaborn (sns)

b)

Numpy (np)

c)

Matplotlib (plt)

d)

Pandas (pd)

8.

Jika Odds Ratio untuk variabel Pregnant (Jumlah Kehamilan) adalah 1.125365, apa interpretasi yang benar dari nilai ini?

a)

Setiap kenaikan satu unit dalam jumlah kehamilan menurunkan odds terjadinya diabetes sebesar 12.54%.

b)

Setiap kenaikan satu unit dalam jumlah kehamilan meningkatkan odds terjadinya diabetes sebesar 1.1254%

c)

Probabilitas dasar diabetes adalah 1.125365 ketika semua prediktor bernilai nol

d)

Setiap kenaikan satu unit dalam jumlah kehamilan meningkatkan odds terjadinya diabetes sebesar 12.54%

9.

Jika Odds Ratio variabel Glucose (Kadar Glukosa) adalah 1.038708, ini menunjukkan bahwa kadar glukosa yang lebih tinggi berhubungan dengan...

a)

Peningkatan odds terjadinya diabetes sebesar 0.0387%

b)

Penurunan odds terjadinya diabetes sebesar 3.87% untuk setiap kenaikan satu unit kadar glukosa

c)

Tidak ada pengaruh signifikan terhadap risiko diabetes

d)

Peningkatan odds terjadinya diabetes sebesar 3.87% untuk setiap kenaikan satu unit kadar glukosa

10.

Dalam banyak aplikasi klasifikasi biner, nilai Log loss yang lebih rendah dari nilai berikut biasanya dianggap baik:

a)

0,5

b)

0

c)

0,1

d)

1

11.

Nilai Log-Likelihood idealnya harus mendekati angka berapa untuk dikatakan sebagai model yang baik?

a)

1

b)

0

c)

Tak Terhingga

d)

-198,29

12.

Uji kesesuaian yang digunakan untuk membandingkan dua model, yaitu model null (tanpa prediktor) dan model akhir (dengan semua prediktor), dalam ringkasan model Regresi Logistik adalah...

a)

Uji Wald Statistic

b)

Uji Pearson Residual

c)

Uji Rasio Log-Likelihood (Log-Likelihood Ratio Test)

d)

Uji-t

13.

Jika nilai AME pedigree adalah 0,1677, apa arti dari nilai ini menurut interpretasi yang benar?

a)

Setiap kenaikan satu satuan nilai pedigree meningkatkan odds terjadinya diabetes sebesar 16,77%

b)

Rasio Log-Likelihood model adalah 0,1677

c)

Probabilitas prediksi yang salah adalah 16,77%

d)

Setiap kenaikan satu satuan nilai pedigree meningkatkan kemungkinan menderita diabetes sebesar 16,77%

14.

Jenis plot yang hanya mungkin dilakukan jika memasang regresi logistik menggunakan satu variabel independen, yang memvisualisasikan kemungkinan terkena diabetes berubah dengan garis kurva 'S', adalah...

a)

Heatmap Matriks Korelasi

b)

Histogram

c)

Scatter plot dengan fungsi regplot( ) dan parameter logistic = True

d)

Boxplot

15.

Nilai Statistik Konkordansi (c-statistic) yang menunjukkan prediksi sempurna di mana model selalu memprediksi dengan benar siapa yang akan mengalami peristiwa tersebut adalah...

a)

0,5

b)

0

c)

1

d)

0,7

16.

AUC (Area Under the Curve) adalah ukuran yang serupa dengan Statistik Konkordansi (c-statistic). AUC menunjukkan...

a)

Area di bawah garis regresi linear sederhana

b)

Rasio antara True Positive dan False Positive

c)

Kemampuan model untuk membedakan antara hasil positif dan negatif (diskriminasi)

d)

Tingkat korelasi linear antara variabel dependen dan independen

17.

Dalam Matriks Klasifikasi, sel yang menunjukkan jumlah pengamatan yang positif, tetapi salah diprediksi menjadi negatif disebut...

a)

Positif Sejati (True Positive)

b)

Positif Palsu (False Positive)

c)

Negatif Sejati (True Negative)

d)

Negatif Palsu (False Negative)

18.

Apa yang dimaksud dengan Kekhususan (Specificity) dalam metrik evaluasi model Regresi Logistik?

a)

Persentase hasil positif aktual yang diprediksi positif

b)

Persentase prediksi positif yang sebenarnya positif

c)

Rasio antara jumlah True Negative dan jumlah seluruh observasi

d)

Persentase hasil negatif aktual yang diprediksi negatif

19.

Jika koefisien regresi logistik (β1) untuk suatu prediktor positif, apa yang dapat disimpulkan tentang hubungan prediktor tersebut dengan odds kejadian?

a)

Odds Ratio akan bernilai kurang dari 1

b)

Tidak ada hubungan antara prediktor dan odds kejadian

c)

Peningkatan prediktor menyebabkan penurunan odds kejadian

d)

Peningkatan prediktor menyebabkan peningkatan odds kejadian

20.

Dalam konteks evaluasi model klasifikasi, metrik yang dihitung sebagai persentase dari keseluruhan hasil yang diprediksi dengan benar ({TP + TN}/{Total}) adalah...

a)

Specificity (Kekhususan)

b)

Recall (Sensitivitas)

c)

Precision

d)

Accuracy (Ketepatan)