wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

PRE TEST 3 & 5

Total questions: 20

Worksheet time: 10mins

Name
Class
Date
1.
Apa tujuan utama dari regresi linier dalam konteks analisis bisnis dan pembelajaran mesin?
a)
Mengelompokkan data ke dalam cluster berdasarkan kemiripan karakteristik
b)
Mencari hubungan linear antara variabel dependen (Y) dan satu atau lebih variabel independen (X) untuk memprediksi nilai Y
c)
Mengidentifikasi hubungan kausalitas antara variabel kategorikal
d)
Mengurangi dimensi data untuk visualisasi yang lebih baik
2.
Dalam persamaan regresi linier , y=mx+c, variabel y disebut sebagai...
a)
Variabel predictor
b)
Variabel Independen
c)
Variabel Dependen
d)
Slope atau Gradien
3.
Evaluasi mana yang digunakan untuk mengukur seberapa baik model linier memprediksi data, yang menghasilkan persentase akurasi?
a)
metrics.mean_squared_error (MSE)
b)
metrics.mean_absolute_error (MAE)
c)
metrics.cohen_kappa_score
d)
r2_score
4.
Dalam konteks Regresi Linier Sederhana (Y=a+bX), manakah persamaan yang benar untuk menghitung koefisien kemiringan (b)?
a)
b = var(X) / var(y)
b)
b = cov(X, y) / cov(X, X)
c)
b = cov(X, y) / var(X)
d)
b = mean(y) / mean(X)
5.
Diberikan data variabel independen X (Lama Iklan dalam Minggu) dari studi kasus Modul 3: X={20,40,20,30,10,10,20,20,20,30}. Hitunglah nilai rata-rata (X) dari data tersebut.
a)
20
b)
25
c)
22
d)
30
6.
Library mana yang secara spesifik digunakan untuk pemodelan Regresi Linier dan split data?
a)
Pandas dan Matplotlib
b)
Scikit-learn (sklearn)
c)
NumPy dan Seaborn
d)
Statsmodels.formula.api (smf)
7.
Jika nilai koefisien korelasi (r) dari suatu model regresi adalah 0.76, bagaimana interpretasi tingkat hubungannya berdasarkan Kriteria Koefisien Korelasinya?
a)
Sangat Lemah
b)
Lemah
c)
Cukup
d)
Kuat
8.
Diberikan model regresi linier sederhana Y=18.95+1.18X. Berapakah nilai prediksi Y (Jumlah Produk Internet of Think yang Terjual) jika variabel independen X (Lama Iklan) memiliki nilai 50 hari?
a)
77.95
b)
68.95
c)
59.00
d)
80.15
9.
Apa makna dari Koefisien Determinasi (r2) dalam konteks model regresi?
a)
Mengukur kekuatan dan arah hubungan linear antara variabel X dan Y
b)
Menentukan probabilitas hasil tertentu ketika variabel dependen bersifat biner
c)
Mengukur seberapa dekat data pengamatan menyebar di sekitar garis regresi
d)
Mengukur besarnya pengaruh atau kontribusi dari variabel independen (X) terhadap variabel dependen (Y)
10.
Regresi Logistik (Logistic Regression) merupakan teknik regresi yang digunakan ketika variabel dependennya bersifat kategorikal atau biner. Apa yang diprediksi oleh Regresi Logistik?
a)
Nilai kontinu dari variabel dependen
b)
Koefisien Determinasi (r2)
c)
Probabilitas hasil tertentu
d)
Nilai minimum support
11.

Clustering termasuk ke dalam jenis pembelajaran apa?

a)

Supervised learning

b)

Semi Supervised learning

c)

Unsupervised learning

d)

Reinforcement learning

12.

Tujuan utama dari metode clustering adalah…

a)

Memprediksi nilai target

b)

Mengelompokkan data dengan karakteristik serupa

c)

Menghapus data duplikat

d)

Meningkatkan ukuran dataset

13.

Algoritma yang paling umum digunakan dalam clustering adalah… 

a)

Decision Tree

b)

K-Means

c)

k-Nearest Neighbor

d)

Random Forest

14.

Dalam algoritma K-Means, pusat dari setiap cluster disebut…

a)

Variabel

b)

Silhouette Score

c)

Node

d)

Centroid

15.

Kriteria utama keanggotaan data dalam sebuah cluster adalah…

a)

Jarak minimum ke centroid

b)

Nilai median tertinggi

c)

Variansi terkecil

d)

Asumsi Normalitas

16.

Metode pengukuran jarak yang umum digunakan pada K-Means adalah…  

a)

Manhattan Distance

b)

Euclidean Distance

c)

Cosine Similarity

d)

Mahalanobis Distance

17.

Langkah pertama dalam algoritma K-Means adalah…

a)

Menghitung centroid baru

b)

Menentukan jumlah cluster (K)

c)

Mengurutkan data

d)

Menghapus outlier

18.

Proses K-Means berhenti ketika…

a)

Centroid berhenti berubah

b)

Semua data memiliki nilai nol

c)

Nilai K mencapai maksimum

d)

Jumlah data meningkat

19.

Elbow Method digunakan untuk…

a)

Menentukan centroid awal

b)

Menentukan jumlah cluster optimal

c)

Menghapus outlier

d)

Menstandarkan data

20.

Silhouette Score digunakan untuk mengukur…

a)

Variansi antar cluster

b)

Kualitas pengelompokan

c)

Banyaknya data dalam cluster

d)

Ukuran centroid