WorksheetsTebak-Tebakan Modul 3
Total questions: 20
Worksheet time: 20mins
AI Vs Machine Learning, Sama Atau Beda?
Sama Aja
Beda Sama Sekali
AI Bagian Dari Machine Learning
Machine Learning Bagian Dari AI
Pilihlah 3 strategi dibawah ini yang merupakan strategi untuk mengatasi imbalance dataset.
Feature Engineering
Oversampling
Tuning Hyperparameter
Mengatur Weight (Bobot)
Mengurangi Data
Pilih 2 kondisi yang menyebabkan overfitting
Menbuat decission tree dengan gini
sebagai kriteria split
Menggunakan k=1 pada KNN
Menggunakan Logistic Regression
sebagai model ML
Menggunakan feature sebanyak banyaknya
untuk training model
Menggunakan SVM dengan kernel Linear
Strategi yang dapat digunakan untuk melakukan penanganan terhadap missing value adalah. . . .
Menghapus semua data
Mengisi kolom kategori dengan median
Mengisi kolom numerik dengan modus
Menggunakan standar deviasi untuk kolom numerik
Menghapus baris/kolom yang berisikan
missing value
Underfitting adalah kondisi yang terjadi karena . . . .
Kurangnya data latih
Terlalu banyak feature yang dilatih model
Model yang sangat kompleks
Model Machine Learning Non Linear
Data yang hanya kategorik semua
Metode memperlihatkan grafik dan silhouette score dalam K-Means bertujuan untuk. . . .
Menentukan cluster boundaries
Menentukan jumlah cluster optimum
Memberitahu jarak antar data points
disetiap cluter
Menentukan jumlah iterasi maksimal
Tidak ada jawaban yang benar
Kelemahan dari model-based pada recommendation system adalah . . . .
Memerlukan domain knowlegde
Memerlukan data latih yang sedikit
Pengukuran kemiripan (similarity) bias
Sulit untuk melihat interrest baru dari seorang user
Tidak ada jawaban yang tepat
Pilih 2 bentuk yang interpretable dari machine learning
Tree dari Decission Tree
Core samples pada DBSCAN
Dendogram pada K-Menas
Koefisien Pada SVM
Dendogram pada Agglomerative Clustering
Pilih 3 yang tidak termasuk pada klasifikasi
KNN
Logistic Regression
Linear Regression
K-Means
Ridge Regression
Manakah statement yang benar dari coding tersebut?
Coding tersebut sudah benar
Coding tersebut memiliki error dibagian library
Kesalahan pada baris ke 16
Kesalahan pada baris 13
Tidak ada opsi yang benar
Berita menghebohkan apa di bola yang terjadi minggu lalu? (Gambar hanya pemanis)
C. Ronaldo Gabung Manchester City
C. Ronaldo Gabung Arsenal
C. Ronaldo Gabung Manchester United
Manchester City Juara Liga Champions
Arsenal Juara Di Liga Inggris
Jika terdapat kata
"Achmad Kurniansyah Sedang Main Mobile Legend"
Maka output yang keluar ketika menjalankan 2-grams tokenization adalah?
Achmad, Kurniansyah, Sedang, Main, Mobile, Legend
Achmad Kurniansyah, Sedang Main, Mobile Legend
Achmad Kurniansyah, Kurniansyah Sedang, Sedang, Main, Main Mobile, Mobile Legend
Semua Benar
Semua Salah
Jika melihat potongan coding tersebut, statement mana yang benar dari pernyataan dibawah ini?
Akan terbentuk 15 kombinasi tuning karena menggunakan RandomSearchCV dengan max iter = 15
Akan terdapat 24 kombinasi tuning yang terjadi karena jika dikalikan jumlah parameternya maka nilainya 24
Script tersebut akan menghasilkan error
Tidak ada yang terjadi
Semua salah
Pilihlah 2 maturity level dibawah ini yang tepat untuk mencapai level data-driven
Data-Driven
Data-Saver
Data-Suggestion
Data-Resistant
Data-Rejection
Berikut ini penulisan model ARIMA yang tepat setelah 2 differencing dan grafik PACF nya menunjukan cut off di lag ketiga adalah . . . .
ARIMAX(1,2,0)
ARIMA(1,2,0)
ARIMA(2,2,2)
ARIMA(2,2,0)
SARIMA(2,2,0)
Pilihlah 2 pernyataan yang tepat untuk kasus email spam detection dibawah ini.
Jumlah email spam dan ham haruslah
sama persis untuk membuat model machine learning
Semua email untuk membuat model harus email non-spam
Salah satu output machine learning untuk spam detection
dapat berupa peluang untuk masing-masih kelasnya
Waktu penerimaan email dapat menjadi feature
Model Decission Tree dapat digunakan untuk
membuat prediksi email spam
Melihat confusion matrix tersebut, pernyataan manakah yang benar dari pilihan dibawah ini
Metrics akurasi dapat digunakan
Terdapat lebih banyak kesalahan prediksi untuk kelas NO
Confusion matrix tersebut adalah evaluasi dari Linear Regression
Terdapat lebih banyak kesalahan prediksi untuk kelas YES
Nilai akurasinya sebesar 0.975
Berapakah nilai recall kelas YES untuk confusion matrix tersebut?
0.367
0.975
0.800
0.600
0.845
Yang bukan merupakan supervised learning adalah?
KNN
Decission Tree
DBSCAN
XGBoost
SVM
Model-based feature selection dapat melakukan pemilihan fitur dengan cara. . . .
Berdasarkan EDA
Melihat Feature Importance pada Decision Tree
Melihat kernel pada SVM
Menggunakan domain knowledge
Menggunakan jumlah K pada KNN
