NEW
Font size
WorksheetsModule 2 Quiz Preparation
Total questions: 20
Worksheet time: 3600secs
Misalkan kita membuat array/list dengan nama variabel x dan berisi sesuai dengan gambar. Agar dapat mengambil array berikut:
array([[11, 14, 16],
[21, 24, 26],
[31, 34, 36]])
maka code yang tepat adalah
x[-4:-1, np.array([1, 4, 6])]
x[1:4, np.array([1, 4, 6])]
x[-4:-1, np.array([-9, -6, -4])]
x[1:4, np.array([-9, -6, -4])]
Semua jawaban benar
Jika kita ingin generate array 2-D mengandung 3 baris dan 5 kolom random integer dari 0 sampai 100, maka code yang tepat digunakan adalah
random.rand(3,5)
random.randint(100, size=(3, 5))
Tidak ada yang benar
random.randint(100, size=(5, 3))
random.randn(3,5)
Jika kita memiliki df1 (atas) dan df2 (bawah) seperti pada gambar dan ingin menampilkan data seperti data di bawah ini:
A B C D F
A0 B0 C0 D0 NaN
A1 B1 C1 D1 NaN
A2 B2 C2 D2 NaN
A3 B3 C3 D3 NaN
NaN B0 NaN D0 F0
NaN B1 NaN D1 F1
NaN B3 NaN D3 F3
NaN B4 NaN D4 F4
maka code yang tepat digunakan adalah
join = pd.concat([df1, df2], axis=0, join='outer')
join = pd.concat([df1, df2], axis=1, join='inner')
join = pd.concat([df1, df2], axis=0, join='inner')
Tidak ada yang benar.
join = pd.concat([df1, df2], axis=1, join='outer')
Jika kita ingin mengetahui jumlah data `clarity` yang unik pada data `diamonds`, code yang tepat digunakan adalah
df['clarity'].nunique()
Semua pilihan benar.
len(pd.unique(df['clarity']))
len(df['clarity'].unique())
len(df['clarity'].value_counts())
Manakah cara yang tepat untuk mencari median harga berlian dengan jumlah carat lebih dari 0.1?
df[df['carat']>=0.1]['price'].median()
df[df['carat']==0.1]['price'].sum()/len(df[df['carat']==0.1])
df[df['carat']>0.1]['price'].median()
df.loc[df['carat']>0.1, 'price'].mean()
Semua jawaban benar
Interpretasi manakah yang tepat untuk menggambarkan output dari kode berikut berdasarkan gambar tersebut:
df.groupby('cut').mean().sort_values('depth', ascending=True)['depth'].iloc[:3]
3 `cut` dengan rata-rata `depth` terendah
3 `cut` dan `depth` dengan rata-rata `depth` tertinggi
3 `cut` dan `depth` dengan rata-rata `depth` terendah
3 `cut` dengan rata-rata `depth` tertinggi
Rata-rata `depth` berdasarkan `cut`nya
Berdasarkan gambar berikut, mana cara yang paling tepat untuk melakukan uji korelasi antara `depth` dan `table`?
df[['depth','table']].corr()
df.corr()[['depth','table']]
df['depth'].corr(df['table'])
df['depth'].corr(df['table'], method = 'pearson')
df['depth'].corr(df['table'], method = 'spearman')
Untuk menjawab pertanyaan 'Apakah terdapat perbedaan nilai exam module 2 oleh student Purwadhika di tiap cabangnya?', uji hipotesis yang tepat digunakan adalah
Wilcoxon
Mann-whitney U
Chi-square test
t-test independent
Kruskal-Wallis
Dalam uji hipotesis, kita mengenal istilah "Two-Tail Test". Manakah pernyataan yang tepat mengenai Two-Tail Test?
Variabel yang diuji pada Two-Tail Test memiliki distribusi right skewed atau left skewed
Two-Tail Test digunakan untuk menguji apakah rata-rata dari satu kelompok berbeda dengan rata-rata teoritis
Two-Tail Test digunakan ketika kita punya alasan kuat untuk menentukan arah hipotesis alternatifnya ke arah tertentu (hanya lebih besar atau hanya lebih kecil dari nilai parameter)
Two-Tail Test hanya ada pada parametric test
Two-Tail Test tidak bisa digunakan pada Proportion Z-test
Dalam menentukan plot visualisasi yang tepat, perlu adanya tujuan yang spesifik agar visualisasi yang ditampilkan relevan dan insightful. Jika kita ingin menampilkan perbandingan biaya rata-rata makan siang yang dikeluarkan oleh murid Purwadhika berdasarkan kelas dan jenis kelamin, maka plot yang tepat digunakan adalah
Horizontal bar plot
Histogram
Line plot
Scatterplot
Stacked bar plot
Ketika ingin menyimpan bilangan float pada MySQL, maka tipe data yang tepat digunakan adalah
INT
VARCHAR
FLOAT
BOOLEAN
DECIMAL
Mana diantara query berikut untuk mengambil waktu saat ini:
A. SELECT DATE ( NOW() ) as today;
B. SELECT DATE_FORMAT( NOW( ) , '%Y-%m-%d' ) as today;
A
B
A dan B
Tidak ada yang benar
Diantara pernyataan berikut terkait distribusi normal, mana pernyataan yang salah:
A. Distribusi normal memiliki nilai median dan mean yang berbeda
B. Untuk melihat distribusi normal perlu menggunakan histogram, scatterplot dan boxplot
C. Selain data numerik, kita juga harus memperhatikan distribusi normal pada data kategorikal
A
A dan B
A, B dan C
Semua jawaban salah
Diantara pernyataan berikut mana yang benar terkait uji hipotesis:
Kita tidak bisa melakukan uji hipotesis jika data yang dimiliki tidak terdistribusi normal
Z-test digunakan untuk menguji hipotesis perbedaan median
Wilcoxon, Mann-whitney U, Kruskal-Wallis dan Friedman merupakan uji hipotesis yang digunakan jika jumlah data yang dimiliki cukup besar
D'Agostino-Pearson bukan merupakan uji hipotesis
Manakah diantara pernyataan berikut yang benar terkait alternative hypothesis (Ha)?
Tidak ada perbedaan antara nilai TOEFL pelamar kelas DTI (Digital Talent Incubator) Purwadhika yang pernah bepergian ke luar negeri dengan yang belum pernah bepergian ke luar negeri
Kecepatan makan Tanboy Kun sama dengan Nex Carlos jika diberikan porsi yang bervariatif
Data gaji karyawan Purwadhika tidak mengikuti distribusi gaussian
Pengaruh bermain Valorant terhadap nilai siswa Purwadhika tidak signifikan
Jika kita ingin melihat korelasi antara harga dengan karat, maka visualisasi yang tepat digunakan adalah
Bar plot
Line plot
Boxplot
Scatterplot
Histogram
Jika kita memiliki distribusi nilai karat seperti pada gambar, maka istilah yang tepat untuk menggambarkan distribusi tersebut adalah
Uniform
Normal
Left-skewed
Negative-skewed
Positive-skewed
Jika kita memiliki tabel employees dengan kolom emp_no, birth_date, first_name, last_name, gender dan hire_date serta tabel salaries dengan kolom emp_no, salary, from_date dan to_date; maka agar dapat menghasilkan 5 nama lengkap karyawan dengan gaji di atas 100.000, query yang tepat digunakan adalah
Jika kita ingin menampilkan 5 nama kota, nama distrik dan nama negara dari tabel `city` dan `country` dengan luas permukaan (`SurfaceArea`) lebih dari 10 juta seperti pada gambar, maka query yang tepat digunakan adalah
Jika kita ingin menampilkan nama provinsi unik yang ada di pulau Sumatera pada database world seperti pada gambar, maka query yang tepat digunakan adalah
