wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Module 2 Review

Total questions: 20

Worksheet time: 58mins

Name
Class
Date
1.

Perintah agar dapat menampilkan data dari baris ke 3 sampai 10 pada kolom yang mempunyai nama "Restoran A" dan "Restoran B"

a)

df.loc[3:11, ["Restoran A","Restoran B"]]

b)

df[2:10][["Restoran A","Restoran B"]]

c)

df.iloc[2:10, ["Restoran A","Restoran B"]]

d)

df[["Restoran A","Restoran B"]]

e)

Semua benar

2.

Fungsi yang digunakan saat kita ingin membuat angka acak berdistribusi normal adalah

a)

numpy.random.randint()

b)

numpy.random.randn()

c)

numpy.random.random()

d)

numpy.random.random_sample()

3.

Manakah dari syntax ini yang akan mereturn index bernama "foo" dari DataFrame "df"?

a)

df['foo']

b)

Tidak ada jawaban yang benar

c)

df.loc['foo',:]

d)

df.loc[:,'foo']

e)

df['foo'][:]

4.

Mana diantara pernyataan berikut yang menjadi hal paling penting di Data Science?

a)

jawaban

b)

data

c)

pertanyaan

d)

Tidak ada jawaban benar

5.

import numpy as np

arr = np.arange(1,21)

arr = arr.reshape(-1)

print(arr)

Output dari syntax ini adalah ...

a)


[1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20]

b)


[[1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20]]

c)

[[ 1] [ 2] [ 3] [ 4] [ 5] [ 6] [ 7] [ 8] [ 9] [10] [11] [12] [13] [14] [15] [16] [17] [18] [19] [20]]

d)

[20 19 18 17 16 15 14 13 12 11 10 9 8 7 6 5 4 3 2 1]

e)

Error

6.

F_onewayResult(statistic=4.809836065573772, pvalue=0.0163405142361861)

Kemungkinan kesimpulan yang dapat diambil dari hasil diatas adalah

a)

Seluruh kelompok sample memiliki perbedaan rata-rata yang signifikan

b)

Seluruh kelompok sample memiliki rata-rata yang sama

c)

Salah satu kelompok sample memiliki rata-rata yang berbeda dari kelompok sample yang lainnya

7.

from scipy.stats import ttest_1samp

import numpy as np

ages = np.round(np.random.normal(30,4,40))

ttest_1samp(ages,26)

Apakah perintah untuk melakukan uji T-test 1 sample sudah tepat?

a)

Tepat

b)

Salah

8.

Mana diantara pilihan berikut yang memiliki urutan paling tepat dalam melakukan data analisis?

a)

Conclusion, plan, problem, data, Analysis

b)

Plan, problem, analysis, data, conclusion

c)

Problem, plan, data, analysis, conclusion

d)

Problem, data, plan, analysis, conclusion

9.

Barplot paling sesuai digunakan untuk melihat aggregate data numerik berdasarkan suatu kategori.

a)

Benar

b)

Salah

10.

Metode paling tepat untuk melihat pusat tendensi untuk data kualitatif?

a)

Median

b)

Mean

c)

Modus

d)

Standar deviasi

11.

Plot yang paling tepat untuk melihat hubungan antar 2 variabel adalah

a)

Boxplot

b)

Bar Plot

c)

Scatter Plot

d)

Histogram

12.

Manakah dari berikut ini yang mewakili hipotesis nol dan alternatif yang sesuai?

Tinggi rata-rata wanita lebih besar dari 64

(μ = rata-rata)

a)

H₀ : μ > 64

Hₐ : μ ≠ 64

b)

H₀: μ < 64

Hₐ: μ > 64

c)

H₀ : μ = 64

Hₐ : μ ≠ 64

d)

H₀: μ > 64

Hₐ: μ < 64

13.

Sebuah bank secara acak mensurvei 50 pelanggannya melalui surat untuk mengetahui bagaimana pelanggan menggunakan layanan mobile banking-nya. Survei menemukan bahwa hanya 11 dari 50 pelanggan yang menggunakan layanan tersebut.

Isi blank berikut:

Jika cabang memiliki 1.700 nasabah, sekitar _____ nasabah menggunakan layanan mobile banking.

a)

374

b)

3.740

c)

37

d)

1.326

14.

Apa yang terjadi ketika kita mengalikan DataFrame seperti df * 2?

a)

Menggandakan baris dataframe

b)

Memunculkan pesan error "bad operand type"

c)

Menggandakan kolom dataframe

d)

Menggandakan setiap elemen dataframe

15.

Uji hipotesis apa yang paling cocok untuk menajwab pertanyaan "Apakah rata-rata tekanan darah peserta sebelum dan sesudah meditasi sama?"

a)

Chi-square Test

b)

Mann Whitney U Test

c)

Wilcoxon Test

d)

Kruskal-Wallis Test

e)

Proportion Z-Test

16.

Dengan SQL, bagaimana kita memilih semua catatan dari tabel bernama "Person" di mana nilai kolom "FirstName" mengandung karakter "al"

a)

SELECT * FROM Persons WHERE FirstName LIKE "%al%"

b)

SELECT * FROM Persons WHERE FirstName LIKE "_al_"

c)

SELECT * FROM Persons WHERE FirstName = "al"

d)

SELECT * FROM Persons WHERE FirstName LIKE "%al"

17.
  1. 1. Kedua variabel memiliki korelasi yang cukup kuat

  2. 2. Kedua variabel memiliki korelasi yang cukup lemah

  3. 3. Kedua variabel memiliki korelasi negatif

  4. 4. Kedua variabel memiliki korelasi positif

Berdasarkan scatter plot ini, pernyataan yang tepat adalah

a)

1 dan 3

b)

1 dan 4

c)

2 dan 3

d)

2 dan 4

18.

Diberi dataset bernama 'df' yang berisi 5 kolom dan 10 baris, temukan output dari kode di bawah ini?

print(len(df.columns))

a)

10

b)

5

c)

error

19.

Perintah untuk mengurutkan DataFrame bernama df berdasarkan suatu "nama_kolom" adalah

a)


df.sort_index(axis=1)

b)

df.sort_values("nama_kolom")

c)

df.reorder_levels("nama_kolom")

20.

Diantara visualisasi berikut, yang paling tepat untuk mencari data outlier adalah

a)

Scatter Plot

b)

Bar Plot

c)

Histogram

d)

Box Plot