NEW
Font size
WorksheetsModule 2 Review
Total questions: 20
Worksheet time: 58mins
Perintah agar dapat menampilkan data dari baris ke 3 sampai 10 pada kolom yang mempunyai nama "Restoran A" dan "Restoran B"
df.loc[3:11, ["Restoran A","Restoran B"]]
df[2:10][["Restoran A","Restoran B"]]
df.iloc[2:10, ["Restoran A","Restoran B"]]
df[["Restoran A","Restoran B"]]
Semua benar
Fungsi yang digunakan saat kita ingin membuat angka acak berdistribusi normal adalah
numpy.random.randint()
numpy.random.randn()
numpy.random.random()
numpy.random.random_sample()
Manakah dari syntax ini yang akan mereturn index bernama "foo" dari DataFrame "df"?
df['foo']
Tidak ada jawaban yang benar
df.loc['foo',:]
df.loc[:,'foo']
df['foo'][:]
Mana diantara pernyataan berikut yang menjadi hal paling penting di Data Science?
jawaban
data
pertanyaan
Tidak ada jawaban benar
import numpy as np
arr = np.arange(1,21)
arr = arr.reshape(-1)
print(arr)
Output dari syntax ini adalah ...
[1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20]
[[1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20]]
[[ 1] [ 2] [ 3] [ 4] [ 5] [ 6] [ 7] [ 8] [ 9] [10] [11] [12] [13] [14] [15] [16] [17] [18] [19] [20]]
[20 19 18 17 16 15 14 13 12 11 10 9 8 7 6 5 4 3 2 1]
Error
F_onewayResult(statistic=4.809836065573772, pvalue=0.0163405142361861)
Kemungkinan kesimpulan yang dapat diambil dari hasil diatas adalah
Seluruh kelompok sample memiliki perbedaan rata-rata yang signifikan
Seluruh kelompok sample memiliki rata-rata yang sama
Salah satu kelompok sample memiliki rata-rata yang berbeda dari kelompok sample yang lainnya
from scipy.stats import ttest_1samp
import numpy as np
ages = np.round(np.random.normal(30,4,40))
ttest_1samp(ages,26)
Apakah perintah untuk melakukan uji T-test 1 sample sudah tepat?
Tepat
Salah
Mana diantara pilihan berikut yang memiliki urutan paling tepat dalam melakukan data analisis?
Conclusion, plan, problem, data, Analysis
Plan, problem, analysis, data, conclusion
Problem, plan, data, analysis, conclusion
Problem, data, plan, analysis, conclusion
Barplot paling sesuai digunakan untuk melihat aggregate data numerik berdasarkan suatu kategori.
Benar
Salah
Metode paling tepat untuk melihat pusat tendensi untuk data kualitatif?
Median
Mean
Modus
Standar deviasi
Plot yang paling tepat untuk melihat hubungan antar 2 variabel adalah
Boxplot
Bar Plot
Scatter Plot
Histogram
Manakah dari berikut ini yang mewakili hipotesis nol dan alternatif yang sesuai?
Tinggi rata-rata wanita lebih besar dari 64
(μ = rata-rata)
H₀ : μ > 64
Hₐ : μ ≠ 64
H₀: μ < 64
Hₐ: μ > 64
H₀ : μ = 64
Hₐ : μ ≠ 64
H₀: μ > 64
Hₐ: μ < 64
Sebuah bank secara acak mensurvei 50 pelanggannya melalui surat untuk mengetahui bagaimana pelanggan menggunakan layanan mobile banking-nya. Survei menemukan bahwa hanya 11 dari 50 pelanggan yang menggunakan layanan tersebut.
Isi blank berikut:
Jika cabang memiliki 1.700 nasabah, sekitar _____ nasabah menggunakan layanan mobile banking.
374
3.740
37
1.326
Apa yang terjadi ketika kita mengalikan DataFrame seperti df * 2?
Menggandakan baris dataframe
Memunculkan pesan error "bad operand type"
Menggandakan kolom dataframe
Menggandakan setiap elemen dataframe
Uji hipotesis apa yang paling cocok untuk menajwab pertanyaan "Apakah rata-rata tekanan darah peserta sebelum dan sesudah meditasi sama?"
Chi-square Test
Mann Whitney U Test
Wilcoxon Test
Kruskal-Wallis Test
Proportion Z-Test
Dengan SQL, bagaimana kita memilih semua catatan dari tabel bernama "Person" di mana nilai kolom "FirstName" mengandung karakter "al"
SELECT * FROM Persons WHERE FirstName LIKE "%al%"
SELECT * FROM Persons WHERE FirstName LIKE "_al_"
SELECT * FROM Persons WHERE FirstName = "al"
SELECT * FROM Persons WHERE FirstName LIKE "%al"
1. Kedua variabel memiliki korelasi yang cukup kuat
2. Kedua variabel memiliki korelasi yang cukup lemah
3. Kedua variabel memiliki korelasi negatif
4. Kedua variabel memiliki korelasi positif
Berdasarkan scatter plot ini, pernyataan yang tepat adalah
1 dan 3
1 dan 4
2 dan 3
2 dan 4
Diberi dataset bernama 'df' yang berisi 5 kolom dan 10 baris, temukan output dari kode di bawah ini?
print(len(df.columns))
10
5
error
Perintah untuk mengurutkan DataFrame bernama df berdasarkan suatu "nama_kolom" adalah
df.sort_index(axis=1)
df.sort_values("nama_kolom")
df.reorder_levels("nama_kolom")
Diantara visualisasi berikut, yang paling tepat untuk mencari data outlier adalah
Scatter Plot
Bar Plot
Histogram
Box Plot
