Font size
WorksheetsDS als Entscheidungstool
Total questions: 16
Worksheet time: 22mins
Long data-sets kommen häufiger vor bei...
Statistik
Machine Learning
Im Machine Learning wird ein Modell beispielsweise mit folgenden Größen evaluiert:
Konfidenzintervall
Accuracy
Recall
p-Value
Bei welchen der folgenden Methoden handelt es sich um "Unsupervised Learning"?
Klassifikation
Clustering
Dimensionsreduktion
Regression
Einen Train-Test Split gibt es nur für Methoden des "unsupervised learning".
Richtig
Falsch
Was sind typische Unterschiede zwischen "supervised" und "unsupervised" learning?
Welche Methode wird durch diese Formel beschrieben?
knn-Klassifikation
k-means
Lineare Regression
Entscheidungsbäume
Ist dies ein "tidy" data-frame?
Ja
Nein
Kreisen Sie alle Variablen in diesem Datensatz ein.
Kennzeichnen Sie Variablen, Werte und Beobachtungen in diesem Datensatz ein.
Welche Pre-processing Schritte kennen Sie? (Nennen Sie mehrere in einem Antwortfeld)
Gehen wir davon aus, dass absolut kein Muster hinter fehlenden Beobachtungen in einem Datensatz liegt bezeichnen wir diese Kategorie von Missing Values als (Abkürzung):
(a)
Welches Machine Learning Verfahren wird häufig zum Einsetzen von Missing Values verwendet?
Numerische Variablen müssen vor der Anwendung eines ML Algorithmus immer skaliert werden.
Ja
Nein
Anstatt eines Train-Test Splits können auch andere Verfahren, wie z.B. die k-Fold Cross Validation verwendet werden.
Richtig
Falsch
Das k in k-means steht für die Anzahl der umliegenden Beobachtungen.
Richtig
Falsch
Je niedriger der RMSE (root mean square error) desto besser.
Richtig
Falsch
