Worksheets2da Maratón
Total questions: 25
Worksheet time: 13mins
¿Qué es un "DF"?
Data Frame
Archivo de extensión .csv
Es el tamaño efectivo de la muestra
Un comando de RStudio
Sinónimo de "Unidad Muestral" en un DF
Observación
Fila
Dato
Columna
Una Columna es una Variable
Verdadero
Falso
Un Dato es una intersección entre una Observación y una Variable
Verdadero
Falso
Sinónimo de Outlier
Dato atípico
Los bigotes de un Boxplot
Dato NA
Observación incompleta
Es la cantidad de Casos Completos en un DF
Tamaño efectivo de la muestra
Representatividad de la muestra
Sesgo de la muestra
Asimetría de la muestra
¿Cómo se calcula el Tamaño Efectivo de la muestra?
nrow(DF)
sum(complete.cases(DF))
sum(!is.na(DF))
read_csv("DF.csv")
El Tamaño Efectivo de la variable X es la cantidad de datos NA en X
Verdadero
Falso
¿Cómo se calcula el Tamaño Efectivo de una variable X?
sum(!is.na(DF$X))
sum(complete.cases(DF$X))
length(DF$X, na.rm = F)
rowSums(!is.na(DF))
El DNI de una persona es una variable Numérica/Cuantitativa
Verdadero
Falso
Las variables Categóricas/Cualitativas nunca pueden ser números
Verdadero
Falso
Si una variable toma números con decimales, entonces es Numérica Continua
Verdadero
Falso
Si una variable no Numérica toma valores que se pueden ordenar, entonces es Categórica Ordinal
Verdadero
Falso
El comando ncol(DF) calcula la cantidad de filas y nrow(DF) la cantidad de columnas
Verdadero
Falso
Es un Descriptor Numérico conocido como el centro de masa de los datos
Media Aritmética
Mediana
Coeficiente de Variación
Moda
La Mediana siempre es el 2do Cuartil
Verdadero
Falso
El Coeficiente de Variación
No tiene unidades (Adimensional)
Comparte las unidades de la variable
sd()/mean()
mean()/sd()
Es una característica de aquellos descriptores cuyo resultado no se ve significativamente afectado por la presencia de outliers
Robustez
Representatividad
Aleatoriedad
`na.rm = T`
La Mediana es más robusta que la Media (promedio)
Verdadero
Falso
El Rango es más robusto que el Rango Intercuartil
Verdadero
Falso
Si en una variable la media > mediana, entonces su distribución está Sesgada hacia la Derecha (positivamente)
Verdadero
Falso
Comando de la librería dplyr que permite seleccionar variables
choose()
select()
filter()
group_by()
Verbo para seleccionar observaciones de acuerdo a requisitos específicos
select()
filter()
summarise()
choose()
Comando para ordenar las filas de acuerdo a los datos de una columna/variable
arrange()
count()
sort()
pull()
Verbo que retorna una Tabla de Frecuencias Absolutas
count()
group_by()
slice()
summarise()
