wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Evaluación Módulo 4 - Ciencia de Datos

Total questions: 60

Worksheet time: 2hrs 0mins

Name
Class
Date
1.
¿Qué significa EDA en ciencia de datos?
a)
Exploratory Data Analysis
b)
Extended Data Analysis
c)
Essential Data Arrangement
d)
Estimation Data Approach
2.
¿Cuál es la diferencia principal entre EDA y Análisis Confirmatorio?
a)
EDA es confirmación de hipótesis, confirmatorio es exploración
b)
EDA es exploración sin hipótesis previas
c)
Ambos son idénticos
d)
Confirmatorio usa gráficos, EDA no
3.
¿Cuál es el objetivo del Análisis Inicial de Datos (IDA)?
a)
Validar modelos predictivos
b)
Realizar la inspección básica del conjunto de datos
c)
Generar visualizaciones avanzadas
d)
Calcular métricas de error
4.
En Pandas, ¿qué instrucción usamos para detectar valores faltantes en una columna?
a)
df.dropna()
b)
df.isnull().sum()
c)
df.empty()
d)
df.missing()
5.
¿Qué tipo de análisis corresponde a un histograma?
a)
Multivariado
b)
Univariado
c)
Bivariado
d)
Confirmatorio
6.
¿Cuál de los siguientes gráficos es útil para un análisis bivariado?
a)
Boxplot
b)
Histograma
c)
Diagrama de dispersión
d)
Heatmap
7.
¿Qué aplicación es un ejemplo de EDA en negocios?
a)
Entrenamiento de modelos
b)
Segmentación de clientes
c)
Test de normalidad
d)
Validación de supuestos
8.
¿Qué medida estadística se utiliza en análisis de correlación?
a)
Moda
b)
Mediana
c)
Coeficiente de Pearson
d)
Percentil
9.
¿Qué ventaja ofrece el EDA antes de modelar?
a)
Evitar sesgos y suposiciones incorrectas
b)
Eliminar automáticamente outliers
c)
Sustituir la validación del modelo
d)
Generar automáticamente predicciones
10.
¿Qué librería de Python se utiliza comúnmente para visualización en EDA?
a)
NumPy
b)
Matplotlib
c)
TensorFlow
d)
Keras
11.
¿Qué tipo de variable es el nivel de satisfacción 'Bajo, Medio, Alto'?
a)
Cuantitativa discreta
b)
Categórica nominal
c)
Categórica ordinal
d)
Continua
12.
¿Cuál es la fórmula de la media aritmética?
a)
ΣXi / n
b)
Σ(Xi – X̄)² / n
c)
ΣFi / N
d)
ΣXi / (n–1)
13.
¿Qué medida no se ve afectada por valores atípicos?
a)
Media
b)
Moda
c)
Mediana
d)
Rango
14.
¿Qué función de NumPy calcula la mediana?
a)
np.mode()
b)
np.average()
c)
np.median()
d)
np.std()
15.
¿Qué representa la corrección de Bessel?
a)
Usar n en lugar de n–1
b)
Dividir entre n–1 para estimar varianza muestral
c)
Ajustar valores atípicos
d)
Normalizar los datos
16.
¿Qué medida de posición divide los datos en 10 partes iguales?
a)
Cuartil
b)
Percentil
c)
Decil
d)
Quintil
17.
¿Qué representa un outlier en un boxplot?
a)
Mediana
b)
Valor dentro de bigotes
c)
Punto fuera de los bigotes
d)
Rango intercuartílico
18.
¿Qué tipo de frecuencia muestra la proporción respecto al total?
a)
Frecuencia absoluta
b)
Frecuencia relativa
c)
Frecuencia acumulada
d)
Frecuencia absoluta acumulada
19.
¿Qué medida de dispersión es la raíz cuadrada de la varianza?
a)
Rango
b)
Desviación estándar
c)
Media absoluta
d)
Percentil
20.
¿Qué librería de Python se usa para calcular la moda?
a)
NumPy
b)
Pandas
c)
SciPy
d)
Matplotlib
21.
¿Qué indica una correlación positiva?
a)
Cuando X aumenta, Y disminuye
b)
Cuando X aumenta, Y aumenta
c)
No hay relación
d)
Relación no lineal
22.
¿Qué herramienta gráfica se usa para dos variables categóricas?
a)
Scatterplot
b)
Crosstab / Tabla de contingencia
c)
Heatmap
d)
Pairplot
23.
¿Qué gráfico es ideal para ver relación entre dos variables numéricas?
a)
Barplot
b)
Boxplot
c)
Scatterplot
d)
Countplot
24.
¿Qué rango de valores puede tomar el coeficiente de Pearson?
a)
0 a 1
b)
–1 a 1
c)
–∞ a +∞
d)
0 a ∞
25.
Si r = 0.85, ¿qué interpretación es correcta?
a)
Correlación positiva débil
b)
Correlación positiva fuerte
c)
Correlación negativa
d)
Sin relación
26.
¿Qué función en Pandas construye una tabla de contingencia?
a)
pd.cross_table()
b)
pd.crosstab()
c)
pd.contingency()
d)
pd.count()
27.
¿Cuál es la diferencia entre correlación y causalidad?
a)
La correlación siempre implica causalidad
b)
La causalidad siempre implica correlación
c)
La correlación mide asociación, la causalidad implica efecto directo
d)
No existe diferencia
28.
¿Qué valor de p indica que la correlación es estadísticamente significativa?
a)
p > 0.1
b)
p < 0.05
c)
p = 1
d)
p > 0.5
29.
¿Qué tipo de correlación describe r = –0.7?
a)
Positiva fuerte
b)
Negativa moderada
c)
Negativa fuerte
d)
Nula
30.
¿Qué librería de Python incluye pearsonr()?
a)
NumPy
b)
SciPy
c)
Pandas
d)
Matplotlib
31.
En regresión lineal simple, ¿qué representa β₀?
a)
Pendiente
b)
Intercepto
c)
Error
d)
Media
32.
¿Qué método se usa para calcular los coeficientes de regresión?
a)
Máxima verosimilitud
b)
Mínimos cuadrados
c)
Normalización
d)
PCA
33.
¿Qué mide el R² en un modelo de regresión?
a)
La media de errores
b)
La proporción de varianza explicada
c)
La dispersión residual
d)
El error absoluto medio
34.
¿Qué métrica penaliza más los errores grandes?
a)
MAE
b)
MSE
c)
d)
Moda
35.
¿Qué función de sklearn crea un modelo de regresión lineal?
a)
LinearRegression()
b)
LogisticRegression()
c)
Ridge()
d)
RegressionModel()
36.
¿Qué supuesto evalúa el test de Durbin-Watson en regresión múltiple?
a)
Linealidad
b)
Independencia de errores
c)
Homocedasticidad
d)
Normalidad
37.
¿Qué técnica elimina variables poco significativas en un modelo?
a)
Forward Selection
b)
Backward Elimination
c)
PCA
d)
Cross-validation
38.
¿Qué métrica ajusta el R² considerando el número de variables?
a)
R² ajustado
b)
AIC
c)
BIC
d)
Varianza
39.
¿Qué prueba evalúa la normalidad de errores?
a)
Shapiro-Wilk
b)
Durbin-Watson
c)
Pearson
d)
Jarque-Bera
40.
¿Qué librería de Python se usa para regresión lineal con métricas detalladas?
a)
TensorFlow
b)
Statsmodels
c)
Seaborn
d)
Matplotlib
41.
¿Cuál es la ventaja de Seaborn sobre Matplotlib?
a)
Paletas de colores y gráficos estadísticos por defecto
b)
Es más rápido
c)
Solo genera gráficos 3D
d)
Reemplaza a Pandas
42.
¿Qué función reemplaza a distplot()?
a)
histplot()
b)
plot()
c)
kdeplot()
d)
barplot()
43.
¿Qué parámetro en histplot() añade curva de densidad?
a)
density=True
b)
kde=True
c)
smooth=True
d)
curve=True
44.
¿Qué combinación gráfica permite analizar múltiples variables a la vez?
a)
regplot
b)
pairplot
c)
barplot
d)
heatmap
45.
¿Qué variante de jointplot incluye regresión?
a)
kind='scatter'
b)
kind='reg'
c)
kind='hex'
d)
kind='kde'
46.
¿Qué gráfico es útil para detectar outliers en categorías?
a)
barplot
b)
countplot
c)
boxplot
d)
regplot
47.
¿Qué función genera un mapa de calor en Seaborn?
a)
mapplot()
b)
heatmap()
c)
cmap()
d)
barplot()
48.
¿Qué gráfico combina boxplot y densidad?
a)
violinplot
b)
scatterplot
c)
regplot
d)
countplot
49.
¿Qué parámetro en pairplot colorea según variable categórica?
a)
color
b)
hue
c)
group
d)
cat
50.
¿Qué librería usa Seaborn como base?
a)
Statsmodels
b)
NumPy
c)
Matplotlib
d)
TensorFlow
51.
¿Qué módulo de Matplotlib se importa comúnmente como plt?
a)
matplotlib.graphs
b)
pyplot
c)
charts
d)
figplot
52.
¿Qué representa 'Figure' en Matplotlib?
a)
Los datos
b)
El contenedor principal del gráfico
c)
Los ejes X e Y
d)
La leyenda
53.
¿Qué crea plt.plot(x,y)?
a)
Un histograma
b)
Una línea conectando puntos
c)
Un boxplot
d)
Un diagrama de barras
54.
¿Qué parámetro ajusta el tamaño de la figura?
a)
figsize
b)
size
c)
length
d)
plotdim
55.
¿Qué método guarda un gráfico en archivo?
a)
plt.save()
b)
plt.savefig()
c)
plt.export()
d)
plt.to_file()
56.
¿Qué diagrama es más apropiado para distribución de frecuencias?
a)
Boxplot
b)
Histograma
c)
Pie chart
d)
Line chart
57.
¿Qué elemento muestra la explicación de colores y series?
a)
Title
b)
Legend
c)
Label
d)
Axis
58.
¿Qué gráfico muestra relación entre dos variables?
a)
Scatterplot
b)
Pie chart
c)
Boxplot
d)
Histogram
59.
¿Qué parámetro controla los límites del eje Y?
a)
set_ylim()
b)
set_xlim()
c)
ylimit()
d)
axis_y()
60.
¿Qué librería complementa Matplotlib para cálculos numéricos?
a)
NumPy
b)
Seaborn
c)
Statsmodels
d)
TensorFlow