WorksheetsUnidad 1 & 2
Total questions: 16
Worksheet time: 12mins
¿Cuál de las siguientes cosas pueden ser datos en Pandas?
un dict de python
un ndarray
un valor escalar
todos los anteriores
¿Qué función en la biblioteca de Pandas permite jugar con datos y crea nuevas variables?
apply
read_csv
pivot_table
merge
Cuál es el resultado de este código?
2 (2L, 4L) int64
4 (2L) int32
2 (4L) int64
2 (2L, 4L) int32
Como ploteas dos columnas de un DataFrame usando puntos?
import numpy as nup
import pandas as pnd
di = {'one' : nup.random.rand(10),
'two' : nup.random.rand(10)}
df = pnd.DataFrame(di)
df.plot(style=['o','rx'])
No se puede.
Se pueden usar lineas y barras pero not puntos.
df.plot(x='col_name_1', y='col_name_2', style='o')
¿Cuáles de los siguientes son los objetivos del Análisis de Datos Exploratorios (EDA)?
Probar de suposiciones de negocios
Generar hipótesis para su posterior análisis.
Preparar los datos para el modelado.
Todos los anteriores.
¿Cuál de los siguientes es el resultado del siguiente código de Python?
[ True False True True False True False]
[True False True False]
[True False True False True False]
[ True True False True False True False]
¿Cómo crearías una matriz de identidad en python?
Nota: la biblioteca numpy ha sido importada como np.
np.eye(3)
identity(3)
np.array([1, 0, 0], [0, 1, 0], [0, 0, 1])
Todos los anteriores.
[5, 11, 12] [5, 11, 12]
[5, 11, 12] [10, 11, 12]
[10, 11, 12] [10, 11, 12]
[10, 11, 12] [5, 11, 12]
[200 200 300 400 250] [200 200 300 400 250]
[100 200 300 400 250] [100 200 300 400 250]
[200 200 300 400 250] [100 200 300 400 250]
ninguno de estos
Si quisiera ver el rango intercuantil de una variable en un set de datos, que tipo de gráfico usaría?
Histograma
HeatMap
BoxPlot
Ninguno de los anteriores
Que es el Feature Engineering?
Es el proceso de utilizar el conocimiento de dominio de los datos para crear características que hacen que los algoritmos de aprendizaje automático funcionen.
Es el proceso de limpiado de datos para su posterior uso en algoritmos de aprendizaje automático
Es el proceso de rellenado de valores faltantes en un dataset con sus diferentes técnicas
Es el proceso de conversión de variables categóricas a variables binarias.
¿Cuales son las etapas del ciclo de vida de Data Science?
Recogida de datos, Tratamiento y Procesado de Datos, Entrenamiento, Testing, Visualizacion e Interpretacion
Recogida de datos,Graficado y Segmentacion, Entrenamiento, Testing, Visualizacion
Recogida de datos, Entrenamiento, Testing, Visualizacion
Recogida de datos, Tratamiento y Procesado de Datos, Entrenamiento, Determinacion de Tecnicismos
¿Qué es una libreria en programación?
Conjunto de clases, que poseen una serie de métodos y atributos
Puesto en el que se venden libros
Codigo que simula un comportamiento
Almacen de codigo individual de un usuario
¿Cómo se calculan los umbrales máximos y mínimos con el rango intercuantil para filtrar outliers?
q < Q1 - IQR*1.5
q > Q3 + IQR*1.5
q < Q3 + IQR*1.5
q > Q1 - IQR*1.5
q < Q1 - IQR*0.5
q > Q3 + IQR*0.5
q > Q1 - IQR*0.5
q < Q3 + IQR*0.5
¿Cúal es una diferencia entre Business intelligence y Data Science?
Uno es descriptivo y el otro prescriptivo
Uno hace analisis de los datos y el otro no
Uno usa estadisticas y el otro no
Uno utiliza grandes volumenes de datos y otro entre pequeños y medianos
¿Cúal de las siguientes no es una técnica del feature engineering?
Binning
One-Hot Encoding
Imputation
Distribution
