wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Evaluación Ingeniero de datos

Total questions: 34

Worksheet time: 17mins

Name
Class
Date
1.

¿Qué es un almacén de datos (data warehouse)?

a)

a) Un sistema de almacenamiento de archivos sin estructura.

b)

b) Una base de datos transaccional en tiempo real.

c)

c) Un almacén centralizado y estructurado para datos históricos.

d)

d) Un repositorio de datos en bruto sin procesar.

2.

¿Cuál es el principal objetivo de las bases de datos NoSQL?

a)

Permite esquemas flexibles y dinámicos.

b)

Garantizar la integridad y consistencia de los datos.

c)

Escalar horizontalmente para manejar grandes volúmenes de datos.

d)

Reducir la redundancia de los datos mediante tablas normalizadas.

3.

¿Qué tipo de base de datos es más adecuado para almacenar y analizar datos altamente estructurados, como registros de clientes y transaccionesen un sistema de gestión de soporte técnico?

a)

Base de datos SQL.

b)

Base de datos NoSQL.

c)

Base de datos de grafos.

d)

Base de datos de documentos.

4.

¿Cuál de las siguientes bases de datos NoSQL es más adecuada para consultas que involucran análisis de datos geoespaciales y ubicación?

a)

Base de datos de grafos.

b)

Base de datos de documentos.

c)

Base de datos de clave-valor.

d)

Base de datos de columnas amplias.

5.

¿Cuál es el primer paso en el proceso de análisis de datos?

a)

Realizar una visualización de los datos.

b)

Definir los objetivos del análisis.

c)

Limpieza y preparación de los datos.

d)

Aplicar algoritmos de aprendizaje automático.

6.

¿Cuál es la principal ventaja de utilizar una arquitectura de microservicios en el contexto de datos?

a)

Mayor escalabilidad y flexibilidad.

b)

Menor complejidad y costos.

c)

Mejor seguridad y encriptación.

d)

Mayor rendimiento en tiempo real.

7.

¿Qué tipo de índice se utiliza comúnmente para mejorar el rendimiento de consultas en una base de datos?

a)

Índice secundario (secondary index).

b)

Índice primario (primary index).

c)

Índice compuesto (composite index).

d)

Índice único (unique index).

8.

¿Qué es la normalización de bases de datos?

a)

Un proceso para eliminar duplicados en una tabla.

b)

Una técnica para mejorar el rendimiento de consultas.

c)

Un método para estructurar una base de datos en tablas relacionadas.

d)

Un procedimiento para comprimir y reducir el tamaño de la base de datos.

9.

¿Cuál de las siguientes opciones describe mejor el concepto de un índice clustered en una base de datos?

a)

Un índice que ordena físicamente los registros de una tabla en función de los valores de una columna

b)

Un índice que permite la inclusión de valores nulos en una columna

c)

Un índice que relaciona dos tablas en una base de datos

d)

Un índice que mejora el rendimiento de las consultas en una base de datos

10.

¿Cuál de las siguientes opciones describe mejor el concepto de una transacción ACID en una base de datos?

a)

Una transacción que se ejecuta de manera rápida y eficiente

b)

Una transacción que asegura la disponibilidad de los datos en todo momento

c)

Una transacción que cumple con los principios de atomicidad, consistencia, aislamiento y durabilidad

d)

Una transacción que permite la inclusión de valores nulos en una columna

11.

¿Cuál de las siguientes opciones representa una métrica comúnmente utilizada para evaluar la precisión de un modelo de aprendizaje automático?

a)

Fórmula de Black-Scholes

b)

Puntuación de Fischer

c)

Matriz de confusión

d)

Índice de Herfindahl-Hirschman

12.

¿Cuál de las siguientes técnicas se utiliza para identificar valores atípicos o anómalos en un conjunto de datos?

a)

Regresión lineal

b)

Análisis factorial

c)

Prueba t de Student

d)

Diagrama de caja y bigotes

13.

¿Cuál de las siguientes técnicas se utiliza para realizar análisis de segmentación de clientes?

a)

Regresión logística

b)

Análisis de componentes principales

c)

Árboles de decisión

d)

Clustering

14.

¿Cuál de las siguientes opciones representa una métrica comúnmente utilizada para evaluar la calidad de un modelo de clasificación?

a)

AUC-ROC

b)

R cuadrado

c)

Coeficiente de determinación

d)

Exactitud

15.

¿Cuál de las siguientes técnicas se utiliza para identificar las características más relevantes en un conjunto de datos?

a)

Regresión lineal

b)

Análisis de varianza

c)

Prueba de hipótesis

d)

Análisis de importancia de características

16.

¿Qué es el análisis de series temporales?

a)

Un método para analizar datos multidimensionales

b)

Un enfoque para analizar datos categóricos

c)

Una técnica para analizar datos en función del tiempo

d)

Un algoritmo de aprendizaje automático para clasificar datos no etiquetados

17.

¿Cuál de las siguientes técnicas se utiliza para realizar pronósticos o predicciones futuras basadas en datos históricos?

a)

Regresión logística

b)

Análisis factorial

c)

Modelos ARIMA

d)

Análisis de componentes principales

18.

¿Cuál de las siguientes opciones describe mejor el concepto de minería de datos?

a)

Un proceso para descubrir patrones y tendencias ocultas en grandes conjuntos de datos

b)

Un método para analizar datos numéricos utilizando gráficos y diagramas

c)

Un proceso para seleccionar características relevantes para el análisis

d)

Un algoritmo de aprendizaje automático para clasificar datos no etiquetados

19.

¿Cuál es el objetivo principal de la gobernanza de datos?

a)

Garantizar que los datos estén siempre disponibles.

b)

Asegurar que los datos sean almacenados en un data lake.

c)

Cumplir con regulaciones y políticas de privacidad.

d)

Implementar una arquitectura de microservicios.

20.

¿Cuál de las siguientes afirmaciones sobre un data lake es correcta?

a)

Los datos en un data lake están altamente estructurados.

b)

Un data lake permite almacenar datos sin procesar y no estructurados.

c)

Un data lake es adecuado para almacenar solo datos transaccionales.

d)

Los datos en un data lake no requieren ninguna gobernanza.

21.

¿Cuál es la principal ventaja de un enfoque de "data streaming" sobre el procesamiento por lotes?

a)

Mayor escalabilidad en entornos de pocos recursos.

b)

Menor latencia en el procesamiento de datos.

c)

Mayor capacidad de almacenamiento en la nube.

d)

Los datos en un data lake no requieren ninguna gobernanza.

22.

¿Cuál de las siguientes tecnologías se utiliza comúnmente para implementar la seguridad en una arquitectura de datos?

a)

Apache Hadoop

b)

Elasticsearch

c)

Kerberos

d)

Redis

23.

¿Qué tipo de análisis se utiliza para descubrir patrones o relaciones en grandes conjuntos de datos?

a)

Análisis descriptivo.

b)

Análisis predictivo.

c)

Análisis exploratorio.

d)

Análisis de regresión.

24.

¿Cuál de las siguientes declaraciones es cierta sobre la regresión lineal?

a)

Es un método de clasificación de datos.

b)

Se utiliza para visualizar datos en gráficos circulares.

c)

Encuentra la relación lineal entre dos variables.

d)

Es una técnica para el análisis de texto.

25.

¿Qué técnica de aprendizaje automático se utiliza para clasificar datos en categorías discretas?

a)

Regresión logística.

b)

Árboles de decisión.

c)

K-means clustering.

d)

Regresión lineal.

26.

¿Qué función cumple el índice de correlación de Pearson en el análisis de datos?

a)

Identificar valores atípicos en un conjunto de datos.

b)

Medir la dispersión de datos alrededor de la media.

c)

Evaluar la relación lineal entre dos variables.

d)

Calcular la diferencia entre el valor más grande y más pequeño.

27.

¿Cuál es el objetivo principal del análisis descriptivo de datos?

a)

Hacer predicciones sobre eventos futuros.

b)

Descubrir patrones y relaciones ocultas en los datos.

c)

Resumir y visualizar datos de manera concisa y comprensible.

d)

Clasificar datos en grupos similares.

28.

¿Cuál de las siguientes opciones describe mejor una arquitectura de datos orientada a servicios (SOA)?

a)

Una arquitectura donde todos los datos se almacenan en un único repositorio central.

b)

Una arquitectura que utiliza múltiples bases de datos independientes para cada departamento.

c)

Una arquitectura en la que los datos se organizan en capas según su nivel de acceso y procesamiento.

d)

Una arquitectura que utiliza servicios independientes para acceder y manipular datos.

29.

¿Cuál de las siguientes afirmaciones es cierta sobre el data mart?

a)

Es un sistema que integra datos de diferentes fuentes para análisis y toma de decisiones.

b)

Es un conjunto de herramientas para analizar datos en tiempo real.

c)

Es una copia exacta de la base de datos de producción utilizada para pruebas.

d)

Es una base de datos que almacena datos críticos para el funcionamiento diario de una empresa.

30.

¿Qué componente de la arquitectura de datos es responsable de garantizar la integridad y calidad de los datos almacenados?

a)

Base de datos relacional.

b)

Sistema de gestión de bases de datos (DBMS).

c)

Proceso de ETL (Extracción, Transformación y Carga).

d)

Diccionario de datos.

31.

¿Cuál de las siguientes opciones es una medida de seguridad para proteger los datos en tránsito durante su transferencia entre sistemas?

a)

Uso de un cortafuegos en el servidor de la base de datos.

b)

Implementación de políticas de seguridad para los empleados.

c)

Cifrado de datos mediante protocolos seguros como SSL/TLS.

d)

Respaldos regulares de la base de datos.

32.

¿Cuál de las siguientes opciones describe mejor el concepto de "privacidad por diseño"?

a)

La implementación de medidas de seguridad solo después de un incidente de seguridad.

b)

La protección de la privacidad de los datos solo en situaciones de alto riesgo.

c)

La integración de medidas de seguridad desde la etapa inicial del diseño de sistemas y aplicaciones.

d)

La eliminación de datos personales para evitar problemas de privacidad.

33.

¿Cuál de las siguientes opciones es una medida de seguridad para proteger los datos almacenados en una base de datos frente a ataques de inyección de SQL?

a)

Implementar un cortafuegos en la red de la empresa.

b)

Utilizar contraseñas seguras para el acceso a la base de datos.

c)

Validar y sanitizar las entradas de usuario antes de procesarlas en las consultas SQL.

d)

Encriptar todos los datos almacenados en la base de datos.

34.

¿Cuál de las siguientes opciones es una práctica de seguridad recomendada para proteger los datos en un entorno de almacenamiento en la nube?

a)

Utilizar contraseñas seguras para el acceso a la base de datos.

b)

Utilizar servicios de almacenamiento en la nube con cifrado de datos.

c)

Implementar autenticación multifactor para acceder a los datos en la nube.

d)

Restringir el acceso a la nube desde cualquier dispositivo.