NEW
Font size
WorksheetsEvaluación Ingeniero de datos
Total questions: 34
Worksheet time: 17mins
¿Qué es un almacén de datos (data warehouse)?
a) Un sistema de almacenamiento de archivos sin estructura.
b) Una base de datos transaccional en tiempo real.
c) Un almacén centralizado y estructurado para datos históricos.
d) Un repositorio de datos en bruto sin procesar.
¿Cuál es el principal objetivo de las bases de datos NoSQL?
Permite esquemas flexibles y dinámicos.
Garantizar la integridad y consistencia de los datos.
Escalar horizontalmente para manejar grandes volúmenes de datos.
Reducir la redundancia de los datos mediante tablas normalizadas.
¿Qué tipo de base de datos es más adecuado para almacenar y analizar datos altamente estructurados, como registros de clientes y transaccionesen un sistema de gestión de soporte técnico?
Base de datos SQL.
Base de datos NoSQL.
Base de datos de grafos.
Base de datos de documentos.
¿Cuál de las siguientes bases de datos NoSQL es más adecuada para consultas que involucran análisis de datos geoespaciales y ubicación?
Base de datos de grafos.
Base de datos de documentos.
Base de datos de clave-valor.
Base de datos de columnas amplias.
¿Cuál es el primer paso en el proceso de análisis de datos?
Realizar una visualización de los datos.
Definir los objetivos del análisis.
Limpieza y preparación de los datos.
Aplicar algoritmos de aprendizaje automático.
¿Cuál es la principal ventaja de utilizar una arquitectura de microservicios en el contexto de datos?
Mayor escalabilidad y flexibilidad.
Menor complejidad y costos.
Mejor seguridad y encriptación.
Mayor rendimiento en tiempo real.
¿Qué tipo de índice se utiliza comúnmente para mejorar el rendimiento de consultas en una base de datos?
Índice secundario (secondary index).
Índice primario (primary index).
Índice compuesto (composite index).
Índice único (unique index).
¿Qué es la normalización de bases de datos?
Un proceso para eliminar duplicados en una tabla.
Una técnica para mejorar el rendimiento de consultas.
Un método para estructurar una base de datos en tablas relacionadas.
Un procedimiento para comprimir y reducir el tamaño de la base de datos.
¿Cuál de las siguientes opciones describe mejor el concepto de un índice clustered en una base de datos?
Un índice que ordena físicamente los registros de una tabla en función de los valores de una columna
Un índice que permite la inclusión de valores nulos en una columna
Un índice que relaciona dos tablas en una base de datos
Un índice que mejora el rendimiento de las consultas en una base de datos
¿Cuál de las siguientes opciones describe mejor el concepto de una transacción ACID en una base de datos?
Una transacción que se ejecuta de manera rápida y eficiente
Una transacción que asegura la disponibilidad de los datos en todo momento
Una transacción que cumple con los principios de atomicidad, consistencia, aislamiento y durabilidad
Una transacción que permite la inclusión de valores nulos en una columna
¿Cuál de las siguientes opciones representa una métrica comúnmente utilizada para evaluar la precisión de un modelo de aprendizaje automático?
Fórmula de Black-Scholes
Puntuación de Fischer
Matriz de confusión
Índice de Herfindahl-Hirschman
¿Cuál de las siguientes técnicas se utiliza para identificar valores atípicos o anómalos en un conjunto de datos?
Regresión lineal
Análisis factorial
Prueba t de Student
Diagrama de caja y bigotes
¿Cuál de las siguientes técnicas se utiliza para realizar análisis de segmentación de clientes?
Regresión logística
Análisis de componentes principales
Árboles de decisión
Clustering
¿Cuál de las siguientes opciones representa una métrica comúnmente utilizada para evaluar la calidad de un modelo de clasificación?
AUC-ROC
R cuadrado
Coeficiente de determinación
Exactitud
¿Cuál de las siguientes técnicas se utiliza para identificar las características más relevantes en un conjunto de datos?
Regresión lineal
Análisis de varianza
Prueba de hipótesis
Análisis de importancia de características
¿Qué es el análisis de series temporales?
Un método para analizar datos multidimensionales
Un enfoque para analizar datos categóricos
Una técnica para analizar datos en función del tiempo
Un algoritmo de aprendizaje automático para clasificar datos no etiquetados
¿Cuál de las siguientes técnicas se utiliza para realizar pronósticos o predicciones futuras basadas en datos históricos?
Regresión logística
Análisis factorial
Modelos ARIMA
Análisis de componentes principales
¿Cuál de las siguientes opciones describe mejor el concepto de minería de datos?
Un proceso para descubrir patrones y tendencias ocultas en grandes conjuntos de datos
Un método para analizar datos numéricos utilizando gráficos y diagramas
Un proceso para seleccionar características relevantes para el análisis
Un algoritmo de aprendizaje automático para clasificar datos no etiquetados
¿Cuál es el objetivo principal de la gobernanza de datos?
Garantizar que los datos estén siempre disponibles.
Asegurar que los datos sean almacenados en un data lake.
Cumplir con regulaciones y políticas de privacidad.
Implementar una arquitectura de microservicios.
¿Cuál de las siguientes afirmaciones sobre un data lake es correcta?
Los datos en un data lake están altamente estructurados.
Un data lake permite almacenar datos sin procesar y no estructurados.
Un data lake es adecuado para almacenar solo datos transaccionales.
Los datos en un data lake no requieren ninguna gobernanza.
¿Cuál es la principal ventaja de un enfoque de "data streaming" sobre el procesamiento por lotes?
Mayor escalabilidad en entornos de pocos recursos.
Menor latencia en el procesamiento de datos.
Mayor capacidad de almacenamiento en la nube.
Los datos en un data lake no requieren ninguna gobernanza.
¿Cuál de las siguientes tecnologías se utiliza comúnmente para implementar la seguridad en una arquitectura de datos?
Apache Hadoop
Elasticsearch
Kerberos
Redis
¿Qué tipo de análisis se utiliza para descubrir patrones o relaciones en grandes conjuntos de datos?
Análisis descriptivo.
Análisis predictivo.
Análisis exploratorio.
Análisis de regresión.
¿Cuál de las siguientes declaraciones es cierta sobre la regresión lineal?
Es un método de clasificación de datos.
Se utiliza para visualizar datos en gráficos circulares.
Encuentra la relación lineal entre dos variables.
Es una técnica para el análisis de texto.
¿Qué técnica de aprendizaje automático se utiliza para clasificar datos en categorías discretas?
Regresión logística.
Árboles de decisión.
K-means clustering.
Regresión lineal.
¿Qué función cumple el índice de correlación de Pearson en el análisis de datos?
Identificar valores atípicos en un conjunto de datos.
Medir la dispersión de datos alrededor de la media.
Evaluar la relación lineal entre dos variables.
Calcular la diferencia entre el valor más grande y más pequeño.
¿Cuál es el objetivo principal del análisis descriptivo de datos?
Hacer predicciones sobre eventos futuros.
Descubrir patrones y relaciones ocultas en los datos.
Resumir y visualizar datos de manera concisa y comprensible.
Clasificar datos en grupos similares.
¿Cuál de las siguientes opciones describe mejor una arquitectura de datos orientada a servicios (SOA)?
Una arquitectura donde todos los datos se almacenan en un único repositorio central.
Una arquitectura que utiliza múltiples bases de datos independientes para cada departamento.
Una arquitectura en la que los datos se organizan en capas según su nivel de acceso y procesamiento.
Una arquitectura que utiliza servicios independientes para acceder y manipular datos.
¿Cuál de las siguientes afirmaciones es cierta sobre el data mart?
Es un sistema que integra datos de diferentes fuentes para análisis y toma de decisiones.
Es un conjunto de herramientas para analizar datos en tiempo real.
Es una copia exacta de la base de datos de producción utilizada para pruebas.
Es una base de datos que almacena datos críticos para el funcionamiento diario de una empresa.
¿Qué componente de la arquitectura de datos es responsable de garantizar la integridad y calidad de los datos almacenados?
Base de datos relacional.
Sistema de gestión de bases de datos (DBMS).
Proceso de ETL (Extracción, Transformación y Carga).
Diccionario de datos.
¿Cuál de las siguientes opciones es una medida de seguridad para proteger los datos en tránsito durante su transferencia entre sistemas?
Uso de un cortafuegos en el servidor de la base de datos.
Implementación de políticas de seguridad para los empleados.
Cifrado de datos mediante protocolos seguros como SSL/TLS.
Respaldos regulares de la base de datos.
¿Cuál de las siguientes opciones describe mejor el concepto de "privacidad por diseño"?
La implementación de medidas de seguridad solo después de un incidente de seguridad.
La protección de la privacidad de los datos solo en situaciones de alto riesgo.
La integración de medidas de seguridad desde la etapa inicial del diseño de sistemas y aplicaciones.
La eliminación de datos personales para evitar problemas de privacidad.
¿Cuál de las siguientes opciones es una medida de seguridad para proteger los datos almacenados en una base de datos frente a ataques de inyección de SQL?
Implementar un cortafuegos en la red de la empresa.
Utilizar contraseñas seguras para el acceso a la base de datos.
Validar y sanitizar las entradas de usuario antes de procesarlas en las consultas SQL.
Encriptar todos los datos almacenados en la base de datos.
¿Cuál de las siguientes opciones es una práctica de seguridad recomendada para proteger los datos en un entorno de almacenamiento en la nube?
Utilizar contraseñas seguras para el acceso a la base de datos.
Utilizar servicios de almacenamiento en la nube con cifrado de datos.
Implementar autenticación multifactor para acceder a los datos en la nube.
Restringir el acceso a la nube desde cualquier dispositivo.
