WorksheetsPreguntas sobre Ingeniería de Datos
Total questions: 23
Worksheet time: 12mins
¿Por qué se le llama al ingeniero de datos el “arquitecto invisible de la información”?
Porque trabaja siempre en segundo plano
Porque convierte el caos de la información en conocimiento útil
Porque diseña solo bases de datos relacionales
Porque se dedica exclusivamente a la seguridad
¿Cuál de estas es una función principal de un ingeniero de datos?
Gestión de infraestructura
Creación de pipelines
Calidad y seguridad de datos
Todas las anteriores
¿Con qué perfiles profesionales suele colaborar un ingeniero de datos?
Científicos de datos, analistas de negocio y desarrolladores
Únicamente con administradores de bases de datos
Solo con equipos de marketing
Con diseñadores gráficos
¿Qué lenguaje es más versátil para ETL y machine learning?
R
Python
Scala
SQL
¿Qué framework permite procesamiento distribuido en memoria a gran escala?
Hadoop
Apache Kafka
Apache Spark
PostgreSQL
¿Qué metodología describe la extracción, transformación y carga de datos?
CI/CD
ETL/ELT
Scrum
Data Mesh
¿Cuál es la principal diferencia entre datos estructurados y semi-estructurados?
Los estructurados siempre están en archivos JSON
Los semi-estructurados no tienen ninguna organización
Los estructurados tienen un formato tabular rígido y los semi-estructurados esquemas flexibles
Los semi-estructurados requieren bases de datos relacionales
¿Cuál de los siguientes es un ejemplo de dato semi-estructurado?
Registros de ventas en SQL
JSON de una API
Video en YouTube
Texto libre en un correo electrónico
Aproximadamente, ¿qué porcentaje de la información empresarial corresponde a datos no estructurados?
20%
40%
60%
80%
¿En qué casos es más recomendable un Data Warehouse que un Data Lake?
Para análisis exploratorio y machine learning
Para reportes financieros y dashboards ejecutivos
Para almacenamiento de imágenes y videos
Para logs de servidores sin procesar
¿Qué ventaja principal ofrece el enfoque schema-on-read en un Data Lake?
Define la estructura de los datos al momento de consulta
Obliga a definir el esquema antes de almacenar
Aumenta el costo del almacenamiento
Requiere transformación previa de datos
Menciona una tecnología clave usada en los Data Lakehouse:
MongoDB
Redis
Delta Lake
MySQL
¿Qué tipo de base de datos garantiza transacciones ACID e integridad referencial?
NoSQL
Relacionales (SQL)
Grafos
Columnar
¿Qué tipo de base de datos NoSQL es más adecuada para almacenar relaciones complejas como redes sociales?
Documentales
Grafos
Clave-valor
Columnar
¿Cuál es la diferencia principal entre bases de datos relacionales y NoSQL?
SQL es más rápido en todos los casos
NoSQL no permite consultas complejas
SQL tiene esquemas fijos y NoSQL esquemas flexibles
NoSQL no puede escalar horizontalmente
¿Qué servicio de Azure permite la orquestación de pipelines de datos?
Azure Synapse Analytics
Azure Data Factory
Azure Databricks
Microsoft Fabric
¿Qué servicio de Google Cloud es un data warehouse serverless con machine learning integrado?
BigQuery
Cloud Dataflow
Cloud Pub/Sub
Cloud SQL
¿Qué herramienta de AWS permite ejecutar clusters gestionados de Hadoop y Spark?
AWS Glue
Amazon Redshift
AWS EMR
DynamoDB
¿Qué herramienta open source usa DAGs para definir workflows como código?
dbt
Apache Airflow
Delta Lake
Apache Kafka
¿Qué capa open source permite transacciones ACID sobre data lakes?
MongoDB
Delta Lake
Redis
CouchDB
¿Qué tendencia emergente propone arquitecturas descentralizadas y domain-driven?
Data Mesh
Edge Computing
Machine Learning Ops
Sustainability
¿Por qué la sostenibilidad es relevante en la ingeniería de datos?
Porque reduce el consumo energético en data centers
Porque acelera las consultas SQL
Porque disminuye el costo del software
Porque evita el vendor lock-in
Según el documento, ¿qué papel cumple el ingeniero de datos respecto a los datos como “nuevo petróleo”?
Es quien los extrae de la fuente
Es quien los refina para generar valor
Es quien los compra y vende
Es quien los archiva sin transformación
