wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

BIG DATA PC

Total questions: 50

Worksheet time: 2hrs 40mins

Name
Class
Date
1.

¿Qué tipos de datos podemos encontrar?

a)

Estructurados, semiestructurados, no estructurados

b)

Estructurados, superestructurados, no estructurados

c)

Estructurados, semiestructurados, no estructurados o todos los anteriores

d)

Ninguna de las anteriores

2.

¿Cuáles son las 2Vs de Big Data que se unieron a las 3 principales para formar las 5Vs de

Big Data?

a)

Valor y volumen

b)

Valor y velocidad

c)

Valor y veracidad

d)

Valor y visualización

3.

¿A cuál de las Vs de Big Data hace referencia hablar de tipos de datos?

a)

Velocidad

b)

Volatilidad

c)

Visualización

d)

Variedad

4.

¿Cuál de los siguientes enunciados hace referencia a lo que conceptualizaba la ley de

Moore?

a)

El procesamiento computacional aumentaría a mayor velocidad, sería más grande el

hardware requerido para su procesamiento y su eficiencia aumentaría con el pasar de

tiempo

b)

El procesamiento computacional aumentaría a mayor velocidad, sería más pequeño

el hardware requerido para su procesamiento y su eficiencia aumentaría con el pasar

de tiempo

c)

El procesamiento computacional aumentaría a menor velocidad, sería más pequeño

el hardware requerido para su procesamiento y su eficiencia aumentaría con el pasar

de tiempo

d)

Ninguna de las anteriores

5.

¿Cuál de las siguientes afirmaciones es la correcta?

a)

Las bases de datos de código abierto pueden ser bases de datos únicamente SQL

b)

Las bases de datos de código abierto pueden ser bases de datos únicamente NoSQL

c)

Las bases de datos de código abierto no pueden ser bases de datos SQL, ni tampoco

NoSQL

d)

Las bases de datos de código abierto pueden ser bases de datos tanto SQL como

NoSQL

6.

¿Cuál de los siguientes tipos de bases de datos es el que se enfoca en combinar distintos

tipos en un único servidor integrado?

a)

Base de datos en la nube

b)

Bases de datos de autogestión (o autónomas)

c)

Bases de datos distribuidas

d)

Bases de datos multimodelo

7.

¿Cuál de los siguientes modelos de bases de datos es el que incluye nociones de funciones,

encapsulación e identidad de objetos?

a)

Modelo de datos relacional

b)

Modelo de datos entidad-relación

c)

Modelo de datos basado en objetos

d)

Ninguna de las anteriores

8.

¿Cuál de las siguientes NO es una fase o etapa del procesamiento de datos?

a)

Recopilación de datos

b)

Preparación de datos

c)

Interpretación o salida de datos

d)

Integración de los datos a la nube

9.

¿Cuál de las siguientes es la explicación que se le puede dar al nivel de incertidumbre como

característica dependiente del proceso utilizado, el dominio y la interpretación?

a)

Variabilidad implícita que se deriva de las operaciones de agregación, y que modifica

la percepción de precisión del valor puntual

b)

Variabilidad explícita que se deriva de las operaciones de agregación, y que modifica

la percepción de precisión del valor puntual

c)

Variabilidad implícita que se deriva de las operaciones de connotación, y que modifica

la percepción de precisión del valor puntual

d)

Ninguna de las anteriores

10.

¿A qué hace referencia la frontera más allá de la cual la información pierde sentido y

aplicación?

a)

Alcance o ámbito

b)

Rango de validez

c)

Connotación

d)

Ninguna de las anteriores

11.

¿Cuál de las siguientes NO es una característica de los clústeres o sistemas distribuidos?

a)

Independencia de componentes

b)

Connotación

c)

Concurrencia

d)

Transparencia

12.

¿Cuál es la característica de los clústeres de datos o sistemas distribuidos que se da para

la escalabilidad de los sistemas de datos distribuidos?

a)

Apertura

b)

Concurrencia

c)

Independencia de componentes

d)

Modularidad

13.

¿A cuál de las siguientes hace referencia la letra "K" dentro de la sigla DIKW?

a)

Data

b)

Sabiduría

c)

Información

d)

Conocimiento

14.

El propósito hace referencia a que:

a)

Existe un objetivo asociado a la información que regula la manera de transformar los

datos en información

b)

Existe un objetivo asociado al conocimiento que regula la manera de transformar los

datos en información

c)

Posee una estructura de interrelaciones con otros conocimientos, bases teóricas y

experiencias

d)

Ninguna de las anteriores

15.

Es una técnica para agrupar data no etiquetada de acuerdo con sus similitudes o

diferencias

a)

Asociación

b)

Reducción de dimensionalidad

c)

Clustering

d)

Ninguna de las anteriores

16.

Es un algoritmo para asignar con precisión datos de prueba en categorías específicas

a)

Clasificación

b)

Regresión

c)

Clustering

d)

Ninguna de las anteriores

17.

¿Quiénes se encontraron la World Wide Web y desarrollaron HTML, URL y HTTP?

a)

Tim Berners-Lee y Robert Cailou

b)

Tim Berners-Lee y Robert Caiou

c)

Tim Berners-Lee y Robert Kailliaw

d)

Tim Berners-Lee y Robert Cailliau

18.

¿A cuál de las grandes fases de la evolución de Big Data se hace referencia cuando se

habla de contenido estructurado basado en SGBD?

a)

Fase 3 de Big Data: 2010-presente

b)

Fase 1 de Big Data: 1970-2000

c)

Fase 2 de Big Data: 2000-2010

d)

Ninguna de las anteriores

19.

¿A qué se refiere la sigla HMI?

a)

Ninguna de las anteriores

b)

Human-Machine Introduction

c)

Human-Machine Introspective

d)

Human-Machine Interface

20.

¿Cuál de las siguientes profesiones es la que Harvard Business Review consideró como

la más deseada del siglo XXI en 2012?

a)

Desarrollador Blockchain

b)

Científico de datos

c)

Desarrollador de Hadoop

d)

Ninguna de las anteriores

21.

¿Cuál de los siguientes organismos brinda la siguiente definición sobre gobernanza de

datos?

"Es un sistema de derechos de decisión y responsabilidades para los procesos relacionados

con la información, ejecutado de acuerdo con modelos acordados que describen quién puede

tomar qué acciones con qué información y cuándo, bajo qué circunstancias, utilizando qué

métodos."

a)

Data Governance Institute

b)

Data Government Institute

c)

Data Governance Institution

d)

Ninguna de las anteriores

22.

Es la actividad del gobierno de datos donde se da el cumplimiento de las regulaciones de

la organización tanto gubernamentales como del sector al que pertenece la organización.

a)

Cumplimiento estructural

b)

Cumplimiento legislativo

c)

Cumplimiento normativo

d)

Cumplimiento organizacional

23.

¿Cuáles de las siguientes son actividades del gobierno de datos?

a)

Definir estrategia de información, proyectos de gestión de datos, valoración de

activos, promoción y comunicación

b)

Definir estrategia de datos, proyectos de gestión de datos, valoración de activos,

promoción y comunicación

c)

Definir estrategia de datos, proyectos de gestión de información, valoración de

activos, promoción y comunicación

d)

Ninguna de las anteriores

24.

¿Cuál de las siguientes es una ventaja del gobierno de datos?

a)

Toma de decisiones más acertadas y oportunas

b)

Mejora los controles de costes

c)

Todas las anteriores

d)

Gestión de riesgos con más facilidad

25.

¿A qué hace referencia el data steward?

a)

Al propietario de datos

b)

Al registrador de datos

c)

Al comité directivo

d)

Al administrador de datos

26.

¿En cuál de los siguientes sectores se tiene como un desafío importante el fraude y

compliance?

a)

Financiero

b)

Salud

c)

Telecomunicaciones

d)

Gobierno

27.

¿Cuáles son los desafíos de los servicios financieros?

a)

Fraude y compliance, antilavado de criptos, impulsar la innovación, análisis normativo

y de cumplimiento financiero

b)

Fraude y compliance, antilavado de dinero, impulsar la tecnología, análisis normativo

y de cumplimiento financiero

c)

Fraude y compliance, antilavado de dinero, impulsar la innovación, análisis normativo

y de cumplimiento financiero

d)

Fraude y compliance, antilavado de dinero, impulsar la innovación, análisis normativo

y de cumplimiento legal

28.

El customer lifetime value es un desafío propio del sector:

a)

Retail

b)

Financiero

c)

Salud

d)

Gaming

29.

La optimización de producción es un desafío propio del sector:

a)

Retail

b)

Telecomunicaciones

c)

Bienes raíces

d)

Manufactura

30.

Los informes Ad Hoc y OLAP forman parte de:

a)

Analítica tradicional

b)

Analítica avanzada

c)

Analítica prescriptiva

d)

Ninguna de las anteriores

31.

¿Cuál de las siguientes NO es una de las mejores prácticas de BI?

a)

Alinear Big Data con objetivos empresariales generales

b)

Alinear Big Data con objetivos empresariales específicos

c)

La principal ventaja reside en alinear los datos estructurados y no estructurados

d)

Planificar el laboratorio de hallazgos en pro del rendimiento

32.

¿Cuál es el método de BI encargado de convertir el análisis de datos en representaciones

visuales como tablas, gráficos e histogramas para consumir datos más fácilmente?

a)

Consultas

b)

Visualización de datos

c)

Análisis visual

d)

Métricas de rendimiento y evaluación comparativa

33.

¿Cuál de las siguientes NO es una característica de un almacén de datos?

a)

Diseño de la nube

b)

Diseño de esquemas

c)

Modificaciones de datos

d)

Carga de trabajo

34.

¿A cuál de las fases de la evolución de BI y Analytics se relaciona web intelligence y

analytics?

a)

BI&A 4.0: 2020

b)

BI&A 1.0: 1990

c)

BI&A 3.0: 2010

d)

BI&A 2.0: 2000

35.

¿Cuál de las siguientes afirmaciones es la correcta?

a)

La preparación de datos (Data preparation) es la primera fase de la metodología

CRISP-DM

b)

El entendimiento del negocio (Business understanding) es la primera fase de la

metodología CRISP-DM

c)

El modelado (Modeling) es la primera fase de la metodología CRISP-DM

d)

La evaluación (Evaluation) es la primera fase de la metodología CRISP-DM

36.

¿Cuál de las siguientes afirmaciones NO es la correcta?

a)

El despliegue o implementación (Deployment) es la última de la metodología CRISP-

DM

b)

El entendimiento del negocio (Business understanding) es la primera fase de la

metodología CRISP-DM

c)

El despliegue o implementación (Deployment) es la primera fase de la metodología

CRISP-DM

d)

Ninguna de las anteriores

37.

¿CRISP-DM fue la evolución de cuál metodología?

a)

Agile

b)

Six Sigma

c)

SEMMA

d)

Ninguna de las anteriores

38.

¿Con cuál de las siguientes fases empieza la metodología SEMMA?

a)

Exploración (Explore)

b)

Muestreo (Sample)

c)

Modelado (Model)

d)

Valoración (Assess)

39.

Explotar sucesos pasados para poder predecir eventos futuros hace parte del tipo de

análisis:

a)

Prescriptivo

b)

Predictivo

c)

De diagnóstico

d)

Descriptivo

40.

¿Cuál NO es una característica del método de agrupamiento del aprendizaje no

supervisado?

a)

Aglomerativo

b)

Probabilístico

c)

Solapamiento

d)

Datos etiquetados

41.

¿Cuál tipo de aprendizaje es en el que se desconoce sobre el resultado deseado?

a)

Aprendizaje supervisado

b)

Aprendizaje automático

c)

Ninguna de las anteriores

d)

Aprendizaje no supervisado

42.

El ______________ es la capacidad de encontrar distintas soluciones a los problemas que

se afrontan, lo cual requiere de una profunda investigación con todos los recursos que estén

a su disposición, pero sin transgredir en ningún momento la gobernanza, privacidad y

tratamiento de los datos manejados

a)

Hacking normativo

b)

Hacking organizacional

c)

Hacking ético

d)

Ninguna de las anteriores

43.

¿Cuál es la institución que provee la arquitectura de referencia de Big Data?

a)

National Institute of Stereotypes and Technology

b)

National Industry of Standards and Technology

c)

National Institute of Standards and Technology

d)

National Incorporation of Standards and Technology

44.

¿Cuál de los siguientes se encuentra dentro de la arquitectura de Referencia de Big Data

del NIST?

a)

Proveedor del marco Big Data (Big Data framework provider)

b)

Todas las anteriores

c)

Proveedor de datos (data provider)

d)

Consumidor de datos (data consumer)

45.

¿Cuáles son los dos tipos de trabajos que se encuentran en la arquitectura MapReduce?

a)

Mapeadores y aumentadores

b)

Mapeadores y relativos

c)

Ninguna de las anteriores

d)

Mapeadores y reductores

46.

¿Cuál de las siguientes NO es un tipo de base NoSQL?

a)

Valor Creación

b)

Valor Clave

c)

Familia de Columnas

d)

Documentos

47.

¿Cuál de los siguientes funciona como un ecosistema de datos, es gratuito y de código

abierto, usado para procesar grandes volúmenes de datos en bloques usando modelos de

programación?

a)

Apache Storm

b)

Apache Hadoop

c)

Apache Spark

d)

Apache Kafka

48.

¿Para qué es utilizado el ZooKeeper en Apache Kafka?

a)

Para almacenar información sobre el clúster de Kafka, así como los detalles de los

clientes consumidores

b)

Para almacenar información sobre el clúster de Kafka, así como los detalles de los

clientes productores

c)

Para servir como puente entre productores y consumidores.

d)

Para componerse de diferentes corredores, temas y sus respectivas particiones

49.

¿Cuál de los siguientes es un tipo de servicio de la nube?

a)

Todas las anteriores

b)

Nube pública

c)

Nube privada

d)

Nube híbrida

50.

Dataproc forma parte de:

a)

Google Cloud Platform

b)

Amazon Web Services

c)

Microsoft Azure

d)

Oracle Cloud Infrastructure