wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

BIG DATA 2

Total questions: 60

Worksheet time: 3600secs

Name
Class
Date
1.
¿Cuál NO corresponde a una de las 5V del Big Data?
a)
Volumen
b)
Velocidad
c)
Variedad
d)
Validación
2.
¿Qué representa la 'Veracidad' en Big Data?
a)
El tamaño de los datos
b)
La calidad y confiabilidad de los datos
c)
La rapidez de acceso
d)
La variedad de fuentes
3.
Un ejemplo de 'Volumen' en Big Data sería:
a)
1 registro en una tabla
b)
10 filas en Excel
c)
1 millón de registros en una base transaccional
d)
50 tweets diarios
4.
¿Qué se entiende por 'Velocidad' en Big Data?
a)
Capacidad de almacenamiento
b)
Rapidez con la que llegan los datos
c)
Número de usuarios concurrentes
d)
Compresión de archivos
5.
¿Cuál de estos es un ejemplo de dato no estructurado?
a)
Archivo Excel
b)
Imagen JPEG
c)
Tabla SQL
d)
Archivo CSV
6.
El concepto de 'Valor' en Big Data hace referencia a:
a)
Costo del hardware
b)
Utilidad de los datos analizados
c)
Tipo de archivo
d)
Tiempo de respuesta
7.
¿Qué ventaja tiene Big Data frente a bases tradicionales?
a)
Solo maneja datos estructurados
b)
Permite analizar grandes volúmenes y tipos de datos
c)
Se limita a transacciones simples
d)
No requiere almacenamiento distribuido
8.
Una fuente típica de Big Data es:
a)
Sensor IoT
b)
Hoja Excel con 100 filas
c)
Tabla Access
d)
Calculadora
9.
¿Qué tipo de analítica responde a 'qué pasará'?
a)
Descriptiva
b)
Predictiva
c)
Diagnóstica
d)
Prescriptiva
10.
¿Qué tipo de datos generan redes sociales como Twitter?
a)
Solo estructurados
b)
Solo no estructurados
c)
Mixtos (texto, imágenes, videos)
d)
Ninguno
11.
¿Qué sentencia SQL selecciona todos los registros de 'clientes'?
a)
SELECT * FROM clientes;
b)
GET clientes;
c)
SHOW clientes;
d)
FETCH clientes;
12.
¿Qué instrucción elimina una tabla en SQL?
a)
DROP TABLE nombre;
b)
DELETE ALL nombre;
c)
ERASE TABLE nombre;
d)
REMOVE nombre;
13.
¿Qué comando cuenta filas en SQL?
a)
COUNT(*)
b)
SUM(*)
c)
TOTAL(*)
d)
LENGTH(*)
14.
En SQL, ¿qué hace la cláusula WHERE?
a)
Renombra columnas
b)
Filtra registros
c)
Elimina tablas
d)
Ordena resultados
15.
¿Qué sentencia devuelve solo valores únicos?
a)
SELECT DISTINCT
b)
SELECT UNIQUE
c)
SELECT FILTERED
d)
SELECT CLEAN
16.
¿Qué tipo de JOIN devuelve coincidencias en ambas tablas?
a)
LEFT JOIN
b)
RIGHT JOIN
c)
INNER JOIN
d)
FULL JOIN
17.
En Big Data, SQL se usa principalmente para:
a)
Diseño de redes
b)
Consultar y transformar grandes volúmenes de datos
c)
Dibujar diagramas
d)
Crear imágenes
18.
¿Qué función SQL devuelve el promedio?
a)
AVG()
b)
MEAN()
c)
PROM()
d)
SUM()
19.
¿Qué cláusula ordena resultados en SQL?
a)
GROUP BY
b)
SORT BY
c)
ORDER BY
d)
ALIGN BY
20.
¿Cuál es un lenguaje declarativo en Big Data?
a)
Java
b)
SQL
c)
Python
d)
C++
21.
¿Qué significa HDFS?
a)
Hadoop Distributed File System
b)
Hadoop Data File System
c)
High Data File Storage
d)
Hadoop Disk File System
22.
¿Qué componente de Hadoop administra recursos?
a)
HDFS
b)
YARN
c)
Hive
d)
Sqoop
23.
Hive está diseñado para:
a)
Procesar imágenes
b)
Consultas SQL sobre Hadoop
c)
Ingesta en tiempo real
d)
Dashboards
24.
Pig se usa en Big Data para:
a)
MapReduce con scripts
b)
Manejo de imágenes
c)
Machine Learning
d)
Cargar datos en Kafka
25.
Sqoop se emplea para:
a)
Transferir datos entre SQL y Hadoop
b)
Procesar imágenes
c)
Análisis predictivo
d)
Dashboards
26.
¿Qué motor reemplaza MapReduce en memoria?
a)
Spark
b)
YARN
c)
Hive
d)
Sqoop
27.
¿Qué significa Replication Factor en HDFS?
a)
Copias de cada bloque
b)
Usuarios conectados
c)
Tamaño de archivos
d)
Velocidad de red
28.
El NameNode en Hadoop es responsable de:
a)
Guardar datos en bruto
b)
Metadata del sistema de archivos
c)
Procesar en memoria
d)
Replicar datos
29.
¿Cuál de estos no es parte del ecosistema Hadoop?
a)
Cassandra
b)
Hive
c)
Pig
d)
Sqoop
30.
Cloudera y Hortonworks son:
a)
Lenguajes
b)
Distribuciones de Hadoop
c)
Bases NoSQL
d)
Librerías de IA
31.
¿Qué formato optimizado para Hadoop usa columnas comprimidas?
a)
JSON
b)
Parquet
c)
TXT
d)
XML
32.
¿Qué tipo de nodo ejecuta tareas en Hadoop?
a)
DataNode
b)
NameNode
c)
ControlNode
d)
ClientNode
33.
¿Qué motor es más eficiente que MapReduce para iteraciones?
a)
Spark
b)
Hive
c)
Sqoop
d)
Pig
34.
Hadoop se diseñó para:
a)
Almacenamiento local
b)
Procesamiento distribuido
c)
PCs de escritorio
d)
Lenguajes compilados
35.
¿Qué librería de Spark se usa para Machine Learning?
a)
MLlib
b)
GraphX
c)
SparkSQL
d)
SparkR
36.
¿Cuál es un ejemplo de base documental?
a)
MongoDB
b)
MySQL
c)
PostgreSQL
d)
Oracle
37.
Cassandra es una base:
a)
Columnares
b)
Relacional
c)
Clave-valor
d)
Grafos
38.
Redis es principalmente:
a)
Clave-valor en memoria
b)
Columnares
c)
Relacional
d)
Grafos
39.
Neo4j se usa para:
a)
Datos en grafos
b)
Tablas
c)
Logs
d)
ETL
40.
CouchDB almacena datos en:
a)
Documentos JSON
b)
Archivos planos
c)
Hojas Excel
d)
Columnas binarias
41.
¿Qué propiedad hace escalable a NoSQL?
a)
Sharding y replicación
b)
Normalización estricta
c)
SQL
d)
ACID
42.
¿Qué base se adapta mejor a redes sociales?
a)
Grafos
b)
Clave-valor
c)
Relacionales
d)
Excel
43.
MongoDB almacena en:
a)
Colecciones BSON
b)
Tablas y filas
c)
Archivos XML
d)
Grafos
44.
Cassandra es ideal para:
a)
Escritura distribuida masiva
b)
Procesar imágenes
c)
Consultas OLAP simples
d)
Streaming
45.
Redis se usa para:
a)
Caché de aplicaciones
b)
SQL complejas
c)
Imágenes
d)
Data Lakes
46.
¿Qué herramienta ingiere datos en tiempo real?
a)
Kafka
b)
Hive
c)
Pig
d)
MySQL
47.
Spark Streaming se usa para:
a)
Procesar flujos en tiempo real
b)
Imágenes
c)
Reportes estáticos
d)
Grafos
48.
Apache Flink está diseñado para:
a)
Procesamiento streams y batch
b)
Caché
c)
Procesar gráficos
d)
Almacenar logs
49.
¿Qué significa Throughput en streaming?
a)
Datos procesados/tiempo
b)
Latencia
c)
Tamaño de archivos
d)
Usuarios
50.
¿Qué base se usa junto a Kafka para persistencia?
a)
Cassandra
b)
Excel
c)
Access
d)
SQLite
51.
¿Qué lenguaje es compatible con Spark?
a)
Scala
b)
C
c)
Pascal
d)
VB
52.
¿Qué mide la latencia en Big Data?
a)
Tiempo de respuesta
b)
Volumen total
c)
Tipo de dato
d)
Costo
53.
En streaming, los datos:
a)
Llegan en tiempo real
b)
Cargan manual
c)
Solo estructurados
d)
Limitados a logs
54.
Apache Storm se usaba para:
a)
Procesamiento de flujos en tiempo real
b)
SQL
c)
Gráficos
d)
Cargar datos en HDFS
55.
¿Qué motor SQL usa Spark?
a)
SparkSQL
b)
Hive
c)
Sqoop
d)
Pig
56.
¿Qué biblioteca de Spark se usa para IA?
a)
MLlib
b)
TensorFlow
c)
Scikit-learn
d)
Pandas
57.
El aprendizaje supervisado requiere:
a)
Datos etiquetados
b)
Datos sin etiquetas
c)
Solo imágenes
d)
Simulaciones
58.
Un ejemplo de IA en Big Data es:
a)
Predicción de churn
b)
Guardar datos en HDFS
c)
Dibujar gráficos
d)
Logs
59.
¿Qué algoritmo clasifica correos spam?
a)
Clasificación supervisada
b)
Clustering
c)
Algoritmo grafos
d)
Reglas SQL
60.
En Big Data, los modelos IA suelen entrenarse en:
a)
Spark MLlib/TensorFlow
b)
Excel
c)
Access
d)
Manual