wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

Apache Spark - Delta Lake

Total questions: 7

Worksheet time: 6mins

Name
Class
Date
1.

Delta Lake es una alternativa para Google Cloud Storage o Amazon S3?

a)

b)

No

2.

Las transacciones ACID sólo están disponibles en Delta Lake si usamos una base de datos relacional como método de almacenamiento

a)

Verdadero

b)

Falso

3.

Qué es el log de transacciones en Delta Lake?

a)

Un conjunto de ficheros parquet que nos indican como la información está almacenada

b)

No hay log de transacciones en Delta Lake

c)

Un conjunto de ficheros que nos indican qué operaciones han sido ejecutadas

d)

Un conjunto de ficheros JSON que almacenan datos de la tabla

4.

Selecciona todas las correctas sobre Delta Lake...

a)

Es posible obtener atomicidad en Delta Lake

b)

El nivel de aislamiento por defecto en Delta Lake es Serializable

c)

El nivel de aislamiento por defecto en Delta Lake es WriteSerializable

d)

Delta Lake gestiona completamente la durabilidad de los datos

5.

Selecciona todas las correctas. Time Travel en Delta Lake sirve para....

a)

Reproducir experimentos en base al estado de las tablas en un momento dado

b)

Mejorar la eficiencia de la capa de almacenamiento

c)

Mejorar la eficiencia de las transformaciones en Spark

d)

Auditar cambios de datos

6.

Which of the following statements describes Delta Lake?

a)

Delta Lake is an open source analytics engine used for big data workloads

b)

Delta Lake is an open format storage layer that delivers reliability, security, and performance

c)

Delta Lake is an open source platform to help manage the complete machine learning lifecycle

d)

Delta Lake is an open source data storage for distributed data

e)

Delta Lake is an open format storage layer that processes data

7.

¿Cuál es una de las principales características del enfoque Lakehouse?

a)

Separación estricta de almacenamiento y procesamiento de datos.

b)

Integración de las funcionalidades de un Data Warehouse con la escalabilidad de un Data Lake.

c)

Uso exclusivo de almacenamiento en la nube.

d)

Optimización únicamente para datos estructurados.