wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

Introduction au Big Data

Total questions: 25

Worksheet time: 40mins

Name
Class
Date
1.

Ce cours va lever le voile sur le concept du Big Data?

4 lines
2.

Comment tirer profit de cette technologie?

4 lines
3.

Quel est son impact sur les entreprises?

4 lines
4.

Quelles sont ses principales technologies?

4 lines
5.

Comment se lancer dans un projet de transformation numérique dans son entreprise vers le Big Data?

4 lines
6.

Le Big Data ou mégadonnées en Français est un terme qui décrit le grand volume de données structurées, semi structurée et non structurées qui inonde une entreprise au quotidien. Ce n'est pas la quantité de données qui est importante. Mais plutôt ce que les organisations font de ces données.

4 lines
7.

Les Bases de données SQL relationnelles face au volume gigantesque de données et à leurs nature hétérogène, ne répondent plus de manière efficiente, à des besoins spécifiques. Ce défaut a été balayé par les bases de données NoSQL (Not Only SQL) qui sont pensées de manière à agir sur la structure des données qu'elles manipulent, de façon à optimiser leurs traitements futurs.

4 lines
8.

Une base de données NoSQL (parfois appelée Not Only SQL) est une base de données qui fournit un mécanisme pour stocker et récupérer des données autres que les relations tabulaires utilisées dans les bases de données relationnelles.

4 lines
9.

Hadoop est un framework open source Apache écrit en java qui permet le traitement distribué de grands ensembles de données sur des clusters d'ordinateurs à l'aide de modèles de programmation simples.

4 lines
10.

Quelles sont les principales tâches effectuées par Hadoop ?

a)

Diviser les données en répertoires et fichiers

b)

Répliquer les blocs pour gérer les pannes

c)

Vérifier que le code a été exécuté avec succès

d)

Effectuer le tri entre les étapes map et reduce

e)

Envoyer des données triées à un ordinateur

11.

Quels sont les avantages de Hadoop ?

a)

Open source et compatible sur toutes les plateformes

b)

Permet d'écrire et tester rapidement des systèmes

c)

Gère les défaillances au niveau de la couche d'application

d)

Fonctionne sans interruption lors de l'ajout ou suppression de serveurs

12.

Quels sont les modules principaux du framework Hadoop ?

a)

Hadoop Common

b)

Hadoop Distributed File System (HDFS)

c)

YARN (Yet Another Resource Negotiator)

d)

MapReduce

13.

Qu'est-ce qu'Ambari ?

a)

Une interface web pour gérer les services Hadoop

b)

Un système de base de données distribué

c)

Un logiciel de collecte de données

d)

Une base de données non relationnelle

14.

Quel est le rôle de HCatalog ?

a)

Gestion de stockage et de tableau

b)

Langage de requête SQL

c)

Planification des tâches

d)

Manipulation des données dans HDFS

15.

Qu'est-ce que Sqoop et à quoi sert-il ?

a)

Un outil pour importer des données à partir de sources de données structurées.

b)

Un framework de computing cluster.

c)

Un système de fichiers distribué.

d)

Un outil de recherche scalable.

16.

Quel est le rôle de Flume dans l'écosystème Hadoop ?

a)

Déplacer des données de streaming vers HDFS.

b)

Importer des données à partir de RDBMS.

c)

Coordonner les traitements distribués.

d)

Fournir des outils d'analytics in-memory.

17.

Comment HDFS stocke-t-il les données ?

a)

En les répartissant sur plusieurs nœuds.

b)

En les stockant sur un seul serveur.

c)

En les compressant.

d)

En les chiffrant.

18.

Quelle est la spécificité de MapR par rapport à Hadoop ?

a)

A développé plusieurs composants du noyau d'Hadoop.

b)

Est un outil de recherche.

c)

Est un framework de computing cluster.

d)

Est un mécanisme de connexion.

19.

Quel est le principal objectif des systèmes d'ingestion de données dans Hadoop ?

a)

Obtenir des données dans votre cluster et HDFS.

b)

Analyser les données.

c)

Stocker les données.

d)

Transférer les données entre bases de données.

20.

Quelle était la taille du marché mondial du Big Data en 2015?

a)

25,67 milliards USD

b)

123,23 milliards USD

c)

50 milliards USD

d)

10 milliards USD

21.

Quels sont les principaux acteurs de l'industrie du Big Data?

a)

IBM, Oracle, Microsoft

b)

Google, Yahoo, Facebook

c)

SAP SE, Amazon Web Services

d)

Tous les précédents

22.

Qu'est-ce que HDFS?

4 lines
23.

Quels sont les rôles gérés par HDFS?

4 lines
24.

Quelles commandes HDFS permettent de lister les fichiers?

a)

fs -ls

b)

fs -cat

c)

fs -text

d)

fs -rm

25.

Quel est le modèle de sécurité de HDFS?

a)

Modèle équivalent au modèle de droits Unix

b)

Modèle de sécurité basé sur les rôles

c)

Modèle de sécurité basé sur les groupes

d)

Modèle de sécurité basé sur les utilisateurs