WorksheetsBig data 5
Total questions: 65
Worksheet time: 33mins
Dữ liệu của Big Data là loại nào ?
Structured Data
Semi-Structured Data
Unstructured Data
Tất cả
Đăc trưng nào không phải của Big Data
Volume
Variety
Vision
Velocity
NoSQL là ?
Database
Field
Document
Collection
Mục tiêu của NoSQL là gì?
NoSQL cung cấp một giải pháp thay thế cho cơ sở dữ liệu SQL để lưu trữ dữ liệu dạng văn bản.
Cơ sở dữ liệu NoSQL cho phép lưu trữ dữ liệu không có cấu trúc.
NoSQL không thích hợp để lưu trữ dữ liệu có cấu trúc.
NoSQL là một định dạng dữ liệu mới để lưu trữ các tập dữ liệu lớn.
Cloudera phát triển công cụ nào ?
HCatalog
Hbase
Imphala
Oozie
Loại nào không phải là CSDL NoSQL ?
SQL Server
MongoDB
Cassandra
Không có
Đâu là một kiểu của CSDL NoSQL
SQL
Document databases
JSON
Tất cả
Chọn đúng 5 đặc trưng cho Big Data ?
Volume, Velocity, Variety, Veracity, Value
Volume, Videos, Velocity, Variability, Value
Volume, Variability, Veracity, Visualization, Value
Volume, Velocity, Veracity, Visualization, Value
Velocity (Tốc độ) là đặc trưng nói về?
Tốc độ gia tăng khối lượng dữ liệu lớn
Tốc độ cập nhật dữ liệu lớn
Tốc độ xử lý dữ liệu lớn
Tốc độ lưu trữ dữ liệu lớn
Variety (Tính đa dạng) là đặc trưng về ?
Kiểu dữ liệu thu thập
Kiểu nội dung dữ liệu
Nguồn thu thập dữ liệu
Phương thức xử lý dữ liệu
Đặc trưng quan trọng nhất của Big Data?
Khối lượng
Tính đa dạng
Tốc độ
Tất cả
Đặc trưng quan trọng nhất của Big Data?
Khối lượng
Tính đa dạng
Tốc độ
Tất cả
Đâu là đặc trưng quyết việc triển khai Dữ liệu lớn?
Khối lượng
Giá trị
Tốc Độ
Tính đa dạng
Tích hợp dữ liệu là quá trình ?
Kết hợp các dữ liệu không đồng nhất từ nhiều nguồn khác nhau
Sao chép dữ liệu vào CSDL hệ thống để tiến hành phân tích
Làm sạch các dữ liệu thu thập được từ các hệ thống thành phần
Tăng giá trị từ các tài nguyên dữ liệu đang lưu trữ phân tán
Thuật ngữ Thuật ngữ Dữ liệu lớn ra đời năm nào?
1997
2000
1998
1941
Các dạng thức khoa học dữ liệu của Jim Gray?
Thực nghiệm
Lý thuyết
Tính toán
Tất cả các ý
Phát biểu nào không phải dạng thức nghiên cứu Khoa học dữ liệu của Jim Gray?
Khai thác dữ liệu
Mô phỏng
Tính toán
Thực nghiệm
Đâu không phải là phương thức xử lý dữ liệu lớn?
Thu thập (acquire)
Đánh giá (reviews)
Tổ chức (organize)
Phân tích (analyze)
RDBMS là gì ?
Relational Database Management System
Relat Data Management System
Relational Database Microsoft System
Tất cả
Thị trường Big Data bao gồm:
Phần cứng
Phần Mềm
Tất cả
Dịch vụ
Nhược điểm của tích hợp dữ liệu theo phương pháp Tight Coupling
Độ trễ
Phản hồi truy vấn
Phụ thuộc vào nguồn dữ liệu
Tất cả
Nhược điểm của tích hợp dữ liệu theo phương pháp Loose Coupling
Tất cả
Chi phí cao
Độ trễ
Phụ thuộc mạng / băng thông
Công cụ nào hỗ trợ tốt NoSQL?
SAP Data Services
Oracle Data Integrator
SQL Server Integration Services
Tất cả
Công cụ tích hợp dữ liệu Boomi là của?
Dell
IBM
Microsoft
SAP
Công cụ SQL Server Integrator do ai phát triển ?
Oracle
IBM
Microsoft
SAP
SAP Data Service là công cụ để làm gì ?
Lưu trữ dữ liệu
Tích hợp dữ liệu
Phân tích dữ liệu
Tất cả
Hệ quản trị CSLD DynamoDB là kiểu nào ?
Key value
Wide Column based
Document based
Graph based
Hệ quản trị CSLD DynamoDB là kiểu nào ?
Key value
Wide Column based
Document based
Graph based
Hệ quản trị CSLD MongoDB là kiểu nào ?
Document based
Key value
Wide Column based
Graph based
Hệ quản trị CSLD Neo4J là kiểu nào ?
Key value
Wide Column based
Document based
Graph based
Hệ quản trị CSLD IBM Graph là kiểu nào ?
Key value
Document based
Graph based
Wide Column based
Hệ quản trị CSLD Google Big Table là kiểu nào ?
Key value
Wide Column based
Document based
Graph based
Đâu không phải là RDBMS ?
IBM DB2
MS SQL Server
MS Access
Cassandra
Loại nào là dữ liệu Bán cấu trúc ?
Tất cả
JSON
CSV
XML
Loại nào là dữ liệu Unstructured ?
Video
XML
Table
Tất cả
Yếu tố nào quyết định để sử dụng NoSQL
Tốc độ gia tăng CSDL
Tính đa dạng của dữ liệu
Tốc độ truy cập dữ liệu
Tất cả
CSDL nào không phải kiểu Key-Value:
MongoDB
DynamoDB
Redis
Riak
CSDL NoSQL nào không phải kiểu Document:
MongoDB
CouchDB
Elasticsearch
Riak
CSDL nào không phải kiểu Graph:
InfoGrid
Hbase
InfiniteGraph
IBM Graph
CSDL nào không phải kiểu Wide-Column:
Hbase
Cassandra
BigTable
Dex
Ưu điểm của hệ thống HDFS là gì ?
Lưu trữ phân tán, xử lý song song, khả năng chịu lỗi cao
Lưu trữ song song, xử lý phân tán, tính sẵn sàng cao
Xử lý phân tán song song, khả năng chịu lỗi chấp nhận sai sót
Tất cả
Ưu điểm của DFS là gì ?
Hệ thống lưu trữ song song nên tránh được ảnh hưởng khi một máy chủ hoặc bộ nhớ bị lỗi
Hệ thống được sao lưu tại Server thứ hai nên đảm bảo việc cung cấp dữ liệu
Khi một máy chủ hoặc bộ nhớ bị lỗi, hệ thống tệp phân tán vẫn đảm bảo có thể cung cấp dữ liệu ổn định
Tất cả
Ưu điểm của công nghệ Cluster
Tất cả
Hiệu quả chi phí
TÍnh sẵn sàng cao
Khả năng mở rộng linh hoạ
Ưu điểm của công nghệ Cluster
Tất cả
Hiệu quả chi phí
TÍnh sẵn sàng cao
Khả năng mở rộng linh hoạt
Cluster node có mấy loại ?
1
2
3
4
Nguồn của kiến trúc HDFS trong Hadoop có nguồn gốc là
Hệ thống tệp phân phối của Google
Hệ thống tệp phân tán của Yahoo
Hệ thống tệp phân tán của Facebook
Hệ thống tệp phân tán Azure
Loại dữ liệu mà Hadoop có thể xử lý là
Structred (Có cấu trúc)
Semi-structured (Bán cấu trúc)
Unstructured (Không có cấu trúc)
All of the above (Tất cả những điều trên)
YARN là viết tắt của
Yahoo’s another resource name
Yet another resource negotiator
Yahoo’s archived Resource names
Yet another resource need.
Điều nào sau đây không phải là mục tiêu của HDFS?
Phát hiện lỗi và khôi phục
Xử lý tập dữ liệu khổng lồ
Ngăn chặn việc xóa dữ liệu
Cung cấp băng thông mạng cao để di chuyển dữ liệu
Trong HDFS, các tệp không thể
Đọc
Xóa
Thực thi
Lưu trữ
So với RDBMS, Hadoop
Có tính toàn vẹn dữ liệu cao hơn.
Có giao dịch ACID không
Thích hợp để đọc và truy vấn nhanh
Hoạt động tốt hơn trên dữ liệu phi cấu trúc và bán cấu trúc.
Vấn đề chính gặp phải khi đọc và ghi dữ liệu song song từ nhiều đĩa là gì?
Xử lý khối lượng lớn dữ liệu nhanh hơn.
Kết hợp dữ liệu từ nhiều đĩa.
Phần mềm cần thiết để thực hiện nhiệm vụ này là cực kỳ tốn kém.
Phần cứng cần thiết để thực hiện tác vụ này là cực kỳ tốn kém.
Tính năng định vị dữ liệu trong Hadoop có nghĩa là
lưu trữ cùng một dữ liệu trên nhiều nút.
chuyển vị trí dữ liệu từ nút này sang nút khác.
đồng định vị dữ liệu với các nút tính toán.
Phân phối dữ liệu trên nhiều nút.
Các tệp HDFS được thiết kế cho
Nhiều người viết và sửa đổi ở các hiệu số tùy ý.
Chỉ nối vào cuối tệp.
Chỉ ghi thành tệp một lần.
Truy cập dữ liệu có độ trễ thấp.
Công việc khung hadoop được viết bằng
C ++
Python
Java
Go
Cái nào không phải là một trong đặc trưng 3Vs của dữ liệu lớn?
Vận tốc Velocity
Tính xác thực Ver
Cái nào không phải là một trong đặc trưng 3Vs của dữ liệu lớn?
Vận tốc Velocity
Tính xác thực Veracity
Khối lượng Volume
Đa dạng Variety
Điều nào sau đây đúng đối với Hadoop?
Đây là một khung phân tán.
Thuật toán chính được sử dụng trong đó là Map Reduce
Nó chạy có thể thực thi trên hạ tầng Cloud Computing
Tất cả đều đúng
Loại nào sau đây lưu trữ dữ liệu?
Name node
Data node
Master node
None of these
Node nào sau đây quản lý các nút khác?
Name node
Data node
slave node
None of these
Hadoop xử lý khối lượng lớn dữ liệu như thế nào?
Hadoop sử dụng song song rất nhiều máy. Điều này tối ưu hóa việc xử lý dữ liệu.
Hadoop được thiết kế đặc biệt để xử lý lượng lớn dữ liệu bằng cách tận dụng phần cứng MPP.
Hadoop gửi mã đến dữ liệu thay vì gửi dữ liệu đến mã.
Hadoop sử dụng các kỹ thuật bộ nhớ đệm phức tạp trên NameNode để tăng tốc độ xử lý dữ liệu.
MapReduce do công ty nào phát triển ?
Apache
IBM
Amazon
Dịch vụ đám mây nào hỗ trợ tốt cho Big Data ?
Amazon AWS
Google Cloud
Tất cả
Microsoft Azure
Nhược điểm khi triển khai Big Data trên nền tảng Cloud Computing là?
Nhiều rủi ro cho hệ thống
Không có ý đúng
Tốc độ xử lý không đảm bảo
Phân tích theo thời gian thực kém
Mô hình chính dành cho Điện toán đám mây ?
Cơ sở hạ tầng dưới dạng dịch vụ (IaaS)
Tất cả
Nền tảng dưới dạng dịch vụ (PaaS)
Phần mềm dưới dạng dịch vụ (SaaS)
