wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

GDCC X Data Engineer #2

Total questions: 10

Worksheet time: 8mins

Name
Class
Date
1.

บุคคลตามข้อใดนำหลักการของแนวปฏิบัติที่ดีเกี่ยวกับข้อมูลขนาดใหญ่ (Big Data Best Practices) มาปรับใช้ได้เหมาะสมที่สุด

a)

สุรชัยปฏิเสธการทำระบบสำรอง (Backup Site) ตามเงื่อนไขของลูกค้า เนื่องจากสถิติ 2 ปีที่ผ่านมาศูนย์ข้อมูล (Data Center) สามารถให้บริการได้ร้อยละ 100 และเป็นการสิ้นเปลืองงบประมาณ

b)

ทักขิณาตั้งสิทธิ์ให้ทุกคนในองค์กรสามารถเข้าถึงข้อมูลอ่อนไหว (Sensitive Personal Data) ได้ เพื่อลดขั้นตอนประสานงานขอข้อมูลระหว่างแผนกงาน

c)

ชาคริตกำหนดเกณฑ์การเปลี่ยนรหัสผ่านเข้าสู่ระบบงานทุก ๆ 90 วัน ตามมาตรฐานของบริษัท เพื่อป้องกันการถูกโจมตีจากภายนอก แม้ว่าจะมีเพื่อนพนักงานบางคนไม่เห็นด้วยก็ตาม

d)

อนุสรมอบหมายให้นักศึกษาฝึกงานทำความสะอาดข้อมูล (Data Cleaning) ในชุดข้อมูลลับของหน่วยงาน
เพื่อเร่งหาคำตอบบางอย่าง เพียงเพราะวิศวกรข้อมูล (Data Engineer) ประจำของบริษัทลางาน 1 วัน

2.

บริการในข้อใดมีวัตถุประสงค์หลักเพื่อรวบรวมคำอธิบายข้อมูล (Metadata)

a)

บัญชีข้อมูล (Data Catalog)

b)

ทะเลสาบข้อมูล (Data Lake)

c)

กระบวนงานปรับข้อมูลให้มีความพร้อมใช้งาน (Exact-Transform-Load)

d)

นำเสนอข้อมูลในรูปแบบของแผนภาพ (Data Visualization)

3.

เทคนิคในข้อใดเป็นการแยกหมวดหมู่ข้อมูลเป็นกลุ่มย่อย เพิ่มประสิทธิภาพการค้นหาข้อมูล (Data Query) และลดจำนวนข้อมูลที่จะถูกสืบค้น เช่น แยกหมวดหมู่ตาม วันที่ ภูมิภาค ชื่อประเทศ เป็นต้น

a)

Partitioning Data

b)

Data Compression

c)

Query Caching

d)

ไม่มีข้อถูก

4.

ข้อใด ไม่ใช่ ประโยชน์ที่ได้รับจากการนำเสนอข้อมูลด้วยแผนภาพ (Data Visualization)

a)

ผู้อ่านสามารถทำความเข้าใจข้อมูลที่มีความซับซ้อนได้อย่างรวดเร็ว

b)

ผู้บริหารสามารถตัดสินใจ (Decision Making) ได้แม่นยำมากขึ้น โดยคาดการณ์จากแนวโน้มของข้อมูลที่ปรากฎ

c)

เพื่อหลีกเลี่ยงหรือปกปิดข้อมูลที่ผิดปกติ (Data Anomaly) โดยใช้แผนภาพแทนคำอธิบาย

d)

ถูกทุกข้อ

5.

Name Node (Master Node) บน Big Data Platform มีหน้าที่อะไร

a)

ประมวลผล และจัดเก็บข้อมูลในรูปแบบกระจาย (HDFS)

b)

มอบหมายและกระจายงานไปยังโหนดที่มีหน้าที่ประมวลผลและจัดเก็บข้อมูล

c)

ประมวลผลแล้วส่งต่อข้อมูลไปยังโหนดที่ใช้ในการจัดเก็บข้อมูล

d)

จัดเก็บข้อมูลที่ผ่านการประมวลผลแล้ว

6.

Service ใดบน Big Data Platform ที่มีหน้าที่ในการประมวลผลข้อมูลที่สามารถรันบนหน่วยความจำ (In-memory Data Processing) ได้อย่างรวดเร็ว

a)

Apache Oozie

b)

Apache Sqoop

c)

Apache HBase

d)

Apache Spark

7.

จงเรียงขั้นตอนเพื่อจำลองการเรียนรู้ของเครื่อง (Machine Learning) เมื่อกำหนดให้ดังต่อไปนี้ ตั้งแต่เริ่มต้นถึงสิ้นสุดให้ถูกต้อง

a)

A > B > C > D

b)

A > C > B > D

c)

C > A > B > D

d)

B > A > C > D

8.

นักวิทยาศาสตร์ข้อมูล (Data Scientist) ใช้เครื่องมือพัฒนาชุดคำสั่ง (Notebook) เพื่อจำลองการเรียนรู้ของเครื่อง (Machine Learning) ในด้านใดเป็นสำคัญ

a)

ออกแบบส่วนต่อประสานกับผู้ใช้งาน (User Interface) ที่แสดงบนเว็บแอปพลิเคชัน (Web Application)

b)

ตรวจสอบการใช้ทรัพยากรของเครื่องเสมือน (Virtual Machine

c)

ทำฐานข้อมูล (Database)

d)

สร้างและประมวลผลภาษาทางคอมพิวเตอร์ (Write and Execute Code)

9.

Object Storage รองรับการจัดเก็บข้อมูลประเภทใดได้บ้าง

a)

ข้อมูลชนิดมีโครงสร้าง (Structured Data)

b)

ข้อมูลชนิดไม่มีโครงสร้าง (Unstructured Data)

c)

ข้อมูลชนิดกึ่งมีโครงสร้าง (Semi-Structured Data)

d)

ถูกทุกข้อ

10.

กระบวนการในข้อใด ไม่เกี่ยวข้อง กับการเตรียมข้อมูลให้มีความพร้อมใช้งาน (Data Preparation)

a)

กระบวนการนำเสนอข้อมูลด้วยแผนภาพ (Data Visualization)

b)

กระบวนการแปลงข้อมูล (Data Transformation)

c)

กระบวนการแก้ไขความผิดพลาดของข้อมูล (Data Cleaning)

d)

ทุกข้อเป็นกระบวนการที่เกี่ยวข้อง