NEW
Font size
WorksheetsGDCC X Data Engineer #2
Total questions: 10
Worksheet time: 8mins
บุคคลตามข้อใดนำหลักการของแนวปฏิบัติที่ดีเกี่ยวกับข้อมูลขนาดใหญ่ (Big Data Best Practices) มาปรับใช้ได้เหมาะสมที่สุด
สุรชัยปฏิเสธการทำระบบสำรอง (Backup Site) ตามเงื่อนไขของลูกค้า เนื่องจากสถิติ 2 ปีที่ผ่านมาศูนย์ข้อมูล (Data Center) สามารถให้บริการได้ร้อยละ 100 และเป็นการสิ้นเปลืองงบประมาณ
ทักขิณาตั้งสิทธิ์ให้ทุกคนในองค์กรสามารถเข้าถึงข้อมูลอ่อนไหว (Sensitive Personal Data) ได้ เพื่อลดขั้นตอนประสานงานขอข้อมูลระหว่างแผนกงาน
ชาคริตกำหนดเกณฑ์การเปลี่ยนรหัสผ่านเข้าสู่ระบบงานทุก ๆ 90 วัน ตามมาตรฐานของบริษัท เพื่อป้องกันการถูกโจมตีจากภายนอก แม้ว่าจะมีเพื่อนพนักงานบางคนไม่เห็นด้วยก็ตาม
อนุสรมอบหมายให้นักศึกษาฝึกงานทำความสะอาดข้อมูล (Data Cleaning) ในชุดข้อมูลลับของหน่วยงาน
เพื่อเร่งหาคำตอบบางอย่าง เพียงเพราะวิศวกรข้อมูล (Data Engineer) ประจำของบริษัทลางาน 1 วัน
บริการในข้อใดมีวัตถุประสงค์หลักเพื่อรวบรวมคำอธิบายข้อมูล (Metadata)
บัญชีข้อมูล (Data Catalog)
ทะเลสาบข้อมูล (Data Lake)
กระบวนงานปรับข้อมูลให้มีความพร้อมใช้งาน (Exact-Transform-Load)
นำเสนอข้อมูลในรูปแบบของแผนภาพ (Data Visualization)
เทคนิคในข้อใดเป็นการแยกหมวดหมู่ข้อมูลเป็นกลุ่มย่อย เพิ่มประสิทธิภาพการค้นหาข้อมูล (Data Query) และลดจำนวนข้อมูลที่จะถูกสืบค้น เช่น แยกหมวดหมู่ตาม วันที่ ภูมิภาค ชื่อประเทศ เป็นต้น
Partitioning Data
Data Compression
Query Caching
ไม่มีข้อถูก
ข้อใด ไม่ใช่ ประโยชน์ที่ได้รับจากการนำเสนอข้อมูลด้วยแผนภาพ (Data Visualization)
ผู้อ่านสามารถทำความเข้าใจข้อมูลที่มีความซับซ้อนได้อย่างรวดเร็ว
ผู้บริหารสามารถตัดสินใจ (Decision Making) ได้แม่นยำมากขึ้น โดยคาดการณ์จากแนวโน้มของข้อมูลที่ปรากฎ
เพื่อหลีกเลี่ยงหรือปกปิดข้อมูลที่ผิดปกติ (Data Anomaly) โดยใช้แผนภาพแทนคำอธิบาย
ถูกทุกข้อ
Name Node (Master Node) บน Big Data Platform มีหน้าที่อะไร
ประมวลผล และจัดเก็บข้อมูลในรูปแบบกระจาย (HDFS)
มอบหมายและกระจายงานไปยังโหนดที่มีหน้าที่ประมวลผลและจัดเก็บข้อมูล
ประมวลผลแล้วส่งต่อข้อมูลไปยังโหนดที่ใช้ในการจัดเก็บข้อมูล
จัดเก็บข้อมูลที่ผ่านการประมวลผลแล้ว
Service ใดบน Big Data Platform ที่มีหน้าที่ในการประมวลผลข้อมูลที่สามารถรันบนหน่วยความจำ (In-memory Data Processing) ได้อย่างรวดเร็ว
Apache Oozie
Apache Sqoop
Apache HBase
Apache Spark
จงเรียงขั้นตอนเพื่อจำลองการเรียนรู้ของเครื่อง (Machine Learning) เมื่อกำหนดให้ดังต่อไปนี้ ตั้งแต่เริ่มต้นถึงสิ้นสุดให้ถูกต้อง
A > B > C > D
A > C > B > D
C > A > B > D
B > A > C > D
นักวิทยาศาสตร์ข้อมูล (Data Scientist) ใช้เครื่องมือพัฒนาชุดคำสั่ง (Notebook) เพื่อจำลองการเรียนรู้ของเครื่อง (Machine Learning) ในด้านใดเป็นสำคัญ
ออกแบบส่วนต่อประสานกับผู้ใช้งาน (User Interface) ที่แสดงบนเว็บแอปพลิเคชัน (Web Application)
ตรวจสอบการใช้ทรัพยากรของเครื่องเสมือน (Virtual Machine
ทำฐานข้อมูล (Database)
สร้างและประมวลผลภาษาทางคอมพิวเตอร์ (Write and Execute Code)
Object Storage รองรับการจัดเก็บข้อมูลประเภทใดได้บ้าง
ข้อมูลชนิดมีโครงสร้าง (Structured Data)
ข้อมูลชนิดไม่มีโครงสร้าง (Unstructured Data)
ข้อมูลชนิดกึ่งมีโครงสร้าง (Semi-Structured Data)
ถูกทุกข้อ
กระบวนการในข้อใด ไม่เกี่ยวข้อง กับการเตรียมข้อมูลให้มีความพร้อมใช้งาน (Data Preparation)
กระบวนการนำเสนอข้อมูลด้วยแผนภาพ (Data Visualization)
กระบวนการแปลงข้อมูล (Data Transformation)
กระบวนการแก้ไขความผิดพลาดของข้อมูล (Data Cleaning)
ทุกข้อเป็นกระบวนการที่เกี่ยวข้อง
