NEW
Font size
WorksheetsNLP,RNN Quiz
Total questions: 15
Worksheet time: 8mins
กระบวนการแบ่งข้อความออกเป็นหน่วยย่อยๆ เช่น คำ หรือ ตัวอักษร เรียกว่าอะไร
Padding
Tokenization
Stopword Removal
Embedding
คำว่า "a", "an", "this" จะถูกจัดอยู่ในกลุ่มใดในการทำ NLP
Keywords
Tokens
Stopwords
N-grams
พี่คนสอนชื่ออะไร
ตี๋
ตีฟ
ต้อง
เต๋อ
การกำหนด 'truncating' และ 'padding' มีความสำคัญที่สุดในขั้นตอนใดของ Process
Tuning Model
เหตุใดเราจึงต้องทำ Padding กับข้อมูลข้อความก่อนส่งเข้าสู่โมเดล Deep Learning
เพื่อลบคำที่ไม่มีความหมายออก
เพื่อให้ข้อมูลทุก Input มีขนาดความยาว (Length) เท่ากัน
เพื่อเพิ่มความแม่นยำของโมเดล
เพื่อลดขนาดของเวกเตอร์
หากกำหนด maxlen=5 และ truncating='post' ประโยคที่มี Token เป็น [1, 2, 3, 4, 5, 6, 7] จะถูกจัดการอย่างไร
[1, 2, 3, 4, 5]
[1, 2, 3, 4, 5, 0, 0]
[3, 4, 5, 6, 7]
[1, 2, 3]
ถ้ากำหนด maxlen=4, padding='pre', และประโยคเดิมคือ [10, 11] ผลลัพธ์ที่ได้จะเป็นข้อใด? (สมมติให้ <PAD> = 0)
ก. [10, 11, 0, 0]
ข. [0, 0, 10, 11]
ค. [10, 11]
ง. [0, 10, 11, 0]
กำหนด Vocabulary: {'<PAD>': 0, 'I': 1, 'love': 2, 'NLP': 3} หากต้องการแปลงประโยค 'I love NLP' เป็นตัวเลข จะได้ผลลัพธ์ข้อใด?
[1, 2, 3]
[0, 1, 2]
[3, 2, 1]
[1, 1, 1]
1D Tensor มักใช้แทนข้อมูลในลักษณะใด?
รูปภาพสี (RGB)
วิดีโอ
ตารางข้อมูล Excel
เวกเตอร์ของตัวเลขชุดเดียว (Vector)
ข้อมูลรูปภาพขาวดำขนาด 28 x 28 พิกเซล จัดเป็น Tensor มิติใด?
1D Tensor
2D Tensor
3D Tensor
4D Tensor
ในการสร้างโมเดล NLP ข้อมูล 3D Tensor มักแสดงผลในรูปแบบใด?
[Width, Height, Color]
[Row, Column]
[Batch, Sequence_length, Embedded Size]
[Total_Words]
ใน Python (เช่น Library NumPy หรือ PyTorch) รูปแบบ x = [ [1, 2], [3, 4] ] คือ Tensor ชนิดใด?
ปัญหา 'Vanishing Gradient' ใน RNN แบบดั้งเดิมส่งผลเสียอย่างไร?
ทำให้โมเดลจำลำดับข้อมูลที่อยู่ไกลกันมากๆ ไม่ได้ (Long-term dependency)
ทำให้โมเดลทำงานเร็วเกินไป
ทำให้โมเดลทำ Tokenization ผิดพลาด
ทำให้โมเดลใช้หน่วยความจำมากเกินไป
LSTM แตกต่างจาก RNN ทั่วไปอย่างไรในเชิงโครงสร้าง
LSTM ไม่มีสถานะซ่อน
LSTM ใช้เฉพาะกับข้อมูลรูปภาพเท่านั้น
LSTM ไม่สามารถทำ Backpropagation ได้
LSTM มี Gates เพื่อควบคุมการไหลของข้อมูล
งานประเภท Sentiment Analysis วิเคราะห์อารมณ์จากข้อความ จัดอยู่ในหัวข้อใด?
Text Classification
Machine Translation
Object Detection
Speech Recognition
