NEW
Font size
WorksheetsAgentic AI II Quiz
Total questions: 17
Worksheet time: 9mins
กลไก Self-Attention ทำหน้าที่อะไร?
สลับตำแหน่งคำในประโยค
คำนวณความสัมพันธ์ระหว่างคำในประโยคเดียวกัน
ย่อประโยคยาวให้เหลือสั้นลง
แปลงตัวอักษรให้เป็นตัวเลข
ทำไม Transformer ต้องมี Positional Encoding?
เพื่อให้โมเดลรู้ลำดับก่อนหลังของคำ
เพื่อเพิ่มความเร็วในการเทรน
เพื่อลดจำนวนคำศัพท์ในระบบ
เพื่อใช้ในการแยกแยะภาษา
โมเดลตระกูล GPT ใช้โครงสร้างแบบใด?
Encoder-only
Decoder-only
Encoder-Decoder
RNN-based
Tokenization คือกระบวนการอะไร?
การแปลภาษาอัตโนมัติ
การตรวจสอบไวยากรณ์
การแยกข้อความย่อยและแปลงเป็นตัวเลข
การลบคำหยาบออกจากประโยค
โมเดล BERT เหมาะกับงานลักษณะใด?
การเขียนนิยายหรือบทความ
การวิเคราะห์อารมณ์หรือจำแนกข้อความ
การสร้างแชทบอทถามตอบ
การพยากรณ์ราคาหุ้น
คำว่า Pre-trained ใน LLM หมายถึงอะไร?
โมเดลที่เพิ่งเริ่มสร้างใหม่
โมเดลที่ฝึกฝนกับข้อมูลขนาดใหญ่มาแล้ว
โมเดลที่ทำงานได้โดยไม่ต้องใช้ GPU
โมเดลที่ใช้สำหรับงานขนาดใหญ่
โครงสร้าง Encoder-Decoder นิยมใช้ในงานใด?
การจำแนกรูปภาพ
การแปลภาษา
การกรองอีเมลขยะ
การเก็บข้อมูลในฐานข้อมูล
ค่า Query (Q) ใน Attention เปรียบได้กับอะไร?
คำค้นหาที่ป้อนเข้าไป
หัวข้อข้อมูลที่มีอยู่
เนื้อหาที่ได้รับกลับมา
ลำดับหน้าของหนังสือ
Hugging Face Library มีประโยชน์อย่างไร?
ใช้แต่งรูปภาพด้วย AI
ช่วยให้ดึงโมเดลมาใช้ง่ายขึ้น
ใช้พิมพ์เอกสารรายงาน
ใช้ป้องกันไวรัสคอมพิวเตอร์
เลเยอร์ Feed-Forward ใน Transformer ทำหน้าที่อะไร?
จัดลำดับคำให้ถูกต้อง
ประมวลผลข้อมูลต่อจาก Attention
รับส่งข้อมูลผ่านอินเทอร์เน็ต
เลือกภาษาที่จะสื่อสาร
Multi-Head Attention มีข้อดีอย่างไร?
ช่วยให้โมเดลทำงานได้หลายคน
ช่วยมองบริบทได้หลายแง่มุมพร้อมกัน
ช่วยให้แปลได้หลายภาษาพร้อมกัน
ช่วยประหยัด memory
Fine-tuning คืออะไร?
การเทรนโมเดลใหม่ตั้งแต่ต้น
การนำโมเดลเดิมมาเทรนเฉพาะทางเพิ่ม
การลบความรู้เดิมทิ้งให้หมด
การปิดเครื่องพักการทำงาน
Masking ใน Decoder มีไว้เพื่ออะไร?
ป้องกันโมเดลมองเห็นคำในอนาคต
ซ่อนความลับของโปรแกรมเมอร์
ทำให้ภาพใน AI ดูนวลขึ้น
ระบุชนิดของคำนามและกริยา
LLM มีพารามิเตอร์อยู่ใน Range ประมาณเท่าไร
1M- 175B
500K- 50M
10M-1000M
2M-200M
ข้อใดคือชื่อโมเดลภาษาจาก Google?
GPT-4
Gemini
Claude
Llama
Beam Algorithim ใช้หลักการเลือกประโยคสุดท้ายจากอะไร
ประโยคที่มีค่า ความน่าจะเป็นสะสมสูงสุด
ประโยคที่ถูก generate ก่อน
ความถี่ของคำในประโยค
ประโยคที่มี token ซ้ำกันน้อยที่สุด
Multi-Head Attention พัฒนาต่อยอดมาจาก Self-Attention อย่างไร
ช่วยให้โมเดลสามารถทำงานได้รวดเร็วขึ้น
ช่วยให้โมเดลเรียนรู้ความสัมพันธ์ของคำได้หลายมิติพร้อมกัน
ช่วยลดจำนวนชั้นของโมเดลให้เหลือน้อยลง
ช่วยให้โมเดลไม่ต้องใช้ Positional Encoding
