wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Machine 2

Total questions: 30

Worksheet time: 15mins

Name
Class
Date
1.

Thông số Learning rate dùng trong ANN là chỉ số tác động đến:

a)

. Kết quả tính feedforward

b)

Tốc độ hội tụ kết quả huấn luyện mô hình

c)

Các giá trị ngõ vào

d)

Tốc độ tính toán feedforward

2.

Epsilon-greedy (e-greedy) là:

a)

Một phương pháp RL

b)

Một giá trị epsilon vô cùng bé

c)

Một chính sách thưởng của RL

d)

Một chính sách chọn hành động trong RL

3.

Khi huấn luyện Agent theo phương pháp RL dạng bảng:

 A. Bảng Q-value không được dùng cho Sarsa

 B. Bảng Q-value của Sarsa có kích thước lớn hơn bảng Q-value của Q-learning với bài toán có cùng số trạng thái và hành động.

 C. Chỉ số discount Gamma có giá trị thuộc [0, 0.9)

a)

A. Bảng Q-value không được dùng cho Sarsa

b)

 B. Bảng Q-value của Sarsa có kích thước lớn hơn bảng Q-value của Q-learning với bài toán có cùng số trạng thái và hành động.

c)

C. Chỉ số discount Gamma có giá trị thuộc [0, 0.9

d)

D. Bảng V-value có kích thước nhỏ hơn bảng Q-value với bài toán có cùng số trạng thái và hành động.

4.

: Chỉ số discount Gamma:

 

 

a)

A. Khiến Agent đánh giá thấp các phần thưởng ở trạng thái gần

b)

B. Giúp Agent tìm được đường đi ngắn đến GOAL

c)

. Giúp Agent tăng cường khai phá

d)

D. Giúp Agent tăng cường khai thác.

5.

Phương trình Bellman:

 

a)

A. Chỉ dùng để cập nhật trạng thái của Agent.

b)

B. Là phương trình đệ qui.

c)

C. Là phương trình dạng tổng vô số thành phần

d)

D. Chỉ dùng để tính Q-value tại trạng thái s, ứng với hành động a

6.

Tích chập liên tục 1 chiều

a)

Có tính phân phối với phép cộng

b)

Không có tính giao hoán

c)

hông có tính kết hợp

d)

Có thể không xác định mặc dù các hàm đầu vào là xác định.

7.

Lớp Max Pooling 3x3 và Average Pooling 2x2

a)

Được dùng trước tất cả các lớp thực hiện tính tích chập

b)

Cho ra kích thước giống nhau với ngõ vào cùng kích thước

c)

Giữ nguyên kích thước so với ngõ vào

d)

Làm giảm kích thước so với ngõ vào

8.

: Kĩ thuật Dropout

a)

Các nút được chọn tắt được tắt theo thứ tự

b)

Giải quyết vấn đề quá khớp (overfitting)

c)

Giải quyết vấn đề thiếu khớp (underfitting)

d)

. Các nút được chọn tắt được tắt ngẫu nhiên trong quá trình testing

9.

: Chọn phát biểu SAI

a)

ANN thường dùng activation function tanh.

b)

Softmax là một activation function

c)

Tanh là activation function có giới hạn ngõ ra thuộc (-1, 1)

d)

Leaky ReLU là activation function có giới hạn ngõ ra là [0, +Inf)

10.

: Chọn phát biểu SAI:

a)

Mạng RNN có thể học qua toàn bộ chuỗi theo thứ tự thuận hoặc ngược,

b)

Mạng RNN học được các cấu trúc con

c)

. Mạng RNN có thể xử lý các chuỗi có chiều dài tùy ý.

d)

Mạng RNN không phù hợp với nhận dạng hành động qua dữ liệu video.

11.

Giả sử ta có 10000 mẫu dữ liệu X và 10000 nhãn y tương ứng. Chia thành các tập để huấn luyện một DLN theo tỉ lệ train-test là 80-20. Nếu số epoch = 5, thì tổng số lần đọc điểm dữ liệu mẫu của DLN trong quá trình huấn luyện là bao nhiêu:

a)

50000

b)

40000

c)

. 20000

d)

. 10000

12.

Giả sử ta có 20000 mẫu dữ liệu X và 20000 nhãn y tương ứng. Chia thành các tập để huấn luyện một DLN theo tỉ lệ train-test là 80-20. Nếu bachsize là 1000 thì số Iteration huấn luyện là bao nhiêu?

a)

16

b)

20

c)

32

d)

64

13.

Trong bài toán huấn luyện xe leo núi (Moutain Car):

a)

Số episode là số lần xe thực hiện hành động trong mỗi step.

b)

Số step huấn luyện trong mỗi episode có xu hướng giảm khi xe đến được GOAL

c)

Số step huận luyện luôn không đổi trong mỗi episode.

d)

Chính sách greedy có thể được sử dụng trong quá trình huấn luyện.

14.

Đối với một activation h(x),

a)

h(3x): kéo giãn hàm h(x) theo trục x

b)

h(x-5): dời hàm h(x) về bên phải

c)

h(x/2 -3): nén hàm h(x) theo trục x và sau đó dời hàm h(x) sang trái

d)

h(-x + 2): dời h(x) về bên phải và sau đó thực hiện phép đối xứng qua trục tung.

15.

: Khi vẽ đường ROC cho bài toán phân loại 2 lớp (nhãn 0 và 1)

a)

Số điểm trên đường ROC phụ thuộc vào số điểm dữ liệu được dùng khi kiểm tra mô hình.

b)

Số điểm trên đường ROC phụ thuộc vào số điểm có nhãn 0, nhưng được máy phân loại là 1

c)

Số điểm trên đường ROC phụ thuộc vào số điểm có nhãn 0, nhưng được máy phân loại là 0

d)

Số điểm trên đường ROC phụ thuộc vào số điểm có nhãn 1, nhưng được máy phân loại là 1

16.

Đối với một mô hình phân loại nhị phân, chọn phát biểu SAI:

a)

ROC được vẽ trong giới hạn của đồ thị 2 chiều: [0, 1] cho trục hoành và [0, 1] cho trục tung

b)

Giá trị AUC không phụ thuộc vào ROC

c)

AUC có giá trị thuộc [-1, 1]

d)

Một model phân loại nhị phân có thể có nhiều AUC

17.

Cấu trúc của CNN là:

a)

One to One, One to many

b)

. One to many, many to one

c)

Many to one, many to many

d)

Tất các kiểu được nêu.

18.

Cho câu sau: “Dai hoc khoa hoc may tinh” biểu diễn dưới dạng One hot thì số chiều của ma trận One hot thông thường là:

a)

6 x 6

b)

. 6 x 5

c)

5 x 6

d)

5 x 5

19.

PCA (Principal Component Analysis) dùng để làm gì

a)

Là một kỹ thuật dùng để dự đoán

b)

Là một kỹ thuật dùng để phân lớp.

c)

Là một kỹ thuật dùng để tách dữ liệu thành hai bộ train và test.

d)

Là kỹ thuật dùng để giảm số chiều dữ liệu

20.

Dùng thư viện Pandas để chuyển câu “Ca an kien, kien an ca” ra ma trận One hot thì ma trận có số chiều là

a)

. 4 x 4

b)

4 x 3

   

c)

6 x 6

d)

3 x 6

21.

Biểu diễn câu “Dai hoc khoa hoc may tinh” sang ma trận One hot dùng kỹ thuật CountBase với Window size =1 tính từ trái sang, thì vector được tạo từ từ “hoc” là:

a)

 A. 1 0 1 1 0

b)

 C. 1 1 0 1

c)

 B. 0 1 1 0 1

d)

D. 0 1 0 1

22.

Trong kỹ thuật CountBase (count base method) window size =1 nghĩa là:

a)

  D. Tính một từ bên phải của từ đang xét.

b)

  B. Tinh một từ bên phải hoặc một từ bên trái của từ đang xet.

c)

Tính một từ bên trái của từ đang xét.

d)

 A. Tính một từ bên trái và bên phải của từ đang xét

23.

Kỹ thuật Skip-gram trong Word2vec là:

   

   

   

   

a)

D. Dự đoán một từ dựa vào toàn bộ văn bản.

b)

A. Dự đoán những từ ngữ cảnh nếu biết trước từ đích.

c)

B. Dựa vào những từ ngữ cảnh để dự đoán từ đích.

d)

C. Dự đoán một từ dựa vào toàn đoạn văn bản.

24.

24 : LSTM bổ sung bao nhiêu cổng vào CNN

   

a)

    C. 4

b)

 D. 5

c)

A. 2

d)

    B. 3

25.

: LSTM sử dụng bao nhiêu hàm sigmod và bao nhiều hàm tanh trong mỗi cell state

  

a)

 D. 2 sigmod, 3 tanh

b)

  A. 3 sigmod, 4 tanh

c)

B. 4 sigmod, 3 tanh

d)

C. 3 sigmod, 2 tanh

26.

Kỹ thuật CBOWtrong Word2vec là:

a)

Dự đoán những từ ngữ cảnh nếu biết trước từ đích.

b)

B. Dựa vào những từ ngữ cảnh để dự đoán từ đích.

c)

Dự đoán một từ dựa vào toàn đoạn văn bản

d)

Dự đoán một từ dựa vào toàn bộ văn bản.

27.

: Cho a =[0 1 0 1 2 1 0 2 0 2] cho bộ lọc w=[0 1 1]. Tính y[2].

a)

2

b)

1

c)

3

d)

4

28.

: Trong CNN, cho vector a có độ dài là 20, bộ lọc w có độ dài là 3. Để cho vector đầu y có chiều bằng a thì phải bổ sung bao nhiều số 0 vào mỗi đầu của a.

a)

1

b)

2

c)

3

d)

4

29.

Trong CNN, cho vector a có độ dài là 20, bộ lọc w có độ dài là 5. Để cho vector đầu y có chiều bằng a thì phải bổ sung bao nhiều số 0 vào mỗi đầu của a.

a)

1

b)

2

c)

3

d)

4

30.

: Trong CNN, cho a có số chiều là 4x4 và bộ lọc có số chiều là 3x3, số chiều của ma trận đầu ra là:

a)

3x3

b)

2x2

c)

3x2

d)

2x3