wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

tri tuệ nhân tạo

Total questions: 45

Worksheet time: 23mins

Name
Class
Date
1.

Logistic regression là một kỹ thuật phân loại được sử dụng chủ yếu cho:

a)

Bài toán hồi quy tuyến tính

b)

Bài toán phân loại nhị phân

c)

Bài toán phân loại nhiều lớp

d)

Bài toán hồi quy phi tuyến tính

2.

Trong Logistic Regression, hàm kích hoạt nào thường được sử dụng?

a)

Hàm tuyến tính

b)

Hàm sigmoid

c)

Hàm ReLU

d)

Hàm tanh

3.

Để đánh giá mô hình logistic regression, bạn có thể sử dụng chỉ số nào sau đây?

a)

R-squared

b)

Mean Squared Error (MSE)

c)

Confusion Matrix

d)

Adjusted R-squared

4.

Trong Logistic Regression, để giải quyết vấn đề overfitting, bạn có thể sử dụng phương pháp nào?

a)

Thêm thuộc tính mới

b)

Giảm số lượng dữ liệu

c)

Regularization (L1, L2)

5.

Trong Logistic Regression, thông số nào sau đây cho biết độ mạnh của sự ảnh hưởng của một biến độc lập đến biến phụ thuộc?

a)

Độ dốc (slope)

b)

Hệ số (coefficient)

c)

Giá trị trung bình

d)

Hằng số (constant)

6.

Cho dữ liệu sau: 3, 7, 5, 9, 6, 2, 8 Tính giá trị trung vị (median) của tập dữ liệu trên.

a)

5

b)

6

c)

7

d)

8

7.

Cho tập dữ liệu: 4, 6, 8, 10, 12 Tính phương sai (variance) của tập dữ liệu trên.

a)

8

b)

10

c)

12

d)

16

8.

Độ tương quan Pearson giữa hai biến X và Y có giá trị nào sau đây thể hiện sự tương quan mạnh nhất?

a)

-0.9

b)

0.3

c)

-0.1

d)

0.8

9.

Trong các phương pháp sau, phương pháp nào thường không được sử dụng cho bài toán phân loại (classification)?

a)

Logistic Regression

b)

Support Vector Machines

c)

Decision Trees

d)

Linear Regression

10.

Khi đánh giá mô hình hồi quy, chỉ số nào dưới đây không phải là một tiêu chí đánh giá thường dùng?

a)

Mean Absolute Error (MAE)

b)

Root Mean Square Error (RMSE)

c)

Accuracy

d)

R-squared (R²)

11.

Trong phương pháp phân cụm K-Means, bước nào sau đây là quan trọng nhất để đảm bảo kết quả tốt?

a)

Chọn số cụm k

b)

Sắp xếp lại các cụm

c)

Khởi tạo các tâm cụm (centroids)

d)

Tính toán độ lệch chuẩn trong cụm

12.

Trong học tăng cường, thuật ngữ nào sau đây mô tả sự thay đổi của trạng thái môi trường sau khi thực hiện một hành động?

a)

Action

b)

State

c)

Reward

d)

Transition

13.

Cho tập dữ liệu: 12, 15, 9, 11, 14, 13 Tính phương sai (variance) theo mẫu (sample variance) của tập dữ liệu này.

a)

3.2

b)

4.4

c)

3.9

d)

5.1

14.

Cho dãy số liệu: 10, 14, 18, 12, 16 Tính độ lệch chuẩn (standard deviation) theo mẫu (sample standard deviation) của dãy số liệu trên.

a)

3.16

b)

2.98

c)

4.12

d)

5.24

15.

Cho hai biến X và Y với các giá trị: X: 1, 2, 3, 4, 5 Y: 2, 4, 5, 4, 5 Tính hệ số tương quan Pearson giữa X và Y.

a)

0.89

b)

0.6

c)

0.77

d)

0.91

16.

Cho tập dữ liệu: 23, 29, 20, 32, 23, 21 Tính giá trị trung vị (median) của tập dữ liệu trên.

a)

23

b)

24

c)

25

d)

26

17.

Bạn có một tập dữ liệu với biến độc lập X và biến phụ thuộc Y. Dựa trên mô hình hồi quy tuyến tính, công thức của đường hồi quy là Y = 2X + 3. Dự đoán giá trị của Y khi X = 4.

a)

8

b)

11

c)

10

d)

9

18.

Cho tập dữ liệu: 5, 7, 9, 11, 13 Tính giá trị trung bình (mean) và phương sai (variance) theo mẫu của tập dữ liệu này.

a)

Mean = 9, Variance = 6

b)

Mean = 9, Variance = 8

c)

Mean = 8, Variance = 5

d)

Mean = 10, Variance = 7

19.

Câu hỏi về tính toán phạm vi (range) và khoảng tứ phân vị (interquartile range): Cho tập dữ liệu: 8, 15, 22, 10, 7, 18, 25 Tính phạm vi (range) và khoảng tứ phân vị (IQR) của tập dữ liệu trên.

a)

Range = 18, IQR = 7

b)

Range = 17, IQR = 9

c)

Range = 18, IQR = 14

d)

Range = 19, IQR = 10

20.

Câu hỏi về Accuracy: Bạn có một mô hình phân loại với kết quả như sau: 80 trường hợp dự đoán đúng (true positive), 10 trường hợp dự đoán sai là có (false positive), 5 trường hợp dự đoán sai là không (false negative), và 105 trường hợp dự đoán đúng là không (true negative). Tính Accuracy của mô hình.

a)

0.85

b)

0.90

c)

0.925

d)

0.80

21.

Câu hỏi về Precision: Sử dụng thông tin từ câu hỏi trước, tính Precision của mô hình.

a)

0.88

b)

0.89

c)

0.92

d)

0.95

22.

Câu hỏi về Recall: Sử dụng thông tin từ câu hỏi đầu tiên, tính Recall của mô hình.

a)

0.85

b)

0.89

c)

0.94

d)

0.95

23.

Câu hỏi về F1 Score: Từ các giá trị Precision và Recall đã tính, tính F1 Score cho mô hình.

a)

0.89

b)

0.91

c)

0.87

d)

0.93

24.

Câu hỏi tổng hợp về Precision và Recall: Một mô hình phân loại có các giá trị sau: True Positives (TP) = 50, False Positives (FP) = 10, False Negatives (FN) = 20. Tính Precision và Recall.

a)

Precision = 0.83, Recall = 0.71

b)

Precision = 0.91, Recall = 0.71

c)

Precision = 0.83, Recall = 0.80

d)

Precision = 0.91, Recall = 0.80

25.

Câu hỏi về đánh giá mô hình: Một mô hình phân loại dự đoán 100 trường hợp trong đó 70 dự đoán đúng là dương (true positive), 20 dự đoán sai là dương (false positive), 10 dự đoán sai là âm (false negative), và 60 dự đoán đúng là âm (true negative). Tính các giá trị Precision, Recall, và F1 Score.

a)

Precision = 0.77, Recall = 0.87, F1 Score = 0.81

b)

Precision = 0.78, Recall = 0.87, F1 Score = 0.82

c)

Precision = 0.77, Recall = 0.88, F1 Score = 0.82

d)

Precision = 0.78, Recall = 0.88, F1 Score = 0.83

26.

Trong một tình huống mà bạn cần giảm thiểu số lượng False Negatives (FN), bạn sẽ tập trung cải thiện chỉ số nào của mô hình?

a)

Accuracy

b)

Precision

c)

Recall

d)

F1 Score

27.

Tập huấn luyện (train set) trong quá trình huấn luyện mô hình có vai trò gì?

a)

Để kiểm tra hiệu suất của mô hình

b)

Để đánh giá độ chính xác của mô hình

c)

Để học các tham số của mô hình

d)

Để giảm thiểu lỗi của mô hình

28.

Tại sao tập kiểm tra (test set) không nên được sử dụng trong quá trình huấn luyện mô hình?

a)

Để tránh tình trạng mô hình bị quá khớp (overfitting)

b)

Để tiết kiệm thời gian huấn luyện

c)

Để tăng cường tính chính xác của mô hình

d)

Để giảm thiểu sự phức tạp của mô hình

29.

Điểm khác biệt chính giữa tập huấn luyện và tập kiểm tra là gì?

a)

Tập huấn luyện dùng để kiểm tra mô hình, còn tập kiểm tra dùng để huấn luyện mô hình

b)

Tập huấn luyện dùng để huấn luyện mô hình, còn tập kiểm tra dùng để đánh giá mô hình

c)

Tập huấn luyện dùng để giảm thiểu lỗi, còn tập kiểm tra dùng để tăng cường độ chính xác

d)

Tập huấn luyện dùng để kiểm tra độ chính xác, còn tập kiểm tra dùng để kiểm tra hiệu suất

30.

Nếu mô hình của bạn cho thấy hiệu suất rất tốt trên tập huấn luyện nhưng kém trên tập kiểm tra, hiện tượng này gọi là gì?

a)

Underfitting

b)

Regularization

c)

Cross-validation

d)

Overfitting

31.

Tại sao việc chia dữ liệu thành tập huấn luyện và tập kiểm tra là quan trọng?

a)

Để có thể kiểm tra các giả định thống kê

b)

Để đảm bảo mô hình có khả năng tổng quát hóa tốt

c)

Để giảm thiểu chi phí tính toán

d)

Để tăng tốc độ huấn luyện

32.

Tập kiểm tra (test set) được sử dụng chủ yếu để:

a)

Huấn luyện mô hình với các tham số tốt nhất

b)

Điều chỉnh siêu tham số (hyperparameters)

c)

Đánh giá hiệu suất tổng quát của mô hình

d)

Chọn mô hình tốt nhất từ các mô hình đã huấn luyện

33.

Cross-validation thường được sử dụng trong bối cảnh nào và với mục đích gì?

a)

Để huấn luyện mô hình với dữ liệu lớn hơn

b)

Để chọn siêu tham số tối ưu và đánh giá khả năng tổng quát của mô hìnhn

c)

Để giảm thời gian huấn luyện

d)

Để cải thiện tốc độ dự đoán của mô hình

34.

R² score trong hồi quy là gì?

a)

Đo lường độ chính xác của mô hình bằng cách so sánh số lượng dự đoán đúng

b)

Đo lường sự khác biệt giữa giá trị dự đoán và giá trị thực tế

c)

Đo lường tỷ lệ biến thiên của biến phụ thuộc được giải thích bởi biến độc lập

d)

Đo lường sự khác biệt giữa các điểm dữ liệu với giá trị trung bình của chúng

35.

Một mô hình hồi quy tuyến tính có các giá trị thực tế là [3, 4, 5, 6] và giá trị dự đoán là [2.8, 3.9, 5.1, 5.9]. Tính R² score.

a)

0.97

b)

0.95

c)

0.99

d)

0.92

36.

Nếu một mô hình hồi quy có R² score bằng 0.85, điều này có nghĩa là gì?

a)

85% biến thiên trong biến độc lập được giải thích bởi mô hình

b)

85% biến thiên trong biến phụ thuộc được giải thích bởi biến độc lập

c)

15% biến thiên trong biến độc lập được giải thích bởi biến phụ thuộc

d)

15% biến thiên trong biến phụ thuộc được giải thích bởi mô hình

37.

Một mô hình có R² score rất cao trên tập huấn luyện nhưng thấp trên tập kiểm tra có thể là dấu hiệu của hiện tượng gì?

a)

Underfitting

b)

Overfitting

c)

Proper fitting

d)

Regularization

38.

R² score có thể có giá trị âm trong trường hợp nào?

a)

Khi mô hình có khả năng dự đoán hoàn hảo

b)

Khi mô hình dự đoán tốt hơn giá trị trung bình của dữ liệu

c)

Khi mô hình dự đoán tệ hơn so với việc sử dụng giá trị trung bình của dữ liệu

d)

Khi dữ liệu không có sự biến thiên

39.

Cho các giá trị thực tế: [10, 15, 20, 25] và các giá trị dự đoán: [12, 14, 19, 24]. Tính R² score.

a)

0.80

b)

0.85

c)

0.90

d)

0.95

40.

Bạn có một tập dữ liệu chứa các thông tin về các email và bạn muốn phân loại chúng thành "spam" và "không spam". Đây là ví dụ của loại học máy nào?

a)

Supervised learning

b)

Unsupervised learning

c)

Reinforcement learning

d)

Semi-supervised learning

41.

Khi bạn có một tập dữ liệu khách hàng với các thuộc tính như độ tuổi, thu nhập, và bạn muốn nhóm các khách hàng này vào các phân khúc khác nhau mà không có nhãn trước. Đây là loại bài toán gì?

a)

Supervised learning

b)

Unsupervised learning

c)

Reinforcement learning

d)

Semi-supervised learning

42.

Bài toán dự đoán giá nhà dựa trên các yếu tố như diện tích, số phòng, và vị trí thuộc loại nào trong học máy?

a)

Supervised learning

b)

Unsupervised learning

c)

Reinforcement learning

d)

Semi-supervised learning

43.

Bạn có một tập dữ liệu về hình ảnh và muốn nhóm các hình ảnh tương tự lại với nhau mà không biết trước các nhóm. Đây là ví dụ của phương pháp nào?

a)

Classification

b)

Clustering

c)

Regression

d)

Dimensionality reduction

44.

Trong bài toán dự đoán thời gian kết thúc của một vận động viên chạy marathon dựa trên lịch sử các lần chạy trước, bạn sẽ sử dụng loại học máy nào?

a)

Supervised learning

b)

Unsupervised learning

c)

Reinforcement learning

d)

Semi-supervised learning

45.

Một công ty muốn phân tích dữ liệu về lịch sử mua sắm của khách hàng để phát hiện ra các nhóm hành vi mua sắm khác nhau mà không có nhãn sẵn có. Bài toán này thuộc loại nào?

a)

Supervised learning

b)

Unsupervised learning

c)

Reinforcement learning

d)

Semi-supervised learning