wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Nhập môn khoa học dữ liệu và trí tuệ nhân tạo

Total questions: 74

Worksheet time: 37mins

Name
Class
Date
1.

Đáp án đầy đủ nhất khi nói về khía cạnh chính của khoa học dữ liệu?

a)

Tiền sử lí dữ liệu

b)

Phân tích dữ liệu

c)

Tất cả các lựa chọn còn lại

d)

Thu thập dữ liệu

2.

Đại lượng nào sau đây KHÔNG được coi là đặc trưng thống kê về cân nặng của gà trong một trang trại?

a)

Giá trị trung vị (median)

b)

Giá trị trung bình (mean)

c)

Phương sai (Variance)

d)

Tên chủ trang trại

3.

Mục đích của trực quan trong dữ liệu trong khoa học dữ liệu là gì

a)

Để chuẩn bị dữ liệu cho việc xây dựng các thuật toán học máy

b)

Để tìm kiếm các quy luật trong dữ liệu

c)

Để làm sạch và xử lí dữ liệu

d)

Để thực hiện việc trình bày thông tin bằng ngôn ngữ hình ảnh phục vụ việc trao đổi thông điệp và dữ liệu với các bên liên quan

4.

Việc chuẩn hoá dữ liệu là gì?

a)

Là quá trình biến đổi dữ liệu theo phân phối Gaussian

b)

Là quá trình biến đổi dữ liệu sang một định dạng (format) chuẩn

c)

Là quá trình loại bỏ những điểm những dữ liệu bất thường

d)

Là quá trình thay đổi lại thang đo của các đại lượng trong tập dữ liệu để dùng trong học máy

5.

Cho tập dữ liệu sau X= [ -1.444, - 1.467, - 1.224, -1.151, - 1.402]. Giá trị độ lệch chuẩn (std) của tập dữ liệu trên là?

a)

0.712

b)

0.127

c)

-0.127

d)

0.712

6.

Cho tập dữ liệu sau: X=[-0.044, -0.314, -0.03,-0.01, -0.205] Giá trị trung vị (median) của tập dữ liệu trên là

a)

-0.044

b)

-0.030

c)

-0.205

d)

-0.314

7.

Cho tập dữ liệu sau: X=[-0.426,-0.428,-0.464, -0.207,-0.276] Giá trị trung vị(median) của tập dữ liệu trên là

a)

-0.426

b)

-0.207

c)

0.428

d)

-0.276

8.

Một hãng oto muốn nghiên cứu khả năng mua một loại xe mới của khách hàng, đối tượng nghiên cứu phù hợp nhất là:

a)

Tất cả các công nhân Việt Nam

b)

Những người trưởng thành có độ tuổi từ 18 đến 60

c)

Tất cả người dân sông tại TPHCM

d)

Tất cả những người dân sống tại TP HN

9.

Cho tập dữ liệu sau: X=[0.929, -1.656, -2.281, -4.177, 1.712] Giá trị trung bình của tập dữ liệu trên là

a)

1.095

b)

-1.095

c)

-0.995

d)

2.092

10.

Mệnh đề nào sau đây ĐÚNG trong các mệnh đề sau:

a)

Trí tuệ nhân tạo là khả năng thích nghi của các loài động vật

b)

Trí tuệ nhân tạo là khả năng của con người có thể xây dựng các chương trình máy tính có thể học.

c)

Trí tuệ nhân tạo có thể được xem như một chương trình máy tính có thể khái quát hoá tri thức từ dữ liệu để thực hiện một chức năng nào đó giống con người.

d)

Trí tuệ nhân tạo là trí tuệ tự nhiên của con người

11.

Biểu đồ tần suất(histogram) là gì?

a)

Là biểu đồ thể hiện sự phân phối của các điểm dữ liệu

b)

Là biểu đồ thể hiện tần suất xuất hiện của các điểm dữ liệu

c)

Là biểu đồ thể hiện giá trị trung bình của tập dữ liệu

d)

Là biểu đồ thể hiện mối quan hệ giữa các biến

12.

Cho tập dữ liệu sau: X=[-0.703, -0.344, -0.669, -0.636, -0.913] Giá trị trung bình của tập dữ liệu trên là?

a)

0.653

b)

-0.344

c)

-0.669

d)

-0.635

13.

Cho tập dữ liệu sau: X=[-1.217, -2.059, -0.868, -0.341, -1.237] giá trị trung bình

a)

-0.615

b)

-0.651

c)

0.615

d)

-1.1444

14.

Phát biểu nào sau đây không chính xác

a)

Giá trị trung bình của một tập dữ liệu luôn lớn hơn giá trị nhỏ nhất

b)

Phương sai là đại lượng đặc trưng cho độ phân tán của tập dữ liệu

c)

Giá trị trung bình của một tập dữ liệu luôn nhỏ hơn giá trị lớn nhất

d)

Phương sai là đại lượng đo lường dữ liệu

15.

Đặc trưng thuộc tính của dữ liệu là gì

a)

Vector có số thành phần bằng tổng số điểm dữ liệu và số thuộc tính

b)

Là số đối tượng nghiên cứu trong tập dữ liệu

c)

Vector trong không gian 3 chiều

d)

Là tập hợp các thuộc tính của các đối tượng nghiên cứu

16.

Một tập dữ liệu là gì

a)

Tập hợp các thuật toán

b)

Tập hợp các công cụ để lưu trữ dữ liệu

c)

Tập hợp các mô hình toán học

d)

Tập hợp thông tin nguyên thuỷ của các đối tượng thoả mãn một điều kiện nghiên cứu nào đó.

17.

Một tập dữ liệu thường được coi là một bảng, trong đó:

a)

Số hàng bằng số điểm dữ liệu, số cột là số thuộc tính của các đối tượng dữ liệu

b)

Số hàng luôn bằng số cột và bằng số điểm dữ liệu

c)

Số hàng bằng số điểm dữ liệu, số cột là một đặc trưng (thuộc tính) của các điểm dữ liệu.

d)

Số hàng bằng số cột

18.

Để nghiên cứu khả năng mua hàng của một khách hàng thì các đặc trưng nào về khách hàng là phù hợp với đối tượng nghiên cứu?

a)

Tuổi, giới tính, thu nhập, địa chỉ, nghề nghiệp

b)

Địa chỉ, địa chỉ email, chiều cao, cân nặng

c)

Địa chỉ, số điện thoại, nhóm máu, nghề nghiệp

d)

Địa chỉ email, tên, giới tính, nhóm máu

19.

Cho tập dữ liệu sau: X=[-1.217, -2.059, -0.868, -0.342, -1.237] Giá trị độ lệch chuẩn (std) của tập dữ liệu trên là

a)

-0.615

b)

-0.651

c)

0.615

d)

0.561

20.

Cho tập dữ liệu sau X=[-1.444, -1.467, -1.224, -1.151, -1.402] Giá trị độ lệch chuẩn của tập dữ liệu

a)

0.561

b)

0.127

c)

0.615

d)

-0.651

21.

Mục đích chính của khoa học dữ liệu là gì?

a)

Nghiên cứu để trích xuất các giá trị ẩn trong dữ liệu phục vụ việc đưa ra các quyết định để giải quyết một bài toán nghiệp vụ nào

b)

Tất cả các đáp án khác đều đúng

c)

Nghiên cứu để lưu trữ và quản lí dữ liệu

d)

Để trực quan hoá dữ liệu và xây dựng báo cáo

22.

Phần mềm nào sau đây Không phải là công cụ chính của khoa học dữ liệu?

a)

Ngôn ngữ lập trình R

b)

Các phần mềm xử lý bảng tính (spreadsheet - Excel)

c)

Microsoft Word

d)

Ngôn ngữ lập trình Python

23.

Định nghĩa của khoa học dữ liệu là gì?

a)

Là việc sử dụng các mô hình thống kê để phân tích dữ liệu

b)

Là quá trình thu thập lưu trữ và quản lý dữ liệu

c)

Là lĩnh vực nghiên cứu liên ngành kết hợp toán thống kê khoa học dữ liệu và một số kiến thức chuyên môn sâu của dữ liệu để tìm kiếm các quy luật từ các tập dữ liệu

d)

Là việc tạo ra các biểu đồ trực quan hoá dữ liệu để trình bày các quy luật trong dữ liệu.

24.

Vai trò của nhà khoa học dữ liệu là gì?

a)

Xây dựng các phương thức trao đổi thông tin tóm tắt bản chất của dữ liệu liên quan

b)

Tất cả các phương án khác

c)

Xây dựng các mô hình dự báo và thuật toán

d)

Thu thập và làm sạch dữ liệu

25.

Mục đích chính trong công việc của các nhà khoa học dữ liệu là gì

a)

Cung cấp các gợi ý cho việc phát triển sản phẩm và dịch vụ mới

b)

Cải tiến quá trình xây dựng các quyết định trong kinh doanh

c)

Tất cả các phương pháp nghiên cứu

d)

Hỗ trợ các nghiên cứu khoa học

26.

Các kĩ năng cần có để thực thi một nhà phân tích dữ liệu cần có?

a)

Kỹ năng phân tích thống kê dữ liệu

b)

Kỹ năng lập trình

c)

Kỹ năng giao tiếp và trình bày

d)

Tất cả các kĩ năng được liệt kê

27.

Các hàng trong một bảng dữ liệu thường chứa các thông tin gì?

a)

Là một tập con thuộc các thuộc tính của một dữ liệu

b)

Là một tập con của các trường thông tin

c)

Là một trường thông tin chứa giá trị của một thuộc tính của các mẫu (đối tượng) dữ liệu

d)

Là các mẫu (đối tượng) trong tập dữ liệu

28.

Một đặc trưng của các mẫu (đối tượng) trong tập dữ liệu là gì?

a)

Là một thuộc tính của các mẫu dữ liệu

b)

Là một đối tượng trong tập dữ liệu

c)

Là một hàng trong bảng dữ liệu

d)

Là một tập hợp các đối tượng được nghiên cứu

29.

Phát biểu nào sau đây là KHÔNG chính xác?

a)

Giá trị trung bình của một tập dữ liệu luôn lớn giá trị nhỏ nhất

b)

Phương sai là đại lượng đặc trưng cho độ phân tán của tập dữ liệu

c)

Giá trị trung bình của một tập dữ liệu luôn nhỏ hơn giá trị lớn nhất

d)

Phương sai là đại lượng đo lường dữ liệu

30.

Đại lượng nào sau đây KHÔNG được coi là đặc trưng thống kê về cân nặng của đàn gà trong một trang trại?

a)

Giá trị trung vị

b)

Phương sai

c)

Giá trị trung bình

d)

Tên người chủ trại

31.

Công cụ nào sau đây không dùng để biểu diễn trực quan hoá dữ liệu?

a)

Các mô hình hồi qui tuyến tính

b)

Box plot

c)

Bar plot

d)

Scatter plot

32.

Đại lượng trung vị là gì?

a)

Là đại lượng chia đôi tập dữ liệu

b)

Là trung bình cộng của tập dữ liệu

c)

Là giá trị có tần suất xuất hiện nhiều nhất

d)

Là giá trị trung bình của tập dữ liệu

33.

Một tập dữ liệu là gì?

a)

Tập các thuật toán

b)

Tập hợp thông tin nguyên thuỷ của các đối tượng thoả mãn một điều kiện nghiên cứu nào đó

c)

Tập hợp các công cụ để lưu trữ dữ liệu

d)

Tập hợp các mô hình toán học

34.

Bước đầu tiên trong một quá trình làm khoa học dữ liệu

a)

Phân tích dữ liệu

b)

Trực quan hoá dữ liệu

c)

Làm sạch dữ liệu

d)

Thu thập dữ liệu

35.

Mục tiêu chính của việc làm sạch dữ liệu là gì?

a)

Để loại bỏ những điểm dữ liệu bị thiếu và không phù hợp

b)

Để bảo đảm tính chính xác và tương thích của dữ liệu

c)

Cả 2 đáp án trên

36.

Một tập dữ liệu được coi là một bảng:

a)

Số hàng bằng số điểm dữ liệu số cột là một đặc trưng (thuộc tính) của điểm dữ liệu

b)

Số hàng bằng số cột

c)

Số hàng luôn bằng số cột và bằng số điểm dữ liệu

d)

Số hàng bằng số mẫu (đối tượng) của tập dữ liệu số cột là số thuộc tính của các mẫu (đối tượng) dữ liệu

37.

Chương trình máy tính nào sau đây KHÔNG được coi là một ứng dụng của trí tuệ nhân tạo?

a)

Chương trình điều khiển xe tự lái

b)

Chương trình quản lý sinh viên

c)

Chương trình gợi ý các sản phẩm hoặc dịch vụ cho khách hàng

d)

Chương trình nhận diện khuôn mặt

38.

Đặc trưng thuộc tính của tập dữ liệu là gì?

a)

Là tập hợp các thuộc tính (giá trị thuộc tính) của các đối tượng nghiên cứu

b)

Chính là số đối tượng nghiên cứu trong tập dữ liệu

c)

Vector có số thành phần bằng tổng số điểm dữ liệu và số thuộc tính

d)

Vector trong không gian 3 chiều

39.

Mệnh đề nào sau đây ĐÚNG?

a)

Trí tuệ nhân tạo là trí tuệ của con người

b)

Trí tuệ nhân tạo là khả năng thích nghi của các loài động vật

c)

Trí nhân tạo có thể được xem như một chương trình máy tính có thể khái quát hoá tri thức từ dữ liệu để thực hiện một chức năng nào đó giống như một chuyên gia trong lĩnh vực đó.

d)

Trí tuệ nhân tạo là khả năng của con người có thể xây dựng các chương trình máy tính có thể học

40.

Hệ số tương quan của 2 biến là gì?

a)

Là đại lượng biểu diễn mối quan hệ giữa các giá trị trung bình của hai biến được chuẩn hoá

b)

Là đại lượng biểu diễn mối quan hệ giữa các giá trị của hai biến đã được chuẩn hoá

c)

Là đại lượng biểu diễn mối quan hệ giữa các giá trị trung bình của hai biến

d)

Là đại lượng biểu diễn mối quan hệ giữa hai biến.

41.

Chức năng của tập huấn luyện trong học máy là gì?

a)

Dùng để huấn luyện mô hình

b)

Dùng để so sánh với các mô hình khác

c)

Dùng để đánh giá mô hình

d)

Dùng để kiểm tra độ chính xác của mô hình.

42.

Quá trình xây dựng một mô hình học máy thường gồm các bước nào?

a)

Tiền xử lý dữ liệu

b)

Huấn luyện mô hình

c)

Thu nhập dữ liệu

d)

Tất cả các bước trên.

43.

Trong quá trình kiểm định một mô hình học máy, tỷ phần trăm dữ liệu dành cho tập kiểm tra thường là bao nhiêu?

a)

10-20%

b)

40-50%

c)

30-40%

d)

20-30%

44.

Một mô hình hồi quy tuyến tính thường được sử dụng để làm gì?

a)

Tìm ra mối quan hệ phi tuyến tính giữa các biến

b)

Tìm ra các mẫu trong tập dữ liệu

c)

Dự đoán một biến phụ thuộc từ một hoặc nhiều biến độc lập

d)

Phân loại các điểm dữ liệu vào các nhóm khác nhau

45.

Hệ số hồi quy trong một mô hình hồi quy tuyến tính thể hiện điều gì?

a)

Mối quan hệ giữa biến phụ thuộc khi biến độc lập thay đổi

b)

Mức độ biến động của biến phụ thuộc khi biến độc lập thay đổi

c)

Độ chính xác của mô hình

d)

Số lượng biến độc lập trong mô hình

46.

Phát biểu nào sau đây đúng về quá trình tiền xử lí dữ liệu

a)

Là bước không quan trọng trong quá trình làm khoa học dữ liệu

b)

Là bước cuối cùng trong quá trình làm khoa học dữ liệu

c)

Là bước đầu tiên trong quá trình làm khoa học dữ liệu

d)

Là bước có thể bỏ qua trong quá trình làm khoa học dữ liệu

47.

Mô hình hồi quy tuyến tính có thể được kiểm tra bằng cách nào?

a)

Bằng cách kiểm tra giá trị trung bình của biến phụ thuộc

b)

Bằng cách kiểm tra số tương quan giữa giá trị thực và giá trị dự đoá

c)

Bằng cách kiểm tra phương sai của các biến độc lập

d)

Bằng cách kiểm tra hệ số hồi quy của các biến độc lập

48.

Độ chính xác của một mô hình học máy tính là gì?

a)

Độ lệch chuẩn của các giá trị dự đoán

b)

Tỷ lệ phần trăm các dự đoán đúng so với tổng số dự đoán

c)

Tỷ lệ phần trăm các dự đoán so với tổng số dự đoán

d)

Sai số trung bình giữa các giá trị thực và giá trị dự đoán.

49.

Phương pháp nào sau đây được sử dụng để kiểm định độ chính xác của một mô hình học máy?

a)

K-fold validation

b)

Tất cả các phương pháp trên

c)

Holdout validation

d)

Cross-validation

50.

Với mô hình: y = 2x + 3 Hệ số góc là số nào?

a)

2

b)

3

c)

4

d)

5

51.

MAE là gì?

a)

Giá trị trung bình của absolute error

b)

Bình phương của error

c)

Căn bậc 2 của lỗi

d)

Không có phương án trả lời đúng

52.

Tính phương sai chuỗi số: 7, 3, 9, 2, 8, 6

a)

0

b)

6.75

c)

6.5

d)

6.47

53.

Mục tiêu chính của Data Science là gì?

a)

Tạo ra các mô hình 3D chân thực

b)

Tạo ra các ứng dụng di động

c)

Khám phá các khuôn mẫu (patterns), thông tin hữu ích và đưa ra quyết định dựa trên dữ liệu

d)

Lưu trữ dữ liệu trên đám mây

54.

Quá trình Data Science bao gồm các bước nào?

a)

Thiết kế đồ họa, tạo hoạt ảnh

b)

Quảng cáo, bán hàng, tiếp thị

c)

Thu thập dữ liệu, làm sạch dữ liệu, phân tích dữ liệu, trực quan hóa dữ liệu

d)

Lập trình, gỡ lỗi, triển khai

55.

Ứng dụng của Data Science trong lĩnh vực chăm sóc sức khỏe là gì?

a)

Chẩn đoán bệnh, phát hiện thuốc mới, y học cá nhân hóa

b)

Thiết kế các công trình kiến trúc

c)

Phát triển trò chơi điện tử

d)

Tạo hiệu ứng hình ảnh cho phim

56.

Loại AI nào tập trung vào việc thực hiện các nhiệm vụ cụ thể

a)

AI hẹp (Narrow AI)

b)

AI siêu việt (Super AI)

c)

AI đa nhiệm (Multitask AI)

d)

AI tổng quát (General AI)

57.

Phương pháp học có giám sát (supervised learning) có đặc điểm gì?

a)

Chỉ yêu cầu output

b)

Yêu cầu cả input và output label

c)

Chỉ yêu cầu input

d)

Tự học được theo thời gian

58.

Phương pháp học AI nào sau đây có đặc điểm là dễ thu thập dữ liệu huấn luyện nhất?

a)

Supervised learning

b)

Reinforcement learning

c)

Unsupervised learning

59.

Công nghệ nhận diện khuôn mặt trong ứng dụng chuyển tiền ngân hàng thuộc phân loại AI nào?

a)

Generative AI

b)

Narrow AI

c)

Artificial Superintelligence

60.

Dữ liệu âm thanh thuộc loại là dữ liệu gì?

a)

Phi cấu trúc

b)

Bán cấu trúc

c)

Có cấu trúc

61.

Dữ liệu điểm danh lớp học là loại dữ liệu gì?

a)

Có cấu trúc

b)

Bán cấu trúc

c)

Phi cấu trúc

62.

Phần mềm nào sau đây ít có khả năng được sử dụng nhất trong khoa học dữ liệu

a)

Ngôn ngữ lập trình Python

b)

Phần mềm excel

c)

Phần mềm Photoshop

d)

Ngôn ngữ lập trình C

63.

Mục đích của việc của làm khoa học dữ liệu là gì?

a)

Hỗ trợ nghiên cứu khoa học

b)

Hỗ trợ trong đưa ra quyết định trong kinh doanh

c)

Tất cả các phương án

d)

Cung cấp gợi ý cho việc phát triển sản phẩm

64.

Một mẫu trong cơ sở dữ liệu là gì?

a)

Một ô trong bảng

b)

Một hàng trong bảng

c)

Một cột trong bảng

d)

Một bảng dữ liệu

65.

Thuộc tính của mẫu dữ liệu là gì?

a)

Là hàng trong bảng

b)

Là thông tin về cột trong bảng

c)

Là ô giá trị trong bảng

d)

Là bảng dữ liệu

66.

Câu nào sau đây đúng?

a)

Hỏi quy tuyến tính mô hình hóa mối quan hệ giữa 1 biến phụ thuộc và 1 hoặc nhiều biến độc lập

b)

Hỏi quy tuyến tính mô hình hóa mối quan hệ giữa 1 biến phụ thuộc và 1 biến độc lập

c)

Hỏi quy tuyến tính mô hình hóa mối quan hệ giữa 1 biến độc lập và nhiều biến phụ thuộc

d)

Hỏi quy tuyến tính mô hình hóa mối quan hệ giữa nhiều biến phụ thuộc

67.

Logic mệnh đề là gì?

a)

Công cụ toán học logic, trong đó có các mệnh đề và các biểu thức

b)

Tập các ký hiệu và tập các luật xây dựng công thức

c)

Xác định ngữ nghĩa của các công thức trong thế giới hiện thực.

d)

Biểu diễn tri thức về thế giới với các đối tượng.

68.

Câu nào dưới đây KHÔNG là một mệnh đề.

a)

An là sinh viên khoa CNTT

b)

An không phải học Trí Tuệ Nhân Tạo

c)

X là sinh viên không phải học Trí tuệ nhân tạo.

d)

An là sinh viên CNTT nhưng không phải học Trí tuệ nhân tạo

69.

Có mấy phép kết nối logic trong mệnh đề

a)

2

b)

3

c)

4

d)

5

70.

Ai là người đề ra thuật ngữ "Trí tuệ nhân tạo"

a)

John McCarthy

b)

Alan Turing

c)

Elon Musk

d)

Bill Gates

71.

Turing test là

a)

Bài toán kiểm tra khả năng trí tuệ của máy tính

b)

Bài toán kiểm tra khả năng giải thuật

c)

Bộ câu hỏi lý thuyết về trí tuệ nhân tạo

d)

Bộ câu hỏi lý thuyết về khoa học máy tính

72.

Những mô hình tính toán có cách thức suy nghĩ giống con người được gọi là.

a)

Mô hình mạng nơ-ron

b)

Mô hình hồi quy tuyến tính

c)

Mô hình cây lí thuyết

d)

Mô hình hồi quy logistic

73.

Đâu là ứng dụng của trí tuệ nhân tạo

a)

Thị giác máy tính

b)

Xử lý ngôn ngữ tự nhiên

c)

Học máy

d)

Tất cả đáp án trên

74.

Hàm đánh giá dùng để

a)

Tính toán mức độ tốt/xấu, khả năng về đích của trạng thái

b)

Tính toán thời gian của thuật toán

c)

Tính toán độ lớn của thuật toán

d)

Tính toán sự sai lệch giữa trạng thái đầu và trạng thái đích của thuật toán