Font size
WorksheetsCâu hỏi về Mô hình Agent Thông minh
Total questions: 62
Worksheet time: 31mins
Thành phần nào dưới đây không phải là một phần của mô hình agent thông minh?
Môi trường (Environment)
Cảm biến (Sensors)
Hệ điều hành (Operating System)
Bộ thực thi hành động (Actuators)
Một robot quét dọn nhà sử dụng cảm biến bụi để xác định nơi bẩn và sau đó di chuyển đến vị trí đó để làm sạch. Đây là ví dụ của loại agent nào?
Simple Reflex Agent (Agent phản xạ đơn giản)
Utility-Based Agent (Agent dựa trên hàm tiện ích)
Goal-Based Agent (Agent dựa trên mục tiêu)
Learning Agent (Agent có khả năng học tập)
Trong mô hình PEAS, thành phần nào đánh giá mức độ hiệu quả của agent?
Environment (Môi trường)
Actuators (Bộ thực thi hành động)
Sensors (Cảm biến)
Performance Measure (Thước đo hiệu suất)
Trong hệ thống chatbot hỗ trợ khách hàng, thành phần nào sau đây thuộc Sensors (Cảm biến) trong mô hình PEAS?
Các phản hồi được chatbot gửi lại cho khách hàng
Giao diện nhận đầu vào văn bản hoặc giọng nói từ khách hàng
Mức độ hài lòng của khách hàng sau khi tương tác
Lịch sử truy vấn của khách hàng được lưu trữ
Môi trường nào dưới đây là discrete (rời rạc) thay vì continuous (liên tục)?
Trò chơi cờ vua
Robot di chuyển trong nhà kho
Xe tự lái trên đường
Máy bay điều khiển tự động
Thuật toán nào sau đây không thuộc nhóm uninformed search?
Breadth-First Search (BFS)
Depth-First Search (DFS)
A* Search
Uniform-Cost Search (UCS)
Giả sử bạn cần mô hình hóa bài toán tìm đường đi trong mê cung để giải bằng uninformed search. Đại diện nào sau đây phù hợp nhất để mô hình hóa không gian trạng thái?
Một danh sách các hành động khả thi (trái, phải, lên, xuống)
Một đồ thị có các ô trong mê cung là đỉnh và các cạnh là lối đi giữa các ô
Một hàm heuristic để ước lượng khoảng cách đến đích
Một danh sách các tọa độ của bức tường trong mê cung
Trong bài toán 8 puzzle (trò chơi đố trượt với 8 ô số và 1 ô trống), đâu là cách thích hợp để biểu diễn trạng thái?
Một ma trận 3×3 thể hiện vị trí của các ô số
Một biến chứa vị trí xuất hiện của ô trống
Một chuỗi nhị phân mã hóa tính đúng/sai về vị trí của các số
Một danh sách các nước đi hợp lệ từ trạng thái hiện tại
Thuật toán Uniform-Cost Search (UCS) khác với Breadth-First Search (BFS) như thế nào?
UCS ưu tiên mở rộng nút có chi phí thấp nhất, còn BFS mở rộng theo nút có độ sâu nhất
UCS được cài đặt sử dụng cấu trúc dữ liệu hàng đợi (queue), trong khi BFS sử dụng cấu trúc dữ liệu ngăn xếp (stack)
UCS xem xét chi phí đường đi, còn BFS chỉ xét số bước đi từ trạng thái ban đầu
UCS sử dụng heuristic để tìm đường đi tốt nhất, còn BFS thì không
Trong Depth-First Search (DFS), ta cần sử dụng cấu trúc dữ liệu nào để cài đặt danh sách các nút đang chờ mở rộng?
Queue (hàng đợi)
Stack (ngăn xếp)
Priority Queue (hàng đợi ưu tiên)
Hash Table (bảng băm)
Thuật toán tìm kiếm nào sau đây thuộc nhóm uninformed search?
A* search
Best-first search
Breadth-first search
Greedy search
Điểm khác biệt chính giữa informed search và uninformed search là gì?
Uninformed search luôn nhanh hơn informed search
Informed search sử dụng heuristic để dẫn hướng tìm kiếm, còn uninformed search không sử dụng heuristic
Informed search chỉ áp dụng được trên đồ thị có trọng số, còn uninformed search thì không
Uninformed search luôn tìm được đường đi tối ưu, còn informed search thì không
Trong thuật toán tìm kiếm A*, hàm đánh giá f(n) được tính như thế nào?
f(n)=g(n)
f(n)=g(n)−h(n)
f(n)=h(n)
f(n)=g(n)+h(n)
Điều kiện nào sau đây đảm bảo thuật toán tìm kiếm A* tìm ra đường đi tối ưu?
Hàm heuristic luôn trả về giá trị bằng 0
Hàm heuristic phải là một hàm hằng
Hàm heuristic phải là hàm chấp nhận được (admissible heuristic)
Hàm heuristic phải đánh giá chính xác khoảng cách đến đích
Trong thuật toán A*, nếu hàm heuristic h(n) luôn bằng 0, thuật toán sẽ hoạt động giống với thuật toán nào?
Breadth-First Search (BFS)
Depth-First Search (DFS)
Uniform-Cost Search (UCS)
Greedy Best-First Search
Trong thuật toán A*, cấu trúc dữ liệu nào thường được sử dụng để lưu trữ các nút đang chờ mở rộng?
Stack (ngăn xếp)
Queue (hàng đợi)
Priority Queue (hàng đợi ưu tiên)
Hash Table (bảng băm)
Thuật toán Minimax được sử dụng trong các trò chơi nào?
Trò chơi có thông tin không hoàn hảo như Poker
Trò chơi có thông tin hoàn hảo như Cờ vua, Cờ caro
Trò chơi một người như Sudoku
Trò chơi ngẫu nhiên như Xúc xắc
Trong thuật toán Minimax, nút MIN có nhiệm vụ gì?
Chọn nước đi có giá trị lớn nhất để tối đa hóa điểm số
Loại bỏ các trạng thái có điểm số thấp
Chọn nước đi có giá trị nhỏ nhất để giảm lợi thế của MAX
Cân bằng giữa việc tấn công và phòng thủ
Thuật toán Minimax hoạt động như thế nào?
Duyệt toàn bộ cây trạng thái để tìm nước đi tốt nhất
Chọn nước đi ngẫu nhiên và đánh giá kết quả
Tìm kiếm heuristic để chọn nước đi mà không duyệt toàn bộ cây
Chỉ đánh giá trạng thái hiện tại mà không xét đến tương lai
Mục đích chính của cắt tỉa Alpha-Beta trong thuật toán Minimax là gì?
Đảm bảo tìm kiếm tất cả các nút trong cây trò chơi
Tăng độ chính xác của việc đánh giá các trạng thái trong cây
Loại bỏ hoàn toàn các nước đi có giá trị thấp
Giảm số lượng nút cần được đánh giá mà không ảnh hưởng đến kết quả
Điều kiện nào sau đây cho phép thuật toán Alpha-Beta thực hiện cắt tỉa hiệu quả nhất?
Các nước đi được mở rộng theo thứ tự ngẫu nhiên
Các nước đi được sắp xếp theo giá trị tốt nhất trước khi tìm kiếm
Không có giới hạn độ sâu trong tìm kiếm
Chỉ sử dụng cắt tỉa Beta mà không cần cắt tỉa Alpha
Một mệnh đề được gọi là vững chắc (valid) nếu:
Nó đúng với ít nhất một phép gán giá trị chân lý
Nó mâu thuẫn với mệnh đề khác
Nó đúng với mọi phép gán giá trị chân lý
Nó có đúng 1 mô hình
Cho mệnh đề: ϕ = (P ∨ Q) ∧ ( ¬P ∨ R) Hỏi có bao nhiêu mô hình (cách gán giá trị chân lý cho P, Q, R) làm cho mệnh đề trên đúng?
3
4
5
6
Cho cơ sở tri thức KB, và mệnh đề α. Khi nào ta nói rằng KB⊨α ?
Khi α có ít nhất một mô hình thỏa mãn
Khi mọi mô hình của α đều là mô hình của KB
Khi mọi mô hình của KB đều là mô hình của α
Khi KB ∧ α là mâu thuẫn (unsatisfiable)
Cặp mệnh đề nào dưới đây là tương đương logic với nhau?
¬(P∧Q) và ¬P∧¬Q
¬(P∨Q) và ¬P ∨ ¬Q
¬P→¬Q và P∨Q
¬(P∧Q) và ¬P∨¬Q
Mệnh đề nào tương đương với P→Q?
¬P∧Q
¬P∨Q
P∧Q
¬Q→¬P
Cả B và D
Cho các mệnh đề: Nếu trời mưa thì đường trơn (M → S)
Trời mưa (M)
Kết luận hợp logic theo luật Modus Ponen là gì?
Không thể kết luận gì thêm
Trời không mưa
Đường trơn
Trời mưa và đường không trơn
Cho cơ sở tri thức:
P→Q
Q→R
P
Suy ra mệnh đề nào đúng?
R
Q
¬Q
P∧R
Trong logic mệnh đề, một literal là gì?
Một câu có dạng kéo theo, ví dụ: P→Q
Một câu luôn đúng trong mọi mô hình
Một ký hiệu mệnh đề hoặc phủ định của ký hiệu mệnh đề
Một nhóm các mệnh đề liên kết bằng phép toán tuyển (∨)
Trong logic mệnh đề, "câu tuyển" (clause) là gì?
Một câu dạng phủ định của kéo theo
Một câu dạng hội của các literal
Một câu dạng tuyển của các literal
Một câu dạng hội của tuyển của các literal
Thủ tục suy diễn tiến (forward chaining) hoạt động như thế nào?
Bắt đầu từ mệnh đề cần chứng minh và truy ngược về sự kiện ban đầu
Bắt đầu từ sự kiện đã biết và áp dụng luật suy diễn để rút ra kết luận mới
Duyệt tất cả mô hình và kiểm tra từng mô hình thỏa mãn
Biến đổi tương đương để rút gọn câu
Cho mô hình logistic regression với đầu vào x ∈ Rn, vector trọng số w ∈ Rn, và hệ số chệch b ∈ R. Biểu thức nào sau đây đúng cho bước lan truyền tiến (tính toán đầu ra)?
y^=xTw+b
y^=ReLU(wTx+b)
y^=sigmoid(wTx+b)
y^=softmax(wTx+b)
Trong logistic regression, giá trị đầu ra của mô hình (sau sigmoid) được hiểu là gì?
Điểm phân lớp rời rạc (0 hoặc 1)
Khả năng mô hình hội tụ
Khoảng cách Euclidean đến siêu phẳng quyết định
Xác suất điều kiện của lớp dương với đầu vào đã cho
Trong quá trình huấn luyện logistic regression bằng thuật toán gradient descent, hàm mất mát phổ biến nào thường được sử dụng?
Mean Squared Error (MSE)
Hinge loss
Cross Entropy Loss
Triplet Loss
Mục tiêu chính của thuật toán gradient descent trong huấn luyện mô hình là gì?
Tăng độ phức tạp mô hình để cải thiện độ chính xác
Tìm giá trị trọng số cực đại sao cho hàm mất mát lớn nhất
Tối thiểu hóa hàm mất mát bằng cách cập nhật trọng số theo hướng đạo hàm âm
Cố định các tham số và tăng cường dữ liệu đầu vào
Trong huấn luyện bằng gradient descent, điều gì xảy ra nếu learning rate α quá lớn?
Mô hình có thể dao động hoặc không hội tụ
Mô hình hội tụ nhanh hơn mà không gây ảnh hưởng
Hàm mất mát dừng lại ở cực tiểu toàn cục
Các gradient trở thành 0 và mô hình không học được
Trong huấn luyện logistic regression, đồ thị tính toán giúp ích gì?
Tăng độ chính xác của mô hình bằng cách thêm nhiều tham số
Biểu diễn quá trình tính toán có cấu trúc để tự động tính đạo hàm
Tối ưu hóa không gian lưu trữ trọng số
Biểu diễn kết quả huấn luyện dưới dạng đồ thị
Khi sử dụng đồ thị tính toán để huấn luyện logistic regression, bước nào sau đây mô tả backpropagation đúng nhất?
Tính giá trị đầu ra từ trái sang phải của đồ thị
Cập nhật trọng số trực tiếp mà không cần tính gradient
Lưu trữ kết quả huấn luyện theo chuỗi các ma trận
Xác định gradient của hàm mất mát đối với mỗi tham số bằng cách lan truyền đạo hàm ngược từ đầu ra về đầu vào
Tại sao nên sử dụng vector hóa khi cài đặt logistic regression?
Tận dụng hiệu suất tính toán của phần cứng (CPU/GPU) và giảm vòng lặp
Giảm số tham số trong mô hình
Tăng khả năng mô hình hóa các quan hệ phi tuyến
Giúp mô hình hội tụ nhanh hơn bằng cách tăng learning rate
Trong huấn luyện mô hình bằng gradient descent, đạo hàm của hàm mất mát theo một tham số w cho ta điều gì?
Giá trị nhỏ nhất mà hàm mất mát có thể đạt được
Tốc độ thay đổi của hàm mất mát khi thay đổi w
Độ chính xác trung bình trên tập huấn luyện
Hệ số học được cho lớp đầu ra
Tại điểm cực tiểu của hàm mất mát (điểm hội tụ lý tưởng), đạo hàm của hàm mất mát theo các tham số sẽ:
Có giá trị bất kỳ tùy theo hướng cập nhật
Luôn bằng 1
Tiến dần về 0
Bằng gradient ngẫu nhiên sinh từ noise
Mạng nơ-ron truyền thẳng (feedforward neural network) là gì?
Một mô hình trong đó tín hiệu có thể đi vòng lặp trong mạng
Một mạng trong đó thông tin truyền từ đầu vào đến đầu ra theo một hướng duy nhất, không có vòng lặp
Một mạng chỉ bao gồm một lớp ẩn và một lớp đầu ra
Một mạng có thể tự học không cần dữ liệu được gán nhãn
Trong mạng nơ-ron truyền thẳng, vai trò của hàm kích hoạt (activation function) là gì?
Truyền toàn bộ giá trị đầu vào sang lớp tiếp theo mà không thay đổi
Giảm số lượng tham số của mô hình
Giới hạn giá trị đầu ra của một nơ-ron và tạo tính phi tuyến cho mạng
Cố định giá trị đầu ra của mạng luôn trong khoảng [0, 1]
Hàm kích hoạt nào thường được sử dụng ở lớp đầu ra trong bài toán phân loại nhị phân?
ReLU
tanh
sigmoid
softmax
Hàm kích hoạt ReLU (Rectified Linear Unit) có đặc điểm khác biệt nào (so với các hàm kích hoạt thông dụng khác)?
Luôn cho đầu ra nằm trong khoảng [0, 1]
Cho giá trị âm nếu đầu vào âm
Cho đầu ra bằng 0 nếu đầu vào nhỏ hơn 0, và bằng chính đầu vào nếu lớn hơn 0
Luôn cho đầu ra nằm trong khoảng [-1, 1]
Hàm softmax thường được sử dụng trong lớp đầu ra của mạng nơ-ron cho bài toán nào?
Hồi qui tuyến tính
Phân lớp nhị phân
Phân cụm (clustering) không giám sát
Phân loại đa lớp (multi-class classification)
Mục đích chính của hàm softmax trong mạng nơ-ron là gì?
Giới hạn đầu ra trong khoảng [0, 1] cho mỗi nơ-ron
Biến đầu ra thành nhị phân
Chuẩn hóa trọng số trong mạng
Chuyển đầu ra thành các xác suất đại diện cho khả năng thuộc từng lớp
Trong huấn luyện mạng nơ-ron, phương pháp phổ biến nào được sử dụng để tính toán và cập nhật trọng số dựa trên độ dốc của hàm mất mát?
Thay đổi ngẫu nhiên trọng số
Sử dụng giải tích để giải trực tiếp ra bộ tham số tối ưu
Gradient descent kết hợp với lan truyền ngược để tính đạo hàm
Tối ưu hóa ngẫu nhiên với trọng số khởi tạo nhiều lần
Trong thiết kế và huấn luyện mạng nơ-ron, đâu là điểm khác biệt chính giữa parameter và hyperparameter?
Parameters được học từ dữ liệu, còn hyperparameters được thiết lập trước khi huấn luyện và điều chỉnh qua thử nghiệm
Parameters là các giá trị cố định, còn hyperparameters thay đổi trong quá trình huấn luyện
Parameters được chọn trước khi huấn luyện, còn hyperparameters được cập nhật từ dữ liệu
Parameters là cấu trúc mạng, còn hyperparameters là trọng số của từng nơ-ron
Hiện tượng overfitting trong huấn luyện mô hình mạng nơ ron (và học máy nói chung) xảy ra khi:
Mô hình không học được từ dữ liệu huấn luyện
Mô hình hoạt động tốt trên dữ liệu huấn luyện nhưng kém trên dữ liệu kiểm tra
Mô hình có quá ít tham số nên không đủ khả năng mô phỏng dữ liệu
Mô hình sử dụng quá ít dữ liệu để huấn luyện
Giải pháp nào không giúp giảm hiện tượng overfitting?
Tăng kích thước tập dữ liệu
Sử dụng regularization (như L2)
Thêm nhiều tham số và tăng số lớp trong mạng
Áp dụng kỹ thuật dropout
Hiện tượng vanishing gradient thường gây ra hậu quả gì trong quá trình huấn luyện mạng nơ-ron sâu?
Mạng học quá nhanh và dễ bị overfitting
Trọng số cập nhật quá lớn khiến mô hình không ổn định
Mạng tạo ra đầu ra nằm ngoài khoảng dự đoán
Gradient trở nên rất nhỏ khiến mạng gần như ngừng học
Nguyên nhân chính gây ra exploding gradient trong mạng nơ-ron sâu là gì?
Chuỗi đạo hàm trong quá trình lan truyền ngược được tính bằng tích liên tiếp, dẫn đến giá trị gradient trở nên quá lớn
Sử dụng hàm mất mát tuyến tính
Mạng tạo ra đầu ra nằm ngoài khoảng dự đoán
Mạng có quá ít lớp nên khó hội tụ
Yếu tố nào sau đây không phải là một quyết định thiết kế khi xây dựng mạng nơ-ron?
Số lớp ẩn và số nơ-ron trong mỗi lớp
Cách tính đạo hàm của hàm mất mát
Hàm kích hoạt sử dụng tại các lớp ẩn
Kiểu dữ liệu đầu vào (rời rạc, liên tục…)
Điều gì xảy ra nếu ta thêm quá nhiều lớp ẩn vào mạng nơ-ron truyền thẳng mà không có chiến lược kiểm soát thích hợp?
Mô hình chắc chắn chính xác hơn
Mô hình sẽ đơn giản hơn và dễ huấn luyện
Mô hình sẽ không cần đến hàm kích hoạt phi tuyến
Mô hình có thể gặp hiện tượng vanishing gradient hoặc overfitting
Mục đích chính của vector hóa trong huấn luyện mạng nơ-ron là gì?
Làm cho mô hình chính xác hơn
Giảm kích thước của mô hình
Tăng tốc độ tính toán bằng cách xử lý ma trận thay vì từng phần tử
Dễ dàng huấn luyện mô hình với ít dữ liệu
Vì sao ngôn ngữ tự nhiên thường gây khó khăn cho hệ thống NLP do yếu tố mơ hồ (ambiguity)?
Vì mọi ngôn ngữ đều có từ điển cố định
Vì một từ hoặc câu có thể mang nhiều nghĩa khác nhau, phụ thuộc vào ngữ cảnh và kiến thức nền
Vì văn bản thường ngắn, không đủ dữ kiện
Vì máy không thể phân biệt chữ in hoa và in thường
Khi một hệ thống phân loại email thành "spam" và "không spam", nó đang thực hiện tác vụ gì trong NLP?
Tóm tắt văn bản
Nhận diện thực thể
Phân loại văn bản (text classification)
Sinh văn bản mới
Đặc điểm nào sau đây không đúng về các mô hình ngôn ngữ lớn (LLM)?
Có hàng tỷ tham số
Có thể thực hiện nhiều tác vụ khác nhau mà không cần huấn luyện lại
Được huấn luyện trên lượng lớn văn bản từ Internet
Luôn cần có tập nhãn lớn cho mỗi tác vụ trước khi sử dụng
Đâu là mục tiêu cốt lõi của Xử lý Ngôn ngữ Tự nhiên (NLP) trong hệ thống trí tuệ nhân tạo?
Giúp máy xử lý văn bản theo cú pháp lập trình chuẩn
Hỗ trợ máy phân loại văn bản dựa trên mô hình thống kê
Trang bị cho máy khả năng phân tích, hiểu và tạo ra ngôn ngữ tự nhiên tương tự con người
Dạy máy học quy tắc ngôn ngữ bằng luật logic hình thức
Vì sao mạng học sâu lại được sử dụng rộng rãi trong NLP hiện đại?
Vì mạng học sâu có thể tự động học các đặc trưng ngôn ngữ từ dữ liệu lớn mà không cần thiết kế đặc trưng thủ công
Vì mạng học sâu luôn có độ chính xác cao hơn các phương pháp thống kê truyền thống, bất kể dữ liệu thế nào
Vì mạng học sâu chỉ cần dữ liệu có nhãn và không cần cấu trúc ngôn ngữ
Vì mạng học sâu xử lý tốt ngữ pháp nhưng học ngữ nghĩa không tốt bằng
Tại sao sự tồn tại của hàng nghìn ngôn ngữ trên thế giới lại gây khó khăn cho việc xây dựng hệ thống NLP?
Vì nhiều ngôn ngữ có cú pháp tương đồng nhau nên dễ gây nhầm lẫn
Vì mỗi ngôn ngữ có hệ thống từ vựng, ngữ pháp và cách diễn đạt riêng biệt, đòi hỏi thiết kế và huấn luyện mô hình riêng
Vì ngôn ngữ nào cũng có kho dữ liệu phong phú nên việc chọn dữ liệu rất khó
Vì máy chỉ xử lý tốt các ngôn ngữ ký tự Latin
