wayground logo

Free Printable Worksheets

NEW

Font size

S
M
L
XL
Worksheets

Ενισχυτική Μάθηση – Ερωτήσεις

Total questions: 20

Worksheet time: 10mins

Name
Class
Date
1.

Τι περιγράφει καλύτερα την Ενισχυτική Μάθηση (Reinforcement Learning);

a)

Εκπαίδευση με εποπτευόμενα δεδομένα

b)

Δημιουργία διανυσμάτων από κείμενο

c)

Μάθηση μέσω αλληλεπίδρασης και επιβράβευσης

d)

Κατηγοριοποίηση εικόνων

2.

Ποιο στοιχείο αφορά την εκτίμηση της μελλοντικής ανταμοιβής σε μια κατάσταση;

a)

Περιβάλλον (Environment)

b)

Επιβράβευση (Reward)

c)

Πολιτική (Policy)

d)

Συνάρτηση Τιμής (Value Function)

3.

Ποια τεχνική συνδυάζει εκτίμηση αξίας και άμεση επιλογή ενεργειών;

a)

Μάθηση βάσει πολιτικής

b)

Μάθηση βάσει τιμής

c)

Actor-Critic

d)

Q-Learning

4.

Στα Συστήματα Πολλαπλών Πρακτόρων (Multi-Agent Systems), οι πράκτορες μπορούν να:

a)

Μόνο να ανταγωνίζονται

b)

Μόνο να συνεργάζονται

c)

Να συνεργάζονται ή να ανταγωνίζονται

d)

Να παραμένουν παθητικοί

5.

Ποιο είναι το κύριο πρόβλημα που αντιμετωπίζεται με το δίλημμα εξερεύνησης–εκμετάλλευσης;

a)

Υπερκατάδευση

b)

Ανάγκη για ισορροπία μεταξύ ανακάλυψης νέων στρατηγικών και χρήσης γνωστών

c)

Κακή ταξινόμηση

d)

Υψηλή ακρίβεια με χαμηλή ταχύτητα

6.

Ποιο είδος μάθησης χρησιμοποιεί συνεχώς μεταβαλλόμενες στρατηγικές των άλλων πρακτόρων;

a)

Ανεξάρτητη μάθηση (Independent Learning)

b)

Συνελικτική μάθηση

c)

Πολυπρακτορική μάθηση

d)

Εποπτευόμενη μάθηση

7.

Ποια μέθοδος βελτιώνει άμεσα την πολιτική με βάση τον υπολογισμό παραγώγου;

a)

Value-Based RL

b)

Policy Gradients

c)

Deep Q-Learning

d)

Random Search

8.

Στην Ιεραρχική Ενισχυτική Μάθηση, οι στρατηγικές:

a)

Χωρίζονται σε επίπεδα στόχων και ενεργειών

b)

Είναι τυχαίες

c)

Αφορούν μόνο τον πράκτορα

d)

Εστιάζουν μόνο στις ανταμοιβές

9.

Ποια είναι βασική πρόκληση της Βαθιάς Ενισχυτικής Μάθησης σε μεγάλα περιβάλλοντα;

a)

Μικρή ανάγκη για δεδομένα

b)

Απλή ανατροφοδότηση

c)

Υψηλές υπολογιστικές απαιτήσεις

d)

Χαμηλή αβεβαιότητα

10.

Ποια τεχνική επιτρέπει τη μάθηση σε πολυπλοκότερα περιβάλλοντα με νευρωνικά δίκτυα;

a)

Ομαδοποίηση δεδομένων

b)

Deep Reinforcement Learning

11.

Στην Ενισχυτική Μάθηση, οι ανταμοιβές δίνονται πάντα σε κάθε ενέργεια. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

12.

Τα Συστήματα Πολλαπλών Πρακτόρων απαιτούν πάντα συνεργασία μεταξύ των πρακτόρων. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

13.

Στη Βαθιά Ενισχυτική Μάθηση χρησιμοποιούνται νευρωνικά δίκτυα για την εκτίμηση στρατηγικών. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

14.

Το περιβάλλον σε ένα σύστημα Ενισχυτικής Μάθησης είναι πάντα στατικό και αμετάβλητο. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

15.

Το Exploration-Exploitation Dilemma αναφέρεται στο πώς να επιλέγουμε ανάμεσα σε νέες ή γνωστές ενέργειες. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

16.

Τα συστήματα Ενισχυτικής Μάθησης δεν μπορούν να προσαρμοστούν σε περιβάλλοντα υψηλής αβεβαιότητας. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

17.

Ένα σύστημα Actor-Critic περιλαμβάνει δύο υποσυστήματα: έναν εκτελεστή και έναν κριτή. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

18.

Η Ιεραρχική Ενισχυτική Μάθηση βοηθά στη διάσπαση περίπλοκων προβλημάτων σε υποπροβλήματα. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

19.

Στη μάθηση βάσει τιμής, ο πράκτορας επιλέγει πάντα την ενέργεια με τη μικρότερη αναμενόμενη ανταμοιβή. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος

20.

Οι βαθιές ενισχυτικές μέθοδοι χρησιμοποιούνται ευρέως σε εφαρμογές έξυπνης διαχείρισης ενέργειας. Επίλεξε Σωστό ή Λάθος.

a)

Σωστό

b)

Λάθος