NEW
Font size
WorksheetsΕνισχυτική Μάθηση – Ερωτήσεις
Total questions: 20
Worksheet time: 10mins
Τι περιγράφει καλύτερα την Ενισχυτική Μάθηση (Reinforcement Learning);
Εκπαίδευση με εποπτευόμενα δεδομένα
Δημιουργία διανυσμάτων από κείμενο
Μάθηση μέσω αλληλεπίδρασης και επιβράβευσης
Κατηγοριοποίηση εικόνων
Ποιο στοιχείο αφορά την εκτίμηση της μελλοντικής ανταμοιβής σε μια κατάσταση;
Περιβάλλον (Environment)
Επιβράβευση (Reward)
Πολιτική (Policy)
Συνάρτηση Τιμής (Value Function)
Ποια τεχνική συνδυάζει εκτίμηση αξίας και άμεση επιλογή ενεργειών;
Μάθηση βάσει πολιτικής
Μάθηση βάσει τιμής
Actor-Critic
Q-Learning
Στα Συστήματα Πολλαπλών Πρακτόρων (Multi-Agent Systems), οι πράκτορες μπορούν να:
Μόνο να ανταγωνίζονται
Μόνο να συνεργάζονται
Να συνεργάζονται ή να ανταγωνίζονται
Να παραμένουν παθητικοί
Ποιο είναι το κύριο πρόβλημα που αντιμετωπίζεται με το δίλημμα εξερεύνησης–εκμετάλλευσης;
Υπερκατάδευση
Ανάγκη για ισορροπία μεταξύ ανακάλυψης νέων στρατηγικών και χρήσης γνωστών
Κακή ταξινόμηση
Υψηλή ακρίβεια με χαμηλή ταχύτητα
Ποιο είδος μάθησης χρησιμοποιεί συνεχώς μεταβαλλόμενες στρατηγικές των άλλων πρακτόρων;
Ανεξάρτητη μάθηση (Independent Learning)
Συνελικτική μάθηση
Πολυπρακτορική μάθηση
Εποπτευόμενη μάθηση
Ποια μέθοδος βελτιώνει άμεσα την πολιτική με βάση τον υπολογισμό παραγώγου;
Value-Based RL
Policy Gradients
Deep Q-Learning
Random Search
Στην Ιεραρχική Ενισχυτική Μάθηση, οι στρατηγικές:
Χωρίζονται σε επίπεδα στόχων και ενεργειών
Είναι τυχαίες
Αφορούν μόνο τον πράκτορα
Εστιάζουν μόνο στις ανταμοιβές
Ποια είναι βασική πρόκληση της Βαθιάς Ενισχυτικής Μάθησης σε μεγάλα περιβάλλοντα;
Μικρή ανάγκη για δεδομένα
Απλή ανατροφοδότηση
Υψηλές υπολογιστικές απαιτήσεις
Χαμηλή αβεβαιότητα
Ποια τεχνική επιτρέπει τη μάθηση σε πολυπλοκότερα περιβάλλοντα με νευρωνικά δίκτυα;
Ομαδοποίηση δεδομένων
Deep Reinforcement Learning
Στην Ενισχυτική Μάθηση, οι ανταμοιβές δίνονται πάντα σε κάθε ενέργεια. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Τα Συστήματα Πολλαπλών Πρακτόρων απαιτούν πάντα συνεργασία μεταξύ των πρακτόρων. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Στη Βαθιά Ενισχυτική Μάθηση χρησιμοποιούνται νευρωνικά δίκτυα για την εκτίμηση στρατηγικών. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Το περιβάλλον σε ένα σύστημα Ενισχυτικής Μάθησης είναι πάντα στατικό και αμετάβλητο. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Το Exploration-Exploitation Dilemma αναφέρεται στο πώς να επιλέγουμε ανάμεσα σε νέες ή γνωστές ενέργειες. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Τα συστήματα Ενισχυτικής Μάθησης δεν μπορούν να προσαρμοστούν σε περιβάλλοντα υψηλής αβεβαιότητας. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Ένα σύστημα Actor-Critic περιλαμβάνει δύο υποσυστήματα: έναν εκτελεστή και έναν κριτή. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Η Ιεραρχική Ενισχυτική Μάθηση βοηθά στη διάσπαση περίπλοκων προβλημάτων σε υποπροβλήματα. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Στη μάθηση βάσει τιμής, ο πράκτορας επιλέγει πάντα την ενέργεια με τη μικρότερη αναμενόμενη ανταμοιβή. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
Οι βαθιές ενισχυτικές μέθοδοι χρησιμοποιούνται ευρέως σε εφαρμογές έξυπνης διαχείρισης ενέργειας. Επίλεξε Σωστό ή Λάθος.
Σωστό
Λάθος
