Μουσείο ΤΝ
Μενού

Έκθεμα 6.5

5

Ευθυγράμμιση

Άνθρωποι, ή και άλλα μοντέλα, αξιολογούν απαντήσεις. Το μοντέλο ενισχύεται προς τις πιο χρήσιμες, ειλικρινείς και ασφαλείς. Γνωστή τεχνική είναι η ενισχυτική μάθηση από ανθρώπινη ανατροφοδότηση (RLHF).

Ευθυγράμμιση
Απόδοση με ΤΝ

Γιατί βρίσκεται στο μουσείο

Ένα σύγχρονο γλωσσικό μοντέλο δεν εμφανίζεται έτοιμο. Περνά από δεδομένα, εκπαίδευση, προσαρμογή, αξιολόγηση και τελικά παραγωγή απάντησης.

Τι στηρίζει το έκθεμα

Πρωτογενής ερευνητική δημοσίευση

Τη χρήση ανθρώπινων προτιμήσεων και reinforcement learning για ευθυγράμμιση απαντήσεων.

Κύρια πηγή: Ouyang, L. et al. (2022), “Training language models to follow instructions with human feedback”.

Άνοιξε την πηγή

Τι χρειάζεται προσοχή: Πρωτογενής πηγή · σήμερα χρησιμοποιούνται και άλλες μέθοδοι πέρα από RLHF

Ρώτησε το έκθεμα

Ο μικρός ξεναγός αυτής της σελίδας χρησιμοποιεί μόνο όσα υπάρχουν στον φάκελο του εκθέματος. Αν η ερώτηση ζητά κάτι που δεν τεκμηριώνεται εδώ, δεν θα το συμπληρώσει μόνος του.

Μπορείς να ξεκινήσεις με μία από τις ερωτήσεις που βλέπεις πιο πάνω.