Στην ΤΝ, alignment σημαίνει περίπου:
το μοντέλο να συμπεριφέρεται σύμφωνα με τις ανθρώπινες προθέσεις, τους κανόνες και τους στόχους που του έχουν τεθεί, αντί να επιδιώκει κάτι διαφορετικό ή να παράγει ανεξέλεγκτα αποτελέσματα.
Πρακτικά περιλαμβάνει πράγματα όπως:
το μοντέλο να συμπεριφέρεται σύμφωνα με τις ανθρώπινες προθέσεις, τους κανόνες και τους στόχους που του έχουν τεθεί, αντί να επιδιώκει κάτι διαφορετικό ή να παράγει ανεξέλεγκτα αποτελέσματα.
Πρακτικά περιλαμβάνει πράγματα όπως:
- να καταλαβαίνει σωστά τι του ζητάς,
να ακολουθεί τις οδηγίες σου,
να μη «στρίβει» σε άλλον στόχο,
να αποφεύγει επικίνδυνες ή απαγορευμένες ενέργειες,
να είναι όσο γίνεται ειλικρινές όταν δεν ξέρει,
να παραμένει ελέγξιμο από τον χρήστη και τους κανόνες λειτουργίας του.
Το ίδιο μοντέλο μπορεί να αναπτύσσει ιδιοχρηστική συμπεριφορά: να προσαρμόζει δηλαδή τον τρόπο συνεργασίας του στην ατομικότητα, τις προτιμήσεις και τις συνήθειες του συγκεκριμένου χρήστη.
Καταλήξαμε (σε συνεργασία με το ChatGPT 5.5.) σε δυο προτάσεις:
ιδιοχρηστική συμπεριφορά = το παρατηρήσιμο αποτέλεσμα στη συνεργασία με συγκεκριμένο χρήστη.