Le scénario
Un système doit aligner son comportement sur les préférences de l’utilisateur grâce à des interactions répétées. Le diagramme montre une boucle où les retours guident les mises à jour du modèle jusqu’à l’arrêt des corrections par l’utilisateur.
Ce que contient ce dessin
Comprenez les décisions qui le sous-tendent.
01
Déterminer si l’utilisateur fournit un retour après avoir vu une proposition
02
Déterminer si le retour est positif ou négatif afin de choisir entre renforcement et ajustement
03
Déterminer quand finaliser l’alignement actuel
À utiliser pour concevoir des systèmes d’alignement avec humain dans la boucle, de personnalisation interactive ou d’apprentissage itératif des préférences.