Pour ce sujet
la réponse de l’IA n’est pas celle que j’aurais approuvée après une revue humaine.
La réponse de l’IA devrait-elle inclure l’apprentissage par renforcement à partir des retours humains (RLHF) ?
Le RLHF devrait-il être limité à certains utilisateurs ? Je soupçonne que certains utilisateurs pourraient détourner les réponses à l’aide du RLHF.
En vérifiant les paramètres d’administration, grâce à Jarvis, je n’ai pas trouvé d’option permettant de personnaliser le prompt de l’IA localement.
Dans le lien ci-dessous, faites défiler la page jusqu’à la section Ce qu’un administrateur peut modifier.
