Recherchez mieux dans votre communauté avec Ask AI

Pour ce sujet

la réponse de l’IA n’est pas celle que j’aurais approuvée après une revue humaine.

La réponse de l’IA devrait-elle inclure l’apprentissage par renforcement à partir des retours humains (RLHF) ?

Le RLHF devrait-il être limité à certains utilisateurs ? Je soupçonne que certains utilisateurs pourraient détourner les réponses à l’aide du RLHF.


En vérifiant les paramètres d’administration, grâce à Jarvis, je n’ai pas trouvé d’option permettant de personnaliser le prompt de l’IA localement.

Dans le lien ci-dessous, faites défiler la page jusqu’à la section Ce qu’un administrateur peut modifier.