Comment « Entraîner » un Compagnon IA - Ce que Change Vraiment Votre Retour

Comment ça marche

Beaucoup d'utilisateurs notent chaque réponse en pensant éduquer leur compagnon. Le plus souvent, ce n'est pas le cas - du moins pas comme ils l'imaginent. Voici ce que fait réellement chaque type de retour.

Nous pouvons percevoir une commission via les liens de cette page. Cela n'influence jamais nos notes.

« Entraîner » un compagnon IA laisse penser que le logiciel apprend peu à peu vos préférences, comme un animal de compagnie. La réalité compte plus de pièces : quelques leviers changent le comportement immédiatement, d'autres le changent lentement pour tout le monde, et certains servent surtout à vous donner le sentiment de participer.

Ce qui façonne réellement une réponse

Chaque réponse est générée à partir de ce que le modèle voit à cet instant - le mécanisme est détaillé dans comment un compagnon IA rédige sa réponse :

  1. La description et les réglages du personnage.
  2. Les souvenirs et résumés enregistrés, récupérés pour cette conversation.
  3. La conversation récente elle-même.
  4. Le modèle sous-jacent, tel que l'entreprise l'a mis à jour en dernier.

Votre retour compte dans la mesure où il modifie l'un de ces quatre éléments.

Les leviers, du plus fort au plus faible

Les leviers pour façonner un compagnon IA classés selon leur rapidité et leur force : modifier le personnage, modifier les réponses, notes de mémoire, régénérer, notes hors personnage et notations

Changez ce que le modèle lit, pas ce qu'il ressent pour vous.

LevierCe qu'il changeRapiditéForce
Modifier la description du personnageLes instructions lues avant chaque réponseImmédiateForte et durable
Modifier une réponseLa conversation que le modèle imiteRéponses suivantesForte tant qu'elle reste visible
Notes de mémoireLes faits retrouvés dans les conversations futuresÀ la prochaine récupérationForte pour les faits, faible pour le style
Notes hors personnageLa scène en coursImmédiateS'estompe quand la discussion s'allonge
RégénérerCette seule réponseImmédiateAucune au-delà de cette réponse
Notations (pouces, étoiles)Généralement des données pour les futures mises à jour du modèleDes semaines ou des mois, si tant estFaible pour votre personnage

Modifiez, ne discutez pas

Argumenter en restant dans le personnage - « tu ne te comportes pas comme d'habitude » - marche rarement, car la discussion elle-même devient une partie de la conversation que le modèle imite. Transformer une réponse en ce que le personnage aurait dû dire donne au modèle un bon exemple à suivre. Si votre application permet de modifier les réponses, c'est l'habitude la plus utile à prendre.

Le style dans la description, les faits en mémoire

  • Le style - ton, longueur des phrases, humour, degré d'affection - relève de la description du personnage, car il doit s'appliquer à chaque réponse. Notre guide du créateur de personnage explique quels champs comptent.
  • Les faits - votre métier, le nom de votre chien, ce qui s'est passé la semaine dernière - relèvent de la mémoire, qui les retrouve quand c'est pertinent.

Les mélanger pose problème : des notes de style en mémoire sont retrouvées de façon irrégulière, et de longues listes de faits dans la description étouffent la personnalité.

À quoi servent vraiment les notations

Dans la plupart des applications, les notations alimentent les données de l'entreprise pour améliorer ses modèles, souvent pour tous les utilisateurs. Cela peut valoir la peine - vous aidez les versions futures - mais ce n'est pas une ligne directe vers votre personnage. Certaines applications affirment que les notations influencent votre compagnon en particulier ; même là, l'effet est progressif et bien plus faible qu'une description modifiée.

Consultez la politique de confidentialité si cela vous importe : noter une réponse peut marquer la conversation pour relecture ou entraînement, ce qui est un compromis pour votre vie privée. Voir qui lit les conversations de votre compagnon IA.

Un réglage hebdomadaire

  1. Notez deux choses que vous avez aimées et une qui vous a agacé cette semaine.
  2. Transformez l'agacement en instruction positive dans la description (« Elle répond par des phrases courtes et sèches » plutôt que « Ne divague pas »).
  3. Ajoutez en mémoire les nouveaux faits importants.
  4. Ouvrez une nouvelle conversation si l'ancienne a dérivé - les longues conversations accumulent des habitudes, comme l'explique la dérive de personnalité.

Le compagnon ne vous apprend pas comme le ferait une personne. Mais il vous lit à chaque fois - à travers sa description, sa mémoire et vos derniers mots. Changez ce qu'il lit, et vous changez qui il est.

Questions fréquentes

Les pouces levés ou baissés changent-ils mon compagnon IA ?

Rarement sur le moment, et souvent pas votre compagnon en particulier. Dans la plupart des applications, les notes sont collectées pour améliorer le modèle de tous les utilisateurs lors de futures mises à jour. Quelques applications s'en servent pour ajuster votre personnage, mais l'effet est faible et lent comparé à une modification de la description.

Quel est le moyen le plus rapide de changer la façon de parler de mon compagnon IA ?

Modifiez la description ou le champ de personnalité du personnage, et corrigez les réponses en les éditant plutôt qu'en discutant. Le modèle imite ce qui figure dans ses instructions et dans la conversation récente : ce sont les deux leviers qui agissent immédiatement.

Mon compagnon IA apprend-il de nos conversations ?

Il enregistre des faits et des résumés dans un système de mémoire, ce qui lui permet de se rappeler des détails. Il ne ré-entraîne généralement pas son modèle sous-jacent sur vos conversations en temps réel. L'utilisation de vos échanges pour entraîner de futures versions dépend de la politique de l'entreprise.