121 articles · 8 rubriques Mise à jour 20.08.2026
Prompts et méthodes 07.08.2026 8 min de lecture

Pourquoi l’IA oublie vos consignes au fil de la conversation et comment l’éviter

Ce qui se passe vraiment quand un assistant perd le fil, les cinq symptômes à reconnaître et la méthode pour garder des consignes stables.

Pourquoi l’IA oublie vos consignes au fil de la conversation et comment l’éviter
Photo : Caio via Pexels

En bref. Ce n’est pas de l’oubli, c’est de la dilution. Vos consignes restent dans la conversation mais elles pèsent de moins en moins lourd à mesure que le texte s’accumule autour d’elles, et au-delà d’une certaine longueur les plus anciennes sortent purement et simplement de la fenêtre de contexte. Trois réflexes suffisent à corriger 90 % des cas : rappeler les contraintes à la fin de chaque message, ouvrir une conversation neuve à chaque changement de tâche, et garder un document de référence que vous recollez au lieu de le réexpliquer.

Ce qui se passe réellement

Un assistant n’a pas de mémoire au sens humain. À chaque message, l’intégralité de la conversation lui est renvoyée, et il produit sa réponse à partir de ce bloc de texte. Trois phénomènes se combinent quand ce bloc grossit.

La fenêtre de contexte est finie. Elle se mesure en tokens — environ 600 à 650 mots français pour 1 000 tokens. Les modèles courants acceptent aujourd’hui de 100 000 à plusieurs centaines de milliers de tokens, ce qui représente beaucoup de texte, mais une conversation où vous collez des documents entiers l’atteint plus vite qu’on ne le croit. Quand la limite est franchie, le début de la conversation est tronqué ou résumé automatiquement, et vos consignes initiales disparaissent sans avertissement.

Le milieu compte moins que les extrémités. C’est un comportement documenté et constant : une instruction placée au tout début ou à la toute fin d’un long contexte est bien mieux suivie qu’une instruction enfouie au milieu. Vos consignes du premier message se retrouvent progressivement « au milieu » à mesure que l’échange s’allonge.

Le contenu récent domine. Si vous avez demandé un ton sobre au message 1, puis collé quinze paragraphes de texte marketing enthousiaste au message 12, le modèle imite ce qu’il a sous les yeux. Ce n’est pas une désobéissance, c’est une question de proportion.

Les cinq symptômes et ce qu’ils indiquent

SymptômeCause probableCorrection immédiate
Le ton dérive vers un style promotionnelLe contenu collé récemment pèse plus que la consigne initialeRappeler la contrainte de ton en fin de message
Un format demandé (longueur, structure) n’est plus respectéLa consigne de format est trop ancienne dans le filRépéter le format exigé à chaque demande, en trois lignes
Des informations validées reviennent faussesTroncature du début de conversationRecoller le document de référence, ouvrir un nouveau fil
Les réponses deviennent plus vagues et plus longuesContexte saturé, instructions concurrentes accumuléesNouvelle conversation avec un résumé d’état
Une correction déjà faite réapparaît deux tours plus tardLa correction était une remarque en passant, pas une règleFormuler la correction comme une règle numérotée et la maintenir

Le cinquième cas mérite une attention particulière. « Non, pas comme ça » n’est pas une consigne : c’est un commentaire sur une réponse précise. « Règle : jamais de phrase d’introduction avant la première section » est une consigne, et elle se transporte.

La structure de message qui tient

L’ordre des éléments dans un message change nettement le résultat. Celui-ci fonctionne pour la quasi-totalité des tâches de rédaction et d’analyse :

  1. Tâche en une phrase. Ce que vous voulez obtenir, tout de suite. Pas de préambule.
  2. Contexte utile. Qui vous êtes, pour qui, dans quel but. Trois à cinq lignes suffisent.
  3. Données ou document. Le matériau brut, clairement délimité par une ligne de séparation ou une mention explicite du type « Voici le texte source, entre les deux lignes de tirets ».
  4. Format attendu. Longueur, structure, présence ou absence de titres, langue.
  5. Contraintes, en dernier. Ce qu’il ne faut pas faire, les mots à éviter, les règles de ton. Deux à cinq points maximum, formulés positivement quand c’est possible.

Le point 5 est le levier principal. Placer les contraintes en fin de message les met dans la zone la mieux suivie, celle qui précède immédiatement la génération. Une liste de cinq contraintes répétée à chaque tour coûte trente secondes de copier-coller et supprime la majorité des dérives.

Une contrainte formulée en négatif fonctionne moins bien qu’une contrainte formulée en positif. « N’utilise pas de superlatifs » donne des résultats plus irréguliers que « Utilise des chiffres et des exemples concrets à la place des qualificatifs ». Quand une règle négative est ignorée deux fois de suite, reformulez-la en décrivant le comportement souhaité.

Le document de référence, à recoller plutôt qu’à réexpliquer

Écrivez une fois, dans un fichier texte que vous gardez ouvert, un bloc de 300 à 600 mots qui contient tout ce que l’assistant doit savoir en permanence sur votre activité. Vous le recollerez en tête de chaque nouvelle conversation.

  • Ce que vous faites, en deux phrases, sans jargon interne.
  • À qui vous vous adressez, avec un exemple de personne réelle.
  • Le vocabulaire imposé et le vocabulaire interdit — les termes que vous n’utilisez jamais dans votre communication.
  • Deux extraits courts de textes que vous jugez réussis, comme référence de ton.
  • Vos contraintes récurrentes : longueur habituelle, format de sortie, langue, niveau de technicité.

Ce bloc coûte une heure à écrire et se rentabilise dès la troisième utilisation. Il présente un avantage supplémentaire : il est portable. Le même document fonctionne d’un assistant à l’autre, alors que les fonctions de mémoire intégrées restent propres à chaque outil.

Quand ouvrir une nouvelle conversation

Beaucoup d’utilisateurs gardent un fil unique pendant des semaines. C’est la principale source de dérive. Ouvrez un nouveau fil dans ces quatre situations :

  • Vous changez de tâche, même si le sujet reste le même. Rédiger puis analyser des chiffres sont deux contextes différents.
  • Vous dépassez une quinzaine d’échanges nourris.
  • Vous venez de coller un document long dont vous n’avez plus besoin.
  • Les réponses se dégradent sans raison identifiable — c’est le signe le plus fiable.

Pour ne rien perdre, utilisez le passage de relais : demandez à l’assistant, en fin de conversation, un résumé de l’état des lieux destiné à être collé ailleurs. Une formulation qui fonctionne bien : « Rédige un état des lieux de 200 mois maximum destiné à être collé dans une nouvelle conversation : décisions prises, contraintes retenues, vocabulaire imposé, prochaine étape. Pas de politesses, pas de récapitulatif de ce que nous avons dit. » Vous obtenez un bloc propre à recoller, et vous repartez sur un contexte de 300 tokens au lieu de 40 000.

Ce que les fonctions intégrées retiennent vraiment

FonctionCe qu’elle faitLimite principale
Instructions personnaliséesUn texte court injecté au début de chaque nouvelle conversationSouvent limité en longueur, et soumis à la même dilution une fois la conversation longue
Espaces de travail ou projetsConsignes et fichiers partagés par toutes les conversations du projetCloisonné à un seul outil, à reconstruire si vous changez
Mémoire automatiqueRetient des éléments jugés importants entre les sessionsVous ne contrôlez pas ce qui est retenu ; à relire et nettoyer régulièrement
Document collé manuellementContexte explicite, identique à chaque foisDemande un copier-coller, mais c’est la seule méthode entièrement prévisible

Utilisez les trois premières pour le confort, la quatrième pour tout ce qui compte. Et vérifiez ce que la mémoire automatique a enregistré : les informations sensibles ou confidentielles de vos clients n’ont pas à s’y trouver.

Questions fréquentes

Faut-il répéter ses consignes à chaque message ?

Pas toutes. Répétez les deux ou trois contraintes qui comptent le plus — généralement le format et le ton — en fin de message. Le reste peut rester dans le premier message tant que la conversation est courte. Au-delà de quinze échanges, mieux vaut ouvrir un nouveau fil que d’empiler les rappels.

Une fenêtre de contexte plus grande règle-t-elle le problème ?

Elle repousse la troncature mais ne supprime pas la dilution. Un modèle qui accepte 500 000 tokens suit toujours moins bien une consigne noyée au milieu de 200 000 tokens qu’une consigne isolée dans un message court. Un contexte long est une capacité, pas une méthode de travail.

Pourquoi l’assistant redevient-il bavard alors que j’ai demandé d’être bref ?

La longueur est une contrainte particulièrement fragile parce qu’elle entre en concurrence avec la tendance naturelle du modèle à développer. Donnez une limite chiffrée et vérifiable plutôt qu’un adjectif : « quatre phrases maximum » ou « 150 mots » fonctionne, « sois concis » beaucoup moins.

Comment savoir si mes consignes ont été tronquées ?

Posez la question directement : « Quelles règles t’ai-je données au début de cette conversation ? Réponds uniquement par la liste. » Si la réponse est incomplète ou inventée, le début du fil n’est plus accessible. C’est le signal qu’il faut recoller votre document de référence ou repartir sur une conversation neuve.

Mis à jour le 07.08.2026 Version .md Plus dans Prompts et méthodes →
WDesigner.fr

Votre site, livré avant le paiement.

On conçoit le site complet, vous le voyez en ligne, vous payez seulement s'il vous plaît.

Voir avant de payer →