Utiliser l'IA

Le contexte bat le prompt : pourquoi vos demandes échouent

Vous cherchez la bonne formule alors que le problème est ailleurs. Voici ce que le modèle voit réellement quand il répond, et pourquoi c'est là que tout se joue.

Anthony Courtin 9 min de lecture Mis à jour le

Résumé IA

Le prompt est ce que vous demandez ; le contexte est tout ce que le modèle a sous les yeux au moment de répondre : documents joints, historique de la conversation, consignes permanentes. Sur les modèles récents, le contexte pèse bien plus lourd que la formulation de la demande.

Synthèse rédigée à partir de l'article.

Petit cube de verre translucide à côté d'un très grand volume de verre, illustration abstraite du rapport entre prompt et contexte

Le prompt est ce que vous demandez ; le contexte est tout ce que le modèle a sous les yeux au moment de répondre. Sur les modèles récents, le second pèse bien plus lourd que le premier. C'est pourquoi un prompt de trois lignes accompagné du bon document bat un prompt de deux pages sans document.

Cette distinction explique la quasi-totalité des déceptions que j'entends en formation. Voici comment le contexte fonctionne réellement, ce que change sa taille, et comment le composer.

2 notions

La confusion qui coûte le plus cher

Chercher la formule magique alors que le problème est l'absence d'information. Un modèle ne devine pas ce qu'il ne voit pas : aucune tournure de phrase ne remplace un document manquant.

  • Le contexte contient tout : documents, historique, consignes
  • Il se compose une fois et se réutilise
  • Il est mesurable, contrairement au talent de formulation
  • Il a une taille limitée, et elle se remplit vite
  • Trop de contexte inutile dégrade la réponse

Le geste le plus rentable : joindre le document Vaut pour ChatGPT, Claude, Gemini et Le Chat

À retenir

  • Le prompt est une partie du contexte, pas l'inverse : c'est la hiérarchie qu'on inverse toujours.
  • La fenêtre de contexte se mesure en tokens : environ 750 mots pour 1 000 tokens en français.
  • Tout l'historique d'une conversation est renvoyé à chaque message, ce qui explique la consommation.
  • Trop de contexte nuit : au-delà d'un certain volume, l'information utile se dilue.
  • L'ingénierie contextuelle consiste à choisir quoi mettre dans cette fenêtre, et dans quel ordre.

Combien pouvez-vous réellement donner à lire à un modèle ? Estimez ce que représente votre document en tokens, et ce qu'il reste de place.

Outil interactif Ce qui tient dans une fenêtre de contexte
Taille de la fenêtre du modèle
0% de la fenêtre utilisée
Lecture
La méthode S·M·T·F
Estimation indicative calculée dans votre navigateur, aucune donnée ne sort. Base : 1 000 tokens pour environ 750 mots en français

Prompt et contexte : la différence

Posons les définitions, parce que le vocabulaire commercial les mélange en permanence.

Le prompt est votre demande : la phrase ou le paragraphe par lequel vous formulez ce que vous voulez obtenir.

Le contexte est l'ensemble de ce que le modèle reçoit pour produire sa réponse : votre demande, mais aussi les documents joints, l'historique de la conversation, les consignes permanentes de votre compte, et parfois des résultats de recherche web.

Autrement dit, le prompt est un élément du contexte, généralement le plus petit en volume. Passer une heure à peaufiner la formulation pendant qu'on oublie de joindre le document revient à polir la poignée d'une porte qu'on a laissée fermée.

Pourquoi cette hiérarchie s'est inversée

Entre 2022 et 2024, la formulation comptait vraiment. Les modèles étaient fragiles : changer « rédige » en « agis comme un rédacteur expérimenté et rédige » modifiait sensiblement la sortie. C'est de là que vient le terme d'ingénierie de prompt.

Les modèles actuels ont largement absorbé cette fragilité. Ils reformulent une demande maladroite sans difficulté. En revanche, ils n'ont toujours aucun moyen de connaître votre entreprise, vos clients, votre façon d'écrire ou vos contraintes réelles. Le goulot d'étranglement s'est déplacé de la formulation vers l'information.

Comment fonctionne le contexte

La fenêtre de contexte

Un modèle ne peut traiter qu'une quantité limitée de texte à la fois. Cette limite s'appelle la fenêtre de contexte et se mesure en tokens, des fragments de mots. En français, comptez environ 750 mots pour 1 000 tokens, soit à peu près une page et demie.

Les fenêtres actuelles vont de 200 000 tokens, soit environ 150 000 mots, à un million de tokens, soit environ 555 000 mots. C'est considérable : un million de tokens représente une documentation technique complète ou plusieurs années d'échanges.

L'historique compte dans la fenêtre

C'est le point que personne ne soupçonne, et il explique beaucoup de comportements surprenants.

À chaque message que vous envoyez, toute la conversation précédente est renvoyée au modèle. Il n'a aucune mémoire entre deux échanges : on lui redonne l'historique complet pour qu'il garde le fil. Une conversation de cinquante messages fait donc traiter cinquante messages à chaque nouvelle question.

Deux conséquences pratiques. D'abord, une conversation longue consomme énormément, ce qui explique les quotas atteints étonnamment vite. Ensuite, elle finit par saturer : quand la fenêtre est pleine, les premiers échanges sont écartés, et le modèle « oublie » ce que vous aviez dit au début.

Trop de contexte nuit aussi

On pourrait croire qu'il suffit de tout donner. C'est faux, et c'est une erreur que je vois de plus en plus depuis que les fenêtres sont grandes.

Au-delà d'un certain volume, l'information pertinente se dilue dans le bruit. Un modèle à qui vous donnez trois cents pages pour répondre à une question sur un paragraphe précis répondra moins bien que si vous lui aviez donné les trois pages utiles. La qualité du contexte prime sur sa quantité.

La règle des trois pages

Avant de joindre un document entier, demandez-vous quelles pages contiennent réellement la réponse. Si vous pouvez les isoler, collez-les. Vous obtiendrez une meilleure réponse, plus vite, et pour beaucoup moins de quota. Je ne joins un document complet que lorsque je ne sais pas où se trouve l'information.

Qu'est-ce que l'ingénierie contextuelle

Le terme s'est imposé pour désigner ce qui remplace l'ingénierie de prompt : l'art de décider ce qui entre dans la fenêtre, dans quel ordre, et sous quelle forme.

Elle repose sur quatre décisions.

  • Que faut-il inclure ? Les documents strictement utiles, des exemples de ce qu'on attend, les contraintes réelles.
  • Que faut-il exclure ? Tout ce qui n'aide pas à répondre. C'est la décision la plus difficile et la plus rentable.
  • Dans quel ordre ? Les consignes importantes en début et en fin de contexte sont mieux prises en compte que celles noyées au milieu.
  • Sous quelle forme ? Un texte structuré, avec des titres explicites, est mieux exploité qu'un bloc indistinct.

Dans mes propres projets, cette discipline prend la forme d'un fichier de contexte permanent que l'outil lit à chaque démarrage. C'est exactement le principe du fichier de configuration que j'utilise avec Claude Code : écrit une fois, il évite de tout réexpliquer à chaque session.

Comment composer un bon contexte

La méthode tient en quatre briques, que j'ai détaillées dans mon article sur la méthode S·M·T·F. En résumé.

  1. La situation. Qui vous êtes, à qui s'adresse le résultat, pourquoi maintenant. Deux à quatre phrases suffisent, et c'est ce qui empêche la réponse générique.
  2. Les matériaux. Les documents, les exemples de votre travail, ce qui a déjà été tenté. La brique décisive.
  3. La tâche. Un seul verbe d'action, un seul livrable.
  4. Le format. Longueur, structure, ton, et ce qu'il ne faut surtout pas faire.

Un test simple pour vérifier que votre contexte est suffisant : un nouveau collaborateur compétent mais qui vient d'arriver pourrait-il faire le travail avec ces seules informations ? Si la réponse est non, ce n'est pas la formulation qu'il faut retravailler.

Les avantages d'un contexte bien construit

  • Il se réutilise. Une fois composé, il sert pour toutes les demandes similaires. Le temps investi est amorti dès la troisième utilisation.
  • Il rend le résultat vérifiable. Quand vous savez ce que le modèle avait sous les yeux, vous savez ce qu'il pouvait ou ne pouvait pas savoir.
  • Il réduit les inventions. Un modèle qui dispose de la donnée n'a pas besoin de la reconstituer, et c'est cette reconstitution qui produit les erreurs.
  • Il se partage. Un bon contexte écrit devient un actif d'équipe, contrairement à un tour de main personnel.

Le contexte permanent : le vrai gain de temps

Tout ce qui précède décrit un contexte composé pour une demande. Le saut de productivité vient quand vous cessez de le recomposer à chaque fois.

Les outils actuels proposent tous une forme de contexte permanent : des instructions attachées à votre compte, des espaces de projet qui contiennent des documents de référence, ou un fichier de configuration lu au démarrage. Le nom change, le principe est le même : écrire une fois ce que vous répétez toujours.

Ce que je mets dans mon contexte permanent

  • Qui je suis et ce que je fais, en trois lignes. Cela évite les réponses génériques dès le premier message.
  • Mes contraintes d'écriture : la voix employée, les tournures que je refuse, la longueur habituelle.
  • Des exemples de mon travail, deux ou trois textes qui donnent le ton.
  • Ce qu'il ne faut jamais faire : c'est la partie la plus utile, et la moins renseignée par les utilisateurs.

Le gain est mesurable : sur des demandes répétitives, je passe d'environ quatre allers-retours à un seul. Sur vingt demandes par semaine, cela représente plusieurs heures récupérées, sans rien changer à ma façon de formuler.

Le piège du contexte permanent mal réglé

Une consigne permanente s'applique à tout, y compris là où elle n'a pas de sens. J'ai vu des utilisateurs demander en permanence des réponses très courtes, puis s'étonner d'obtenir des analyses superficielles sur des sujets complexes.

La règle : mettez en permanent ce qui est vrai pour tout ce que vous faites, et laissez le reste dans la demande. En cas de doute, laissez dans la demande, c'est réversible.

Les erreurs de contexte les plus fréquentes

  1. Résumer un document de mémoire au lieu de le joindre. Le modèle travaille alors sur votre résumé approximatif.
  2. Tout empiler dans une conversation unique. Le contexte se remplit de sujets sans rapport qui parasitent la réponse.
  3. Repartir de zéro à chaque insatisfaction. Corriger dans la conversation en cours est presque toujours meilleur, parce que le contexte y est déjà.
  4. Ne jamais donner d'exemples de son propre travail. C'est le seul moyen fiable de récupérer votre style plutôt qu'un style moyen.
  5. Oublier les contraintes. Budget, délai, ce qui est interdit : ces informations changent complètement la réponse et on les garde souvent pour soi.

Une dernière remarque, qui vaut avertissement. Donner du contexte signifie transmettre de l'information à un service tiers. Avant de coller un contrat ou un fichier client, vérifiez le type de compte que vous utilisez et ce que ses conditions autorisent. C'est un contrôle de trente secondes, et il évite des questions désagréables ensuite.

Questions fréquentes

Quelle est la différence entre contexte et prompt ?

Le prompt est votre demande, la phrase par laquelle vous formulez ce que vous voulez obtenir. Le contexte est l'ensemble de ce que le modèle reçoit pour répondre : votre demande, mais aussi les documents joints, l'historique de la conversation et les consignes permanentes. Le prompt est donc un élément du contexte, souvent le plus petit.

Comment fonctionne le contexte dans l'IA ?

Un modèle ne traite qu'une quantité limitée de texte à la fois, appelée fenêtre de contexte et mesurée en tokens. En français, comptez environ 750 mots pour 1 000 tokens. À chaque message, tout l'historique de la conversation est renvoyé au modèle, car il n'a aucune mémoire entre deux échanges.

Pourquoi le contexte est-il plus important que le prompt ?

Parce que les modèles récents reformulent sans difficulté une demande maladroite, mais n'ont aucun moyen de connaître votre entreprise, vos clients ou vos contraintes. Le goulot d'étranglement s'est déplacé de la formulation vers l'information : un prompt de trois lignes avec le bon document bat un prompt de deux pages sans document.

Qu'est-ce que l'ingénierie contextuelle ?

C'est l'art de décider ce qui entre dans la fenêtre de contexte, dans quel ordre et sous quelle forme. Elle repose sur quatre décisions : que faut-il inclure, que faut-il exclure, dans quel ordre placer les éléments, et sous quelle forme les structurer. C'est ce qui remplace l'ingénierie de prompt.

Trop de contexte peut-il nuire ?

Oui. Au-delà d'un certain volume, l'information pertinente se dilue dans le bruit. Un modèle à qui vous donnez trois cents pages pour répondre sur un paragraphe précis répondra moins bien que si vous lui aviez donné les trois pages utiles. La qualité du contexte prime sur sa quantité.

Comment créer un bon contexte ?

Quatre briques : la situation (qui vous êtes, à qui s'adresse le résultat), les matériaux (documents et exemples de votre travail), la tâche (un seul verbe d'action) et le format attendu. Testez-le ainsi : un nouveau collaborateur compétent pourrait-il faire le travail avec ces seules informations ?

Comment le contexte influence-t-il les réponses ?

Il détermine ce que le modèle peut savoir. Sans contexte, il produit la moyenne statistique de ce qu'il a lu, ce qui donne un texte valable pour tout le monde donc utile à personne. Avec les bons documents, il raisonne sur du réel et invente beaucoup moins.

Former votre équipe à ce qui marche vraiment

Une journée, vos vrais dossiers, vos vrais outils. On repart avec des méthodes qui tiennent le lundi matin suivant.

Discuter d'une formation →
Anthony Courtin

Écrit par

Anthony Courtin

Consultant SEO, GEO & automatisation IA

J'accompagne des PME et des indépendants sur la visibilité (Google, ChatGPT, Perplexity) et sur l'usage réel de l'IA au travail. J'interviens en entreprise pour former les équipes et repenser les process. Tout ce que j'écris ici, je l'utilise en mission.

Avis des lecteurs

Cet article vous a servi ? Dites-le, ça aide les suivants.

Notez cet article

Votre note

Ce qu'en disent les lecteurs

Aucun avis pour le moment.

Soyez le premier à donner votre avis.