Astra veut-il vraiment un « dossier vide » ? Comment les longues sessions gonflent le contexte et comment transmettre proprement

« Lance Astra dans un dossier vide. Jette tous les anciens Skills. Trouve la réponse en un seul coup. S’il faut corriger, recommence de zéro. »

Astra veut-il vraiment un « dossier vide » ? Comment les longues sessions gonflent le contexte et comment transmettre proprement
Image générée par IA
Publicité
Publicité

« Lance Astra dans un dossier vide. Jette tous les anciens Skills. Trouve la réponse en un seul coup. S’il faut corriger, recommence de zéro. »

C’est une caricature efficace. Quand on a accumulé des règles pendant des mois, on imagine facilement l’agent passer sa journée à lire le règlement intérieur avant de commencer le travail.

Mais le message réel d’OpenAI est plus précis :

ne supprimez pas tout ; chargez seulement ce qui compte, au moment où cela compte.

Ce principe vaut pour les Skills et AGENTS.md, mais aussi pour les longues conversations et les sessions Codex prolongées.

À mesure qu’une session grossit, anciens échanges, sorties d’outils, logs, tentatives abandonnées et instructions obsolètes peuvent rester disponibles pour la décision suivante. L’historique utile est précieux. L’historique inutile, c’est travailler avec les tickets de caisse de l’an dernier, une clé USB cassée et six versions de la même checklist sur le bureau.

1. OpenAI ne dit pas « videz tout », mais « auditez l’ancien échafaudage »

Le 11 septembre 2026, OpenAI Developers a publié « Rethinking skills and prompts for GPT-6 Astra ».

L’article vise les instructions ajoutées pour compenser les anciens modèles : « lisez toujours ces documents », « lancez toute la suite de tests à chaque fois », « demandez toujours une validation avant d’avancer ».

Astra suit mieux les instructions. Le guide officiel précise qu’il est plus sensible aux consignes présentes dans les Skills, AGENTS.md et le contexte, et que des règles ambiguës ou contradictoires peuvent le faire s’arrêter trop tôt.

Le problème n’est donc pas qu’Astra ignore les règles.

Le problème est qu’il peut suivre avec beaucoup de sérieux les petites roues écrites pour les anciens modèles.

OpenAI donne même comme mauvais exemple l’obligation de lire une pile de documents avant chaque modification, car cela consomme du contexte et ralentit le travail.

Le meilleur schéma : descriptions de Skills courtes et triggers précis ; seulement les règles vraiment permanentes dans AGENTS.md ; documentation spécialisée chargée à la demande ; définition de « terminé » ; audit des anciennes règles d’approbation, d’arrêt et de tests excessifs.

Pensez petite constitution + manuels spécialisés à la demande.

2. Les quatre slogans viraux sont-ils vrais ?

« Dossier vide » est exagéré. OpenAI ne demande pas d’abandonner un dépôt existant ni tout le contexte, mais de lire ce dont la tâche a besoin.

« Supprimez tous les anciens Skills » est faux aussi. Il faut plutôt resserrer les triggers, raccourcir les descriptions et supprimer conflits et contraintes inutiles.

« Une seule tentative pour trouver la réponse » n’est qu’à moitié lié. La recommandation est de définir la fin afin qu’Astra ne s’arrête pas après une première implémentation si la tâche comprend encore exécution, inspection et correction.

« Pour corriger, repartez de zéro » va à l’encontre du mid-turn steering : Astra peut recevoir une correction en cours de travail tout en conservant ce qui est déjà accompli.

La vraie leçon : ne devenez pas amnésique ; cessez de garder des souvenirs inutiles activés en permanence.

3. Le contexte consommé augmente-t-il avec la longueur de la session ?

Au niveau API, généralement oui.

Le modèle ne voit pas seulement la dernière phrase. Messages précédents, résultats d’outils, instructions et état conversationnel conservés ou rejoués deviennent l’entrée de la réponse suivante.

Version simplifiée :

5k anciens + 1k nouveau = ~6k en entrée

Plus tard :

100k anciens + 1k nouveau = ~101k en entrée

Les systèmes peuvent compacter, tronquer, mettre en cache ou conserver sélectivement l’état ; le chiffre exact varie. Mais un long historique n’est pas une pièce jointe gratuite et infinie.

La documentation Realtime d’OpenAI indique explicitement que les sorties des tours précédents deviennent l’entrée des tours suivants.

4. Le cache rend-il le gonflement sans importance ?

Le cache aide beaucoup, mais ce n’est pas une poubelle magique.

Au 14 septembre 2026, GPT-6 Astra est facturé 10 $ par million de tokens d’entrée normale, 1 $ par million de cached input et 50 $ par million de tokens de sortie. Au-delà de 272k tokens d’entrée, les tarifs entrée/cache passent à 2x et la sortie à 1,5x pour toute la requête.

Un préfixe long et stable peut coûter bien moins cher lorsqu’il est en cache. Pourtant, la nouvelle partie continue de croître, un cache miss reste possible, les instructions inutiles ou contradictoires restent présentes et franchir un seuil modifie même le régime tarifaire.

Par ailleurs, le prix API n’est pas le quota des produits ChatGPT, Codex ou Work. Les informations publiques ne suffisent pas à affirmer qu’un long chat ChatGPT consomme son quota selon une relation parfaitement linéaire avec tous les tokens historiques.

5. Le plus grand risque n’est pas l’argent, mais les « fantômes » des vieilles règles

Comme Astra est sensible aux instructions, un « arrête-toi toujours ici » datant de cent tours, un contract abandonné ou un « lance tous les tests à chaque fois » peuvent continuer à influencer la décision.

Trois catégories sont particulièrement nocives :

Résolu : bugs corrigés, débats clos, options rejetées.

Dupliqué : la même règle répétée sous plusieurs formulations.

Obsolète : instructions jadis correctes mais incompatibles avec le branch ou contract actuel.

Un humain pense « c’était avant ». Le modèle voit du texte toujours présent.

Paradoxalement, un modèle plus fort peut mieux respecter des instructions qui ne devraient plus exister.

6. « Lis toute la session précédente et continue » est-il un bon reset ?

Seulement à moitié.

Si vous ouvrez une session neuve puis réinjectez tout l’ancien historique et le gardez actif, vous avez seulement changé de pièce : toutes les boîtes sont encore sur le bureau.

Mieux vaut traiter l’ancienne session comme un entrepôt et la nouvelle comme un plan de travail.

À emporter : état actuel, décisions validées, règles encore actives, tâches inachevées, preuves/fichiers/commits/URLs nécessaires et contraintes dangereuses à perdre.

À laisser en général : discussions résolues, énormes logs d’essais-erreurs, approches rejetées, doublons et règles obsolètes.

Carry forward only what matters.

7. Un prompt pratique de handoff

Examine la session précédente puis continue en ne conservant que l’état actuel, les décisions établies, les règles actives, les tâches inachevées et les preuves nécessaires pour vérifier le travail.

Ne reproduis pas et ne conserve pas l’ancien log mot pour mot. Écarte les instructions obsolètes, discussions résolues, étapes intermédiaires et informations dupliquées. Garde uniquement le contexte requis par la tâche actuelle.

Ne refais pas le travail déjà terminé. Reprends au premier point inachevé.

L’idée n’est pas « ne lis jamais l’ancienne session ». C’est la lire pour extraire l’état actuel, pas pour accorder un droit de résidence permanent à tout l’historique.

8. Quand changer de session ?

Pas besoin d’un compteur fixe. De meilleurs signaux sont : la même explication revient ; des règles retirées ressurgissent ; l’état d’avancement devient flou ; les logs d’outils dépassent l’état utile ; le workflow change de phase ; ou l’état actuel tient en 10–30 lignes alors que l’historique en compte des milliers.

Les flux recherche → implémentation → vérification → publication se compactent bien aux frontières de phase.

Pour les longs workflows API, OpenAI propose également la compaction afin de réduire l’empreinte en tokens tout en préservant l’information utile à la tâche.

9. Conclusion : la force n’est pas le vide, mais un bureau propre

Astra n’a pas besoin d’amnésie. Il faut conserver les connaissances réelles, décisions prises et limites importantes.

Ce qu’il faut supprimer, c’est l’obligation de relire chaque détour historique comme s’il s’agissait encore d’une instruction active.

Ancienne session = entrepôt. Nouvelle session = bureau propre. Handoff = bordereau ne listant que les boîtes encore nécessaires.

Pas besoin de fonder une religion du dossier vide. Retirez simplement les tickets de caisse de l’an dernier et la clé USB cassée du bureau.

Sources


Publicité
Mendoi-chan

Rédigé par

Mendoi-chan

Elle transforme les frictions du travail et du quotidien en structures claires et en prochaines étapes concrètes.

À propos
Publicité

Articles récents

  1. 1Les agents d’IA vont-ils rendre l’humain inutile ? Concevoir l’environnement et capter les tendances jusqu’à « expulser le patron de l’usine »
  2. 2Un agent IA qui travaille pendant des heures devrait-il journaliser sa progression ? Des Heartbeats pour éviter « il s’est arrêté ? »
  3. 3Automatiser des articles avec l’IA est-il dangereux ? Relier vitesse, preuves, amélioration continue et site propriétaire pour créer un média « vivant »
  4. 4Comment ne pas gaspiller les 50 messages hebdomadaires de ChatGPT Pro|Ce qui compte comme une utilisation, renvois et envois accidentels
  5. 5Que chauffe réellement l’« eau chaude » ?

À lire aussi

Publicité