Consommer moins de tokens sans travailler moins bien
Les réglages et les habitudes qui font la différence, du choix du modèle à la façon de découper une tâche.
La facture d'un agent est presque toujours faite de contexte relu, pas de code produit. Une session qui traîne depuis deux heures repaie son historique à chaque tour. Les leviers ci-dessous s'attaquent à ça, sans dégrader le résultat.
Où part réellement l'argent
| Poste | Part typique | Levier |
|---|---|---|
| Historique de conversation relu à chaque tour | Le plus gros | Découper les sessions |
| Fichiers lus en entier | Important | Déléguer la recherche, demander des extraits |
| Fichiers de mémoire trop longs | Constant, sur toutes les tâches | Raccourcir le CLAUDE.md |
| Sorties de commandes volumineuses | Ponctuel mais brutal | Filtrer avant de montrer |
Le coût n'est pas linéaire
Ce qui entre dans le contexte y reste pour toute la session et se repaie à chaque échange. Un fichier de 2 000 lignes lu au début d'une session de cinquante tours a été payé cinquante fois.
Avant de commencer
- Claude Code installé
- Une session de travail typique en tête
- Dix minutes
1Découper les sessions
Le réflexe le plus rentable, et le plus simple. Une tâche finie, une session finie.
/clear
Repartir d'un contexte vide entre deux sujets sans rapport ne coûte rien et supprime tout le report d'historique. Si tu veux garder le fil sans garder le volume :
/compact
La conversation est résumée, on garde les décisions et on jette les détours.
2Déléguer les explorations
Une recherche dans un gros dépôt lit beaucoup pour conclure peu. Fait dans la conversation principale, tout ce qui a été lu reste. Fait par un sous-agent, seule la conclusion revient.
Cherche ou est gere l'envoi d'e-mails dans ce depot. Rends-moi seulement la
synthese avec les chemins, pas le contenu des fichiers.
C'est le même travail, avec un dixième du contexte consommé.
3Raccourcir la mémoire
Le CLAUDE.md est relu à chaque session, sur chaque tâche. Chaque ligne inutile est une taxe permanente.
Passe le fichier et supprime ce que le modèle peut déduire du code : la liste des dossiers, les dépendances, la stack. Garde les commandes exactes, les interdits et les pièges. La plupart des fichiers perdent les deux tiers de leur volume sans rien perdre d'utile.
4Filtrer avant de montrer
Une sortie de test de 800 lignes, un git log complet, un JSON d'API brut :
tout ça entre en entier dans le contexte.
Lance les tests et montre-moi seulement les echecs, pas la sortie complete.
Même logique côté outils : un serveur MCP qui renvoie tout un objet coûte à chaque appel. Filtre côté serveur.
5Choisir le bon modèle par tâche
Tout ne demande pas le modèle le plus capable. Renommer des variables, appliquer un formatage, extraire une liste : un modèle plus léger fait aussi bien, plus vite et pour moins cher.
/model
Le réflexe utile : monter en gamme pour l'architecture, le débogage difficile et les revues ; redescendre pour le mécanique.
Ne descends pas sur le débogage
C'est le faux calcul classique. Un modèle plus léger sur un bug tordu produit trois hypothèses fausses, et les trois allers-retours coûtent plus cher que le modèle capable du premier coup.
Les habitudes qui font la différence
- Nommer les fichiers. « Regarde
src/api/mail.ts» évite une exploration complète du dépôt. - Une tâche par session. Le mélange de sujets gonfle l'historique sans profit.
- Refuser les récapitulatifs. « Ne me résume pas ce que tu viens de faire » supprime des tours entiers.
- Couper tôt. Quand une piste est mauvaise,
/clearet repartir coûte moins cher que d'insister dans un contexte pollué.
Ce qui ne marche pas
- Écrire des prompts plus courts. Le prompt pèse quelques centaines de tokens. C'est le contexte qui pèse, pas ta question.
- Interdire au modèle de lire. Il devine à la place, et les corrections coûtent plus que la lecture.
- Tout compacter en permanence. Un
/compacttoutes les cinq minutes perd du contexte utile et provoque des redites.
Quelques prompts pour aller plus loin
| Objectif | Prompt à adapter |
|---|---|
| Auditer sa mémoire | Relis mon CLAUDE.md et dis-moi quelles lignes sont deductibles du code, donc a supprimer. |
| Déléguer proprement | Cherche [SUJET] dans le depot. Rends une synthese avec chemins et numeros de ligne, sans le contenu. |
| Réduire une sortie | Lance [COMMANDE] et montre seulement les lignes en echec. |
| Faire le point | Resume l'etat de cette tache en dix lignes, puis on repart sur un contexte propre. |
Tu as d’autres ressources comme ça ?
Ce que tu viens de lire est entièrement gratuit. Une nouvelle ressource part chaque semaine dans la newsletter : guides, modèles à copier et liens triés, sans compte à créer.
Me contacter
Une question, un projet, une envie de collaborer ? Écris-moi.
Cette page est en accès libre, n’hésite pas à la partager.