Débutant35 min30 XP
Objectifs de cette leçon
- Comprendre la tarification
- Comparer les coûts
- Optimiser
Tokens, coûts et optimisation 💰
Comment les coûts sont calculés
Les coûts sont basés sur le nombre de tokens consommés :
| Type de token | Coût typique |
|---|---|
| Input (ce que vous écrivez) | $1 par million |
| Output (ce que l'IA répond) | $3 par million |
💡 Les tokens output sont 3x plus chers car la génération nécessite plus de calculs.
L'impact des allers-retours
Chaque aller-retour multiplie les coûts :
| Scénario | Tokens input | Tokens output | Coût total |
|---|---|---|---|
| 1 tour (prompt bon) | 500 | 1500 | $0.005 |
| 3 tours (prompt moyen) | 1500 | 2000 | $0.0075 |
| 5 tours (prompt mauvais) | 3000 | 2500 | $0.0105 |
Les gaspillages courants
1. Les prompts vagues
❌ "Fais-moi une application" ✅ "Crée une API Express avec CRUD users, validation Zod, tests Jest"
2. Les conversations trop longues
❌ 20 tours de conversation pour un même sujet ✅ 1 tour structuré avec toutes les informations
3. Les régénérations inutiles
❌ "Non, pas ça, recommence" (sans expliquer pourquoi) ✅ "Le problème est X, voici ce que j'attends : Y"
Stratégies d'optimisation
| Stratégie | Économie |
|---|---|
| Prompt structuré dès le 1er tour | 50-70% |
| Batch prompting | 30-50% |
| Résumé de contexte | 40-60% |
| Demander l'analyse avant le code | 20-40% |
Calcul de budget
Projet type : Créer une API REST
| Approche | Tours | Coût estimé |
|---|---|---|
| Prompt inefficace | 8-12 | $0.08-0.15 |
| Prompt structuré | 2-3 | $0.02-0.04 |
| Économie | ~75% |
Compter les tokens avant d'envoyer
L'API de comptage de tokens est gratuite et vous permet d'estimer les coûts avant chaque requête :
import Anthropic from "@anthropic-ai/sdk"; const client = new Anthropic(); // Compter les tokens AVANT d'envoyer const count = await client.messages.countTokens({ model: "claude-opus-4-8", system: "Tu es un développeur backend senior", messages: [{ role: "user", content: "Crée une API REST avec CRUD users" }], }); console.log(count.input_tokens); // 28
💡 Le comptage est une estimation. Le nombre réel peut différer légèrement. Les tokens système ajoutés par Anthropic ne sont pas facturés.
Tarification du comptage de tokens
| Palier | Requêtes/minute (RPM) |
|---|---|
| Start | 2 000 |
| Build | 4 000 |
| Scale | 8 000 |
⚠️ Le comptage de tokens et la création de messages ont des limites de débit distinctes et indépendantes. L'utilisation de l'un ne compte pas dans les limites de l'autre.
Résumé
- Les tokens output coûtent 3x plus cher que les tokens input
- Les allers-retours multiplient les coûts
- Utilisez l'API de comptage gratuite pour estimer avant d'envoyer
- Un bon prompt économise 50-75% de crédits
- Le meilleur moyen d'économiser : écrire le meilleur prompt dès la première fois
Tokens et coûts
ÉconomisezTokens saisis
0
≈ Mots
0
Coût estimé
$0.000000
Exemples de comparaison :
4 tokensFais une API$0.000006
18 tokensCrée une API REST Express avec auth JWT, validation Zod, et tests Jest$0.000027
4 tokensFais une app web$0.000006
16 tokensDéveloppe un dashboard React avec charts Recharts, filtres, et export PDF$0.000024
💡 1 token ≈ 0.75 mots anglais, ≈ 0.5 mot français. Input et output sont facturés séparément.