Il s’agit de la référence détaillée. Pour la version écrémée de cinq minutes (tableau rapide + règles du routeur), voir le blog compagnon.
1. Pourquoi comparer les modèles Claude ?
La plupart des équipes ne perdent pas d’argent parce que leurs invites sont mauvaises. Ils perdent de l’argent parce qu’ils utilisent le modèle le plus cher pour tout, ou parce qu’ils traitent le choix du modèle comme une vague préférence plutôt que comme une simple préférence. décision de produit budgétisée. La gamme de Claude est explicitement hiérarchisée : elle est conçue pour que vous puissiez correspondre forme de tâche au plus petit modèle qui le finira bien.
Le résultat pratique : la sélection de modèles est l’un des leviers les plus simples que vous puissiez actionner pour améliorer latence, qualité, et coût par résultat en même temps.
2. La programmation Claude moderne (2026)
Tous les modèles Claude actuels prennent en charge saisie de texte et d'image, capacités multilingues, et vue, et ils sont disponibles via Claude API, Claude Platform sur AWS, Amazon Bedrock, Google Cloud et Microsoft Foundry.
2.1 Spécifications dont vous devriez réellement vous soucier
| Modèle | Identifiant API | Fenêtre contextuelle | Sortie maximale | Tarification (entrée/sortie) | Comportement de pensée |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 (alias : claude-haiku-4-5) |
200 000 jetons | 64 000 jetons | 1 $ / 5 $ par MTok | Pensée étendue disponible (adaptatif désactivé) |
| Claude Sonnet 5 | claude-sonnet-5 |
1 million de jetons | 128 000 jetons | 3 $ / 15 $ par MTok | Pensée adaptative toujours active |
| Claude Opus 4.8 | claude-opus-4-8 |
1 million de jetons | 128 000 jetons | 5 $ / 25 $ par MTok | Pensée adaptative toujours active |
| Claude Fable 5 | claude-fable-5 |
1 million de jetons | 128 000 jetons | 10 $ / 50 $ par MTok | Pensée adaptative toujours active |
Claude Mythos 5 (claude-mythos-5) est fermé et partage les mêmes spécifications et prix que Fable 5, mais il est associé à une architecture de sécurité différente (pas de classificateurs de sécurité de la même manière que Fable 5). Si vous n'y avez pas accès, vous pouvez toujours exécuter essentiellement la même logique d'intégration en utilisant Fable 5 si disponible.
2.2 Seuil de connaissances (pourquoi est-ce important pour les « informations actuelles »)
L’aperçu du modèle d’Anthropic répertorie :
- Seuil de connaissances fiable : janvier 2026 pour Fable 5 / Opus 4.8 / Sonnet 5 ; Février 2025 pour Haiku 4.5.
- Date limite des données d'entraînement : globalement janvier 2026 pour Fable 5 / Opus 4.8 / Sonnet 5 ; Juillet 2025 pour Haiku 4.5.
Prise pratique : si vous avez besoin de faits après la coupure, utilisez récupération (RAG) ou un outil, quel que soit le niveau du modèle.
3. Que signifient les niveaux dans la pratique
3.1 Latence et réalité du jeton de sortie
Dans l’ensemble de la gamme, l’économie des jetons diffère davantage selon sortie que par entrée. Une façon simple d’y penser :
- Le haïku est le moins cher (et le plus rapide) lorsque vous souhaitez des réponses courtes et structurées.
- Opus et Sonnet dépensent plus, mais s'adaptent toujours bien lorsque vos invites sont limitées.
- Fable 5 est cher car il est destiné aux exécutions difficiles et longues où le modèle doit rester dans la portée au fil du temps.
Si vous laissez un modèle produire du texte illimité, les jetons de sortie dominent les dépenses. C'est pourquoi sortie maximale (ou des instructions fortes pour le TLDR d'abord) est important pour tous les niveaux, pas seulement Fable 5.
3.2 Pensée adaptative ou étendue
Le tableau récapitulatif d’Anthropic met en évidence deux différences :
- Fable 5 / Opus 4.8 / Sonnet 5 avoir une pensée adaptative toujours active.
- Haiku 4.5 la pensée étendue est disponible, mais la pensée adaptative est désactivée.
Prise pratique : utilisez Haiku pour des tâches à volume élevé, mais gardez à l'esprit qu'il n'est pas optimisé pour le même comportement de « toujours s'adapter » à long terme. Lorsque vous rencontrez une ambiguïté ou des besoins de planification approfondis, passez à Sonnet/Opus/Fable.
3.3 L’effort comme cadran coût-qualité
L'effort est le principal contrôle du compromis entre l'intelligence, la latence et le coût sur Fable 5 et Mythos 5. Opus 4.8 et Sonnet 5 exposent également le contrôle de l'effort sur les surfaces API.
Implication pratique : l’erreur de migration la plus courante n’est pas une « mauvaise invite ». Il s’agit de « maximiser l’effort partout ». Pour la plupart des charges de travail de production, vous obtenez le meilleur rapport qualité-prix en acheminant délibérément les efforts (tâches peu coûteuses à faible/moyen, tâches difficiles nécessitant un effort plus élevé).
4. Une matrice de décision que vous pouvez mettre en œuvre
Au lieu de demander « Quel modèle est le meilleur ? », demandez « Quel modèle peut finir ceci workflow avec les jetons les moins chers ? »
| Forme de la tâche | Choisissez | Pourquoi |
|---|---|---|
| Classification des intentions, routage, extraction d'entités | Haïku | Rapide, bon marché et idéal pour un débit élevé |
| Aide quotidienne au codage, documentation, raisonnement structuré | Sonnet | Meilleur équilibre vitesse/qualité |
| Codage agent complexe, analyse d'entreprise, débogage approfondi | Opus | Fortes performances sur les tâches d'entreprise longues et en plusieurs étapes |
| Exécutions d'agents sur plusieurs jours, synthèse multi-documents avec délégation | Fable 5 (ou portail Mythos 5) | Conçu pour une autonomie à long terme et pour rester dans la portée |
5. Plan de routage pour la production (bon marché -> intelligent -> frontière)
Il s'agit d'un modèle pratique qui fonctionne bien lorsque vous avez un mélange de tâches : certaines faciles, d'autres difficiles et beaucoup de "pour la plupart faciles mais parfois délicates".
5.1 Routeur étape par étape
- Classer avec Haiku. Déterminer l'intention et la complexité approximative ; estimez également si vous avez besoin d'un contexte long ou d'une utilisation d'outils.
- Exécutez le chemin principal sur Sonnet ou Opus. Sonnet pour la plupart des tâches « sérieuses mais limitées ». Opus lorsque vous attendez un codage agent complexe ou un débogage plus approfondi.
- Passez à Fable 5 pour un véritable travail à long terme. Exemples : refactors cross-repo, synthèse multi-documents où le modèle doit maintenir plusieurs contraintes actives et exécutions autonomes qui délèguent des sous-tâches.
- Gérer les replis/refus. Si Fable 5 refuse en raison de classificateurs de sécurité, revenez à Opus 4.8 (ou à un autre modèle approprié) en fonction des exigences de votre produit.
5.2 Budgétisez le routeur (ne laissez pas l'escalade effacer les économies)
Un routeur ne peut être rentable que si les escalades sont rares. Ajoutez des contraintes pour que le niveau coûteux ne puisse pas gonfler :
- Définissez le nombre maximal de jetons de sortie sur chaque niveau.
- Utilisez d'abord les instructions TLDR afin que le modèle puisse s'arrêter plus tôt lorsqu'on en sait suffisamment.
- Mettez en cache les préfixes stables (invite système et schémas d’outils) pour réduire les coûts d’entrée répétés.
6. L’économie des jetons que vous pouvez utiliser comme contrôle de santé mentale
Étant donné que le prix est par jeton, vous pouvez approximer le coût par demande. À l'aide des valeurs de tarification de l'aperçu du modèle :
- Fable 5 : 10 $ d'entrée / 50 $ de sortie par MTok
- Opus 4.8 : 5 $ d'entrée / 25 $ de sortie par MTok
- Sonnet 5 : 3 $ d'entrée / 15 $ de sortie par MTok
- Haiku 4.5 : 1 $ d'entrée / 5 $ de sortie par MTok
Formule approximative (branchez vos estimations) :
cost ~= (input_tokens / 1_000_000) * input_price
+ (output_tokens / 1_000_000) * output_price
Règle de bon sens : si les jetons de sortie sont volumineux, Fable 5 devient rapidement le facteur de coût dominant. C’est pourquoi la structure rapide et les plafonds de production sont plus importants que ce à quoi de nombreuses équipes s’attendent.
7. Modèles d'invite à travers les niveaux
La plupart des bonnes pratiques s'appliquent à chaque modèle Claude : fournissez des objectifs clairs, limitez le format de sortie et ne demandez que ce dont vous avez besoin. Les différences spécifiques aux niveaux apparaissent dans la façon dont vous longueur de contrôle et effort de contrôle.
7.1 Règles générales qui évitent les fuites budgétaires
- Menez avec le résultat. Votre première ligne doit dire ce qui s'est passé ou ce que vous avez trouvé.
- Demandez d’abord le TLDR. Laissez le modèle s’arrêter tôt quand il le peut.
- Fluage de la portée du capuchon. Ne demandez pas de fonctionnalités supplémentaires, de refactorisations ou d'améliorations « agréables à avoir », sauf si cela est demandé.
- Longueur de sortie liée. Utilisez des jetons de sortie maximum ou des formats stricts.
7.2 Quand Fable 5 change de travail
Fable 5 est conçu pour une autonomie à long terme : il peut maintenir une production productive sur des périodes prolongées, déléguer des sous-tâches et rester cohérent lorsque la tâche comporte véritablement plusieurs étapes. La différence qui suscite l’intérêt n’est pas seulement « davantage de raisonnement ». C'est que vous pouvez (et devez) structurer les flux de travail comme objectifs + points de contrôle + preuves basées sur des outils, au lieu de tout forcer dans une réponse unique.
8. Exemples de flux de travail (quoi utiliser où)
8.1 Haiku 4.5
- Classez les demandes entrantes (intention + complexité) et acheminez-les vers le bon niveau.
- Extrayez les champs structurés en JSON pour les systèmes en aval.
- Résumez des passages courts avec un schéma strict et un plafond de sortie maximum.
8.2 Sonnet 5
- Refactorisez et expliquez le code avec un format « quoi/pourquoi/comment ».
- Rédigez du contenu destiné aux clients avec un ton cohérent et des résultats courts.
- Créez des outils d'agent qui ont encore besoin de vitesse (appel d'outil + boucles courtes).
8.3 Opus 4.8
- Codage agent complexe : modifications multi-fichiers, débogage plus approfondi et raisonnement plus minutieux à l’échelle du système.
- Analyse de documents d'entreprise : feuilles de calcul, diapositives et rapports longs.
- Tâches difficiles mais limitées pour lesquelles vous souhaitez toujours une réponse de niveau entreprise, pas seulement une esquisse.
8.4 Fable 5 (et Mythos 5)
- Migrations de code d'une durée de plusieurs jours entre les dépôts avec utilisation des outils et étapes de vérification.
- Synthèse multi-documents où la rétention des instructions et la cohérence sur de longues périodes sont essentielles.
- Flux de travail autonomes qui délèguent des sous-tâches et se poursuivent après des résultats intermédiaires.
9. Notes de migration
9.1 Migration vers Opus 4.8
Si vous utilisez actuellement Opus 4.7 ou une version antérieure, commencez par :
- S'assurer que vous définissez
effortexplicitement lorsque vous avez des exigences de latence ou de budget. - Examiner toutes les compétences rapides qui pourraient être trop prescriptives. Une capacité plus élevée peut amplifier des instructions trop spécifiques.
- Re-tester les hypothèses de longueur de sortie et appliquer des plafonds de sortie maximum si nécessaire.
9.2 Migration d'Opus vers Fable 5
Fable 5 n'est pas un « Opus plus rapide ». Traitez-le comme un outil de workflow pour les tâches à long terme :
- Passer à la structuration objectif + point de contrôle (en particulier pour les courses agentiques).
- Déléguez des sous-tâches au lieu de tout empiler dans un long thread.
- Utilisez la mise en cache et la sortie limitée afin que les longues exécutions ne gonflent pas les dépenses.
10. Les pièges courants
- Utiliser Fable pour tout. Il est destiné aux cas difficiles et à long terme.
- Pas de plafond de production. Même le haïku peut coûter cher si vous le laissez générer du texte illimité.
- En supposant que les fenêtres contextuelles soient interchangeables. Haiku a 200 000 jetons ; les autres sont par défaut à 1M.
- Ignorer les différences de seuil. Si vous avez besoin d'informations après la coupure, utilisez la récupération/les outils.
- Pas d'effort de routage. Fixer un effort maximum partout augmente souvent les coûts sans améliorer les résultats.
11. Conclusion
La gamme Claude est conçue pour que vous puissiez créer un modèle de routeur qui correspond au plus petit niveau capable à chaque forme de tâche. Commencez par Haiku pour un routage et une extraction bon marché. Utilisez Sonnet pour la majorité du travail quotidien. Passez à Opus pour le codage d'entreprise et agent complexe. Réservez Fable 5 (et Mythos 5) pour les véritables courses à long horizon qui nécessitent une autonomie et une cohérence soutenues.
En cas de doute, limitez vos invites, limitez la longueur de sortie et mesurez les jetons de sortie par résultat. Cette mesure tend à rendre le choix du modèle évident.
Aperçu SEO pour cet article
- Titre SEO : Comparaison des modèles Claude : Haiku vs Sonnet vs Opus vs Fable 5 (Mythos 5)
- Méta description : Comparez Anthropic Claude Haiku, Sonnet, Opus, Fable 5 et gated Mythos 5. Comprend les spécifications, la stratégie de coût/jetons, le plan de routage et quand utiliser chaque niveau.
- Mots-clés principaux : Comparaison des modèles Claude, Claude Opus 4.8, Claude Fable 5, Claude Sonnet 5, Claude Haiku 4.5, Claude Mythos 5, budgétisation de jetons, codage agentique
- Twitter/X : Les niveaux de modèle Claude ont expliqué : Haiku pour un routage bon marché, Sonnet pour le travail quotidien, Opus pour un codage complexe, Fable 5 pour des exécutions agents de plusieurs jours. Plan de routage du budget jeton à l'intérieur.
- LinkedIn : Une comparaison pratique et réalisable d'Anthropic Claude Haiku, Sonnet, Opus, Fable 5 et gated Mythos 5. Spécifications, modèle de coût et routeur qui garde les jetons de sortie sous contrôle. De Workstation.