Même prix. La plupart des gens vont juste changer de modèle et passer à côté de tout le reste.

Avec Opus 4.8, Anthropic a livré trois choses qui changent plus votre façon de travailler dans Claude Code que les chiffres des benchmarks : le contrôle de l’effort, les workflows dynamiques et le mode rapide moins cher. Les personnes qui configurent correctement ces éléments obtiennent de meilleurs résultats et dépensent moins. Voici les détails.
Le chiffre le plus important
Pas le 69,2 % sur le codage. C'est que 4.8 est environ 4 fois moins susceptible de laisser passer des défauts dans le code qu'il a lui-même écrit.
Les anciens modèles adoraient dire « terminé, bug corrigé » avec peu de preuves. Anthropic a misé sur l'honnêteté : 4.8 ralentit plus souvent et signale là où il n'est pas sûr, au lieu de générer du code plausible qui casse silencieusement les cas limites. Sur une longue session, cela s'accumule. Un modèle qui admet son incertitude au tour 15 vous sauve quelques heures de débogage au tour 40.
Ce qui a changé : la version courte
Codage.
SWE-bench Verified : 87,6 % → 88,6 % (proche du plafond).
SWE-bench Pro (plus dur, moins contaminé) : 64,3 % → 69,2 %, 10+ points devant GPT-5.5.
C'est le chiffre phare du codage.
Terminal.
Terminal-Bench 2.1 : 66,1 % → 74,6 % (+8,5), mais GPT-5.5 reste en tête (78,2 %). Le seul benchmark sur sept où 4.8 perd.
Travail intellectuel.
GDPval-AA : 1890 Elo contre 1769 pour GPT-5.5. L'écart le plus large de tout le tableau.
Utilisation de l'ordinateur.
OSWorld-Verified : 83,4 % (une partie du gain provient d’un harnais mis à jour, ce qu'Anthropic signale ouvertement).
Science.
GPQA Diamond : 93,6 %, essentiellement stable (les deux modèles sont au-dessus de 93 %, c'est une saturation, pas une régression).

Anthropic elle-même qualifie cette version d'« amélioration modeste mais tangible ». Les benchmarks sont un plus. Les changements opérationnels ci-dessous sont la véritable histoire.
Fonctionnalité 1. Contrôle de l'effort (le plus sous-estimé)
Opus 4.8 utilise par défaut un effort élevé. Mais maintenant, vous décidez du temps de réflexion qu'il consacre à une tâche. Considérez-le comme une transmission manuelle pour le raisonnement.
Dans claude.ai et Cowork, le curseur se trouve à côté du sélecteur de modèle, avec cinq niveaux : Faible, Moyen, Élevé (par défaut), Supplémentaire, Max, plus un interrupteur Pensée séparé. Dans Claude Code, ce sont les mêmes niveaux avec des noms légèrement différents, et il y a un mode automatique :
Remarque : « Extra » dans claude.ai et « xhigh » dans Claude Code sont le même niveau, juste des libellés différents sur des surfaces différentes.

La partie financière, pour qu'il n'y ait pas de confusion. Il n'y a PAS de supplément séparé par niveau d'effort. Le tarif est le même à chaque niveau : 5 $ pour 1M de tokens d'entrée, 25 $ pour 1M de tokens de sortie. La différence n'est pas le prix par token, mais le nombre de tokens que le modèle dépense. Faible répond brièvement et réfléchit peu, Max réfléchit longtemps et brûle plusieurs fois plus de tokens. Donc Max est « plus cher » à cause du volume, pas à cause du tarif.
Un guide approximatif des dépenses relatives pour la même tâche (chiffres illustratifs, pour l'intuition) :
- Faible = ~1/10e des tokens de sortie de Élevé
- Moyen = ~1/2 des tokens de sortie de Élevé
- Supplémentaire = 2-3x les tokens de sortie de Élevé
- Max = 4-8x les tokens de sortie de Élevé
Un exemple financier. Disons qu'une réponse Élevé coûte ~0,05 $. La même demande en Faible coûte environ ~0,005 $, et en Max elle peut facilement atteindre ~0,20-0,40 $. Si 60 % de vos prompts sont petits (« que retourne cette fonction ? »), les passer de Élevé à Faible réduit les dépenses quotidiennes plusieurs fois, sans perte de qualité là où ça compte.
Pourquoi cela impacte le plus la facture. La plupart des gens laisseront tout en Élevé (ou le mettront à Max « pour être sûr ») et ne toucheront jamais au curseur. Ceux qui répartissent l'effort par tâche obtiennent les mêmes résultats pour nettement moins. C'est la fonctionnalité la plus sous-estimée de cette version.
Fonctionnalité 2. Mode rapide (3x moins cher)
Le mode rapide fait fonctionner Opus à 2,5x la vitesse avec la même qualité, et il est maintenant 3x moins cher qu'avant.
Activez-le dans Claude Code avec /fast (une session active est marquée par une icône ↯). L'accès à l'API est limité pour l'instant (liste d'attente sur claude.com/fast-mode).
Utilisez le mode rapide pour : les refontes multi-fichiers volumineuses, la génération de code à partir de spécifications, la documentation, la génération de tests. Partout où la vitesse l'emporte sur la profondeur. Restez en mode standard pour : le débogage complexe, les décisions d'architecture, la révision de sécurité. Partout où la qualité de la réflexion l'emporte sur la vitesse.
Fonctionnalité 3. Workflows dynamiques (le gros morceau)
Claude Code écrit maintenant un script d'orchestration JavaScript pour votre tâche et l'exécute en arrière-plan pendant que votre session reste réactive. Le plan vit dans le code, pas dans le contexte du modèle, donc seule la réponse finale revient dans votre session.
Ce qu'il faut savoir, d'après la documentation officielle :
- Jusqu'à 16 sous-agents simultanément, un plafond strict de 1 000 au total par exécution.
- Reprise possible : si votre ordinateur plante ou si vous fermez le terminal, l'exécution reprend là où elle s'est arrêtée.
- Nécessite Claude Code v2.1.154+. Aperçu de recherche.
- Activé par défaut sur Max, Team, Enterprise. Sur Pro, activez-le dans /config (et passez d'abord à Opus 4.8).
- Les sous-agents fonctionnent en mode acceptEdits et héritent de votre liste blanche d'outils.
Déclenchez-le avec /effort ultracode (un paramètre Claude Code : xhigh plus orchestration automatique du workflow), ou décrivez simplement une grande tâche en mots :

Bon pour : les migrations sur 200+ fichiers, les audits de sécurité de toute la base de code, la génération de tests à l'échelle du projet, les grosses refontes, les recherches dans plusieurs dépôts. Pas bon pour : les corrections de bugs simples, les modifications d'un seul fichier, les questions rapides. Trop excessif.
Sur le coût. Les workflows consomment significativement plus de tokens qu'une session normale. La façon officielle de maîtriser les dépenses est de limiter la portée de la tâche : exécutez d'abord un audit sur un dossier, voyez combien de sous-agents cela génère, puis calibrez la grosse exécution à partir de là.
Pour désactiver complètement les workflows :
Exemple de configuration Claude Code (modèle de départ)
Variables d'environnement (dans ~/.zshrc ou ~/.bashrc) :
Vient ensuite la partie utile : un settings.json avec des autorisations sécurisées. Il permet au modèle de lire et d'éditer du code, d'exécuter des tests et de commit, mais bloque catégoriquement les choses dangereuses : lire les fichiers .env et les clés SSH, rm -rf, sudo, et git push. L'agent travaille librement mais ne peut rien casser ni divulguer.

Le fichier settings.json prêt à coller est dans mon canal Telegram (le format est trop volumineux pour être lu ici) : t.me/+JmDeelv5UCwwMTcy

Aide-mémoire des commandes quotidiennes
Installer Opus 4.8 : trois façons
A. Navigateur ou application. Sur claude.ai, sélectionnez Claude Opus 4.8 dans la liste des modèles et réglez le curseur d'effort. Aucune installation nécessaire.
B. API. ID du modèle claude-opus-4-8. Prix 5 $ / 25 $ par 1M. Contexte jusqu'à 1M (200k sur Microsoft Foundry), jusqu'à 128k de sortie. La réflexion prolongée à budget fixe n'est pas prise en charge : utilisez la réflexion adaptative (thinking: {type: "adaptive"}) et le paramètre d'effort.
C. Claude Code (terminal). L'installateur natif est maintenant la méthode recommandée (npm est héritage) :
Ensuite, exécutez claude, connectez-vous via le navigateur et choisissez Opus 4.8 avec /model.
Liste de contrôle de migration : 4.7 vers 4.8
- Changez l'ID du modèle en claude-opus-4-8
- Exécutez 10 à 20 de vos tâches réelles sur 4.7 et 4.8 avec des prompts identiques
- Comparez : taux de complétion, nombre d'étapes, tokens, taux de réussite des tests
- Vérifiez les prompts optimisés pour le comportement de 4.7
- Attribuez des niveaux d'effort par type de tâche
- Testez le mode rapide là où la vitesse compte
- Mettez à jour Claude Code vers v2.1.154+ (pour les workflows)
- Revérifiez la facture API après la première semaine
Fiche récapitulative : tout en un endroit
Modèle : claude-opus-4-8 · publié le 2026-05-28
Prix : 5 $ / 25 $ par 1M · mode rapide 10 $ / 50 $
Contexte : jusqu'à 1M · jusqu'à 128k de sortie
Clé : SWE-bench Pro 64,3 % → 69,2 % (+10 sur GPT-5.5) · SWE-bench Verified 88,6 % · 4x moins de bugs manqués · GDPval-AA 1890 Elo
Nouveau : contrôle de l'effort · mode rapide 3x moins cher · workflows dynamiques (16 simultanés / 1 000 par exécution)
Merci d'avoir lu. Si vous ne retenez qu'une chose de ceci, que ce soit « répartissez l'effort par tâche ».
Le reste de mes notes sur Claude et le vibe coding se trouve ici : t.me/+JmDeelv5UCwwMTcy.
On s'y retrouve.
@shmidtqq.





