Actualité · Modèles IA

Claude Opus 5 : l'intelligence frontier à moitié prix (et ce que ça change pour toi)

29 juillet 2026 · 6 min de lecture

Illustration aquarelle : un petit robot violet souriant sur un podium, avec un grand robot fantôme en arrière-plan. Le petit robot a un cerveau lumineux et dégage une aura mint, suggérant qu'il vaut plus que sa taille. Style éditorial doux, palette violet et mint.
Claude Opus 5 : frontier intelligence à moitié prix. Illustration style saisir.ai.

Anthropic a sorti Claude Opus 5 le 24 juillet 2026. Le pitch tient en une phrase : performance de Fable 5 (le modèle le plus cher d'Anthropic) pour la moitié du prix. Sur le benchmark indépendant d'Artificial Analysis, Opus 5 ne fait pas que l'égaler : il la dépasse d'un cheveu, à 25 $ le million de tokens de sortie contre 50 $.

C'est une sortie importante pour toi si tu utilises une IA au quotidien, que ce soit sur Claude Pro, via l'API, ou à travers un outil comme Cursor ou Claude Code. Voici ce qui a changé, ce que ça change pour ton usage, et les limites à connaître.

Les chiffres-clés

CaractéristiqueClaude Opus 5Claude Fable 5GPT-5.6 Sol
Prix (API, sortie)25 $/Mtok50 $/Mtok~26 $/Mtok
Intelligence Index (max)616059
Contexte1M tokens1M tokens1M tokens
StatutFlagship ClaudeHaut de gammeFlagship OpenAI
DisponibilitéClaude.ai, API, Claude CodeClaude.ai, APIChatGPT, API

Le prix API d'Opus 5 est identique à celui d'Opus 4.8 qu'il remplace : 5 $ par million de tokens d'entrée, 25 $ par million de sortie. Fable 5, le modèle frontier absolu d'Anthropic, coûte le double (10 $ et 50 $). Pour la première fois, le modèle le plus performant sur le benchmark indépendant n'est pas le plus cher.

Ce que les benchmarks indépendants disent

Artificial Analysis, un laboratoire tiers qui évalue les modèles sur un composite de 9 évaluations (raisonnement, code, mathématiques, connaissance), place Opus 5 en effort maximum à 61 points sur son Intelligence Index. Fable 5 obtient 60, GPT-5.6 Sol 59, Kimi K3 57. Opus 5 est le nouveau leader, d'un cheveu.

Les chiffres les plus parlants sont sur le travail agentique :

  • GDPval-AA v2 (tâches professionnelles de bout en bout) : 1861 Elo, soit +114 points sur Fable 5 et GPT-5.6 Sol. C'est un écart significatif.
  • AA-Briefcase (production de livrables professionnels) : 1720 Elo, +146 sur Fable 5.
  • Coding Agent Index (code, terminal, codebases réelles) : premier ex aequo avec Claude Code.
  • Terminal-Bench v2.1 (usage du terminal) : 89% en effort max, au niveau de GPT-5.6 Sol.
  • ARC-AGI 3 (résolution de problèmes inédits) : score trois fois supérieur au deuxième modèle.
  • OSWorld 2.0 (computer use) : bat tous les modèles à coût égal, surpassant Fable 5 pour un tiers du coût.

Anthropic présente aussi des exemples concrets : sur une tâche de Frontier-Bench, on a donné à Opus 5 le dessin d'une pièce mécanique sans lui fournir de moyen de visualiser l'image. Le modèle a écrit son propre pipeline de vision par ordinateur pour extraire la géométrie depuis les pixels bruts, puis a reconstruit la pièce en 3D dans FreeCAD. Aucun modèle concurrent n'a réussi cette tâche en cinq tentatives.

Le réglage d'effort : cinq vitesses au lieu d'un modèle unique

C'est la nouveauté la plus pratique. Opus 5 introduit cinq niveaux d'effort : low, medium, high, xhigh et max. Plus l'effort est élevé, plus le modèle génère de tokens de raisonnement (les "thinking tokens", facturés au prix de sortie) et meilleure est la réponse.

Sur l'Intelligence Index, l'écart entre medium (56) et max (61) est de 5 points. C'est la première fois qu'un modèle Anthropic te permet de doser l'intelligence par tâche avec un simple paramètre, au lieu de changer de modèle.

En pratique :

  • Low / medium pour les tâches courantes (résumés, drafts, classifications). Tu consommes moins de tokens, tu paies moins.
  • High pour le travail complexe (analyse, code multi-fichiers, planification).
  • Xhigh / max pour les tâches difficiles où quelques points de fiabilité comptent (debugging profond, recherche, décision structurée).

C'est le même trade-off que GPT-5.6 avec ses niveaux medium / high / max / ultra. La différence : Opus 5 n'orchestre pas plusieurs agents en parallèle comme le mode ultra d'OpenAI. Il monte en intensité sur un seul agent.

Ce que ça change si tu utilises Claude

Sur Claude Pro (20 €/mois) : Opus 5 est le modèle le plus puissant disponible sur ce plan. Tu bénéficies du frontier sans changer d'abonnement. C'est un upgrade direct.

Sur Claude Max (100 €/mois) : Opus 5 est le nouveau modèle par défaut. Tu l'utilises sans y penser.

Via l'API : si tu construis des outils ou des agents, Opus 5 devient le point de départ évident. Tu obtiens la performance frontier à 25 $/Mtok au lieu de 50 $ chez Fable 5. Le réglage d'effort te permet d'ajuster le coût par tâche sans multiplier les modèles.

Sur Claude Code (l'outil de coding agentique d'Anthropic) : Opus 5 mène le Coding Agent Index. Si tu codes avec Claude Code, c'est le modèle à utiliser.

Sur Cursor (l'éditeur de code propulsé par IA) : Opus 5 est disponible et atteint la performance de Fable 5 pour la moitié du coût par tâche, selon Anthropic.

Les limites, à connaître avant de migrer

Opus 5 est verbeux. Artificial Analysis a mesuré qu'il génère environ 100 millions de tokens pour compléter l'Intelligence Index, contre une médiane de 63 millions pour les autres modèles. Un prix par token plus bas ne veut pas dire une facture plus basse si le modèle parle deux fois plus pour arriver au même résultat. Sur tes tâches réelles, compare le coût par tâche terminée, pas le coût par token.

La connaissance factuelle reste en dessous de Fable 5. Sur AA-Omniscience (le benchmark de connaissance factuelle), Opus 5 améliore sa précision de 7 points par rapport à Opus 4.8, mais répond plus souvent quand il n'est pas sûr. Son taux d'hallucination monte de 14 points à 50%. Fable 5, plus gros modèle, reste meilleur sur les faits. Si ton usage dépend de faits précis (questions factuelles, citations, recherche académique), Fable 5 ou GPT-5.6 Sol sont plus sûrs.

Pas de mode multi-agent. Contrairement à GPT-5.6 et son mode ultra qui coordonne quatre agents en parallèle, Opus 5 travaille seul. Il compense par un raisonnement plus long en effort max, mais il ne parallélise pas. Sur les tâches qui se décomposent naturellement en sous-tâches indépendantes (recherche multi-sources, migration de code), le mode ultra de GPT-5.6 peut être plus rapide.

La computer use progresse mais reste limitée. Opus 5 bat Fable 5 sur OSWorld 2.0 à un tiers du coût, ce qui est un signal positif. Mais la computer use (utiliser ton écran, ta souris, ton clavier) reste une fonctionnalité émergente avec un taux d'erreur significatif sur les tâches longues. Ne remplace pas un humain sur des actions critiques sans supervision.

Un exemple chez Maisons&Mobilia

Pierre, DAF de Maisons&Mobilia (M&M, enseigne de meubles fictive), utilise Claude pour analyser des contrats fournisseurs et préparer des notes de synthèse pour le comité de direction. Jusqu'ici, il utilisait Claude Sonnet 5 pour les tâches courantes et Fable 5 pour les analyses complexes, quand le budget le permettait.

Avec Opus 5, Pierre change son setup :

  1. Tâches courantes (résumés de contrats, emails, notes de réunion) : Opus 5 en effort medium. Qualité équivalente à Sonnet 5 sur ces tâches, avec un contexte plus large (1M tokens) pour ingérer plusieurs documents à la fois.

  2. Analyses complexes (comparaison de contrats, audit de clauses, synthèse pour le CODIR) : Opus 5 en effort high ou max. Pierre obtient la qualité de Fable 5 pour la moitié du coût API. Sur une analyse de 200 000 tokens en entrée et 20 000 en sortie, la facture passe de 3 $ (Fable 5) à 1,50 $ (Opus 5). Sur un volume mensuel de 50 analyses, l'économie est de 75 $.

  3. Cas où Fable 5 reste pertinent : quand Pierre a besoin d'un fait précis (vérifier une référence juridique, citer un texte de loi), il bascule sur Fable 5. Le taux d'hallucination plus bas de Fable 5 le rend plus fiable sur les faits.

Pierre ne supprime pas Fable 5 de son workflow. Il l'utilise moins souvent, pour les cas où la précision factuelle prime. Sur le reste, Opus 5 suffit et coûte moitié prix.

Comment ça se compare aux concurrents

CritèreClaude Opus 5GPT-5.6 SolClaude Fable 5Kimi K3
Intelligence Index61596057
Prix sortie ($/Mtok)25~265015
Multi-agentNonOui (ultra, 4 agents)NonNon
Effort réglable5 niveaux4 niveauxOuiOui
Open sourceNonNonNonOui
Contexte1M1M1M1M
Computer useFortFortMoyenLimité

Le marché se divise maintenant en deux strates : les modèles frontier à 50 $/Mtok+ (Fable 5) et les modèles "frontier-adjacent" à 15-26 $/Mtok (Opus 5, GPT-5.6 Sol, Kimi K3). L'écart de performance entre les deux strates s'est réduit à 1-4 points sur les benchmarks. L'écart de prix reste de 2x à 3x.

Ce que tu dois retenir

  1. Opus 5 est le nouveau meilleur rapport qualité-prix du frontier. Si tu utilisais Fable 5 pour de l'analyse, du code ou du raisonnement complexe, teste Opus 5 sur tes tâches réelles. Tu vas probablement diviser ta facture par deux sans perte de qualité.

  2. Le réglage d'effort change ta façon de travailler. Au lieu de choisir entre Sonnet, Opus et Fable selon la tâche, tu gardes Opus 5 et tu ajustes l'effort. Medium pour le rapide, max pour le difficile. C'est plus simple et plus économique.

  3. Fable 5 garde sa place sur les faits. Si tu as besoin de précision factuelle maximale et d'un faible taux d'hallucination, Fable 5 reste le bon choix. Opus 5 est un agent plus fort, pas une encyclopédie plus fiable.

  4. Le marché se comprime. Trois modèles (Opus 5, GPT-5.6 Sol, Kimi K3) sont à 1-4 points du frontier pour la moitié ou le tiers du prix. La question n'est plus "quel est le meilleur modèle" mais "quel modèle suffit pour ma tâche au meilleur coût". C'est une compétence de pilotage, pas de sélection.

Aller plus loin

Pour comprendre comment le réglage d'effort (thinking tokens) change le raisonnement d'un modèle, lis notre article sur les modèles qui raisonnent. Pour voir comment GPT-5.6 orchestre plusieurs agents en parallèle, vois GPT-5.6 et le mode ultra. Et pour comprendre pourquoi l'open source rattrape le frontier à fraction du prix, notre analyse de Kimi K3 pose le contexte.

Dans l'app saisir.ai, tu apprends à comparer les modèles, doser l'effort et choisir le bon outil pour chaque tâche, en 5 minutes par jour, en français, sans coder.

Sources

Questions fréquentes

Qu'est-ce que Claude Opus 5 ?
Claude Opus 5 est le nouveau modèle flagship d'Anthropic, sorti le 24 juillet 2026. Il remplace Opus 4.8 au même prix (5 $ par million de tokens en entrée, 25 $ en sortie) tout en approchant la performance de Fable 5, le modèle le plus cher d'Anthropic, qui coûte le double. Il est disponible sur Claude.ai, Claude Code et via l'API.
Claude Opus 5 est-il meilleur que Fable 5 ?
Sur l'Artificial Analysis Intelligence Index (un benchmark indépendant), Opus 5 en effort maximum obtient 61 points, devant Fable 5 à 60 et GPT-5.6 Sol à 59. Sur les tâches agentiques de travail de connaissance (GDPval-AA v2), il mène de plus de 100 points Elo. Fable 5 reste devant sur la connaissance factuelle (AA-Omniscience) et a un taux d'hallucination plus bas. Opus 5 n'est pas 'meilleur' au sens absolu : il est plus rentable.
Combien coûte Claude Opus 5 ?
Le prix API est de 5 $ par million de tokens d'entrée et 25 $ par million de sortie, identique à Opus 4.8 et la moitié de Fable 5 (10 $ et 50 $). Le cache de prompts coûte 0,50 $ par million en lecture (90% de réduction) et 6,25 $ en écriture. Sur Claude Pro (20 $/mois) et Claude Max (100 $/mois), Opus 5 est inclus sans surcoût.
C'est quoi le réglage d'effort (effort dial) de Claude Opus 5 ?
Opus 5 propose cinq niveaux d'effort : low, medium, high, xhigh et max. Plus l'effort est élevé, plus le modèle génère de tokens de raisonnement (facturés au prix de sortie) et meilleure est la performance. Sur l'Intelligence Index, l'écart entre medium et max est de 5 points. En pratique : medium pour les tâches courantes, high ou max pour les tâches difficiles.
Claude Opus 5 est-il disponible en français ?
Oui. Opus 5 gère le français comme toutes les langues principales. Il est accessible depuis la France sur claude.com, dans Claude Code, et via l'API Anthropic. Les performances en français sont au niveau des autres langues. Claude Pro et Claude Max sont disponibles en France.
Faut-il passer à Claude Opus 5 si on utilise déjà GPT-5.6 ou Gemini ?
Si ton usage est le code ou les tâches agentiques longues, Opus 5 mène sur Frontier-Bench, CursorBench, GDPval-AA et AA-Briefcase. Si tu cherches le rapport qualité-prix, Opus 5 à 25 $/Mtok de sortie est devant Fable 5 (50 $) pour une performance supérieure. GPT-5.6 Sol reste compétitif et moins verbeux. Le choix dépend de ton cas d'usage : teste sur tes tâches réelles avant de migrer.

Termes du glossaire