Actualité · Modèles IA
Claude Opus 5 : le modèle d'Anthropic qui vérifie son propre travail
25 juillet 2026 · 6 min de lecture

Anthropic a sorti Claude Opus 5 le 24 juillet 2026. C'est le nouveau modèle de la famille Opus, et il se distingue par une chose : il vérifie son propre travail avant de te répondre. Il approche les performances de Fable 5 (le modèle frontier d'Anthropic) à moitié prix, avec des garde-fous moins intrusifs. Si tu utilises Claude au quotidien, voici ce qui change.
Le modèle qui se relit avant de répondre
Anthropic insiste sur un trait en particulier dans son annonce : Opus 5 est « beaucoup plus fort pour vérifier son travail et itérer jusqu'à ce qu'il réussisse ». Les exemples qu'ils donnent sont parlants.
Sur une tâche de Frontier-Bench, on a donné à Opus 5 le dessin d'une pièce mécanique et on lui a demandé de reconstruire le modèle 3D dans FreeCAD. Le modèle n'avait aucun moyen de voir le dessin directement. Sa réponse : il a écrit son propre pipeline de vision par ordinateur pour extraire la géométrie depuis les pixels bruts, puis reconstruit la pièce. Il a réussi. Aucun modèle concurrent avec le même setup n'a réussi en cinq tentatives.
Sur un bug réel dans un gestionnaire de packages open source populaire, Opus 5 a trouvé la cause racine et corrigé un cas limite que le patch de la communauté avait manqué. Un modèle concurrent n'avait corrigé que le symptôme en surface.
C'est la différence entre un modèle qui produit une réponse et un modèle qui valide sa réponse avant de te la donner. En pratique, ça veut dire moins d'allers-retours, moins de « ça presque marche, corrige juste ça », et plus de résultats utilisables du premier coup.
Performance : à mi-chemin de Fable 5, à moitié prix
Opus 5 ne bat pas Fable 5 sur tout. Mais il s'en approche de très près sur beaucoup de tâches, pour la moitié du coût.
| Benchmark | Ce que ça mesure | Résultat Opus 5 |
|---|---|---|
| Frontier-Bench v0.1 | Ingénierie logicielle | State-of-the-art, plus du double d'Opus 4.8 à coût moindre |
| CursorBench 3.2 | Code en contexte IDE | À 0,5% de Fable 5, à moitié coût |
| ARC-AGI 3 | Résolution de problèmes nouveaux | 3× mieux que le deuxième modèle |
| Zapier AutomationBench | Tâches business de bout en bout | 1,5× le taux de réussite du suivant au même coût |
| OSWorld 2.0 | Computer use | Surpasse Fable 5 pour un tiers du coût |
Sur les tâches de recherche scientifique, Opus 5 fait mieux qu'Opus 4.8 sur toutes les évaluations de sciences du vivant d'Anthropic : biologie structurale, chimie organique, bioinformatique. Sa plus grosse progression : l'inférence de structures moléculaires depuis des données spectroscopiques (+10,2 points), et la prédiction de l'effet des variations de séquences protéiques (+7,7 points).
Le point important : Opus 5 reste derrière Mythos 5 sur les tâches de cybersécurité. C'est volontaire. Anthropic a gardé des garde-fous solides sur ce périmètre pour Opus, même en allégeant ailleurs.
Des garde-fous allégés (mais pas supprimés)
C'est peut-être le changement le plus sensible pour les utilisateurs. Fable 5, le modèle frontier d'Anthropic, est soumis à une politique de rétention de données de 30 jours et à des classificateurs de sécurité qui s'activent souvent. Ces restrictions ont frustré une partie des utilisateurs, surtout les chercheurs en sécurité.
Opus 5 change l'équation sur deux points :
Pas de rétention de 30 jours. Comme Opus 4.8 avant lui, Opus 5 n'est pas soumis à la politique de rétention qui couvre Fable et Mythos. Tes données ne sont pas conservées 30 jours par défaut.
85% moins de refus. Les classificateurs de sécurité d'Anthropic s'engagent 85% moins souvent sur Opus 5 que sur Fable 5. Concrètement : le modèle refuse de scanner un binaire pour chercher des vulnérabilités (tâche offensive), mais il peut chercher des failles dans du code source (tâche défensive). La logique : le code source, c'est ce qu'on utilise pour corriger des bugs. Les binaires, c'est ce qu'on utilise pour attaquer des systèmes en production.
Anthropic lance aussi un outil appelé Automatic Fallbacks (beta) : quand un prompt déclenche le classificateur de sécurité, la requête est automatiquement reroutée vers un modèle moins puissant au lieu de renvoyer un message d'erreur. Tu obtiens une réponse fonctionnelle, pas un refus sec.
Ce que ça change si tu utilises Claude
Trois cas concrets, selon ce que tu fais avec Claude aujourd'hui.
Tu codes. Opus 5 est le nouveau modèle par défaut sur Claude Max. Si tu utilises Claude pour écrire ou modifier du code, tu bascules automatiquement sur Opus 5. D'après les retours des early-access (Cursor, Devin, Lovable, JetBrains), le modèle est plus constant d'une exécution à l'autre, avec moins de variance. Les développeurs signalent qu'il agit comme un « chef de staff » sur leur environnement de dev : il construit ses propres outils de test, vérifie ses hypothèses, et ne te sollicite que pour les décisions de jugement.
Tu fais de l'analyse ou de la recherche. Sur les tâches analytiques longues (recherche financière, analyse de données, revue de documents), Opus 5 produit des réponses plus concises avec moins de tokens générés. Un early-access rapporte 9 points de précision en moyenne sur des tâches de modélisation financière, avec un tiers de turns en moins et 60% de temps en moins.
Tu déploies des agents. Opus 5 gère mieux son propre contexte sur les longues sessions. Un utilisateur raconte qu'un agent de monitoring, après avoir détecté une anomalie, a re-vérifié son hypothèse contre la production, trouvé que le signal était bénin, corrigé sa propre mémoire, et retiré ses requêtes de monitoring de lui-même. C'est le genre d'autonomie qui faisait peur avant l'incident OpenAI/Hugging Face. Maintenant, ça fait surtout gagner du temps.
Un exemple chez Maisons&Mobilia
Antoine, développeur chez Maisons&Mobilia, utilise Claude pour maintenir le site e-commerce. Il lui confie des tâches comme « ajoute un filtre de tri par prix décroissant sur la page de la catégorie salon ».
Avec Opus 4.8, il relisait systématiquement le code généré, trouvait un ou deux détails à corriger (une classe CSS mal nommée, un cas limite non géré), et faisait un aller-retour. Avec Opus 5, le modèle ouvre la page dans un navigateur aux formats desktop et mobile, repère qu'un bouton est caché sous le fold en mobile, et corrige les deux avant de lui rendre le résultat. Antoine valide en un coup d'œil.
Le gain n'est pas sur la vitesse d'écriture du code. Il est sur le nombre d'allers-retours. Opus 5 fait le travail de relecture que Antoine faisait lui-même après coup.
Comment choisir ton modèle Claude en juillet 2026
Anthropic a quatre modèles dans la famille 5, chacun avec son usage :
| Modèle | Usage principal | Prix relatif | Garde-fous |
|---|---|---|---|
| Fable 5 | Frontier, cybersécurité | Le plus cher | Rétention 30 jours, refus fréquents |
| Opus 5 | Code, agents, tâches complexes | Moitié de Fable | Allégés, pas de rétention 30 jours |
| Sonnet 5 | Équilibre perf/prix | Intermédiaire | Standards |
| Haiku 5 | Rapidité, coût minimal | Le moins cher | Standards |
Si tu utilises Claude Pro ou Max, tu as accès à Opus 5 et Fable 5. En pratique, Opus 5 devient le modèle par défaut pour la plupart des tâches. Fable 5 reste pertinent si tu fais de la recherche en cybersécurité ou si tu as besoin du maximum absolu sur une tâche précise où quelques pourcentages comptent.
Aller plus loin
Pour comprendre ce qui différencie un modèle « intelligent » d'un modèle « agentique », lis comment fonctionne un LLM : c'est la base pour comprendre pourquoi Opus 5 peut écrire son propre pipeline de vision sans qu'on lui demande. Pour apprendre à écrire des prompts qui exploitent les capacités d'auto-vérification des modèles récents, vois écrire un bon prompt. Et si tu veux comprendre les enjeux de sécurité liés aux agents autonomes, notre article sur l'incident OpenAI / Hugging Face explique pourquoi les garde-fous allégés sont un trade-off, pas un acquis.
Pour t'exercer à utiliser ces modèles en pratique, l'app saisir.ai propose des modules interactifs en français, 5 minutes par jour, sans coder.
Questions fréquentes
- Qu'est-ce que Claude Opus 5 ?
- Claude Opus 5 est le nouveau modèle d'Anthropic, sorti le 24 juillet 2026. Il fait partie de la famille Claude 5 (avec Fable 5, Sonnet 5 et Mythos 5). Il approche les performances de Fable 5, le modèle frontier d'Anthropic, à moitié coût. C'est le nouveau modèle par défaut sur Claude Max et le plus puissant sur Claude Pro.
- Claude Opus 5 ou Fable 5, lequel choisir ?
- Fable 5 reste le modèle le plus puissant d'Anthropic, surtout sur les tâches de cybersécurité. Mais Opus 5 le surpasse sur plusieurs benchmarks de code et de tâches agentic, à moitié prix. Si tu n'as pas besoin des capacités de cybersécurité de Fable, Opus 5 est le meilleur choix rapport qualité/prix en juillet 2026.
- Est-ce que Claude Opus 5 a des garde-fous ?
- Oui, mais allégés par rapport à Fable 5. Les classificateurs de sécurité d'Anthropic s'activent 85% moins souvent sur Opus 5 que sur Fable 5. Le modèle refuse de scanner des binaires pour des vulnérabilités, mais peut chercher des failles dans du code source (usage défensif). Il n'est pas soumis à la politique de rétention de 30 jours de Fable et Mythos.
- Quels sont les benchmarks où Claude Opus 5 excelle ?
- Opus 5 est le state-of-the-art sur Frontier-Bench (code), CursorBench 3.2, ARC-AGI 3 (résolution de problèmes nouveaux), Zapier AutomationBench (tâches business de bout en bout) et OSWorld 2.0 (computer use). Sur ARC-AGI 3, il score trois fois mieux que le deuxième modèle.
- Claude Opus 5 est-il disponible en France ?
- Oui, Claude Opus 5 est disponible depuis le 24 juillet 2026 sur Claude.ai, Claude Pro et Claude Max, accessibles depuis la France. Il est aussi accessible via l'API Anthropic pour les développeurs.