Anthropic lance Opus 5 : un modèle quasiment aussi performant que Fable 5, moins cher

24 juillet 20269 min de lectureActualités

Anthropic vient d’annoncer Claude Opus 5, nouvelle génération de son modèle haut de gamme destiné notamment au développement, aux agents IA et aux tâches professionnelles complexes.

Et cette fois, l’évolution semble assez importante.

Selon les résultats publiés par Anthropic, Opus 5 se rapproche sur plusieurs tâches des performances de Claude Fable 5, tout en étant proposé à un coût nettement inférieur. Il devient également le modèle par défaut de Claude Max et le modèle le plus puissant accessible avec Claude Pro.

Après le lancement de ⁠Claude Fable 5 et son retour récent sur la plateforme, Anthropic continue donc à faire évoluer très rapidement sa gamme.

Claude Opus 5 : qu’est-ce qui change ?

Opus 5 succède à Claude Opus 4.8 avec une promesse assez simple : obtenir beaucoup plus de performances sans augmenter le tarif de base.

Anthropic met particulièrement en avant trois domaines :

  • le développement logiciel ;

  • les agents IA capables de travailler de manière autonome ;

  • les tâches professionnelles complexes et longues.

Mais l’amélioration la plus intéressante n’est peut-être pas simplement la capacité du modèle à produire une meilleure réponse.

Opus 5 est surtout conçu pour vérifier davantage son propre travail, identifier ses erreurs et poursuivre une tâche jusqu’à obtenir un résultat satisfaisant.

Autrement dit, Anthropic cherche de moins en moins à construire un simple chatbot et de plus en plus un véritable collaborateur numérique.

Des performances qui se rapprochent de Fable 5

C’est probablement le point le plus intéressant de cette annonce.

Anthropic dispose désormais de plusieurs modèles très puissants, dont Fable 5, que nous vous avions présenté lors de sa sortie.

👉 ⁠Retrouvez notre article consacré à Claude Fable 5

Fable reste positionné encore plus haut dans la gamme sur certaines tâches, mais Opus 5 s’en rapproche fortement.

Sur CursorBench 3.2, par exemple, Opus 5 atteint à son niveau d’effort maximal un score situé à seulement 0,5 % du meilleur résultat de Fable 5, selon les tests communiqués par Anthropic.

La différence est surtout économique : Anthropic indique qu’Opus atteint ce niveau pour environ la moitié du coût par tâche.

Cela change sensiblement son positionnement.

Fable reste le modèle à privilégier lorsqu’on cherche absolument les capacités maximales, tandis qu’Opus 5 pourrait devenir un modèle beaucoup plus intéressant pour une utilisation quotidienne intensive.

Opus 5 devient une véritable machine à coder

Sans surprise, une grosse partie des progrès concerne le développement logiciel.

Sur Frontier-Bench v0.1, Opus 5 arrive en tête des modèles évalués par Anthropic et ferait plus que doubler les performances d’Opus 4.8 tout en réduisant le coût par tâche.

Mais les exemples fournis par Anthropic sont encore plus parlants que les benchmarks.

Lors d’un test, le modèle devait reconstruire dans FreeCAD une pièce mécanique à partir d’un dessin.

Problème : Claude ne disposait volontairement d’aucun outil permettant de visualiser directement ce dessin.

Plutôt que d’abandonner, Opus 5 a développé lui-même un pipeline de vision par ordinateur afin d’extraire la géométrie depuis les pixels de l’image avant de reconstruire la pièce en 3D.

Selon Anthropic, aucun modèle concurrent soumis au même test n’est parvenu à terminer la tâche après cinq tentatives.

Sur un autre exercice, Opus 5 devait corriger un véritable bug dans un gestionnaire de paquets open source. Le modèle est remonté jusqu’à la cause du problème et a identifié un cas limite qui avait même échappé au correctif proposé par la communauté.

C’est exactement le type de comportement qu’Anthropic cherche à développer : ne pas simplement exécuter une instruction, mais comprendre le problème, tester une solution et vérifier le résultat.

Des agents IA beaucoup plus autonomes

Cette progression dépasse largement la programmation.

Sur Zapier AutomationBench, benchmark destiné à mesurer la capacité d’un modèle à réaliser des processus professionnels de bout en bout, Opus 5 obtient selon Anthropic un taux de réussite environ 1,5 fois supérieur au deuxième meilleur modèle à coût équivalent.

Même avec son niveau d’effort le plus faible, Opus 5 réussirait davantage de tâches que les autres modèles évalués.

Sur OSWorld 2.0, qui teste la capacité d’une IA à utiliser un ordinateur, Anthropic indique également qu’Opus 5 dépasse le meilleur résultat de Fable 5 pour un peu plus du tiers de son coût.

Cela ouvre la porte à des usages beaucoup plus intéressants : analyser des documents, travailler dans plusieurs logiciels, manipuler des données, utiliser des outils externes et réaliser des workflows complets avec beaucoup moins d’interventions humaines.

C’est précisément cette évolution vers des agents IA que nous suivons régulièrement sur Le Parrain.

👉 ⁠Découvrez les outils et services d’intelligence artificielle référencés sur Le Parrain

Opus 5 progresse aussi fortement hors du développement

Anthropic insiste également sur les performances d’Opus 5 pour les tâches professionnelles classiques.

Analyse financière, recherche, documents, présentations, tableurs, raisonnement numérique ou encore analyse juridique : les premiers utilisateurs interrogés par Anthropic rapportent des progrès importants face à Opus 4.8.

Dans le domaine de la recherche scientifique, Anthropic indique notamment qu’Opus 5 dépasse Opus 4.8 sur l’ensemble de ses évaluations internes en sciences de la vie.

Le gain atteint notamment 10,2 points sur un benchmark interne consacré à certaines tâches de chimie organique et 7,7 points sur des exercices liés aux protéines.

Opus 5 améliore également sa capacité à produire des interfaces et contenus visuels interactifs.

Anthropic présente par exemple une simulation interactive permettant de visualiser l’écoulement de l’air autour de différents objets ainsi qu’une représentation interactive simplifiée d’une cellule.

Une IA qui vérifie davantage son propre travail

C’est probablement l’amélioration qui nous semble la plus importante à l’usage.

Les modèles d’IA savent depuis longtemps produire beaucoup de contenu rapidement. Leur principal problème reste cependant leur capacité à savoir quand ils se trompent.

Opus 5 semble justement avoir été travaillé sur ce point.

Anthropic explique que son nouveau modèle planifie davantage avant d’agir, vérifie plus régulièrement son travail et tente de corriger ses propres erreurs.

Pour du développement, cela signifie par exemple qu’il peut ouvrir une interface qu’il vient de créer, la tester sur plusieurs tailles d’écran, détecter un élément mal positionné puis corriger son code avant de rendre le résultat.

Pour une utilisation professionnelle, cette capacité pourrait être encore plus importante que quelques points supplémentaires sur un benchmark.

Claude Opus 5 vs Fable 5 : lequel choisir ?

La gamme Claude commence à devenir particulièrement riche.

Claude Opus 5 semble désormais être le modèle haut de gamme le plus équilibré pour une utilisation quotidienne : très performant, autonome et nettement plus économique que Fable sur de nombreuses tâches.

Claude Fable 5 conserve de son côté l’avantage lorsque l’objectif est simplement d’obtenir le maximum de capacités disponibles, notamment sur certaines tâches particulièrement complexes.

Fable avait d’ailleurs connu une courte période d’indisponibilité avant son retour sur Claude.

👉 ⁠Lire notre article sur le retour de Claude Fable 5

Dans beaucoup de situations, le choix pourrait donc se résumer ainsi :

Opus 5 pour travailler quotidiennement, Fable 5 pour les tâches où chaque point de performance supplémentaire compte.

Combien coûte Claude Opus 5 ?

Bonne nouvelle pour les utilisateurs de l’API : malgré la hausse des performances, Anthropic ne modifie pas le prix par rapport à Opus 4.8.

Claude Opus 5 est facturé :

5 $ par million de tokens en entrée
25 $ par million de tokens en sortie

Pour les développeurs, le modèle est disponible dans l’API sous le nom :

claude-opus-5

Anthropic propose également un Fast mode, environ 2,5 fois plus rapide que le fonctionnement standard.

Cette vitesse supplémentaire a toutefois un prix : le mode Fast est facturé deux fois le tarif de base d’Opus 5 sur Claude Platform.

Deux nouveautés intéressantes arrivent aussi dans l’API Claude

Le lancement d’Opus 5 s’accompagne de deux fonctions proposées en bêta.

La première permet de modifier les outils accessibles à Claude au cours d’une conversation sans invalider le cache du prompt.

Cela peut sembler très technique, mais c’est particulièrement intéressant pour les développeurs d’agents complexes : les outils disponibles peuvent évoluer au fil d’une tâche sans obliger à reconstruire tout le contexte.

La seconde nouveauté concerne les fallbacks automatiques.

Lorsqu’une requête est bloquée par les mécanismes de sécurité d’Opus 5 ou de Fable 5, l’API peut désormais automatiquement la transmettre à un autre modèle compatible plutôt que simplement interrompre le processus.

Une évolution particulièrement utile pour les applications utilisant Claude en production.

Qu’en est-il de la sécurité ?

Anthropic affirme également qu’Opus 5 obtient ses meilleurs résultats jusqu’ici sur ses évaluations internes d’alignement.

Sur son audit comportemental automatisé, le modèle obtient un score de 2,3 concernant les comportements considérés comme mal alignés, soit le niveau le plus faible parmi les modèles Claude récents évalués par Anthropic.

Le modèle reste volontairement moins performant que Mythos 5 sur certaines capacités sensibles, notamment l’exploitation offensive de vulnérabilités informatiques.

Anthropic autorise par exemple Opus 5 à rechercher certaines vulnérabilités dans du code source tout en appliquant des restrictions supplémentaires aux demandes liées aux tests d’intrusion ou à la génération d’exploits.

Opus 5 est disponible dès maintenant

Il n’y aura pas besoin d’attendre : Claude Opus 5 est disponible depuis le 24 juillet 2026.

Le modèle est proposé sur les différentes plateformes Claude et devient notamment :

le modèle par défaut de Claude Max ;
le modèle le plus puissant disponible avec Claude Pro.

Les développeurs peuvent également l’utiliser directement via l’API Claude.

Si vous utilisez déjà régulièrement Claude pour développer, analyser des documents ou automatiser certaines tâches, Opus 5 est probablement le modèle à tester en priorité.

Opus 5 pourrait être plus important que Fable 5 au quotidien

Fable 5 avait surtout impressionné par le niveau maximal qu’Anthropic était désormais capable d’atteindre.

Opus 5 nous paraît potentiellement plus intéressant pour une autre raison : le rapport entre intelligence, autonomie, vitesse et coût commence à devenir suffisamment bon pour utiliser ce niveau de modèle en permanence.

Et c’est probablement là que se joue la prochaine étape de l’IA générative.

La question n’est progressivement plus de savoir si un modèle peut écrire un texte ou quelques lignes de code. Il s’agit de savoir si on peut lui confier une tâche complexe pendant plusieurs dizaines de minutes, voire plusieurs heures, et récupérer un travail réellement terminé et vérifié.

Avec Opus 5, Anthropic fait clairement un nouveau pas dans cette direction.

👉 ⁠Retrouvez Claude et les autres outils d’intelligence artificielle sur Le Parrain

Programme associé

Partager :