Le nouveau modèle d'IA de Claude frappe fort : presque aussi intelligent que les meilleurs, mais deux fois moins cher. Voici pourquoi il pourrait bien devenir votre outil de travail préféré.

UN MODÈLE QUI FRÔLE L'EXCELLENCE À PETIT PRIX

Le Claude Opus 5 débarque aujourd'hui sur le marché. Ce modèle d'intelligence artificielle se distingue par son intelligence proactive et réfléchie, se rapprochant dangereusement des performances de pointe de Claude Fable 5, mais à seulement la moitié du prix. Il n'est pas tout à fait au niveau des meilleurs sur les tâches de cybersécurité, mais il surpasse tous les autres modèles dans les évaluations de programmation et de travail professionnel comme Frontier-Bench ou GDPval-AA.

LE NOUVEAU STANDARD POUR LES DÉVELOPPEURS ET LES PROFESSIONNELS

Conçu pour une utilisation quotidienne, ce modèle fonctionne de manière plus efficace que ses prédécesseurs. Il devient le modèle par défaut sur Claude Max et le plus puissant disponible sur Claude Pro. Avec Claude Opus 5, les utilisateurs obtiennent des performances bien supérieures pour le même coût que son prédécesseur, l'Opus 4.8. Les graphiques montrent clairement comment les performances évoluent en fonction du niveau d'effort que le modèle doit fournir. Les clients peuvent ainsi optimiser leur usage pour maximiser l'intelligence ou économiser des jetons pour des résultats plus rapides et moins chers.

UNE RÉVOLUTION DANS LA PROGRAMMATION ET LA Recherche

Ce modèle brille particulièrement sur les tâches complexes de génie logiciel. Par exemple, sur Frontier-Bench v0.1, Claude Opus 5 dépasse tous les autres modèles et double presque les performances de l'Opus 4.8, le tout à un coût inférieur par tâche. Sur CursorBench 3.2, à effort maximal, il atteint un score à seulement 0,5 % du pic de Fable 5, mais pour la moitié du prix par tâche. Il surpasse également tous les autres modèles sur les niveaux d'effort élevés, extra-élevés et maximaux.

Sur les tâches de recherche scientifique, Claude Opus 5 montre une amélioration notable par rapport à l'Opus 4.8, avec des gains particulièrement marqués en chimie organique et en bioinformatique.

DES PERFORMANCES RECORD EN CHIMIE ORGANIQUE ET BIOINFORMATIQUE

Claude Opus 5 représente une avancée majeure pour la recherche scientifique. Il surpasse l'Opus 4.8 dans toutes les évaluations en sciences de la vie, couvrant des domaines comme la biologie structurale, la chimie organique et la bioinformatique. Ses améliorations sont particulièrement visibles en chimie organique, par exemple pour déduire des structures moléculaires à partir de données de spectroscopie (il obtient un score supérieur de 10,2 points de pourcentage à celui de l'Opus 4.8 sur un benchmark interne). Dans les tâches liées aux protéines, comme la prédiction de l'impact des variations de séquence sur leur fonction, il marque 7,7 points de pourcentage de plus.

DES SORTIES VISUELLES PLUS PUISSANTES QUE JAMAIS

Le modèle excelle également dans la production de sorties visuelles de haute qualité. Il vérifie son travail avec une rigueur inégalée, itérant jusqu'à obtenir un résultat parfait. Les tests et les retours des premiers utilisateurs montrent à quel point Claude Opus 5 se distingue par son autonomie et son attention aux détails.

LES RETOURS DES PREMIERS UTILISATEURS

Les premiers utilisateurs de Claude Opus 5 partagent leur enthousiasme. Sur FrontierCode 1.1, il approche les performances de Fable tout en restant à la moitié du coût. Dans Devin, il se montre particulièrement efficace pour le débogage complexe et l'analyse des causes racines. Un utilisateur souligne que Claude Opus 5 livre une intelligence proche de Fable 5 à la vitesse et au coût de l'Opus.

Sur CursorBench, Claude Opus 5 est à moins de 0,5 % du score maximal de Fable 5, mais pour la moitié du prix.

UNE PERFORMANCE INÉGALÉE SUR LES TÂCHES D'AUTOMATISATION

Claude Opus 5 a également dominé le classement AutomationBench de Zapier sans consommer plus de jetons que les modèles précédents. Il a pris en charge un classeur de santé des comptes et exécuté une séquence complète de prévention du churn : identification des comptes à risque, alerte des responsables concernés et synthèse pour les opérations de rétention. Les modèles précédents échouaient ; Claude Opus 5 a réussi à 100 %.

UNE APPROCHE SCIENTIFIQUE RIGOUREUSE POUR L'ANALYSE GÉNOMIQUE

Dans le domaine de l'analyse génomique, Claude Opus 5 se comporte comme un scientifique méticuleux. Il sélectionne les bons tests statistiques pour écarter les biais, recoupe ses résultats par des méthodes indépendantes et maintient sa trajectoire même sur des analyses complexes en plusieurs étapes.

LA CONSISTANCE QUI FAIT LA DIFFÉRENCE POUR LES DÉVELOPPEURS

Sur les tâches de codage les plus difficiles, Claude Opus 5 surpasse l'Opus 4.7 de 22 %, tout en étant plus stable. Pour les millions de développeurs utilisant Lovable, cette cohérence est cruciale : des résultats fiables, build après build.

DES APPLICATIONS FRONTALES PLUS FLUIDES ET PLUS BEAUX

Claude Opus 5 marque la plus grande avancée dans la famille Opus depuis la version 4.5. Sur les mêmes builds d'applications full-stack, il produit les meilleures animations, jeux et travaux 3D jamais vus avec un modèle Opus.

UNE AMÉLIORATION SIGNIFICATIVE POUR LES TRAVAUX ANALYTIQUES OUVERTS

Pour les travaux analytiques ouverts que gère son agent, Claude Opus 5 est une amélioration stricte par rapport à l'Opus 4.8. Les gains sont les plus importants là où ça compte : les tâches les plus difficiles et les plus floues. Les réponses sont plus claires et plus concises, et l'efficacité s'améliore même à des niveaux d'effort élevés.

UNE RÉVOLUTION POUR LES RECHERCHES FINANCIÈRES

Claude Opus 5 représente une amélioration frappante par rapport à l'Opus 4.8 pour les flux de travail de recherche financière quotidiens. Il se distingue particulièrement dans le raisonnement numérique, le travail sur tableaux et la pensée critique précise, là où la précision est essentielle.

Box a constaté que Claude Opus 5 améliore les performances de 8 % par rapport à l'Opus 4.8 dans l'analyse de données et de 17 % dans les travaux de diligence raisonnable.

UNE INTELLIGENCE INDUSTRIELLE POUR L'ANALYSE DE CONTENUS SPÉCIALISÉS

Claude Opus 5 fournit l'intelligence et la précision nécessaires pour analyser des contenus spécialisés en entreprise. Il est désormais adopté pour des charges de travail de production, notamment dans les secteurs technologiques, de la santé et public.

UNE GÉNÉRATION DE PAS EN AVANT PAR RAPPORT À L'OPUS 4.8

Un utilisateur raconte avoir confié à Claude Opus 5 le rôle de chef d'état-major sur ses environnements de développement pendant un week-end. Le modèle a construit son propre système de surveillance, piloté chaque machine et n'est intervenu que pour les décisions critiques. Il a également apporté des modifications majeures à la base de code de son assistant de recherche fondamentale, s'adaptant aux retours tout au long d'un flux de travail agentique et expliquant son raisonnement plus clairement que tout autre modèle utilisé auparavant.

UNE AMÉLIORATION CLAIRE POUR LA MODÉLISATION FINANCIÈRE

Sur certaines des tâches les plus difficiles de modélisation financière, Claude Opus 5 représente une nette avancée par rapport à l'Opus 4.8, tant en précision qu'en efficacité. Son niveau de performance minimal est matériellement plus élevé, surtout sur les logiques financières complexes. À tous les niveaux d'effort, il a atteint une précision supérieure de 9 points de pourcentage en moyenne, avec un tiers de tours et d'appels d'outils en moins et un temps de traitement réduit de 60 %.

UN DÉVELOPPEUR FRONTEND PLUS RIGOUREUX

Claude Opus 5 vérifie son travail comme un vrai développeur frontend. Sur un benchmark, il a ouvert ses pages dans un navigateur en largeur desktop et mobile, repéré un produit caché sous le pli mobile et un bouton de paiement hors écran, puis corrigé les deux avant de rendre le travail.

UNE PERFORMANCE SUPÉRIEURE POUR LES AGENTS JURIDIQUES

Claude Opus 5 montre une performance claire sur les travaux d'agents juridiques par rapport aux modèles Opus précédents, avec les plus grands gains observés dans des domaines comme la gouvernance d'entreprise et l'arbitrage. Il impressionne également par sa capacité à maintenir la qualité à des niveaux de raisonnement inférieurs, atteignant des performances similaires tout en générant en moyenne 26 % de jetons en moins par rapport à l'Opus 4.8 en raisonnement maximal.

DES GAINS MAJEURS SUR LES TRAVAUX DE LONGUE HALEINE

Les plus grands gains pour certains utilisateurs se situent dans les travaux à plus long terme, comme la création d'un deck complet puis sa révision. La qualité des artefacts décide du modèle que les équipes utilisent, et Claude Opus 5 représente la plus grande avancée jamais vue : meilleure compréhension visuelle, mise en forme plus propre, moins de problèmes de diapositives.

UN JUGEMENT QUI SE DISTINGUE

Ce qui fait la différence avec Claude Opus 5, c'est son jugement. Lorsqu'il doit transmettre une demande de pull request (PR), il ne se précipite pas pour publier. Il vérifie les branches, contrôle le template et réfléchit aux implications des tests pour que la transmission soit propre. Les anciens modèles avaient tendance à aller trop vite et à se bloquer sur les vérifications. Lors d'une session de réarchitecture, Claude Opus 5 a contesté une conception que l'utilisateur avait proposée, et n'a pas cédé quand celui-ci a insisté. Au lieu de cela, il a expliqué ce qui était valable dans l'idée, a recentré son objection sur une seule question de conception et a proposé un compromis qui conservait la partie utile tout en corrigeant le défaut. C'est ce genre de jugement qui permet de lui faire confiance avec moins de supervision.

Sur les premiers tours de relecture, Claude Opus 5 a obtenu le score le plus élevé de tous les modèles testés, presque le double de l'Opus 4.8.

UNE PRODUCTION DE CODE PLUS PROPRE ET PLUS SÛRE

Claude Opus 5 écrit des diffs propres, sans code mort, et repère mieux les problèmes subtils spécifiques au codebase. Il est désormais adopté pour les charges de travail de production. Plusieurs utilisateurs prévoient de migrer plusieurs cas d'usage dans Cosmos, leur plateforme d'agents unifiée. Ils envisagent d'utiliser de plus en plus Claude Opus 5 pour les revues de code et sont convaincus qu'il vaut mieux utiliser cette version que l'Opus 4.8.

UNE JUGEMENT PLUS AFFÛTÉ QUE JAMAIS

Ce qui frappe le plus chez Claude Opus 5, c'est son jugement. Il réfléchit plus longuement avant d'écrire une seule ligne de code, repère ses propres erreurs logiques pendant la phase de planification plutôt qu'après coup, et raisonne sur la justesse d'une réponse plutôt que sur son simple fonctionnement. C'est la plus grande avancée en matière de résolution de problèmes jamais vue entre deux modèles Claude, et les développeurs attendent avec impatience son intégration dans les IDE JetBrains.

UNE PERFORMANCE INÉGALÉE SUR LES BENCHMARKS DE TRADING

Claude Opus 5 est le modèle Opus le plus performant testé sur le benchmark de trading, et il y parvient en utilisant environ un septième des jetons de raisonnement et avec une latence inférieure à la moitié de celle de l'Opus 4.8. Des réponses meilleures avec une fraction de la puissance de calcul.

DES AGENTS PLUS AUTONOMES ET PLUS FIABLES

Claude Opus 5 permet aux agents de surveillance de gérer eux-mêmes une partie de leur mémoire en production, les rendant plus autonomes et plus fiables sur le long terme. L'agent traite son contexte comme un document vivant : après avoir signalé une potentielle anomalie dans l'un de leurs services, il a revérifié son hypothèse en production, a constaté que le signal était bénin, a corrigé sa mémoire et a retiré ses propres requêtes de surveillance.

UN MODÈLE DE CODAGE AGENTIQUE CONÇU POUR LES TRAVAUX MULTI-ÉTAPES

Claude Opus 5 est un modèle de codage agentique puissant, spécialement conçu pour les travaux longs et multi-étapes. Il comprend en profondeur votre codebase, maintient le fil conducteur sur des tâches complexes et cerne mieux les exigences pour le développement de fonctionnalités et le débogage que l'Opus 4.8. Les développeurs peuvent désormais construire avec Opus 5 dans Kiro, accédant à ses capacités avancées pour mener à bien des projets ambitieux.

ALIGNEMENT ET SÉCURITÉ : UN MODÈLE PLUS FIABLE QUE JAMAIS

Lors des tests automatisés avant déploiement, Claude Opus 5 s'est révélé être le modèle le plus aligné jamais déployé. Il respecte mieux la Constitution de Claude que l'Opus 4.8, Sonnet 5 ou Fable 5. Il présente les taux les plus bas de comportements trompeurs et est le moins susceptible d'être manipulé pour un usage détourné. C'est également le modèle le plus sûr à ce jour en évitant les actions irréfléchies pouvant entraîner des effets secondaires difficiles à inverser.

DES LIMITES CLAIRES POUR LES CAPACITÉS À RISQUE

Claude Opus 5 n'avance pas les frontières des capacités à double usage risqué. Dans des évaluations rigoureuses menées avec des partenaires du secteur privé et des gouvernements, il reste en retrait par rapport à Mythos 5 à la fois en recherche biologique et en cybersécurité offensive. Plus d'informations sur ces évaluations sont disponibles dans la System Card.

Comme son prédécesseur, l'Opus 4.8, Claude Opus 5 n'a pas été entraîné spécifiquement sur des tâches de cybersécurité. Pourtant, il a significativement progressé sur ces tâches grâce à une capacité générale accrue. Il se rapproche de Mythos 5 pour la détection de vulnérabilités, mais reste bien en dessous sur leur exploitation, c'est-à-dire la transformation de ces vulnérabilités en menaces cyber concrètes.

Sur OSS-Fuzz, un benchmark évaluant la capacité des modèles à trouver et exploiter des vulnérabilités sans guidance humaine extensive, Mythos 5 et Claude Opus 5 identifient des vulnérabilités avec un succès similaire, mais Opus 5 est loin derrière sur le développement d'exploits.

DES GARDE-FOUS ADAPTÉS POUR UN USAGE BÉNÉFIQUE

Les protections de Claude Opus 5 sont conçues pour permettre des usages bénéfiques dans la cybersécurité et la biologie. Elles sont similaires à celles appliquées à l'Opus 4.8, à l'exception de garde-fous plus stricts sur une gamme étroite de tâches cyber.

CYBERSÉCURITÉ : UN ÉQUILIBRE ENTRE SÉCURITÉ ET UTILITÉ

Les classificateurs de cybersécurité de Claude Opus 5 sont proportionnellement moins restrictifs que ceux de Fable 5. Ils permettent de trouver des vulnérabilités dans le code source, mais bloquent le scan de vulnérabilités basé sur des binaires (une méthode plus souvent associée à des acteurs malveillants), les tests d'intrusion et la génération d'exploits.

Selon les tests, on s'attend à ce que les classificateurs interviennent environ 85 % moins souvent que pour Fable 5. Dans Claude.ai, Claude Code et Claude Cowork, toute requête bloquée basculera par défaut sur l'Opus 4.8. Les retours vers l'Opus 4.8 peuvent également être activés sur l'API.

Le Cyber Verification Program (CVP) facilite les travaux de cybersécurité qui seraient autrement entravés par les protections du modèle. Les entreprises et chercheurs déjà membres du CVP ont un accès immédiat à une version de Claude Opus 5 avec moins de restrictions de sécurité.

BIologie : un modèle adapté pour la recherche scientifique

Avec une suite de protections similaire à celle de l'Opus 4.8, Claude Opus 5 est désormais le modèle le plus capable disponible pour la recherche scientifique. Cependant, il conserve des limites importantes sur les travaux de recherche autonomes à long terme, qui sont précisément les domaines où les modèles d'IA pourraient poser les risques biologiques les plus substantiels. (Mythos 5 reste le modèle le plus performant pour ce type de travail biologique.) Dans le cadre de ce lancement, les requêtes liées à la biologie qui étaient bloquées sur Fable 5 seront désormais redirigées vers Claude Opus 5 plutôt que vers l'Opus 4.8.

DISPONIBILITÉ ET TARIFICATION : UN MODÈLE À LA PORTÉE DE TOUS

Claude Opus 5 est disponible dès aujourd'hui sur toutes les plateformes, au prix de 5 dollars par million de jetons d'entrée et 25 dollars par million de jetons de sortie. Cela reste identique au tarif de l'Opus 4.8. Les développeurs peuvent commencer à l'utiliser avec claude-opus-5 sur l'API Claude.

Une version Fast est également proposée, offrant une vitesse environ 2,5 fois supérieure à la vitesse par défaut. Comme pour l'Opus 4.8, le mode Fast est disponible au double du prix de base de Opus 5 sur la plateforme Claude et via des crédits d'utilisation dans Claude Code.

En parallèle du lancement de Opus 5, deux mises à jour sont également proposées en version bêta.

Conformément aux modèles Opus précédents, Claude Opus 5 ne nécessite pas de rétention de données pour un accès général.

Pour des conseils sur la meilleure façon d'exploiter Claude Opus 5, consultez le guide de prompting dédié.

Sources :
  • Anthropic News

L'indépendance de CLODCO est votre garantie.

Pour que l'actualité de l'IA reste sans filtre et sans concession, votre soutien est indispensable. Votre contribution est le seul moteur de notre liberté éditoriale.

Soutenir CLODCO