Claude Opus 4.8 : ce que change le nouveau modèle phare d’Anthropic

Table des matières

Anthropic vient de lever le voile sur Claude Opus 4.8, la nouvelle version de son modèle phare. Présentée comme une amélioration « modeste mais tangible » par rapport à Opus 4.7, cette mise à jour pousse les curseurs sur le code, le raisonnement avec outils, la vitesse… et surtout sur l’honnêteté du modèle. Petit tour d’horizon de ce qui change vraiment.

Des benchmarks en hausse, devant GPT-5.5 et Gemini 3.1 Pro

Sur le papier, Opus 4.8 progresse sur la plupart des catégories testées par Anthropic, et devance ses concurrents directs — GPT-5.5 d’OpenAI et Gemini 3.1 Pro de Google — sur la majorité des évaluations. Les gains les plus nets concernent le code agentique et le raisonnement multidisciplinaire avec outils.

BenchmarkOpus 4.7Opus 4.8
SWE-bench Verified (code)87,6 %88,6 %
SWE-bench Pro (code agentique)64,3 %69,2 %
Raisonnement avec outils54,7 %57,9 %
Online-Mind2Web (agent web)84 %

À titre de comparaison, GPT-5.5 plafonne à 58,6 % sur SWE-bench Pro, là où Opus 4.8 atteint 69,2 %. Le modèle est aussi le seul à avoir bouclé l’intégralité des cas du benchmark Super-Agent de bout en bout, et signe le meilleur score sur le Legal Agent Benchmark.

Le contrôle de l’effort débarque

Nouveauté la plus visible côté utilisateur : sur claude.ai (et Cowork), vous pouvez désormais choisir la quantité d’« effort » que Claude consacre à une tâche. En clair, vous arbitrez entre rapidité et profondeur de réflexion selon le besoin — réponse express pour une question simple, ou réflexion poussée pour un problème complexe.

Workflows dynamiques : des centaines de sous-agents en parallèle

Pour les tâches lourdes, Opus 4.8 introduit les workflows dynamiques : la capacité à lancer des centaines de sous-agents en parallèle pour décomposer et traiter un gros chantier (audit de code, migration, recherche massive…). La fonctionnalité est disponible dans Claude Code pour les offres Enterprise, Team et Max.

Un mode rapide 3× moins cher

Le mode rapide (Fast mode), qui fait tourner le modèle à environ 2,5× la vitesse normale, devient trois fois moins cher que sur les versions précédentes. Important : il s’agit toujours d’Opus à pleine puissance qui répond plus vite, et non d’un repli sur un modèle plus petit.

  • Tarif standard : 5 $ / million de tokens en entrée, 25 $ / million en sortie (inchangé par rapport à Opus 4.7)
  • Mode rapide : 10 $ / million en entrée, 50 $ / million en sortie

Plus honnête, et moins enclin à la tromperie

C’est peut-être le progrès le plus important. Selon Anthropic, Opus 4.8 est environ quatre fois moins susceptible que son prédécesseur de laisser passer sans le signaler un défaut dans le code qu’il a écrit. Le modèle a aussi tendance à signaler de lui-même les problèmes sur les entrées et sorties d’une analyse — un réflexe que les autres modèles laissent souvent à la charge de l’utilisateur. L’équipe alignement note par ailleurs des taux de comportements « désalignés » nettement plus bas.

Disponibilité

Claude Opus 4.8 est disponible immédiatement, au même prix qu’Opus 4.7. Côté API, il s’appelle claude-opus-4-8. Une mise à jour de la Messages API permet aussi d’ajouter des entrées système en cours de tâche sans casser le cache de prompt — un détail technique qui compte pour les développeurs.

En résumé

Opus 4.8 n’est pas une révolution, mais une consolidation bien sentie : meilleur en code, plus rapide, moins cher en mode rapide, et surtout plus fiable et transparent. Pour celles et ceux qui utilisent Claude au quotidien — en particulier pour le développement — la montée de version se justifie largement.

Sources : Anthropic — Introducing Claude Opus 4.8, The Decoder, VentureBeat.

AdCreative ai

Noté 4 sur 5
Générez des créations publicitaires axées sur la conversion et des créations de messages sur les médias sociaux en quelques secondes grâce à l’intelligence artificielle. Obtenez de meilleurs résultats tout en gagnant du temps….
Graphisme, Indispensables, Marketing, Top 3 Marketing, Top 5

Deepswap ai

Noté 4 sur 5
Deepswap.ai est une application faceswap en ligne pour générer des vidéos, des photos et des GIFs d’échange de visage. Plus de 150 millions d’utilisateurs font des faceswaps ici, y compris des faceswaps de célébrités, des échanges de sexe, des mèmes, etc….
Création Vidéo, Deepswap ai, Indispensables, Nouveautés, Top 5

Elevenlabs AI

Noté 5 sur 5
Créez des voix-off IA, des agents vocaux et doublez vos vidéos. Simple et rapide. Plus de 29 langues disponibles….
Indispensables, Synthèse Vocale, Top 3 Synthèse Vocale, Top 5

Fireflies ai

Noté 5 sur 5
Avec Fireflies vous n’avez plus besoin de prendre des notes pendant vos appels. Fireflies transcrit tout et vous permet de retrouver les éléments clés de vos appels….
Assistant, Automatisation, Indispensables, Nouveautés, Productivité, Top 3 Assistant, Top 3 Transcription, Top 5, Transcription

Jasper ai

Noté 5 sur 5
Jasper est le générateur de contenu IA qui vous aide, vous et votre équipe, à surmonter les blocages créatifs pour créer un contenu original et étonnant 10 fois plus vite….
Indispensables, Marketing, Productivité, Rédaction, Top 3 Marketing, Top 3 Productivité, Top 3 Rédaction, Top 5

Undetectable AI

Noté 4.5 sur 5
Rendez vos textes rédigés par l’IA indétectables et plus humains. Passez au travers des détecteurs d’IA en produisant un contenu de qualité….
Nouveautés, Paraphraseur, Rédaction, Top 3 Paraphraseur, Top 5

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *

Jasper.ai

3/5
Noté 3 sur 5

Titre 1

Découvrez toute la puissance d’un générateur de contenu IA qui fournit des résultats de qualité en quelques secondes.

En Savoir plus