Plus proactif sur l’incertitude
Les réponses signalent plus souvent ce qui est incertain ; les défauts manqués dans le code auto-écrit chutent nettement — adapté comme primaire de collaboration.
Claude Opus 4.8 est l’Opus d’Anthropic sorti en mai 2026, avec des hausses notables face à Claude Opus 4.7 sur le jugement de collaboration, la fiabilité d’agent et l’honnêteté. Il travaille en général à haute profondeur ; les jobs plus durs peuvent aller plus loin. Le nouveau code longue durée et le travail d’analyse choisissent plus souvent Claude Opus 5 ; si vos workflows sont déjà validés sur 4.8 — ou si vous avez besoin d’un filet Opus stable — vous pouvez continuer à l’utiliser. Sur iMini Agent, choisissez Claude Opus 4.8 pour l’utiliser.
Honnêteté, jugement d’agent et computer use — ce qu’il faut vérifier avant de passer de 4.7 à 4.8.
Les réponses signalent plus souvent ce qui est incertain ; les défauts manqués dans le code auto-écrit chutent nettement — adapté comme primaire de collaboration.
Moins d’étapes inutiles dans les appels d’outils et les jobs multi-étapes — des chemins plus propres vers les mêmes résultats d’intelligence.
Hausses claires sur les évals officielles de computer use comme Online-Mind2Web — adapté aux flux web et bureau de bout en bout.
Les taux de tromperie et d’aide au mésusage chutent nettement face à 4.7, approchant les niveaux de sécurité Mythos Preview de l’époque.
Résultats publiés par Anthropic avec Claude Opus 4.8, comparés à Claude Opus 4.7, GPT-5.5 et Gemini 3.1 Pro — génie logiciel, raisonnement multidisciplinaire, computer use et alignement comportemental.


Claude Opus 4.8 convient encore au travail niveau Opus validé ; les nouvelles charges flagship peuvent comparer Opus 5.
Pour le travail de feature, la chasse aux défauts et la revue de PR fondée sur des preuves. Adapté aux équipes dont les prompts et évals sont déjà liés à 4.8.
Pour les jobs multi-étapes qui pilotent un environnement web ou bureau. Écrivez clairement critères de complétion et conditions d’abort.
Pour le juridique, la finance et d’autres flux qui exigent un jugement stable. Les nouveaux jobs longue durée au plafond peuvent réévaluer Opus 5 ou Fable 5.
Les trois sont des chevaux de bataille Claude. Les différences : plafond de génération, coût haute fréquence, et si votre workflow est déjà validé.
| Dimension | Claude Opus 4.8 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| Contexte | 1M tokens | 1M tokens | 1M tokens |
| Raisonnement | En général haute profondeur, réglable | Réflexion approfondie intégrée, réglable | Niveaux de profondeur réglables |
| Code / agents | Code & collaboration Opus | Primaire flagship actuel pour code longue durée | Agents à l’échelle & code quotidien |
| Longues courses d’outils | Collaboration stable niveau Opus | Meilleure tenue d’objectif et complétion | Meilleur comme primaire haute fréquence |
| Posture vitesse | Qualité et expérience en équilibre | Qualité de complétion d’abord | Débit d’abord |
| Préférer quand | Workflows déjà validés sur 4.8 | Nouveau code longue durée et travail d’analyse | Nouveau primaire d’agents haute fréquence |
Quota gratuit, noms, specs clés, et différences face à Opus 5.
Contexte d’un million de tokens, en général haute profondeur, adapté aux workflows Opus validés.
Ouvrir Claude Opus 4.8Aucune clé API Anthropic requise.