Claude Opus 4.8 : Anthropic enchaîne à toute vitesse avec les « dynamic workflows »
Le 28 mai 2026, Anthropic a sorti Claude Opus 4.8, seulement 41 jours après Opus 4.7. Un rythme effréné qui montre l'accélération de la course aux modèles frontière. Au même prix que la version précédente (5 $ par million de tokens en entrée, 25 $ en sortie), Opus 4.8 progresse sur tous les benchmarks clés : codage agentique (de 64,3 % à 69,2 %), raisonnement multidisciplinaire avec outils (de 54,7 % à 57,9 %), analyse financière et travail de la connaissance. Sur le Super-Agent benchmark, c'est le seul modèle à boucler tous les cas de bout en bout, devançant GPT-5.5 à coût égal. Il établit aussi le record sur le Legal Agent Benchmark. Trois nouveautés majeures : (1) le contrôle de l'effort (effort control) qui permet de doser le temps de raisonnement, (2) un fast mode 2,5× plus rapide à qualité identique et 3× moins cher que sur les versions précédentes, (3) les « dynamic workflows » dans Claude Code, Claude planifie une tâche massive, lance jusqu'à 16 sous-agents en parallèle (1 000 au total par run), vérifie les résultats et synthétise. Fenêtre de contexte : 1 million de tokens. Côté fiabilité, Opus 4.8 est environ 4 fois moins susceptible que 4.7 de laisser passer une faille dans son propre code sans la signaler, un vrai progrès sur l'honnêteté du modèle.
L'avis d'Emmanuel
Ce qui me frappe, c'est la VITESSE. 41 jours entre deux versions majeures d'un modèle frontière, on n'avait jamais vu ça. Pour vous, dirigeant, deux enseignements. (1) N'attendez plus « la bonne version » pour vous lancer : elle sera dépassée dans 6 semaines. Le bon réflexe, c'est de maîtriser la MÉTHODE (prompt, agents, workflows), pas de courir après le dernier modèle. (2) Les « dynamic workflows » sont un signal fort : on passe de « 1 humain pilote 1 IA » à « 1 humain pilote une flotte de sous-agents ». C'est exactement la bascule agentique que je décris dans le module 11. Et l'accent mis sur l'honnêteté du modèle (4× moins d'erreurs de code non signalées) est rassurant pour un usage entreprise sérieux. Claude reste mon choix n°1 pour les tâches longues et le code. Pour la souveraineté de vos données sensibles, gardez Mistral en parallèle, la diversification reste la bonne discipline.
Sources : Anthropic — Introducing Claude Opus 4.8 · TechCrunch 28 mai 2026 · Axios · The New Stack
Cet article est extrait de la veille IA de L'EssentIAl, la plateforme d'Emmanuel Derrien : l'actualité de l'intelligence artificielle filtrée, expliquée, et reliée à ce qu'elle change concrètement pour votre entreprise.