Claude Opus 5 rivalise avec le top de l’IA à moitié prix

Claude Opus 5 en challenger de boxe lumineux face à un champion géant dans l'ombre

Anthropic a lancé Claude Opus 5 le 24 juillet en le présentant comme le modèle par défaut du travail de bureau, facturé environ moitié moins que son modèle phare Fable 5. Sur plusieurs benchmarks il s’approche de Fable 5 tout en coûtant près de 50 % de moins par token, et il embarque une commande qui laisse choisir l’effort que le modèle consacre à chaque requête.

Pour résumer

  • Claude Opus 5 atteint une qualité proche de Fable 5 sur de nombreuses tâches, pour environ la moitié du prix au token.
  • Une commande d’effort faible, moyen ou élevé permet d’arbitrer entre vitesse et profondeur à chaque prompt.
  • Opus 5 signe de nouveaux meilleurs scores en code et en travail de connaissance, et Anthropic le positionne comme le modèle du bureau au quotidien.

Faire résumer cet article par une IA

ChatGPT

Opus 5 arrive à moitié du prix au token de Fable 5

Le modèle est disponible depuis le 24 juillet, et le discours est inhabituellement direct pour un laboratoire de pointe. Anthropic attend d’Opus 5 qu’il devienne l’option par défaut de la plupart des besoins de bureau quotidiens, pas un modèle lourd qu’on sort une fois par semaine. Il succède à la version lancée quand Opus 4.8 avait redéfini les règles avec ses workflows dynamiques, et il livre un rendu nettement meilleur pour le même coût d’usage que ce prédécesseur.

Le prix est l’argument central. Opus 5 coûte environ 50 % de moins par token que Fable 5, le modèle le plus avancé largement accessible de la maison, tout en s’en approchant dans de nombreuses catégories. Anthropic a détaillé les chiffres dans son annonce officielle d’Opus 5 publiée vendredi, et la séparation qu’il trace entre capacité et coût résume tout l’enjeu de la sortie.

Côté tableau de bord, Opus 5 dépasse Fable 5 sur huit tests de référence sur treize, malgré son prix plus bas. Il établit de nouveaux records en code et en travail de connaissance sur des suites comme Frontier-Bench et GDPval-AA, le genre d’évaluations qui mesurent la production professionnelle réelle plutôt que des questions de culture. Il reste derrière le modèle spécialisé Mythos 5 sur les tâches de cybersécurité, un écart qu’Anthropic n’a pas masqué.

Un chiffre ressort pour qui suit le raisonnement brut. Sur ARC-AGI-3, un benchmark bâti autour de problèmes que le modèle n’a jamais vus, Opus 5 obtient 30,2 %, près de quatre fois le score du GPT-5.6 Sol d’OpenAI. C’est le genre d’écart qui transforme une histoire de prix en histoire de capacité, et il tombe alors que l’économie du token bascule pour tout le marché, un virage déjà visible quand Fable 5 est passé de l’abonnement fixe à la facturation au token.


Claude Opus 5

Un curseur faible, moyen, élevé sur chaque réponse

La nouveauté qui va changer les habitudes est la commande d’effort. Claude Opus 5 laisse choisir la dose d’effort consacrée à une tâche, entre faible, moyen et élevé, avant même de répondre. Le mode faible renvoie une réponse rapide et bon marché pour du travail courant, le mode élevé consacre plus de calcul et de temps à un problème difficile, et le choix revient à la personne qui envoie le prompt.

Pour une équipe produit, ce curseur est un levier de budget. Un brouillon de support, un compte rendu de réunion ou une reformulation rapide tournent en mode faible et pèsent à peine sur la facture, tandis qu’un plan de migration épineux ou une relecture juridique passent en élevé sans changer de modèle. On arrête de payer un tarif de pointe pour du travail administratif, exactement la couche où se concentre l’essentiel des usages aujourd’hui, un enseignement utile quand on cherche à arrêter de gaspiller ses tokens sur Claude.

Pour les développeurs, la migration est légère. Opus 5 remplace Opus 4.8 au même coût, donc la vraie question n’est pas de migrer mais de router agressivement les appels courants vers l’effort faible. Le travail d’efficacité et de sûreté intégré au modèle réduit les reprises et les surprises, ce qui compte davantage qu’un point de benchmark quand le modèle tourne dans une boucle d’agent toute la journée.

La nuance, c’est que le curseur ne paie que si les équipes s’en servent vraiment. Une entreprise qui laisse tout en mode élevé hérite de la capacité mais pas des économies. Les gagnants ici sont ceux qui traitent l’effort comme une décision tâche par tâche, et l’outillage d’Opus 5 est clairement pensé pour les y pousser.


D’autres articles sur Horizon


Le haut de gamme à moitié prix met OpenAI sous pression

Un modèle quasi de pointe à moitié prix ne reste pas longtemps une affaire interne à Claude. Il offre aux développeurs un défaut moins cher et force chaque rival à répondre sur le coût, pas seulement sur la capacité. OpenAI est le plus directement touché, puisque l’écart sur ARC-AGI-3 vise GPT-5.6 Sol, et la pression montait déjà quand Grok 4.5 visait Claude Opus au tiers du prix.

La riposte est prévisible. Les concurrents alignent le prix et rognent leur marge, ou ils appuient plus fort sur un différenciant qu’Opus 5 ne touche pas, aujourd’hui l’avance en cybersécurité que garde Mythos 5. Dans les deux cas, le standard implicite du marché pour un modèle de bureau au quotidien vient de baisser, et les autres doivent désormais justifier un tarif plus élevé.

Le calendrier n’est pas un hasard. Anthropic prépare une entrée en bourse plus tard cette année, et un modèle qui montre de la discipline sur la marge tout en dominant les benchmarks est un récit propre à présenter au marché, celui amorcé quand le dossier d’introduction a été déposé auprès de la SEC. Opus 5 est un lancement produit, mais c’est aussi une démonstration destinée aux investisseurs qui veulent voir un laboratoire de pointe gagner de l’argent.

Pour le reste de 2026, le chiffre qui compte n’est pas un benchmark mais une habitude. Si les équipes routent réellement leur travail courant vers l’effort faible, Opus 5 redéfinit en silence ce qu’un modèle IA professionnel est censé coûter.

Affaire à suivre sur Horizon.

Comments

No comments yet. Why don’t you start the discussion?

    Laisser un commentaire

    Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *