NewsIA
En direct
Modèles de langage

Claude Opus 5 et Gemini 3.6 : la guerre des prix

En trois jours, Google sort Gemini 3.6 Flash et Anthropic Claude Opus 5. Même capacité, prix cassés : le milieu de gamme devient la vraie bataille.


PartagerXLinkedInEmail
Claude Opus 5 et Gemini 3.6 : la guerre des prix
L'essentiel en 30 secondes
  • Claude Opus 5 (24 juillet) et Gemini 3.6 Flash (21 juillet) sont sortis à trois jours d'écart, tous deux confirmés officiellement.
  • Opus 5 vise la capacité de Fable 5 à environ moitié prix, avec un contrôle d'effort à 5 niveaux.
  • Gemini 3.6 Flash coûte 1,50 / 7,50 $ par million de tokens et consomme 17 % de tokens en moins.
  • La vraie bataille de l'été n'est plus la performance brute, mais le rapport qualité-prix.

En l'espace de trois jours, les deux plus gros laboratoires d'IA ont dégainé. Google a lancé Gemini 3.6 Flash le 21 juillet, Anthropic a répliqué avec Claude Opus 5 le 24. Ni l'un ni l'autre ne cherche le record absolu : les deux visent le meilleur ratio capacité-prix. Pour les entreprises, c'est peut-être la nouvelle la plus concrète de l'été.

01 · Claude Opus 5

Opus 5 : la puissance de Fable 5, à moitié prix

Anthropic positionne Opus 5 comme son nouveau modèle par défaut sur Claude Max et le plus puissant de Claude Pro. Le prix APIApplication Programming Interface, le canal d'accès programmatique à un service ou à un modèle. reste inchangé face à Opus 4.8 : 5 dollars le million de tokens en entrée, 25 en sortie. La fenêtre de contexteLa fenêtre de contexte : le nombre maximum de tokens qu'un modèle peut traiter en une seule requête (ex : 200k, 1M). grimpe à 1 million de tokens, la sortie jusqu'à 128 000 tokens, et la date de connaissance atteint mai 2026.

Sur les benchmarks avancés par Anthropic, Opus 5 double le score d'Opus 4.8 sur Frontier-Bench, dépasse Claude Fable 5 sur l'usage ordinateur (OSWorld 2.0) à un tiers de son prix, et talonne Fable 5 sur le codage (CursorBench) à moitié prix. Sur la cybersécurité, il reste toutefois derrière le modèle spécialisé Mythos.

02 · Gemini 3.6 Flash

Gemini 3.6 Flash : Google mise tout sur l'efficacité

Côté Google, la stratégie est limpide : de l'efficacité, pas de flagship. Gemini 3.6 Flash coûte 1,50 dollar en entrée et 7,50 en sortie par million de tokens, soit 17 % moins cher en sortie que la version 3.5, tout en produisant 17 % de tokens en moins pour une qualité supérieure. Sa date de connaissance passe à mars 2026.

Fait notable : Google a livré trois modèles d'un coup (3.6 Flash, 3.5 Flash-Lite et une variante 3.5 Flash Cyber pour la cybersécurité) mais a de nouveau repoussé Gemini 3.5 Pro, jugé insuffisant en codage. Le prochain vrai palier s'appelle désormais Gemini 4, en pré-entraînement.

03 · Le comparatif

Le nouveau paysage tarifaire

Modèle Entrée / Sortie ($/M tokens) Contexte Sortie max
Gemini 3.6 Flash 1,50 / 7,50 1 M 64 k
Claude Opus 5 5 / 25 1 M 128 k
Claude Opus 4.8 5 / 25 1 M ,
Claude Fable 5 10 / 50 1 M ,
GPT-5.6 Sol 5 / 30 272 k ,

La lecture est nette : pour un travail de volume (tri, brouillons, résumés), Gemini 3.6 écrase la concurrence sur le coût. Pour le raisonnement complexe, Opus 5 offre désormais 80 à 90 % de la capacité du haut de gamme à la moitié du prix.

04 · L'innovation

Le contrôle d'effort, la vraie nouveauté d'Opus 5

Opus 5 laisse l'utilisateur choisir, requête par requête, entre coût et capacité.D'après Fortune, 24 juillet 2026

La fonctionnalité la plus commentée n'est pas un benchmarkUn test standardisé qui mesure la performance des modèles sur une tâche (ex : SWE-bench pour le code, MMLU pour les savoirs généraux). : c'est le réglage d'effort à cinq niveaux. En clair, vous décidez pour chaque requête combien Opus 5 « réfléchit », donc combien il coûte. Un effort maximal rapproche Opus 5 des capacités de Fable 5 pour environ deux fois le prix de base, au lieu de cinq. C'est une réponse directe à la principale critique des modèles de raisonnement : leur facture qui s'envole.

05 · L'actu chaude

Et pendant ce temps, début août

La cadence ne faiblit pas. Le 1er août, OpenAI a annoncé que son modèle interne de raisonnement, baptisé Astra, avait résolu une dizaine de problèmes mathématiques ouverts avec des preuves formelles en Lean, sans pour autant rendre le modèle public. Le 2 août, Alibaba enchaînait avec Qwen 3.8 Max. Le message est clair : entre les modèles ouverts chinois et cette guerre des prix, la pression sur les marges d'OpenAI et Anthropic n'a jamais été aussi forte.

06 · L'enjeu concret

Ce que ça change pour vous

Pour une PME, une agence ou un développeur français, le calcul devient imbattable : un pipeline « Gemini 3.6 pour le tri et les brouillons, Opus 5 pour le raisonnement lourd » revient 40 à 50 % moins cher qu'une solution tout-OpenAI, sans perte de qualité notable. Et comme Opus 5 et Gemini 3.6 restent hébergés par des acteurs occidentaux, l'argument souveraineté tient mieux que face aux modèles chinois. Pour comparer, utilisez notre comparateur de modèles et notre calculateur de coût LLM. Voir aussi notre dossier sur Claude Opus 4.8 et la fiche Claude, mise à jour.

Sources

  • Anthropic, annonce officielle de Claude Opus 5 (24 juillet 2026)
  • Google DeepMind, annonce de Gemini 3.6 Flash (21 juillet 2026)
  • TechCrunch, « Google releases three new Gemini models, but no 3.5 Pro »
  • Fortune, « Anthropic debuts Claude Opus 5 with a cost-capability toggle »
  • VentureBeat, réduction des coûts de tokens de Gemini 3.6 Flash

Questions fréquentes

Quand Claude Opus 5 est-il sorti et que change-t-il ?
Claude Opus 5 est sorti le 24 juillet 2026. Il double le score d'Opus 4.8 sur Frontier-Bench, dépasse Fable 5 sur l'usage ordinateur à un tiers du prix, garde le tarif de 5 / 25 $ par million de tokens et ajoute un contrôle d'effort à cinq niveaux.
Combien coûte Gemini 3.6 Flash ?
Gemini 3.6 Flash coûte 1,50 dollar en entrée et 7,50 dollars en sortie par million de tokens, soit 17 % moins cher en sortie que Gemini 3.5 Flash. Il consomme aussi 17 % de tokens en moins pour une qualité supérieure, avec une fenêtre de contexte d'un million de tokens.
Qu'est-ce que le contrôle d'effort d'Opus 5 ?
C'est un réglage à cinq niveaux qui laisse l'utilisateur décider, pour chaque requête, combien le modèle « réfléchit », donc combien il coûte. À effort maximal, Opus 5 approche les capacités de Fable 5 pour environ deux fois le prix de base, au lieu de cinq fois.
Gemini 3.5 Pro est-il enfin sorti ?
Non. Google a de nouveau repoussé Gemini 3.5 Pro, jugé insuffisant en codage, tout en livrant trois modèles Flash. Le prochain vrai palier de Google s'appelle désormais Gemini 4, actuellement en phase de pré-entraînement, sans date annoncée.
Faut-il choisir Opus 5 ou Gemini 3.6 ?
Les deux sont complémentaires. Gemini 3.6 Flash est imbattable sur le coût pour les tâches de volume (tri, brouillons, résumés). Opus 5 offre 80 à 90 % de la capacité du haut de gamme à moitié prix pour le raisonnement complexe. Beaucoup d'entreprises combinent les deux.
Que s'est-il passé début août 2026 côté modèles ?
Le 1er août, OpenAI a annoncé qu'un modèle interne nommé Astra avait résolu une dizaine de problèmes mathématiques ouverts avec des preuves formelles en Lean, sans le rendre public. Le 2 août, Alibaba a lancé Qwen 3.8 Max. La cadence des sorties reste très soutenue.

Source : www.anthropic.com

À lire aussi