Claude Opus 5 et Gemini 3.6 : la guerre des prix
En trois jours, Google sort Gemini 3.6 Flash et Anthropic Claude Opus 5. Même capacité, prix cassés : le milieu de gamme devient la vraie bataille.

- Claude Opus 5 (24 juillet) et Gemini 3.6 Flash (21 juillet) sont sortis à trois jours d'écart, tous deux confirmés officiellement.
- Opus 5 vise la capacité de Fable 5 à environ moitié prix, avec un contrôle d'effort à 5 niveaux.
- Gemini 3.6 Flash coûte 1,50 / 7,50 $ par million de tokens et consomme 17 % de tokens en moins.
- La vraie bataille de l'été n'est plus la performance brute, mais le rapport qualité-prix.
En l'espace de trois jours, les deux plus gros laboratoires d'IA ont dégainé. Google a lancé Gemini 3.6 Flash le 21 juillet, Anthropic a répliqué avec Claude Opus 5 le 24. Ni l'un ni l'autre ne cherche le record absolu : les deux visent le meilleur ratio capacité-prix. Pour les entreprises, c'est peut-être la nouvelle la plus concrète de l'été.
Opus 5 : la puissance de Fable 5, à moitié prix
Anthropic positionne Opus 5 comme son nouveau modèle par défaut sur Claude Max et le plus puissant de Claude Pro. Le prix APIApplication Programming Interface, le canal d'accès programmatique à un service ou à un modèle. reste inchangé face à Opus 4.8 : 5 dollars le million de tokens en entrée, 25 en sortie. La fenêtre de contexteLa fenêtre de contexte : le nombre maximum de tokens qu'un modèle peut traiter en une seule requête (ex : 200k, 1M). grimpe à 1 million de tokens, la sortie jusqu'à 128 000 tokens, et la date de connaissance atteint mai 2026.
Sur les benchmarks avancés par Anthropic, Opus 5 double le score d'Opus 4.8 sur Frontier-Bench, dépasse Claude Fable 5 sur l'usage ordinateur (OSWorld 2.0) à un tiers de son prix, et talonne Fable 5 sur le codage (CursorBench) à moitié prix. Sur la cybersécurité, il reste toutefois derrière le modèle spécialisé Mythos.
Gemini 3.6 Flash : Google mise tout sur l'efficacité
Côté Google, la stratégie est limpide : de l'efficacité, pas de flagship. Gemini 3.6 Flash coûte 1,50 dollar en entrée et 7,50 en sortie par million de tokens, soit 17 % moins cher en sortie que la version 3.5, tout en produisant 17 % de tokens en moins pour une qualité supérieure. Sa date de connaissance passe à mars 2026.
Fait notable : Google a livré trois modèles d'un coup (3.6 Flash, 3.5 Flash-Lite et une variante 3.5 Flash Cyber pour la cybersécurité) mais a de nouveau repoussé Gemini 3.5 Pro, jugé insuffisant en codage. Le prochain vrai palier s'appelle désormais Gemini 4, en pré-entraînement.
Le nouveau paysage tarifaire
| Modèle | Entrée / Sortie ($/M tokens) | Contexte | Sortie max |
|---|---|---|---|
| Gemini 3.6 Flash | 1,50 / 7,50 | 1 M | 64 k |
| Claude Opus 5 | 5 / 25 | 1 M | 128 k |
| Claude Opus 4.8 | 5 / 25 | 1 M | , |
| Claude Fable 5 | 10 / 50 | 1 M | , |
| GPT-5.6 Sol | 5 / 30 | 272 k | , |
La lecture est nette : pour un travail de volume (tri, brouillons, résumés), Gemini 3.6 écrase la concurrence sur le coût. Pour le raisonnement complexe, Opus 5 offre désormais 80 à 90 % de la capacité du haut de gamme à la moitié du prix.
Le contrôle d'effort, la vraie nouveauté d'Opus 5
Opus 5 laisse l'utilisateur choisir, requête par requête, entre coût et capacité.D'après Fortune, 24 juillet 2026
La fonctionnalité la plus commentée n'est pas un benchmarkUn test standardisé qui mesure la performance des modèles sur une tâche (ex : SWE-bench pour le code, MMLU pour les savoirs généraux). : c'est le réglage d'effort à cinq niveaux. En clair, vous décidez pour chaque requête combien Opus 5 « réfléchit », donc combien il coûte. Un effort maximal rapproche Opus 5 des capacités de Fable 5 pour environ deux fois le prix de base, au lieu de cinq. C'est une réponse directe à la principale critique des modèles de raisonnement : leur facture qui s'envole.
Et pendant ce temps, début août
La cadence ne faiblit pas. Le 1er août, OpenAI a annoncé que son modèle interne de raisonnement, baptisé Astra, avait résolu une dizaine de problèmes mathématiques ouverts avec des preuves formelles en Lean, sans pour autant rendre le modèle public. Le 2 août, Alibaba enchaînait avec Qwen 3.8 Max. Le message est clair : entre les modèles ouverts chinois et cette guerre des prix, la pression sur les marges d'OpenAI et Anthropic n'a jamais été aussi forte.
Ce que ça change pour vous
Pour une PME, une agence ou un développeur français, le calcul devient imbattable : un pipeline « Gemini 3.6 pour le tri et les brouillons, Opus 5 pour le raisonnement lourd » revient 40 à 50 % moins cher qu'une solution tout-OpenAI, sans perte de qualité notable. Et comme Opus 5 et Gemini 3.6 restent hébergés par des acteurs occidentaux, l'argument souveraineté tient mieux que face aux modèles chinois. Pour comparer, utilisez notre comparateur de modèles et notre calculateur de coût LLM. Voir aussi notre dossier sur Claude Opus 4.8 et la fiche Claude, mise à jour.
Sources
- Anthropic, annonce officielle de Claude Opus 5 (24 juillet 2026)
- Google DeepMind, annonce de Gemini 3.6 Flash (21 juillet 2026)
- TechCrunch, « Google releases three new Gemini models, but no 3.5 Pro »
- Fortune, « Anthropic debuts Claude Opus 5 with a cost-capability toggle »
- VentureBeat, réduction des coûts de tokens de Gemini 3.6 Flash
Questions fréquentes
- Quand Claude Opus 5 est-il sorti et que change-t-il ?
- Claude Opus 5 est sorti le 24 juillet 2026. Il double le score d'Opus 4.8 sur Frontier-Bench, dépasse Fable 5 sur l'usage ordinateur à un tiers du prix, garde le tarif de 5 / 25 $ par million de tokens et ajoute un contrôle d'effort à cinq niveaux.
- Combien coûte Gemini 3.6 Flash ?
- Gemini 3.6 Flash coûte 1,50 dollar en entrée et 7,50 dollars en sortie par million de tokens, soit 17 % moins cher en sortie que Gemini 3.5 Flash. Il consomme aussi 17 % de tokens en moins pour une qualité supérieure, avec une fenêtre de contexte d'un million de tokens.
- Qu'est-ce que le contrôle d'effort d'Opus 5 ?
- C'est un réglage à cinq niveaux qui laisse l'utilisateur décider, pour chaque requête, combien le modèle « réfléchit », donc combien il coûte. À effort maximal, Opus 5 approche les capacités de Fable 5 pour environ deux fois le prix de base, au lieu de cinq fois.
- Gemini 3.5 Pro est-il enfin sorti ?
- Non. Google a de nouveau repoussé Gemini 3.5 Pro, jugé insuffisant en codage, tout en livrant trois modèles Flash. Le prochain vrai palier de Google s'appelle désormais Gemini 4, actuellement en phase de pré-entraînement, sans date annoncée.
- Faut-il choisir Opus 5 ou Gemini 3.6 ?
- Les deux sont complémentaires. Gemini 3.6 Flash est imbattable sur le coût pour les tâches de volume (tri, brouillons, résumés). Opus 5 offre 80 à 90 % de la capacité du haut de gamme à moitié prix pour le raisonnement complexe. Beaucoup d'entreprises combinent les deux.
- Que s'est-il passé début août 2026 côté modèles ?
- Le 1er août, OpenAI a annoncé qu'un modèle interne nommé Astra avait résolu une dizaine de problèmes mathématiques ouverts avec des preuves formelles en Lean, sans le rendre public. Le 2 août, Alibaba a lancé Qwen 3.8 Max. La cadence des sorties reste très soutenue.
Source : www.anthropic.com


