Close-up of a computer motherboard with
IA

OpenAI et Anthropic annoncent des baisses de prix majeures

GPT-6 Sol/Luna sont prévus pour une réduction de coût de 50 % et Opus 5.5 est proposé à environ 40 % moins cher, tandis que DeepSeek V4.1 Flash a enregistré une augmentation de 172 % de l'utilisation hebdomadaire.

Par Elliot Marsh6 min de lecture

Un nouveau cycle de sortie hebdomadaire pousse les modèles d'IA phares à descendre la courbe des coûts, OpenAI et Anthropic annonçant de fortes réductions de prix plutôt que de simplement réduire le prix des anciennes versions. Les premières données d'utilisation d'OpenRouter, où le V4.1 Flash de DeepSeek se classe au No.

1 avec une augmentation de 172 % "cette semaine", sont cohérentes avec une tarification par jeton moins chère qui élargit la demande même si les laboratoires subissent une pression sur les marges.

Points clés

  • OpenAI prévoyait de lancer GPT-6 Sol et GPT-6 Luna mardi avec des coûts pour les principaux clients commerciaux réduits de 50 % par rapport aux itérations précédentes des mêmes modèles.
  • Anthropic a également ciblé mardi pour Opus 5.5, affirmant qu'il coûte environ 40 % de moins à exécuter que Opus 5 tout en maintenant "une intelligence de haut niveau".
  • xAI a lancé Grok 4.7 lundi et l'a commercialisé sur la base du rapport qualité-prix, mais les lancements concurrents ont réduit une grande partie de cet avantage de prix en 24 heures.
  • Le V4.1 Flash de DeepSeek s'est classé No. 1 sur le classement d'OpenRouter et a enregistré une augmentation de 172 % de l'utilisation "cette semaine".

Les modèles phares deviennent moins chers, rapidement : GPT-6 Sol/Luna, Opus 5.5 et Grok 4.7

Le rythme de sortie de l'IA cette semaine est commercialisé moins comme une course pure aux capacités et plus comme une réécriture de la grille tarifaire. OpenAI prévoyait de lancer GPT-6 Sol et GPT-6 Luna mardi, réduisant les coûts pour les principaux clients commerciaux de 50 % par rapport aux itérations précédentes des mêmes modèles.

Anthropic prévoyait de lancer Opus 5.5 le même jour et a déclaré qu'il coûte environ 40 % de moins à faire fonctionner qu'Opus 5 tout en maintenant une intelligence de premier plan. Le fil conducteur est une compression explicite des coûts sur le nouveau niveau "flagship", et non pas simplement le schéma habituel de réduction des prix sur les anciens modèles après un nouveau lancement.

Le mouvement de xAI a donné le ton. xAI d'Elon Musk a lancé Grok 4.7 lundi, positionnant le modèle autour du rapport qualité-prix, et la réponse concurrentielle a été immédiate. En 24 heures, de nouvelles options avaient réduit une grande partie de l'avantage de prix de Grok 4.7, un rappel rapide que le pouvoir de fixation des prix dans les modèles de pointe peut s'évaporer en un seul cycle d'actualités.

Coûts par jeton, expliqués : pourquoi les réductions de prix peuvent augmenter les dépenses totales en IA.

L'unité qui compte dans ce combat est le jeton. Les coûts par jeton sont le prix qu'un fournisseur facture pour traiter ou générer une unité de texte, et c'est le moyen le plus simple de comparer les coûts d'exploitation entre les modèles lorsque tout le reste évolue.

Réduire les prix par jeton ne signifie pas automatiquement que le marché dépense moins en IA. Le mécanisme est simple : lorsqu'un modèle devient moins cher à appeler, les développeurs expédient plus de fonctionnalités qui étaient auparavant trop coûteuses, les utilisateurs effectuent des sessions plus longues, et les entreprises poussent plus de flux de travail à travers le modèle au lieu de le réserver pour des invites "à haute valeur".

Cela peut augmenter le volume total de jetons suffisamment pour maintenir les dépenses agrégées en hausse même si le prix par jeton diminue.

Cette dynamique est l'intuition derrière le paradoxe de Jevons, l'idée économique selon laquelle lorsqu'une ressource devient moins chère à utiliser, la consommation totale peut augmenter plutôt que diminuer. Dans ce cas, la "ressource" est l'inférence, et le pari est que des prix plus bas débloquent suffisamment de nouvelles utilisations pour maintenir le compteur de calcul en marche.

Le cadrage du côté vendeur dans le paquet s'appuie sur cette histoire de volume. Citadel Securities a dit à ses clients que la baisse des coûts par jeton alimente une utilisation supplémentaire et que les dépenses globales en IA augmentent, ce qui, selon elle, indique des bénéfices éventuels plus élevés pour les laboratoires d'IA ou les entreprises fournissant la puissance de calcul derrière l'utilisation de l'IA.

Morgan Stanley a formulé un cas similaire du côté de la demande, présentant la concurrence des fournisseurs chinois comme"optimiste"pour l'IA parce qu'un accès moins cher peut capter plus de clients et augmenter la demande globale de calcul.

Point de preuve d'adoption : DeepSeek V4.1 Flash dépasse OpenRouter alors que l'utilisation augmente de 172 %.

Le point de données le plus clair dans le paquet n'est pas un score de référence. C'est un classement et un pic d'utilisation.

Le Flash V4.1 de DeepSeek s'est classé No. 1 sur le classement d'OpenRouter et a enregistré un pic d'utilisation de 172 % « cette semaine ». OpenRouter est un agrégateur qui achemine les demandes à travers plusieurs modèles et publie des classements que les traders et les développeurs utilisent comme un proxy approximatif pour l'élan d'adoption.

DeepSeek est également l'exemple que le paquet utilise pour définir la pression de poids ouvert sur les acteurs établis. Un modèle à poids ouvert est un modèle dont les paramètres entraînés sont rendus disponibles afin que d'autres puissent l'exécuter ou l'affiner, ce qui permet souvent un déploiement moins coûteux ou plus flexible que les offres entièrement fermées.

Le paquet note que DeepSeek a déclaré que le V4.1 Flash surpasse son précédent modèle phare sur un certain nombre de références grâce à des mises à jour techniques qui lui permettent de facturer moins, bien que la suite de référence et les résultats ne soient pas fournis ici.

Le point plus large est compétitif, pas idéologique. Lorsque les fournisseurs à poids ouvert grimpent dans des classements largement observés tout en réduisant les prix, ils forcent les laboratoires fermés à réagir sur le coût, et le langage tarifaire du modèle phare de cette semaine ressemble à cette réponse.

Liste de vérification de confirmation pour les traders : Utilisation à revenu, planchers de prix et part de classement.

Le premier point de confirmation est de savoir si les réductions de prix sont réelles dans le seul endroit qui compte : les pages de prix post-lancement et les conditions d'entreprise.

La réduction de 50 % déclarée par OpenAI pour les principaux clients commerciaux et le coût d'exécution d'environ 40 % inférieur d'Anthropic pour Opus 5.5 sont des chiffres importants, mais le paquet n'inclut pas de chiffres absolus en $/token ni l'étendue exacte des clients et des niveaux d'utilisation qui qualifient.

Deuxième point : les classements et les tendances d'utilisation d'OpenRouter maintiennent-ils DeepSeek V4.1 Flash à la première place ou près de celle-ci au cours des une à deux prochaines semaines, ou le classement revient-il après les lancements phares de mardi ? Un pic d'une semaine peut être dû à la nouveauté, aux incitations ou aux défauts d'acheminement. Une part soutenue est une revendication différente.

Troisième point : le pont utilisation-revenu. Le paquet signale une pression sur les marges pour OpenAI et Anthropic alors que la guerre des prix s'accélère, et il reste à savoir si des volumes de tokens plus élevés se traduisent par une croissance soutenue des revenus lorsque le prix par token se comprime.

Enfin, surveillez la rapidité avec laquelle la revalorisation se propage. L'avantage de Grok 4.7 étant concurrencé en moins de 24 heures est le modèle. Si la même revalorisation rapide touche d'autres variantes « flash » ou petites, le marché est probablement en train de se diriger vers un plancher de prix fixé par celui qui a le calcul le moins cher et la meilleure distribution, et non par celui qui remporte un seul lancement phare.

Mon avis : La guerre des prix ressemble à une histoire de marge pour les laboratoires — et à une histoire de volume pour le calcul.

La partie qui décide cela n'est pas de savoir quel modèle est "le meilleur", mais si une inférence moins coûteuse élargit suffisamment la charge de travail pour maintenir l'augmentation des dépenses totales. La preuve tangible du paquet est étroite mais directionnellement cohérente : le Flash V4.1 de DeepSeek, classé No.

1 sur OpenRouter avec un pic d'utilisation hebdomadaire de 172 %, est ce à quoi ressemble la demande du paradoxe de Jevons dans la nature, même avant que les réductions phares de mardi n'entrent en jeu.

Le véritable test est de savoir si les pages de tarification post-lancement et les conditions d'entreprise confirment les réductions annoncées de 50 % et ~40 % et si la part du classement se maintient après l'arrivée des nouveaux modèles phares. Si ces deux éléments s'alignent, la configuration commence à sembler structurelle : les laboratoires mènent une guerre de marge tandis que la demande de calcul reste élevée en volume.

Sources