Close-up of a computer motherboard with
IA

OpenAI y Anthropic anuncian rebajas tras aumento de DeepSeek

GPT-6 Sol/Luna están programados para una reducción de costos del 50% y Opus 5.5 se ofrece a aproximadamente un 40% más barato, mientras que DeepSeek V4.1 Flash registró un aumento del 172% en el uso semanal.

Por Elliot Marsh6 min de lectura

Un nuevo ciclo de lanzamiento semanal está empujando a los modelos de IA insignia hacia abajo en la curva de costos, con OpenAI y Anthropic promocionando fuertes reducciones de precios en lugar de simplemente descontar niveles más antiguos. Los datos de uso inicial de OpenRouter, donde el V4.1 Flash de DeepSeek ocupa el No.

1 con un aumento del 172% "esta semana", son consistentes con una demanda en expansión gracias a precios más bajos por token, incluso mientras los laboratorios enfrentan presión sobre los márgenes.

Puntos Clave

  • OpenAI planeaba lanzar GPT-6.Soly GPT-6 Luna el martes con costos para los principales clientes comerciales reducidos en un 50% en comparación con iteraciones anteriores de los mismos modelos.
  • Anthropic también programó el martes para Opus 5.5, diciendo que cuesta alrededor de un 40% menos ejecutarlo que Opus 5 mientras mantiene “inteligencia de primer nivel.”
  • xAI lanzó Grok 4.7 el lunes y lo promocionó por su relación precio-rendimiento, pero los lanzamientos de la competencia redujeron gran parte de esa ventaja de precios en 24 horas.
  • El Flash V4.1 de DeepSeek ocupó el primer lugar en la tabla de clasificación de OpenRouter y registró un aumento del 172% en el uso "esta semana".

Modelos insignia se vuelven más baratos, rápido: GPT-6 Sol/Luna, Opus 5.5 y Grok 4.7

El ritmo de lanzamientos de IA de esta semana se está comercializando menos como una pura carrera de capacidades y más como una reescritura de la lista de precios. OpenAI planeó lanzar GPT-6 Sol y GPT-6 Luna el martes, reduciendo los costos para los principales clientes empresariales en un 50% en comparación con iteraciones anteriores de los mismos modelos.

Anthropic planeaba lanzar Opus 5.5 el mismo día y dijo que cuesta alrededor de un 40% menos operar que Opus 5 mientras mantiene una inteligencia superior. El hilo conductor es la compresión de costos explícita en el nuevo nivel 'flagship', no solo el patrón habitual de bajar precios en modelos más antiguos después de un nuevo lanzamiento.

El movimiento de xAI marcó el ritmo. xAI de Elon Musk lanzó Grok 4.7 el lunes, posicionando el modelo en torno a la relación precio-rendimiento, y la respuesta competitiva fue inmediata. En 24 horas, nuevas opciones habían reducido gran parte de la ventaja de precio de Grok 4.7, un recordatorio rápido de que el poder de fijación de precios en modelos de frontera puede evaporarse en un solo ciclo de noticias.

Costos por token, explicados: por qué las reducciones de precios pueden aumentar el gasto total en IA.

La unidad que importa en esta lucha es el token. Los costos por token son el precio que un proveedor cobra para procesar o generar una unidad de texto, y es la forma más sencilla de comparar los costos operativos entre modelos cuando todo lo demás está en movimiento.

Reducir los precios por token no significa automáticamente que el mercado gaste menos en IA. El mecanismo es sencillo: cuando un modelo se vuelve más barato de usar, los desarrolladores envían más funciones que antes eran demasiado caras, los usuarios realizan sesiones más largas y las empresas impulsan más flujos de trabajo a través del modelo en lugar de reservarlo para solicitudes de 'alto valor'.

Eso puede aumentar el volumen total de tokens lo suficiente como para mantener el gasto agregado en aumento incluso cuando el precio por token cae.

Esa dinámica es la intuición detrás de la paradoja de Jevons, la idea económica de que cuando un recurso se vuelve más barato de usar, el consumo total puede aumentar en lugar de disminuir. En este caso, el 'recurso' es la inferencia, y la apuesta es que los precios más bajos desbloquean suficiente nuevo uso para mantener el medidor de computación funcionando.

El marco de venta en el paquete se inclina hacia esa historia de volumen. Citadel Securities dijo a los clientes que la caída de los costos por token está alimentando un uso adicional y que el gasto total en IA está aumentando, lo que argumentó que apunta a mayores beneficios eventuales para los laboratorios de IA o empresas que proporcionan la potencia de computación detrás del uso de IA.

Morgan Stanley hizo un caso similar desde el lado de la demanda, enmarcando la competencia de los proveedores chinos comooptimistapara la IA porque el acceso más barato puede captar más clientes y aumentar la demanda general de computación.

Punto de prueba de adopción: DeepSeek V4.1 Flash supera a OpenRouter a medida que el uso salta un 172%.

El punto de datos más limpio en el paquete no es una puntuación de referencia. Es una tabla de clasificación y un aumento en el uso.

DeepSeek’s V4.1 Flash ocupó el primer lugar en la tabla de clasificación de OpenRouter y registró un aumento del 172% en el uso "esta semana". OpenRouter es un agregador que enruta solicitudes a través de múltiples modelos y publica clasificaciones que los traders y constructores utilizan como un proxy aproximado para el impulso de adopción.

DeepSeek también es el ejemplo que el paquete utiliza para definir la presión de peso abierto sobre los incumbentes. Un modelo de peso abierto es aquel donde los parámetros entrenados se ponen a disposición para que otros puedan ejecutarlo o ajustarlo, lo que a menudo permite un despliegue más barato o flexible que las ofertas completamente cerradas.

El paquete señala que DeepSeek dijo que V4.1 Flash supera su anterior buque insignia en una serie de referencias a través de actualizaciones técnicas que le permiten cobrar menos, aunque la suite de referencia y los resultados no se proporcionan aquí.

El punto más amplio es competitivo, no ideológico. Cuando los proveedores de peso abierto ascienden en clasificaciones ampliamente observadas mientras reducen precios, obligan a los laboratorios cerrados a responder en costos, y el lenguaje de precios del buque insignia de esta semana se lee como esa respuesta.

Lista de verificación de confirmación para traders: Uso a ingresos, pisos de precios y participación en la tabla de clasificación.

El primer punto de confirmación es si los recortes de precios son reales en el único lugar que importa: páginas de precios posteriores al lanzamiento y términos empresariales.

La reducción del 50% declarada por OpenAI para los principales clientes comerciales y el costo de ejecución ~40% más bajo de Anthropic para Opus 5.5 son cifras grandes, pero el paquete no incluye cifras absolutas de $/token ni el alcance exacto de qué clientes y niveles de uso califican.

El segundo es si las clasificaciones y tendencias de uso de OpenRouter mantienen a DeepSeek V4.1 Flash en el No. 1 o cerca de él durante las próximas una a dos semanas, o si la tabla de clasificación vuelve a revertirse después de que se lancen los buques insignia del martes. Un aumento de una semana puede ser novedad, incentivos o defaults de enrutamiento. La participación sostenida es una afirmación diferente.

El tercero es el puente de uso a ingresos. El paquete señala la presión sobre el margen en OpenAI y Anthropic a medida que la guerra de precios se acelera, y aún no se ha resuelto si los volúmenes de tokens más altos se traducen en un crecimiento sostenido de ingresos cuando los precios por token están comprimiéndose.

Finalmente, observa qué tan rápido se propaga el reajuste de precios. La ventaja de Grok 4.7 siendo competida en 24 horas es el modelo. Si el mismo reajuste rápido de precios afecta a más variantes "flash" o pequeñas, es probable que el mercado se esté moviendo hacia un piso de precios establecido por quien tenga la computación más barata y la mejor distribución, no por quien gane un solo lanzamiento de buque insignia.

Mi opinión: La guerra de precios parece ser una historia de márgenes para los laboratorios—y una historia de volumen para la computación.

La parte que decide esto no es si un modelo es "el mejor", sino si una inferencia más barata expande lo suficiente la carga de trabajo para mantener el gasto total en aumento. La evidencia dura del paquete es estrecha pero direccionalmente consistente: el V4.1 Flash de DeepSeek en el No.

1 en OpenRouter con un aumento del 172% en el uso semanal es lo que parece la demanda del paradoja de Jevons en la práctica, incluso antes de que lleguen los cortes insignia del martes.

La verdadera prueba es si las páginas de precios posteriores al lanzamiento y los términos empresariales confirman las reducciones del 50% y del ~40% declaradas y si la participación en el ranking se mantiene después de que lleguen los nuevos insignia. Si esas dos cosas se alinean, la configuración comienza a parecer estructural: los laboratorios luchan en una guerra de márgenes mientras la demanda de computación se mantiene elevada en volumen.

Fuentes