
OpenAI ve Anthropic, DeepSeek kullanımında indirim yapıyor
GPT-6 Sol/Luna'nın maliyetinin %50 oranında düşürülmesi planlanırken, Opus 5.5 yaklaşık %40 daha ucuz olarak sunuluyor. Öte yandan, DeepSeek V4.1 Flash, haftalık kullanımda %172'lik bir artış kaydetti.
Yeni bir haftalık yayın döngüsü, OpenAI ve Anthropic'in sadece eski katmanları indirimli hale getirmek yerine keskin fiyat indirimleri pazarladığı, amiral gemisi AI modellerini maliyet eğrisinin aşağısına itiyor.
DeepSeek’in V4.1 Flash'ının bu hafta %172'lik bir artışla 1 numarada yer aldığı OpenRouter'dan gelen erken kullanım verileri, laboratuvarlar marj baskısıyla karşılaşırken, daha ucuz token başına fiyatlandırmanın talebi genişlettiğiyle tutarlıdır.
Ana Noktalar
- OpenAI, GPT-6'yı piyasaya sürmeyi planlıyordu.SolSalı günü, en iyi iş müşterileri için maliyetlerin önceki versiyonlarına göre %50 oranında azaltıldığı GPT-6 Luna tanıtıldı.
- Anthropic, Opus 5.5 için Salı gününü hedeflediğini belirtti ve bunun, "üst düzey zeka"yı korurken Opus 5'ten yaklaşık %40 daha düşük maliyetle çalıştığını söyledi.
- xAI, Grok 4.7'yi Pazartesi günü piyasaya sürdü ve fiyat-performans ile tanıttı, ancak rakip lansmanlar bu fiyat avantajının çoğunu 24 saat içinde daralttı.
- DeepSeek’in V4.1 Flash’ı OpenRouter’ın liderlik tablosunda birinci sırada yer aldı ve “bu hafta” kullanımda %172’lik bir artış kaydetti.
Amiral Gemisi Modelleri Hızla Ucuzluyor: GPT-6 Sol/Luna, Opus 5.5 ve Grok 4.7
Bu haftaki AI sürüm hızı, saf bir yetenek yarışı gibi değil, daha çok bir fiyat listesi yeniden yazımı gibi pazarlanıyor. OpenAI, Salı günü GPT-6 Sol ve GPT-6 Luna'yı piyasaya sürmeyi planladı ve aynı modellerin önceki sürümlerine göre en büyük iş müşterileri için maliyetleri %50 oranında düşürdü.
Anthropic, Opus 5.5'i aynı gün piyasaya sürmeyi planladı ve bunun, en yüksek zekayı korurken Opus 5'ten yaklaşık %40 daha az maliyetle çalıştığını söyledi. Ortak nokta, yalnızca yeni bir lansmandan sonra eski modellerin fiyatlarını düşürme alışkanlığı değil, en yeni "bayrak gemisi" seviyesinde açık maliyet sıkıştırmasıdır.
xAI'nin hamlesi tempoyu belirledi. Elon Musk'ın xAI'si, fiyat-performans etrafında konumlandırdığı Grok 4.7'yi Pazartesi günü piyasaya sürdü ve rekabetçi yanıt hemen geldi. 24 saat içinde, yeni seçenekler Grok 4.7'nin fiyat avantajını büyük ölçüde azalttı; bu, sınır modellerindeki fiyat gücünün tek bir haber döngüsünde buharlaşabileceğinin hızlı bir hatırlatıcısıydı.
Token Başına Maliyetler, Açıklandı: Neden Fiyat Kesintileri Toplam AI Harcamasını Artırabilir
Bu savaşta önemli olan birim, token'dır. Token başına maliyetler, bir sağlayıcının bir metin birimini işlemek veya üretmek için talep ettiği fiyattır ve her şeyin hareket ettiği durumlarda modeller arasında işletme maliyetlerini karşılaştırmanın en basit yoludur.
Token başına fiyatların düşürülmesi, otomatik olarak pazarın AI'ya daha az harcama yapacağı anlamına gelmez. Mekanizma basittir: bir model çağırmak daha ucuz hale geldiğinde, geliştiriciler daha önce çok pahalı olan daha fazla özellik sunar, kullanıcılar daha uzun oturumlar gerçekleştirir ve şirketler, "yüksek değerli" istemler için ayırmak yerine modeli daha fazla iş akışı için kullanır. Bu, toplam token hacmini artırabilir ve token başına fiyat düşse bile toplam harcamanın artmasını sağlayabilir.
Bu dinamik, Jevons paradoksunun arkasındaki sezgidir; bir kaynağın kullanımı daha ucuz hale geldiğinde, toplam tüketimin artabileceği ekonomik bir fikirdir. Bu durumda, "kaynak" çıkarım ve bahis, daha düşük fiyatların yeterince yeni kullanım açacağını ve hesaplama ölçümünü çalışır durumda tutacağını öngörmektedir.
Paket içindeki satış tarafı çerçevesi, bu hacim hikayesine dayanıyor. Citadel Securities, düşen token başına maliyetlerin ek kullanımı artırdığını ve toplam AI harcamasının arttığını belirtti; bu, AI laboratuvarları veya AI kullanımının arkasındaki hesaplama gücünü sağlayan şirketler için nihai kârların artacağına işaret ettiğini savundu.
Morgan Stanley, Çinli sağlayıcılardan gelen rekabeti benzer bir talep tarafı durumu olarak çerçeveleyerek, "iyimser"AI için çünkü daha ucuz erişim daha fazla müşteri çekebilir ve hesaplama talebini artırabilir.
Benimseme Kanıtı: DeepSeek V4.1 Flash, Kullanımın %172 Artmasıyla OpenRouter'ı Geride Bıraktı
Paketteki en temiz veri noktası bir benchmark skoru değildir. Bu, bir liderlik tablosu ve bir kullanım artışıdır.
DeepSeek’in V4.1 Flash’ı OpenRouter’ın liderlik tablosunda 1. sırada yer aldı ve bu hafta %172’lik bir kullanım artışı kaydetti. OpenRouter, talepleri birden fazla model arasında yönlendiren ve tüccarların ve geliştiricilerin benimseme ivmesi için kaba bir proxy olarak kullandığı sıralamaları yayınlayan bir toplayıcıdır.
DeepSeek, paketin mevcut oyuncular üzerindeki açık ağırlık baskısını tanımlamak için kullandığı örnektir. Açık ağırlık modeli, eğitilmiş parametrelerin başkalarının çalıştırmasına veya ince ayar yapmasına olanak tanıdığı bir modeldir; bu genellikle tamamen kapalı tekliflerden daha ucuz veya daha esnek dağıtım sağlar.
Paket, DeepSeek’in V4.1 Flash’ın, daha az ücret talep etmesine olanak tanıyan teknik güncellemeler aracılığıyla önceki amiral gemisini birçok benchmarkta geride bıraktığını belirtmektedir, ancak burada benchmark seti ve sonuçları sağlanmamıştır.
Daha geniş nokta rekabetçidir, ideolojik değil. Açık ağırlık sağlayıcıları, fiyatları düşürürken geniş çapta izlenen sıralamalarda yükseldiğinde, kapalı laboratuvarları maliyet konusunda yanıt vermeye zorlarlar ve bu haftanın amiral gemisi fiyatlandırma dili bu yanıt gibi okunmaktadır.
Tüccarlar için Onay Kontrol Listesi: Kullanımdan Gelire, Fiyat Tabanlarına ve Liderlik Tablosu Payına
İlk onay noktası, fiyat indirimlerinin yalnızca önemli olan yerde, yani satış sonrası fiyatlandırma sayfalarında ve kurumsal şartlarda gerçek olup olmadığıdır. OpenAI’nin en büyük iş müşterileri için belirttiği %50’lik indirim ve Anthropic’in Opus 5.5 için ~%40 daha düşük çalışma maliyeti büyük rakamlardır, ancak paket, mutlak $/token rakamlarını veya hangi müşterilerin ve kullanım katmanlarının uygun olduğunu tam olarak içermemektedir.
İkincisi, OpenRouter’ın sıralamaları ve kullanım eğilimlerinin önümüzdeki bir ila iki hafta boyunca DeepSeek V4.1 Flash’ı 1. sırada veya yakınında tutup tutmayacağıdır, yoksa liderlik tablosu Salı günü amiral gemisi sürümleri geldikten sonra geri mi dönecek. Bir haftalık bir artış yenilik, teşvikler veya yönlendirme varsayımları olabilir. Sürekli pay, farklı bir iddiadır.
Üçüncüsü, kullanım-gelir köprüsüdür. Paket, fiyat savaşı hızlandıkça OpenAI ve Anthropic üzerindeki marj baskısını işaret ediyor ve daha yüksek token hacimlerinin, token başına fiyatlama sıkışırken sürdürülebilir gelir büyümesine dönüşüp dönüşmeyeceği hala çözülmemiştir.
Son olarak, yeniden fiyatlandırmanın ne kadar hızlı yayıldığını izleyin. Grok 4.7’nin avantajının 24 saat içinde rekabet edilerek kaybolması bir şablondur. Aynı hızlı yeniden fiyatlandırma daha fazla “flash” veya küçük varyantlara ulaşırsa, piyasa, en ucuz hesaplama ve en iyi dağıtım yapanın belirlediği bir fiyat tabanına doğru hareket ediyor olabilir, tek bir amiral gemisi lansmanını kazanan değil.
Benim Görüşüm: Fiyat Savaşı, Laboratuvarlar için Bir Marj Hikayesi ve Hesaplama için Bir Hacim Hikayesi Gibi Görünüyor.
Bunu belirleyen kısım, bir modelin "en iyi" olup olmadığı değil, daha ucuz çıkarımın toplam harcamayı artıracak kadar iş yükünü genişletip genişletmediğidir. Paketin somut kanıtları dar ama yönsel olarak tutarlıdır: DeepSeek’in V4.1 Flash’ı, OpenRouter'da %172'lik haftalık kullanım artışıyla 1. sırada yer alıyor; bu, Jevons paradoksu talebinin gerçek hayatta nasıl göründüğüdür, Salı günü amiral gemisi kesintileri gelmeden önce bile.
Gerçek test, lansman sonrası fiyat sayfalarının ve kurumsal şartların belirtilen %50 ve ~%40 indirimlerini doğrulayıp doğrulamadığı ve yeni amiral gemileri geldiğinde liderlik payının korunup korunmadığıdır. Eğer bu iki şey uyumlu olursa, kurulum yapısal görünmeye başlar: laboratuvarlar marj savaşı verirken, hesaplama talebi hacim üzerinde yüksek kalır.