
OpenAI, 6 haftada 12 modelle GPT-6 Astra'yı tanıttı
Önbellek okuma kesintileri ve düz Flash fiyatlandırması, siber yetenekli katmanların kapalı programların arkasına geçmesiyle birlikte çıkarım maliyetlerini düşürüyor.
OpenAI, 3 Eylül 2026'da GPT-6 Astra'yı piyasaya sürdü ve kurucu ortağı Greg Brockman bunu "AGI çağı"nın başlangıcı olarak nitelendirdi. Bu sürüm, yaklaşık altı hafta içinde 12 öncü modelin piyasaya sürülmesiyle sonuçlanan bir sürecin sonunu işaret ediyor; bu patlama, hem çıkarım fiyatlandırmasını hem de en güvenlik açısından önemli yeteneklere kimin erişim sağladığını yeniden şekillendiriyor.
Ana Noktalar
- OpenAI, 3 Eylül 2026'da GPT-6 Astra'yı piyasaya sürdü ve Greg Brockman bunu "AGI çağının" başlangıcı olarak tanımladı.
- Astra, Hazırlık Çerçevesi'nde "kritik" seviyeye ulaşan ilk OpenAI modelidir ve dağıtımı öncelikle Daybreak kurumsal erişimi ile sınırlıdır ve tam erişim için yayımlanmış bir zaman çizelgesi yoktur.APIveya AWS Bedrock kullanılabilirliği.
- Anthropic, Claude Fable 5.1 önbellek okuma fiyatını %75 oranında düşürerek milyon token başına 0,25 $'a indirdi ve başlık fiyatını 10 $/50 $ olarak koruyarak tekrar eden bağlam üretim iş yükleri için ekonomik dengeleri değiştirdi.
- Google, Gemini Flash tanıtım fiyatını 31 Aralık 2026'ya kadar milyon token başına 0,75 $/3,75 $ olarak belirledi ve Gemini 3.8 Flash Cyber'ı Fairwind aracılığıyla hükümetler ve kritik altyapı operatörleriyle sınırladı.
GPT-6 Astra, altı hafta içinde 12. Sınır Lansmanı olarak geliyor.
GPT-6 Astra, 3 Eylül 2026'da piyasaya sürüldü ve OpenAI kurucu ortağı Greg Brockman bunu “AGI çağı”nın başlangıcı olarak nitelendirdi. OpenAI ayrıca Astra'yı “kuşak atlama” olarak tanımladı; bu dil genellikle hikayenin tamamını oluştururdu.
Tüccarlarla ilgili çerçeve, ritimdir. Astra, Anthropic, Google, SpaceXAI ve birçok Çin laboratuvarından ardışık lansmanların ardından yaklaşık altı hafta içinde 12. sınır modeli olarak piyasaya sürüldü. Yayın takvimi böyle görünüyorsa, tek model anlatıları, sprintin birim ekonomisi ve dağıtım üzerindeki etkisinden daha az önemli hale gelir.
Bu sprint, Moonshot AI'nin Kimi K3'ü (16 Temmuz) ve DeepSeek'in V4-Pro GA'sını (13 Ağustos) içeren açık ağırlık sürümlerini ve Google ile Z.ai'den hızlı takip eden "Flash" tarzı teklifleri içeriyordu. Bu bağlamda, sınır modeli, en üst düzey yetenek laboratuvarlarının en son teknolojiyi tanımlamak için kullandığı anlamına gelir ve bu pencere, fiyatlandırmayı ve erişimi gerçek bir savaş alanına dönüştürmek için yeterince model içeriyordu.
Benchmarklar Tavanın Yakınında, Ancak Erişim Gerçek Kısıtlama
OpenAI, birkaç kamu testinde etkili bir şekilde tavanı dokunan benchmark puanları yayınladı: FrontierMath Tier 4'te %98, ARC-AGI-3'te %99.9 ve ExploitBench'te %100. Sorun şu ki, bu rakamlar kaynak materyalde kendiliğinden raporlanmıştır ve yazım sırasında bağımsız olarak doğrulanmamıştır, bu da onları hem bir başlık hem de bir risk bayrağı haline getirir.
Astra'nın başlıca yeteneği "bilgisayar kullanımı"dır; bir bilgisayarı bir insan gibi kullanmak: elektronik tablolar doldurmak, web sitelerini gezmek ve ses istemlerinden uygulamalar oluşturmak olarak tanımlanır. Brockman, Astra'nın "bir insanın bilgisayarla yapabileceği her şeyi yapabileceğini" söyledi ve belirli görevlerde hızını "üstün insan" olarak nitelendirdi.
Mekanik olarak, bu özellik önemlidir çünkü modeli sadece bir metin üreticisi değil, bir operatör haline getirir; bu da güvenlik ve politika kısıtlamalarıyla çarpışma eğiliminde olan yetenek sınıfıdır.
OpenAI'nin kendi kapama mekanizması bunu açık hale getiriyor. Şirket, Astra'nın, potansiyel olarak tehlikeli yetenekleri değerlendirmek ve kısıtlamak için iç risk çerçevesi olan Hazırlık Çerçevesinde "kritik" katmanı tetikleyen ilk model olduğunu söyledi, özellikle siber güvenlikte.
Dağıtım, bu risk duruşunu takip eder: OpenAI'nin Daybreak programındaki kurumsal müşteriler önce erişim alır, ardından ChatGPT Plus, Pro, Business ve Enterprise kullanıcıları "önümüzdeki günlerde" erişim alır; tam API ve AWS Bedrock erişimi için ise yayımlanmış bir zaman çizelgesi yoktur.
Tüccarlar için, bu sıralama önemlidir. Yetenek başlıkları, geniş erişilebilirlikten önce basılabilir ve para kazanılabilir yüzey alanı API ve bulut kanallarıdır, dar bir kurumsal grup ile başlayan aşamalı bir dağıtım değil.
Sessiz Fiyat Savaşı: Önbellek Okuma Kesintileri ve Düz Flash Fiyatlandırması
Bu sprintteki en somut değişim bir benchmark farkı değildir. Öngörünün yeniden fiyatlandırılma şeklidir, özellikle önbelleğin faturayı domine ettiği tekrar bağlamlı iş yükleri için.
Anthropic'in 1 Eylül'deki Claude Fable 5.1 sürümü, başlık fiyatını milyon token başına 10$/50$ olarak korudu, ancak önbellek okuma fiyatını milyon token başına 1.00$'dan 0.25$'a %75 oranında düşürdü. Önbellek okuma fiyatı, daha önce işlenmiş bağlamın yeniden kullanılmasının indirimli ücretidir, bu nedenle tekrar eden sorgular tam girdi maliyetlerini yeniden ödemez.
Bu, aynı bağlamı sürekli olarak ileri taşıyan üretim sistemleri için en önemlisidir; örneğin, sohbet botları, kod asistanları ve RAG boru hatları gibi, burada geri alma artırılmış üretim belgeleri alır ve her dönüşte bunları modele geri besler.
Google'un hamlesi daha sessiz ama aynı derecede yönlendirici. Altı hafta içinde üç Gemini Flash sürümünde, Google, 31 Aralık 2026'ya kadar milyon token başına $0.75/$3.75'lik tanıtım fiyatını korudu: Gemini 3.6 Flash (21 Temmuz), Gemini 3.7 Flash (13 Ağustos) ve Gemini 3.8 Flash (2 Eylül).
Hızlı iterasyonlar boyunca fiyatı sabit tutmak, laboratuvarın piyasa dengeleme fiyatının nereye gittiğine dair bir beyan ve rakipleri faturalama mekanikleri ve ürün segmentasyonu üzerinde rekabet etmeye zorlamakta, sadece liste fiyatlarını artırmak yerine.
İşte burada 'çıkarım ekonomisi' hikayesi gerçek hale geliyor. Eğer önbellek okumaları ucuzlarsa ve hızlı modeller ucuz kalırsa, ajan döngülerini çalıştırmanın marjinal maliyeti düşer ve darboğaz erişim, uyum ve en yetenekli varyantları dağıtma iznine sahip olanlar yönüne kayar.
Siber Güvenlik Kapasiteli Varyantlar Kısıtlı Programların Arkasında Hareket Ediyor
2026'dan önce var olmayan bir model artık büyük laboratuvarlar arasında tutarlı: en siber güvenlik ile ilgili yetenekler kısıtlı katmanlara ayrılıyor, standart API erişimi olarak satılmıyor.
OpenAI'nin versiyonu Hazırlık kapama. Astra 'kritik' ve erişim, daha geniş ChatGPT katmanlarına genişlemeden önce Enterprise Daybreak ile başlıyor, API ve AWS Bedrock planlanmış ancak programlanmamış. Bu, tasarım gereği izinli bir dağıtım, pazarlama gecikmesi değil.
Anthropic'in versiyonu ürün bifurkasyonu. Claude Fable 5.1, halka açık modelken, Mythos 5.1 daha gevşek korumalarla aynı model olarak tanımlanıyor ve Project Glasswing aracılığıyla onaylı ABD organizasyonlarına kısıtlı. Mekanizma basit: yetenek sadece fiyatlandırılmıyor, izinli ve izin verme kimlik ve yargı yetkisine bağlı.
Google'un versiyonu programatik kısıtlama. Gemini 3.8 Flash Cyber, yalnızca Google'ın hükümetler ve kritik altyapı operatörleri için Fairwind Programı aracılığıyla sunulan bir siber güvenlik savunma varyantıdır. Temel Flash serisi düşük tanıtım fiyatıyla geniş ölçüde erişilebilirken, siber kapasiteli katman, daha çok tedarik gibi görünen bir kapının arkasında yer alıyor.
Öne çıkan şey, birleşim. Farklı laboratuvarlar farklı paketler kullanıyor, ancak aynı temel hareket gerçekleşiyor: 'siber', kontrol edilen bir dağıtım kanalı haline geliyor, ana SKU üzerinde bir onay kutusu özelliği değil.
Çin'in Açık Ağırlık Baskısı ve $0.50 Altı Çıktı Token Talepleri
Sprint'in fiyat baskısı hikayesi, açık veya neredeyse açık ağırlıklarla sınır ölçeğinde modeller gönderen Çin laboratuvarları tarafından belirleniyor. Açık ağırlık, eğitilmiş parametrelerin indirilebilir olduğu anlamına geliyor, böylece geliştiriciler modeli kendileri çalıştırıp ince ayar yapabiliyor, sadece barındırılan bir API aracılığıyla tüketmek yerine. Bu, alıcılar için dış seçeneği değiştiriyor, bu da fiyat keşfini zorlayan şey.
Moonshot AI’nin Kimi K3 (16 Temmuz), değiştirilmiş bir MIT lisansı altında 1M bağlam penceresine sahip 2.8T-parametreli açık ağırlık modeli olarak tanımlanıyor. DeepSeek’in V4-Pro GA (13 Ağustos) ise, 1M bağlam penceresi ve bir MIT lisansı ile birlikte, her sorguda 49B parametreyi etkinleştiren 1.6T-parametreli uzman karışımı modeli olarak tanımlanıyor.
Uzman karışımı burada önemlidir çünkü yalnızca ağın bir kısmını etkinleştirerek talep başına hesaplamayı azaltır, bu da bu modellerin ucuz bir şekilde sunulabilmesinin bir nedenidir.
Kaynak materyali ayrıca, Çin açık ağırlık sınır modellerinin API fiyatlarını milyon çıktı tokeni başına 0.50 $’ın altına ittiğini, bu durumun Batılı laboratuvarların fiyatlandırması üzerinde sürdürülebilir aşağı yönlü baskı yarattığını iddia ediyor. Örnekler yönsel olarak tutarlı ancak sayılarda tam olarak temiz değil.
Z.ai’nin GLM-5.3-Flash (26 Ağustos) aynı kaynakta çelişkili fiyatlandırma ile listeleniyor: bir tabloda milyon token başına 0.15 $/0.50 $ gösterilirken, sonraki metin tanıtım fiyatını 0.075 $/0.25 $ olarak adlandırıyor. DeepSeek’in Flash katmanı, milyon girdi tokeni başına 0.14 $ olarak belirtiliyor, ancak çıktı-token fiyatlandırması alıntıda belirtilmemiş.
Alibaba’nın Qwen 3.8-Max, diğer kaldıraç olan: daha düşük fiyat noktalarında rekabetçi performansı ekliyor. Qwen 3.8-Max, 3 Ağustos’ta 1 milyon token başına 2 $/6 $ fiyatlandırmasıyla piyasaya sürüldü ve 2 Eylül’de güncellenmiş bir Qwen 3.8-Max-0902 anlık görüntüsünün, bu değerlendirmede Claude Opus 5 Max’ın 3 puan üzerinde 1,691 puanla Code Arena WebDev’i geride bıraktığı söyleniyor.
Dahili tutarsızlıklara rağmen, mekanizma tutarlı. Açık ağırlıklar ve ucuz barındırılan katmanlar bir referans fiyatı belirliyor ve Batılı laboratuvarlar, gerçek iş yüklerini domine eden fatura parçalarını, örneğin önbellek okumaları gibi, keserek yanıt veriyor, en hassas yetenekleri ise doğrulama programlarının arkasında segmentlere ayırıyor.
AI sınır modeli sprintinde fiyatları sıkıştırmak için İzlenecek İşaretler
İlk işaret, OpenAI’nin tam GPT-6 Astra API erişimi ve AWS Bedrock kullanılabilirliği için kesin bir zaman çizelgesi yayınlayıp yayınlamadığıdır. Tarihler olmadan, "planlanan" dağıtım, pazarın modelleyebileceği bir şey değildir ve yetenek başlıkları ile paraya dönüştürülebilir erişim arasındaki boşluğu geniş tutar.
İkincisi, diğer laboratuvarların yalnızca başlık girdi ve çıktı token fiyatlarını kesmekle kalmayıp, önbellek okuma fiyatlarını da kesip kesmeyeceğidir. Öncelikle önbellek okuma, tekrar bağlam sistemlerinin ödeme yaptığı yerdir ve burada geniş bir hareket, rekabetçi sınırın liste fiyatlarından faturalama ilkelerine kaydığını doğrulayacaktır.
Üçüncüsü, kısıtlı siber programlarda kapsam genişlemesidir. Eğer Daybreak uygunluğu genişlerse, Project Glasswing, onaylanmış ABD organizasyonlarının ötesine geçerse veya Google’ın Fairwind kriterleri hükümetler ve kritik altyapı operatörlerinin ötesine genişlerse, bu izin eğrisini düzleştirir. Eğer bu kapılar daralırsa, en güvenlik açısından önemli yeteneklerin yapısal olarak kıt olduğu iki katmanlı bir pazarı resmileştirir.
Son işaret, özellikle GLM-5.3-Flash gibi iç tutarsızlıklar içeren paketlerde Çin laboratuvarı fiyatlandırma açıklamaları hakkında netliktir. Eğer milyon çıktı tokeni başına 0.50 $’ın altındaki iddia anlatıyı destekleyecekse, pazarın temiz, karşılaştırılabilir fiyatlandırma terimlerine ihtiyacı olacaktır.
Benim Okumam: Tüccarlar Maliyet Eğrisini ve İzin Eğrisini Ayrı Takip Etmelidir
Bu altı haftalık sprinti, zıt yönlere hareket eden iki eğri olarak okudum. Maliyet eğrisi hızla sıkışıyor ve en temiz kanıt mekanik: Anthropic'in önbellek okuma fiyatını milyon token başına 1,00 $'dan 0,25 $'a düşürmesi, başlık fiyatlandırmasını ise 10 $/50 $'da bırakması ve Google'ın 31 Aralık 2026'ya kadar üç sürüm boyunca 0,75 $/3,75 $ Flash fiyatlandırmasını koruması. Bunlar pazarlama iddiaları değil. Bunlar faturalama terimleri ve faturalama terimleri, üretim benimsemesinin ya gerçekleştiği ya da durakladığı yerdir.
İzin eğrisi aynı zamanda daralıyor. OpenAI, Astra'yı Hazırlık Çerçevesi altında "kritik" olarak etiketliyor ve dağıtımı Daybreak aracılığıyla kısıtlıyor, Anthropic, Mythos 5.1'i Project Glasswing ile sınırlıyor ve Google, Flash Cyber'ı Fairwind'in arkasına alıyor; bunların hepsi aynı sonuca işaret ediyor: En güvenlik açısından önemli yetenekler, bir mal API'si değil, kontrol edilen altyapı gibi ele alınıyor.
Bu, bir rakip benzer bir yetenek sunana kadar işe yarıyor, işte burada Çin'den gelen açık ağırlık baskısı zorlayıcı bir faktör haline geliyor.
Önemli olan eşik, Astra'nın belirli bir zaman diliminde tam API dağıtımı ve bulut kanalları aracılığıyla geniş ölçüde erişilebilir hale gelip gelmeyeceği veya “kritik” durumunun kıtlık için kalıcı bir mazeret olup olmayacağıdır. Eğer OpenAI tarihler yayınlarsa ve Astra AWS Bedrock'a zamanında ulaşırsa, “AGI dönemi” çerçevesi gerçek bir dağıtım olayına dönüşmeye başlar.
Eğer zaman çizelgeleri belirsiz kalırken laboratuvarlar arasındaki siber yetenekli katmanlar onay programlarının arkasında kilitli kalırsa, o zaman sprintin gerçek piyasa etkisi yetenek değil, ucuz çıkarımın bol olduğu ancak üst düzey izinlerin kıt olduğu iki yönlü bir tedarik zinciridir.varlık.
Bu, bir sonraki çeyreğin hem daha geniş Astra dağıtımı hem de endüstri genelinde önbellek okuma kesintileri getirmesi durumunda pratik anlamda önemlidir, çünkü bu, temel tezi doğrulayacaktır: sınır, işletme maliyetleri açısından daha ucuz hale gelirken erişimi daha zor hale geliyor.