
OpenAI از GPT-6 Astra رونمایی کرد؛ جهش ۱۲ مدلی در ۶ هفته
کاهش هزینههای خواندن کش و قیمتگذاری ثابت فلش هزینههای استنتاج را کاهش میدهد در حالی که سطوح دارای قابلیت سایبری به برنامههای محدود منتقل میشوند.
OpenAI در تاریخ ۳ سپتامبر ۲۰۲۶، GPT-6 Astra را راهاندازی کرد و همبنیانگذار آن، گرگ براکمن، آن را آغاز «عصر AGI» نامید. این انتشار به عنوان ۱۲ مدل پیشرفته در حدود شش هفته توصیف شد که اکنون در حال تغییر قیمتگذاری استنتاج و اینکه چه کسی به قابلیتهای مرتبط با امنیت بیشتر دسترسی دارد، میباشد.
نکات کلیدی
- OpenAI در تاریخ ۳ سپتامبر ۲۰۲۶، GPT-6 Astra را عرضه کرد و گرگ براکمن آن را آغاز «عصر AGI» توصیف کرد.
- Astra اولین مدل OpenAI است که به سطح «بحرانی» در چارچوب آمادگی دست یافته و راهاندازی آن با دسترسی اولیه به Daybreak محدود شده و زمانبندی کامل آن منتشر نشده است.APIیا در دسترس بودن AWS Bedrock.
- Anthropic قیمت خواندن کش Claude Fable 5.1 را ۷۵٪ کاهش داد و به $0.25 به ازای هر میلیون توکن رساند در حالی که قیمتهای اصلی را در $10/$50 حفظ کرد و اقتصاد تولید بارهای کاری با زمینه تکراری را تغییر داد.
- گوگل قیمتگذاری ابتدایی Gemini Flash را در $0.75/$3.75 به ازای هر میلیون توکن تا ۳۱ دسامبر ۲۰۲۶ حفظ کرد و در عین حال Gemini 3.8 Flash Cyber را به دولتها و اپراتورهای زیرساختهای حیاتی از طریق Fairwind محدود کرد.
GPT-6 Astra به عنوان دوازدهمین راهاندازی پیشرفته در شش هفته به زمین نشست.
GPT-6 Astra در تاریخ ۳ سپتامبر ۲۰۲۶ عرضه شد و گرگ براکمن، همبنیانگذار OpenAI، آن را آغاز «عصر AGI» نامید. OpenAI همچنین Astra را به عنوان یک «پرش نسلی» توصیف کرد، زبانی که معمولاً تمام داستان را تشکیل میدهد.
چارچوب مرتبط با معاملهگران، ریتم است. آسترا به عنوان دوازدهمین مدل مرزی در حدود شش هفته منتشر شد، پس از راهاندازیهای متوالی از آنتروپیک، گوگل، اسپیسایکسای و چندین آزمایشگاه چینی. وقتی برنامه انتشار به این شکل باشد، روایتهای تکمدل کمتر از آنچه که این دویدن به اقتصاد واحد و توزیع میکند، اهمیت پیدا میکند.
این دویدن شامل انتشارهای وزن آزاد مانند Kimi K3 از Moonshot AI (16 ژوئیه) و V4-Pro GA از DeepSeek (13 اوت) بود، به علاوه پیشنهادات سریعدنبالکننده از نوع "فلش" از گوگل و Z.ai. مدل مرزی، در این زمینه، به بالاترین سطح قابلیتهایی اشاره دارد که آزمایشگاهها برای تعریف وضعیت هنر استفاده میکنند و این پنجره به اندازه کافی از آنها داشت تا قیمتگذاری و دسترسی را به میدان واقعی نبرد تبدیل کند.
معیارها نزدیک به سقف، اما دسترسی محدودیت واقعی است
OpenAI نمرات معیارهایی را منتشر کرد که به طور مؤثری به سقف نزدیک هستند در چندین آزمون عمومی: 98% در FrontierMath Tier 4، 99.9% در ARC-AGI-3، و 100% در ExploitBench. نکته این است که این اعداد در مواد منبع خودگزارششدهاند و در زمان نگارش به طور مستقل تأیید نشدهاند، که آنها را هم به عنوان یک تیتر و هم به عنوان یک پرچم خطر تبدیل میکند.
قابلیت اصلی آسترا "استفاده از کامپیوتر" است که به عنوان ناوبری یک کامپیوتر مانند یک انسان توصیف میشود: پر کردن صفحات گسترده، مرور وبسایتها و ساخت برنامهها از دستورات صوتی. بروکمن گفت آسترا میتواند "هر چیزی را که یک انسان میتواند با یک کامپیوتر انجام دهد" انجام دهد و سرعت آن را در برخی وظایف "فوق بشری" نامید.
از نظر مکانیکی، این ویژگی مهم است زیرا مدل را به یک اپراتور تبدیل میکند، نه فقط یک تولیدکننده متن، که دقیقاً همان کلاس قابلیت است که معمولاً با محدودیتهای امنیتی و سیاستی برخورد میکند.
گیتگذاری خود OpenAI این را به وضوح بیان میکند. این شرکت گفت آسترا اولین مدلی است که "سطح بحرانی" را در چارچوب آمادگی خود، چارچوب داخلی ارزیابی و محدود کردن قابلیتهای بالقوه خطرناک، به ویژه در امنیت سایبری، فعال میکند.
توزیع پس از آن موضع ریسک را دنبال میکند: مشتریان شرکتی در برنامه Daybreak OpenAI ابتدا دسترسی پیدا میکنند، سپس کاربران ChatGPT Plus، Pro، Business و Enterprise "در روزهای آینده"، در حالی که دسترسی کامل به API و AWS Bedrock بدون زمانبندی منتشر شده برنامهریزی شده است.
برای معاملهگران، این توالی نقطه است. تیترهای قابلیت میتوانند قبل از دسترسی گسترده چاپ شوند و سطح قابل درآمدزایی API و کانالهای ابری است، نه یک راهاندازی مرحلهای که با یک گروه محدود شرکتی آغاز میشود.
جنگ قیمت خاموش: کاهشهای خواندن کش و قیمتگذاری ثابت فلش
بارزترین تغییر در این دویدن، دلتا معیار نیست. این نحوه قیمتگذاری استنتاج است، به ویژه برای بارهای کاری با زمینه تکراری که در آن کش هزینه را غالب میکند.
انتشار Claude Fable 5.1 از آنتروپیک در 1 سپتامبر قیمت تیتر را در 10 دلار/50 دلار به ازای هر میلیون توکن حفظ کرد، اما قیمت خواندن کش را 75% از 1.00 دلار به 0.25 دلار به ازای هر میلیون توکن کاهش داد. قیمت خواندن کش هزینه تخفیفخورده برای استفاده مجدد از زمینه پردازششده قبلی است، بنابراین پرسشهای تکراری هزینههای ورودی کامل را دوباره پرداخت نمیکنند.
این موضوع بیشتر برای سیستمهای تولیدی که زمینه یکسانی را به جلو میکشند، مانند چتباتها، دستیاران کد و خطوط لوله RAG، که در آن تولید تقویتشده با بازیابی اسناد را میگیرد و آنها را در هر نوبت به مدل بازمیگرداند، اهمیت دارد.
حرکت گوگل آرامتر اما به همان اندازه هدفمند است. در سه نسخه Gemini Flash در شش هفته، گوگل قیمتهای ابتدایی را در ۰.۷۵ دلار/۳.۷۵ دلار به ازای هر میلیون توکن تا ۳۱ دسامبر ۲۰۲۶ حفظ کرد: Gemini 3.6 Flash (۲۱ ژوئیه)، Gemini 3.7 Flash (۱۳ اوت) و Gemini 3.8 Flash (۲ سپتامبر).
حفظ قیمت ثابت در طول تکرار سریع، بیانیهای درباره جایی است که آزمایشگاه فکر میکند قیمت بازار به کجا میرود و این فشار به رقبا وارد میکند تا بر روی مکانیکهای صورتحساب و تقسیمبندی محصول رقابت کنند نه فقط افزایش قیمتهای لیست.
اینجاست که داستان «اقتصاد استنتاج» واقعی میشود. اگر خواندن کش ارزانتر شود و مدلهای سریع ارزان بمانند، هزینه حاشیهای اجرای حلقههای عامل کاهش مییابد و گلوگاه به سمت دسترسی، انطباق و اینکه چه کسی مجاز به استقرار متغیرهای توانمندتر است، تغییر میکند.
متغیرهای دارای قابلیت امنیت سایبری به برنامههای محدود منتقل میشوند.
الگوی که قبل از ۲۰۲۶ وجود نداشت، اکنون در تمام آزمایشگاههای بزرگ ثابت است: قابلیتهای مرتبط با امنیت سایبری به سطوح محدود تقسیم میشوند به جای اینکه به عنوان دسترسی استاندارد API فروخته شوند.
نسخه OpenAI آمادهسازی گیتینگ است. Astra «بحرانی» است و دسترسی با Enterprise Daybreak آغاز میشود قبل از اینکه به سطوح وسیعتری از ChatGPT گسترش یابد، با API و AWS Bedrock که برنامهریزی شده اما زمانبندی نشده است. این یک راهاندازی مجوزی به صورت طراحی شده است، نه تأخیر در بازاریابی.
نسخه Anthropic دوپارهسازی محصول است. Claude Fable 5.1 مدل عمومی است، در حالی که Mythos 5.1 به عنوان همان مدل با حفاظهای شلتر توصیف میشود و فقط به سازمانهای تأیید شده ایالات متحده از طریق پروژه Glasswing محدود است. مکانیزم ساده است: قابلیت فقط قیمتگذاری نمیشود، بلکه مجوزی است و مجوزدهی به هویت و حوزه قضایی مرتبط است.
نسخه گوگل محدودیت برنامهنویسی است. Gemini 3.8 Flash Cyber یک متغیر دفاع سایبری است که فقط از طریق برنامه Fairwind گوگل برای دولتها و اپراتورهای زیرساختهای حیاتی در دسترس است. خط پایه Flash به طور گستردهای با قیمتهای ابتدایی پایین در دسترس میماند، در حالی که سطح دارای قابلیت سایبری پشت دروازهای قرار دارد که بیشتر شبیه تأمین مالی است تا API خود-خدمت.
چیزی که برجسته است همگرایی است. آزمایشگاههای مختلف از بستهبندیهای مختلف استفاده میکنند، اما همان حرکت زیرین در حال وقوع است: «سایبر» در حال تبدیل شدن به یک کانال توزیع کنترلشده است، نه یک ویژگی چکباکس در SKU پرچمدار.
فشار وزن باز چین و ادعاهای توکن خروجی زیر ۰.۵۰ دلار
داستان فشار قیمت اسپرینت توسط آزمایشگاههای چینی که مدلهای مقیاس مرزی با وزنهای باز یا نزدیک به باز را ارسال میکنند، تنظیم میشود. وزن باز به این معنی است که پارامترهای آموزشدیده برای دانلود در دسترس هستند، بنابراین توسعهدهندگان میتوانند مدل را خودشان اجرا و تنظیم کنند به جای اینکه فقط از طریق یک API میزبانی شده از آن استفاده کنند. این گزینه خارجی خریداران را تغییر میدهد، که همان چیزی است که کشف قیمت را مجبور میکند.
مدل Kimi K3 از Moonshot AI (16 ژوئیه) به عنوان یک مدل با 2.8 تریلیون پارامتر و وزن باز با یک پنجره متنی 1 میلیون تحت مجوز MIT اصلاح شده توصیف شده است. مدل V4-Pro GA از DeepSeek (13 اوت) به عنوان یک مدل ترکیبی از کارشناسان با 1.6 تریلیون پارامتر توصیف شده که 49 میلیارد پارامتر را به ازای هر درخواست فعال میکند، همچنین با یک پنجره متنی 1 میلیون و مجوز MIT.
ترکیب کارشناسان در اینجا مهم است زیرا با فعال کردن تنها بخشی از شبکه، محاسبات را در هر درخواست کاهش میدهد، که یکی از دلایل این است که این مدلها میتوانند به طور ارزان ارائه شوند.
منبع همچنین ادعا میکند که مدلهای مرزی وزن باز چینی قیمتهای API را به زیر 0.50 دلار به ازای هر میلیون توکن خروجی کاهش دادهاند و فشار نزولی مداومی بر قیمتگذاری آزمایشگاههای غربی ایجاد کردهاند. مثالها از نظر جهتگیری سازگار هستند اما از نظر عددی کاملاً تمیز نیستند.
مدل GLM-5.3-Flash از Z.ai (26 اوت) با قیمتگذاری متناقض در همان منبع فهرست شده است: جدولی قیمتهای 0.15/0.50 دلار به ازای هر میلیون توکن را نشان میدهد، در حالی که متن بعدی قیمتگذاری مقدماتی را 0.075/0.25 دلار مینامد. سطح Flash از DeepSeek با قیمت 0.14 دلار به ازای هر میلیون توکن ورودی ذکر شده است، اما قیمتگذاری توکن خروجی در این بخش مشخص نشده است.
مدل Qwen 3.8-Max از Alibaba اهرم دیگری را اضافه میکند: عملکرد رقابتی در قیمتهای پایینتر. Qwen 3.8-Max در 3 اوت با قیمتگذاری 2/6 دلار به ازای هر میلیون توکن راهاندازی شد و یک تصویر بهروز شده از Qwen 3.8-Max-0902 در 2 سپتامبر گفته میشود که با 1691 امتیاز از Code Arena WebDev پیشی گرفته است، سه امتیاز بالاتر از Claude Opus 5 Max در آن ارزیابی.
حتی با ناهماهنگیهای داخلی، مکانیزم منطقی است. وزنهای باز به همراه سطوح میزبانی ارزان یک قیمت مرجع تعیین میکنند و آزمایشگاههای غربی با کاهش بخشهای صورتحساب که بر بارهای واقعی تسلط دارند، مانند خواندن کش، واکنش نشان میدهند، در حالی که قابلیتهای حساسترین را در پشت برنامههای تأیید تقسیم میکنند.
سیگنالهایی برای نظارت بر فشردگی قیمت مدلهای مرزی AI
اولین سیگنال این است که آیا OpenAI یک جدول زمانی قطعی برای دسترسی کامل به API GPT-6 Astra و در دسترس بودن AWS Bedrock منتشر میکند یا خیر. بدون تاریخ، توزیع "برنامهریزی شده" چیزی نیست که بازار بتواند مدلسازی کند و فاصله بین عناوین قابلیت و دسترسی قابل درآمدزایی را وسیع نگه میدارد.
دومین سیگنال این است که آیا آزمایشگاههای دیگر با کاهش قیمتهای خواندن کش به دنبال Anthropic میروند یا فقط قیمتهای توکن ورودی و خروجی را کاهش میدهند. خواندن کش جایی است که سیستمهای تکرار-متن هزینه میکنند و یک حرکت گسترده در آنجا تأیید میکند که مرز رقابتی از قیمتهای فهرست به اصول صورتحساب منتقل میشود.
سومین سیگنال، گسترش دامنه در برنامههای سایبری محدود شده است. اگر واجد شرایطی Daybreak گسترش یابد، اگر پروژه Glasswing فراتر از سازمانهای معتبر ایالات متحده گسترش یابد، یا اگر معیارهای Fairwind گوگل فراتر از دولتها و اپراتورهای زیرساختهای حیاتی گسترش یابد، این امر منحنی مجوز را صاف میکند. اگر این دروازهها تنگ شوند، این امر یک بازار دو سطحی را رسمی میکند که در آن قابلیتهای مرتبط با امنیت بیشتر به طور ساختاری نادر هستند.
آخرین سیگنال، شفافسازی در مورد افشای قیمتهای آزمایشگاههای چینی است، به ویژه جایی که بسته شامل ناهماهنگیهای داخلی مانند GLM-5.3-Flash است. اگر ادعای کمتر از 0.50 دلار به ازای هر میلیون توکن خروجی بخواهد روایت را تثبیت کند، بازار به شرایط قیمتگذاری تمیز و قابل مقایسه نیاز خواهد داشت.
خوانش من: معاملهگران باید منحنی هزینه و منحنی مجوز را به طور جداگانه پیگیری کنند.
من این شش هفته دویدن را به عنوان دو منحنی که در جهتهای مخالف حرکت میکنند، میخوانم. منحنی هزینه به سرعت فشرده میشود و واضحترین شواهد مکانیکی است: آنتروپیک هزینه خواندن کش را از ۱.۰۰ دلار به ۰.۲۵ دلار به ازای هر میلیون توکن کاهش میدهد در حالی که قیمتهای اصلی را در ۱۰/۵۰ دلار نگه میدارد و گوگل قیمت فلش ۰.۷۵/۳.۷۵ دلار را از طریق سه انتشار تا ۳۱ دسامبر ۲۰۲۶ حفظ میکند. اینها ادعاهای بازاریابی نیستند. اینها شرایط صورتحساب هستند و شرایط صورتحساب جایی است که پذیرش تولید یا اتفاق میافتد یا متوقف میشود.
منحنی مجوز همزمان در حال تنگ شدن است. OpenAI آسترا را تحت چارچوب آمادگی خود به عنوان "بحرانی" برچسبگذاری میکند و توزیع را از طریق Daybreak محدود میکند، آنتروپیک Mythos 5.1 را از طریق پروژه Glasswing محدود میکند و گوگل فلش سایبر را پشت Fairwind قرار میدهد که همه به یک نتیجه مشابه اشاره دارد: قابلیتهای مرتبط با امنیت بیشتر به عنوان زیرساخت کنترلشده رفتار میشوند، نه یک API کالایی.
این تا زمانی که یک رقیب بتواند قابلیت مشابهی را بدون همان دروازه ارائه دهد، کار میکند، جایی که فشار وزن باز از چین به عامل اصلی تبدیل میشود.
آستانهای که مهم است این است که آیا آسترا به طور گسترده از طریق توزیع کامل API و کانالهای ابری در یک زمانبندی مشخص در دسترس قرار میگیرد یا اینکه "بحرانی" به یک عذر پایدار برای کمبود تبدیل میشود. اگر OpenAI تاریخها را منتشر کند و آسترا به موقع در AWS Bedrock قرار گیرد، چارچوب "عصر AGI" شروع به ترجمه به یک رویداد توزیع واقعی میکند.
اگر زمانبندیها مبهم باقی بمانند در حالی که سطوح دارای قابلیت سایبری در آزمایشگاهها پشت برنامههای تأیید قفل شده باقی بمانند، در این صورت تأثیر واقعی بازار دویدن نه قابلیت، بلکه یک زنجیره تأمین دوشاخهای است که در آن استنتاج ارزان فراوان است اما مجوزهای سطح بالا کمیاب هستند.دارایی.
این در شرایط عملی مهم است اگر سه ماهه بعدی هم توزیع گستردهتر آسترا و هم کاهشهای خواندن کش در سطح صنعت را به همراه داشته باشد، زیرا این تأیید میکند که فرضیه اصلی: مرز در حال ارزانتر شدن برای اجرا است در حالی که دسترسی به آن سختتر میشود.