
آزمایشگاههای هوش مصنوعی زمان انتشار مدلها را به ۴۴ روز…
شاخصهای داخلی در آنتروپیک و اوپنای آی به اتوماسیونی اشاره دارند که پنجرههای ایمنی را فشرده کرده و ریسکهای دنبالهای سیاست و امنیت را افزایش میدهد.
آزمایشگاههای اصلی هوش مصنوعی ایالات متحده و چین میانگین فاصله زمانی بین انتشار مدلهای با عملکرد بالا را از ۱۲۵ روز در بازه زمانی ژانویه ۲۰۲۳ تا مارس ۲۰۲۶ به ۴۴ روز از آوریل ۲۰۲۶ کاهش دادهاند. این تغییر ناشی از این است که عوامل هوش مصنوعی بخش بیشتری از کار ساخت مدلهای نسل بعدی را انجام میدهند و زمانهای تأیید ایمنی را در یک رقابت فشرده که میتواند به بازارهای ریسک سرایت کند، تنگتر میکند.
از ۱۲۵ روز به ۴۴: ریتم جدید انتشار مدل در آزمایشگاههای ایالات متحده و چین
یک نظرسنجی از انتشار مدلهای با عملکرد بالا که شامل پنج شرکت هوش مصنوعی ایالات متحده و چهار شرکت چینی بود، نشان داد که میانگین فاصله انتشار از آوریل ۲۰۲۶ تا سپتامبر ۲۰۲۶ به ۴۴ روز کاهش یافته است، در مقایسه با ۱۲۵ روز از ژانویه ۲۰۲۳ تا مارس ۲۰۲۶. این مجموعه شامل آزمایشگاههای ایالات متحده مانند Anthropic و OpenAI و شرکتهای مستقر در چین از جمله Alibaba Group و Moonshot AI بود.
ریتم دیگر یک میانگین انتزاعی نیست. اوایل سپتامبر یک مثال خوشهای ارائه داد: Anthropic در تاریخ ۱ سپتامبر "Claude Fable 5.1" را معرفی کرد، گوگل در تاریخ ۲ سپتامبر "Gemini 3.8 Flash" را راهاندازی کرد و OpenAI در تاریخ ۳ سپتامبر "GPT-6 Astra" را منتشر کرد. انتشار گوگل در تاریخ ۲ سپتامبر به عنوان سومین مدل Flash در شش هفته توصیف شد.
همین الگو به عنوان یک برنامه پایهای به جای یک دویدن یکباره ظاهر میشود. متا از ژوئیه بهروزرسانیهای ماهانهای برای مدل "Muse Spark" خود انجام میدهد و DeepSeek مستقر در چین از ژوئیه هر ماه نسخههای جدیدی منتشر کرده است، با توصیف Alibaba و Zhipu AI به عنوان پیوستن به رقابت انتشار سریعتر.
برای بازارها، مکانیزمی که اهمیت دارد تنها "مدلهای بیشتر" نیست. یک چرخه ۴۴ روزه به معنای زمان کمتر برای آزمایشهای خارجی، زمان کمتر برای یکپارچهسازهای پاییندستی برای تقویت استقرارها و لحظات بیشتری است که در آن اختلافات سیاست، امنیت یا ایمنی میتواند به کاتالیزورهای کوتاهمدت تبدیل شود.
هوش مصنوعی ساخت هوش مصنوعی: معیارهای خودکارسازی تحقیق و توسعه داخلی در Anthropic و OpenAI
عامل توصیفشده برای چرخه فشرده، تغییر از هوش مصنوعی به عنوان یک دستیار کدنویسی به هوش مصنوعی به عنوان یک مجری تحقیق و توسعه است.عوامل هوش مصنوعیبرای انجام آزمایشها، مدیریت حلقههای ارزیابی و تحلیل نتایج استفاده میشوند که به آزمایشگاهها اجازه میدهد کارهایی را که قبلاً به توجه انسان وابسته بود، به صورت موازی انجام دهند.
گزارش 17 سپتامبر انتروپیک گفت که کلود 26٪ از وظایف تحقیق و توسعه هوش مصنوعی این شرکت را در ماه گذشته رهبری کرده است، که از 0٪ در فوریه 2026 افزایش یافته است. انتروپیک همچنین بهطور عین به عین گفت: "کلود هنوز بهطور کامل بهطور خودکار عمل نمیکند."
این گزارش اندازهگیری را بهعنوان راهی برای ارزیابی نزدیکی به بهبود خودبازگشتی چارچوببندی کرد، به این معنی که یک سیستم بهطور خودکار بر روی طراحی یا فرآیند آموزشی خود تکرار میکند بهگونهای که میتواند افزایش قابلیتها را بدون نظارت انسانی متناسب تسریع کند.
معیارهای داخلی OpenAI در بسته به همان سمت اشاره دارند، اما با نمایندهای متفاوت: کار و هزینه. تا ماه گذشته، عوامل هوش مصنوعی در سازمان تحقیقاتی OpenAI ساعات کاری کلی معادل 3.1 برابر کار روزانه پژوهشگران انسانی ثبت کردند.
هزینههای توکن هوش مصنوعی به ازای هر پژوهشگر در OpenAI، که معیاری از هزینه استفاده است که به میزان خروجی مدل که پژوهشگران مصرف میکنند مرتبط است، از حدود 1 دلار در روز برای یک پژوهشگر معمولی در فوریه 2026 به بیش از 600 دلار در روز تا ماه گذشته افزایش یافت، با 10٪ برتر که بیش از 7000 دلار در روز هزینه کردند.
شاخصهای سمت خروجی نیز با آن حرکت کردند. بسته میگوید حجم کد برنامهنویسی نوشته شده در OpenAI در ماه گذشته به هفت برابر میانگین سال گذشته رشد کرده است، در حالی که کد انتروپیک که به محصولات واقعی در سهماهه دوم وارد شده است به هشت برابر میانگین 2021–2025 رسید. این همان چیزی است که "هوش مصنوعی که هوش مصنوعی میسازد" بهطور عملی به نظر میرسد: تلاشهای بیشتر بهصورت موازی، تکرار سریعتر و فاصله کمتر بین جهشهای قابلیت.
پنجرههای ایمنی در حالی که رقابت به «معضل زندانی» تبدیل میشود، کوچکتر میشوند.
نگرانی ایمنی ساده است: اگر سرعت تکرار افزایش یابد، زمان در دسترس برای انسانها برای درک رفتار مدل و تأیید ایمنی کاهش مییابد. بسته این را به ترس از بهبود خودبازگشتی مرتبط میکند که میتواند منجر به «انفجار هوش» شود، یک افزایش فرضی غیرقابل کنترل در قابلیت که از کنترل و حاکمیت انسانی پیشی میگیرد.
ریسک امنیتی بهطور خودکار در حال تنگ شدن است. موسسه امنیت هوش مصنوعی بریتانیا در نوامبر 2025 تخمین زد که زمان دو برابر شدن طول وظایف حملات سایبری که هوش مصنوعی میتواند انجام دهد، حدود هشت ماه است. تا فوریه 2026، این موسسه تخمین زد که زمان دو برابر شدن به 4.7 ماه کاهش یافته است، که بهبود سریعتر در قابلیت تهاجمی و یک پنجره باریکتر برای سازگاری دفاعی را نشان میدهد.
مشکل انگیزههاست. محیط رقابتی بهعنوان «معضل زندانی» توصیف میشود، جایی که هر آزمایشگاه دلیلی برای ادامه رقابت دارد حتی اگر همه در صورت کند شدن ایمنتر باشند، زیرا کاهش یکجانبه خطر از دست دادن زمین را به همراه دارد. بسته همچنین شامل یک نقطه داده فشار رقابتی تأیید نشده است: به نقل از رویترز میگوید که انتروپیک در حال بررسی تسریع در راهاندازی مدل بعدی خود برای مقابله با آسترا OpenAI قبل از IPO است.
سیگنالهای کوتاهمدت که رژیم 44 روزه را تأیید میکنند، ملموس هستند. تغییرات تأیید شده در برنامهریزی برای انتشار بعدی انتروپیک نشان میدهد که آیا «بررسی تسریع» به یک حرکت واقعی تقویمی تبدیل میشود یا خیر.
بهروزرسانیها در معیارهای شدت اتوماسیون داخلی، از جمله اینکه آیا چند برابر ساعات کاری عوامل OpenAI 3.1 برابر حفظ میشود یا افزایش مییابد و اینکه آیا هزینه توکن به ازای هر پژوهشگر معمولی بالای 600 دلار در روز باقی میماند، نشان میدهد که آیا تسریع در حال تثبیت است یا هنوز در حال افزایش است.
ارزیابیهای جدید قابلیت سایبری از موسسه امنیت هوش مصنوعی بریتانیا یا همتایان که تخمین هشتماهه را به 4.7 ماه گسترش میدهند نیز مهم خواهد بود، زیرا این نوع منحنی ریسک خارجی است که تنظیمکنندگان و خریداران شرکتی میتوانند به آن تکیه کنند.
خوانش من: چرخههای سریعتر احتمال وقوع رویدادهای ریسک ناگهانی را که معاملهگران نمیتوانند نادیده بگیرند، افزایش میدهد.
بخشی که این را تعیین میکند این است که آیا ریتم 44 روزه یک خوشه راهاندازی موقت است یا یک ریتم عملیاتی جدید که توسط اتوماسیون هدایت میشود. سهم 26٪ تحقیق و توسعه هوش مصنوعی انتروپیک و چند برابر ساعات کاری 3.1 بر OpenAI مانند یک تغییر مرحلهای در میزان کاری که توسط ماشینها انجام میشود، نه فقط با کمک، به نظر میرسد و این نوع خروجی تمایل دارد زمان تأیید را فشرده کند حتی اگر بودجههای ایمنی افزایش یابد.
آستانهای که اهمیت دارد این است که آیا آزمایشگاهها به انتشار معیارهایی ادامه میدهند که نشان میدهد شدت اتوماسیون در سطح بالایی باقی مانده در حالی که انتشارها همچنان در عرض چند روز یا هفته جمع میشوند. اگر این موضوع ادامه یابد، ساختار به نظر میرسد که بیشتر ساختاری است تا مبتنی بر روایت، و نتیجه عملی آن افزایش فراوانی شوکهای سیاست و امنیتی است که میتواند به قیمتگذاری ریسکهای وسیعتر نشت کند.