
OpenAI و Anthropic نسخههای ارزانتر GPT-6 و Claude Opus…
OpenAI کاهش 50 درصدی قیمت API را در مقایسه با قیمتهای تبلیغاتی GPT-5.6 اعلام کرد، در حالی که Anthropic هزینههای اجرایی را با کارایی توکن حدود 40 درصد کمتر معرفی کرد.
OpenAI و Anthropic هر کدام گزینههای مدل با هزینه کمتر را در ۲۲ سپتامبر معرفی کردند و این عرضهها را حول کاهش هزینههای استنتاج مشتریان شکل دادند، در حالی که رقبای ارزانتر با وزن باز، قیمتگذاری API میزبان را تحت فشار قرار میدهند. این راهاندازیها همچنین به عنوان اولین مدلهای جدید از هر یک از آزمایشگاهها پس از درخواستهای اخیر برای کاهش سرعت کلی صنعت مرتبط با بحث ایمنی AI صورت میگیرد.
کاهش هزینههای GPT-6 Sol/Luna از OpenAI و Opus 5.5 از Anthropic در کانون توجه قرار دارد.
OpenAI در تاریخ 22 سپتامبر دو سطح جدید به خانواده GPT-6 خود اضافه کرد: GPT-6خورشیدو GPT-6 لونا. شرکت اعلام کرد که سطوح جدید کاهش مییابند.APIکاهش قیمت به میزان ۵۰٪ نسبت به قیمت تبلیغاتی GPT-5.6، این اقدام را به عنوان کاهش مستقیم در هزینهای که توسعهدهندگان برای فراخوانی مدل به صورت برنامهنویسی پرداخت میکنند، معرفی میکند.
تقسیمبندی بهطور واضحی مشخص است. OpenAI سول را در سطحی پایینتر از آسترا قرار داد و آن را برای بارهای کاری پیچیدهتر مانند کدنویسی هدفگذاری کرد. لونا برای "وظایف با حجم بالا" مانند استخراج اطلاعات یا خلاصهسازی اسناد طراحی شده است، نوعی کار با بار سنگین که در آن هزینههای API مبتنی بر توکن میتواند بر اقتصاد واحد تسلط یابد.
انتشار Anthropic از زاویهای متفاوت به همان نقطه قوت رسید. این شرکت Claude Opus 5.5 را به عنوان جدیدترین مدل در خانواده Claude 5.5 معرفی کرد و آن را به عنوان مدلی با کارایی توکن بیشتر توصیف کرد و برآورد کرد که هزینه اجرای آن حدود 40% کمتر از Opus 5 خواهد بود. توکنها بخشهای متنی هستند که مدلها پردازش میکنند و کارایی توکن اهمیت دارد زیرا بیشتر قیمتگذاری API بر اساس توکنهای ورودی و خروجی اندازهگیری میشود.
دیان پن، رهبر محصول آنتروپیک، مکانیزم را بهعنوان کاهش تعداد توکنهایی که مدل برای انجام همان کار در یک "تنظیم تلاش" مشخص نیاز دارد، توصیف کرد. پن گفت: "یکی از چیزهایی که ما همچنان در حال نوآوری در آن هستیم، این است که چگونه این تفکر را بهبود دهیم، چگونه پاسخدهی را کارآمدتر کنیم، بهطوریکه بسته به تنظیم تلاش شما، توکنهای کمتری استفاده کند."
هر دو راهاندازی در پسزمینه رقابتی یکسان قرار داشتند: فشاری از مدلهای ارزانتر و بدون وزن، به این معنی که وزنهای این مدلها برای دیگران قابل دسترسی و تنظیم مجدد است و نه اینکه در پشت یک API میزبانی شده قفل شده باشد. رقبای نام برده شده در این زمینه شامل علیبابا، Moonshot AI و DeepSeek بودند.
زمانبندی نیز اهمیت دارد. اینها به عنوان اولین انتشارها از هر دو آزمایشگاه توصیف میشوند از زمانی که بحثهای ایمنی اخیر شدت گرفت و خواستهها برای کند کردن توسعه AI پیشرفته در سطح صنعت قوت گرفت. مدیرعامل Anthropic، داریو آمودئی، در هفتههای اخیر خواستار کند شدن روند کار شد و مدیرعامل OpenAI، سم آلتمن، و ایلان ماسک نیز به این خواسته پیوستند.
بحث ایمنی تا حدی به وسیله یک پست X در تاریخ ۸ سپتامبر از سوی پژوهشگر سابق Anthropic، جیکوب ککسون، که گفت از کار استعفا داده و هشدار داد که هر دو آزمایشگاه "با زندگی ما قمار میکنند"، تحریک شد.
آنچه معاملهگران میتوانند در آینده زیر نظر داشته باشند: برگههای قیمت، معیارها و سرریز وزن باز
محدودیت فوری این است که افشاگریها جهتدار هستند و بهطور کامل قیمتگذاری نشدهاند. OpenAI و Anthropic کاهشهای درصدی را ارائه دادند، اما متن ارائهشده شامل جداول قیمتگذاری مطلق API نیست، مانند $/1M توکن برای ورودی و خروجی، یا جزئیاتی در مورد اینکه آیا این کاهشها بهطور یکنواخت در تمام پنجرههای متنی، استفاده از ابزارها یا حالتهای استدلال با تلاش بیشتر اعمال میشود یا خیر.
معیارها پرچمدار بعدی هستند که کمبود آن احساس میشود. بدون مقایسههای شخص ثالث از GPT-6 Sol/Luna و Claude Opus 5.5 در برابر نسخههای قبلی و در برابر رقبای با وزن باز ذکر شده، بازار تنها با یک سیگنال منحنی هزینه باقی میماند اما تغییر کمی در عملکرد به ازای هر دلار وجود ندارد.
پذیرش پا دیگر این معادله است. اگر لونا واقعاً برای "وظایف با حجم بالا" تنظیم شده باشد، اعتبارسنجی به صورت رشد قابل اندازهگیری در توان عملیاتی، مهاجرت توسعهدهندگان یا تمرکز استفاده در بارهای کاری استخراج و خلاصهسازی نشان خواهد داد که در آنجا استقرارهای با وزن باز میتوانند APIهای میزبانی شده را تحت تأثیر قرار دهند. این بخش هیچ معیار استفادهای ارائه نمیدهد، بنابراین هرگونه پیشبینی در مورد تقاضای محاسباتی همچنان حدسی باقی میماند.
در نهایت، این انتشارها یک آزمون اعتبار در کوتاهمدت برای لفاظیهای مربوط به کندی ایجاد میکنند. بیانیههای پیرو از رهبری در مورد اینکه آیا تماسهای اخیر بر روی زمانبندی انتشار تأثیر میگذارد یا محدودیتهایی برای استقرار ایجاد میکند، بیشتر از تخفیفهای اصلی اهمیت خواهد داشت، زیرا زمانبندی و محدودیتها تعیین میکنند که چگونه بهسرعت استنتاجهای ارزانتر به واقع در بارهای کاری تولیدی گسترش مییابد.
خوانش من: APIهای مرزی ارزانتر سطح داستانهای «توکن AI» را بدون نقاط اثبات جدید بالا میبرند
مکانیسم در اینجا ساده است: هر دو آزمایشگاه در تلاشند تا حجم استنتاج را با کاهش هزینههای عملیاتی مؤثر دفاع کنند، یا از طریق کاهش قیمتهای صریح API (کاهش ۵۰ درصدی OpenAI در مقابل قیمتهای تبلیغاتی GPT-5.6) یا با بازاریابی کارایی توکن به عنوان "همان کار، توکنهای کمتر" (ادعای ~۴۰ درصد ارزانتر بودن Anthropic).
این بیشتر شبیه یک تبلیغ یکباره نیست و بیشتر شبیه تقسیمبندی برای موارد استفاده حساس به هزینه است، به ویژه در مسیر استخراج و خلاصهسازی با throughput بالا که در آن مدلهای وزن باز میتوانند بهطور ارزان اجرا شوند اگر بتوانید استک را مدیریت کنید.
آستانهای که اهمیت دارد این است که آیا برگههای قیمتگذاری مطلق و معیارهای مستقل به اندازه کافی سریع به دست میآیند تا این موضوع را از یک روایت به یک بازتنظیم عملکرد به ازای هر دلار تبدیل کنند.
اگر اعداد و دادههای پذیرش تأیید کنند که سطوح ارزانتر بار واقعی را از استقرارهای با وزن آزاد بازمیگردانند، تأثیر عملی آن، کف پایینتری برای قیمتگذاری استنتاج است که هر داستان توکن مرتبط با هوش مصنوعی را مجبور میکند تا با استفاده، نه شعارها، خود را توجیه کند.