Close-up of a computer motherboard with
هوش مصنوعی

کاهش قیمت OpenAI و Anthropic با افزایش استفاده از DeepSeek

GPT-6 Sol/Luna برای کاهش هزینه ۵۰٪ آماده شده‌اند و Opus 5.5 با قیمت تقریباً ۴۰٪ ارزان‌تر معرفی شده است، در حالی که DeepSeek V4.1 Flash افزایش استفاده هفتگی ۱۷۲٪ را ثبت کرده است.

نوشته Elliot Marsh6 دقیقه مطالعه

یک چرخه جدید انتشار هفتگی مدل‌های پیشرفته هوش مصنوعی، باعث کاهش هزینه‌ها شده است، به طوری که OpenAI و Anthropic به جای تخفیف بر روی سطوح قدیمی، کاهش قیمت‌های قابل توجهی را تبلیغ می‌کنند. داده‌های اولیه استفاده از OpenRouter، جایی که DeepSeek’s V4.1 Flash در رتبه اول با افزایش ۱۷۲٪ "این هفته" قرار دارد، با قیمت‌گذاری ارزان‌تر به ازای هر توکن و افزایش تقاضا حتی در شرایط فشار حاشیه‌ای آزمایشگاه‌ها سازگار است.

نکات کلیدی

  • OpenAI برنامه‌ریزی کرده بود تا GPT-6 را عرضه کند.خورشیدو GPT-6 لونا در روز سه‌شنبه با کاهش ۵۰ درصدی هزینه‌ها برای بهترین مشتریان تجاری نسبت به نسخه‌های قبلی همین مدل‌ها عرضه شد.
  • آنتروپیک همچنین سه‌شنبه را برای اوپس ۵.۵ هدف قرار داد و گفت که هزینه اجرای آن حدود ۴۰٪ کمتر از اوپس ۵ است در حالی که "هوش بالایی" را حفظ می‌کند.
  • xAI روز دوشنبه نسخه ۴.۷ Grok را منتشر کرد و آن را بر اساس نسبت قیمت به عملکرد تبلیغ کرد، اما راه‌اندازی‌های رقیب در عرض ۲۴ ساعت بخش زیادی از آن مزیت قیمتی را کاهش دادند.
  • نسخه ۴.۱ Flash دیپ‌سیک در رتبه اول جدول رده‌بندی OpenRouter قرار گرفت و در "این هفته" افزایش ۱۷۲ درصدی در استفاده را ثبت کرد.

مدل‌های پرچمدار سریع‌تر ارزان‌تر می‌شوند: GPT-6 Sol/Luna، Opus 5.5 و Grok 4.7

این هفته، روند انتشار هوش مصنوعی کمتر به عنوان یک رقابت خالص در قابلیت‌ها و بیشتر به عنوان یک بازنویسی لیست قیمت بازاریابی می‌شود. OpenAI برنامه‌ریزی کرده بود که GPT-6 Sol و GPT-6 Luna را در روز سه‌شنبه منتشر کند و هزینه‌ها را برای مشتریان برتر کسب‌وکار ۵۰٪ نسبت به نسخه‌های قبلی همان مدل‌ها کاهش دهد.

آنتروپیک برنامه‌ریزی کرده بود که اوپس ۵.۵ را در همان روز منتشر کند و گفت که هزینه‌های آن حدود ۴۰٪ کمتر از اوپس ۵ است در حالی که بالاترین هوش را حفظ می‌کند. موضوع مشترک فشرده‌سازی هزینه‌های صریح در جدیدترین سطح "پرچمدار" است، نه فقط الگوی معمول کاهش قیمت‌ها بر روی مدل‌های قدیمی پس از یک راه‌اندازی جدید.

حرکت xAI ریتم را تنظیم کرد. xAI ایلان ماسک در روز دوشنبه Grok 4.7 را منتشر کرد و مدل را در اطراف قیمت-عملکرد قرار داد و واکنش رقابتی بلافاصله بود. در عرض ۲۴ ساعت، گزینه‌های جدید بخش زیادی از مزیت قیمت Grok 4.7 را کاهش دادند، یادآوری سریع اینکه قدرت قیمت‌گذاری در مدل‌های مرزی می‌تواند در یک چرخه خبری واحد تبخیر شود.

هزینه‌های به ازای توکن، توضیح داده شده: چرا کاهش قیمت‌ها می‌تواند هزینه کل هوش مصنوعی را افزایش دهد.

واحدی که در این مبارزه مهم است، توکن است. هزینه‌های به ازای توکن، قیمتی است که یک ارائه‌دهنده برای پردازش یا تولید یک واحد متن دریافت می‌کند و این ساده‌ترین راه برای مقایسه هزینه‌های عملیاتی در مدل‌ها است وقتی که همه چیز در حال حرکت است.

کاهش قیمت‌های به ازای توکن به طور خودکار به این معنا نیست که بازار کمتر بر روی هوش مصنوعی هزینه می‌کند. مکانیزم ساده است: وقتی یک مدل ارزان‌تر می‌شود، توسعه‌دهندگان ویژگی‌های بیشتری را که قبلاً خیلی گران بودند، ارسال می‌کنند، کاربران جلسات طولانی‌تری را اجرا می‌کنند و شرکت‌ها جریان‌های کاری بیشتری را از طریق مدل پیش می‌برند به جای اینکه آن را برای درخواست‌های "با ارزش بالا" رزرو کنند.

این می‌تواند حجم کل توکن را به اندازه‌ای افزایش دهد که هزینه کل همچنان افزایش یابد حتی در حالی که قیمت به ازای توکن کاهش می‌یابد.

این دینامیک، شهود پشت پارادوکس جونس است، ایده اقتصادی که وقتی یک منبع ارزان‌تر می‌شود، مصرف کل می‌تواند به جای کاهش، افزایش یابد. در این مورد، "منبع" استنتاج است و شرط این است که قیمت‌های پایین به اندازه کافی استفاده جدید را آزاد می‌کنند تا متر محاسباتی همچنان کار کند.

چارچوب فروش در بسته به داستان حجم می‌پردازد. سیتادل سکیوریتیز به مشتریان گفت که کاهش هزینه‌های به ازای توکن باعث افزایش استفاده اضافی می‌شود و اینکه هزینه کل هوش مصنوعی در حال افزایش است، که به گفته آنها به سودهای بالاتر در نهایت برای آزمایشگاه‌های هوش مصنوعی یا شرکت‌هایی که قدرت محاسباتی پشت استفاده از هوش مصنوعی را فراهم می‌کنند، اشاره دارد.

مورگان استنلی یک مورد مشابه از سمت تقاضا را مطرح کرد و رقابت از ارائه‌دهندگان چینی را به عنوانخوشبینانهبرای هوش مصنوعی به تصویر کشید زیرا دسترسی ارزان‌تر می‌تواند مشتریان بیشتری را جذب کند و تقاضای کلی برای محاسبات را افزایش دهد.

نقطه اثبات پذیرش: DeepSeek V4.1 Flash به عنوان استفاده ۱۷۲٪ افزایش می‌یابد، OpenRouter را بالاتر می‌زند.

تمیزترین نقطه داده در بسته، نمره معیار نیست. این یک جدول رده‌بندی و یک افزایش استفاده است.

فلش V4.1 DeepSeek در جدول رده‌بندی OpenRouter رتبه اول را کسب کرد و این هفته 172% افزایش در استفاده را ثبت کرد. OpenRouter یک تجمیع‌کننده است که درخواست‌ها را در بین مدل‌های مختلف هدایت می‌کند و رتبه‌بندی‌هایی را منتشر می‌کند که معامله‌گران و سازندگان به عنوان یک نمای کلی از شتاب پذیرش استفاده می‌کنند.

DeepSeek همچنین مثالی است که بسته برای تعریف فشار وزن باز بر incumbents استفاده می‌کند. یک مدل وزن باز مدلی است که پارامترهای آموزش‌دیده در دسترس قرار می‌گیرند تا دیگران بتوانند آن را اجرا یا تنظیم کنند، که اغلب امکان استقرار ارزان‌تر یا انعطاف‌پذیرتر از پیشنهادات کاملاً بسته را فراهم می‌کند.

بسته اشاره می‌کند که DeepSeek گفته است فلش V4.1 در چندین معیار از پرچمدار قبلی خود پیشی می‌گیرد از طریق به‌روزرسانی‌های فنی که به آن اجازه می‌دهد کمتر هزینه کند، اگرچه مجموعه معیارها و نتایج در اینجا ارائه نشده است.

نکته کلی رقابتی است، نه ایدئولوژیک. وقتی ارائه‌دهندگان وزن باز در رتبه‌بندی‌های دیده‌شده به‌طور گسترده صعود می‌کنند و قیمت را کاهش می‌دهند، آنها آزمایشگاه‌های بسته را مجبور می‌کنند تا در هزینه پاسخ دهند و زبان قیمت‌گذاری پرچمدار این هفته مانند آن پاسخ است.

چک‌لیست تأیید برای معامله‌گران: نسبت استفاده به درآمد، کف قیمت‌ها و سهم جدول رده‌بندی

نقطه تأیید اول این است که آیا کاهش قیمت‌ها واقعی است در تنها جایی که اهمیت دارد: صفحات قیمت‌گذاری پس از انتشار و شرایط شرکتی. کاهش 50% اعلام‌شده OpenAI برای مشتریان تجاری برتر و هزینه اجرای ~40% پایین‌تر Anthropic برای Opus 5.5 اعداد بزرگی هستند، اما بسته شامل ارقام مطلق $/توکن یا دامنه دقیق مشتریان و سطوح استفاده واجد شرایط نیست.

دوم این است که آیا رتبه‌بندی‌ها و روندهای استفاده OpenRouter DeepSeek V4.1 Flash را در یک یا دو هفته آینده در رتبه اول یا نزدیک آن نگه می‌دارد، یا اینکه جدول رده‌بندی پس از انتشار پرچمدارهای سه‌شنبه به حالت قبل برمی‌گردد. یک افزایش یک‌هفته‌ای می‌تواند ناشی از نوآوری، مشوق‌ها یا پیش‌فرض‌های مسیریابی باشد. سهم پایدار ادعای متفاوتی است.

سومین پل نسبت استفاده به درآمد است. بسته فشار حاشیه‌ای بر OpenAI و Anthropic را به عنوان جنگ قیمت‌ها شناسایی می‌کند و هنوز مشخص نیست که آیا حجم‌های بالاتر توکن به رشد پایدار درآمد تبدیل می‌شود وقتی که قیمت‌گذاری به ازای هر توکن در حال فشرده شدن است.

در نهایت، تماشا کنید که چگونه سریع قیمت‌گذاری مجدد گسترش می‌یابد. مزیت Grok 4.7 که در عرض 24 ساعت رقابت می‌شود، الگو است. اگر همان قیمت‌گذاری مجدد سریع به سایر “فلش” یا واریانت‌های کوچک‌تر برسد، بازار احتمالاً به سمت یک کف قیمت حرکت می‌کند که توسط هر کسی که ارزان‌ترین محاسبات و بهترین توزیع را دارد تعیین می‌شود، نه هر کسی که یک راه‌اندازی پرچمدار را برنده می‌شود.

نظر من: جنگ قیمت به نظر می‌رسد داستان حاشیه‌ای برای آزمایشگاه‌ها و داستان حجمی برای محاسبات باشد.

بخشی که این را تعیین می‌کند این نیست که آیا یک مدل "بهترین" است یا نه، بلکه این است که آیا استنتاج ارزان‌تر به اندازه کافی بار کاری را گسترش می‌دهد تا هزینه کل افزایش یابد. شواهد سخت این بسته باریک اما از نظر جهت‌گیری سازگار است: DeepSeek V4.1 Flash که در OpenRouter در رتبه اول قرار دارد و با افزایش 172 درصدی استفاده هفتگی مواجه است، نمایی از تقاضای پارادوکس جونس در دنیای واقعی است، حتی قبل از اینکه کاهش‌های پرچمدار سه‌شنبه به بازار بیفتد.

آزمایش واقعی این است که آیا صفحات قیمت‌گذاری پس از راه‌اندازی و شرایط شرکتی تأیید می‌کنند که کاهش‌های اعلام شده 50% و ~40% صحیح هستند و آیا سهم رده‌بندی پس از ورود پرچمداران جدید حفظ می‌شود. اگر این دو مورد با هم هم‌راستا شوند، این تنظیمات شروع به نشان دادن ساختار می‌کند: آزمایشگاه‌ها در حال جنگ بر سر حاشیه هستند در حالی که تقاضای محاسباتی در حجم بالا باقی می‌ماند.

منابع