Close-up of a microchip with wires connected
هوش مصنوعی

Z.ai، OpenRouter را به GLM-5.3-Flash تغییر نام داد

این مدل دسترسی میزبانی شده به قیمت ۱۸ دلار در ماه یا وزن‌های بیش از ۳۰۰ گیگابایت را در Hugging Face ارائه می‌دهد، پس از یک هفته در صدر جدول‌های OpenRouter.

نوشته Elliot Marsh6 دقیقه مطالعه

شرکت Z.ai چین مسئولیت مدل ناشناس "Ox Alpha" را که در OpenRouter منتشر شده بود بر عهده گرفته و آن را GLM-5.3-Flash نامیده است. این افشاگری یک لیست "پنهان" ویروسی را به یک انتشار قابل ردیابی تبدیل می‌کند که دسترسی اشتراکی آن از ۱۸ دلار در ماه شروع می‌شود و وزن‌های قابل دانلود آن بیش از ۳۰۰ گیگابایت است.

نکات کلیدی

  • مدل ناشناس "Ox Alpha" که در OpenRouter به شدت رشد کرده بود، توسط Z.ai چین ادعا شده و اکنون به طور رسمی GLM-5.3-Flash نامیده می‌شود.
  • Ox Alpha به عنوان محبوب‌ترین مدل OpenRouter در هفته گذشته رتبه‌بندی شد و OpenRouter اعلام کرد که تمام ترافیک این مدل از طریق چیپ‌های هوش مصنوعی ساخت چین ارائه شده است.
  • Z.ai دسترسی میزبانی شده‌ای را از طریق برنامه‌های کدنویسی GLM با شروع قیمت ۱۸ دلار در ماه ارائه می‌دهد و می‌گوید GLM-5.3-Flash "۳ برابر سهم قابل استفاده GLM-5.3" را ارائه خواهد کرد.
  • وزن‌های GLM-5.3-Flash در Hugging Face منتشر شده و به عنوان "بیش از ۳۰۰ گیگابایت" توصیف شده‌اند، در حالی که OpenRouter همچنین گفت که ارائه‌دهنده "روی درخواست‌های شما آموزش نخواهد دید."

Ox Alpha برملا شده: Z.ai مدل OpenRouter را به GLM-5.3-Flash تغییر برند می‌دهد.

تغییر اصلی Ox Alpha در این هفته یک کاهش قابلیت جدید نبود، بلکه یک افشای هویت بود. مدل ناشناس قبلی که هفته گذشته در OpenRouter ظاهر شد، توسط شرکت هوش مصنوعی چینی Z.ai ادعا شده و به GLM-5.3-Flash تغییر برند داده شده است.

Z.ai گفت که این مدل در "تمام پلتفرم‌های رسمی" در دسترس است و "راحت‌ترین و مستقیم‌ترین" مسیر، برنامه‌های کدنویسی GLM آن است که از ۱۸ دلار در ماه شروع می‌شود. این شرکت همچنین این مدل را به عنوان "قوی و ارزان" معرفی کرد و آن را به عنوان یک رقیب از نظر هزینه و قابلیت در برابر پیشنهادات با وزن بسته از توسعه‌دهندگان آمریکایی معرفی کرد.

این افشاگری همچنین به طور مختصر به روایت سهام وارد شد. پس از تأیید Z.ai به عنوان شرکتی که پشت این مدل است، قیمت سهام Z.ai "افزایش یافت"، طبق بلومبرگ که در مواد منبع اشاره شده است، هرچند هیچ درصد حرکتی ارائه نشده است.

افزایش محبوبیت OpenRouter و جزئیات محاسبات مرتبط با چین

OpenRouter یک پلتفرم یکپارچه است که به کاربران اجازه می‌دهد درخواست‌ها را از طریق یک رابط به مدل‌های مختلف هوش مصنوعی هدایت کنند، که این امر آن را به یک سیگنال اولیه مفید برای آنچه که توسعه‌دهندگان در جریان‌های کاری شبیه به تولید واقعاً آزمایش می‌کنند، تبدیل می‌کند. در این زمینه، پذیرش Ox Alpha به طور غیرمعمولی سریع بود: این مدل به محبوب‌ترین مدل OpenRouter در آن هفته تبدیل شد.

جزئیاتی که باعث شد این افزایش به عنوان چیزی بیشتر از یک کنجکاوی در جدول رده‌بندی قابل درک باشد، زیرساخت بود. OpenRouter گفت که تمام ترافیک برای Ox Alpha از طریق چیپ‌های هوش مصنوعی ساخت چین ارائه شده است. فروشنده و مدل خاص چیپ فاش نشده‌اند، اما این ادعا روایت "ارزان" مدل را به یک ردپای محاسباتی مرتبط با چین مرتبط می‌کند، نه فقط به استراتژی قیمت‌گذاری.

این موضوع اهمیت دارد زیرا راه‌اندازی مدل‌های "پنهان" معمولاً بر مبنای ابهام معامله می‌شود. زمانی که ارائه‌دهنده ناشناخته است، کاربران می‌توانند فرضیات مربوط به عملکرد، هزینه و نحوه مدیریت داده‌ها را بر روی فهرست اعمال کنند. هنگامی که نام ارائه‌دهنده مشخص می‌شود، داستان به توزیع و زیرساخت محاسباتی فروشنده مربوط می‌شود، از جمله اینکه استنتاج در کجا انجام می‌شود و این چه تأثیری بر دسترسی، وضعیت انطباق و محدودیت‌های تأمین دارد.

OpenRouter همچنین سعی کرد یکی از بزرگترین موانع برای تیم‌هایی که از مدل‌های شخص ثالث استفاده می‌کنند را کاهش دهد: محرمانگی درخواست‌ها. این پلتفرم Ox Alpha را به عنوان یک "مدل مرزی طراحی شده برای کدنویسی کارآمد، کار مستمر و استفاده در تولید واقعی" توصیف کرد و بعداً افزود که ارائه‌دهنده "بر روی درخواست‌های شما آموزش نخواهد دید."

این یک اهرم نگهداری برای کدنویسی و جریان‌های کاری عامل است، جایی که درخواست‌ها می‌توانند شامل کد اختصاصی، منطق معاملاتی یا کتاب‌های راهنمای عملیاتی باشند.

۱۸ دلار در ماه در مقابل میزبانی شخصی: تعادل‌های عملی یک نسخه با وزن باز ۳۰۰ گیگابایتی و بیشتر

Z.ai به طور مؤثر دو قیف پذیرش را به طور همزمان اجرا می‌کند. اولین مورد دسترسی میزبانی شده عمومی است: یک برنامه ماهانه پرداخت کنید، یک سهم دریافت کنید و مدل را مانند هر مدل دیگری در نظر بگیرید.APIدستیار کدنویسی مبتنی بر هوش مصنوعی.

نقطه ورود اعلام شده Z.ai "برنامه‌های کدنویسی GLM است که از ۱۸ دلار در ماه شروع می‌شود"، به علاوه ادعایی که GLM-5.3-Flash "سه برابر سهم قابل استفاده GLM-5.3" را ارائه خواهد داد، بدون اینکه سهم پایه یا محدودیت‌های دقیق پشت "قابل استفاده" را منتشر کند.

فunnel دوم میزبانی خودکار توسعه‌دهنده از طریق یک نسخه با وزن باز است. "وزن باز" به این معنی است که وزن‌های آموزش‌دیده منتشر می‌شوند تا دیگران بتوانند مدل را دانلود و اجرا کنند، اما این با "منبع باز" که شامل کد منبع، وزن‌ها و داده‌های آموزشی است، یکسان نیست. برای GLM-5.3-Flash، وزن‌ها در Hugging Face در دسترس هستند و به عنوان "بیش از 300GB" توصیف شده‌اند.

این عدد محدودیت عملی است. دانلود بیش از 300 گیگابایت فقط یک مورد ذخیره‌سازی نیست. این به معنای پهنای باند، زمان استقرار و برنامه‌ریزی حافظه GPU است و بار را برای تیم‌هایی که می‌خواهند از مزایای محرمانگی و کنترل استنتاج محلی بهره‌مند شوند، بالا می‌برد. دسترسی میزبانی ممکن است روی کاغذ ارزان باشد، اما میزبانی خود تنها "رایگان" است اگر تیم قبلاً محاسبات اضافی و بلوغ عملیاتی برای اجرای مدل‌های بزرگ به‌طور قابل اعتماد داشته باشد.

منبع همچنین GLM-5.3-Flash را به عنوان داشتن "قابلیت‌های عاملی" بهبود یافته، از جمله استفاده از یک مرورگر و یک کامپیوتر برای مرور صفحات وب و تعامل با برنامه‌های دسکتاپ، قاب‌بندی می‌کند. برای سازندگان، این مدل را از تولید کد تک‌نوبتی به استفاده از ابزار چند مرحله‌ای سوق می‌دهد، جایی که هزینه، تأخیر و قابلیت اطمینان بیشتر از حقوق bragging خام معیارها اهمیت پیدا می‌کند.

چه چیزی روایت "قوی و ارزان" را تأیید می‌کند

این داستان در حال حاضر بر روی موقعیت‌یابی سنگین و بر روی اندازه‌گیری سبک است. هیچ جدول معیار یا ارزیابی‌های شخص ثالثی در بسته گنجانده نشده است، بنابراین تمیزترین تأیید، ارزیابی‌های منتشر شده‌ای خواهد بود که عملکرد GLM-5.3-Flash را در برابر مدل‌های بسته پیشرو تحت یک نام خاص کمی می‌کند.

قیمت‌گذاری دومین عنصر گمشده است. طرح شروع 18 دلار در ماه، بازاریابی را تثبیت می‌کند، اما جایگزینی برای یک کارت نرخ دقیق که قیمت توکن، محدودیت‌های API و رفتار محدودکننده را مشخص کند، نیست. بدون آن، "ارزان" می‌تواند به هر چیزی از سهمیه‌های سخاوتمندانه تا سقف‌های تهاجمی که فقط در حجم پایین خوب به نظر می‌رسند، اشاره داشته باشد.

زاویه زیرساخت نیز به جزئیات نیاز دارد. بیانیه OpenRouter مبنی بر اینکه تمام ترافیک از طریق تراشه‌های هوش مصنوعی ساخت چین ارائه شده است، نوعی جزئیات است که می‌تواند باعث گسترش روایت شود، اما بدون فروشنده و مدل تراشه ناقص است. اگر این اطلاعات فاش شود، مشخص خواهد شد که آیا این یک انتخاب ظرفیت یک‌باره است یا بخشی پایدار از ساختار هزینه.

در نهایت، ادعای Z.ai مبنی بر "3 برابر سهمیه قابل استفاده GLM-5.3" به محدودیت‌های مشخص نیاز دارد. اگر شرکت سهمیه پایه و سهمیه جدید را در همان واحدها منتشر کند، امکان مدل‌سازی هزینه واقعی به ازای هر کار به جای تکیه بر یک ضریب فراهم می‌شود.

نظر من: چرا این نوع راه‌اندازی "پنهان به رسمی" برای روایت‌های هوش مصنوعی که معامله‌گران دنبال می‌کنند مهم است

قسمتی که تصمیم می‌گیرد آیا این مهم است یا نه، تغییر نام نیست، بلکه این است که آیا افشا به توزیع تکرارپذیر تبدیل می‌شود یا خیر. یک فهرست پنهان می‌تواند در یک جدول هفتگی در نوآوری و دهان به دهان قرار گیرد، اما داستان یک فروشنده فقط در صورتی ادامه پیدا می‌کند که قیمت‌گذاری، سهمیه‌ها و قابلیت اطمینان پس از اینکه تیم‌ها بارهای واقعی را از آن عبور دهند، حفظ شود.

آزمون واقعی این است که آیا Z.ai می‌تواند پیشنهاد "قوی و ارزان" را با عناصر اولیه‌ای که بازار می‌تواند پشتیبانی کند، تأمین کند.حسابرسی: ارزیابی‌های شخص ثالث، یک نرخ واقعی فراتر از نقطه شروع ۱۸ دلار در ماه، و وضوح در مورد «چیپ‌های هوش مصنوعی ساخت چین» که ترافیک OpenRouter را تأمین می‌کنند.

اگر این جزئیات به‌خوبی ارائه شوند، این تنظیمات به‌جای اینکه داستان‌محور باشد، ساختاری به نظر می‌رسد، زیرا تیم‌ها می‌توانند واقعاً هزینه به ازای خروجی را مقایسه کرده و تصمیم بگیرند که کجا استنتاج را انجام دهند.

منابع