
انتشار مدل وزن باز Reflection با حمایت Nvidia نزدیک است
این استارتاپ قراردادهای بزرگ اجاره سرور انویدیا را با نبیس و اسپیسایکس امضا کرده است در حالی که یک "کارخانه هوش مصنوعی" برای مؤسسات حساس به دادهها را معرفی میکند.
استارتاپ تحت حمایت انویدیا به نام Reflection در حال آمادهسازی برای انتشار یک مدل هوش مصنوعی با وزن آزاد و قدرتمند است و همزمان ظرفیت سرورهای هوش مصنوعی انویدیا را از طریق قراردادهای اجاره بزرگ با Nebius و SpaceX تأمین میکند. این همکاری به مؤسساتی هدفگذاری شده است که میخواهند از انباشتهای هوش مصنوعی اختصاصی خود بر روی دادههای خود استفاده کنند و به طور کامل به APIهای مدلهای بسته وابسته نباشند.
رفلکشن به راهاندازی اوپنوایت نزدیک میشود در حالی که ظرفیت سرور انویدیا را قفل میکند.
رفلکشن، یک استارتاپ پشتیبانی شده توسط انویدیا، در حال آمادهسازی برای انتشار یک سیستم هوش مصنوعی "قوی" با وزن باز به زودی است و آن را به عنوان یک گزینه ارزانتر برای استفاده از مدلهای مرزی بسته از آزمایشگاههای بزرگ ایالات متحده معرفی میکند، زمانی که با GPUهای انویدیا ترکیب شود.
"وزن باز" در اینجا به این معنی است که وزنهای مدل برای دانلود و اجرا یا سفارشیسازی داخلی در دسترس هستند، به جای اینکه فقط از طریق یک سرویس میزبانی شده قابل دسترسی باشند.APIمتن خالی است.
نشانهای که نشان میدهد Reflection برای حجم واقعی استقرار برنامهریزی میکند، محاسبات است، نه بازاریابی. در هفتههای اخیر، این شرکت قراردادهای "عظیم" با Nebius و SpaceX برای اجاره سرورهای هوش مصنوعی Nvidia امضا کرده است، که به طور مؤثر ظرفیت GPU را برای آموزش، تنظیم دقیق و استنتاج که مشتریان به صورت آنلاین میآیند، رزرو میکند. شرایط این قراردادها فاش نشده و سخنگوی Reflection از اظهار نظر خودداری کرده است.
منابع انتظار دارند که اولین مدل Reflection در زمان راهاندازی، در پشت پیشرفتهترین مدلهای بسته ایالات متحده قرار گیرد، اما با مدلهای وزن باز برتر چین رقابت کند. این نقطه میانه اهمیت دارد زیرا مدل نیازی به پیشرو بودن در مرز ندارد تا از نظر عملی مفید باشد.
اگر این مدل "به اندازه کافی توانمند" باشد، نهادها میتوانند آن را با دادههای داخلی با کیفیت بالا ترکیب کنند تا سیستمهای اختصاصی بسازند که در جریانهای کاری خاص و باریک، با تنظیمات گرانتر مرزی رقابت کنند.
پیشنهاد "کارخانه هوش مصنوعی": مدلهای محلی، دادههای اختصاصی و چرا شرکتهای تجاری اهمیت میدهند
محصول اصلی رفلکشن تحت عنوان "کارخانه هوش مصنوعی" به صورت یک رویکرد بسته برای نهادها به منظور راهاندازی اکوسیستمهای هوش مصنوعی محلی است. از نظر مکانیکی، روند کار ساده است: یک نهاد دادههای اختصاصی خود را میگیرد، مدلهای رفلکشن را اعمال میکند و این مجموعه را بر روی محاسبات اختصاصی که تحت کنترل خود دارد، اجرا میکند. هدف تنها سفارشیسازی نیست. بلکه حفظ دادههای حساس در داخل مرزهای نهاد در حالی است که هنوز قابلیتهای مدرن مدل را به دست میآورد.
به همین دلیلصندوقهای پوشش ریسکو شرکتهای تجاری در این ارائه حضور دارند. این فروشگاهها قبلاً بر روی "دادههای بسیار محافظتشده" نشستهاند و بسیاری به طور ساختاری به ارسال آن به APIهای شخص ثالث آلرژی دارند، حتی تحت شرایط شرکتی. یک مدل وزن باز سطح ناحیه استقرار را تغییر میدهد.
به جای ارسال درخواستها و زمینه به مدل میزبانی شده یک فروشنده، یک شرکت میتواند استنتاج را به صورت داخلی اجرا کند، بر روی مجموعههای خصوصی تنظیم دقیق انجام دهد و کل خط لوله، از جمله ثبت و کنترل دسترسی، را برای مطابقت با انطباق داخلی تجهیز کند.
قفل محاسباتی نیمه دیگر این مکانیزم است. وزن باز به تنهایی گلوگاه را حل نمیکند اگر نتوانید به طور قابل اعتماد GPUها را در مقیاس تأمین کنید، به ویژه برای استنتاج حساس به تأخیر یا برای چرخههای تنظیم دقیق مکرر. با اجاره سرورهای AI انویدیا از طریق نبیس و اسپیسایکس، رفلکشن در تلاش است تا دو محدودیتی را که مؤسسات واقعاً احساس میکنند، ترکیب کند: دسترسی به مدل و دسترسی به محاسبات. این ترکیب به یک "محصول زیرساختی" نزدیکتر از یک مدل است.
رفلکشن قبلاً شروع به آزمایش مفهوم کارخانه AI در یک زمینه AI حاکمیتی کرده است و یک همکاری کارخانه AI حاکمیتی با گروه شینسهگه در کره جنوبی اعلام کرده است. "AI حاکمیتی" در این چارچوب به نگهداشتن دادهها و کنترل در یک کشور یا مؤسسه خاص به دلایل امنیتی و حکومتی مربوط میشود، که به وضوح به این دلیل که شرکتهای غربی و کاربران دولتی از استقرار مدلهای وزن باز با قابلیت بالا چینی خودداری کردهاند، مطابقت دارد.
معیارها، مجوزها و موج وزن باز غربی: چه چیزی را در انتشار زیر نظر داشته باشیم
ناشناخته فوری این است که "رقابتی" در اصطلاح معیارها به چه معناست. رفلکشن معیارهای فنی، تعداد پارامترها، الزامات سختافزاری یا ارزیابیهای شخص ثالثی را منتشر نکرده است که به بازار اجازه دهد آن را به طور دقیق در برابر مدلهای وزن باز پیشرو چینی یا مدلهای مرزی بسته برتر ایالات متحده قرار دهد.
مجوزها دومین مورد محدودکننده برای پذیرش شرکتی هستند. "وزن باز" هنوز میتواند با محدودیتهایی همراه باشد که در عمل مهم هستند، از جمله محدودیتهای استفاده تجاری، توزیع مجدد و حقوق تنظیم دقیق. برای مؤسساتی که میخواهند به صورت داخلی مستقر شوند، تفاوت بین یک مجوز تجاری مجاز و یک مجوز تحقیقاتی محدودتر تفاوت بین یک آزمایش و تولید است.
محاسبات سومین متغیری است که تصمیم میگیرد آیا ارائه کارخانه AI واقعی است یا خیر. قراردادهای اجاره سرور نبیس و اسپیسایکس به عنوان "عظیم" توصیف شدهاند، اما بدون افشای ظرفیت، مدت یا قیمت، سخت است که آنها را به توان استنتاج پشتیبانی شده یا مقیاس آموزش ترجمه کنیم. این جزئیات همچنین نشان میدهد که آیا رفلکشن در حال ساخت یک کانال تأمین تکرارپذیر برای GPUها است یا صرفاً ظرفیت کمی را قبل از راهاندازی به دست میآورد.
انتشار رفلکشن همچنین انتظار میرود در همان ماهی که سایر انتشارهای مدل وزن باز از بازیگران غربی انجام میشود، قرار گیرد و فشار رقابتی بر قیمتگذاری، مجوزها و بستهبندی شرکتی اضافه کند. اگر چندین گزینه وزن باز معتبر غربی در یک بازه زمانی تنگ وارد شوند، تمایز ممکن است از کیفیت خام مدل به ارگونومی استقرار، پشتیبانی و محاسبات تضمین شده تغییر کند.
خوانش من: دسترسی به محاسبات واقعاً حصار است—تا زمانی که مشخصات مدل خلاف آن را ثابت کند
بخشی که تعیین میکند آیا Reflection برای مؤسسات اهمیت دارد یا نه، برچسب "وزن باز" نیست، بلکه این است که آیا شرکت میتواند یک استک قابل استفاده تحت محدودیتهای واقعی ارائه دهد: مجوزی که اجازه استقرار داخلی را میدهد و ظرفیت کافی Nvidia برای پشتیبانی از تنظیم دقیق و استنتاج بدون انتظار در صف. اجارههای Nebius و SpaceX به نظر میرسد تلاشی برای تبدیل وزن باز به چیزی است که واقعاً میتوان خریداری کرد.
آستانهای که اهمیت دارد ساده است: اگر معیارها و ارزیابیهای شخص ثالث مدل را تقریباً در جایی که منابع انتظار دارند قرار دهند و مجوز دوستانه با کسبوکار باشد، Reflection میتواند تقاضا را از فروشگاههای غربی که میخواهند سیستمهای وزن باز غیرچینی داشته باشند، جذب کند حتی اگر در خط مقدم نباشد. اگر مدل از آن باند کمتر عمل کند یا شرایط مجوز و محاسبات خیلی سختگیرانه باشد، پیشنهاد کارخانه هوش مصنوعی به "فقط یک فایل مدل دیگر" برمیگردد.