Four people working on laptops in a dimly lit
هوش مصنوعی

متا و انویدیا مدل‌های هوش مصنوعی را همزمان عرضه کردند

موز گلیمر و نموترون ۳.۵ لایتنینگ پس از نامه‌ای از صنعت در تاریخ ۲۴ ژوئیه که خواستار عدم وجود "محدودیت‌های زودهنگام" بر وزن‌های باز بود، فرود آمدند.

نوشته Elliot Marsh7 دقیقه مطالعه

متا و انویدیا مدل‌های هوش مصنوعی با وزن آزاد را در تاریخ ۱۰ و ۱۱ اوت منتشر کردند و آن‌ها را به عنوان دانلودهای رایگان برای توسعه‌دهندگان در بازاری که توسط رهبران مالکیتی ایالات متحده و استک‌های باز محبوب چینی تسلط یافته است، معرفی کردند.

این انتشارها چند هفته پس از آن صورت می‌گیرد که بیش از ۲۰ شرکت فناوری آمریکایی از سیاست‌گذاران خواسته بودند تا از "محدودیت‌های زودهنگام" بر روی مدل‌های با وزن آزاد اجتناب کنند و این بحث را به یک مسابقه پذیرش تبدیل کردند.

نکات کلیدی

  • متا در تاریخ ۱۰ اوت Muse Glimmer را منتشر کرد و انویدیا در تاریخ ۱۱ اوت با Nemotron 3.5 Lightning به دنبال آن آمد، هر دو به عنوان گزینه‌های رایگان و قابل دانلود با وزن آزاد برای توسعه‌دهندگان توزیع شدند.
  • مدیرعامل متا، مارک زاکربرگ، اعلام کرد که متا وزن‌ها را برای Muse Spark 1.2 باز خواهد کرد، که "وزن‌ها" به عنوان محاسبات و قوانینی توصیف شده‌اند که تعیین می‌کنند هوش مصنوعی چگونه کار می‌کند و رفتار می‌کند.
  • انیدیا انتشار خود را به عنوان "واقعاً متن باز" معرفی کرد و "داده‌های آموزشی، تکنیک‌ها و وزن‌های مدل" را منتشر کرد، نه فقط فایل‌های مدل.
  • یک نامه سرگشاده در تاریخ ۲۴ ژوئیه که توسط بیش از ۲۰ شرکت فناوری آمریکایی امضا شده بود، نسبت به "محدودیت‌های زودهنگام" بر روی مدل‌های وزن باز هشدار داد و تقطیر را "یک تکنیک به‌طور گسترده‌ای مورد استفاده برای بهبود، ارزیابی و اعتبارسنجی مدل" نامید.

متا و انویدیا مدل‌های وزن باز را در عرض ۴۸ ساعت منتشر کردند

متا و انویدیا در این هفته به ترتیب در روزهای متوالی نسخه‌های هوش مصنوعی با وزن آزاد را منتشر کردند، به طوری که متا در تاریخ ۱۰ اوت Muse Glimmer را معرفی کرد و انویدیا در تاریخ ۱۱ اوت Nemotron 3.5 Lightning را به نمایش گذاشت.

هر دو به عنوان مدل‌هایی معرفی شدند که توسعه‌دهندگان می‌توانند به صورت رایگان از طریق اکوسیستم منبع باز دانلود کنند، وضعیتی که با الگوی دسترسی اختصاصی غالب در ایالات متحده که در آن توسعه‌دهندگان مدل‌ها را از طریق میزبانی مصرف می‌کنند، در تضاد است.APIها.

هدف رقابتی صریح است. این انتشارها به عنوان بخشی از یک تلاش گسترده‌تر ایالات متحده برای رقابت با مدل‌های محبوب وزن باز از آزمایشگاه‌های چینی از جمله Moonshot AI و DeepSeek و همچنین Qwen علی‌بابا، در حالی که یک جایگزین برای "مدل‌های محبوب اختصاصی" از OpenAI و Anthropic ارائه می‌دهد، چارچوب‌بندی شده‌اند.

این زمان‌بندی مهم است زیرا یک استدلال سیاستی را به یک استدلال محصول تبدیل می‌کند. نامه‌ای از صنعت در تاریخ ۲۴ ژوئیه از سیاستگذاران خواسته است که "محدودیت‌های زودهنگام" را بر روی مدل‌های وزن باز تحمیل نکنند، حتی اگر منشا آن‌ها در چین باشد. متا و انویدیا با ارسال گزینه‌های قابل دانلود ایالات متحده، به طور مؤثر از توسعه‌دهندگان و شرکت‌ها خواسته‌اند که یک استک باز داخلی را انتخاب کنند و نه فقط به بحث در مورد یکی بپردازند.

این هفته "وزن باز" به چه معناست: Muse Glimmer، Muse Spark 1.2 و Nemotron 3.5 Lightning

"وزن باز" باریک‌تر از "منبع باز" است و تمایز نقطه انتشارهای این هفته است. در این چارچوب، وزن باز به این معناست که توسعه‌دهندگان می‌توانند مدل را با پارامترهای آموخته شده دانلود و اجرا کنند، نه فقط از طریق یک API میزبانی شده آن را فراخوانی کنند. "وزن‌ها" پارامترهای داخلی هستند که در اینجا به عنوان محاسبات و قوانینی توصیف شده‌اند که تعیین می‌کنند چگونه AI پس از آموزش کار می‌کند و رفتار می‌کند.

محصول ارسال شده متا Muse Glimmer است که به عنوان بخشی از یک استراتژی برای قرار دادن قدرتمندترین مدل‌های AI خود در جامعه منبع باز منتشر شده است. زاکربرگ همچنین اعلام کرد که متا وزن‌ها را برای Muse Spark 1.2 باز خواهد کرد، که به عنوان مدل بالاتر در خط Muse قرار دارد. مدیرعامل باکس، آرون لِوی، برنامه زاکربرگ را "یک موضوع بسیار بزرگ" نامید و افزود: "پرچم بسیار محکمی در زمین وجود دارد که آمریکا مدل‌های منبع باز نزدیک به مرز خواهد داشت."

لِوی همچنین استدلال کرد که Muse Spark 1.2 می‌تواند با مدل‌های پایه برتر از Anthropic و OpenAI رقابت کند، هرچند که هیچ داده‌ای از معیارها در متن منبع ارائه نشده است.

انتشار انویدیا Nemotron 3.5 Lightning است که به عنوان بخشی از خانواده Nemotron 3 که در دسامبر منتشر شده توصیف شده است. انویدیا سعی دارد استانداردهای "باز" را بالا ببرد و ادعا کند که مدل‌هایش "واقعاً منبع باز" هستند، زیرا "داده‌های آموزشی، تکنیک‌ها و وزن‌های مدل" را برای بازرسی منتشر می‌کند.

این وعده‌ای متفاوت از "این‌ها وزن‌ها هستند" است و به توسعه‌دهندگانی که به قابلیت بازتولید، قابلیت حسابرسی و نحوه به دست آوردن رفتارهای یک مدل اهمیت می‌دهند، هدف‌گذاری شده است.

هر دو شرکت همچنین انتشارها را به سمت یک شکل خاص از استقرار هدایت می‌کنند: مدل‌های کوچکتر که برای اجرا بر روی لپ‌تاپ‌ها طراحی شده‌اند و برای وظایفی مانند قدرت دادن به عوامل دیجیتال در دستگاه‌ها ارائه شده‌اند. این یک شکاف عملی در برابر مدل‌های فقط API است و همچنین یک شکاف در برابر نگرانی‌های مربوط به ریسک‌های فرامرزی است که در آن شرکت‌ها می‌خواهند کنترل محلی بر داده‌ها و استنتاج داشته باشند.

فشار سیاستی با واقعیت محصول ملاقات می‌کند: نامه ۲۴ ژوئیه و مبارزه تقطیر

زمینه سیاستی انتزاعی نیست. AI وزن باز در سیلیکون ولی و واشنگتن دی‌سی به موضوعی بحث‌برانگیز تبدیل شده است و منتقدان نگرانی‌های امنیت ملی را در مورد مدل‌های چینی و همچنین تقطیر، یک تکنیک آموزشی AI که می‌تواند به عنوان نوعی سرقت مالکیت معنوی در نظر گرفته شود، مطرح کرده‌اند.

نامه عمومی ۲۴ ژوئیه از بیش از ۲۰ شرکت فناوری ایالات متحده موضع مخالفی را اتخاذ کرده و سعی کرده است با چارچوب‌بندی وزن‌های باز به عنوان حامی رقابت و رهبری، از تنظیم مقررات پیشی بگیرد. "عصر AI می‌تواند یکی از شکوفایی باشد"، این نامه گفت.

"با انتخاب‌های درست، AI وزن باز می‌تواند فرصت‌ها را گسترش دهد، رقابت را تقویت کند، رهبری فناوری آمریکایی را گسترش دهد، ریسک را کاهش دهد و اطمینان حاصل کند که مزایای این فناوری فوق‌العاده به طور گسترده‌ای در اقتصاد ما به اشتراک گذاشته می‌شود." در مورد تقطیر، همان نامه آن را به عنوان "یک تکنیک به‌طور گسترده‌ای استفاده شده برای بهبود مدل، ارزیابی و اعتبارسنجی" توصیف کرده است.

این جایی است که انتشارها به یک آزمون اعتبار تبدیل می‌شوند. متا و انویدیا به طور مؤثری استدلال می‌کنند که توزیع وزن‌های باز نه تنها یک ترجیح تحقیقاتی است، بلکه یک کانال پذیرش است که می‌تواند به طور ایمن مدیریت و استفاده شود.

لِوی این را به طور مستقیم به استقرارهای تنظیم‌شده مرتبط کرد و گفت: "شما احتمالاً نمی‌توانید یک مدل متن‌باز غیر داخلی را به عنوان مثال در یک نهاد دولتی بزرگ قرار دهید و احتمالاً نمی‌توانید از آن در بانک‌های بسیار بزرگ استفاده کنید،" و افزود که موز "مقدار زیادی پتانسیل را باز می‌کند."

نکته این است که بازار هنوز باید خود را نشان دهد. متن منبع اشاره می‌کند که هر دو شرکت هنوز باید ثابت کنند که برای پیشنهادات خود در بازاری که مدل‌های باز چینی در آن محبوب هستند، مخاطبی وجود دارد.

سیگنال‌ها برای معامله‌گران کریپتو: مدل‌های باز، عوامل درون‌دستگاهی و روایت 'هزینه توکن'

برای معامله‌گران کریپتو، سیگنال فوری این نیست که "AI اکنون باز است،" بلکه این است که مبارزه سیاست مدل باز به معیارهای پذیرش قابل اندازه‌گیری تحمیل شده است. اگر این انتشارها به موفقیت برسند، تابلو امتیاز در رفتار توسعه‌دهندگان قابل مشاهده خواهد بود: دانلودها، انشعابات، ابزارهای جامعه و اینکه آیا شرکت‌ها وزن‌های باز داخلی را به عنوان یک جایگزین سازگار با قوانین برای انباشت‌های باز غیر داخلی در نظر می‌گیرند.

نقطه عطف بعدی مشخص این است که آیا متا به وعده خود برای باز کردن وزن‌ها برای موز اسپارک 1.2 عمل می‌کند و تحت چه مجوز و شرایطی. برنامه اعلام شده زاکربرگ یک تعهد جهت‌دار است، اما بازار قیمت واقعی اثر و محدودیت‌های آن را تعیین خواهد کرد.

موضع "واقعاً متن‌باز" انویدیا همچنین انتظارات بالاتری را برای آنچه که به عنوان "باز" در AI محسوب می‌شود، تعیین می‌کند، که می‌تواند به روایت‌های توکن حول AI غیرمتمرکز و محاسبات DePIN سرایت کند. اگر توسعه‌دهندگان شروع به درخواست قابلیت بازرسی فراتر از وزن‌ها کنند، پروژه‌هایی که فقط وزن‌ها را بدون منبع منعکس می‌کنند، نازک‌تر به نظر خواهند رسید.

رشته دیگری که معامله‌گران شناسایی خواهند کرد، هزینه است. مدیرعامل یونیفور، اومش سچدو گفت که متا پل‌ها را سوزاند زمانی که از وزن‌های باز به مدل‌های اختصاصی منتقل شد و هشدار داد: "فکر می‌کنم بیش از یک مقاله ۳۵۰۰ کلمه‌ای از زاک برای متقاعد کردن توسعه‌دهندگان نیاز است،" و افزود که توسعه‌دهندگان یونیفور "تقریباً احساس خیانت می‌کنند."

با این حال، سچدو گفت که او برای موفقیت شرکت‌های داخلی دعا می‌کند "زیرا رقابت بیشتر هزینه توکن را کاهش می‌دهد و نوآوری را افزایش می‌دهد و همیشه برای مصرف‌کنندگان خوب است." اگر گزینه‌های وزن باز ایالات متحده به جایگزین‌های معتبر تبدیل شوند، "استنتاج ارزان‌تر" دیگر یک شعار نخواهد بود و به یک محدودیت رقابتی تبدیل خواهد شد.

سیاست همچنان ورق برنده است. نامه ۲۴ ژوئیه خواستار عدم وجود "محدودیت‌های زودهنگام" بود، اما متن منبع مشخص نمی‌کند که چه محدودیت‌هایی ممکن است پیشنهاد شود یا در چه زمانی. هر پیشنهاد مشخص ایالات متحده که به تقطیر، مجوز یا توزیع مربوط می‌شود، بلافاصله قیمت‌گذاری مجدد خواهد کرد که کدام انباشت‌های باز در زمینه‌های تنظیم‌شده قابل استفاده هستند.

خوانش من: این یک بازنشانی 'باز' ایالات متحده است—اما بازار خواستار اثبات دوام اکوسیستم خواهد بود.

آستانه‌ای که اهمیت دارد این است که آیا این انتشارها یک روایت نظارتی را به جاذبه پایدار توسعه‌دهندگان تبدیل می‌کنند یا خیر. ارسال مدل‌های رایگان برای دانلود بلافاصله پس از نامه ۲۴ ژوئیه یک تاکتیک تمیز است، اما تنها در صورتی کار می‌کند که توسعه‌دهندگان واقعاً بر روی آن‌ها بسازند و شرکت‌ها "وزن‌های باز داخلی" را به عنوان یک دسته قابل استقرار در نظر بگیرند نه یک نقطه گفت‌وگو.

انویدیا همچنین به آرامی در حال تغییر اهداف است و می‌گوید "منبع باز واقعی" به معنای انتشار "داده‌های آموزشی، تکنیک‌ها و وزن‌های مدل" است.

اگر این انتظار پابرجا بماند، رقابت مدل‌های باز کمتر به این بستگی دارد که چه کسی زودتر وزن‌ها را منتشر می‌کند و بیشتر به این بستگی دارد که چه کسی می‌تواند یک خط لوله قابل بازرسی را که توسعه‌دهندگان به آن اعتماد دارند، حفظ کند، که شرطی است که باعث می‌شود بازنشانی باز ایالات متحده در این هفته از نظر عملی اهمیت پیدا کند.

منابع