
متا و انویدیا مدلهای هوش مصنوعی را همزمان عرضه کردند
موز گلیمر و نموترون ۳.۵ لایتنینگ پس از نامهای از صنعت در تاریخ ۲۴ ژوئیه که خواستار عدم وجود "محدودیتهای زودهنگام" بر وزنهای باز بود، فرود آمدند.
متا و انویدیا مدلهای هوش مصنوعی با وزن آزاد را در تاریخ ۱۰ و ۱۱ اوت منتشر کردند و آنها را به عنوان دانلودهای رایگان برای توسعهدهندگان در بازاری که توسط رهبران مالکیتی ایالات متحده و استکهای باز محبوب چینی تسلط یافته است، معرفی کردند.
این انتشارها چند هفته پس از آن صورت میگیرد که بیش از ۲۰ شرکت فناوری آمریکایی از سیاستگذاران خواسته بودند تا از "محدودیتهای زودهنگام" بر روی مدلهای با وزن آزاد اجتناب کنند و این بحث را به یک مسابقه پذیرش تبدیل کردند.
نکات کلیدی
- متا در تاریخ ۱۰ اوت Muse Glimmer را منتشر کرد و انویدیا در تاریخ ۱۱ اوت با Nemotron 3.5 Lightning به دنبال آن آمد، هر دو به عنوان گزینههای رایگان و قابل دانلود با وزن آزاد برای توسعهدهندگان توزیع شدند.
- مدیرعامل متا، مارک زاکربرگ، اعلام کرد که متا وزنها را برای Muse Spark 1.2 باز خواهد کرد، که "وزنها" به عنوان محاسبات و قوانینی توصیف شدهاند که تعیین میکنند هوش مصنوعی چگونه کار میکند و رفتار میکند.
- انیدیا انتشار خود را به عنوان "واقعاً متن باز" معرفی کرد و "دادههای آموزشی، تکنیکها و وزنهای مدل" را منتشر کرد، نه فقط فایلهای مدل.
- یک نامه سرگشاده در تاریخ ۲۴ ژوئیه که توسط بیش از ۲۰ شرکت فناوری آمریکایی امضا شده بود، نسبت به "محدودیتهای زودهنگام" بر روی مدلهای وزن باز هشدار داد و تقطیر را "یک تکنیک بهطور گستردهای مورد استفاده برای بهبود، ارزیابی و اعتبارسنجی مدل" نامید.
متا و انویدیا مدلهای وزن باز را در عرض ۴۸ ساعت منتشر کردند
متا و انویدیا در این هفته به ترتیب در روزهای متوالی نسخههای هوش مصنوعی با وزن آزاد را منتشر کردند، به طوری که متا در تاریخ ۱۰ اوت Muse Glimmer را معرفی کرد و انویدیا در تاریخ ۱۱ اوت Nemotron 3.5 Lightning را به نمایش گذاشت.
هر دو به عنوان مدلهایی معرفی شدند که توسعهدهندگان میتوانند به صورت رایگان از طریق اکوسیستم منبع باز دانلود کنند، وضعیتی که با الگوی دسترسی اختصاصی غالب در ایالات متحده که در آن توسعهدهندگان مدلها را از طریق میزبانی مصرف میکنند، در تضاد است.APIها.
هدف رقابتی صریح است. این انتشارها به عنوان بخشی از یک تلاش گستردهتر ایالات متحده برای رقابت با مدلهای محبوب وزن باز از آزمایشگاههای چینی از جمله Moonshot AI و DeepSeek و همچنین Qwen علیبابا، در حالی که یک جایگزین برای "مدلهای محبوب اختصاصی" از OpenAI و Anthropic ارائه میدهد، چارچوببندی شدهاند.
این زمانبندی مهم است زیرا یک استدلال سیاستی را به یک استدلال محصول تبدیل میکند. نامهای از صنعت در تاریخ ۲۴ ژوئیه از سیاستگذاران خواسته است که "محدودیتهای زودهنگام" را بر روی مدلهای وزن باز تحمیل نکنند، حتی اگر منشا آنها در چین باشد. متا و انویدیا با ارسال گزینههای قابل دانلود ایالات متحده، به طور مؤثر از توسعهدهندگان و شرکتها خواستهاند که یک استک باز داخلی را انتخاب کنند و نه فقط به بحث در مورد یکی بپردازند.
این هفته "وزن باز" به چه معناست: Muse Glimmer، Muse Spark 1.2 و Nemotron 3.5 Lightning
"وزن باز" باریکتر از "منبع باز" است و تمایز نقطه انتشارهای این هفته است. در این چارچوب، وزن باز به این معناست که توسعهدهندگان میتوانند مدل را با پارامترهای آموخته شده دانلود و اجرا کنند، نه فقط از طریق یک API میزبانی شده آن را فراخوانی کنند. "وزنها" پارامترهای داخلی هستند که در اینجا به عنوان محاسبات و قوانینی توصیف شدهاند که تعیین میکنند چگونه AI پس از آموزش کار میکند و رفتار میکند.
محصول ارسال شده متا Muse Glimmer است که به عنوان بخشی از یک استراتژی برای قرار دادن قدرتمندترین مدلهای AI خود در جامعه منبع باز منتشر شده است. زاکربرگ همچنین اعلام کرد که متا وزنها را برای Muse Spark 1.2 باز خواهد کرد، که به عنوان مدل بالاتر در خط Muse قرار دارد. مدیرعامل باکس، آرون لِوی، برنامه زاکربرگ را "یک موضوع بسیار بزرگ" نامید و افزود: "پرچم بسیار محکمی در زمین وجود دارد که آمریکا مدلهای منبع باز نزدیک به مرز خواهد داشت."
لِوی همچنین استدلال کرد که Muse Spark 1.2 میتواند با مدلهای پایه برتر از Anthropic و OpenAI رقابت کند، هرچند که هیچ دادهای از معیارها در متن منبع ارائه نشده است.
انتشار انویدیا Nemotron 3.5 Lightning است که به عنوان بخشی از خانواده Nemotron 3 که در دسامبر منتشر شده توصیف شده است. انویدیا سعی دارد استانداردهای "باز" را بالا ببرد و ادعا کند که مدلهایش "واقعاً منبع باز" هستند، زیرا "دادههای آموزشی، تکنیکها و وزنهای مدل" را برای بازرسی منتشر میکند.
این وعدهای متفاوت از "اینها وزنها هستند" است و به توسعهدهندگانی که به قابلیت بازتولید، قابلیت حسابرسی و نحوه به دست آوردن رفتارهای یک مدل اهمیت میدهند، هدفگذاری شده است.
هر دو شرکت همچنین انتشارها را به سمت یک شکل خاص از استقرار هدایت میکنند: مدلهای کوچکتر که برای اجرا بر روی لپتاپها طراحی شدهاند و برای وظایفی مانند قدرت دادن به عوامل دیجیتال در دستگاهها ارائه شدهاند. این یک شکاف عملی در برابر مدلهای فقط API است و همچنین یک شکاف در برابر نگرانیهای مربوط به ریسکهای فرامرزی است که در آن شرکتها میخواهند کنترل محلی بر دادهها و استنتاج داشته باشند.
فشار سیاستی با واقعیت محصول ملاقات میکند: نامه ۲۴ ژوئیه و مبارزه تقطیر
زمینه سیاستی انتزاعی نیست. AI وزن باز در سیلیکون ولی و واشنگتن دیسی به موضوعی بحثبرانگیز تبدیل شده است و منتقدان نگرانیهای امنیت ملی را در مورد مدلهای چینی و همچنین تقطیر، یک تکنیک آموزشی AI که میتواند به عنوان نوعی سرقت مالکیت معنوی در نظر گرفته شود، مطرح کردهاند.
نامه عمومی ۲۴ ژوئیه از بیش از ۲۰ شرکت فناوری ایالات متحده موضع مخالفی را اتخاذ کرده و سعی کرده است با چارچوببندی وزنهای باز به عنوان حامی رقابت و رهبری، از تنظیم مقررات پیشی بگیرد. "عصر AI میتواند یکی از شکوفایی باشد"، این نامه گفت.
"با انتخابهای درست، AI وزن باز میتواند فرصتها را گسترش دهد، رقابت را تقویت کند، رهبری فناوری آمریکایی را گسترش دهد، ریسک را کاهش دهد و اطمینان حاصل کند که مزایای این فناوری فوقالعاده به طور گستردهای در اقتصاد ما به اشتراک گذاشته میشود." در مورد تقطیر، همان نامه آن را به عنوان "یک تکنیک بهطور گستردهای استفاده شده برای بهبود مدل، ارزیابی و اعتبارسنجی" توصیف کرده است.
این جایی است که انتشارها به یک آزمون اعتبار تبدیل میشوند. متا و انویدیا به طور مؤثری استدلال میکنند که توزیع وزنهای باز نه تنها یک ترجیح تحقیقاتی است، بلکه یک کانال پذیرش است که میتواند به طور ایمن مدیریت و استفاده شود.
لِوی این را به طور مستقیم به استقرارهای تنظیمشده مرتبط کرد و گفت: "شما احتمالاً نمیتوانید یک مدل متنباز غیر داخلی را به عنوان مثال در یک نهاد دولتی بزرگ قرار دهید و احتمالاً نمیتوانید از آن در بانکهای بسیار بزرگ استفاده کنید،" و افزود که موز "مقدار زیادی پتانسیل را باز میکند."
نکته این است که بازار هنوز باید خود را نشان دهد. متن منبع اشاره میکند که هر دو شرکت هنوز باید ثابت کنند که برای پیشنهادات خود در بازاری که مدلهای باز چینی در آن محبوب هستند، مخاطبی وجود دارد.
سیگنالها برای معاملهگران کریپتو: مدلهای باز، عوامل دروندستگاهی و روایت 'هزینه توکن'
برای معاملهگران کریپتو، سیگنال فوری این نیست که "AI اکنون باز است،" بلکه این است که مبارزه سیاست مدل باز به معیارهای پذیرش قابل اندازهگیری تحمیل شده است. اگر این انتشارها به موفقیت برسند، تابلو امتیاز در رفتار توسعهدهندگان قابل مشاهده خواهد بود: دانلودها، انشعابات، ابزارهای جامعه و اینکه آیا شرکتها وزنهای باز داخلی را به عنوان یک جایگزین سازگار با قوانین برای انباشتهای باز غیر داخلی در نظر میگیرند.
نقطه عطف بعدی مشخص این است که آیا متا به وعده خود برای باز کردن وزنها برای موز اسپارک 1.2 عمل میکند و تحت چه مجوز و شرایطی. برنامه اعلام شده زاکربرگ یک تعهد جهتدار است، اما بازار قیمت واقعی اثر و محدودیتهای آن را تعیین خواهد کرد.
موضع "واقعاً متنباز" انویدیا همچنین انتظارات بالاتری را برای آنچه که به عنوان "باز" در AI محسوب میشود، تعیین میکند، که میتواند به روایتهای توکن حول AI غیرمتمرکز و محاسبات DePIN سرایت کند. اگر توسعهدهندگان شروع به درخواست قابلیت بازرسی فراتر از وزنها کنند، پروژههایی که فقط وزنها را بدون منبع منعکس میکنند، نازکتر به نظر خواهند رسید.
رشته دیگری که معاملهگران شناسایی خواهند کرد، هزینه است. مدیرعامل یونیفور، اومش سچدو گفت که متا پلها را سوزاند زمانی که از وزنهای باز به مدلهای اختصاصی منتقل شد و هشدار داد: "فکر میکنم بیش از یک مقاله ۳۵۰۰ کلمهای از زاک برای متقاعد کردن توسعهدهندگان نیاز است،" و افزود که توسعهدهندگان یونیفور "تقریباً احساس خیانت میکنند."
با این حال، سچدو گفت که او برای موفقیت شرکتهای داخلی دعا میکند "زیرا رقابت بیشتر هزینه توکن را کاهش میدهد و نوآوری را افزایش میدهد و همیشه برای مصرفکنندگان خوب است." اگر گزینههای وزن باز ایالات متحده به جایگزینهای معتبر تبدیل شوند، "استنتاج ارزانتر" دیگر یک شعار نخواهد بود و به یک محدودیت رقابتی تبدیل خواهد شد.
سیاست همچنان ورق برنده است. نامه ۲۴ ژوئیه خواستار عدم وجود "محدودیتهای زودهنگام" بود، اما متن منبع مشخص نمیکند که چه محدودیتهایی ممکن است پیشنهاد شود یا در چه زمانی. هر پیشنهاد مشخص ایالات متحده که به تقطیر، مجوز یا توزیع مربوط میشود، بلافاصله قیمتگذاری مجدد خواهد کرد که کدام انباشتهای باز در زمینههای تنظیمشده قابل استفاده هستند.
خوانش من: این یک بازنشانی 'باز' ایالات متحده است—اما بازار خواستار اثبات دوام اکوسیستم خواهد بود.
آستانهای که اهمیت دارد این است که آیا این انتشارها یک روایت نظارتی را به جاذبه پایدار توسعهدهندگان تبدیل میکنند یا خیر. ارسال مدلهای رایگان برای دانلود بلافاصله پس از نامه ۲۴ ژوئیه یک تاکتیک تمیز است، اما تنها در صورتی کار میکند که توسعهدهندگان واقعاً بر روی آنها بسازند و شرکتها "وزنهای باز داخلی" را به عنوان یک دسته قابل استقرار در نظر بگیرند نه یک نقطه گفتوگو.
انویدیا همچنین به آرامی در حال تغییر اهداف است و میگوید "منبع باز واقعی" به معنای انتشار "دادههای آموزشی، تکنیکها و وزنهای مدل" است.
اگر این انتظار پابرجا بماند، رقابت مدلهای باز کمتر به این بستگی دارد که چه کسی زودتر وزنها را منتشر میکند و بیشتر به این بستگی دارد که چه کسی میتواند یک خط لوله قابل بازرسی را که توسعهدهندگان به آن اعتماد دارند، حفظ کند، که شرطی است که باعث میشود بازنشانی باز ایالات متحده در این هفته از نظر عملی اهمیت پیدا کند.