
OpenAI بیش از ۳۷۰ نتیجه ریاضی را منتشر کرد؛ هشدار IAS
OpenAI اعلام کرد که با مؤسسه مطالعات پیشرفته همکاری خواهد کرد، اما به توقف آزمایش مشکلات مرزی بر روی مدلهای بسته متعهد نشد.
OpenAI بیش از ۳۷۰ نتیجه ریاضی در زمینههایی از جمله جبر، علوم کامپیوتر نظری و منطق ریاضی منتشر کرد و خروجی تحقیق مدلهای پیشرفته خود را در معرض دید عموم قرار داد. این انتشار، مبارزهای در مورد حکمرانی را تشدید کرده است که آیا مدلهای مرزی مالکیتی میتوانند اثباتهایی تولید کنند که جامعه ریاضی گستردهتر قادر به دسترسی، تأیید یا مسئولیتپذیری برای آنها نیست.
انتشار نتایج ریاضی بیش از ۳۷۰ OpenAI توجه به تأیید را در کانون توجه قرار میدهد
OpenAI بیش از ۳۷۰ نتیجه ریاضی منتشر کرد که شامل جبر، علوم کامپیوتر نظری و منطق ریاضی است. این انتشار در سایه ادعای با پروفایل بالاتر از ماه گذشته قرار گرفت، زمانی که OpenAI گفت معادله ناویر-استوکس را حل کرده است، یک مسئله بنیادی در دینامیک سیالات که به عنوان یک جایزه ۱ میلیون دلاری برای یک راهحل صحیح توصیف شده است.
از نظر مکانیکی، تنش ساده است: آزمایشگاههای مرزی میتوانند مسائل پیشرفته را از طریق مدلهایی که افراد خارج از آن نمیتوانند به راحتی به آنها دسترسی یا بازرسی کنند، اجرا کنند و سپس خروجیهایی منتشر کنند که شبیه نتایج تحقیق به نظر میرسند.
این به عنوان یک نمایش قابلیت عمل میکند، اما همچنین تأیید را به یک سؤال حکمرانی تبدیل میکند، زیرا جامعهای که از آن خواسته میشود کار را تأیید کند ممکن است ابزارها، دسترسی به مدل یا قابلیت ردیابی لازم برای بازتولید آن را نداشته باشد.
مقاومت فوری در مورد این نیست که آیا "۳۷۰" یک عدد بزرگ است. این در مورد این است که آیا خط لولهای که این نتایج را تولید کرده است به اندازه کافی قابل فهم برای بررسی مستقل است و آیا مشوقهای یک آزمایشگاه خصوصی با هنجارهای دقت لازم که ادعاهای ریاضی را پایدار میکند، همراستا است.
IAS و ریاضیدانان خطرات اصلی را پرچمگذاری میکنند: اثباتهای غیرقابل تأیید، مسئولیت و دسترسی
مؤسسه مطالعات پیشرفته (IAS) در پرینستون، نیوجرسی، گفت که از عمل آزمایشگاههای مرزی که مسائل ریاضی پیشرفته را بر روی مدلهای AI مالکیتی که برای جامعه ریاضی گستردهتر قابل دسترسی نیستند، حمایت نمیکند. اعتراض آن به عنوان یک شکاف مسئولیتی که توسط خروجیهای مدل ایجاد میشود که میتواند از درک انسانی فراتر رود، چارچوببندی شده است.
IAS گفت: "اکنون اینگونه است که AI میتواند استدلالهای ریاضی را در شرایطی خروجی دهد که انسانهایی که آن را تحریک کردهاند قادر به درک، تأیید یا مسئولیتپذیری برای آنها نیستند." این مؤسسه افزود: "ما معتقدیم که درک انسانی از ریاضیات از اهمیت بالایی برخوردار است. چگونه، در این عصر جدید، میتوانیم به سوی یک پارادایم جدید حرکت کنیم که شامل درک انسانی از ریاضیات به عنوان بخشی از خروجی علمی مسئولانه باشد؟"
یک خط fault جداگانه، منشاء است، نه فقط درستی. ریاضیدان NYU، تریستان باکمستر هشدار داد که عمل تحریک میتواند خود اطلاعات کلیدی را تزریق کند و جایی که "نتیجه" از آن آمده و چه کسی مستحق اعتبار است را مبهم کند.
باکمستر همچنین خطر این را مطرح کرد که کارهای کمکشده با مدل میتواند به طور مؤثری ایدهای را که شخص دیگری به طور جزئی توسعه داده است، به پایان برساند: "احتمالاً تعدادی نتیجه وجود دارد که آنها کار کسی را میگیرند و سپس آن را به اتمام میرسانند."
یک هیئت مشورتی همچنین از آزمایشگاههای AI خواست تا "دسترسی عادلانه" به مدلهای AI خود را به جامعه جهانی ریاضیات اعطا کنند و استدلال کردند که سیستمهای داخلی بسته خطر تقسیم این حوزه به دارندگان و نداشتگان را دارد. "استفاده از مدلهای داخلی مالکیتی توسط آزمایشگاههای AI برای انجام تحقیقات ریاضی خطر ایجاد یک سیستم دو سطحی را دارد که آزمایشگاهها از بقیه حوزه جلوتر میافتند و به طور مؤثر جامعه ریاضی را از رشته خود بیگانه میکنند،" این گروه نوشت.
چه چیزی سیگنالهای Outreach IAS OpenAI برای حکمرانی مدلهای مرزی را نشان میدهد
پاسخ OpenAI تعامل بود، نه عقبنشینی. این شرکت گفت که با IAS همکاری خواهد کرد تا "ریاضیدانان صدایی در نحوه پیشرفت ما داشته باشند"، اما اشارهای نکرد که آزمایش مدلهای هوش مصنوعی خود را با مسائل ریاضی پیشرفته متوقف خواهد کرد.
این موضوع اختلاف اصلی را زنده نگه میدارد: آیا تحقیقات مدلهای مرزی میتواند به عنوان علم جامعه بدون دسترسی جامعه در نظر گرفته شود یا خیر. سیگنال مشخص بعدی، چارچوبی منتشر شده خواهد بود که مشخص میکند چه کسی شرکت میکند، چه چیزی بررسی میشود و در چه زمانی، زیرا "صدا" بدون دامنه کنترل نیست.
دو نقطه عطف دیگر برای چگونگی حل این داستان اهمیت دارد. یکی این است که آیا OpenAI یا سایر آزمایشگاههای مرزی به سمت استاندارد "دسترسی عادلانه" که هیئت مشورتی خواستار آن بود، حرکت میکنند که به طور مستقیم دینامیک دو سطحی را کاهش میدهد.
دیگری وضعیت تأیید است: منبع مطالب تأسیس تکرار مستقل یا بررسی همتا برای بیش از 370 نتیجه یا برای ادعای Navier–Stokes را مشخص نمیکند، بنابراین هرگونه بهروزرسانی در قابلیت تکرار و مسیرهای بررسی وزن بیشتری نسبت به یک عدد سرخط دیگر خواهد داشت.
نظر من: برای معاملهگران، این یک کاتالیزور روایت اعتماد به هوش مصنوعی است، نه یک پیشرفت ریاضی که بتوانید هنوز قیمتگذاری کنید
بخشی که بازارها را در اینجا حرکت میدهد این نیست که آیا یک مدل بسته میتواند صدها نتیجه ریاضی تولید کند یا خیر. این IAS است که خط روشنی در برابر آزمایشگاههای مرزی که مسائل پیشرفته را بر روی سیستمهایی که میدان وسیعتر نمیتواند به آنها دسترسی پیدا کند، ترسیم میکند، زیرا این موضوع "قابلیت" را به یک مشکل حکمرانی و مشروعیت تبدیل میکند که میتواند به احساسات توکنهای هوش مصنوعی سرایت کند.
آستانهای که اهمیت دارد این است که آیا OpenAI و IAS Outreach را به یک چارچوب تأیید و دسترسی مشخص تبدیل میکنند و آیا هر یک از بیش از 370 نتیجه یا ادعای Navier–Stokes یک مسیر تأیید مستقل دارد که افراد خارج از آن میتوانند واقعاً اجرا کنند. اگر این اتفاق بیفتد، داستان از ریسک روایت به فرآیند قابل اندازهگیری تغییر میکند و این چیزی است که از نظر عملی اهمیت دارد.