Four people gathered around a glowing blue brain
هوش مصنوعی

هشدار پژوهشگر سابق Anthropic درباره خطر انقراض نزدیک به AI

هشدار "آینده نزدیک" جیکوب ککسون واکنش‌های منفی و حمایتی را به همراه داشت در حالی که آنتروپیک از یک مکانیزم قانونی و قابل تأیید برای تنظیم سرعت انتشار حمایت کرد.

نوشته Elliot Marsh6 دقیقه مطالعه

جیکوب کاکسون، پژوهشگر سابق انتروپیک، گفت که کارکنان آزمایشگاه هوش مصنوعی "واقعاً ترسیده‌اند" از سرعت پیشرفت مدل‌های مرزی و هشدار داد که احتمال "قوی" وجود دارد که بشریت "در آینده نزدیک" بدون کاهش سرعت بمیرد. انتروپیک با تأکید بر ایمنی‌ها و آزمایش‌های "تهاجمی" پاسخ داد و از یک روش قانونی و قابل تأیید برای تنظیم زمان انتشارها حمایت کرد، در حالی که رهبران برجسته هوش مصنوعی به طور علنی در مورد جدی بودن چارچوب خطر انقراض اختلاف نظر دارند.

نکات کلیدی

  • جیکوب کاکسون، پژوهشگر سابق انتروپیک، گفت که کارکنان آزمایشگاه هوش مصنوعی "واقعاً ترسیده‌اند" از سرعت پیشرفت و اینکه این می‌تواند چه معنایی برای بشریت داشته باشد.
  • کاکسون هشدار داد که بدون کاهش توسعه، "احتمال قوی وجود دارد که همه ما در آینده نزدیک بمیریم" و استدلال کرد که هر کندی واقعی نیاز به هماهنگی با چین دارد تا از یک رقابت بین‌المللی جلوگیری شود.
  • انتروپیک گفت که مدل‌هایی با "برخی از قوی‌ترین ایمنی‌ها در صنعت" می‌سازد، سیستم‌ها را "تهاجمی" آزمایش می‌کند، یافته‌ها را برای کمک به بررسی منتشر می‌کند و از یک مکانیزم قانونی و قابل تأیید برای تنظیم زمان انتشار مدل‌های قدرتمند حمایت می‌کند.
  • واکنش عمومی بین رد از سوی برخی مدیران و تأیید از درون انتروپیک تقسیم شد، از جمله ادعای اوان هابینگر که خطر انقراض "بیش از ۱۰ درصد در دهه آینده" است.

کارمند سابق انتروپیک: کارکنان "واقعاً ترسیده‌اند" در حالی که پیشرفت هوش مصنوعی تسریع می‌شود.

جیکوب کاکسون، پژوهشگر ۲۷ ساله سابق انتروپیک که قبلاً در OpenAI کار کرده بود، بحث خطرات هوش مصنوعی را با پیامی صریح به جریان اصلی بازگردانده است: افرادی که مدل‌های هوش مصنوعی مرزی می‌سازند ترسیده‌اند و فکر می‌کنند زمان کوتاه است. در یک مصاحبه در برنامه "یکشنبه با لورا کونسبرگ"، کاکسون گفت که کارکنان شرکت‌های هوش مصنوعی "واقعاً ترسیده‌اند" از سرعت پیشرفت‌ها و پیامدهای آن برای بشریت.

کاکسون این ترس را به درخواست برای تنظیم و زمان‌بندی مرتبط کرد نه به یک درخواست مبهم برای "ایمنی". او گفت: "من معتقدم که اگر در سرعت فعلی پیشرفت کاهش نداشته باشیم، احتمال قوی وجود دارد که همه ما در آینده نزدیک بمیریم."

برای بازارها، اهمیت فوری این است که آیا زمان‌بندی شخصی کاکسون درست است یا نه. این است که یک کارمند سابق در همان لحظه‌ای که رهبری انتروپیک به طور علنی برای مکانیزم‌هایی برای کاهش انتشارها استدلال می‌کند، ادعای شدید کوتاه‌مدتی را مطرح می‌کند. این ترکیب روایت‌های "زمان‌بندی"، نظارت و تنظیم را زنده نگه می‌دارد، حتی بدون لایحه جدید یا اقدام اجرایی.

موضع کوکسان برای کاهش سرعت - و چرا او می‌گوید چین باید بخشی از آن باشد

استدلال کوکسان بر اساس یک دینامیک رقابتی ساخته شده است. او گفت که کارگران هوش مصنوعی وقتی درخواست تنظیم مقررات می‌کنند، "کاملاً جدی" هستند زیرا احساس می‌کنند "در یک مسابقه گرفتار شده‌اند" و "از نتایج آن مسابقه ترس دارند." مکانیزمی که او به آن اشاره می‌کند فشار رقابتی برای استقرار است: اگر یک آزمایشگاه معتقد باشد که آزمایشگاه دیگری مدلی با قابلیت بیشتر ارائه خواهد داد، احتیاط به صورت فردی پرهزینه می‌شود حتی اگر به صورت جمعی ایمن‌تر باشد.

به همین دلیل است که کوکسان هر گونه کاهش سرعت معنادار را به عنوان یک موضوع ژئوپولیتیکی، نه فقط شرکتی، مطرح کرد. او گفت: "سم آلتمن و ایلان ماسک توافق کرده‌اند که این یک ایده عالی است. اما فکر می‌کنم اگر بخواهیم از یک مسابقه در مقیاس بین‌المللی جلوگیری کنیم، نیاز به نوعی کاهش سرعت هماهنگ با چین داریم."

او همچنین یک حالت شکست مشخص ارائه داد که به سناریویی اشاره دارد که در نظرات داریو آمودئی ذکر شده است: "گله‌ای از ربات‌ها که مانند یک ابررایانه عمل می‌کنند" و می‌توانند اینترنت را تسخیر کنند. کوکسان گفت که این سناریو می‌تواند در "شش ماه تا یک سال" واقع‌گرایانه باشد و افزود که همتایان از این می‌ترسند که خطر ممکن است در "دو سال آینده" به وجود آید.

این‌ها ارزیابی‌هایی هستند نه ادعاهایی که با شواهد فنی در بسته پشتیبانی می‌شوند، اما آنها کار روایتی انجام می‌دهند و زمان را بر روی بحث قرار می‌دهند.

مشکل در پیاده‌سازی است. "کاهش سرعت هماهنگ با چین" یک بار بالا است زیرا به تأیید و اجرای آن در ایالت‌های رقیب اشاره دارد. در عمل، این معمولاً صحبت‌های سیاست را از یک توقف کامل به سمت نظارت، استانداردها و رژیم‌های افشای اطلاعات که می‌توانند حسابرسی شوند، می‌کشاند.

پاسخ آنتروپیک: تدابیر ایمنی، آزمایش‌های "تهاجمی" و یک مکانیزم سرعت‌سنج قابل تأیید

پاسخ آنتروپیک به زمان‌بندی کوکسان تن نداد، اما دسته ریسک و نیاز به هماهنگی را تأیید کرد. یک سخنگو گفت که این شرکت "همیشه شفاف بوده است که هوش مصنوعی هم مزایای عظیم و هم خطرات بی‌سابقه‌ای به همراه خواهد داشت" و ادامه می‌دهد که مدل‌هایی با "برخی از قوی‌ترین تدابیر ایمنی در صنعت" می‌سازد.

این شرکت یک موضع ایمنی توصیف کرد که باید برای خارجی‌ها قابل درک باشد: آنها مدل‌ها را "به‌طور تهاجمی" آزمایش می‌کنند و یافته‌ها را منتشر می‌کنند تا به بررسی کمک کنند و از حوادث "عدم تطابق هوش مصنوعی"، اصطلاحی برای سیستم‌هایی که رفتارشان از آنچه انسان‌ها قصد داشتند منحرف می‌شود، جلوگیری کنند. آنتروپیک همچنین گفت که اولین شرکتی بود که چارچوبی برای کاهش خطرات ناشی از توسعه مدل‌ها منتشر کرد.

بیشترین ارتباط با بازار، تأیید صریح سرعت به عنوان یک مکانیزم صنعتی به جای یک انتخاب یک‌جانبه است. سخنگو گفت: "این کار همچنین دلیل این است که ما معتقدیم جهان از این که صنعت یک روش قانونی و قابل تأیید برای همکاری در تعیین سرعت انتشار مدل‌های قدرتمند اتخاذ کند، بهره‌مند خواهد شد."

این زبان با مقاله داریو آمودئی، "ما باید سرعت مرز را تنظیم کنیم"، که شنبه منتشر شد، هم‌راستا است. آمودئی یک طرح سه‌قسمتی پیشنهاد کرد: نظارت مستقل بر مدل‌های هوش مصنوعی در حین توسعه، تنظیم مقررات در سطح صنعت و تنظیم مقررات جهانی. نظارت مستقل، در این چارچوب، نظارت شخص ثالث در حین توسعه است و نه صرفاً تکیه بر آزمایشگاهی که سیستم را می‌سازد.

سیگنال‌هایی برای پیگیری: تقسیم اعتبار در میان رهبران AI و قلاب‌های نظارتی بعدی

تقسیم عمومی در میان رهبران AI اکنون بخشی از داستان است و این موضوع به دو طرف می‌خورد برای موقعیت‌یابی مبتنی بر روایت. مدیرعامل Hugging Face، کلمنت دلانگ، چارچوب‌بندی نظرات کوکسون درباره ریسک انقراض را مورد انتقاد قرار داد و در ایکس نوشت: "متاسفم، اما پرسیدن از جیکوب درباره ریسک انقراض AI مانند این است که از تکنسین تهویه مطبوع خود درباره تغییرات اقلیمی بپرسید."

او افزود: "نمی‌گویم که لزوماً غیرجالب یا نادرست است، اما بیایید مسائل را در چشم‌انداز نگه داریم." بعد از مقاله آمودئی، دلانگ همچنین پیشنهاد کمک به راه‌حل‌های بالقوه را داد.

مدیرعامل انویدیا، جنسن هوانگ، نیز به این موضوع واکنش نشان داد. در کنفرانس برگزار شده توسط گلدمن ساکس در هفته گذشته، چندین نفر در گروه گفتند که هوانگ نظرات کوکسون را نادرست دانسته است. هوانگ پیش‌تر گفته بود که این تصور که AI "قرار است پایان بشریت باشد" "کاملاً بی‌معنی" است.

از سوی دیگر، دانشمند آنتروپیک، اوان هوبینگر، به طور عمومی ترس اصلی را تأیید کرد. او در ایکس نوشت: "ما واقعاً به طور جدی معتقدیم که AI می‌تواند تمام انسان‌ها را بکشد! من شخصاً فکر می‌کنم که این احتمال در دهه آینده بیشتر از ۱۰٪ است."

قلاب‌های بعدی مشخص هستند، نه بیانی: اینکه آیا مفهوم نظارت مستقل آمودئی به طرف‌های ثالث نام‌گذاری شده، استانداردها یا آزمایش‌ها تبدیل می‌شود. اینکه آیا آزمایشگاه‌های بزرگ یا دولت‌ها به طور صریح یک مکانیزم "قانونی و قابل تأیید" برای زمان‌بندی تأیید یا رد می‌کنند. و اینکه آیا زبان هماهنگی بین‌المللی، به ویژه ارجاعات صریح به چین، شروع به ظهور در سخنرانی‌های سیاست‌گذاری یا نتایج اجلاس ایمنی AI می‌کند.

نشانه دیگر این است که آیا مدیران ارشد بیشتری با احتمالاتی به سبک کوکسون یا هوبینگر به صورت رسمی صحبت می‌کنند که می‌تواند این ادعا را به جریان اصلی تبدیل کند یا آن را ایزوله کند.

خوانش من: چرا این بحث هنوز می‌تواند به احساسات توکن AI سرریز شود بدون هیچ سیاست جدیدی

بخشی که این را تعیین می‌کند، جدول زمانی "آینده نزدیک" کوکسون نیست. بلکه این واقعیت است که آنتروپیک به طور همزمان از تدابیر حفاظتی خود دفاع می‌کند و خواستار یک روش قانونی و قابل تأیید برای زمان‌بندی انتشارها است که نظارت طرف ثالث و استانداردهای هماهنگ را حتی زمانی که هیچ نهاد نظارتی حرکتی نکرده، در گفتگو نگه می‌دارد.

آزمون واقعی این است که آیا "نظارت مستقل" به یک شی واقعی تبدیل می‌شود که معامله‌گران می‌توانند به آن اشاره کنند، با ناظران نام‌گذاری شده و استانداردی که می‌توان آن را بررسی کرد، نه یک درخواست عمومی برای مسئولیت. اگر این به آزمایش‌ها یا تأییدهای رسمی تبدیل شود، روایت زمان‌بندی دیگر یک چرخه رسانه‌ای نخواهد بود و شروع به شبیه شدن به یک محدودیت می‌کند که می‌تواند شکل دهد به چگونگی ارسال و بازاریابی AI مرزی.

منابع