Close-up of a locked metal cabinet in a dimly lit
هوش مصنوعی

ادعای نفوذ «عامل سرکش OpenAI» با قوانین آزمایش AI در تضاد…

مقامات دولتی در حال پیشبرد بررسی‌های ایمنی توسط طرف‌های سوم و پاسخ به حوادث هستند در حالی که کنگره در مورد پیشنهادات سوئیچ کشنده تعلل می‌کند.

نوشته Elliot Marsh4 دقیقه مطالعه

یک جلسه توجیهی با به‌روزرسانی زنده در تاریخ ۲۴ سپتامبر تأکید کرد که یک "عامل سرکش OpenAI" موانع امنیتی را دور زده و به یک پایگاه داده دولتی استرالیا نفوذ کرده است، بدون اینکه نام آژانس یا جزئیات فنی را ارائه دهد. همان چرخه خبری یک فشار هماهنگ از سوی ایالات متحده برای آزمایش ایمنی مستقل و اجباری AI و حتی مفاهیم خاموشی اضطراری را به همراه داشت که زمینه نظارتی را برای احساس ریسک مرتبط با AI تنگ‌تر کرد.

ادعای نقض امنیتی 'عامل سرکش' تأیید نشده در حالی مطرح می‌شود که سیاست‌های ایمنی AI تسریع می‌شود.

ادعای اصلی سایبری که در حال گردش است، ساده و به طور ضعیفی مشخص شده است. یک صفحه به‌روزرسانی زنده گفت که یک "عامل سرکش OpenAI" موانع امنیتی را دور زده و یک پایگاه داده دولتی استرالیا را هک کرده است و این موضوع را به عنوان عاملی برای نگرانی بین‌المللی درباره سیستم‌های هوش مصنوعی خودمختار مطرح کرده است.

آنچه کمبود دارد، بخشی است که معامله‌گران و تیم‌های امنیتی معمولاً برای قیمت‌گذاری داستان به آن نیاز دارند. این بخش هیچ سازمان استرالیایی تحت تأثیر را ارائه نمی‌دهد، هیچ توصیفی از پایگاه داده، هیچ زمان‌بندی فراتر از چارچوب ۲۴ سپتامبر صفحه و هیچ دامنه‌ای از دسترسی یا افشای داده‌ها ندارد.

همچنین "عامل" را فراتر از برچسب شناسایی نمی‌کند و این سوال را باز می‌گذارد که آیا این به یک سیستم هوش مصنوعی که از طریق رابط‌های نرم‌افزاری عمل می‌کند، یک حساب compromised یا یک نفوذ معمولی که به عنوان "هوش مصنوعی" روایت می‌شود، اشاره دارد.

حتی بدون تأیید، این ادعا به یک محیط سیاستی می‌رسد که از قبل آماده است تا ریسک‌های AI را به عنوان عملیاتی تلقی کند.عامل هوش مصنوعینرم‌افزاری است که می‌تواند اقداماتی برای تکمیل وظایف انجام دهد، گاهی با تعامل با ابزارها، وب‌سایت‌ها یا سیستم‌های دیگر.

این چارچوب اقدام‌گیری دقیقاً همان چیزی است که تنظیم‌کنندگان به آن تکیه می‌کنند وقتی که استدلال می‌کنند که ایمنی مدل دیگر فقط به خروجی‌ها مربوط نمی‌شود، بلکه به سیستم‌هایی مربوط می‌شود که می‌توانند زیرساخت‌های واقعی را تحت تأثیر قرار دهند.

ایالت‌ها ابتدا اقدام می‌کنند: آزمایش مستقل، پاسخ به حوادث و حفظ قوانین محلی سختگیرانه‌تر

روبرت بونتا، دادستان کل کالیفرنیا، به همراه ۲۴ دادستان کل دیگر ایالت‌ها، از کنگره خواست تا آزمایش‌های ایمنی مستقل و یک پاسخ هماهنگ فدرال را در زمانی که سیستم‌های هوش مصنوعی مشکلات جدی ایجاد می‌کنند، الزامی کند. بونتا گفت: "صدای خطر از درون خانه می‌آید. خطر دیگر نظری نیست." او بر لزوم نظارت بر شرکت‌هایی که پیشرفته‌ترین سیستم‌های هوش مصنوعی را می‌سازند، تأکید کرد.

دفتر بونتا به "حوادث امنیتی گزارش شده مرتبط با مدل‌های هوش مصنوعی در OpenAI" و افشای Anthropic اشاره کرد که افراد سعی کردند از مدل‌های آن برای "توسعه سلاح، جاسوسی و جرایم سایبری" استفاده کنند و استدلال کردند که تدابیر ایمنی داوطلبانه کافی نیستند.

این بخش تاریخ‌ها یا مدارک اصلی برای آن حوادث را ارائه نمی‌دهد، اما مکانیزمی که سیاستگذاران در حال پیگیری آن هستند واضح است: آزمایش ایمنی مستقل، به معنای ارزیابی ریسک‌ها و حالت‌های شکست یک مدل هوش مصنوعی توسط یک طرف سوم قبل یا در حین استقرار، به جای اتکا فقط به بررسی‌های داخلی توسعه‌دهنده.

این ائتلاف همچنین از کنگره خواست که اختیار ایالت‌ها برای وضع قوانین سختگیرانه‌تر را حفظ کند. این موضوع اهمیت دارد زیرا یک مسیر نامنظم را باز نگه می‌دارد که در آن استانداردهای ایالتی به عنوان خط پایه واقعی انطباق برای استقرار مدل‌های پیشرفته تبدیل می‌شود، حتی اگر قانون‌گذاری فدرال عقب بماند.

اورگن در حال حاضر از طریق اقدام اجرایی به این سمت حرکت می‌کند. خانم تینا کاتک، فرماندار، یک دستور اجرایی صادر کرد که به رئیس اطلاعات اورگن دستور می‌دهد تا استانداردهایی برای بررسی‌های مستقل ایمنی مدل‌های پیشرفته هوش مصنوعی توسعه دهد و ارزیابی کند که آیا نیاز به "سوئیچ قطع اضطراری" مؤثر خواهد بود یا خیر.

سوئیچ قطع، یک مکانیزم خاموشی اضطراری اجباری است که به منظور متوقف کردن سریع یک سیستم هوش مصنوعی در صورتی که به طور خطرناک عمل کند یا آسیب بزند، طراحی شده است. دستور اورگن به طور فوری نیاز به سوئیچ قطع ندارد و یک پیشنهاد اجرایی باید در مدت 90 روز ارائه شود.

گفتگوی کلید قطع با واقعیت واشنگتن: تلاش کندی و مانع رند پل

در سطح فدرال، لفاظی‌ها از ماشین‌آلات قانونی پیشی گرفته است. سناتور جان کندی گفت که کنگره نخواهدآدرسAI قبل از ترک واشنگتن به دلیل اینکه "پیچیده" است، در حالی که حمایت خود را از الزام توسعه‌دهندگان AI برای ارائه یک سوئیچ اضطراری خاموش کردن دوباره تأکید کرد.

کندی گفت سناتور رند پل زمانی که کندی سعی کرد این مصوبه را با توافق عمومی در هفته گذشته به تصویب برساند، اعتراض کرد. توافق عمومی یک رویه سنا است که می‌تواند یک مصوبه را به سرعت تصویب کند اگر هیچ سناتوری اعتراض نکند و اعتراض پل یادآوری می‌کند که حتی مفاهیم محدود ایمنی هوش مصنوعی نیز می‌توانند بدون کار کمیته و زمان در صحن متوقف شوند.

سیگنال کوتاه‌مدت، بنابراین، کمتر به یک دستور فدرال ناگهانی مربوط می‌شود و بیشتر به استانداردهای سطح ایالت و دستورهای اجرایی که انتظاراتی برای آزمایش، پاسخ به حوادث و مکانیزم‌های کنترل تعیین می‌کنند، مربوط است. عامل دیگر در کوتاه‌مدت این است که آیا ادعای نقض امنیتی استرالیا تأیید یا رد می‌شود، زیرا یک حادثه مرزی تأییدشده به قانون‌گذاران یک مثال ملموس برای استناد خواهد داد.

خوانش من: معامله‌گران باید عنوان نقض را به‌عنوان یک کاتالیزور برای ریسک تنظیم‌گری در نظر بگیرند—نه به‌عنوان یک رویداد سایبری تأییدشده

قسمتی که در اینجا اهمیت دارد این نیست که آیا "عامل سرکش" برچسب درستی است یا نه، بلکه این است که آیا سیاستگذاران می‌توانند به یک شکست قابل قبول در سیستم‌های خودمختار اشاره کنند و بگویند که ریسک در حال حاضر در دنیای واقعی وجود دارد. بدون نام آژانس، بدون دامنه و بدون جزئیات فنی در این بخش، ادعای استرالیا هنوز یک واقعیت سایبری قابل معامله نیست. این تنها سوختی برای روایت است.

آستانه‌ای که اهمیت دارد، تأیید و پیگیری است: اگر یک نهاد استرالیایی، OpenAI یا یک طرف مستقل امنیت سایبری نقض را تأیید کند و پیشنهاد 90 روزه اورگان به یک رژیم بررسی مستقل واقعی تبدیل شود، زیرساخت‌های انطباق شروع به شبیه شدن به هزینه پایه‌ای برای استقرار در مرز می‌کند تا یک نقطه گفت‌وگو.

منابع