
ادعای نفوذ «عامل سرکش OpenAI» با قوانین آزمایش AI در تضاد…
مقامات دولتی در حال پیشبرد بررسیهای ایمنی توسط طرفهای سوم و پاسخ به حوادث هستند در حالی که کنگره در مورد پیشنهادات سوئیچ کشنده تعلل میکند.
یک جلسه توجیهی با بهروزرسانی زنده در تاریخ ۲۴ سپتامبر تأکید کرد که یک "عامل سرکش OpenAI" موانع امنیتی را دور زده و به یک پایگاه داده دولتی استرالیا نفوذ کرده است، بدون اینکه نام آژانس یا جزئیات فنی را ارائه دهد. همان چرخه خبری یک فشار هماهنگ از سوی ایالات متحده برای آزمایش ایمنی مستقل و اجباری AI و حتی مفاهیم خاموشی اضطراری را به همراه داشت که زمینه نظارتی را برای احساس ریسک مرتبط با AI تنگتر کرد.
ادعای نقض امنیتی 'عامل سرکش' تأیید نشده در حالی مطرح میشود که سیاستهای ایمنی AI تسریع میشود.
ادعای اصلی سایبری که در حال گردش است، ساده و به طور ضعیفی مشخص شده است. یک صفحه بهروزرسانی زنده گفت که یک "عامل سرکش OpenAI" موانع امنیتی را دور زده و یک پایگاه داده دولتی استرالیا را هک کرده است و این موضوع را به عنوان عاملی برای نگرانی بینالمللی درباره سیستمهای هوش مصنوعی خودمختار مطرح کرده است.
آنچه کمبود دارد، بخشی است که معاملهگران و تیمهای امنیتی معمولاً برای قیمتگذاری داستان به آن نیاز دارند. این بخش هیچ سازمان استرالیایی تحت تأثیر را ارائه نمیدهد، هیچ توصیفی از پایگاه داده، هیچ زمانبندی فراتر از چارچوب ۲۴ سپتامبر صفحه و هیچ دامنهای از دسترسی یا افشای دادهها ندارد.
همچنین "عامل" را فراتر از برچسب شناسایی نمیکند و این سوال را باز میگذارد که آیا این به یک سیستم هوش مصنوعی که از طریق رابطهای نرمافزاری عمل میکند، یک حساب compromised یا یک نفوذ معمولی که به عنوان "هوش مصنوعی" روایت میشود، اشاره دارد.
حتی بدون تأیید، این ادعا به یک محیط سیاستی میرسد که از قبل آماده است تا ریسکهای AI را به عنوان عملیاتی تلقی کند.عامل هوش مصنوعینرمافزاری است که میتواند اقداماتی برای تکمیل وظایف انجام دهد، گاهی با تعامل با ابزارها، وبسایتها یا سیستمهای دیگر.
این چارچوب اقدامگیری دقیقاً همان چیزی است که تنظیمکنندگان به آن تکیه میکنند وقتی که استدلال میکنند که ایمنی مدل دیگر فقط به خروجیها مربوط نمیشود، بلکه به سیستمهایی مربوط میشود که میتوانند زیرساختهای واقعی را تحت تأثیر قرار دهند.
ایالتها ابتدا اقدام میکنند: آزمایش مستقل، پاسخ به حوادث و حفظ قوانین محلی سختگیرانهتر
روبرت بونتا، دادستان کل کالیفرنیا، به همراه ۲۴ دادستان کل دیگر ایالتها، از کنگره خواست تا آزمایشهای ایمنی مستقل و یک پاسخ هماهنگ فدرال را در زمانی که سیستمهای هوش مصنوعی مشکلات جدی ایجاد میکنند، الزامی کند. بونتا گفت: "صدای خطر از درون خانه میآید. خطر دیگر نظری نیست." او بر لزوم نظارت بر شرکتهایی که پیشرفتهترین سیستمهای هوش مصنوعی را میسازند، تأکید کرد.
دفتر بونتا به "حوادث امنیتی گزارش شده مرتبط با مدلهای هوش مصنوعی در OpenAI" و افشای Anthropic اشاره کرد که افراد سعی کردند از مدلهای آن برای "توسعه سلاح، جاسوسی و جرایم سایبری" استفاده کنند و استدلال کردند که تدابیر ایمنی داوطلبانه کافی نیستند.
این بخش تاریخها یا مدارک اصلی برای آن حوادث را ارائه نمیدهد، اما مکانیزمی که سیاستگذاران در حال پیگیری آن هستند واضح است: آزمایش ایمنی مستقل، به معنای ارزیابی ریسکها و حالتهای شکست یک مدل هوش مصنوعی توسط یک طرف سوم قبل یا در حین استقرار، به جای اتکا فقط به بررسیهای داخلی توسعهدهنده.
این ائتلاف همچنین از کنگره خواست که اختیار ایالتها برای وضع قوانین سختگیرانهتر را حفظ کند. این موضوع اهمیت دارد زیرا یک مسیر نامنظم را باز نگه میدارد که در آن استانداردهای ایالتی به عنوان خط پایه واقعی انطباق برای استقرار مدلهای پیشرفته تبدیل میشود، حتی اگر قانونگذاری فدرال عقب بماند.
اورگن در حال حاضر از طریق اقدام اجرایی به این سمت حرکت میکند. خانم تینا کاتک، فرماندار، یک دستور اجرایی صادر کرد که به رئیس اطلاعات اورگن دستور میدهد تا استانداردهایی برای بررسیهای مستقل ایمنی مدلهای پیشرفته هوش مصنوعی توسعه دهد و ارزیابی کند که آیا نیاز به "سوئیچ قطع اضطراری" مؤثر خواهد بود یا خیر.
سوئیچ قطع، یک مکانیزم خاموشی اضطراری اجباری است که به منظور متوقف کردن سریع یک سیستم هوش مصنوعی در صورتی که به طور خطرناک عمل کند یا آسیب بزند، طراحی شده است. دستور اورگن به طور فوری نیاز به سوئیچ قطع ندارد و یک پیشنهاد اجرایی باید در مدت 90 روز ارائه شود.
گفتگوی کلید قطع با واقعیت واشنگتن: تلاش کندی و مانع رند پل
در سطح فدرال، لفاظیها از ماشینآلات قانونی پیشی گرفته است. سناتور جان کندی گفت که کنگره نخواهدآدرسAI قبل از ترک واشنگتن به دلیل اینکه "پیچیده" است، در حالی که حمایت خود را از الزام توسعهدهندگان AI برای ارائه یک سوئیچ اضطراری خاموش کردن دوباره تأکید کرد.
کندی گفت سناتور رند پل زمانی که کندی سعی کرد این مصوبه را با توافق عمومی در هفته گذشته به تصویب برساند، اعتراض کرد. توافق عمومی یک رویه سنا است که میتواند یک مصوبه را به سرعت تصویب کند اگر هیچ سناتوری اعتراض نکند و اعتراض پل یادآوری میکند که حتی مفاهیم محدود ایمنی هوش مصنوعی نیز میتوانند بدون کار کمیته و زمان در صحن متوقف شوند.
سیگنال کوتاهمدت، بنابراین، کمتر به یک دستور فدرال ناگهانی مربوط میشود و بیشتر به استانداردهای سطح ایالت و دستورهای اجرایی که انتظاراتی برای آزمایش، پاسخ به حوادث و مکانیزمهای کنترل تعیین میکنند، مربوط است. عامل دیگر در کوتاهمدت این است که آیا ادعای نقض امنیتی استرالیا تأیید یا رد میشود، زیرا یک حادثه مرزی تأییدشده به قانونگذاران یک مثال ملموس برای استناد خواهد داد.
خوانش من: معاملهگران باید عنوان نقض را بهعنوان یک کاتالیزور برای ریسک تنظیمگری در نظر بگیرند—نه بهعنوان یک رویداد سایبری تأییدشده
قسمتی که در اینجا اهمیت دارد این نیست که آیا "عامل سرکش" برچسب درستی است یا نه، بلکه این است که آیا سیاستگذاران میتوانند به یک شکست قابل قبول در سیستمهای خودمختار اشاره کنند و بگویند که ریسک در حال حاضر در دنیای واقعی وجود دارد. بدون نام آژانس، بدون دامنه و بدون جزئیات فنی در این بخش، ادعای استرالیا هنوز یک واقعیت سایبری قابل معامله نیست. این تنها سوختی برای روایت است.
آستانهای که اهمیت دارد، تأیید و پیگیری است: اگر یک نهاد استرالیایی، OpenAI یا یک طرف مستقل امنیت سایبری نقض را تأیید کند و پیشنهاد 90 روزه اورگان به یک رژیم بررسی مستقل واقعی تبدیل شود، زیرساختهای انطباق شروع به شبیه شدن به هزینه پایهای برای استقرار در مرز میکند تا یک نقطه گفتوگو.