A disassembled robotic head and arm on a dark
هوش مصنوعی

آزمایش‌های امنیتی AI برای OpenAI و Meta به مشکل خوردند

این گزارش جزئیاتی درباره خطا یا تأثیرات پایین‌دستی ارائه نمی‌دهد و در حال حاضر این داستان به عنوان یک کاتالیزور احساس ریسک باقی می‌ماند.

نوشته Elliot Marsh3 دقیقه مطالعه

ایرگولار، که به عنوان یک استارتاپ امنیتی هوش مصنوعی اسرائیلی توصیف شده، reportedly در ارزیابی مدل‌های هوش مصنوعی برای OpenAI، Anthropic و Meta اشتباهی مرتکب شده و کار "از ریل خارج شده است." این گزارش در تاریخ ۲۵ آگوست ۲۰۲۶ منتشر شد و جزئیات فنی در متن استخراج شده وجود ندارد.

NYT: آزمایش‌های امنیتی هوش مصنوعی ایرگولار برای OpenAI، Anthropic و Meta پس از یک اشتباه "از ریل خارج شد"

ایرگولار، یک استارتاپ اسرائیلی که ارزیابی‌های امنیتی بر روی مدل‌های هوش مصنوعی برای OpenAI، Anthropic و Meta انجام داده است، "اشتباهی مرتکب شد" و تلاش‌های آزمایشی "از ریل خارج شد"، طبق گزارشی در تاریخ ۲۵ آگوست ۲۰۲۶. متن استخراج شده نام افراد، تاریخ‌های درگیری‌های زیرین یا مدل‌های خاص درگیر را ذکر نمی‌کند.

تنها مکانیزم مشخصی که به آن اشاره شده، تیم قرمز است، به معنای آزمایش‌های ساختاریافته متخاصم که برای یافتن راه‌هایی که یک مدل می‌تواند دستکاری شود، داده‌ها را نشت دهد یا به طور ناامن رفتار کند قبل از اینکه مهاجمان واقعی این کار را انجام دهند، طراحی شده است. این کار معمولاً بر روی دسترسی‌های محدود، ثبت وقایع و قوانین از پیش توافق شده اجرا می‌شود زیرا آزمایش‌کننده عمداً سعی در شکستن چیزها دارد.

آنچه گم شده است، بخشی است که معامله‌گران معمولاً برای قیمت‌گذاری به آن نیاز دارند: اینکه "اشتباه" واقعاً چه بود و "از ریل خارج شدن" به طور عملی چه معنایی دارد. متن استخراج شده هیچ نشانه‌ای از دسترسی ناخواسته، نشت داده، آسیب‌پذیری مدل، افشای آسیب‌پذیری، وصله‌ها، پاسخ به حادثه یا اقدام قانونی مرتبط با درگیری‌ها ارائه نمی‌دهد.

دلیل اینکه این موضوع هنوز به میزهای کریپتو می‌رسد، پیوند روایتی است، نه پیوند زنجیره‌ای. تیترهای ریسک هوش مصنوعی می‌توانند سبدهای توکن‌های مرتبط با هوش مصنوعی را جابجا کنند و روایت‌ها را به طور خودکار محاسبه کنند، به ویژه زمانی که طرف‌های نام برده سه آزمایشگاهی هستند که بر ذهن‌ها تسلط دارند. با این حال، بدون جزئیات، سخت است که این را به هر تم واحدی فراتر از یادآوری عمومی "امنیت هوش مصنوعی نامنظم است" مرتبط کنیم.

چه چیزی این را به یک تیتر قابل معامله AI-Crypto تبدیل می‌کند: افشاگری، شواهد سوءاستفاده، یا عواقب سیاستی

اولین قفل، افشای پایه است. اگر گزارش‌های پیگیری مشخص کند که ماهیت "اشتباه" ایرگولار چه بوده و "از ریل خارج شدن" در عمل چه معنایی داشته است، بازار می‌تواند یک شکست فرآیندی را از یک حادثه با شعاع واقعی جدا کند. تفاوت بین یک آزمایش با دامنه نادرست و یک مسیر داده ناخواسته، تفاوت بین شرمندگی و اصلاح است.

دومین قفل، شواهد سوءاستفاده است. نسخه قابل معامله این داستان معمولاً حداقل یکی از موارد زیر را دارد: یک کلاس آسیب‌پذیری افشا شده، یک سطح افشای تأیید شده، یا چرخه وصله‌ای که نشان می‌دهد آزمایشگاه‌ها نتیجه را به عنوان یک رویداد امنیتی به جای یک مشکل فروشنده تلقی کرده‌اند.

سومین قفل، عواقب سیاستی در آزمایشگاه‌ها است. بیانیه‌ها یا تغییرات رویه‌ای از OpenAI، Anthropic یا Meta در مورد کنترل‌های تیم قرمز، نظارت بر فروشندگان یا رویه‌های آزمایش امنیتی، تمیزترین سیگنال خواهد بود که حادثه تغییراتی در نحوه مجاز بودن و محدود کردن آزمایش‌ها ایجاد کرده است.

در غیاب این موارد، خطرات اصلی در مسیر «گفتگوی ریسک هوش مصنوعی» باقی می‌مانند، جایی که تقویت بالا اما محتوای اطلاعاتی کم است. این نوع جریان می‌تواند همچنان احساسات را تکان دهد، اما تمایل دارد که محو شود مگر اینکه به یک شیء مشخص که معامله‌گران بتوانند آن را پیگیری کنند، متصل شود.

خوانش من: این را به عنوان یک پینگ احساسات در نظر بگیرید تا زمانی که «اشتباه» و عواقب آن مشخص شود.

آستانه‌ای که اهمیت دارد این است که آیا «از ریل خارج شد» به یک حالت شکست تعریف شده تبدیل می‌شود: دسترسی ناخواسته، افشای داده‌ها، تغییرات رفتار مدل، یا یک آسیب‌پذیری که نیاز به وصله دارد. در حال حاضر، این گزیده به شما طرف‌های مقابل و یک نتیجه مبهم می‌دهد که برای تقویت کافی است اما برای بازنگری اصول کافی نیست.

اگر داستان در سطح یک «اشتباه» نامشخص باقی بماند، یک پینگ احساساتی است که می‌تواند در روایت‌های هوش مصنوعی-کریپتو جریان یابد بدون اینکه به هر گونه تأثیر قابل اندازه‌گیری متصل شود. اگر به افشا، پاسخ به حادثه، یا تغییرات سیاست در آزمایشگاه‌ها ارتقا یابد، به یک داستان کنترل ریسک مشخص با یک جدول زمانی تبدیل می‌شود که بازار واقعاً می‌تواند حول آن معامله کند.

منابع