A dark server room with a glowing green server
هوش مصنوعی

گوگل Gemini 4 Argon را ابتدا به شرکای امنیتی ارائه کرد

مدل مرزی تحت ارزیابی‌های پیش‌انتشاری دولت ایالات متحده قرار دارد و هنوز تاریخ انتشار عمومی یا شرکای نام‌برده‌ای ندارد.

نوشته Elliot Marsh4 دقیقه مطالعه

آلفابت Gemini 4 Argon را معرفی کرد و شروع به راه‌اندازی مرحله‌ای کرد که با شرکای انتخابی امنیت سایبری آغاز می‌شود و نه یک انتشار گسترده برای توسعه‌دهندگان. گوگل همچنین ارزیابی‌های ایمنی پیش‌انتشار دولت ایالات متحده را انجام می‌دهد و ادعاهای معیار تهاجمی را با یک مسیر دسترسی به‌طور عمدی محدود ترکیب می‌کند.

گوگل شروع به راه‌اندازی Gemini 4 Argon کرده است که آن را پیشرفته‌ترین مدل هوش مصنوعی خود توصیف می‌کند، با "بهبودهای عمده در کدنویسی، امنیت سایبری و کارهای حرفه‌ای پیچیده." دسترسی اولیه محدود است: Argon به مجموعه‌ای انتخابی از "شرکای معتبر امنیت سایبری" به عنوان مرحله اولیه یک انتشار مرحله‌ای می‌رود، با در دسترس بودن گسترده‌تر که به‌طور صریح به عنوان یک مرحله بعدی چارچوب‌بندی شده است.

این راه‌اندازی مرحله‌ای اهمیت دارد زیرا یک انتخاب توزیع است، نه فقط یک خط بازاریابی. گوگل نام شرکای اولیه را ذکر نکرد و توضیح نداد که چه چیزی یک سازمان را به عنوان "معتبر" واجد شرایط می‌کند و همچنین تاریخ انتشار عمومی یا برنامه‌ای دقیق برای مراحل بعدی منتشر نکرد.

این شرکت همچنین Argon را به عنوان ابزاری مفید در داخل عملیات خود قرار می‌دهد. گوگل گفت که این مدل به‌طور داخلی برای بهینه‌سازی حافظه در مراکز داده خود استفاده می‌شود و "صدها ترابایت حافظه" را بدون خرید سخت‌افزار اضافی آزاد می‌کند. همچنین گفت که محققان محاسبات کوانتومی از این مدل استفاده کرده‌اند.

موقعیت‌یابی معیار: جایی که گوگل می‌گوید Argon از GPT-6 Astra، Grok 4.7 و Anthropic پیشی می‌گیرد یا با آن‌ها برابر است.

پیشنهاد عملکرد گوگل برای Argon گسترده و رقابتی است. این شرکت گفت Argon "یک رکورد جدید در مهندسی نرم‌افزار دنیای واقعی ثبت می‌کند،" "در امنیت سایبری با اولی برابر است،" و "یک معیار دیگر را رهبری می‌کند" که عملکرد را در زمینه‌های مالی، حقوقی و سایر وظایف حرفه‌ای اندازه‌گیری می‌کند.

در مقایسه‌های رو در رو، گوگل گفت Argon در معیارهای امنیت سایبری با GPT-6 Astra و Grok 4.7 برابر است. همچنین گفت Argon در شاخص Vals، که یک شاخص معیار است که گوگل به آن اشاره کرده و عملکرد را در وظایف حرفه‌ای اندازه‌گیری می‌کند، از GPT-6 Astra و مدل‌های اخیر Anthropic جلوتر است، بدون اینکه روش‌شناسی آن را در جزئیات ارائه شده تعریف کند.

مشکل برای معامله‌گران این است که چه چیزی مشخص نیست. گوگل نام‌های معیار یا جزئیات نمره‌گذاری پشت ادعای رکورد "مهندسی نرم‌افزار دنیای واقعی" را مشخص نکرد و همچنین "یک معیار دیگر" که برای مقایسه بین حرفه‌ای استفاده شده است را شناسایی نکرد. بدون آن عناصر اولیه، ادعاها سخت است که به یک سیستم تکراری یا تکثیر شخص ثالث مرتبط شوند.

گوگل همچنین Argon را به عنوان یک گام امنیت سایبری معنی‌دار از مدل Gemini 3.8 Flash Cyber که اوایل سپتامبر منتشر شده بود، چارچوب‌بندی کرد، از جمله برتری در کشف آسیب‌پذیری. این یک سرعت تکرار سریع برای یک خط مدل متمرکز بر سایبر است و انتظاراتی را تعیین می‌کند که ممکن است انتشارهای "مرزی" به طور فزاینده‌ای بر اساس قابلیت‌های امنیتی توجیه شوند و نه عملکرد چت عمومی.

نگهبانی ایمنی قبل از دسترسی عمومی: ارزیابی‌های دولت ایالات متحده و تدابیر ایمنی تزریق درخواست.

گوگل در دسترسی عمومی آرگون را به فرآیند ایمنی مرتبط می‌کند، نه فقط آمادگی مدل. این شرکت اعلام کرد که با دولت ایالات متحده بر روی ارزیابی‌های ایمنی پیش از انتشار کار خواهد کرد و برنامه انتشار را به‌گونه‌ای مرحله‌ای توصیف کرد که به‌طور خاص برای ایجاد اعتماد در حالی که یک مدل قوی در دفاع به دست مدافعان می‌رسد، طراحی شده است.

تولسی دوشی، مدیر محصول مدل جمنای گوگل، گفت: "شروع این راه‌اندازی به این شکل به ما اعتماد بیشتری می‌دهد، اما همچنین به ما این امکان را می‌دهد که مدلی که در دفاع سایبری آموزش دیده و قوی است را هر چه زودتر به دست مدافعان برسانیم."

گوگل همچنین اعلام کرد که در حال تلاش برای گسترش تدابیر ایمنی در چهار حوزه کلیدی سایبری قبل از راه‌اندازی عمومی است و به‌طور صریح از سوءاستفاده و تزریق دستوری نام برد.

تزریق دستوری تکنیکی است که در آن یک مهاجم ورودی‌هایی را طراحی می‌کند تا یک سیستم هوش مصنوعی را وادار به نادیده گرفتن قوانین یا افشای اطلاعات حساس کند و این یکی از حالت‌های شکست است که پس از ادغام مدل‌ها در ابزارهایی که می‌توانند به کد، اعتبارنامه‌ها یا جریان‌های کاری دسترسی پیدا کنند، اهمیت بیشتری پیدا می‌کند.

دو نقطه عطف نزدیک به زمان می‌تواند مسیر راه‌اندازی را آسان‌تر کند: نام‌گذاری شرکای اولیه سایبری توسط گوگل یا گسترش دسترسی فراتر از گروه اول، و انتشار تاریخ راه‌اندازی عمومی یا یک برنامه مرحله‌ای واضح‌تر پس از ارزیابی‌های پیش از انتشار دولت ایالات متحده. سومی افشاگری است: جزئیات بیشتر در مورد معیارهای نامشخص پشت "رکورد" و ادعاهای بین حرفه‌ای، به‌علاوه هرگونه تأیید از سوی شخص ثالث.

نظر من: چرا یک انتشار سایبری-اول اهمیت بیشتری نسبت به معیارها برای معامله‌گران کریپتو دارد.

بخشی که تصمیم می‌گیرد آیا این یک ورودی واقعی بازار است یا نه، خط مورد Vals Index نیست، بلکه دروازه توزیع است. یک راه‌اندازی سایبری-شریک اول به این معنی است که گوگل آرگون را به‌عنوان یک قابلیت که نیاز به قرار گرفتن کنترل‌شده و آزمایش‌های واقعی در برابر دشمنان دارد، در نظر می‌گیرد و جزئیات شریک نامشخص نشانه‌ای است که این نزدیک‌تر به یک آزمایش بسته است تا یک لحظه پلتفرم پر سر و صدا.

آستانه‌ای که اهمیت دارد این است که آیا ارزیابی‌های ایمنی پیش از انتشار دولت ایالات متحده به یک جدول زمانی مشخص و کنترل‌های قابل ارسال تبدیل می‌شوند، به‌ویژه در مورد سوءاستفاده و تزریق دستوری.

اگر گوگل شروع به نام‌گذاری شرکا، انتشار جزئیات مربوط به معیارها و حرکت از "مراحل" به تاریخ‌ها کند، آرگون دیگر یک روایت درباره عملکرد مرزی نخواهد بود و به یک کاتالیزور عملی تبدیل می‌شود که واقعاً می‌تواند هزینه‌های امنیتی و موقعیت زیرساخت هوش مصنوعی را تغییر دهد.

منابع