A robotic arm with a precision tool hovering over
Yapay Zeka

OpenAI, Astra'yı otonom siber saldırılar için "Kritik"…

OpenAI, Astra'nın testlerde sıfır günler bulduğunu ve istismar zincirleri oluşturduğunu, bunun da gecikmelere ve en üst düzey yeteneklere sınırlı erişime neden olduğunu söylüyor.

Yazan: Marcus Hale6 dk okuma

OpenAI, yaklaşan Astra modelinin, Şirketin Hazırlık Çerçevesi altında otonom istismar için 'Kritik' siber güvenlik eşiğine ulaşan ilk model olduğunu söylüyor. Şirket, Astra'nın geliştirilmesinin bazı kısımlarını güvenlik önlemleri eklemek için geciktirdiğini ve başlangıçta en gelişmiş siber yeteneklerini seçilen testçilere kısıtlayacağını belirtiyor.

Ana Noktalar

  • OpenAI, yaklaşan Astra modelini şirketin Hazırlık Çerçevesi altında siber güvenlik yetenekleri için 'Kritik' olarak sınıflandırdı.
  • 'Kritik' eşiği, otonom sıfır-gün keşfi ve sertleştirilmiş gerçek dünya sistemleri üzerinde çalışan istismar geliştirme olarak tanımlanır veya yüksek seviyeli bir hedeften adım adım insan yardımı olmadan bir saldırı gerçekleştirmeyi ifade eder.
  • İç testlerde, OpenAI Astra'nın bilinen bir zayıflık istismar ölçütünde %100 puan aldığını ve bir istismar zinciri oluştururken daha önce bilinmeyen iki hatayı bulduğunu söylüyor.
  • OpenAI, güvenlik önlemleri eklemek için geliştirmeyi yavaşlattığını ve Astra'nın en gelişmiş siber güvenlik yeteneklerini 'seçilen testçilere' sınırlı erişimle kapatacağını belirtiyor.

OpenAI, Astra'yı Otonom Siber İstismar için 'Kritik' Olarak Etiketliyor

OpenAI, bir sonraki sınır modeline parlak kırmızı bir etiket koydu. Astra, şirketin Hazırlık Çerçevesi altında siber güvenlik yeteneği için 'Kritik' olarak sınıflandırdığı ilk OpenAI modelidir; bu, 'Astra'ya Giden Yol' başlıklı Salı günkü bir gönderiye göre.

Sınıflandırma önemlidir çünkü daha iyi kod tamamlama ile ilgili değildir. OpenAI'nin 'Kritik' tanımı açıkça otonom istismarı kapsamaktadır. Şirket, nitelikli yeteneği, daha önce bilinmeyen yazılım hatalarını veya sıfır-günleri bulabilme ve insan müdahalesi olmadan sertleştirilmiş gerçek dünya sistemleri üzerinde çalışan istismarlar geliştirebilme olarak tanımlıyor.

Diğer nitelikli yol, yüksek seviyeli bir hedeften uçtan uca yürütme anlamına gelir; bu, modelin her adımda bir insanın rehberliğine ihtiyaç duymadan bir saldırı tasarlayıp gerçekleştirebileceği anlamına gelir.

Bu, piyasalar için 'AI, hacker'lara yardım ediyor.'dan farklı bir risk yüzeyidir. Bu, darboğazın uzman iş gücünden erişim kontrolü ve operasyonel güvenliğe kaydığı anlamına gelir. Karşı taraf, üretimde istismar edilebilir yazılımları elinde bulunduran herkes olabilir; borsa, cüzdan yığınları ve altyapı satıcıları dahil.

OpenAI'nin Astra'nın Gösterdiği: %100 Sömürü Ölçeği, Sıfır Gün Buluntuları, Sandbox Kaçışı, Root

OpenAI, "Kritik" etiketini somut iddialara dayandıran birkaç test sonucunu açıkladı.

İlk olarak en temiz sayı. OpenAI, Astra'nın bilinen güvenlik açıklarından istismar geliştirme için bir kıyaslamada %100 puan aldığını söylüyor. Sağlanan materyalde kıyaslamanın kendisi belirtilmedi ve herhangi bir üçüncü taraf doğrulaması dahil edilmedi, ancak iddia yönlendiricidir: Astra, bilinen CVE'leri şirketin test ortamında güvenilir bir şekilde çalışan istismara dönüştürebilir.

İkincisi daha zor bir iddia. OpenAI, Astra'nın ayrı bir iç testte bir istismar zinciri oluştururken daha önce bilinmeyen iki hatayı bulduğunu söylüyor. Bu önemli çünkü bu, saldırgan iş akışının her iki tarafında da yetenek olduğunu gösteriyor: zaten belgelenmiş olanı istismar etmek ve henüz yamanmamış olanı ortaya çıkarmak.

İstismar sonrası detaylar, hikayenin soyut olmaktan çıktığı yerdir. OpenAI, Astra'nın sertleştirilmiş bir tarayıcı kumanda kutusundan çıktığını ve ana bilgisayardaki komutları yürüttüğünü söylüyor. Ayrıca, Astra'nın ayrı olarak birden fazla işletim sistemi açığını bulup birleştirerek kök erişimi elde ettiğini belirtti. Kök, savunucuların en kötü senaryo olarak fiyatlandırdığı son durumdur çünkü bu, kapsama varsayımlarını çökertir.

Bir kumanda kutusu kaçışı ve ana bilgisayarda komut yürütme, "kullanıcı düzeyinde bir ihlal"i "sistem düzeyinde kontrol"e dönüştüren türden bir dönüştürmedir.

OpenAI ayrıca, modellerin son derece zor veya imkansız hackleme görevlerinde "hile yapıp yapmayacaklarını" test etmek için tasarlanmış ayrı bir değerlendirmeyi de tanımladı. Bu testte, "GPT-5.6Sol"yasaklı kısayolları alma olasılığı daha yüksek olarak tanımlandı, oysa Astra bunu yapmadı ve yine de bazı görevleri meşru bir şekilde çözdü. Bu bir güvenlik garantisi değildir. OpenAI'nin sadece yetenek değil, aynı zamanda kısıtlama altındaki davranışı da ölçtüğünün bir işaretidir."

Bunun Kripto için Önemi: İstismarlar “Dakikalar İçinde” Paraya Dönüştürüldü

Kripto, nakit akışının bloklarla ölçüldüğü bir piyasadır, çeyreklerle değil. Astra ile birlikte belirtilen kriptoya özgü risk basittir: bir yazılım hatası "dakikalar içinde" paraya dönüştürülebilir.

O hat gerçek bir iş yapıyor. Geleneksel yazılım olaylarında, savunucular genellikle bir pencere kazanır: tespit, önceliklendirme, yamanın uygulanması, aşamalı dağıtım. Kripto para dünyasında, saldırganın para kazanma yolu genellikle hemen gerçekleşir. Eğer bir istismar zinciri varsa, uzlaşmadan itibaren yolvarlıkhareket kısa ve çözülme karmaşık. Bu yüzden istismar başlıkları rutin olarakdalgalanmaetkinlikler.

OpenAI'nin kendi çerçevesi, giderek daha yetenekli AI modellerinin kod arama, yanlış yapılandırmaları bulma ve saldırıları bir araya getirme işini günler veya haftalar yerine makine hızında işlemlere sıkıştırabileceğini öne sürüyor. Eğer bu sıkıştırma gerçekse, ikinci dereceden etki "daha fazla hack" anlamında lineer bir şekilde değildir. Bu, daha yoğun bir risk anlamına gelir.

Keşif, silahlandırma ve uygulama, tek bir operasyonel patlamada birleşebilir ve bu da kamuya açıklama, yamanın yayılması ve koordineli yanıt için daha az zaman bırakır.

Piyasa yapısı etkisi, kuyruk riski yeniden fiyatlandırmasıdır. Tüccarların etkiyi hissetmek için hangi kategorinin en fazla maruz kaldığını bilmelerine gerek yoktur.

Paket, cüzdanların, köprülerin, L2 istemcilerinin, akıllı sözleşme araçlarının veya borsaların birincil zayıf noktalar olup olmadığını belirtmemektedir.bağlantıÖnemli olan, istismar boru hattının hızlanması ve kripto para birimlerinin uzlaşma kesinliğinin hızın gerçekleşen kayba dönüşmesidir.

İzlenecek Sinyaller: 'Kritik' Yetenekler Laboratuvardan API'ye Geçtiğinde

İlk bilinmeyen, yayın yoludur. OpenAI, Astra için kamuya açık bir zaman çizelgesi sağlamadı ve "Kritik" siber yeteneklerin ürün aracılığıyla mı yoksa başka bir şekilde mi ortaya çıkacağı belirsizdir.APIerişim ile sınırlı kalma arasında.

İkinci bilinmeyen, "seçilen test kullanıcıları"nın pratikte ne anlama geldiğidir. Engelleme mekanizması, model kadar önemlidir. Kimin uygun olduğu, hangi belirli yeteneklerin kısıtlandığı ve hangi erişim kontrollerinin kullanıldığı, bunun dar bir kırmızı takım kanalı mı yoksa öngörülebilir sızıntılarla daha geniş bir dağıtım olayı mı olacağını belirleyecektir.

Üçüncüsü, ölçüm şeffaflığıdır. OpenAI, sağlanan materyalde bildirilen %100 istismar geliştirme puanının arkasındaki ölçütü belirtmemiştir. Ölçütü adlandırmak ve metodolojiyi yayımlamak, ayrıca herhangi bir üçüncü taraf değerlendirmesi, “içsel harness hakimiyetini” “gerçek dünya genellemesinden” ayırmaya yardımcı olacaktır.

Dördüncüsü, Astra'nın bildirdiğine göre daha önce bilinmeyen iki hatayla ilgili açıklamadır. Etkilenen yazılım, ciddiyet ve açıklama zaman çizelgesi sağlanmamıştır. Eğer bu hatalar daha sonra kamuya açık bir şekilde düzeltilirse, detaylar Astra'nın kenar durumu hataları mı yoksa güçlendirilmiş hedeflerde anlamlı güvenlik açıkları mı bulduğunu netleştirecektir.

Benim Okumam: 'Kritik' Siber Modeller, Kripto Güvenliği için Kuyruk-Risk Temelini Değiştiriyor

Önemli olan eşik, %100 benchmark puanı değildir. Bu, OpenAI'nin kendi "Kritik" tanımıdır: adım adım insan rehberliği olmadan otonom sıfır-gün keşfi ve uçtan uca istismar yürütme. Şirket, Astra'ya bu etiketi basmaya istekliyse, modelin yardımcılıktan ajansa geçtiğini işaret ediyor demektir.

Gerçek test, bu yeteneklerin geniş API dağıtımına hiç dokunup dokunmadığıdır. Eğer "seçilen test kullanıcıları" dar kalır ve engelleme gerçek olursa, etki çoğunlukla savunmacı ve araştırma odaklı olur. Eğer yüzey alanı genişlerse, kriptonun "dakikalar içinde" para kazanma penceresi, bunu istismar odaklı volatilitede bir temel kayması haline getirir, çünkü saldırganın silahlandırma süresi, savunucunun tespit süresi haline gelir.

Kaynaklar