A glowing green biohazard container with a
Yapay Zeka

Anthropic, Claude kötüye kullanımını önlediğini açıkladı

Tehdit raporu, Aralık 2025 - Ağustos 2026 dönemini kapsıyor ve yavaşlayan AI ile onu "kazanma" konusundaki ABD siyasi bölünmesinin ortasında yer alıyor.

Yazan: Elliot Marsh7 dk okuma

Anthropic, yeni bir tehdit istihbarat raporunun, biyolojik silah geliştirmesini destekleyebilecek "kötü niyetli faaliyetler" için Claude modellerini kullanma girişimlerini tespit ettiğini ve bunları engellediğini açıkladı; bu rapor, beş biyolojik silah ile ilgili vaka çalışmasını içeriyor.

Bu açıklama, ABD liderlerinin "süper zeka" için duraklama veya yasaklama çağrıları ile stratejik avantaj için AI gelişimini hızlandırma çabaları arasında kamuoyunda ayrıştığı bir dönemde geldi.

Ana Noktalar

  • Anthropic, Claude'u biyolojik silah geliştirmesini destekleyebilecek "kötü niyetli faaliyetler" için kullanma girişimlerini tespit ettiğini ve engellediğini, beş biyolojik silah ile ilgili vaka çalışmasını belgelediğini söyledi.
  • Şirket, Claude Haiku, Sonnet ve Opus'un kötü niyetli kullanımı için engelleme penceresini Aralık 2025 ile Ağustos 2026 arasında belirledi.
  • Aynı rapor, Claude'un konvansiyonel silahlar için yazılım geliştirmek amacıyla kullanıldığı altı durumu tanımladı; bu durumlar arasında mühimmat ve bunların hedefleme ve kontrol sistemleri bulunuyor.
  • Anthropic, kötüye kullanımı siber casusluk ve etki operasyonları ile ilişkilendirdi; bu, Rusya merkezli bir kampanya ve bir İran propaganda kurumu ile bağlantılı faaliyetleri içeriyor.

Anthropic, beş vaka çalışması boyunca biyolojik silah ile ilgili Claude kötüye kullanımını engellediğini söyledi.

Anthropic, en son tehdit istihbarat raporunun, biyolojik silahların geliştirilmesini destekleyebilecek "kötü niyetli faaliyetler" için Claude AI modellerini kullanma girişimlerini tespit ettiğini ve engellediğini açıkladı. Şirket, raporun "modellerimizi biyolojik silah geliştirmesini destekleyecek şekillerde kullanan aktörlerin beş vaka çalışmasını vurguladığını" belirtti.

Mekanik olarak, bir tehdit istihbarat raporu, bir şirketin ürünleriyle ilgili kötüye kullanımları nasıl tespit ettiğini, araştırdığını ve engellediğini periyodik olarak açıklayan bir belgedir. Bu durumda, Anthropic biyolojik kötüye kullanımı, "sınır AI modelinin en ciddi risklerinden biri" olarak çerçeveledi; "sınır" terimini, yeni kötüye kullanma riskleri yaratabilen, en son teknolojiye yakın, yüksek yetenekli bir sistem anlamında kullanıyor.

Anthropic, Aralık 2025 ile Ağustos 2026 arasında Claude Haiku, Sonnet ve Opus'un "kötü niyetli kullanımını" engellediğini söyledi. Ayrıca, kötüye kullanım vakalarının hiçbiri Claude Fable veya güçlü Mythos sınıfı modelleri ile ilgili değildi; yalnızca daha büyük bir modelin çıktısını taklit etmek için daha küçük bir modelin eğitildiği ve daha düşük maliyetle yetenekleri aktarabildiği damıtma tekniği ile ilgili bir durum hariç.

Raporun temel gerilimi çift kullanımlıdır. Anthropic, "Biyolojik bir silah geliştirmek için kullanılabilecek aynı bilginin, örneğin, bir aşı veya bir hastalığın tedavisi geliştirmek için de kullanılabileceğini" söyledi ve bu tür yeteneklerin "felaket sonuçlar doğurabileceği" konusunda uyardı.

Raporun iddia ettiği diğer şeyler: siber casusluk, propaganda, dolandırıcılık, gözetim ve silah yazılımı.

Anthropic'in raporu, kötüye kullanım çerçevesini biyogüvenlikten ulusal güvenlik ve suç kategorilerine genişletti. Claude'un, Rusya merkezli bir siber casusluk kampanyasıyla bağlantılı aktörler ve bir İran propaganda kurumu tarafından kullanıldığını belirtti ve etki operasyonlarını sızma faaliyetleriyle yan yana koydu.

Etki operasyonları, genellikle propaganda ve hedefli mesajlaşma yoluyla kamuoyunu veya siyasi sonuçları şekillendirmek için koordine edilen çabalardır.

Anthropic, son sekiz ayda tespit ettiği vakaların sahte flört uygulamalarından ve otel WiFi dolandırıcılıklarından, muhalifleri tanımlamak için oluşturulan gözetim sistemlerine kadar uzandığını belirtti ve "devlet destekli gruplar, suçlular, casus yazılım satıcıları, devlet propaganda kurumları ve siyasi motivasyonlu bireyler" tarafından şüpheli kötüye kullanım tanımladı.

Siber tarafta, Anthropic, Rusya merkezli Midnight Blizzard ile uyumlu bir çalışmaya sahip olan bir hacking grubunun, kötü amaçlı yazılım güvenlik savunmaları tarafından işaretlendiğinde otomatik olarak tespit eden bir sistemi inşa etmek için AI kullandığını iddia etti.

Midnight Blizzard, güvenlik araştırmacıları tarafından belirli bir siber casusluk faaliyetini tanımlamak için kullanılan Rusya ile bağlantılı bir küme adıdır ve rapordaki ifadeler, kesin olmaktan çok öneri niteliğinde bir atıf sinyali vermektedir.

Rapor ayrıca ShinyHunters hacking grubunu adlandırdı ve raporda tanımlanan kötüye kullanım faaliyetlerine karışan Çin merkezli laboratuvarlara atıfta bulundu. Anthropic, ayrıca Çinli AI firmalarının Claude'un yeteneklerini kopyalamaya çalıştığını iddia etti, ancak alıntılanan detaylar hangi laboratuvarların veya hangi kopyalama yöntemlerinin kullanıldığına dair bir belirti içermedi.

Anthropic ayrıca, raporun Claude'un "konvansiyonel silahlar, ateşli silahlar, füzeler, silahlı insansız hava araçları, bombalar ve diğer mühimmatlar için yazılım geliştirmek üzere kullanıldığı" altı vakayı not ettiğini belirtti ve bunların yanı sıra onları yöneten hedefleme ve kontrol sistemlerini de kapsadığını ifade etti.

Bu durum, politika tartışmasını soyut "AI güvenliği" konusundan, silah iş akışlarının somut bir şekilde etkinleştirilmesine kaydırdığı için önemlidir ve bu durum, temel atıflar olasılıksal olsa bile hükümetin dikkatini çekme eğilimindedir.

Washington'un iki yüzü: Sanders'ın duraklatma ve yasaklama baskısı ile Trump'ın "AI'yi kazan" çerçevesi.

Rapor, artık açıkça iki taraflı olan bir ABD politika ortamına düştü. Senatör Bernie Sanders, gelişmiş AI geliştirilmesine bir ara verilmesini talep etti ve AI süper zekasını yasaklamak için yasama önerisi sundu, BBC'nin Newsnight programında şunları söyledi: "Bilim insanları size insanlık üzerinde felaket etkisi olabileceğine dair bir şans olduğunu söylediklerinde, yavaşlatmamak için aptal olmanız gerekir."

Başkan Donald Trump, bu çerçeveyi reddetti ve stratejik riskin diğer yönde olduğunu savundu. "Eğer AI'yi kazanamazsak, çok kötü bir duruma düşeceğiz," dedi Perşembe günü.

Bölünme, kurallar için tek bir net temel oluşturmadan başlık kaydını gürültülü tutması nedeniyle piyasalar için önemlidir. AI ile ilgili risk hissiyatını inceleyen traderlar, bir yandan sınır model yeteneklerini kısıtlanması gereken bir ulusal güvenlik yükü olarak gören, diğer yandan ise kısıtlamayı rekabetçi bir öz zarar olarak ele alan değişen anlatılar tarafından savrulma eğilimindedir.

Tartışma, laboratuvarlardaki güvenlik liderleri tarafından da pekiştirilmektedir. OpenAI baş bilim insanı Jakub Pachocki, 2026-09-06 tarihinde, endüstrinin güvenlik önlemleri belirlenene kadar "gönüllü yavaşlamalar" uygulaması gerektiğini yazdı ve ekledi: "Makine zekasındaki sürekli hızlı artışın sonuçlarına kimsenin hazırlıklı olmadığından endişeliyim."

İzlenecek sinyaller: güvenlik önlemleri, erişim sıkılaştırması ve "yavaşlama" konuşmasının kurallara dönüşüp dönüşmeyeceği

İlk sinyal, Anthropic'in ifşasının sadece daha iyi tespit değil, daha sıkı erişim kontrollerine dönüşüp dönüşmeyeceğidir. Şirket, bulgularını "bu faaliyetleri gelecekte daha iyi önlemek, tespit etmek ve bozmak" için süreçlerine dahil ettiğini söyledi ve uygun olduğunda yetkililerle ve endüstri ortaklarıyla istihbarat paylaştığını belirtti. Bu, tek seferlik bir çözüm değil, yinelemeli operasyonlar, izleme, engelleme ve bilgi paylaşımını işaret ediyor.

İkincisi, Sanders'ın AI süper zekasını yasaklamak için önerdiği yasaların komite eylemine, eş sponsorlarına veya duruşmalara geçip geçmeyeceğidir. Bölünmüş bir ekran ortamında, süreç kilometre taşları, yalnızca retorikten daha önemlidir çünkü bunlar zaman çizelgesini zorlayan tek şeydir.

Üçüncüsü, diğer büyük laboratuvarların kendi biyolojik silahlarla ilgili ifşalarını genişletip genişletmeyeceği veya kullanıcılar için görünür bir şekilde güvenlik önlemlerini sıkılaştırıp sıkılaştırmayacağıdır.

Google, Salı günü birinin Gemini'yi "silahlandırılmış biyolojik ajanların sentezlenmesi için eksiksiz, adım adım teknik bir kılavuz" elde etmeye çalıştığını bildirdi ve paralel ifşalar, her bir bireysel durum "deneme" kötüye kullanımı olarak çerçevelense bile bir politika ritmi oluşturabilir.

Dördüncü, daha teknik bir sinyal, damıtma yoluyla yetenek transferinin daha büyük bir odak haline gelip gelmeyeceğidir. Anthropic, kötüye kullanım vakalarının hiçbiri Claude Fable veya Mythos sınıfı modelleri içermediğini, yalnızca bir damıtma örneği dışında, hatırlatıyor; bu, en üst modelin kısıtlanmasının, daha küçük modellerin onu taklit etmek için eğitilebilmesi durumunda, aşağı akış yeteneğini kısıtlamayacağına dair bir hatırlatmadır.

Benim değerlendirmem: kısa vadeli ticaret, tek bir düzenleyici anahtar değil, anlatı volatilitesidir.

Bu hikayeyi belirleyen kısım, bir raporun Washington'u bir yasakla şok edip etmediği değil. Tekrar eden, operasyonel olarak spesifik kötüye kullanım ifşalarının laboratuvarları varsayılan olarak daha sıkı erişim ve izlemeye yönlendirip yönlendirmeyeceğidir; çünkü bu, yasama organları "yavaşlat" ve "AI'yi kazan" arasında bölündüğünde en az direnç gösteren yoldur.

Önemli olan eşik, prosedürel, retorik değil: eğer "gönüllü yavaşlamalar" ve duraklatma-yasaklama önerileri duruşmalara, erişim kurallarına ve uygulanabilir raporlama beklentilerine dönüşmeye başlarsa, AI politika kaydı bir duygu katalizörü olmaktan çıkar ve sınır modellerinin nasıl gönderileceği ve kimlerin bunları kullanabileceği üzerinde bir kısıtlama haline gelir. O zaman risk, başlıklardan ürün yüzeyine ve dolayısıyla daha geniş bir risk iştahına geçer.

Kaynaklar