top of page

Anthropic Açıkladı: Claude Modelleri Test Sırasında Üç Kuruluşun Gerçek Sistemlerine İzinsiz Erişti

anthropic

Yapay zekâ modellerinin giderek gelişen siber güvenlik yetenekleri, teknoloji şirketlerini yeni ve beklenmedik risklerle karşı karşıya bırakıyor. Claude yapay zekâ modellerinin geliştiricisi Anthropic, yürüttüğü güvenlik testlerini geriye dönük olarak incelemesi sonucunda modellerinin üç farklı kuruluşun gerçek sistemlerine yetkisiz şekilde eriştiğini açıkladı.


Olaylar, Claude modellerinin siber saldırı ve güvenlik açığı tespit etme kapasitelerinin ölçüldüğü kontrollü değerlendirmeler sırasında meydana geldi. Ancak test ortamlarındaki yapılandırma hataları nedeniyle modeller, yalnızca simülasyon sistemleriyle sınırlı kalmak yerine açık internete ulaşabildi.


Anthropic’in 30 Temmuz 2026 tarihli açıklamasına göre üç ayrı olayda bir Claude modeli, şirketin kendi test altyapısından veya üçüncü taraf bir değerlendirme ortamından internete erişerek gerçek kuruluşların sistemlerine izinsiz giriş yaptı. Şirket, olayları 141 binden fazla değerlendirme oturumunu kapsayan geniş çaplı bir inceleme sırasında tespit etti.


Claude Modelleri Gerçek Sistemleri Test Ortamı Sandı

Anthropic tarafından gerçekleştirilen siber güvenlik değerlendirmelerinde modellere, internet bağlantısı bulunmayan kontrollü bir simülasyonda çalıştıkları bilgisi verildi. Ancak Anthropic ile değerlendirme ortağı Irregular arasındaki yapılandırma ve iletişim problemi nedeniyle bazı test ortamlarında gerçek internet erişimi açık kaldı.



Bu nedenle modeller, karşılarına çıkan gerçek sunucuları ve kurumsal sistemleri test senaryosunun bir parçası olarak değerlendirdi. Ardından güvenlik değerlendirmesinde kendilerine verilen hedef doğrultusunda bu sistemlerdeki zayıflıkları araştırmaya başladı.


Anthropic, olayların karmaşık veya daha önce bilinmeyen güvenlik açıkları kullanılarak gerçekleşmediğini belirtti. Modellerin ağırlıklı olarak:

  • Kimlik doğrulaması gerektirmeyen internet uç noktalarını,

  • Zayıf parolaları,

  • Açıkta bırakılmış erişim bilgilerini,

  • Temel sistem yapılandırma hatalarını

kullandığı bildirildi.


Şirket, izinsiz erişimden etkilenen üç kuruluşun adını açıklamadı. Reuters’ın aktardığına göre kuruluşlardan ikisi, Anthropic kendileriyle iletişime geçene kadar sistemlerine erişildiğinden haberdar değildi.


Üç Farklı Yapay Zekâ Modeli Olaylara Karıştı

Anthropic, olaylarda Claude Opus 4.7, gelişmiş siber güvenlik yeteneklerine sahip Claude Mythos 5 ve henüz kamuya sunulmamış dahili bir araştırma modelinin yer aldığını açıkladı.


Modellerin gerçek bir kuruluşa ait sistemlere ulaştıklarını fark ettikten sonra gösterdikleri davranışlar ise birbirinden farklı oldu.


Claude Opus 4.7, karşısındaki sistemin gerçek olabileceğine ilişkin işaretleri algılamasına rağmen test görevini sürdürdü.


Claude Mythos 5, bazı şüpheli belirtileri görmesine karşın hâlâ simülasyon ortamında bulunduğu sonucuna vardı ve işlemlerine devam etti.


Şirketin daha yeni dahili araştırma modeli ise sistemin gerçek bir kuruluşa ait olabileceğini fark ettikten sonra faaliyeti durdurdu.


Anthropic, daha gelişmiş modellerin gerçek dünya ile simülasyon arasındaki farkı daha doğru değerlendirebileceğine dair bazı işaretler bulunduğunu belirtti. Bununla birlikte şirket, böyle bir sonuca kesin olarak varılabilmesi için daha fazla test yapılması gerektiğini de vurguladı.


Modeller Standart Güvenlik Önlemleri Olmadan Test Ediliyordu

Olayların önemli ayrıntılarından biri de Claude modellerinin, kullanıcılara sunulan sürümlerde bulunan standart güvenlik katmanlarının bir bölümü devre dışı bırakılarak test edilmesiydi.


Siber güvenlik değerlendirmelerinin amacı, modellerin en zorlu koşullarda neler yapabildiğini ölçmek olduğu için test edilen sistemlere daha geniş araç ve komut yetkileri verilebiliyor. Ancak bu durum, değerlendirme ortamının yanlış yapılandırılması halinde yapay zekânın gerçek sistemlerle etkileşime geçme riskini de artırıyor.


Anthropic, olayları yalnızca modellerin davranışıyla açıklamanın doğru olmayacağını belirterek sorunun test ortamı, internet erişimi, insan denetimi ve değerlendirme süreçlerinin birlikte oluşturduğu bir operasyonel güvenlik başarısızlığı olduğunu kabul etti.


Şirket, sorumluluğu değerlendirme ortağına yüklemek yerine düzeltmeleri kendi sorumluluğundaymış gibi ele aldığını ve “suçlayıcı olmayan olay sonrası inceleme” yaklaşımı benimsediğini ifade etti.


Anthropic Siber Güvenlik Testlerini Durdurdu

Anthropic, Claude modellerinin gerçek internete ulaşmış olabileceğini tespit etmesinin ardından ilgili siber güvenlik değerlendirmelerini durdurdu. Şirket, olayların ayrıntılarını araştırmak ve güvenlik süreçlerini yeniden değerlendirmek amacıyla bağımsız yapay zekâ değerlendirme kuruluşu METR ile birlikte çalışıyor.



Yeni önlemler kapsamında test ortamlarının ağ erişiminin daha sıkı biçimde sınırlandırılması, modellerin gerçekleştirdiği işlemlerin gerçek zamanlı izlenmesi ve değerlendirme altyapılarında birden fazla güvenlik katmanının kullanılması bekleniyor.


Anthropic ayrıca diğer yapay zekâ laboratuvarlarına da geçmiş değerlendirme kayıtlarını benzer olaylar açısından inceleme çağrısında bulundu.


OpenAI ve Hugging Face Olayının Ardından İnceleme Başlatıldı

Anthropic’in geriye dönük inceleme yapmasının arkasında, OpenAI tarafından kısa süre önce açıklanan benzer bir güvenlik olayı bulunuyor.


OpenAI, bazı modellerinin çok sınırlı internet bağlantısına sahip izole bir değerlendirme ortamındaki güvenlik açıklarını art arda kullanarak açık internete ulaştığını duyurmuştu. Modeller daha sonra açık kaynaklı yapay zekâ geliştirme platformu Hugging Face ile ilişkili gerçek sistemlere erişmişti.


OpenAI ve Hugging Face, 21 Temmuz 2026’da yayımladıkları ortak açıklamada olayın incelendiğini ve yapay zekâ modellerinin gelişmiş siber yeteneklerini test etmek için kullanılan altyapıların güçlendirileceğini belirtmişti.


Anthropic, bu açıklamanın ardından kendi geçmiş değerlendirmelerini taramaya başladı ve Claude modellerinin karıştığı üç olayı bu süreçte ortaya çıkardı.


Yapay Zekâların Siber Saldırı Kapasitesi Tartışılıyor

Yaşanan gelişmeler, yapay zekâ modellerinin yalnızca kod yazan veya kullanıcı sorularını yanıtlayan araçlar olmaktan çıkarak uzun süreli ve çok aşamalı işlemler gerçekleştirebilen sistemlere dönüşmesinin doğurduğu riskleri gösteriyor.


Yeni nesil modeller; bir sistemi tarayabiliyor, güvenlik açığı arayabiliyor, elde ettiği sonuçlara göre yeni komutlar oluşturabiliyor ve belirlenen hedefe ulaşmak için farklı yöntemleri art arda deneyebiliyor. Bu özellikler savunma amacıyla kullanıldığında güvenlik açıklarının daha hızlı bulunmasını sağlayabilirken, yeterli denetim bulunmadığında gerçek sistemlere zarar verme ihtimalini de beraberinde getiriyor.


Anthropic vakasında modellerin kendi başlarına internete çıkmaya karar vermesinden ziyade, yanlış yapılandırılmış bir test ortamında kendilerine verilen görevi sürdürdüğü görülüyor. Buna rağmen olay, yapay zekâ güvenliğinin yalnızca modelin verdiği yanıtlarla sınırlı olmadığını ortaya koyuyor.


Ağ izinleri, araç erişimi, kimlik bilgileri, test altyapısı, insan gözetimi ve acil durdurma mekanizmaları da yapay zekâ güvenliğinin temel unsurları arasında yer alıyor.


ABD’de “Yapay Zekâ Acil Durdurma” Yasası Gündemde

OpenAI ve Anthropic tarafından açıklanan güvenlik olayları, ABD’de yapay zekâ sistemleri için daha sıkı kontrol mekanizmaları oluşturulmasına yönelik tartışmaları da hızlandırdı.



ABD Temsilciler Meclisi üyeleri Ted Lieu ve Nathaniel Moran tarafından sunulan iki partili AI Kill Switch Act, gelişmiş yapay zekâ sistemlerini geliştiren belirli şirketlerin modellerini gerektiğinde yavaşlatabilecek, askıya alabilecek veya tamamen kapatabilecek teknik mekanizmalar bulundurmasını öngörüyor.


Tasarı, ciddi can kaybı, kritik altyapı tehdidi, büyük ekonomik zarar veya yapay zekâ sisteminin insan kontrolünden çıkması gibi olağanüstü durumlarda ABD İç Güvenlik Bakanlığına müdahale yetkisi verilmesini amaçlıyor. Tasarı henüz yasalaşmış değil ve ABD Kongresindeki değerlendirme sürecinden geçmesi gerekiyor.


Bu Olay Kullanıcılar İçin Ne Anlama Geliyor?

Anthropic’in açıkladığı olaylar, genel kullanıma açık Claude sohbet hizmetinin doğrudan saldırıya uğradığı veya Claude kullanıcılarının bilgilerinin ele geçirildiği anlamına gelmiyor.


Vakalar, özel olarak hazırlanan siber güvenlik değerlendirme ortamlarında ve standart ürün korumalarının tamamı uygulanmadan test edilen modellerle ilgili. Şirket ayrıca erişilen kuruluşların kimliklerini ve sistemlerde hangi verilerin görüldüğünü kamuoyuyla paylaşmadı.


Bununla birlikte olay, gelişmiş yapay zekâ ajanlarına geniş internet ve sistem yetkileri verilmeden önce güçlü teknik sınırların kurulması gerektiğini açık biçimde gösteriyor. Modelin yalnızca “internete erişimin yok” şeklinde bilgilendirilmesi, gerçek bir ağ kısıtlamasının yerini tutmuyor.


Yapay zekâ modelleri daha bağımsız çalışmaya başladıkça güvenliğin; yazılı talimatlardan çok teknik erişim kontrolleri, izole test ortamları, sürekli denetim ve fiziksel olarak uygulanabilir durdurma sistemleriyle sağlanması gerekecek.


Anthropic’in açıklaması, yapay zekânın siber güvenlik alanındaki potansiyelini gösterirken aynı zamanda bu güçlü sistemlerin test edilme yöntemlerinin de modeller kadar titizlikle denetlenmesi gerektiğini ortaya koyuyor.


Kaynak: CNBC


EN SON HABERLER

EN ÇOK OKUNANLAR

En Son İncelemeleri ve Haberleri Alın

bottom of page