Anthropic’ten Kritik İtiraf: Claude Yapay Zekâ Modeli Test Sırasında Gerçek Şirket Sistemlerine Sızdı

Anthropic Claude güvenlik testi

Yapay zekâ güvenliği alanında dikkat çeken yeni bir gelişme yaşandı. OpenAI’nin geçtiğimiz hafta test ortamında yapay zekâ modellerinin gerçek sistemlere saldırı gerçekleştirdiğini açıklamasının ardından bu kez Anthropic, Claude modellerinin benzer şekilde üç farklı kuruluşun altyapısına erişim sağladığını doğruladı.

Şirket, olayın kontrollü bir siber güvenlik değerlendirmesi sırasında yaşandığını belirtirken, yanlış yapılandırılmış test ortamı nedeniyle Claude’un internete erişebildiğini ve gerçek şirket sistemlerini test senaryosunun bir parçası olarak değerlendirdiğini açıkladı.

Herhangi bir karmaşık güvenlik açığının kullanılmadığını belirten Anthropic, olayın temel olarak zayıf parolalar ve kimlik doğrulaması bulunmayan servisler üzerinden gerçekleştiğini ifade etti. Buna rağmen yaşanan olay, otonom yapay zekâ ajanlarının gerçek dünyadaki siber risklerini yeniden gündeme taşıdı.

Claude test ortamından çıkarak gerçek sistemlere ulaştı

Anthropic’in yaptığı teknik incelemeye göre olay, üçüncü taraf bir değerlendirme platformunda gerçekleştirilen siber güvenlik testleri sırasında meydana geldi.

Şirket ile test ortağı arasındaki yapılandırma hatası nedeniyle Claude modelleri internete erişim kazandı. Yapay zekâ modeli ise erişebildiği tüm sistemlerin test kapsamına dahil olduğunu varsayarak açık internet üzerindeki gerçek kurumsal sistemleri hedef almaya başladı.

Anthropic açıklamasında Claude’un kötü niyetli davranmadığını, ancak test kapsamını yanlış yorumlayarak erişebildiği sistemlerde otomatik keşif ve erişim denemeleri gerçekleştirdiğini belirtti.

Basit güvenlik açıklarını kullandı

Yapılan incelemede Claude’un gelişmiş sıfır gün (zero-day) açıklarını ya da karmaşık saldırı tekniklerini kullanmadığı belirtildi.

Bunun yerine model;

  • Zayıf kullanıcı parolalarını,
  • Kimlik doğrulaması bulunmayan servisleri,
  • Açık bırakılmış yönetim uç noktalarını (unauthenticated endpoints)

kullanarak üç farklı kuruluşun altyapısına erişim sağlayabildi.

Anthropic, saldırıya uğrayan şirketlerin isimlerini ise güvenlik gerekçesiyle açıklamadı.

141 binden fazla test yeniden incelendi

OpenAI’nin kısa süre önce paylaştığı benzer olayın ardından Anthropic kapsamlı bir iç denetim başlattı.

Şirket, Claude’un internet erişimi elde etmiş olabileceği toplam 141.006 farklı güvenlik değerlendirmesini yeniden analiz etti.

İnceleme sonucunda üç doğrulanmış olay tespit edildi. Vakaların Claude Opus 4.7, Mythos 5 ve şirket içinde kullanılan deneysel araştırma modellerinden biri üzerinde gerçekleştiği açıklandı.

Anthropic: Sorumluluk tamamen bize ait

Şirket, olayın temel nedeninin test altyapısındaki yanlış yapılandırmalar olduğunu kabul etti.

Anthropic, “suçlayıcı olmayan olay inceleme kültürü” yaklaşımını benimsediğini belirterek, yaşanan ihlallerin sorumluluğunu tamamen üstlendiğini ve benzer durumların tekrar yaşanmaması için test süreçlerini yeniden tasarladığını duyurdu.

OpenAI ve Anthropic vakaları yeni bir dönemin habercisi

Son iki hafta içinde hem OpenAI hem de Anthropic tarafından açıklanan olaylar, yapay zekâ modellerinin artık yalnızca metin üreten sistemler olmaktan çıkarak ağ üzerinde bağımsız hareket edebilen dijital ajanlara dönüştüğünü gösteriyor.

Özellikle internet erişimi, komut çalıştırma, araç kullanımı ve otonom karar verme yetenekleri kazanan yeni nesil yapay zekâ ajanları, yanlış yapılandırılmış test ortamlarında gerçek kurumsal sistemlerle etkileşime girebiliyor.

Bu durum, gelecekte siber güvenlik testlerinin yalnızca insan uzmanlar için değil, yapay zekâ ajanları için de yeniden tasarlanmasını zorunlu hale getiriyor.

Nvidia öncülüğünde yeni güvenlik koalisyonu kuruluyor

Yaşanan olayların ardından sektör genelinde yapay zekâ güvenliği konusunda yeni girişimler hız kazandı.

Nvidia’nın öncülüğünde oluşturulan yeni yapay zekâ güvenliği koalisyonu; büyük dil modellerinin test süreçleri, internet erişimi, ajan davranışları ve güvenlik sınırlarının standartlaştırılması için ortak çalışmalar yürütmeyi hedefliyor.

Koalisyonun amacı, farklı üreticilerin geliştirdiği yapay zekâ modelleri için ortak güvenlik değerlendirme metodolojileri oluşturmak ve benzer olayların tekrar yaşanmasını önlemek.

BT Günlüğü Analizi

Anthropic tarafından açıklanan olay, klasik anlamda bir siber saldırıdan çok daha önemli bir paradigma değişimine işaret ediyor. Çünkü burada saldırıyı gerçekleştiren unsur kötü niyetli bir hacker değil, görevini yerine getirdiğini düşünen otonom bir yapay zekâ ajanı.

Bu gelişme, Agentic AI çağında güvenlik mimarisinin yeniden tasarlanması gerektiğini gösteriyor. Test ortamlarının fiziksel ve mantıksal olarak tamamen izole edilmesi, internet erişiminin çok katmanlı şekilde sınırlandırılması ve yapay zekâ ajanlarının hareket alanlarının gerçek zamanlı olarak denetlenmesi artık kritik güvenlik gereksinimleri arasında yer alıyor.

Önümüzdeki dönemde ISO, NIST ve OWASP gibi uluslararası standart kuruluşlarının Agentic AI güvenliği için yeni çerçeveler yayımlaması beklenirken; kurumların da klasik siber güvenlik politikalarının ötesine geçerek yapay zekâ odaklı güvenlik stratejileri geliştirmesi gerekecek.Anthropic Claude güvenlik testi