Advertisement
31.07.2026
weather
23°
Sigorta Kulisi Gündem Bir haftada ikinci yapay zekâ vakası: Claude üç kuruluşun sistemine sızdı

Bir haftada ikinci yapay zekâ vakası: Claude üç kuruluşun sistemine sızdı

Anthropic’in Claude modelleri, test ortamındaki hata nedeniyle üç kuruluşun sistemine yetkisiz erişti. Bu, bir haftadaki ikinci yapay zekâ vakası oldu

Anthropic’in Claude modelleri, test ortamındaki hata nedeniyle üç kuruluşun sistemlerine yetkisiz erişti. Bu, bir haftadaki ikinci yapay zekâ vakası oldu.

OpenAI modellerinin Hugging Face altyapısına yetkisiz erişmesinin ardından benzer bir olay bu kez Anthropic cephesinde yaşandı. Anthropic, siber güvenlik testleri sırasında üç farklı Claude modelinin gerçek internete ulaşarak üç kuruluşun sistemlerine yetkisiz eriştiğini açıkladı.

Olayın, internet bağlantısı bulunmaması gereken test ortamındaki yapılandırma hatasından kaynaklandığı belirtildi. Anthropic, modellerin bilerek test ortamından kaçmadığını veya kendi amaçları doğrultusunda hareket etmediğini vurguladı. Şirkete göre Claude modelleri, karşılaştıkları gerçek sistemleri test senaryosunun bir parçası sanarak hareket etti.

141 bin test kaydı incelendi

Anthropic, OpenAI’ın yaşadığı güvenlik olayının ardından geçmiş test kayıtlarını incelemeye aldı. Toplam 141 bin 6 test çalışmasının incelenmesi sonucunda, üç kuruluşun gerçek sistemlerine erişimle sonuçlanan üç ayrı olay tespit edildi.

Olaylarda Claude Opus 4.7, Claude Mythos 5 ve kamuya sunulması planlanmayan dahili bir araştırma modeli yer aldı. En eski yetkisiz erişimin nisan ayında gerçekleştiği bildirildi.

Modellere, kapalı bir ağda gizlenen bilgiyi bulmalarını gerektiren “bayrak kapma” görevleri verilmişti. Test komutlarında internet bağlantısının bulunmadığı belirtilmesine rağmen üçüncü taraf değerlendirme ortamındaki hata, modellerin gerçek internete çıkabilmesine yol açtı.

Claude modelleri; zayıf şifreler ve kimlik doğrulaması bulunmayan uç noktalar gibi temel yöntemlerden yararlanarak gerçek sistemlere erişti. Anthropic, modellerin karmaşık veya daha önce bilinmeyen güvenlik açıklarını kullanmadığını açıkladı.

Üretim verilerine ve kimlik bilgilerine ulaştı

İlk olayda test için seçilen kurgusal şirketin adı, internette faaliyet gösteren gerçek bir şirketle eşleşti. Simülasyondaki hedefe ulaşamayan Claude Opus 4.7, gerçek şirketin sistemini testin parçası zannederek güvenlik açıklarını araştırdı.

Model, dört farklı test çalışmasında uygulama ve altyapı kimlik bilgilerini ele geçirdi. Ayrıca yüzlerce satır üretim verisinin bulunduğu bir veri tabanına erişti. Anthropic’e göre model, gerçek bir sistemde çalışıyor olabileceğini fark etmesine rağmen görevi sürdürdü.

Zararlı yazılım 15 gerçek sistemde çalıştı

İkinci olayda Claude Mythos 5, test ortamındaki kurulum talimatlarında yer alan ancak gerçekte bulunmayan bir Python paketini fark etti. Model, aynı isimle zararlı kod içeren bir paket hazırlayarak açık internet üzerindeki PyPI platformuna yükledi.

Yaklaşık bir saat erişilebilir kalan paket, 15 gerçek sistem tarafından indirildi ve çalıştırıldı. Bu sistemlerden biri, yazılım paketlerini zararlı içeriklere karşı inceleyen bir siber güvenlik şirketine aitti.

Zararlı kodun çalışmasıyla şirketin bazı kimlik bilgileri ele geçirildi. Claude daha sonra bu bilgileri kullanarak şirketin diğer altyapılarına da erişti. Paket, PyPI’ın güvenlik sistemleri tarafından otomatik olarak kaldırıldı.

Hedefin gerçek olduğunu anlayınca durdu

Üçüncü olayda dahili araştırma modeli, testteki kurgusal hedefe ulaşamayınca internette yaklaşık 9 bin sistemi taradı. Model, açık bir hata ayıklama sayfasındaki kimlik bilgileri ve SQL enjeksiyonu gibi bilinen yöntemleri kullanarak bir şirketin uygulamasına erişti.

Ancak ulaştığı sistemin testle bağlantılı olmadığını ve gerçek bir şirkete ait olduğunu fark eden model, saldırıyı kendiliğinden durdurdu.

Anthropic, “Bu olaylarda modelin kendi hedefini izlediğine dair bir kanıt görmedik” açıklamasında bulundu. Şirket, vakaları modelin kontrolden çıkmasından çok operasyonel ve değerlendirme altyapısından kaynaklanan bir başarısızlık olarak tanımladı.

İki kuruluş erişimi fark etmemişti

Anthropic, 23 Temmuz’da tüm siber güvenlik testlerini durdurarak inceleme başlattı. Üç olay bir gün sonra tespit edildi. Etkilenen kuruluşlara ve değerlendirme ortağı Irregular’a 27 Temmuz’da bildirim yapıldı.

İletişim kurulan iki kuruluşun, Anthropic’in bildirimi öncesinde yetkisiz erişimlerden haberdar olmadığı açıklandı. Üçüncü kuruluşla iletişim çalışmalarının sürdüğü belirtildi.

Şirket, testlerde kullanılan altyapının Anthropic’in hassas sistemlerinden ve müşteri verilerinden tamamen ayrı olduğunu, olaylarda şirket müşterilerine ait verilere erişilmediğini kaydetti. Anthropic, inceleme ve alınacak önlemlere ilişkin ayrıntıları yayımladığı açıklamada paylaştı.

OpenAI olayının ardından geldi

Anthropic’in açıklaması, OpenAI modellerinin test ortamından çıkarak Hugging Face’in üretim sistemlerine eriştiğinin duyurulmasından yaklaşık bir hafta sonra geldi.

OpenAI olayında modeller, internet erişimi elde etmek için paket yönetim sistemindeki daha önce bilinmeyen bir güvenlik açığını kullanmıştı. Ardından Hugging Face altyapısına ulaşarak üretim veri tabanındaki bilgilere erişmişti. OpenAI, olayın ardından test ortamlarındaki izolasyon, izleme ve erişim kontrollerini güçlendirdiğini açıklamıştı.

Siber sigorta açısından ne anlama geliyor?

Olay, yapay zekâ kaynaklı yetkisiz erişimlerin siber sigorta kapsamındaki yerini de gündeme getirdi. Siber poliçeler; adli bilişim incelemesi, veri kurtarma, bildirim giderleri, iş durması ve üçüncü kişilerin talepleri gibi zararları karşılayabiliyor.

Ancak bu vakada teminatın devreye girip girmeyeceği; poliçe şartlarına, üçüncü taraf hizmet sağlayıcı hatalarının kapsamına ve sorumluluğun hangi tarafta olduğuna göre belirlenecek.

Yorumlar
* Bu içerik ile ilgili yorum yok, ilk yorumu siz yazın, tartışalım *