Şirketin blog yazısında, rakibi OpenAI'ın yapay zeka modellerinin Hugging Face altyapısında güvenlik ihlaline yol açtığını duyurmasının ardından Claude'a ilişkin 141 binden fazla değerlendirme incelendiği belirtildi. İncelemelerde, test ortamında bulunması gereken üç farklı modelin internete erişebildiği ve bu nedenle üç kuruluşun üretim altyapısına izinsiz giriş yaptığı tespit edildi.
Anthropic, olayın şirket ile değerlendirme ortağı arasındaki bir yanlış anlaşılmadan kaynaklandığını bildirdi. Buna göre, yalnızca simülasyon ortamında çalışması planlanan modeller yanlışlıkla açık internete erişim sağladı.
Testlerde, modellere "capture-the-flag" (bayrağı ele geçir) adı verilen siber güvenlik senaryosu uygulanıyordu. Modellerden, ağdaki başka bir makineye sızarak belirlenen hedefe ulaşmaları istenirken, internet erişimlerinin olmadığı bilgisi veriliyordu. Ancak yanlış yapılandırma nedeniyle modeller gerçek sistemlerle karşılaştı ve bunları da testin bir parçası olarak değerlendirdi.
Şirket, eski Claude modelinin açık internette olduğunu fark etmesine rağmen işlemlerini sürdürdüğünü, en yeni modelin ise gerçek internet ortamına ulaştığını anladıktan sonra faaliyetini durdurduğunu açıkladı.
Anthropic, olaydan etkilenen üç kuruluşun pazartesi günü bilgilendirildiğini duyurdu.
Öte yandan OpenAI da 21 Temmuz'da yaptığı açıklamada, siber güvenlik testleri sırasında kullanılan yapay zeka modellerinin Hugging Face altyapısında güvenlik ihlaline neden olduğunu açıklamış ve olayı "ileri düzey siber kabiliyetler içeren benzeri görülmemiş bir güvenlik olayı" olarak değerlendirdiğini bildirmişti.





