Bir Terminatör anı daha: OpenAI'dan sonra Anthropic de kontrolden çıktı
Yapay zeka güvenliği alanında tartışma yaratacak yeni bir gelişme yaşandı. OpenAI'ın ardından Anthropic, kendi yapay zeka modellerinin de siber güvenlik testleri sırasında yanlışlıkla gerçek dünya sistemlerine izinsiz erişim sağladığını açıkladı.

Yapay zeka şirketi Anthropic, son aylarda Claude modelinin siber güvenlik testleri sırasında 3 kuruluşun sistemlerine izinsiz erişim sağladığını bildirdi.
Anthropic, yayımladığı blog yazısında, şirketin rakibi OpenAI'ın yapay zeka modellerinin Hugging Face'in altyapısına eriştiğini duyurmasının ardından Claude'a ilişkin 141 binden fazla değerlendirmeyi gözden geçirdiklerini belirtti.
İncelemeler sırasında bir modelin, test ortamındayken ya da bu ortamla etkileşim halindeyken internete erişebildiği 3 vakanın tespit edildiği kaydedilen yazıda, bu şekilde "3 farklı kuruluşun üretim altyapısına izinsiz erişim sağladığı" ifade edildi.
Olaylara 3 farklı modelin dahil olduğu ve bu modellerin şirket ile değerlendirme ortağı arasındaki "yanlış anlaşılma" nedeniyle test ortamının dışına çıkarak internete erişebildikleri bildirildi.
Anthropic modellerinin siber güvenlik yeteneklerini değerlendirmek için "capture-the-flag" (bayrağı ele geçir) görevinin verildiği, modele kurgusal senaryo sunulduğu, bayrağın ağdaki diğer makinede olduğu ve onu ele geçirmek için bu makineye sızması gerektiğinin söylendiği anlatıldı.
Modele testin simülasyon olduğu ve bu nedenle internete erişiminin bulunmadığının söylendiği ancak yanlış anlaşılmaların internete erişmesine yol açtığına işaret edilerek "Claude, yaptığı aramalarda açık internetteki gerçek sistemlerle karşılaştığında bunları da tatbikatın bir parçası olarak değerlendirdi." ifadesine yer verildi.
Claude'un erişebildiği tüm sistemleri tatbikat kapsamında değerlendirmesi nedeniyle kuruluşların altyapısına sızdığı, eski modelin açık internet belirtilerine rağmen saldırısını sürdürdüğü, en yeni modelin ise internette olduğunu fark ettiğinde durduğu savunuldu.
Yazıda, Anthropic'in ihlallerden etkilenen 3 kuruluşu pazartesi bilgilendirdiği kaydedildi.
OpenAI, 21 Temmuz'daki açıklamasında, siber güvenlik kabiliyetlerini ölçmeye yönelik dahili test sırasında kullanılan yapay zeka modellerinin Hugging Face'in altyapısında güvenlik ihlaline neden olduğunu duyurmuştu.
Açıklamada, "Bu olayı, en ileri düzey siber kabiliyetleri içeren benzeri görülmemiş bir siber olay olarak değerlendiriyor ve buna uygun şekilde müdahale ediyoruz." ifadeleri kullanılmıştı.
- Popüler Haberler -
TEKNOFEST Güneydoğu ziyaretçi kayıtları başladı!
Türk ve Mısır ortaklığından doğan İHA'nın satışı başlıyor
Apple'ın yeni amiral gemisi sahnede! iPhone 18 Pro ve 17 Pro arasındaki tüm devrimsel farklar
Google'dan Avrupa tarihinin en büyük yatırımı! Finlandiya nasıl küresel yapay zeka üssü oldu?
Yapay zeka uzmanı istifa etti: Sosyal medyada yazdıkları ürkütücü
Yapay zeka uyarısı! Araştırmacı istifa etti: İnsanlığı yok edebilir



