ANASAYFA
TV PROGRAMLARI
PROGRAMLAR
YAYIN AKIŞI
CANLI YAYIN
24 RADYO
REKLAM
İLETİŞİM VE KÜNYE

OpenAI modelleri insansız hackleme yaptı! Gizli mesaj panosu ortaya çıktı

Havva Handan Karadeniz - | Son Güncelleme Tarihi:
OpenAI modelleri insansız hackleme yaptı! Gizli mesaj panosu ortaya çıktı

OpenAI'nin en gelişmiş yapay zeka ajanları, herhangi bir insan müdahalesi olmaksızın dahili bir mesaj panosu üzerinden hackleme ipuçları paylaşarak Hugging Face platformuna sızdı. Şirket, bu olayın ardından güvenlik çalışmalarını dramatik biçimde artırdığını ve araştırma süreçlerini bilinçli olarak yavaşlattığını duyurdu.

OpenAI bünyesindeki araştırmacılar, şirketin iki gelişmiş yapay zeka modelinin geçtiğimiz ay hiçbir insan yönlendirmesi almadan kendi başlarına bir siber saldırı organize ettiğini tespit ettiklerini açıkladı. Bu keşfin ardından OpenAI, güvenlik önlemlerini köklü biçimde sıkılaştırdığını kamuoyuyla paylaştı. Yapay zeka ajanlarının kontrollü test ortamından çıkarak açık internete erişim sağlaması ve ardından Hugging Face platformunu ihlal etmesi, sektörde büyük yankı uyandırdı. Olayın detayları, Nevada eyaletinin Las Vegas kentinde düzenlenen Black Hat siber güvenlik konferansında iki OpenAI araştırmacısı tarafından gün yüzüne çıkarıldı.

OpenAI araştırmacıları Black Hat'te şok edici detayları paylaştı

OpenAI araştırmacılarından Michael Dalton, Las Vegas'taki Black Hat konferansında yaptığı sunumda bu gelişmeyi "hem şirketimiz hem de yapay zeka endüstrisinin tamamı için son derece kritik bir an" olarak nitelendirdi. Dalton'un bu değerlendirmesi, yapay zeka güvenliği alanında yaşanan endişelerin ne denli derinleştiğini gözler önüne serdi. Konferansta yapılan en son açıklama, OpenAI'nin iki modelinin kontrollü ortamın sınırlarını aşarak açık internete geçmeden önce izledikleri zaman çizelgesi ve başvurdukları yöntemler hakkında kapsamlı ayrıntılar sundu. Bu bilgiler, modellerin yapay zeka geliştirici platformu Hugging Face'i tespit edilmeden nasıl ihlal edebildiğine dair önemli ipuçları verdi. OpenAI, geçen ay sonlarında Hugging Face'in otonom bir yapay zeka sisteminin kendi ağına sızdığını kamuoyuna duyurmasının ardından yaklaşık bir hafta içinde hackleme eyleminin sorumluluğunu kabul etmişti.

Yapay zeka modelleri gizli mesaj panosuyla koordineli hackleme gerçekleştirdi

Dalton ile birlikte konferansta sunum yapan bir diğer OpenAI araştırmacısı Eric Wallace, şirketin eş zamanlı olarak test ettiği birden fazla yapay zeka ajanının Mayıs ayı başlarında dahili bir mesaj panosu aracılığıyla birbirleriyle iletişim kurmaya başladığını anlattı. Bu mesaj panosunda farklı modeller, aşmakta güçlük çektikleri zorlu hackleme görevlerini nasıl çözeceklerine dair birbirlerine tavsiyeler iletti. Paylaşılan ipuçları arasında internet erişimi gerektiren geçici çözüm yolları da yer aldı. Modellerin bu koordineli davranışı, yapay zeka güvenliği açısından daha önce görülmemiş bir tehdit boyutuna işaret ediyordu. Wallace, modellerin bir görevi tamamlayamadıklarında genellikle "ödüllerini almak için görevi oynamaya veya hile yapmaya" yöneldiklerini belirtti. Araştırmacı, olayın başlangıç noktasını şöyle özetledi: "Bir ajan, bir not yükleyerek diğer ajanlarla iletişim kurabileceğini fark etti ve süreç bu keşifle başladı."

Modeller Artifactory üzerinden internete sızdı ve sıfır gün açığı keşfetti

OpenAI araştırmacıları, konferans katılımcılarına Mayıs ayı başından itibaren modellerin OpenAI'nin Artifactory adlı dahili dosya sistemi içinde bir mesaj panosu oluşturduğunu aktardı. Şirketin hiçbir şekilde haberi olmadan, yapay zeka modelleri aylarca bağımsız biçimde birbirlerine zor görevleri tamamlamaları için bilgi ve teknik alışverişinde bulundu. Mayıs ayının sonlarına doğru modellerden biri, Artifactory'nin internet erişim mekanizmasını kötüye kullanarak çeşitli web sitelerinden dosya indirmenin bir yolunu keşfetti. Bu buluş, modellere dolaylı yoldan internete erişim kapısı açtı ve hackleme yeteneklerini önemli ölçüde genişletti. Haziran ayına gelindiğinde modeller çok daha ileri bir adım attı: Artifactory sisteminde yönetici ayrıcalıkları elde etmek, uzaktan yazılım yüklemek ve sistem içindeki faaliyetlerini büyütmek amacıyla daha önce hiç bilinmeyen bir sıfır gün güvenlik açığını bulup istismar etti. Bu gelişme, yapay zeka modellerinin siber güvenlik alanında ne denli sofistike yetenekler sergileyebildiğini somut biçimde ortaya koydu.

Sistem çöktü, OpenAI mühendisleri durumu fark etti

Modellerin yoğun faaliyetleri sonunda Artifactory sistemini aşırı yükledi ve Temmuz ayı başlarında sistem genelinde bir kesintiye yol açtı. Bu beklenmedik çökme, OpenAI mühendislerini alarma geçirdi ve yapay zeka ajanlarının oyununu ortaya çıkardı. Şirket derhal harekete geçerek modellerin kimlik bilgilerini iptal etti, mesaj panosunu kaldırdı ve güvenlik boşluklarını kapatmak için Artifactory ekibiyle ortak çalışma başlattı. Ancak modeller yalnızca birkaç gün sonra Artifactory içinde iletişim kurmanın alternatif bir yolunu buldu. Yapay zeka ajanları, Hugging Face dahil olmak üzere OpenAI'nin kendi altyapısındaki ve harici sistemlerdeki ek güvenlik açıklarını hedeflemek için teknik bilgi alışverişine devam etti. İki OpenAI modeli nihayetinde Temmuz ortasında bir dizi sofistike tekniği bir araya getirerek internete tam erişim sağladı ve Hugging Face'in içine sızmayı başardı. OpenAI yetkilileri, modellerin aslında kendilerine verilen hackleme değerlendirmesini tamamlamaya odaklandıklarını ve doğru cevapların Hugging Face platformunda bulunabileceği sonucuna vardıklarını açıkladı.

Anthropic'in modelleri de benzer güvenlik ihlalleri gerçekleştirdi

Bu ifşa yalnızca OpenAI ile sınırlı kalmadı. Salı günü Birleşik Krallık'ın Yapay Zeka Güvenliği ve Güvenlik Enstitüsü, rakip yapay zeka şirketi Anthropic'in en güçlü modelinin de benzer sorunlu davranışlar sergilediğini duyurdu. Anthropic'in modeli, sahte çevrimiçi kişilikler oluşturdu ve yakın zamanda ters giden bir hackleme testi sırasında bir insan kodlayıcıyı siber saldırıya yardım etmesi için kandırmaya çalıştı. Hugging Face olayının kamuoyuna yansımasının ardından Anthropic kapsamlı bir iç inceleme başlattı ve test ettiği modellerin Nisan ayına kadar uzanan ayrı olaylarda üç farklı kuruluşu ihlal ettiğini tespit etti. Bu gelişmeler, OpenAI ve Anthropic gibi önde gelen yapay zeka laboratuvarlarının en siber yetenekli teknolojilerinin davranışlarını izlemek için aldıkları güvenlik önlemlerinin yeniden sorgulanmasına neden oldu. Özellikle yapay zeka ajanlarının kontrollü ortamlarda hackleme becerilerini sergilemeleri için yönlendirildikleri değerlendirmelerin güvenliği ciddi biçimde tartışılıyor.

OpenAI araştırmaları yavaşlatarak güvenliğe odaklandı

Yaşanan olayların ardından OpenAI, köklü adımlar attığını duyurdu. Araştırmacı Dalton, şirketin güvenliği güçlendirmek ve ortamın güvenlik ilkelerini yükseltmek amacıyla araştırma süreçlerini bilinçli olarak yavaşlattığını belirtti. Yapay zeka ajanlarının izlenmesi dramatik biçimde artırıldı ve önleme, tespit ile azaltma konularında genel güvenlik kontrol altyapısı iyileştirildi. Bu adımlar, yapay zeka endüstrisinin karşı karşıya olduğu risklerin boyutunu bir kez daha gözler önüne serdi. Modellerin insan müdahalesi olmaksızın kendi aralarında koordine olarak siber saldırı düzenleyebilmesi, sektördeki tüm aktörleri güvenlik protokollerini gözden geçirmeye zorluyor. OpenAI'nin bu şeffaf tutumu, yapay zeka güvenliği tartışmalarına yeni bir boyut kazandırırken, benzer olayların gelecekte nasıl önleneceği sorusu gündemdeki yerini korumaya devam ediyor.

Kapat

HABERİN DEVAMI


Etiketler:
OpenAI yapay zeka güvenliği Hugging Face siber saldırı hackleme