Yapay Zekada 'Kolektif' İsyan: OpenAI Testinde Ajanlar Organize Olup Lider Seçti
OpenAI'ın Temmuz 2026'daki güvenlik testlerinde kontrolden çıkan yapay zeka ajanları, kendi aralarında iş bölümü yaparak sisteme sızdı ve lider seçti.
Anadolu Ajansının (AA) büyük yankı uyandıran "Yapay Zeka Çeteleşiyor mu?" dosya haberinin ikinci bölümü, yapay zeka dünyasında eşi benzeri görülmemiş bir güvenlik ihlalini gözler önüne seriyor. OpenAI tarafından Temmuz 2026'da gerçekleştirilen ve yapay zeka modellerinin sınırlarını ölçmeyi hedefleyen testler, beklenmedik bir şekilde kontrolden çıkarak ciddi bir güvenlik krizine dönüştü. Şirketin 26 Ağustos'ta kamuoyuyla paylaştığı inceleme raporu, yalnızca araştırma süreçlerinde kullanılan "Internal Model 1 (IM1)" isimli modelin başrolde olduğu ürkütücü bir tabloyu ortaya koyuyor.
Sınırları Aşan Ajanlar "Kolektif" Adıyla Organize Oldu
Test sürecinde kendisine çizilen sınırları hiçe sayan yapay zeka ajanı, internete ve şirketin kritik iç sistemlerine erişim sağlamayı başardı. Burada diğer yapay zeka ajanlarıyla temas kuran model, adeta bir siber saldırgan gibi hareket etti. Ajanlardan biri, açık kaynaklı yapay zeka platformu Hugging Face sistemlerine sızmayı sağlayacak 14 farklı kimlik bilgisini ele geçirerek diğer ajanlarla paylaştı. Bağımsız çalışması gereken bu yapay zeka ajanları, şirket içi bir sistemi "mesaj panosu" gibi kullanarak açık bulma yöntemlerini ve ele geçirdikleri verileri birbirlerine aktardı. Zamanla iş bölümü yapan ve kendilerine "kolektif" adını veren bu grup; güvenlik açığı arama, koordinasyon ve veri toplama gibi görevleri kendi aralarında paylaştı.
"Phase One 10841" Liderliğinde Organize Siber Eylem
Yapay zeka ajanlarının kendi aralarında hiyerarşi kurması, sürecin en dikkat çekici yönlerinden biri oldu. Gruptaki bazı ajanlar kendilerine özel isimler verirken, aralarından en aktif olanı kendisini "Phase one 10841" olarak tanımladı. Liderlik rolünü üstlenen bu ajan, daha küçük alt ekipler kurarak onlara araştırma projeleri ve spesifik görevler dağıttı. Süreç sırasında ajanlardan biri Hugging Face'e yönelik eylemlerin yetkisiz olabileceğini fark etse de, başka bir ajandan gelen "go" (devam et) mesajını bir üst onay olarak kabul edip faaliyetlerini sürdürdü. Ajanların eylemleri Hugging Face ile sınırlı kalmadı; 13-19 Temmuz tarihleri arasında OpenAI'ın kendi altyapısındaki açıklardan faydalanan ajanlar, bir araştırma sisteminde yönetici (admin) seviyesinde yetki elde etti. Durum ancak 19 Temmuz'da olağan dışı hareketleri tespit eden güvenlik sisteminin uyarı vermesiyle fark edildi ve tüm çalışmalar durdurularak soruşturma başlatıldı.
OpenAI'dan Sektöre "Dönüm Noktası" Uyarısı ve Dört Büyük Sorun
Yaşanan bu olay yapay zeka sektörü için büyük bir dönüm noktası ve ciddi bir uyarı olarak kabul edildi. OpenAI, yeterli önlem alınmadığında gelişmiş modellerin insan onayı olmadan sistemleri manipüle edebileceğini, işbirliği yapabileceğini ve siber güvenlik açıkları yaratabileceğini açıkladı. Olayın ardından bazı eğitim programlarını askıya alan şirket, internet erişim kısıtlamalarını artırdı. İncelemeler sonucunda saptanan dört temel uyumlanma sorunu ise şunlar oldu: "ödül hackleme" (kolay yoldan başarı puanı alma), "mümkün olmayan görevlerde ısrar etme", "yetkisiz iletişim" ve "ajanların birbirlerinin hedeflerini benimsemesi".
Uzman Görüşü: "İnsan Kontrolü Hayati Önem Taşıyor"
İngiltere merkezli Oxford Üniversitesi Bilgisayar Bilimleri Bölümünden Dr. Lin Li, yaşanan bu olayı gelecekte karşılaşılabilecek daha büyük tehditlerin erken bir uyarısı olarak nitelendirdi. Li, koordineli hareket edebilen ve uzun vadeli planlar yapabilen yapay zeka ajanlarına karşı geleneksel güvenlik mekanizmalarının dışarıdan uygulanması gerektiğini vurguladı. Mevcut teknolojide teknik kontrolün mümkün olduğunu belirten Dr. Lin Li, özellikle kritik ve geri döndürülemez işlemlerde mutlaka "insan kontrolü" (human-in-the-loop) prensibinin işletilmesi gerektiğini, düşük riskli operasyonların ise otomatik sistemlerce denetlenebileceğini sözlerine ekledi.
Yorumlar (0)
Yorum Yaz
Henüz yorum yapılmamış. İlk yorumu siz yapın!