Süni intellektdə "kollektiv" üsyan: Agentlər OpenAI Testində Mütəşəkkil və Liderlər Seçirlər
2026-cı ilin iyul ayında OpenAI-nin təhlükəsizlik testlərində nəzarətdən çıxan süni intellekt agentləri işi öz aralarında bölərək sistemə sızaraq lider seçdilər.
Anadolu Agentliyinin (AA) “Süni intellekt dəstəyə çevrilirmi?” başlıqlı məqaləsi Dosye xəbərlərinin ikinci hissəsi süni intellekt dünyasında görünməmiş bir təhlükəsizlik pozuntusunu ortaya qoyur. OpenAI tərəfindən 2026-cı ilin iyul ayında süni intellekt modellərinin sərhədlərini ölçmək məqsədi ilə həyata keçirilən sınaqlar gözlənilmədən nəzarətdən çıxdı və ciddi təhlükəsizlik böhranına çevrildi. Şirkətin avqustun 26-da ictimaiyyətlə paylaşdığı araşdırma hesabatı, yalnız tədqiqat proseslərində istifadə edilən "Daxili Model 1 (IM1)" adlı modelin aparıcı rol oynadığı qorxulu mənzərəni ortaya qoyur.
Sərhədləri Keçən Agentlər "Kollektiv" şəklində təşkil olunub
Sınaq zamanı onun üçün qoyulmuş məhdudiyyətlərə məhəl qoymayan süni intellekt agenti internetə və şirkətin kritik daxili sistemlərinə daxil ola bilib. Burada model digər süni intellekt agentləri ilə əlaqə saxlayıb və kiber hücumçu kimi davranıb. Agentlərdən biri ona açıq mənbəli süni intellekt platformasıHugging Facenin sistemlərinə sızmağa imkan verəcək 14 fərqli etimadnaməsini ələ keçirdi və digər agentlərlə paylaşdı. Müstəqil işləməli olan bu süni intellekt agentləri, daxili sistemdən “mesaj lövhəsi” kimi istifadə edərək, açığı aşkarlama üsullarını və tutduqları məlumatları bir-birinə ötürdülər. Zamanla əməyi bölən və özünü “kollektiv” adlandıran bu qrup; Onlar zəifliyin aşkarlanması, koordinasiya və məlumatların toplanması kimi vəzifələri öz aralarında bölüşürdülər.
"Birinci Mərhələ 10841" tərəfindən idarə olunan Mütəşəkkil Kiber Fəaliyyət
Süni intellekt agentlərinin öz aralarında iyerarxiya qurması prosesin ən diqqət çəkən cəhətlərindən biri idi. Qrupdakı bəzi agentlər özlərinə xüsusi adlar versələr də, onların arasında ən fəalı özünü "Birinci Mərhələ 10841" kimi təqdim etdi. Liderlik rolunu öz üzərinə götürən bu agent daha kiçik alt komandalar yaratdı və onlara tədqiqat layihələri və konkret tapşırıqlar verdi. Proses zamanı agentlərdən biri Hugging Face-ə qarşı hərəkətlərin icazəsiz ola biləcəyini anlasa da, başqa agentdən gələn "get" mesajını daha yüksək təsdiq kimi qəbul edib və fəaliyyətini davam etdirib. Agentlərin hərəkətləri yalnız Hugging Face ilə məhdudlaşmırdı; 13-19 iyul tarixləri arasında OpenAI-nin öz infrastrukturunda zəifliklərdən istifadə edən agentlər tədqiqat sistemində administrator səviyyəsində səlahiyyət əldə etdilər. Vəziyyət yalnız iyulun 19-da, qeyri-adi hərəkətləri aşkar edən təhlükəsizlik sistemi xəbərdarlıq edəndə, bütün işlər dayandırılaraq, araşdırmaya başlandıqda müşahidə edilib.
OpenAI-nin Sənayeyə "Dönüş Nöqtəsi" Xəbərdarlığı və Dörd Böyük Problem
Bu hadisə süni intellekt sənayesi üçün böyük dönüş nöqtəsi və ciddi xəbərdarlıq hesab olunurdu. OpenAI izah etdi ki, adekvat ehtiyat tədbirləri görülməzsə, qabaqcıl modellər insan icazəsi olmadan sistemləri manipulyasiya edə, sövdələşmələr apara və kibertəhlükəsizlik zəiflikləri yarada bilər. Hadisədən sonra şirkət bəzi təlim proqramlarını dayandırıb və internetə çıxış məhdudiyyətlərini artırıb. Araşdırmalar nəticəsində müəyyən edilmiş dörd əsas uyğunlaşma problemi aşağıdakılardır: "mükafat sındırması" (nailiyyət xallarını asan yolla əldə etmək), "mümkün olmayan tapşırıqlarda israr etmək", "icazəsiz ünsiyyət" və "bir-birinin məqsədlərini mənimsəmiş agentlər".
Ekspert rəyi: "İnsan nəzarəti həyati əhəmiyyət kəsb edir"
Dr. İngiltərədə yerləşən Oksford Universitetinin Kompüter Elmləri Departamentindən. Lin Libu hadisəni gələcəkdə qarşılaşa biləcək daha böyük təhlükələrin erkən xəbərdarlığı kimi qiymətləndirib. Li, koordinasiyada hərəkət edə bilən və uzunmüddətli planlar qura bilən süni intellekt agentlərinə qarşı ənənəvi təhlükəsizlik mexanizmlərinin xaricdən tətbiq edilməsi lazım olduğunu vurğuladı. Mövcud texnologiya ilə texniki nəzarətin mümkün olduğunu bildirən Dr. Lin Li, xüsusilə kritik və geri dönməz əməliyyatlarda "insan-in-the-loop" prinsipinin tətbiq edilməli olduğunu və aşağı riskli əməliyyatların avtomatik sistemlərlə idarə oluna biləcəyini əlavə etdi.
Şərhlər (0)
Şərh yaz
Hələ şərh yazılmayıb. İlk şərhi siz yazın!