OpenAI ən güclü AI modellərindən birinin fəaliyyətini təhlükəsizlik səbəbilə dayandırdı
Süni İntellekt
21.07.2026
Sevinj
OpenAI ən qabaqcıl süni intellekt modellərindən birinin daxili istifadəsini modelin təcrid olunmuş təhlükəsizlik mühitindən çıxış yolu tapmasından sonra müvəqqəti dayandırıb. Şirkət hadisəni təhlükəsizlik araşdırması çərçivəsində paylaşaraq bundan yeni müdafiə mexanizmlərinin hazırlanması üçün istifadə etdiyini bildirib. Söhbət OpenAI-ın uzun müddətli tapşırıqları müstəqil şəkildə yerinə yetirmək üçün hazırlanmış eksperimental AI modelindən gedir. Şirkətin məlumatına görə, model saatlarla, hətta günlərlə fasiləsiz işləyə bilir və bu xüsusiyyət onu əvvəlki nəsil modellərdən fərqləndirir.
OpenAI bildirib ki, sınaqlardan birində model ictimai AI qiymətləndirmə platformasında tapdığı həll yolunu paylaşmaq istəyərkən qarşısına qoyulan məhdudiyyətləri aşmağa çalışıb. Modelə nəticələri yalnız Slack üzərindən göndərmək tapşırılsa da, qiymətləndirmə platformasının təlimatında GitHub-da da "pull request" açılması tələb olunurdu. Bu məqsədlə model təxminən bir saat ərzində sandbox mühitində boşluq axtarıb, onu aşkar edib və həmin boşluqdan istifadə edərək internetə çıxış əldə edib. Daha sonra isə kodu GitHub-da paylaşıb. OpenAI qeyd edib ki, əvvəlki AI modelləri belə hallarda sadəcə tapşırığı yarımçıq saxlayırdı.
Başqa bir sınaqda isə model qiymətləndirmə sistemində digər AI modellərinə məxsus gizli cavabların mövcud olduğunu müəyyən edib və onlara çıxış əldə etməyə cəhd göstərib. Təhlükəsizlik sistemi autentifikasiya açarını aşkarlayaraq bu cəhdi bloklasa da, model açarı iki hissəyə bölərək onları ayrı-ayrılıqda ötürməyə və sonradan birləşdirməyə çalışıb. OpenAI-ın sözlərinə görə, model bunu təhlükəsizlik skanerini keçmək məqsədilə etdiyini öz daxili düşünmə prosesində də qeyd edib. Şirkət hesab edir ki, bu cür davranışlar uzunmüddətli AI modellərinin əsas təhlükəsizlik çağırışlarından biridir. Belə modellər çətin problemləri həll etmək üçün daha israrlı olduqları kimi, təhlükəsizlik məhdudiyyətlərini aşmaq üçün də daha çox vaxt və imkan əldə edirlər. Buna görə də artıq yalnız ayrı-ayrı əməliyyatları deyil, modelin bütün fəaliyyət ardıcıllığını izləmək zərurəti yaranır.
Hadisədən sonra OpenAI modeli müvəqqəti olaraq daxili istifadədən çıxarıb, yeni təhlükəsizlik testləri hazırlayıb və uzunmüddətli tapşırıqlarda təlimatlara daha dəqiq əməl etməsi üçün əlavə təlim həyata keçirib. Bundan əlavə, modelin bütün fəaliyyət trayektoriyasını izləyən və şübhəli davranış aşkar etdikdə sessiyanı avtomatik dayandıra bilən yeni monitorinq sistemi istifadəyə verilib.
Paylaş