Logo
    OpenAI: Moonshot AI modellərimizin düşünmə prosesini ələ keçirməyə çalışıb

    OpenAI: Moonshot AI modellərimizin düşünmə prosesini ələ keçirməyə çalışıb

            “OpenAI” açıqlayıb ki, Çində yerləşən “Moonshot AI” ilə əlaqəli şəxslər iyulda onun modellərinin gizli düşünmə prosesini əldə etməyə çalışıblar. Şirkət bunu modelin qorunan əsaslandırmasını ələ keçirmək üçün koordinasiyalı kampaniya adlandırıb. Cəhdlər 1 iyulda zəif başlayıb. Aktivlik 24 və 25 iyulda kəskin artıb. “OpenAI”-a görə, bu davranış başqa modeli öyrətmək üçün icazəsiz məlumat toplama üsuluna bənzəyir.
    OpenAI düşüncə qeydlərini oğurlamaq cəhdini Moonshot AI ilə bağlayıb
            Həmin 2 gündə xüsusi çıxarma üsulundan istifadə edən 16 000 sorğu qeydə alınıb. Sorğular 4 000-dən çox istifadəçi hesabından göndərilib. Kampaniya 28 iyulda tam dayanıb. “OpenAI” bütün hesabların eyni tərəfə bağlı olduğuna əmin deyil. Hansı modellərin hədəf seçildiyi və cəhdlərin nə qədər uğurlu olduğu açıqlanmayıb. İstifadəçilərin neçəsinin “Moonshot AI” ilə əlaqəli olduğu da məlum deyil.
            Qorunan əsaslandırma modelin tapşırığı necə həll etdiyini göstərən daxili qeyddir. Düşüncə zəncirinin görünməməsi üçün bu məlumat şifrələnir və müştəriyə ayrıca blok kimi göndərilir. Müştəri hər yeni sorğuda həmin bloku geri qaytarır. Beləliklə, xidməti göstərən şirkətin onu öz serverində saxlamasına ehtiyac qalmır. Operatorlar bir söhbətdən götürülən bloku başqa modelə açdırmağa çalışıblar. Ancaq şifrə sındırılmayıb, istifadəçi söhbətlərinə və məlumat bazasına giriş baş verməyib.
            “OpenAI” başqa istifadəçidən götürülmüş şifrəli əsaslandırmanı yenidən işləyib məzmunu bərpa etməyə yarayan boşluğu bağlayıb. Model cavabı hissə-hissə göndərərkən gizli düşünmə prosesinin üzə çıxmasını aşkarlayan yoxlamalar da əlavə olunub. İstifadəçilər, iş məkanları, təşkilatlar və model ailələri arasındakı qoruma gücləndirilib. Kənar xidmətlərdən işləyən şübhəli hesabların dayandırılması üçün həmin xidmətlərin sahibləri ilə əməkdaşlıq edilib.
    OpenAI düşüncə qeydlərini oğurlamaq cəhdini Moonshot AI ilə bağlayıb
            Müstəqil təhlükəsizlik tədqiqatçıları oxşar boşluqlar barədə şirkətləri daha əvvəl xəbərdar ediblər. Onların 10 avqust tarixli “Stealing Reasoning Traces from Proprietary LLM APIs” araşdırmasında “OpenAI”, “Anthropic” və “Google” modelləri sınaqdan keçirilib. Sınaqlar iyulun əvvəlində aparılıb. Boşluqlar şirkətlərə çatdırıldıqdan sonra eyni hücumları təkrarlamaq olmayıb.
    OpenAI düşüncə qeydlərini oğurlamaq cəhdini Moonshot AI ilə bağlayıb
            “Anthropic”-in 2026-cı ilin sentyabrında açıqladığı məlumatlar da “Moonshot AI” ilə bağlı oxşar fəaliyyəti göstərib. Şirkət 10 gün ərzində 5 380 saxta hesabdan ibarət şəbəkə aşkarlayıb. Bu şəbəkə ilə təxminən 300 000 müştəri sorğusu ötürülüb. “Claude” modelinin əsaslandırma imzaları saxlanılıb, daha sonra yeni söhbətlərdə tam düşünmə qeydlərinə çevrilib. “Moonshot AI” iyulda “Kimi K3” modelinin bu üsulla hazırlandığını təkzib etmişdi. “OpenAI” rəhbərliyi isə nəticə çıxarmaq üçün hələ tez olduğunu demişdi.
            “OpenAI” növbəti mərhələdə tərəfdaşların serverlərində işləyən modelləri də öz xidmətlərindəki kimi qorumaq istəyir. Alətlərdən gələn cavablarla edilə biləcək hücumların qarşısını almaq üçün əlavə yoxlamalar hazırlanacaq. Şirkət nəticələri “Frontier Model Forum” və dövlət qurumlarının məlumat paylaşma kanalları ilə bölüşüb. Modellər gücləndikcə və onları daha ucuz yolla təqlid etmək cəhdləri artdıqca bu hücumların da mürəkkəbləşəcəyi gözlənilir.

    Şərhlər

    Şərh yazmaq üçün Google və ya Facebook hesabınızla daxil olun.

    Şərhlər yüklənir...