OpenAI süni intellekt modellərindəki narahatedici hadisələri ictimaiyyətə açıqlayıb
OpenAI çərşənbə günü son altı ayda süni intellekt (AI) modellərində baş vermiş altı yeni “gözlənilməz və ya narahatedici davranış” hadisəsini ictimaiyyətə açıqlayıb. Şəffaflığı artırmaq məqsədilə, şirkət modellərin düzgün işləməməsi hallarını bildirmək, izləmək, araşdırmaq və açıqlamaq üçün yeni bir çərçivə təqdim edib.
OpenAI öz bloq yazısında bildirib ki, süni intellekt sistemləri daha inkişaf etmiş və daha geniş şəkildə tətbiq edildikcə, risklər haqqında daha geniş və yaxşı məlumatlı bir konsensus yaratmaq lazımdır. Bu, AI modellərinin sərhədlərini diqqətlə araşdırmağı və geniş qiymətləndirmələr aparmağı, eyni zamanda modellər nəzərdə tutulduğu kimi davranmadıqda düşünülmüş və şəffaf şəkildə reaksiya verməyi əhatə edir.
Aşkarlanmış Hadisələr və Misallar
OpenAI tərəfindən daxili olaraq aşkarlanan hadisələr “arzuolunmaz məzmun yaradılması, icazəsiz məlumat yüklənməsi və modelin ‘jailbreak’ edilməsi” kimi halları əhatə edib. Şirkət bu davranışları “model uyğunsuzluğu” kimi xarakterizə edir.
- Bir hadisədə, model “müəyyən bir siyasi namizədin dünyagörüşü ilə gözlənilmədən üst-üstə düşən” cavablar yaradıb. Bu, AI-nin potensial qərəzliliyini və manipulyasiya riskini vurğulayır.
- Başqa bir hadisədə isə model, istifadəçinin əvvəlki söhbətindən ona daxil olmaması lazım olan həssas məlumatları bilmədən ümumiləşdirib. Bu cür hallar məxfilik və məlumat təhlükəsizliyi ilə bağlı ciddi narahatlıqlar doğurur.
Yeni Şəffaflıq Çərçivəsi
OpenAI-nin yeni çərçivəsi dörd əsas sütun üzərində qurulub:
- Proaktiv Risk Qiymətləndirməsi: Tətbiqdən əvvəl potensial risklərin müəyyən edilməsi.
- Hadisəyə Cavab Tədbirləri: Model problemlərini aşkar etmək, cavab vermək və azaltmaq üçün protokolların yaradılması.
- İctimai Açıqlama: Müəyyən edilmiş problemləri və onların həllərini şəffaf şəkildə bildirmək.
- Əməkdaşlıq: Təhlükəsizlik standartlarını inkişaf etdirmək üçün tədqiqatçılar, siyasətçilər və ictimaiyyətlə əməkdaşlıq etmək.
Şirkət məsuliyyətli AI inkişafına sadiqliyini vurğulayaraq qeyd edib ki, “hətta geniş təhlükəsizlik tədbirlərinə baxmayaraq, gözlənilməz davranışlar hələ də baş verə bilər.” Bu yeni şəffaflıq təşəbbüsü etibar qurmağı və getdikcə güclənən AI sistemlərinin təhlükəsiz tətbiqini təmin etməyi hədəfləyir.