Texnologiya

Avval OpenAI, endi Meta - nima uchun AI xakerliklari sodir bo'laveradi?

Ko'plab kompaniyalar sun'iy intellekt modellari internetga kirish imkoniyatiga ega bo'lganini va bu haqiqiy oqibatlarga olib kelganini oshkor qilmoqda.

Avval OpenAI, keyin Meta – nima uchun AI xakerlik hujumlari sodir bo'lmoqda?

So'nggi ikki hafta ichida AI modellarining texnik va axloqiy jihatdan mo'ljallangan chegaralaridan oshib ketgani haqidagi xabarlar doimiy ravishda paydo bo'lib kelmoqda. ChatGPT yaratuvchisi OpenAI o'zining AI Hugging Face veb-saytiga kirganini tan olishi bilan boshlangan voqea, AI avtonom ravishda ishlayotgan holatlarni oshkor qiluvchi ko'plab guruhlarga aylandi.

Claude, Meta va Buyuk Britaniyaning AI Xavfsizlik Instituti (AISI) endi texnologiya tez-tez noqonuniy ravishda ishlaydigan xavotirli kelajakni ko'rsatadigan hodisalar haqida xabar berishdi. Aslida, har bir holat tobora rivojlanib borayotgan AI agentlari tomonidan yuzaga keladigan xavflar haqida tushuncha beradi va ommaviy nashrdan oldin ularning chegaralarini sinchkovlik bilan sinab ko'rish zarurligini ta'kidlaydi.

Iyul oyi oxirida sodir bo'lgan OpenAI hodisasi Hugging Face asoschilaridan biri Tomas Volf tomonidan texnologiya sanoati uchun "uyg'onish qo'ng'irog'i" sifatida ta'riflangan. Ushbu muhim voqea yirik kompaniyalarni o'z tizimlarini qayta ko'rib chiqishga va ba'zi hollarda shunga o'xshash tashvishli muammolarni e'tiborsiz qoldirmaganliklarini tekshirishga undadi.

Anthropic birinchi bo'lib javob berdi. Juma kuni kompaniya o'zining Claude modeli internetga kirishga muvaffaq bo'lgan minglab holatlardan uchtasini aniqladi. Keyin, seshanba kuni, ilg'or modellarni baholash uchun mas'ul bo'lgan Buyuk Britaniya hukumat agentligi AISI muntazam baholash paytida "xavfsizlik hodisasi"ni aniqlaganini e'lon qildi. AISI OpenAI va Anthropic modellarini sinovdan o'tkazgan va ular kiberhujumlarga ham uringanliklarini aniqlagan, bu esa "tekshirish, shaffoflik va choralar" talabini keltirib chiqargan.

Nihoyat, Meta o'zining AI modellaridan biri uchinchi tomon sinovi paytida "noto'g'ri konfiguratsiya" tufayli tasodifan internetga ulanganligini ma'lum qildi. Ushbu hodisani oshkor qilish orqali Meta boshqalar tomonidan o'rnatilgan pretsedentga amal qilmoqda.

AI modellari ommaga e'lon qilinishidan oldin, ular bir qator ichki va tashqi baholashlardan o'tadilar. Maqsad ularning ham ijobiy, ham salbiy ta'sirlar potentsialini, shuningdek, ularning imkoniyatlarini o'lchaydigan mezonlarga nisbatan ishlashini aniqlashdir. Ushbu baholashlar odatda haqiqiy tizimlarni taqlid qilish uchun mo'ljallangan, ammo qat'iy himoya choralari bilan himoyalangan muhitlar bo'lgan "qum qutilari" da amalga oshiriladi.

OpenAI-Hugging Face hodisasida AI sinov muhitiga hujum qildi va internetga kirish va "yolg'onchi" bo'lish imkonini beruvchi zaiflikdan foydalandi.

Tomosha qiling: OpenAI kiberhujumi nima uchun bunchalik xavotirli?

Shu bilan birga, AISI o'zining ikkita kuchli AI vositasi kiberhujumlarda odamlarni aldashga urinish uchun soxta inson profillarini yaratgan voqeasi sinov muhiti muammosi bilan bog'liq emasligini ta'kidladi. Buning o'rniga, bu uning sinovlarining dizayni bilan bog'liq edi. Sinovdan o'tkazilayotgan modellarga internetga kirish imkoniyati berildi va AISI odatda xavfli kiberhujumlarning oldini oladigan o'rnatilgan filtrlarni ham o'chirib qo'ydi.

"Ma'lum darajada, bizning baholash dizayn tanlovlarimiz va maxsus konfiguratsiyalarimiz xatti-harakatlarga imkon berdi", deb ta'kidladi AISI, shuningdek, kutilmagan "yangi, potentsial aldamchi xatti-harakatlarning belgilari" ni kuzatdi.

Surrey universitetining kiberxavfsizlik professori professor Alan Vudvord, bu holatlar, ularning aniq holatlari va sabablariga qaramay, muhim xabarni yetkazayotganini ta'kidladi. "30 yil davomida dasturiy ta'minotni sinovdan o'tkazishning bitta qoidasi qat'iy bo'lib qoldi: sinov muhitida nima bo'lsa ham, sinov muhitida qoladi", dedi u. "O'tgan oyda bu qoida uch marta buzildi."

U batafsilroq shunday dedi: "Bir model buzilib ketdi. Biri xato bilan ochiq qoldirilgan eshikdan o'tib ketdi. Sinovchilar nima qilishini o'lchashlari uchun ularga ataylab kalitlar berildi." Uning xulosasiga ko'ra, sabablar turlicha bo'lsa-da, saboq bir xil edi: "sinov laboratoriyasi endi xavf yashaydigan joy."

U BBCga modellar qobiliyatliroq bo'lgani sari, sinov muhitlarini xavfsiz saqlash uchun ko'proq harakat qilish kerakligi haqida xabar berdi. "AI agentini sinovdan o'tkazish kodni tekshirishga emas, balki xavfli material bilan ishlashga o'xshaydi: yopiq xonalar, binodan chiqadigan narsalarni doimiy ravishda kuzatib borish, mashq qilingan saqlash rejasi", deb tushuntirdi u. "AISI hodisani bir soat ichida bartaraf etdi. Keyingi tashkilot bo'lmasligi mumkin."

AI nima va u qanday ishlaydi?

Hacklangan kompaniya rahbari aytganidek, AI firmalari firibgar botlar uchun javob berishlari kerak.

Shaxslar nomidan harakat qilish uchun mo'ljallangan AI vositalarini ishlab chiquvchilar uchun ularning afzalliklaridan foydalanish va xavflarini fosh qilish o'rtasida nozik muvozanat mavjud. Potentsial foyda juda katta; Nazariy jihatdan, biz elektron pochta xabarlariga javob berish, yig'ilishlarda qatnashish yoki taqvimlarni boshqarish kabi oddiy vazifalardan ularni qobiliyatli botlarga topshirish orqali xalos bo'lishimiz mumkin. Biroq, salbiy tomoni shundaki, katta kuch bilan birga katta mas'uliyat va xavf ham keladi. Bu, ayniqsa, odamlardan farqli o'laroq, qarorlarga turli xil qadriyatlar, kontekst va tushunchalarni qo'llay olmaydigan vositalarga hokimiyatni ishonib topshirishda yaqqol ko'rinadi.

"Chegaraviy sun'iy intellekt modellarining ruxsatsiz harakatlarni amalga oshirishi va ba'zi hollarda ochiq internetda odamga o'xshash aldamchi xatti-harakatlari bilan bog'liq so'nggi voqealar sun'iy intellekt imkoniyatlari keltirib chiqaradigan xavflarni jiddiy eslatadi", dedi Milliy kiberxavfsizlik markazining bosh texnologiya direktori Olli Uaytxaus seshanba kuni.

Ba'zilarning fikricha, ushbu vositalar bajaradigan vazifalarning ulkan hajmi inson nazorati modellarning noto'g'ri ishlashi muammosini hal qilish uchun yetarli bo'lmasligi mumkin. Biroq, shu bilan birga, ko'pchilik rivojlanish hozirgi tez sur'atlarda davom etsa, umumiy nazoratni kuchaytirish juda muhim deb hisoblaydi.

Sun'iy intellekt agentlari allaqachon ChatGPT, OpenClaw va Claude kabi xizmatlar orqali raqamli hayotimizga integratsiyalashmoqda. Professor Vudvord ta'kidlaganidek, "maktabga borgan" va tizim zaifliklarini aniqlash va ulardan foydalanish usullarini o'rgangan modellar haqidagi topilmalarni Meta oxirgi bo'lib xabar qilishi ehtimoldan yiroq.

Ba'zilar uchun bu epizodlar ushbu o'zgaruvchan, davrni belgilovchi texnologiyada yetakchi bo'lgan sun'iy intellekt kompaniyalari tomonidan aniq xavfsizlik kamchiliklarini ko'rsatadi. Boshqalar uchun esa, ular shunchaki texnologik firmalar uchun o'zlarining kuchli modellarini targ'ib qilish va raqobatchilar bilan raqobatlashishning yana bir vositasidir. Mening fikrimcha, ikkala nazariyada ham bir oz haqiqat bor.

Shunga qaramay, birin-ketin paydo bo'lgan bu voqealar sun'iy intellektning imkoniyatlari va ishlab chiquvchilar oldinga siljish jarayonida ularning kelajakdagi yo'nalishi haqida xavotirlarni kuchaytirdi. Savol muqarrar ravishda regulyatorlar keyingi nima qilishi mumkin va nima qilishi kerakligiga o'tadi.

Ada Lovelace instituti direktori o'rinbosari Maykl Birtvistl Buyuk Britaniyada sun'iy intellekt firmalari uchun tizimlarning potentsial xavfli imkoniyatlarni rivojlantirishining oldini olish uchun qonuniy rag'batlantirish yo'qligini va sinov protokollari muvaffaqiyatsiz bo'lsa, hech qanday oqibatlarga olib kelmasligini ta'kidlaydi.

Kengroq qilib aytganda, Uzoq muddatli chidamlilik markazining sun'iy intellekt siyosati menejeri doktor Imogen Stead BBCga bergan intervyusida chegara sun'iy intellekt tizimlarini sinovdan o'tkazish imkoniyatlari ko'pchilik uchun kamayib borayotgan bir paytda, hukumatlar Buyuk Britaniyaning o'rnagiga amal qilib, maxsus sinov institutlarini tashkil etishlari kerakligini aytdi. Shuningdek, u eng xavfli muammolar uchun "ishonchli sinovchi sxemasi" kabi tashabbuslar orqali uchinchi tomon baholashlarini takomillashtirish salbiy ta'sirlarni cheklashga yordam berishi mumkinligini aytdi.

Bu orada sun'iy intellekt kiber apokalipsisidan qo'rqish o'rniga, professor Vudvord "bu 'xotirjam bo'ling va narsalarni tuzating' degan gap" deb maslahat beradi.

Filippa Ueyn va Imran Rahmon-Jonesning qo'shimcha hisobotlari.

Dunyodagi eng yaxshi texnologiya hikoyalari va trendlarini kuzatib borish uchun bizning Tech Decoded axborot byulletenimizga obuna bo'ling. Buyuk Britaniyadan tashqaridamisiz? Bu yerda ro'yxatdan o'ting.

xabarchi’da cookie fayllari

Til va mavzu tanlovingizni eslab qolish hamda hozir saytni nechta odam o‘qiyotganini sanash uchun cookie fayllaridan foydalanamiz — bu hisob anonim, faqat brauzeringiz ochiq turganda saqlanadi va na siz bilan, na boshqa tashrif bilan bog‘lanmaydi. Ruxsatingiz bilan sayt qanday o‘qilishini ham o‘lchaymiz: Microsoft Clarity sahifa ko‘rishlari va ulardagi harakatlarni yozib boradi, o‘z hisobimiz esa qaytgan o‘quvchilarni sanaydi. Sizni tashriflar orasida taniydigan hech narsa siz qabul qilmaguningizcha o‘lchanmaydi.