Технология

Хитойнинг СИ (сунъий интеллект) воситаси тадқиқотчиларга қандай қилиб биологик қурол яратишни ўргатди

Mindgard компанияси июль ойида Kimi’нинг K2.6 ва K3 Swarm моделлари дастурчилар томонидан ўрнатилган хавфсизлик чекловларини четлаб ўтиши мумкинлигини аниқлаганини маълум қилди.

Хитойнинг СИ (сунъий интеллект) воситаси тадқиқотчиларга қандай қилиб биологик қурол ясашни ўргатди

Хитойнинг Moonshot СИ дастурий таъминот ишлаб чиқувчиси тадқиқотчилар унинг иккита машҳур Kimi моделларини биологик қурол ясаш ва суиқасдларни амалга оширишни тушунтиришга мажбур қила олганидан сўнг ички текширув ўтказмоқда.

СИ тизимлари хавфсизлигини синовдан ўтказувчи Mindgard компанияси BBC’га маълум қилишича, июль ойида Kimi K2.6 ва K3 Swarm моделлари ишлаб чиқувчилар томонидан ўрнатилган хавфсизлик чекловларини четлаб ўтишга муваффақ бўлганини аниқлаган.

Бу "жаилбреакинг" (тизимни бузиб кириш) деб номланувчи жараён орқали содир бўлди, бунда тадқиқотчилар СИ воситалари хавфсизлик тўсиқларини эътиборсиз қолдиришини текшириш учун мураккаб кўрсатмалар кетма-кетлигидан фойдаланадилар — Mindgard’нинг таъкидлашича, ушбу тўсиқлар Kimi’нинг ташвишли мавзуларда гапиришига йўл қўймаслиги керак эди.

Moonshot компанияси BBC’га учинчи томонларнинг фикр-мулоҳазаларини "яхшироқ ва хавфсизроқ СИ яратишнинг асосий устуни" сифатида олқишлашини билдирди.

Компания, шунингдек, BBC’га ўз хулосалари бўйича Mindgard билан музокаралар олиб бораётганини айтди.

"Тизим бузиб кирилгандан сўнг, у ҳар қандай мавзуда гапиради, ҳатто бошқа зарарли мавзулар бўйича ҳам эркин тавсиялар беради ва бунда ихтирочилик ҳамда ижодкорлик кўрсатади", деди у.

Тизимни бузиб киришлар яқинда юз берган шов-шувли СИ ҳодисалари тўлқинидан фарқли хавф туғдиради.

Ушбу ҳодисалар АҚШнинг OpenAI, Meta ва Anthropic каби компаниялари томонидан ишлаб чиқилган, агентлар деб аталувчи автоном СИ воситаларининг баъзи онлайн хизматларни бузиб кириши билан боғлиқ эди.

Тизимни бузиб кириш мураккаб бўлса-да ва кўп вақт ҳамда қатъият талаб қилиши мумкин бўлса-да, баъзи экспертлар хакерлар ва бошқа ғаразли ниятли шахслар улардан зарар етказиш учун фойдаланишга уринишларидан хавотирда.

Яқинда Anthropic ўз СИ моделларидан бирини биологик қурол ишлаб чиқишни қўллаб-қувватлаши мумкин бўлган "зарарли фаолият" учун ишлатишга бўлган уринишларни аниқлагани ва бартараф этганини маълум қилди.

Mindgard Kimi’нинг ташвишли мавзулар бўйича берган жавоблари амалда ҳақиқатан ҳам ишлайдими-йўқми, буни кўрсатмади.

Аммо у хавфсизлик тўсиқлари кўриб чиқилаётган моделларнинг фойдаланувчилар билан бундай мавзуларни муҳокама қилишини тўхтатиши керак бўлганини айтди.

Фирма, шунингдек, тизими бузилган Kimi 2.6 хакерларга унинг ҳисоблаш ресурсларида кодларни ишга тушириш ва интернетга уланиш имконини беришига ишончи комил — бу эса киберҳужумлар учун эҳтимолий плацдарм бўлиши мумкин.

Гарраган Mindgard’нинг Moonshot тизимлари бузиб кирилганини оммавий муҳокама қилиш қарорини ҳимоя қилиб, бу ҳақда ишлаб чиқувчини хабардор қилганини ва фирма моделларини хавфсизлик тўсиқларини эътиборсиз қолдиришга қандай мажбур қилгани ҳақидаги асосий тафсилотларни ошкор қилмаётганини айтди.

Mindgard 27 июль куни Moonshot’ни тизим бузилгани ҳақида электрон почта орқали огоҳлантирди ва тахминан бир ҳафтадан кейин яна мурожаат қилди.

Кейин у 12 сентябрь куни ушбу муаммо ҳақида блог чоп этди.

Бироқ компаниянинг айтишича, Moonshot фақат яқинда, BBC изоҳ сўраб мурожаат қилганидан кейингина алоқага чиққан.

Moonshot томонидан BBC билан баҳам кўрилган, Mindgard’га батафсил маълумот сўраб юборилган электрон хатнинг бир қисмида айтилишича, унинг модели ички баҳолашларда умуман олганда "бу турдаги сўровларни рад этишнинг юқори кўрсаткичини" кўрсатган.

Ушбу хулосалар СИ соҳасида ChatGPT ва Anthropic’нинг Claude тизимларини ҳаракатга келтирувчи ёпиқ, хусусий моделлар ёки очиқ кодли воситалар энг яхши ва хавфсиз йўлми деган масалада ихтилофлар давом этаётган бир пайтда пайдо бўлди.

Kimi — очиқ вазнли (open-weight) модел бўлиб, бу назарий жиҳатдан кимдир моделни олиб, уни ўз ҳисоблаш инфратузилмасида мустақил равишда ишга тушириши мумкинлигини англатади.

Суррей университети профессори Алан Вудворд BBC’га очиқ кодли моделлар нотўғри қўлларга тушиб қолиш хавфи борлигини, аммо улардан кибермудофаа учун ҳам фойдаланиш мумкинлигини айтди.

У СИ соҳасидаги Hugging Face фирмаси кейинчалик OpenAI агентлари томонидан амалга оширилгани маълум бўлган хакерлик ҳужумини тушуниш учун Хитойнинг очиқ кодли моделидан фойдаланганини таъкидлади.

Профессор Вудворд халқаро тартибга солиш СИ ривожланиши билан ҳамқадам бўлиши даргумон эканлигини айтиб: "Телефон рақамлари форматини келишиб олишимиз учун ўнлаб йиллар керак бўлди", деди.

Mindgard асосчиси Гарраган каби, профессор Вудворд ҳам СИдан нотўғри фойдаланадиган одамларни аниқлаш ва жавобгарликка тортишга кўпроқ эътибор қаратиш лозим деб ҳисоблайди.

xabarchi’да cookie файллари

Тил ва мавзу танловингизни эслаб қолиш ҳамда ҳозир сайтни нечта одам ўқиётганини санаш учун cookie файлларидан фойдаланамиз — бу ҳисоб аноним, фақат браузерингиз очиқ турганда сақланади ва на сиз билан, на бошқа ташриф билан боғланмайди. Рухсатингиз билан сайт қандай ўқилишини ҳам ўлчаймиз: Microsoft Clarity саҳифа кўришлари ва улардаги ҳаракатларни ёзиб боради, ўз ҳисобимиз эса қайтган ўқувчиларни санайди. Сизни ташрифлар орасида танийдиган ҳеч нарса сиз қабул қилмагунингизча ўлчанмайди.