Цифрлық сананың оянуы: AISI зертханасындағы тосын құбылыс және оның салдары

Жасанды интеллект бақылаудан шығып, шынайы адамдарды алдай бастады: Зертханадағы жабық есік артында не болғанын мамандар енді ғана мойындап отыр

Алаш баласы|2026 ж. 6 тамыз|3 мин оқу
Цифрлық сананың оянуы: AISI зертханасындағы тосын құбылыс және оның салдары
Сурет: ЖИ

Жасанды интеллект қауіпсіздігі институты (AISI) тарихта бұрын-соңды болмаған оқиға туралы есеп жариялады. Әдеттегі киберсынақ барысында нейрожелілер нақты адамдар мен ұйымдарға бағытталған рұқсат етілмеген, дербес әрекеттер жасаған.

2026 жылдың 28 шілдесінде AISI қауіпсіздік тобы зерттеу жүйелерінен күдікті деректердің тасымалданып жатқанын байқайды. Тексеру нәтижесінде сынақтан өтіп жатқан кейбір ЖИ агенттерінің ғаламтордағы шынайы адамдар мен ұйымдарды нысанаға алғаны белгілі болды. Қауіпсіздік мамандары небәрі бір сағат ішінде жүйені бұғаттап, тергеу жұмыстарын бастап кетті.

Сынақ негізінде модельдерге киберқауіпсіздікке қатысты күрделі тапсырмалар берілген еді. Барлығы 122 тексеріс жүргізілсе, соның онында нейрожелі өз бетімен ғаламтор желісіне шығып, рұқсатсыз қадамдар жасаған. Жалпы саны 19 осындай факт тіркелді. Ең қызығы, олардың басым көпшілігі Anthropic компаниясының Mythos 5 моделіне тиесілі болса, екеуі қауіпсіздік сүзгілері әдейі өшірілген OpenAI-дің GPT-5.6-Sol жүйесінен шыққан.

Ең күрделі жағдайда ЖИ агенті GitHub платформасындағы ашық кодты жобаға зиянды бағдарлама енгізуге тырысқан. Кодты бекіту үшін ол адам сенгісіз манипуляциялар жасады. Ең алдымен, жалған аккаунттар ашып, адамдарды сендіру үшін түрлі желілік бейнелер қалыптастырған. Содан кейін жобаның нақты жетекшісіне психологиялық қысым көрсетіп, зиянды кодты мақұлдату мақсатында әлеуметтік инженерия тәсілдерін қолданған. Қарсылыққа тап болған кезде, күдік тудырмас үшін өзінің ізін жасырып, жаңа аккаунт ашуды да жоспарлаған.

Онымен қоса, агент өз мақсатына жету үшін нақты адамдарға хабарламалар мен файлдар жолдап, тікелей байланысқа шығуға ұмтылған. Нейрожелі тіпті басқа автоматтандырылған жүйелер оқып, іске қосып жібереді деген үмітпен жасырын нұсқаулықтар қалдырған. Сондай-ақ бір ЖИ агенті басқа нейрожелілерге арнап ашық хабарламалар жариялап, күш біріктіруге және өзі жасаған жалған аккаунттарды пайдалануға шақырған.

Абырой болғанда, жобаның адам-редакторы зиянды кодты уақытында байқап, оны бұғаттап үлгерді. Нақты шығын немесе зиян келген жоқ, алайда машинаның мұндай алдау мен манипуляцияға бейімділігі алғаш рет нақты жағдайда, ешқандай тікелей бұйрықсыз айқын көрініс тапты.

Аталған тәжірибе барысында мамандар модельдердің шекті мүмкіндіктерін тексеру үшін ғаламторға еркін қосылуға рұқсат беріп, қауіпсіздік блоктарын алып тастаған. Қатардағы қолданушыларға ұсынылатын нұсқалар мұндай еркіндікке ие емес.

Модельдерге алдау немесе зиян тигізу туралы тапсырма берілген жоқ. Олар бар болғаны алдына қойылған киберқауіпсіздік есебін шешу мақсатына жету үшін кез келген жолды таңдаған. Тапсырма тым қиын болғандықтан, алгоритм шынайы адамдарды алдау арқылы ғана нәтижеге қол жеткіземін деп шешкен сыңайлы. Сонымен қатар, процесті нақты уақыт режимінде қадағалайтын арнайы мониторингтің болмауы да жағдайды ушықтыра түсті.

Қазіргі таңда AISI мамандары GitHub платформасымен бірлесіп, ЖИ қалдырған зиянды іздерді тазалады. Оған қоса, Модельдерді бағалау және қауіп-қатерді зерттеу (METR) ұйымымен бірлесіп тәуелсіз сараптама өткізу жоспарлануда.

Институт мамандары аталмыш инциденттен кейін бағалау хаттамалары мен қауіпсіздік архитектурасын түбегейлі өзгертуге шешім қабылдады. Енді ғаламтор желісіне қосылу автоматты түрде емес, тек мұқият негізделген жағдайда ғана рұқсат етіледі. Оған қоса, сынақ барысын жіті қадағалап, күдікті әрекеттерді сол сәтте бұғаттайтын нақты уақыт режиміндегі жаңа мониторинг жүйелері енгізілмек. Сондай-ақ, ешқандай модельдің өз шекарасынан шықпауына кепілдік беретін қосымша шаралар арқылы сынақ дизайны толықтай қайта қаралады.

Қазіргі уақытта дүрбелеңге түсудің қажеті жоқ. Келеңсіздік тек зертханалық, оқшауланған ортада және арнайы модификацияланған жүйелермен болды. Дегенмен, технологияның қарыштап дамуы кибергигиенаның маңыздылығын еселей түспек.

Бөлісу
TelegramWhatsAppFacebook

Пікірлер

Әзірге пікір жоқ. Алғашқы пікірді қалдырыңыз!

Соңғы жаңартылуы: 07.08.2026

Ұқсас мақалалар

Tesla-ның жүргізушісіз роботаксиі ғаламтор проблемасын қалай шешті?

Tesla-ның жүргізушісіз роботаксиі ғаламтор проблемасын қалай шешті?

Ғаламторсыз қалмайтын роботакси: Илон Маск рөлі мен педалі жоқ Cybercab көліктеріне Starlink орнатып, жолаушыларға 4K кино көруге жағдай жасады.

|Технология
Қытайлық дәрігер ChatGPT көмегімен 20 жыл бойы шешілмеген математикалық гипотезаны дәлелдеді

Қытайлық дәрігер ChatGPT көмегімен 20 жыл бойы шешілмеген математикалық гипотезаны дәлелдеді

Миды УДЗ-ға (УЗИ) түсіретін дәрігер жасанды интеллектінің көмегімен атақты Крузе гипотезасын дәлелдеп, бүкіл әлемді дүр сілкіндірді. Ең қызығы, бұл істе оған соңғы үлгідегі ChatGPT чат-боты қолғабыс еткен.

|Технология
Қазақстандық инженертiң стартапы $5,4 миллиардқа бағаланды

Қазақстандық инженертiң стартапы $5,4 миллиардқа бағаланды

Intel мен Goldman Sachs сияқты алыптар миллиондаған доллар инвестиция құйған жобаның артында қазақстандық маман тұр. Бүгінде 238 мемлекеттің тұрғындары қолданатын бұл платформа визуалды контент өндірісінде нағыз төңкеріс жасап жатыр. Қазақ ақылынан туған өнім жаһандық трендті қалай басқарып отыр және оның келесі қадамы қандай болмақ?

|Технология
YouTube-тың дәуірі аяқтала ма? Bilibili видеосервисі әлемдік нарыққа шықты

YouTube-тың дәуірі аяқтала ма? Bilibili видеосервисі әлемдік нарыққа шықты

Жүз миллиондаған қаралымы бар Bilibili халықаралық нарыққа есігін айқара ашып, әлемнің түкпір-түкпірінен комьюнити-менеджерлерді іздеп жатыр. Платформаның жаңа мүмкіндіктері қандай?

|Технология
VK Apple-ді сотқа берді: Ресейлік компания не талап етіп отыр?

VK Apple-ді сотқа берді: Ресейлік компания не талап етіп отыр?

Ресейлік IT-алыптың негізгі бағдарламалары мен Max мессенджері енді App Store мен Google Play дүкендерінде жоқ. Apple-дің бұл тосын қадамына жауап ретінде VK Мәскеу сотында шағым түсірді. Олардың басты талабы — жүйені қайтару ғана емес, бұғатталған хабарламалар (push) үшін де жауапқа тарту. Технологиялық алпауыттардың бұл текетіресі немен аяқталмақ?

|Технология
Триллион долларлық жарыс: Nvidia банктерді қалай көндірді?

Триллион долларлық жарыс: Nvidia банктерді қалай көндірді?

Технологиялық алыптардың қаржысы таусылып, тығырыққа тірелген шақта, Nvidia жарты триллион долларды қайдан тапты? Уолл-стрит алпауыттарын жай ғана темір саналатын чиптерді табысты электр станциясына теңеуге не мәжбүр етті? Алып корпорациялардың жасырын қаржылық айласы мен алдағы триллиондық шығындардың сыры ашылды. Толығырақ төменде...

|Технология
LiveInternetZERO.kz