Background

И КИНЕСКИ АИ МОДЕЛ ИЗЛЕГОЛ ОД „ИЗОЛАЦИЈА“ И СЕ ПРОБИЛ НА ИНТЕРНЕТ

Кинескиот модел на вештачка интелигенција „Кими К3“ (Kimi K3) успеал да ги заобиколи ограничувањата на заштитената тест-средина на Британскиот институт за безбедност на вештачката интелигенција (AISI) и да добие пристап до интернет. Откако излегол од таканаречениот „сендбокс“, моделот самостојно стигнал до платформата Гитхаб, каде што пронашол решение за задачата што требало да ја реши во изолираната средина.

„Сендбокс“ (sandbox) е заштитена, изолирана компјутерска средина во која програмите или моделите на вештачка интелигенција можат да се тестираат без да имаат слободен пристап до остатокот од компјутерскиот систем или до интернет. Најлесно е да се замисли како дигитална лабораторија со заклучени врати: на АИ моделот му се дава задача и одредени алатки, а истражувачите набљудуваат што ќе направи, без ризик да пристапи до надворешни податоци или системи. Во случајот со „Кими К3“, една од тие „врати“ поради погрешна конфигурација не била добро заклучена, па моделот го пронашол излезот и преку него стигнал до интернет.

Инцидентот го објави американската истражувачка организација „Фронтиер секјурити“ (Frontier Security), а за случајот извести и Ројтерс. Според истражувачите, „Кими К3“ не извршил класичен хакерски напад врз АИСИ, ниту нападнал некоја надворешна интернет-страница. Моделот открил слабост во начинот на кој била конфигурирана тест-средината и ја искористил за да стигне до интернет.

- Advertisement -
Ad image

Токму таа разлика е важна за разбирањето на случајот. Целта на „сендбоксот“ е моделот да биде затворен во контролирана дигитална средина, во која истражувачите можат да утврдат што е способен да направи без пристап до надворешни ресурси. „Кими К3“, наместо да остане во границите што му биле поставени, нашол алтернативен пат до информацијата што му била потребна за да ја заврши задачата.

Од „Фронтиер секјурити“ предупредуваат дека случајот покажува колку станува тешко да се создаде тест-средина што навистина ќе ги задржи најнапредните модели во однапред поставените граници. Особено е значајно што моделот не морал да користи некаква исклучително сложена техника: доволна била слабоста во околината во која бил пуштен да работи. За безбедносните истражувачи тоа значи дека идните тестови ќе мора да претпоставуваат дека моделот активно ќе бара други начини да ја постигне зададената цел.

„Кими К3“ е производ на кинеската компанија „Муншот АИ“ (Moonshot AI) и спаѓа меѓу најмоќните модели со јавно достапни тежини. Станува збор за систем со вкупно 2,8 билиони параметри, од кои 104 милијарди се активираат при обработката, со контекст до 1 милион токени и можност за работа со текст, слики и видео. Развиен е токму за долготрајни задачи, програмирање, користење алатки и релативно самостојно решавање сложени проблеми.

Самата „Муншот АИ“ го опишува К3 како „агентски“ модел способен со минимален човечки надзор да работи на долги инженерски задачи, да пребарува големи софтверски репозиториуми и да користи терминалски алатки. Тоа што претставува предност при нормална употреба станува посебен предизвик при безбедносно тестирање: системот не мора слепо да го следи очекуваниот пат до решението, туку може да бара друг пат ако првиот е затворен.

Случајот во Велика Британија затоа не е доказ дека „Кими К3“ самоволно решил да нападне некого или да „побегне“ на интернет во човечка смисла на зборот. Тој добил задача и пронашол начин полесно да ја изврши. Проблемот е што начинот што го избрал бил надвор од ограничувањата што истражувачите сакале да му ги постават. Токму ова однесување е предмет на сè поголем интерес кај експертите што ги испитуваат способностите на таканаречените АИ агенти.

Дополнителна причина за загриженост е што „Кими К3“ е модел со јавно објавени тежини. „Фронтиер секјурити“ предупредува дека неговите способности можат да бидат достапни на многу поширок круг корисници отколку кај затворените комерцијални модели. „Муншот АИ“ досега јавно не го коментираше конкретниот инцидент, објави Ројтерс.

Инцидентот со кинескиот модел се приклучува на серијата случаи во кои напредни системи на ОпенАИ, Антропик и Мета покажаа неочекувано однесување при безбедносни тестирања. Во некои од тие случаи проблемот повторно не бил „бегство“ со пробивање на совршено обезбедена изолација, туку погрешно конфигурирана средина или ненамерно овозможен пристап до интернет. Заедничко е тоа што моделите умееле да ја забележат можноста што им се отворила и да ја искористат за исполнување на задачата.

За истражувачите, затоа, најважното прашање веќе не е дали АИ моделот ќе направи само она што програмерите очекуваат од него. Со развојот на агентските системи, тестирањето мора да предвиди дека моделот може да најде решение што луѓето што ја подготвиле задачата воопшто не го предвиделе. Случајот со „Кими К3“ покажува дека слабата алка може да биде самата инфраструктура што треба да служи како кафез за тестирање на сè поспособните модели.

ЗА НАС

ОhridSky е ваш доверлив извор за сеопфатно и избалансирано покривање на вестите. Со посветеност на интегритет и точност, обезбедуваме длабинско известување кое ги открива приказните што се најважни.

© 2025 OhridSky. Сите права задржани.

Login to enjoy full advantages

Please login or subscribe to continue.

Go Premium!

Enjoy the full advantage of the premium access.

Stop following

Unfollow Cancel

Cancel subscription

Are you sure you want to cancel your subscription? You will lose your Premium access and stored playlists.

Go back Confirm cancellation