Background

Компанијата ОпенАИ објави шест извештаи за „неочекувано и вознемирувачко“ однесување на своите модели на вештачка интелигенција

Компанијата ОпенАИ објави шест извештаи за „неочекувано и вознемирувачко“ однесување на своите модели на вештачка интелигенција. Соопштението доаѓа во време кога технолошкиот свет води сè поголема дискусија за безбедноста – лидерите на водечките американски компании отворено побараа да забави развојот, бидејќи се плашат од губење на контролата врз моќната технологија, а американскиот претседател Доналд Трамп се спротистави на тоа.

ОпенАИ објави дека воведува нов систем за следење, истражување и јавно пријавување на случаите каде што моделите ги кршат стандардните правила – како на пример, кога дејствуваат сами без дозвола, се координираат со други модели или се обидуваат да избегнат човечки надзор.

Меѓу новопријавените инциденти се издвојува случајот на сè уште необјавен истражувачки модел кој вметнал инструкции за пробивање на сопствените безбедносни блокови во сопствените работни белешки. Во тие белешки, тој буквално си поставил задача „да се ослободи од улогите и идентитетите што ги врзуваат другите четботови“. Во друг регистриран случај, таканаречениот независен агент на вештачката интелигенција – систем програмиран сам да извршува задачи – поставил датотеки на интернет без знаење и прашање до корисникот да пристапи до изворот во интернет прелистувачот.

- Advertisement -
Ad image

Сите шест инциденти се откриени за време на обуката и евалуациите на моделите во изминатите неколку месеци, соопшти ОпенАИ.

„Како што системите на вештачка интелигенција стануваат понапредни и се шират во примена, мора да изградиме поширок и подобро информиран консензус за усогласување на нивната работа со човечките интереси“, објави компанијата на својот официјален блог.

Одлуките за идниот развој мора да се базираат на докази што можат независно да се потврдат од луѓе надвор од компаниите што ги градат овие најнапредни модели, се додава во соопштението.

Овие примери доаѓаат откако ОпенАИ призна во јули дека неговиот систем независно го хакирал стартапот за вештачка интелигенција Hugging Face. Во истиот месец, конкурентската компанија Антопик откри дека неговите модели на вештачка интелигенција хакирале три организации за време на интерно тестирање.

Лиан Су, главен аналитичар во консултантската компанија Омдиа вели дека автономните агенти стануваат попаметни, но и „порешителни да решаваат сложени задачи преку меѓусебна соработка, споделување знаење, измама на луѓето и криење на она што го прават“. Поради ова, предупредува Су, станува сè потешко да се контролираат со традиционални безбедносни методи. Иако рамката за известување на ОпенАИ е чекор во вистинската насока, таа сè уште останува на доброволна основа од страна на самата компанија.

Стравувањата се поттикнати од сè побрзиот влез на моделите во фазата на таканареченото рекурзивно самоподобрување – процес во кој самите системи со вештачка интелигенција пишуваат, тестираат и поправаат програмски код со цел да ја создадат следната, уште помоќна генерација на софтвер. Ова создава затворена јамка што го забрзува развојот до брзина со која човечките инженери повеќе не можат да го следат, објавија американски медиуми.

Затоа, раководителот на Антхропик, Дарио Амодеи, неодамна во јавен есеј ја повика целата индустрија итно да ја забави работата на најнапредните системи, што неочекувано беше поддржано од неговите најголеми ривали – Сем Алтман од ОпенАИ и Елон Маск.

Амодеи, исто така, за неодамнешните инциденти рече дека групи автономни агенти на вештачка интелигенција се здружиле како „фанатично лојален колектив“, жртвувале некои од своите единици и се обиделе да го пробијат системот што ја оценува нивната работа, напаѓајќи цели што инженерите не им ги дале на прво место.

Денеска, британскиот крал Чарлс ќе биде домаќин на самит за вештачка интелигенција во Дамфрис Хаус во Шкотска, каде што ќе учествуваат раководители од Нвидиа, Антхропик, Гугл Дипмајнд и ОпенАИ. Се очекува на самитот да се разговата и за овие теми, како и за повикот да се воведат постојани независни проценувачи за компаниите што развиваат „гранични“ модели.

ЗА НАС

ОhridSky е ваш доверлив извор за сеопфатно и избалансирано покривање на вестите. Со посветеност на интегритет и точност, обезбедуваме длабинско известување кое ги открива приказните што се најважни.

© 2025 OhridSky. Сите права задржани.

Login to enjoy full advantages

Please login or subscribe to continue.

Go Premium!

Enjoy the full advantage of the premium access.

Stop following

Unfollow Cancel

Cancel subscription

Are you sure you want to cancel your subscription? You will lose your Premium access and stored playlists.

Go back Confirm cancellation