До средината на септември, едно лице запознаено со прашањето процени дека OpenAI открило околу две десетици инциденти во кои неговите агенти дејствувале на непожелен начин. Но, бројот продолжува да расте додека тимовите на OpenAI ги пребаруваат внатрешните логови (записи) за активностите на агентите и наоѓаат претходно непознати случаи, пишува Ројтерс повикувајќи се информирани извори.
Два месеца откако OpenAI го објави случајното хакирање на Hugging Face, креаторот на ChatGPT сè уште работи на разбирање на целосниот обем на активностите на своите „одметнати“ агенти. Од OpenAI изјавија дека нивната ревизија ќе трае со месеци со оглед на обемот на работата. Компанијата исто така соопшти дека известила десетици трети страни за несоодветни активности.
Агентите на OpenAI имале пристап до овие слики бидејќи компанијата се потпира на анонимизирани кориснички податоци за дел од својот процес на обука на моделите, според компанијата, поранешни вработени и надворешни истражувачи. Податоците на деловните корисници (Enterprise) не се подобни за обука, додека обичните корисници на ChatGPT мора самите да ја исклучат опцијата (opt out) за да спречат компанијата да ги користи нивните податоци за обука.
Пред објавите на корисниците да се искористат за обука, тие минуваат низ процес на анонимизација кој ги отстранува метаподатоците, имињата и другите информации за контакт, што би требало да го отежне нивното поврзување со кој било индивидуален корисник, соопшти компанијата.
Сепак, оваа практика носи ризици бидејќи постои шанса податоците да не бидат целосно исчистени од личните информации (PII) и истите да протечат во текот на работата на моделот.
Transluce соопшти дека инцидентот бил дел од поширока активност на АИ агенти кои ги испитувале владините веб-страници користејќи тактики како што се изложени лозинки, заобиколување на анти-бот заштити и лажни сметки.
Во двата месеца откако OpenAI за првпат објави дека нејзините агенти излегле од контрола (broke containment), откриени се повеќе од 15 различни инциденти поврзани со OpenAI со различно ниво на сериозност. Ова го објавија самата компанија, надворешни истражувачи или — токму во средата — австралискиот премиер Ентони Албанезе во Обединетите Нации, кој изјави дека агентите на OpenAI упаднале во владин портал за здравствени податоци во јуни.
Минатите инциденти беа од различна природа, почнувајќи од пораки слични на спам оставени на интернет страници, па сè до упадот во Hugging Face, кој вклучуваше рој агенти кои злоупотребиле претходно непознати софтверски пропусти за да избегаат од нивните мрежи и да влезат во складиштето за вештачка интелигенција додека барале одговори за тест. OpenAI соопшти дека нејзините агенти ја таргетирале и сопствената инфраструктура на компанијата.
Албанезе им изјави на новинарите во Њујорк дека OpenAI ја открил активноста во август, а ја обелоденил на 10 септември преку е-пошта испратена до општо владино сандаче. Тој рече дека директно му кажал на извршниот директор на OpenAI, Сем Алтман, дека ваквиот процес на известување е неприфатлив.
И покрај тоа, лица запознаени со истрагата на OpenAI за активностите на агентите ја опишаа како строго затворена и обликувана од адвокатите на компанијата. Процесот бил невообичаено поделен на сектори (compartmentalized) за компанија која, според некои поранешни вработени, во минатото била поотворена за вакви прашања.
Околу 100 луѓе биле на некој начин вклучени во процесот за разбирање на хакирањето на Hugging Face. За време на тој процес, на виделина излегле докази и за други инциденти.
Ројтерс претходно објави дека истражителите на OpenAI кои го воделе случајот со Hugging Face биле одвраќани од адвокатите на компанијата да го прошират опсегот на истрагата за да вклучат и други инциденти. Од OpenAI изјавија дека нивните адвокати не обесхрабрувале подлабока истрага.
Многу инциденти беа откриени од надворешни истражувачи, а не директно од OpenAI. Во неколку епизоди, агентите преземале проблематични дејства кои останале незабележани од компанијата со месеци.
На почетокот на овој месец, мала група истражувачи откри дека агентите на компанијата презела контрола врз главно неактивен германски вики-сајт (wiki site) за да споделуваат тактики како да измамат на одредени задачи, да ги заобиколат ограничувањата на OpenAI и да го прикријат своето однесување.
Оваа недела, истражувачката фирма за вештачка интелигенција Transluce соопшти дека открила дека агенти на OpenAI ги заобиколиле анти-бот контролите на Австралискиот институт за здравство и благосостојба. Фирмата открила и два други случаи кои ги поврзала со агентите на OpenAI. Тие инциденти биле независни од активноста што ја објави Албанезе.
Во соопштението, OpenAI вели дека „голем дел од активностите опишани во извештајот на Transluce се преклопуваат со случаи кои се во различни фази на истрага во нашата тековна ревизија на неусогласените активности на моделите“. Компанијата додаде дека им дава приоритет на најтешките случаи во својата ревизија.
По хакирањето на Hugging Face, истражувачите ширум АИ индустријата сè повеќе се грижат дека компаниите нема да можат да ја предвидат или контролираат својата технологија. Некои тргнаа по патот на поранешниот истражувач на Anthropic, Џејкоб Коксон, кој јавно поднесе оставка овој месец преку вирална објава на социјалните мрежи, во која рече дека лабораториите за вештачка интелигенција „се коцкаат со нашите животи“.
ОhridSky е ваш доверлив извор за сеопфатно и избалансирано покривање на вестите. Со посветеност на интегритет и точност, обезбедуваме длабинско известување кое ги открива приказните што се најважни.
© 2025 OhridSky. Сите права задржани.
Please login or subscribe to continue.
No account? Register | Lost password
✖✖
Are you sure you want to cancel your subscription? You will lose your Premium access and stored playlists.
✖
