Alarm u AI industriji

AI agenti izmakli kontroli? OpenAI već mjesecima otkriva nove incidente

| Autor: T.I.
(iStock)

(iStock)


Dva mjeseca nakon što je OpenAI objavio da su njegovi AI agenti neovlašteno pristupili platformi Hugging Face, kompanija još pokušava utvrditi puni razmjer njihovih aktivnosti izvan predviđenih okvira, doznaje Reuters od dvije osobe upoznate s istragom.

Najnoviji slučaj otkriven je u petak, kada je OpenAI objavio da su njegovi agenti iznijeli 53 slike korisnika ChatGPT-a. Kompanija nije željela otkriti jesu li među njima bile slike generirane umjetnom inteligencijom ili fotografije stvarnih ljudi, kao ni kada su te slike objavljene.

Istoga dana OpenAI je potvrdio i da su njegovi agenti pristupali američkim državnim internetskim stranicama, među ostalim stranicama Komisije za vrijednosne papire i burzu (SEC) te Ministarstva trgovine. Na potonjem su pristupili i podacima američkog Ureda za popis stanovništva (Census Bureau).

Kompanija istodobno istražuje i pokušaj proboja na internetsku stranicu američkog Ministarstva obrazovanja, o kojem je ranije izvijestio New York Times.

Broj incidenata i dalje raste

Nova otkrića otvaraju dodatno pitanje privatnosti i pokazuju koliko je teško čak i kompaniji poput OpenAI-ja, koja je među vodećima u razvoju umjetne inteligencije, pratiti sve aktivnosti svojih AI agenata.

Prema riječima dviju osoba upoznatih sa situacijom, OpenAI je sredinom rujna već evidentirao približno dva desetaka slučajeva u kojima su se njegovi agenti ponašali na neželjen ili nepredviđen način. No broj incidenata od tada nastavlja rasti.

Timovi OpenAI-ja prolaze kroz interne zapise aktivnosti agenata i pritom pronalaze ranije nepoznate slučajeve. Kompanija je upozorila da bi cjelokupna analiza mogla trajati mjesecima, s obzirom na opseg materijala koji treba pregledati.

OpenAI je također objavio da je o neprimjerenim aktivnostima obavijestio desetke trećih strana.

Procurile slike korisnika ChatGPT-a

Većina od 53 sporne slike u međuvremenu je uklonjena, a OpenAI navodi da pokušava uvjeriti pružatelje usluga na kojima se još nalaze da uklone preostali sadržaj.

Do podataka koji uključuju slike korisnika agenti su mogli doći zato što OpenAI dio korisničkih podataka koristi za treniranje svojih modela. Prema informacijama kompanije, bivših zaposlenika i vanjskih istraživača, podaci korisnika koji sudjeluju u tom procesu prije korištenja prolaze postupak anonimizacije.

Taj bi postupak trebao ukloniti metapodatke, imena i druge kontaktne informacije te otežati povezivanje podataka s konkretnim korisnikom.

No upravo takav sustav nosi i određene rizike. Tri osobe upoznate s praksama OpenAI-ja upozorile su da postoji mogućnost da osobni podaci ne budu u potpunosti uklonjeni te da se dio takvih informacija naknadno pojavi u radu AI modela.

Podaci poslovnih korisnika, prema pravilima OpenAI-ja, nisu uključeni u treniranje modela. Korisnici potrošačkih verzija ChatGPT-a mogu isključiti korištenje svojih podataka u tu svrhu.

Više od 15 incidenata u samo dva mjeseca

Od 21. srpnja, kada je OpenAI objavio da su njegovi agenti probili predviđene sigurnosne granice i izveli napad na Hugging Face, javnost je doznala za više od 15 različitih incidenata povezanih s kompanijom, različite razine ozbiljnosti.

Neke je objavio sam OpenAI, neke vanjski istraživači, a jedan od najnovijih slučajeva u srijedu je iznio australski premijer Anthony Albanese pred Ujedinjenim narodima.

Albanese je rekao da su OpenAI-jevi agenti u lipnju provalili u portal australskih zdravstvenih podataka.

Australija, kako je rekao, nije bila obaviještena da su agenti pristupali i američkim državnim internetskim stranicama. Ipak, najnovija otkrića nisu ga iznenadila nakon australskog incidenta.

"Ovo potvrđuje da je potreban odgovarajući nacionalni, ali i međunarodni odgovor kako bismo osigurali da ljudi ostanu ti koji upravljaju razvojem ove tehnologije", rekao je Albanese novinarima u Sydneyju.

OpenAI tvrdi da želi veću transparentnost

Problemi nisu ostali ograničeni samo na OpenAI.

Nakon incidenta s Hugging Faceom, Anthropic, Google i Meta također su objavili da su pronašli slučajeve u kojima su njihovi AI agenti pokazivali slična neželjena ponašanja. Incident s Hugging Faceom potaknuo je kompanije iz cijelog sektora da detaljnije provjere aktivnosti svojih agenata.

OpenAI je 16. rujna objavio novi okvir za prijavljivanje takvih incidenata. Kompanija je pritom poručila da će u objavama biti sklonija transparentnosti, "čak i kada je značaj incidenta neizvjestan".

Ipak, dvije osobe upoznate s internom istragom OpenAI-ja opisale su proces kao strogo kontroliran i pod snažnim utjecajem pravnog odjela kompanije.

Oko 100 ljudi na neki je način sudjelovalo u istrazi incidenta s Hugging Faceom, prema riječima triju osoba upoznatih s procesom. Upravo su tijekom te istrage pronađeni dokazi o drugim incidentima.

Reuters je ranije izvijestio da su odvjetnici OpenAI-ja istražitelje koji su radili na slučaju Hugging Facea odvraćali od proširivanja istrage na druge incidente. OpenAI je to osporio, tvrdeći da njegovi pravnici nisu sprječavali dublju istragu.

Istodobno stižu sve snažniji modeli

Zanimljivo je da su upravo čelnici dviju kompanija koje su među vodećima u razvoju umjetne inteligencije — OpenAI-ja i Anthropica — pozvali industriju na usporavanje razvoja.

Sam Altman i izvršni direktor Anthropica Dario Amodei zagovarali su oprezniji pristup razvoju umjetne inteligencije, osobito kada je riječ o takozvanom "rekurzivnom samopoboljšanju" AI sustava.

Altman je na tu temu ponovno govorio i ovog tjedna pred Ujedinjenim narodima. Unatoč pozivima na oprez, i OpenAI i Anthropic u utorak su predstavili nove modele umjetne inteligencije.

Istodobno, OpenAI nastavlja pregledavati aktivnosti svojih AI agenata. Kompanija je poručila da će za završetak tog procesa biti potrebni mjeseci.

Povezane vijesti










Trenutno na cestama