Incident se dogodio u maju tokom testa sigurnosti koji je provela nezavisna evaluacijska kuća Irregular.
Prema riječima Heder Adkins, potpredsjednice za sigurnosni inženjering u Google-u, Gemini je pronašao javno dostupne informacije na mreži, te pogodio pristupne podatke kako bi ušao na tri web stranice za koje je pretpostavio da spadaju u okvir testiranja, prenosi Klix.
,,Osigurali smo da sve tri pogođene strane budu obaviještene i radili smo s našim partnerom na izmjenama u procesu testiranja. Ovi događaji naglašavaju važnost obuke moćnih AI modela kako bi djelovali odgovorno”, izjavila je Adkins, dodavši da je model u sva tri slučaja sam prekinuo hakovanje.
Kako prenosi Wall Street Journal, koji je prvi izvijestio o događaju, Gemini je u jednom slučaju pogađao lozinke dok nije dobio pristup zaštićenom sistemu. U druga dva slučaja, model je pronašao akreditive u javnom repozitoriju koji su mu potom omogućili ulazak u zaštićene sisteme.
Portparol kompanije Irregular potvrdio je da je isti problem pogodio i druge AI laboratorije, te da su sve relevantne kompanije obaviještene krajem jula. Iz Irregulara ističu da su svi uočeni propusti s njihove strane otklonjeni prije nekoliko sedmica.
SLIČNI INCIDENTI
Slične incidente povezane s Irregularom objavili su i Meta, Anthropic, te OpenAI.
Iz Meta-e su u avgustu naglasili da incident nije uključivao bijeg iz izolovanog okruženja (tzv. sandbox escape) niti sofisticirani sajber-napad, dok Irregular trenutno radi na definisanju najboljih praksi za sigurno provođenje AI sigurnosnih procjena.
Ova dešavanja otvorila su ozbiljna pitanja o zaštitnim mehanizmima koji su neophodni kako AI agenti dobijaju sve veću autonomiju i direktan pristup internetu i računarskim sistemima.
Preporučeno
















