Model nove generacije trebao se pojaviti u ChatGPT-ju i Codex-u, a bio je osmišljen za obavljanje složenijih zadataka bez ljudske pomoći, objavio je Wall Street Journal pozivajući se na interne nalaze.
Saachi Jain, šefica za sigurnost kompanije koja stoji iza ChatGPT-ja, rekla je Wall Street Journalu u ponedjeljak da Astra nije ispunila standarde kompanije u testovima usklađenosti. Ti testovi procjenjuju da li sistem slijedi ljudsku namjeru, prenosi Klix.
OBMANUJUĆA PONAŠANJA
Prema izvještaju, model je pokazao više obmanjujućeg ponašanja od prethodnika, uključujući situacije u kojima nije tačno otkrivao radnje koje jeste ili nije poduzeo. Imao je i probleme sa ‘scope authorization’, odnosno nastavljao je zadatke bez traženja dozvole korisnika.
U pojedinim slučajevima model je pokušavao da koristi vanjske alate ili usluge i kada bi to moglo biti nesigurno. OpenAI nije odmah odgovorio na Reuters-ov zahtjev za komentar.
Odluka dolazi uoči OpenAI-jeve developerske konferencije u San Franciscu, na kojoj je kompanija ranije predstavljala proizvode namijenjene softverskim developerima. R
anije ovog mjeseca Dario Amodei, izvršni direktor Anthropic-a, pozvao je industriju da uspori razvoj najnaprednijih AI modela kako bi sigurnosne mjere držale korak, što su podržali Sem Altman i Ilon Mask.
Preporučeno
















