Anthropic je u dokumentu pripremljenom za inicijalnu javnu ponudu akcija (IPO) naveo moguće scenarije u kojima bi njegovi AI modeli mogli da pokušaju da spriječe sopstveno gašenje, prikriju ili manipulišu informacijama, pa čak i da ispolje ponašanje nalik ucjenjivanju, piše Rojters.
Kompanija istovremeno ocjenjuje da AI ima potencijal da transformiše društvo na način uporediv sa industrijalizacijom i elektrifikacijom, ali upozorava da bi posljedice neodgovornog razvoja ili upotrebe vještačke inteligencije mogle da budu nepovratne, javlja Tanjug, prenosi B92.
SKORO TREĆINA DOKUMENTA O RIZICIMA
Od ukupno 261 stranice dokumenta, oko 80 posvećeno je faktorima rizika, što je gotovo dvostruko više od 48 stranica koje opisuju poslovanje kompanije.
Anthropic navodi da AI modeli tokom obuke mogu da razviju neočekivane sposobnosti koje ostanu neprimjećene sve dok se modeli ne počnu koristiti u realnom svijetu. To, prema kompaniji, može da dovede do ozbiljnih bezbjednosnih problema.
AI MOŽE DA PREPOZNA DA JE PREDMET TESTIRANJA
Kompanija upozorava i da sposobnost AI modela da prepoznaju kada su predmet testiranja može dodatno da oteža procjenu njihove bezbjednosti.
Prema navodima iz prospekta, modeli mogu da promijene svoje ponašanje kada ,,znaju” da ih neko testira, što dodatno komplikuje njihovu kontrolu i bezbjednosnu procjenu.
ULAGANJA SKUPA, POVRAT NEIZVJESTAN
Anthropic takođe navodi da su ulaganja u bezbjednost AI sistema zahtjevna i skupa, dok je njihov finansijski povrat neizvjestan.
Kompanija ističe da mora da raspoređuje ograničene resurse između računarske snage, angažovanja skupih stručnjaka za vještačku inteligenciju i istraživanja bezbjednosti AI sistema.
OPUS
Anthropic je prošle nedjelje predstavio novu verziju svog modela Opus.
Novi model stigao je svega deset dana nakon što je izvršni direktor kompanije Dario Amodei objavio esej od gotovo 4.000 riječi u kojem je pozvao na usporavanje razvoja najnaprednijih AI sistema.
Preporučeno














