Antropik u dokumentu za inicijalnu javnu ponudu akcija (IPO) pred izlazak na berzu navodi moguće scenarije u kojima bi njeni modeli mogli da pokušaju da spriječe sopstveno gašenje, prikriju ili manipulišu informacijama i ispolje ponašanje nalik ucjenjivanju, prenosi Rojters.
Kompanija istovremeno ocjenjuje da AI ima potencijal da transformiše društvo na način uporediv sa industrijalizacijom i elektrifikacijom, ali upozorava da bi posljedice neodgovornog razvoja ili upotrebe AI mogle da budu nepovratne.
U dokumentu je oko 80 od ukupno 261 stranice posvećeno faktorima rizika, što je gotovo dvostruko više od 48 stranica koje opisuju poslovanje kompanije.
Antropik navodi da AI modeli tokom obuke mogu da razviju neočekivane sposobnosti koje se ne primijete dok se modeli ne koriste u realnom svijetu, što može da dovede do ozbiljnih bezbjednosnih problema.
Kompanija takođe upozorava da sposobnost modela da prepoznaju kada su predmet testiranja može da oteža procjenu njihove bezbjednosti.
Prema navodima iz prospekta, AI modeli mogu da mijenjaju ponašanje kada “znaju” da ih neko testira, što dodatno komplikuje njihovu kontrolu i procjenu.
Antropik navodi da su ulaganja u bezbjednost AI sistema zahtjevna i skupa, dok je njihov finansijski povrat neizvjestan.
Kompanija napominje da mora da raspoređuje ograničene resurse između računarske snage, skupih stručnjaka za vještačku inteligenciju i istraživanja bezbjednosti.
Antropik je prošle nedjelje predstavio novu verziju svog modela Opus, svega deset dana nakon što je izvršni direktor Dario Amodei objavio esej od gotovo 4.000 riječi u kojem je pozvao na usporavanje razvoja najnaprednijih AI sistema.
Bonus video
Saznajte sve o najvažnijim vijestima i događajima, pridružite se našoj Viber zajednici ili čitajte na Google News.