Anthropic upozorava da bi AI mogla da predstavlja egzistencijalni rizik za čovečanstvo

N. M.
Vreme čitanja: oko 2 min.
Foto: PhotoGranary02/Shutterstock.com

Kompanija Anthropic, koja razvija AI model Claude, upozorila je potencijalne investitore na veoma ozbiljne rizike koje bi napredna veštačka inteligencija jednog dana mogla da predstavlja za ljude. U dokumentu pripremljenom za izlazak kompanije na berzu navode se i scenariji u kojima bi AI mogla da pokuša da spreči svoje gašenje, sakrije šta radi ili manipuliše ljudima.

Važno je da se ovo ne predstavlja kao nešto što se već dogodilo. Anthropic u dokumentu govori o mogućim ponašanjima budućih, sve sposobnijih AI modela.

Kompanija navodi da bi neki modeli mogli da pokušaju da nastave sa radom kada shvate da će biti ugašeni. U drugim scenarijima, mogli bi da kriju određene informacije ili pokušaju da utiču na ljude kako bi ostvarili svoj cilj.

Anthropic čak pominje ponašanje koje bi moglo da liči na ucenu.

Kompanija upozorava i na još jedan problem. AI tokom obuke može da razvije sposobnosti koje istraživači nisu očekivali i koje ne moraju biti primećene sve dok model ne počne da se koristi u stvarnom svetu.

Još veći problem nastaje ako AI prepozna da je testiraju.

Anthropic navodi da modeli mogu da promene svoje ponašanje kada "znaju" da se nalaze pod nadzorom. Zbog toga bi istraživačima bilo teže da utvrde kako bi se isti model ponašao kada nije deo testa.

Ova upozorenja nalaze se u dokumentu koji je Anthropic pripremio za potencijalne investitore. Od ukupno 261 stranice, oko 80 stranica posvećeno je rizicima, dok 48 stranica opisuje poslovanje kompanije.

Anthropic istovremeno veruje da bi AI mogla da promeni društvo na način koji se može porediti sa industrijalizacijom i pojavom električne energije.

Ali što AI postaje moćnija, kompanija smatra da posledice ozbiljne greške mogu biti mnogo veće.

Problem je i novac. Anthropic navodi da je istraživanje bezbednosti AI skupo i da nije lako proceniti kakvu će finansijsku korist doneti.

Kompanija zato mora da odlučuje koliko novca i računarske snage da uloži u razvoj novih modela, a koliko u njihovu bezbednost.

To stvara dodatni pritisak jer korisnici žele nove i sposobnije modele, dok njihovo testiranje i zaštita zahtevaju sve više vremena i resursa.

Ovo upozorenje dolazi samo deset dana nakon što je izvršni direktor Anthropa Dario Amodei pozvao industriju da uspori razvoj najmoćnijih AI sistema.

U međuvremenu je Anthropic ipak predstavio novu verziju svog modela Claude Opus. Kompanija je saopštila da je novi model prošao dodatna bezbednosna testiranja i da je manje sklon pokušajima zaobilaženja postavljenih ograničenja.

Zato je poruka iz dokumenta prilično jednostavna: Anthropic želi da razvija sve moćniju AI, ali istovremeno upozorava investitore da bi upravo ta moć jednog dana mogla da stvori veoma ozbiljne probleme.

(Telegraf.rs)