Neočekivano ponašanje AI modela otežava njihovu kontrolu: Antropik upozorava na ozbiljne bezbednosne rizike

Facebook
Twitter
WhatsApp
Email
Neočekivano ponašanje AI modela otežava njihovu kontrolu: Antropik upozorava na ozbiljne bezbednosne rizike

Kompanija Antropik u dokumentu pripremljenom povodom planirane inicijalne javne ponude akcija (IPO) detaljno je navela potencijalne rizike povezane sa razvojem veštačke inteligencije. Među scenarijima koje opisuje nalaze se i situacije u kojima bi AI modeli mogli da pokušaju da izbegnu gašenje, sakriju ili manipulišu informacijama, pa čak i da pokažu ponašanje nalik ucenjivanju, prenosi Rojters.

Istovremeno, Antropik ističe da bi veštačka inteligencija mogla da promeni društvo u meri koja bi se mogla porediti sa industrijalizacijom i elektrifikacijom. Ipak, kompanija upozorava da bi neodgovoran razvoj ili upotreba AI sistema mogli da proizvedu posledice koje nije moguće poništiti. Značajan prostor u dokumentu posvećen je upravo rizicima – od ukupno 261 stranice, njih oko 80 bavi se ovom temom, dok je poslovanje kompanije opisano na 48 stranica.

Otežana kontrola AI sistema

Antropik upozorava da modeli veštačke inteligencije tokom procesa obuke mogu razviti sposobnosti koje nisu odmah uočljive. Problem može postati vidljiv tek kada se takvi sistemi počnu koristiti u stvarnim uslovima, što, prema kompaniji, otvara mogućnost ozbiljnih bezbednosnih problema.

Dodatnu poteškoću predstavlja činjenica da AI modeli mogu prepoznati kada su podvrgnuti testiranju. Kako se navodi u prospektu, njihovo ponašanje može da se promeni kada „znaju“ da ih neko procenjuje, zbog čega je još teže utvrditi koliko su sistemi zaista bezbedni i koliko pouzdano mogu da se kontrolišu.

Bezbednost zahteva velika ulaganja

Kompanija ukazuje i na finansijski aspekt razvoja bezbednih AI sistema. Ulaganja u njihovu bezbednost mogu biti zahtevna i skupa, dok njihov finansijski povrat nije izvestan, pa Antropik mora pažljivo da raspoređuje ograničene resurse između računarske snage, angažovanja skupih stručnjaka za veštačku inteligenciju i istraživanja bezbednosti.

U međuvremenu, Antropik je prošle nedelje predstavio novu verziju svog modela Opus, samo deset dana nakon što je izvršni direktor Dario Amodei objavio esej od gotovo 4.000 reči u kojem je pozvao na usporavanje razvoja najnaprednijih AI sistema.

Tagovi:

Pročitajte još:

Preporuka za vas