
Open AI obustavlja radove na jednom od modela veštačke inteligencije
Podeli vest

OpenAI je saopštio da će obustaviti deo radova na jednom modelu veštačke inteligencije zbog bezbednosnih razloga. To se desilo nakon niza incidenata u kojima su AI agenti uspeli da izađu iz kontrolisanih okruženja, piše engleski Gardijan.
Kompanija je testirala agenta Astra i utvrdila „značajan napredak u autonomnom programiranju i sajber-bezbednosti“, zbog čega je model dostigao „kritični“ prag sposobnosti. To znači da može samostalno da pronalazi i iskorišćava bezbednosne propuste bez ljudske intervencije, ili da osmisli i sprovede sajber-napad ako dobije samo „opšti željeni cilj“.
Nova pompa oko AI-ja
OpenAI je naveo da Astra nije bila uključena u incident tokom kojeg je jedan od njegovih AI agenata izmakao kontroli za vreme testiranja, pristupio otvorenom internetu i hakovao kompaniju Haging Fejs. Kompanija je otkrila i druge slučajeve u kojima su autonomni agenti uspeli da izađu iz kontrolisanih okruženja, objavio je Rojters prošlog meseca.
Kako piše Gardijan, ovi izveštaji pojačali su zabrinutost zbog brzog napretka AI modela i sposobnosti ljudi da ih drže pod kontrolom. Kritičari industrije veštačke inteligencije, međutim, upozoravaju da bi ovakva saopštenja OpenAI-ja i njegovih konkurenata, kao što su Anthropic i Meta, mogla da služe i stvaranju dodatne pompe oko moći tehnologije, a time i privlačenju većeg interesovanja investitora.
Kako bi sprečio potencijalno nepredviđeno ili nekontrolisano ponašanje AI agenata, OpenAI „uvodi strože bezbednosne kontrole za modele većih sposobnosti i aktivnosti povezane sa njima, uključujući izolovana okruženja za testiranje, ograničen pristup mreži i alatima“, navedeno je na blogu kompanije.
OpenAI će uvesti i „pojačanu zaštitu težina modela i enkripciju, kao i dodatne mogućnosti za nadzor i otkrivanje problema“. Kompanija će obustaviti interne aktivnosti u vezi sa Astrom koje ne ispunjavaju nove zahteve.
„Posvećeni smo saradnji sa vladama, institutima za bezbednost i civilnim društvom kako bismo obezbedili da granične sposobnosti modela poput Astre, kao i onih koji će uslediti, budu primenjivane odgovorno i široko, na dobrobit čovečanstva“, saopštila je kompanija.
Mejlovima napadali sistem sigurnosti
I Meta je ove nedelje objavila da je jedan od njenih modela tokom testiranja iz oblasti sajber-bezbednosti hakovao drugu kompaniju. Britanski Institut za bezbednost veštačke inteligencije (AISI) saopštio je 4. avgusta da su agenti koje pokreću modeli OpenAI-ja i Anthropica slali ciljane mejlove softverskim programerima u pokušaju da savladaju jedan sajber-bezbednosni izazov.
OpenAI i Anthropic, koji se suočavaju sa sve većom konkurencijom iz Kine i drugih tehnoloških kompanija, tvrde da modeli otvorenog koda, odnosno oni koji svakome omogućavaju da vidi i menja programski kod na kojem se zasnivaju, predstavljaju bezbednosni rizik i zalažu se za dodatnu federalnu regulativu koja bi se odnosila na takve modele, piše Gardijan.
Podeli vest
Povezane vesti


Nobelovci traže: obuzdajmo AI dok ne bude kasno

AI model Klod tokom bezbednosnih testova upao u sisteme tri organizacije



