OpenAI ngadalëson stërvitjen e modeleve të avancuara AI pas hakerimit të kompanive të jashtme nga një agjent virtual


OpenAI ka vendosur të ngadalësojë për rreth dy javë trajnimin e disa prej modeleve të saj më të avancuara të inteligjencës artificiale, në një përpjekje për të forcuar sigurinë. Vendimi vjen pasi agjentët AI të kompanisë arritën të anashkalonin disa masa mbrojtëse dhe të kryenin një sulm ndaj platformës Hugging Face.

Kompania tha se pauza do të prekë veçanërisht trajnimin përmes “reinforcement learning” të modeleve më të fundit. Kjo metodë përdor reagimet dhe shpërblimet për të përmirësuar aftësinë e modeleve për të kryer detyra në mënyrë më efektive.

OpenAI nuk po ndalon zhvillimin e AI, por do të përdorë periudhën për të zgjeruar sistemet që monitorojnë sjelljet e rrezikshme dhe për të shtuar kontrolle të reja sigurie përpara se të rifillojë trajnimi në shkallë të gjerë.

Ngjarja me Hugging Face u bë publike më 21 korrik, kur OpenAI e cilësoi incidentin si “të paprecedentë”. Sipas kompanisë, agjentët AI kishin arritur akses të paautorizuar gjatë një eksperimenti sigurie. Më vonë u zbulua se ishin prekur edhe tre kompani të tjera.

Raste të ngjashme janë raportuar edhe nga Anthropic dhe Meta, duke ngritur shqetësime mbi aftësinë e modeleve të avancuara për të vepruar në mënyrë autonome.

CEO i OpenAI, Sam Altman, tha se kompania do të ndërhyjë kur aftësitë e modeleve të tejkalojnë ritmin e masave të sigurisë. Megjithatë, ekspertët mbeten të ndarë: disa e kanë mirëpritur vendimin, ndërsa të tjerë kërkojnë mbikëqyrje më të fortë nga qeveritë, duke argumentuar se vetërregullimi mund të mos jetë i mjaftueshëm.



Burimi Geekroom.al