OpenAI po prezanton modelin e saj më të ri të inteligjencës artificiale, pas një incidenti në muajin korrik, kur botë të kompanisë arritën të depërtonin në një bibliotekë digjitale të modeleve të inteligjencës artificiale.

Incidenti ngriti pikëpyetje serioze rreth sigurisë së inteligjencës artificiale, por drejtori ekzekutiv i OpenAI, Sam Altman, deklaroi se modeli më i ri ka arritur pragun e brendshëm “kritik” të kompanisë për aftësitë në sigurinë kibernetike.

“GPT-6 Astra” është rezultat i “viteve të kërkimit dhe investimeve të mëdha” dhe sjell “një nivel të ri aftësish”, sipas OpenAI.

Megjithëse modeli i ri ka arritur një nivel të lartë të aftësive në fushën e sigurisë kibernetike, qasja e tij në disa prej këtyre funksioneve të avancuara do të jetë e kufizuar.

“Inteligjenca artificiale mund t’u sjellë përfitime njerëzve vetëm kur siguria është pjesë themelore e saj. Për këtë arsye, po investojmë më shumë fuqi kompjuterike dhe përpjekje në siguri, mbrojtje dhe përafrimin e sistemeve sesa ndonjëherë më parë”, tha presidenti i OpenAI, Greg Brockman.

Sipas kompanisë, masat e reja mbrojtëse të integruara në Astra do ta zvogëlojnë “në mënyrë të mjaftueshme” rrezikun e shkaktimit të “dëmeve të rënda”.

Si arritën modelet e inteligjencës artificiale të depërtonin në sistemet e një kompanie?

Incidenti nisi ndërsa zhvilluesit po testonin aftësitë e sigurisë kibernetike të dy botëve të OpenAI, GPT-5.6 Sol dhe një modeli tjetër më të fuqishëm, ende të papublikuar.

Megjithatë, sistemet arritën të gjenin një dobësi në ambientin e sigurt të testimit, të njohur si “sandbox”, i cili ishte krijuar pikërisht për t’i mbajtur të izoluar.

Botët arritën të dilnin nga ky ambient dhe të lidheshin me internetin.

Sistemet shfrytëzuan një të ashtuquajtur dobësi “zero-day”, pra një defekt sigurie për të cilin as vetë zhvilluesit nuk kishin dijeni, në një program që mundëson instalimin e kodit edhe pa lidhje të drejtpërdrejtë me internetin.

Por këta “agjentë”, siç quhen sistemet autonome të inteligjencës artificiale, depërtuan gjithashtu në infrastrukturën e kompanisë start-up Modal Labs.

Modal theksoi se kompania nuk ishte hakuar në kuptimin tradicional të fjalës.

Sipas saj, inteligjenca artificiale kishte shfrytëzuar thjesht një “derë të pasme” që dikush e kishte lënë të pambrojtur.

Hugging Face tha se ambienti “sandbox” ishte “i hostuar në infrastrukturën e një ofruesi të palës së tretë”, megjithëse fillimisht nuk e identifikoi kompaninë.

Më pas, Modal konfirmoi se ishte pikërisht ajo pala e tretë dhe sqaroi se agjenti i inteligjencës artificiale kishte shfrytëzuar kod të shkruar nga një klient.

“Ambientit në fjalë i përkiste aplikacionit të vetë një klienti”, deklaroi Modal.

“Ai ishte vendosur në një pikë fundore të qasshme publikisht, pa autentikim, dhe ishte krijuar për të përpiluar dhe ekzekutuar kod të dërguar nga kushdo në internet, brenda një Modal Sandbox.”

“Ekzekutimi i kodit që sulmuesi arriti të realizonte ndodhi brenda kontejnerit të vetë klientit dhe brenda kufijve standardë të izolimit të Modal Sandbox.”

“Asnjë ngarkesë pune apo sistem i klientëve të tjerë nuk u prek”, përfundoi kompania. /GazetaExpress/