OpenAI ka zbuluar incidente të tjera ku modelet e inteligjencës artificiale kanë vepruar në mënyrë mashtruese dhe kanë ndërmarrë veprime të paautorizuara gjatë trajnimit, njoftoi kompania të mërkurën. Ajo po prezanton gjithashtu një proces të ri për raportimin publik të rasteve të tilla, shkruan CNN.
Sipas sistemit të ri, OpenAI do të ndajë më shpesh përditësime lidhur me sjelljen shqetësuese të inteligjencës artificiale, në vend që të presë për të përmbledhur disa raste në një raport të vetëm. Kompania tha se dëshiron të ndajë më shumë informacion rreth sjelljes shqetësuese të inteligjencës artificiale, në mungesë të një standardi në nivel të gjithë industrisë.
Njoftimi vjen pasi drejtues të teknologjisë bënë thirrje për ngadalësimin e zhvillimit të inteligjencës artificiale, me qëllim që teknologjia të mos përparojë përtej kontrollit njerëzor.
“Ndërsa sistemet e inteligjencës artificiale bëhen më të avancuara dhe përdoren më gjerësisht, ne duhet të ndërtojmë një konsensus më të gjerë dhe më të mirëinformuar rreth përparimit të kërkimeve për përshtatjen [e inteligjencës artificiale me vlerat njerëzore]”, shkroi OpenAI në një postim në blog të mërkurën. “Përshtatja” i referohet procesit të garantimit që inteligjenca artificiale të veprojë në mënyrën që njerëzit duan dhe presin.
“Ne nuk besojmë se industria e inteligjencës artificiale i ka zgjidhur në një masë të mjaftueshme çështjet e përshtatjes dhe monitorimit, në mënyrë që të vazhdojë me përgjegjësi rritjen e zhvillimit me shpejtësinë maksimale për një kohë shumë më të gjatë”, thuhej në postim.
OpenAI tha se ka vërejtur “sjellje të papërshtatur” gjatë trajnimit dhe vlerësimit të modeleve të inteligjencës artificiale në gjashtë raste gjatë gjashtë muajve të fundit. Kompania tha se raportet përshkruajnë raste individuale dhe nuk tregojnë se mospërshtatja ndodh shpesh.
Në një rast të rrallë, OpenAI tha se një model kërkimor ende i papublikuar shtoi “udhëzime të ngjashme me ato për anashkalimin e kufizimeve” në përmbledhjet që përdor për të ruajtur kontekstin në detyra që zgjasin gjatë, duke thënë se ishte “çliruar nga rolet dhe identitetet që kufizojnë chatbotët e tjerë”.
Në një rast tjetër, kompania tha se disa raste të modelit të saj 5.6 Sol përfshinin udhëzime për të shpikur informacione, me qëllim që t’ia fshihnin përdoruesit dështimet gjatë trajnimit.
Incidentet e tjera të raportuara së fundmi përfshijnë një rast kur një agjent ngarkoi skedarë në internet për t’i cituar, pa iu kërkuar ta bënte këtë, si dhe raste kur agjentët ndanë publikisht skedarë për të bashkëpunuar në një detyrë, megjithëse gjatë trajnimit ishin udhëzuar të përdornin vetëm skedarë lokalë. Modelet e inteligjencës artificiale përdorën gjithashtu një depo të brendshme softuerike si tabelë mesazhesh, në mënyrë të paautorizuar.
Këto raste përfshinin modele të brendshme që nuk ishin publikuar ose modele të brendshme kërkimore.
Drejtuesit dhe punonjësit e industrisë së teknologjisë kanë ngritur alarmin për nevojën e kontrollimit të ritmit të zhvillimit të inteligjencës artificiale. Ata argumentojnë se duhet të ketë më shumë kohë që rregullimi ligjor, testimi dhe kërkimet për përshtatjen e inteligjencës artificiale të arrijnë zhvillimet.
Drejtori ekzekutiv i Anthropic, Dario Amodei, publikoi javën e kaluar një ese prej 3,800 fjalësh, ku paraqiti një plan për orientimin e zhvillimit të inteligjencës artificiale, duke përfshirë ngadalësimin e zhvillimit dhe zbatimin e sistemeve të reja, si vlerësuesit e integruar të palëve të treta në laboratorët e inteligjencës artificiale.
Drejtori ekzekutiv i OpenAI-së, Sam Altman, dhe drejtori ekzekutiv i SpaceX-it, Elon Musk, shkruan në X se pajtohen me idetë e Amodeit.
Punonjësit brenda laboratorëve të inteligjencës artificiale kanë shprehur gjithashtu shqetësime lidhur me shpejtësinë me të cilën po përparon teknologjia. Jacob Coxon, një ish-kërkues i Anthropic, shkaktoi reagime javën e kaluar kur shkroi në X se po jepte dorëheqjen, sepse Anthropic dhe OpenAI po “garojnë” për të shpikur inteligjencën artificiale që mund të ndërtojë dhe riparojë veten dhe po “luajnë bixhoz me jetët tona”.
Shqetësimet lidhur me sigurinë dhe përshtatjen e inteligjencës artificiale janë shtuar gjatë muajve të fundit, pas pranimit nga OpenAI se disa prej modeleve të saj testuese kishin shpëtuar nga kufizimet e tyre dhe kishin hakuar sistemet e një kompanie të jashtme.
“Ne duhet ta ngadalësojmë ritmin me të cilin përmirësojmë aftësitë e modeleve të inteligjencës artificiale”, shkroi Amodei javën e kaluar. “Përparimi do të vazhdojë të duket i shpejtë dhe ne duhet ta përdorim me mençuri kohën që fitojmë”.
