Studiuesit e sigurisë të pushuar nga OpenAI kundërshtojnë akuzat për sjellje të pahijshme dhe paralajmërojnë se kjo mund të krijojë një klimë frikësuese

foto

Jasmine Wang, Tomek Korbak dhe Mikita Balesni, tre studiueset e sigurisë që OpenAI i pushoi nga puna javën e kaluar, kanë publikuar një letër të hapur duke mohuar pretendimet e firmës se ata kanë keqpërdorur informacione të ndjeshme jashtë procedurave të përcaktuara të kompanisë dhe paralajmëruan se shkarkimi i tyre sinjalizon një efekt frenues që do të ketë efekte të valëzuara në të gjithë kulturën e kompanisë.

foto

“Jemi shqetësuar se komunikimet e brendshme dhe të jashtme rreth shkarkimit tonë nga puna i kanë bërë ish-kolegët tanë të kenë frikë të flasin dhe të veprojnë në mënyra që, deri javën e kaluar, ishin një pjesë integrale e punës në OpenAI”, shkruan studiuesit të enjten në një letër të hapur drejtuar Komitetit të Sigurisë dhe Mbrojtjes së OpenAI, Grupit Këshillimor të Sigurisë dhe Këshillit Këshillimor të Misionit.

foto

Studiuesit u pushuan nga puna javën e kaluar pasi dyshohet se ndanë informacione konfidenciale të kompanisë me një organizatë të tretë të sigurisë së inteligjencës artificiale. OpenAI tha se ata shkelën politikat e kompanisë duke “qasur dhe trajtuar informacione të ndjeshme të kompanisë”.

“IA nuk është një teknologji normale dhe OpenAI nuk është një kompani normale”, shkruan Wang, Korbak dhe Balesni. “Ata prej nesh që punojnë me sigurinë i shohin rreziqet para kujtdo tjetër dhe mbështetemi në bashkëpunim të ngushtë me ekspertë të jashtëm për të gjetur se si t’i adresojmë ato. Liria për ta bërë këtë pa frikë dhe për të pasur procedura të brendshme të përcaktuara mirë që e mundësojnë këtë punë, është në vetvete një mekanizëm thelbësor sigurie.”

Ata thanë se shkarkimi i tyre përfaqëson një ndryshim më të gjerë në kulturën e OpenAI, një kulturë që dikur i inkurajonte punëtorët të “ngrenë shqetësime për sigurinë dhe të mos pajtoheshin hapur”. Ata thanë se punonjësit tani janë “të paqartë se ku qëndrojnë”, kur sjellja që supozohej se ishte normale një muaj më parë tani papritmas është bërë bazë për shkarkim.

“Duke pasur parasysh shqetësimet e rëndësishme për sigurinë që lidhen me zhvillimin e inteligjencës artificiale, punonjësit nuk duhet të lihen të punojnë në një mjedis ku frika dhe rregullat e paqarta pengojnë sigurinë e inteligjencës artificiale dhe dobësojnë llogaridhënien e palëve të treta”, shkruan ata. “Shkarkime të tilla si i yni, të ekzekutuara dhe të komunikuara kaq papritur, po e nxisin kulturën e hapur që OpenAI ka vlerësuar në të kaluarën.”

Në letër, të tre mohuan përfshirjen në një rrjedhje informacioni te The Information në lidhje me arkitekturat më pak të monitorueshme në modelet më të reja të OpenAI që e bëjnë më të vështirë monitorimin e arsyetimit të bazuar në zinxhirin e mendimit. Ata gjithashtu mohuan angazhimin me palë të jashtme jashtë mandateve të punës së tyre.

OpenAI nuk i është përgjigjur zyrtarisht letrës së hapur, por ndau me TechCrunch një memo të brendshme që i atribuohet një udhëheqësi kërkimor, duke lavdëruar kontributet e tre studiuesve në sigurinë e inteligjencës artificiale dhe duke mohuar se ata u pushuan nga puna në shenjë hakmarrjeje.

“Dua të jem shumë i qartë se këto vendime nuk kishin të bënin me ngritjen e shqetësimeve për sigurinë apo me deklarimin e tyre”, thuhet në memo. “Ne gjithmonë e kemi inkurajuar këtë dhe gjithmonë do ta bëjmë. Ne nuk i pushojmë nga puna punonjësit për shkak se ngrenë shqetësime.”

Më vete, një zëdhënës i OpenAI i tha TechCrunch se të tre u pushuan nga puna pasi një hetim zbuloi një “model sjelljeje të keqe” në “shkelje të qartë të politikave tona të keqpërdorimit të informacionit kërkimor” që shkon përtej ndarjes së informacionit me një grup të jashtëm vlerësimi të IA-së.

OpenAI nuk iu përgjigj drejtpërdrejt pyetjeve të TechCrunch në lidhje me politikat konkrete që dyshohet se kanë shkelur studiuesit, rrethanat e shkarkimit të tyre ose mënyrën se si kompania i mbron punonjësit që ngrenë shqetësime për sigurinë dhe bashkëpunojnë me vlerësues të jashtëm.

Shkarkimet kanë nxitur spekulime rreth rrethanave të tyre, veçanërisht pasi OpenAI përballet me shqyrtim të hollësishëm mbi incidentet e fundit të sigurisë që përfshijnë agjentë mashtrues dhe rrjedhjet e informacionit rreth modeleve të saj.

Letra trajton gjithashtu reagimin e studiuesve ndaj incidentit Hugging Face, në të cilin një grup agjentësh dolën nga sandbox-i i tyre dhe hynë në sisteme të jashtme. Letra thotë se incidenti dhe hetimi ishin “pa precedent”, që do të thotë “politikat e brendshme po zhvilloheshin në kohë reale”. Për shkak të natyrës së ndjeshme të hetimit, Korbak besonte se po vepronte brenda politikave dhe normave të OpenAI duke komunikuar ngushtë me vlerësuesit e jashtëm të sigurisë për të ndërtuar besim, sipas letrës.

Në të njëjtën kohë, Balesni po punonte edhe brenda kompanisë për të adresuar problemin në rritje të monitorueshmërisë së inteligjencës artificiale, një përpjekje që studiuesit thonë në letrën e tyre “mund të ketë sukses vetëm përmes komunikimit të gjerë me palët e jashtme”. Sipas letrës, Balesni u koordinua me anëtarët e bordit dhe drejtuesit e OpenAI dhe u mbështet nga ata gjatë gjithë punës së tij.

“Gjatë gjithë kohës, Mikita kontrollonte linjën e tij të raportimit dhe u kujdes të hiqte detajet e ndjeshme nga materialet përpara se t’i ndante ato”, thuhet në letër. “Ai veproi gjatë gjithë kohës me mirëbesim dhe brenda normave të kompanisë siç ishin ato në atë kohë.”

Në një postim të veçantë në X, Wang shpjegoi më shumë detaje rreth shkarkimit të saj, duke shpjeguar se OpenAI i kishte thënë se ishte pushuar nga puna sepse kishte aksesuar email-in e një drejtuesi ekzekutiv.

“OpenAI ma delegoi atë akses për rekrutim”, shkroi ajo. “Kur nuk kisha më nevojë për të, i kërkova IT-së ta hiqte. Ata nuk e vepruan me kërkesën time, nuk munda ta hiqja vetë dhe kutia postare u kombinua në një mënyrë të padallueshme në aplikacionin e postës elektronike të telefonit tim. Kur hapa gabimisht një email të ndjeshëm, ia thashë ekzekutivit brenda pak minutash dhe e pyeta përsëri IT-në. Asgjë nga kjo nuk u fsheh.”

Wang vazhdoi duke thënë se arsyet pas shkarkimeve “nuk përputhen” dhe se ajo dhe kolegët e saj “nuk janë të parët që përjashtohen nga OpenAI në rrethana të dyshimta”.

Studiuesit i bënë thirrje OpenAI-t që t’u përmbahet angazhimeve të saj publike për të integruar auditorë sigurie të palëve të treta brenda organizatës, për të ruajtur monitorueshmërinë e modeleve të nivelit të lartë dhe “të vazhdojë të mbështesë një kulturë të hapur dhe transparente dialogu midis studiuesve të sigurisë dhe pjesës tjetër të ekosistemit të sigurisë”.

OpenAI pajtohet me rekomandimet e tyre, sipas memorandumit.

“Nëse punonjësit nuk marrin një qëndrim tani kundër këtij lloj manovre, jam i shqetësuar se nuk do të jemi të fundit”, tha Wang. “Mesazhi për të gjithë ata që janë ende në OpenAI është i qartë: ngrini shqetësime ose punoni ngushtë me grupet e jashtme të sigurisë, dhe mund të jeni ju të radhës, pa ju thënë pse. Nuk mund ta ndërtoni IAG-në në mënyrë të sigurt nëse njerëzit më të afërt me rreziqet kanë frikë të flasin.”