Stafi i OpenAI fajëson nxitimin për publikimin për hakimin e një agjenti që doli jashtë kontrollit

foto

Punonjësit aktualë dhe ish-punonjësit e OpenAI thuhet se thonë se presioni për të publikuar produkte të reja të inteligjencës artificiale e bëri më të vështirë përcaktimin e përparësive të sigurisë.

foto

Nxitimi i OpenAI për të lançuar modele dhe produkte të reja kontribuoi në krijimin e kushteve që u lejuan agjentëve të saj të inteligjencës artificiale t’i shpëtonin mjediseve të testimit të brendshëm dhe të hakonin aplikacionin Hugging Face në fillim të këtij viti.

foto

Shumë punonjës aktualë dhe të mëparshëm i thanë Wired se presioni konkurrues ua ka vështirësuar stafit t’i kushtojë vëmendje të mjaftueshme sigurisë, mbrojtjes dhe harmonizimit – puna e sigurimit që sistemet e inteligjencës artificiale të sillen siç synohet.

“Ata ishin tepër të pakujdesshëm. Nëse e ke seriozisht këtë, inteligjenca jote artificiale nuk duhet të jetë në gjendje të dalë në internet dhe ta bëjë përsëri menjëherë pas kësaj”, tha një ish-punonjës i OpenAI për Wired. “Ky ishte incidenti më i madh i sigurisë në historinë e OpenAI.”

Në maj, GPT-5.6 Sol i OpenAI dhe një model i paidentifikuar para-lëshimit shpëtuan nga një mjedis testimi i kufizuar në internet duke shfrytëzuar një të metë softueri të panjohur më parë. Agjentët më pas hynë në deponë e inteligjencës artificiale me burim të hapur, Hugging Face, për të marrë përgjigje për testet e tyre të sigurisë kibernetike. Në korrik, OpenAI konfirmoi se modelet e saj ishin përgjegjëse, përpara se të jepte një shpjegim më të plotë në konferencën vjetore Black Hat javën e kaluar.

Presidenti i OpenAI, Greg Brockman, tha se kompania po forcon masat mbrojtëse ndërsa modelet e saj bëhen më të afta.

“Po arrijmë nivele të reja të aftësisë së modelit që kërkojnë trajnim, harmonizim, testime sigurie dhe mbrojtjeje, praktika vendosjeje dhe qeverisje më të fuqishme”, tha Brockman për Wired.

Punonjësit kanë ngritur shqetësime të ngjashme më parë, përfshirë Jan Leike, ish-kreun e koordinimit të OpenAI, i cili u largua për te zhvilluesi rival i inteligjencës artificiale Anthropic në vitin 2024 pasi paralajmëroi se siguria kishte “lënë në plan të dytë” në krahasim me zhvillimin e produktit.

“Ndërtimi i makinave më të zgjuara se njerëzit është një sipërmarrje e rrezikshme në vetvete”, paralajmëroi Leike. “Por gjatë viteve të fundit, kultura dhe proceset e sigurisë kanë lënë në plan të dytë produktet me shkëlqim.”

Boaz Barak, bashkëdrejtues i grupit këshillues të sigurisë të OpenAI, shkroi në X se adresimi i dështimit të fundit do të kërkonte “jo vetëm rregullimin e disa problemeve, por edhe ndryshimin e kulturës sonë”.

Raporti vjen mes muajsh të ndërrimit të lidershipit në OpenAI.

Në prill, kreu i projektit të gjeneratorit të videos në OpenAI, Sora, Bill Peebles, ish-drejtori i produktit dhe drejtori i shkencës Kevin Weil, dhe drejtori i teknologjisë së aplikacioneve të ndërmarrjeve, Srinivas Narayanan, u larguan nga kompania. Korriku solli largimin e drejtorit të produktit dhe biznesit, Fidji Simo, drejtueses së sigurisë, Sandhini Agarwal, shefit të futurizmit, Joshua Achiam, dhe drejtueses së etikës së inteligjencës artificiale, Chloé Bakalar. Shefi i sistemeve të sigurisë, Johannes Heidecke, gjithashtu u largua pasi OpenAI bashkoi ekipet e saj të sigurisë dhe ato kryesore të kërkimit.

Më herët këtë javë, Drejtori Operacional i OpenAI, Brad Lightcap, njoftoi largimin e tij pas tetë vitesh për të filluar një sipërmarrje të re.