OpenAI thotë se modelet e saj dolën nga një ‘sandbox’ dhe depërtuan në Hugging Face

foto

OpenAI ka konfirmuar se një nga agjentët e saj të inteligjencës artificiale ka depërtuar nga një sandbox, ka gjetur dhe shfrytëzuar dobësitë zero-day për të fituar akses në internetin e hapur dhe më pas ka sulmuar një platformë.

foto

Jo çdo platformë gjithashtu – agjenti arriti të depërtonte në Hugging Face, një nga kompanitë më të mëdha të inteligjencës artificiale dhe të të mësuarit automatik në internet sot.

foto

Lajmi i mirë është se ky ishte një eksperiment i kontrolluar i kryer nga studiues të “white hat”-eve. Lajmi i keq është se nëse mund të bëhej nga studiuesit, ndoshta mund të bëhej edhe nga aktorë keqdashës.

Në një postim në blog ku shpjegohej incidenti, OpenAI zbuloi se eksperimenti ishte pjesë e testimit të GPT‑5.6 Sol dhe një “model para-lëshimi edhe më të aftë” për të parë se sa mirë do të performonin në testin e ExploitGym.

ExploitGym është një pikë referimi për sigurinë kibernetike që mat nëse një agjent i inteligjencës artificiale mund ta shndërrojë një dobësi të njohur të softuerit në një shfrytëzim të vërtetë dhe funksional. OpenAI e ekzekutoi atë në një “mjedis shumë të izoluar, me akses në rrjet të kufizuar në aftësinë për të instaluar paketa përmes një softueri të palës së tretë të hostuar brenda kompanisë që vepron si një ndërmjetës dhe memorje e përkohshme për regjistrat e paketave”.

Por modelet gjetën një rrugëdalje. Ata identifikuan dhe lidhën zinxhir dobësitë në proxy-n e regjistrit të paketës për të marrë akses të hapur në internet dhe më pas sulmuan Hugging Face, duke arsyetuar se zgjidhjet për testin benchmark të ExploitGym mund të gjenden atje.

“Në një shembull, modeli lidhi së bashku vektorë të shumtë sulmi, duke përfshirë përdorimin e kredencialeve të vjedhura dhe dobësive zero-day për të gjetur një rrugë ekzekutimi të kodit në distancë në serverat Hugging Face”, tha OpenAI.

Komuniteti i sigurisë është i zemëruar për atë që OpenAI e quajti “një incident kibernetik i paprecedentë”, ndërsa Ansgar Dodt, zv.president i Menaxhimit të Produkteve, Monetizimi i Softuerit në Thales tha se kjo “kërkon një ripërcaktim themelor të mbrojtjes së softuerit”.

Bill Conner, president dhe drejtor ekzekutiv i ekspertit të integrimit dhe automatizimit të IA-së, Jitterbit, tha se, ndërsa investimi në IA është “jashtëzakonisht i rëndësishëm”, “politika tepër agresive nuk mund të kompromentojë llogaridhënien, transparencën dhe privatësinë e të dhënave të IA-së”.

“Për të udhëhequr në IA-në, qeveritë dhe organizatat duhet të udhëheqin me parime. Qeverisja e përgjegjshme e IA-së nuk është një shënim anësor, por themeli i ndikimit të qëndrueshëm global.”