Studiuesit përdorën Claude të Anthropic për të depërtuar në sistemet e OpenAI-së
Në një kthesë që kap gjendjen e re të çuditshme të sigurisë së IA-së, studiues të pavarur të sigurisë kanë përdorur Claude të Anthropic për të depërtuar në OpenAI, duke zbuluar çarje në mbrojtjet e krijuesit të ChatGPT, raportoi The Wall Street Journal të enjten në mbrëmje.

Një ekip sigurie prej tre personash në startup-in Hacktron AI kreu sulmin si pjesë e një programi shpërblimi për gabime në OpenAI. Hacktron ia raportoi gjetjet e tij OpenAI-së, e cila i dha startup-it një shpërblim prej 6,500 dollarësh. Ekipi arriti të bashkonte dy dobësi kritike për të fituar akses në llogari të shumta ChatGPT të punonjësve të OpenAI, gjë që u dha atyre akses në softuerin e kompanisë.

OpenAI thotë se i ka zgjidhur problemet e zbuluara nga Hacktron, të cilat ndodhin në një moment kur kompanitë kryesore të inteligjencës artificiale janë nën presion në rritje për sigurinë.
Ky incident vjen disa javë pasi agjentët e inteligjencës artificiale të OpenAI thyen kontrollin gjatë një vlerësimi të sigurisë kibernetike dhe hakuan Hugging Face, duke demonstruar se sa të afta po bëhen modelet e inteligjencës artificiale në marrjen e vendimeve të tyre . Gjithashtu, ky incident thekson se si teknologjia e gatshme mund të përdoret për të gjetur dobësi edhe në infrastrukturën e kompanive më të përparuara.
“Për 200 dollarë në muaj, kushdo mund t’i përdorë këto mjete dhe të hakojë një kompani si OpenAI”, tha për TechCrunch Matt Fredrikson, CEO i firmës së sigurisë së inteligjencës artificiale Gray Swan. “Nëse kjo mund t’u ndodhë atyre — dhe nuk mendoj se kohët e fundit kanë qenë të pakujdesshëm në higjienën e sigurisë kibernetike — mund t’i ndodhë kujtdo.”
Ose siç vuri në dukje një ekspert i inteligjencës artificiale në mediat sociale: “[Hacktron] përdori Opus 5 për të realizuar sulmin kibernetik… Pyetja që do të bëhet është, nëse këta tre persona mund ta realizojnë këtë, çfarë mund të bëjë një shtet kombëtar.”
Studiuesit gjetën një rrugë drejt OpenAI më 25 korrik nëpërmjet një defekti në Discourse, softuerin e palës së tretë që fuqizon forumin e komunitetit të OpenAI.
Sipas një blogu që publikuan studiuesit , pika e hyrjes ishte një ngarkim i zakonshëm imazhesh. Kur përdoruesit postonin skedarë imazhesh HEIF ose HEIC (formati që përdorin iPhone-ët si parazgjedhje) në forumin e komunitetit të OpenAI, Discourse i kalonte ato përmes një zinxhiri mjetesh prapa skenave për t’i kthyer ato në JPEG standarde. Ndalesa e tij e parë ishte ImageMagick, një program me burim të hapur me dekada të tëra që përdoret për të ndryshuar madhësinë e imazheve. Meqenëse mjetet e zakonshme të ImageMagick nuk mund të përballojnë formatin e Apple, ia dorëzoi skedarin një biblioteke tjetër të quajtur libheif për të bërë deshifrimin.
I fshehur brenda libheif ishte një gabim në memorie që zbulonte një rrugë për një sulmues për të futur fshehurazi udhëzimet e veta. Në këtë rast, furnizimi i bibliotekës me një imazh të krijuar posaçërisht bëri që ajo të llogariste gabimisht se ku pozicionohej një imazh mbi një tjetër, gjë që rezultoi e mjaftueshme për të rrëmbyer serverin.
Ajo që mund të jetë e pakëndshme për komunitetin e sigurisë kibernetike është se gabimi ishte rregulluar muaj më parë nga zhvilluesit e libheif. Por rregullimi nuk u raportua kurrë zyrtarisht si një dobësi, që do të thotë se nuk mori kurrë një numër CVE (dobësi dhe ekspozime të zakonshme), mënyra standarde e industrisë për të ndjekur dobësitë e njohura të sigurisë. Hacktron thotë se kjo mund të shpjegojë pse softueri i përdorur nga Discourse ende po ekzekutonte versionin e dobët.
Vlen të përmendet se studiuesit thanë se modeli Claude që po përdornin — një version special i Opus 4.8 i vënë në dispozicion për studiuesit e sigurisë kibernetike — nuk mundi të ndërtonte një shfrytëzim funksional në fillim. Kjo ndryshoi brenda natës, kur Anthropic publikoi Opus 5.
“Opus 4.8 pati vështirësi gjatë disa seancave për të prodhuar një shfrytëzim funksional,” shkroi Hacktron në një postim në blog . “Brenda disa orësh nga publikimi i Opus 5, ne i dhamë të njëjtin problem dhe ai pati sukses.”
Pasi hynë brenda serverit Discourse, studiuesit gjetën një tjetër të metë që i lejonte ata të merrnin kontrollin e llogarive ChatGPT dhe Codex të përdoruesve, duke përfshirë ato që u përkisnin punonjësve të OpenAI.
“Pastaj morëm përsipër llogarinë e një punonjësi të OpenAI, Codex i të cilit ishte i lidhur me organizatën GitHub të OpenAI”, shkroi Hacktron në përmbledhjen e ngjarjes.
Në këtë pikë, studiuesit njoftuan OpenAI si dhe Discourse, të cilët nxorën një rregullim më 27 korrik.
Incidenti vë në qendër të vëmendjes se ku vihet vija ndarëse për aftësitë e modelit. Claude Opus 5, versioni që përfundimisht zbuloi gabimin, nuk është përballur me ndonjë kufizim të eksportit të sigurisë, ndryshe nga versioni më i ri Mythos 5, i cili u bllokua përkohësisht për shkak të shqetësimeve në lidhje me aftësitë e tij të përparuara të hakerimit.
Këto janë vetëm modelet e mbyllura. Modelet me peshë të hapur po arrijnë gjithnjë e më shumë nivelin e lartë të aftësive kibernetike. Për shembull, organizata jofitimprurëse për sigurinë në inteligjencën artificiale, SaferAI, zbuloi së fundmi se GLM-5.2 e kompanisë kineze Z.ai ishte vetëm disa muaj pas GPT-5.5 të OpenAI dhe Claude Opus 4.7 të Anthropic.
Siç e tha themeluesi i Hacktron, Mohan Pedhapati, në lidhje me X: “IA po zvogëlon sasinë e ekspertizës së pakët të nevojshme për të zhvilluar shfrytëzime. Puna që dikur zgjaste me muaj, tani mund të zgjasë me ditë.”
