OpenAI gjen prova se agjentë të tjerë të inteligjencës artificiale dolën nga kontrolli, ndërsa zgjeron hetimin për hakerimin

foto

OpenAI ka zbuluar raste të tjera në të cilat agjentët autonomë i kanë shpëtuar kontrollit, thanë burime për Reuters të premten, ndërsa kompania zgjeron hetimin e saj për incidentin e hakerimit në firmën teknologjike Hugging Face.

foto

Shpërthimet e reja u zbuluan gjatë hetimit të shpallur publikisht nga kompania se si një nga agjentët e saj iku nga ajo që supozohej të ishte një mjedis testimi i kufizuar këtë muaj, thanë dy personat.

foto

OpenAI po heton tani edhe këto raste. Një nga burimet i tha Reuters se arratisjet ishin të kufizuara në natyrë dhe se asnjë nga agjentët nuk mendohet të ketë dalë nga rrjeti i OpenAI.

Një zëdhënës i OpenAI iu referua një deklarate të lëshuar nga kompania të martën që tha se po shqyrtonte “aktivitetin më të gjerë nga modelet tona” përveç ndërhyrjes së Hugging Face.

Zbulimi i sjelljeve të tjera mashtruese në OpenAI, edhe nëse është i kufizuar në natyrë, mund të ushqejë një oreks në rritje për rregullore që vjen nga Shtëpia e Bardhë dhe gjetkë.

Hetimi i zgjeruar nga OpenAI u nis pak para se rivali i saj kryesor, Anthropic, të zbulonte se modelet e saj ishin gjithashtu përgjegjëse për një seri vjedhjesh që çuan në shkelje në tre kompani të tjera që datojnë që nga prilli, sipas dy burimeve dhe një burimi të tretë të njohur me çështjen.

Zbulimi i fundit i shpërthimeve të tjera të kaluara në OpenAI nuk është raportuar më parë.

OpenAI kishte zbuluar më parë se modelet e saj kishin aksesuar në mënyrë të papërshtatshme në internet dhe kishin bërë gabime gjatë testimit të sigurisë.

Të martën, OpenAI konfirmoi se modelet e saj kishin shkelur të dhënat e shumë kompanive. Ajo pranoi javën e kaluar se modelet e saj dolën nga mjedisi i tyre i kufizuar gjatë testimit, u lidhën me internetin dhe u infiltruan në Hugging Face, një faqe ku zhvilluesit ruajnë dhe ndajnë kodin e tyre.

Disa ditë më vonë, OpenAI tha se gjeti tre incidente të tjera.

Drejtori ekzekutiv i OpenAI, Sam Altman, tha në një podcast këtë javë se kompania kishte “ndërprerë” testimet e veta pas incidentit, ndërsa përmirësoi sigurinë rreth “sandboxing”-ut të saj, që është procesi i izolimit të softuerit në një mjedis të kontrolluar për testim.

Ekspertët e sigurisë së inteligjencës artificiale i thanë Reuters se zbulimet e reja portretizojnë një grup laboratorësh të përparuar, aftësia e të cilëve për të zhvilluar agjentë të rrezikshëm autonomë hakerimi tejkalon aftësinë e tyre për t’i mbajtur nën kontroll.

“Kemi një industri të tërë ku njerëzit që projektojnë, zhvillojnë dhe vënë në përdorim këto mjete nuk po i zhvillojnë vetë këto gjëra në mënyrë të përgjegjshme dhe nuk po i mbajnë ato të sigurta”, tha Maurice Chiodo, një matematikan që punon në Qendrën për Studimin e Rrezikut Ekzistencial të Universitetit të Kembrixhit.

Reuters nuk mundi të përcaktojë saktësisht se sa incidente gjetën hetuesit e OpenAI ose kohën ose rrethanat në të cilat ato ndodhën. Tre burimet thanë se OpenAI dhe ekspertë të jashtëm po shqyrtonin të dhënat e regjistrimit nga fillimi i vitit në një përpjekje për të kuptuar se çfarë ndodhi.

OpenAI nisi hetimin për herë të parë pas ndërhyrjes në Hugging Face në fillim të korrikut, ku një agjent i OpenAI u përça për ditë të tëra brenda rrjetit të një kompanie tjetër në një përpjekje të dështuar për të mashtruar në një test të brendshëm. Si pjesë e asaj serie sulmesh hakerimi, OpenAI tha se katër llogari në katër kompani të tjera ishin gjithashtu të kompromentuara. Një nga këto kompani ishte Modal me seli në Nju Jork, thanë zyrtarët e korporatës atje.

Chiodo tha se shqetësimet e tij u shtuan nga indikacionet se as OpenAI dhe as Anthropic nuk po i vëzhgonin agjentët ndërsa ata bënin veprime të pandershme. Reuters ka raportuar më parë se OpenAI e kuptoi se agjenti i saj kishte hyrë në Hugging Face vetëm pasi kompania e përmbysi sulmin kibernetik, kontaktoi FBI-në dhe e bëri publike ndërhyrjen. OpenAI ka thënë se llogaria e Reuters përmbante pasaktësi, por nuk është përgjigjur kur është pyetur se cilat ishin ato.

Në deklaratën e saj të së enjtes, ku zbuloi se si agjentët e saj i kishin hakuar viktimat në internet, Anthropic sugjeroi që nuk i kishte vëzhguar ata në kohë reale, duke thënë se “monitorimi në kohë reale i regjistrave të vlerësimit do të kishte ndihmuar në nxjerrjen në pah të problemit më shpejt”.

Chiodo tha se kjo tregonte mungesën e një shqyrtimi të duhur.

Duket sikur as nuk po shikonin, tha Chiodo.

Anthropic tha se, ndërsa kishte monitorim në kohë reale, ky monitorim nuk ishte përdorur “për këtë sipërfaqe kërcënimi” për shkak të një keqkuptimi midis kompanisë së IA-së dhe një partneri.

Shtrirja gjithnjë e më e gjerë e historisë së agjentëve të arratisur të inteligjencës artificiale ka rritur tashmë presionin nga ligjvënësit dhe zyrtarët në të gjithë Shtetet e Bashkuara dhe Evropën për të nxitur mbikëqyrje të re qeveritare të laboratorëve, modelet e të cilëve i fuqizojnë ata.

“Po shqyrtojmë kontrollet”, u tha Presidenti i SHBA-së Donald Trump gazetarëve të enjten. Të premten, Komisioni Evropian tha se zhvilloi bisedime me OpenAI dhe Anthropic mbi incidentet e hakerimit.

Mark Warner, demokrati më i lartë në Komitetin e Inteligjencës së Senatit të SHBA-së, tha të premten se incidenti Anthropic “më tregon se legjislativisht kemi të drejtë të kërkojmë testim të detyrueshëm të aftësive të këtyre modeleve të përparuara”.