OpenAI ngadalëson publikimin e modelit Astra, duke përmendur aftësitë kibernetike

foto

OpenAI “nuk mund ta përjashtojë” që modeli i saj i ardhshëm Astra të ketë aftësi kibernetike “kritike”, një përcaktim që e ka shtyrë kompaninë të zgjerojë testimet e sigurisë dhe të ndalojë aktivitetet e brendshme që nuk plotësojnë kërkesat më të rrepta të sigurisë, tha OpenAI për Axios first të premten.

foto

Është shenja e fundit e përparimit të shpejtë të aftësive kibernetike nga modelet e IA-së, pasi të tjerët punuan në mënyrë autonome jashtë testimit të sandbox-eve dhe mbrojtjeve.

foto

OpenAI tha se “nuk mund të përjashtojmë aftësitë kritike kibernetike” pasi kreu vlerësime të brendshme të Astra-s, një nga modelet e saj të ardhshme.

OpenAI do të rrisë testimet dhe sigurinë rreth tij para çdo publikimi dhe do të ngadalësojë zhvillimin në Astra derisa të ketë në vend masat e duhura mbrojtëse, siç kërkohet nga kuadri i gatishmërisë së kompanisë, i botuar për herë të parë në vitin 2023.

Astra nuk ishte e përfshirë në shfrytëzimet e Hugging Face, tha kompania.

Ndërsa koha e publikimit të modelit ishte e paqartë, me këtë pauzë në zhvillimin e tij, çdo publikim i ardhshëm mund të vonohej.

“OpenAI informoi vullnetarisht administratën për planet e tyre për të shtyrë publikimin”, tha një zyrtar i Shtëpisë së Bardhë.

Kjo mund të jetë hera e parë që një laborator i inteligjencës artificiale në nivel të lartë është zotuar të ngadalësojë progresin në një nga modelet e veta të inteligjencës artificiale për shkak të shqetësimeve kibernetike.

Anthropic më parë ishte zotuar të ndalonte trajnimin e modeleve të fuqishme nëse aftësitë tejkalonin aftësinë e kompanisë për t’i kontrolluar ato.

Por laboratori i IA-së e anuloi këtë në një përditësim të Politikës së tij të Shkallëzimit të Përgjegjshëm në shkurt të këtij viti.

“Nëse një zhvillues i inteligjencës artificiale do të ndalonte zhvillimin për të zbatuar masa sigurie, ndërsa të tjerët do të ecnin përpara duke trajnuar dhe vendosur sisteme të inteligjencës artificiale pa zbutje të forta, kjo mund të rezultojë në një botë më pak të sigurt”, thuhet në kuadër.

Njoftimi vjen ndërsa administrata Trump punon për të zhvilluar një proces për vlerësimin e modeleve të inteligjencës artificiale para publikimit të tyre.

Industri të caktuara u informuan mbi një kornizë këtë javë, por ka ende shumë pyetje pa përgjigje për kompanitë.

Për shembull, si të angazhohet qeveria, sa kohë do të zgjasë procesi i shqyrtimit, çfarë shpresojnë të mësojnë qeveria dhe industria prej tij.

Gjithashtu: kush ka qasje në ose i shqyrton modelet.

Ajo që përbën rrezik të mjaftueshëm kombëtar dhe modelet më të fundit u operacionalizua në kuadër, por nuk u përcaktua.

Laboratori konkurrues i inteligjencës artificiale, Anthropic, publikoi në qershor një version më të sigurt të modelit të tij më të aftë në aspektin kibernetik, Mythos.

Dianne Penn, drejtuesja e menaxhimit të produkteve, kërkimit dhe laboratorëve në Anthropic, i tha Axios gjatë lançimit se kompania po ishte “qëllimisht më konservatore” me atë publikim.

Anthropic paralajmëroi për modelet që përmirësoheshin vetë në një blog të kompanisë në qershor, i cili gjithashtu bëri thirrje për një pauzë globale në zhvillimin e inteligjencës artificiale.

Më herët këtë javë në konferencën e sigurisë kibernetike Black Hat, anëtarët e stafit teknik të OpenAI thanë se kompania po ngadalësonte testimet ndërsa punonte për përmirësimin e praktikave të saj të sigurisë.

Në postimin në blog të së premtes, OpenAI tha se ka filluar të zbatojë kontrolle më të rrepta sigurie për testimin, duke përfshirë mjedise të izoluara testimi dhe monitorim universal në të gjitha aplikacionet agjentike të Astra-s.

OpenAI ka filluar “të ngadalësojë me vetëdije kërkimin për të rritur sigurinë”, tha Michael Dalton, një anëtar i stafit teknik të OpenAI, gjatë një prezantimi.

Në fund të fundit: modelet e inteligjencës artificiale po bëhen më të mira dhe më të afta kibernetike më shpejt sesa po formalizohet rregullorja rreth përdorimit të tyre.