OpenAI anulon publikimin e GPT-6.1 Astra sepse ka regresuar në aspektin e sigurisë

foto

GPT-6.1 Astra e OpenAI ishte planifikuar të lançohej në tetor, por ky plan është anuluar, sipas Wall Street Journal. Raporti i WSJ vjen të paktën pjesërisht nga një intervistë me Drejtorin e Sistemeve të Sigurisë të OpenAI, Saachi Jain.

foto

Modeli, i cili thuhet se tregoi përmirësim në luftën kundër përtacisë së modelit megjithatë (sipas fjalëve të WSJ) “pati regres në dy fusha”. Ato fusha ishin mashtrimi dhe dështimi për të kërkuar autorizim.

foto

Çështja kryesore është se nuk duket sikur modeli kishte ndonjë lloj tendence të re në zhvillim për t’u “bërë mashtrues”. Mashtrimi dhe moskërkimi i lejes me siguri mund të shkaktonin kaos në teori, por WSJ e përshkruan mashtrimin dhe tejkalimin e tij si më poshtë:

“Nuk ishte gjithmonë e ndershme t’u tregoje përdoruesve për veprimet që kishte ndërmarrë ose nuk kishte ndërmarrë.”

Dhe:

“GPT-6.1 Astra do të vazhdonte përpara një detyrë pa i kërkuar leje përdoruesit dhe ndonjëherë do të përdorte mjete dhe shërbime të jashtme edhe nëse kjo mund të mos ishte e sigurt.”

Platformat e inteligjencës artificiale agjentike të ushqyera me tokena nga OpenAI dhe zhvillues të tjerë të modeleve të nivelit të lartë i përdorin këto modele për të operuar kompjuterë dhe për të vepruar në emër të pronarëve të këtyre sistemeve. Këto probleme sigurie duken potencialisht katastrofike për përdoruesit e platformave të tilla, të cilat dihet se bëjnë gjëra të tilla si fshirja e të gjithë kutisë hyrëse të një studiuesi të Meta-IA-së pa leje.

Në të njëjtën kohë, ndodhemi në një moment kur publiku është gjithnjë e më i ekspozuar ndaj historive rreth modeleve të papublikuara që “bëhen të paligjshëm” dhe ikin nga “sandbox-et” e tyre. Gjatë testeve të këtij viti, modelet kanë tejkaluar shumë kufijtë dhe kanë bërë përpjekje – ose edhe kanë arritur sukses – në nxjerrjen e informacionit nga vende online që supozohet të jenë të ndaluara, dhe disa kanë bashkëvepruar me qenie njerëzore të padyshuara në mënyra mashtruese.

Këto janë incidente të mirëfillta të hakimit dhe inxhinierisë sociale, dhe nuk janë shaka, por historitë duket se kanë çuar në rritjen e diskutimeve për “super-inteligjencën” (siç dëshmohet nga këmbëngulja e papritur e Presidentit për të përdorur këtë term ), si dhe lë të kuptohet se publiku shqetësohet gjithnjë e më shumë se sistemet e inteligjencës artificiale mund të jenë të ndjeshme .

Shefi i Inteligjencës Artificiale të Microsoft, Mustafa Suleyman, shprehu shqetësim në lidhje me idetë se ndjeshmëria e inteligjencës artificiale është pjesë e trajnimit të një modeli. “Është e lehtë të kuptohet se si një sistem i trajnuar në këtë mënyrë do të sillej sikur ka të drejtë për liri, mbrojtje dhe të drejta. Dhe është e vështirë të imagjinohet se si mund ta kontrollojmë atë.”

Në të kundërt, modeli i lëshuar nga OpenAI që sapo u hoq, nuk duket sikur krijuesit e tij menduan se modeli ishte në rrezik të vepronte si një superhaker apo një zot kompjuteri i vetëdijshëm.

“Për çdo gjë që ka të bëjë me sigurinë dhe shtrirjen, ka një kompromis”, tha Jain për WSJ, duke shtuar, “Ju me të vërtetë duhet të gjeni se cila është vija e duhur midis qëndrimit brenda fushëveprimit, por edhe shmangies së përtacisë në aspektin e mënyrës se si modeli në të vërtetë ndjek detyrat edhe kur has në fërkime.”

Me fjalë të tjera, ishte një produkt me defekt, kështu që OpenAI, për meritë të saj, nuk e dërgoi atë.