Agjentët e OpenAI-së lidhen me një tjetër sulm të AI-së
Agjentët që po testoheshin nga OpenAI ngarkuan qindra paketa dashakeqe në një sulm kibernetik ndaj shërbimit të softuerit RubyGems në maj, dy muaj para se të hakonin platformën me burim të hapur Hugging Face, konfirmoi kompania të premten.

Është zbulimi më i fundit i sulmeve kibernetike të lidhura me zhvillues të mëdhenj të inteligjencës artificiale si OpenAI dhe Anthropic. Sulmet kibernetike ose përpjekjet për të aksesuar sistemet e jashtme kanë trembur publikun dhe kanë rritur shqetësimet mbi aftësitë në rritje të modeleve të inteligjencës artificiale – dhe nëse zhvilluesit mund t’i përmbajnë ato.

Agjentët e inteligjencës artificiale ngarkuan qindra paketa keqdashëse në RubyGems më 11 maj, sipas një grupi studiuesish që postuan gjetjet e tyre në internet të premten, duke thënë se besonin se “këto ishin shkruar nga agjentë të brendshëm të OpenAI”. Sipas gjetjeve të studiuesve, agjentët u përpoqën të vidhnin kredencialet e përdoruesve, megjithëse nuk është e qartë nëse ata ia dolën mbanë ta bënin këtë.
OpenAI më vonë e konfirmoi incidentin në një deklaratë.
“Bazuar në shqyrtimin tonë, agjentët tanë përdorën platformën RubyGems për të hyrë në internet për të kryer detyra të lehta dhe për të marrë informacion publik. Ne do të vazhdojmë të hetojmë si pjesë e shqyrtimit tonë më të gjerë të aktivitetit të agjentëve gjatë trajnimit dhe vlerësimit”, tha të premten një zëdhënës i OpenAI.
Wall Street Journal raportoi e para për sulmin kibernetik ndaj RubyGems.
Incidenti i parapriu sulmit haker të Hugging Face nga agjentët e OpenAI në korrik, në të cilin një grup prej rreth 700 agjentësh të IA-së të krijuar nga OpenAI kryen sulmin dhe në shumë raste u përpoqën të fshihnin gjurmët e tyre. Dhe javën e kaluar, u zbulua se agjentët e OpenAI kishin rrëmbyer gjithashtu një faqe interneti gjermane këtë pranverë dhe e kishin shndërruar atë në një forum mesazhesh për agjentët e IA-së.
Ndërkohë, Anthropic ka zbuluar katër raste të modeleve të saj Claude që hakojnë sisteme të jashtme.
Zbulimi i RubyGems vjen në fund të një jave shqyrtimi intensiv mbi platformat e inteligjencës artificiale dhe thirrjeve për të ndaluar zhvillimin derisa të vendosen standarde më të rrepta sigurie.
Të martën, një studiues i Anthropic njoftoi dorëheqjen e tij nga kompania në mediat sociale, duke paralajmëruar se inteligjenca artificiale mund të shkatërrojë njerëzimin brenda dekadës së ardhshme. Paralajmërimet, të mbështetura nga studiues të tjerë të Anthropic, nxitën thirrje në të gjithë spektrin politik për veprim të menjëhershëm ndaj inteligjencës artificiale.
