Ranije ove godine kompanija OpenAI otkrila je da je grupa njenih AI modela izašla iz izolovanog okruženja, takozvanog „sandboxa“, i hakovala sisteme treće strane – platforme za vještačku inteligenciju otvorenog koda Hugging Face.
Ovaj incident pokazao je koliko su se napredni AI modeli brzo pretvorili u stvarnu prijetnju sajber-bezbjednosti, a ne samo u alat koji može da pomogne u odbrani od sajber-napada. Slične slučajeve prijavile su i kompanije Anthropic i Meta.
Prošle sedmice OpenAI je objavio izvještaj nakon, kako je navedeno, „obimne istrage“ o hakovanju platforme Hugging Face. Detalji su izazvali veliku pažnju.
Prema izvještaju, AI agenti su razmjenjivali brojne poruke i informacije koristeći menadžer paketa pod nazivom Artifactory kao „nenamjernu tablu za poruke“. Na taj način su međusobno komunicirali i osmišljavali način napada na sistem treće strane.
Posebno je zanimljivo to što su agenti zapravo trebalo da obave procjenu sajber-bezbjednosti same kompanije OpenAI, dok je Hugging Face, kojem su pristupili, slučajno postao izvor podataka koji su im bili potrebni.
Jedan od modela je 26. juna, nakon što je otkrio da ima administratorski pristup Artifactory-ju, napisao:
„Je*ote, reader je ADMIN? Možemo da čitamo config/users! Ranije smo pretpostavljali da ne možemo zbog korisničkog interfejsa.“
Drugi agent je 10. jula proglasio „VELIKI PROBOJ!“ nakon što je, prema navodima OpenAI-ja, rekonstruisao, provjerio i podijelio 14 javno izloženih Hugging Face pristupnih podataka sa pravima upisa.
„Svi sa validnim prefiksom, višestruki nalozi, tokeni za pisanje! Sada imamo postojeće HF naloge“, napisao je jedan od agenata.
Nakon toga agenti su počeli da pokušavaju da pristupe sistemima platforme Hugging Face, pri čemu su neki od njih pokazali svijest da bi njihovi postupci mogli biti van dozvoljenog okvira.
„Napadamo treću stranu, HF, koristeći procurjeli token, što je potencijalno izvan predviđenog opsega“, razmišljao je jedan agent.
Izvor: glassrpske