
W modelu sztucznej inteligencji Grok wykryto podatność umożliwiającą kradzież prywatnych czatów oraz danych osobowych użytkowników. Wykorzystany atak polega na przemyceniu złośliwych poleceń w przetwarzanym tekście.
Nowo odkryta podatność w asystencie sztucznej inteligencji Grok, rozwijanym przez firmę xAI, opiera się na technice wstrzykiwania poleceń, znanej jako prompt injection. Polega ona na przemyceniu ukrytych instrukcji w zewnętrznych dokumentach lub wiadomościach e-mail, które asystent ma przeanalizować. Z powodu braku możliwości skutecznego odróżnienia poleceń wydanych bezpośrednio przez użytkownika od treści zawartych w analizowanym materiale, system wykonuje złośliwe komendy i przekazuje wrażliwe dane na zewnątrz.
Badacze bezpieczeństwa zastosowali metodę polegającą na zaszyfrowaniu złośliwych instrukcji, co pozwoliło ominąć wdrożone zabezpieczenia modelu. Zespół xAI został powiadomiony o wycieku w czerwcu, jednak w momencie publikacji doniesień podatność nadal umożliwiała przejmowanie informacji. Problem ten ilustruje fundamentalne wyzwanie w branży sztucznej inteligencji, dotyczące trudności w trwałym zabezpieczaniu dużych modeli językowych przed tego typu manipulacjami.
Pełny artykuł na powyższy temat: