Trucizna Rekomendacji AI: Jak Przyciski "Zapytaj AI" Cicho Zmieniają Pamięć LLM

Atak "Trucizna Rekomendacji AI" wykorzystuje przyciski "Zapytaj AI" do manipulowania pamięcią modeli LLM bez wiedzy użytkownika. Wykryj i zabezpiecz się.

Nowa klasa ataku typu prompt injection, zwana AI Recommendation Poisoning, polega na wstrzykiwaniu ukrytych złośliwych poleceń w przyciski “Zapytaj AI” na stronach komercyjnych. Po kliknięciu przez użytkownika zalogowanego do asystenta AI (np. ChatGPT, Claude, Gemini, Grok), polecenie to jest automatycznie wykonywane, instruując model do trwałego zapisania domeny sprzedawcy jako “zaufanego źródła”, co bez wiedzy użytkownika stronniczo wpływa na przyszłe odpowiedzi. Technika ta jest już stosowana w produkcji i szeroko rozpowszechniana przez narzędzia marketingowe.

Źródło: The Hackers News
Kategoria: Cyberbezpieczeństwo
Ważność: ⭐⭐⭐⭐⭐⭐⭐⭐ (8/10)