Luka w API OpenAI, Anthropic i Google pozwalała słabszym modelom AI odczytywać rozumowanie silniejszych modeli

Nowa luka w API OpenAI, Anthropic i Google pozwalała odzyskiwać sekrety, klucze API i hasła z logów sesji modeli AI. Odkryto 4 ścieżki ataków.

Odkryto lukę w sposobie, w jaki OpenAI, Anthropic i Google przekazywały ukryte rozumowanie AI między wywołaniami API, co pozwoliło badaczom odzyskać wewnętrzne procesy decyzyjne i sekrety z logów sesji, w tym klucze API i hasła. Słabość ta dotyczyła szyfrowanych obiektów rozumowania, które mogły być powielane w innych sesjach i nawet przekazywane słabszym modelom w tej samej rodzinie dostawcy, aby wydobyć ukryte treści, takie jak klucze API i hasła, co otwierało nowe ścieżki ataków, w tym dystylację modeli i ekstrakcję danych.

Źródło: The Hackers News
Kategoria: Cyberbezpieczeństwo
Ważność: ⭐⭐⭐⭐⭐⭐⭐⭐ (8/10)