Odkryto lukę w sposobie, w jaki OpenAI, Anthropic i Google przekazywały ukryte rozumowanie AI między wywołaniami API, co pozwoliło badaczom odzyskać wewnętrzne procesy decyzyjne i sekrety z logów sesji, w tym klucze API i hasła. Słabość ta dotyczyła szyfrowanych obiektów rozumowania, które mogły być powielane w innych sesjach i nawet przekazywane słabszym modelom w tej samej rodzinie dostawcy, aby wydobyć ukryte treści, takie jak klucze API i hasła, co otwierało nowe ścieżki ataków, w tym dystylację modeli i ekstrakcję danych.
Źródło: The Hackers News
Kategoria: Cyberbezpieczeństwo
Ważność: ⭐⭐⭐⭐⭐⭐⭐⭐ (8/10)