Môžu byť ukradnuté skryté úvahy od GPT, Claude a Gemini?

Môžu byť ukradnuté skryté úvahy GPT, Claude a Gemini? Výskumníci zistili spôsob extrahovania skrytých úvah z jazykových modelov, čo otvára dvere k rizikám pre súkromie a bezpečnosť. Je možné obnoviť osobný údaj a prihlasovacie údaje!

Môžu byť ukradnuté skryté úvahy od GPT, Claude a Gemini?
Photo by Steve A Johnson/Unsplash

Nedávno sa objavila znepokojivá správa: výskumníci zistili spôsob, ako extrahovať skryté úvahy (tzv. chain of thought) z jazykových modelov spoločností OpenAI, Anthropic a Google – a to bez prelomenia šifrovania! Znie to neuveriteľne, ale je to tak. Táto nová metóda otvára dvere k potenciálnym rizikám pre súkromie a bezpečnosť pri používaní AI nástrojov. V tomto článku sa pozrieme na podrobnosti tejto zaujímavej (a trochu desivej) situácie, vysvetlíme si, ako to funguje, a zhodnotíme dôsledky pre používateľov.

Ako to vlastne funguje?

Jazykové modely ako GPT, Claude a Gemini neukazujú všetky kroky svojho uvažovania pri generovaní odpovede. Namiesto toho posielajú späť „opaque block“ (nepriehľadný blok) s dlhou reťazou úvah, ktorá zostáva skrytá. Tento postup umožňuje modelom udržiavať kontext rozhovoru bez odhaľovania všetkých detailov.

Mastodon