← Zpět na AI Briefing
🔒 Bezpečnost 🔬 Výzkum ⏱ 4 min čtení 27. 5. 2026

Výzkumníci varují: prompt injection možná nejde opravit

Nová studie tvrdí, že náchylnost AI agentů k podvrženým instrukcím není chyba, kterou lze záplatovat, ale fundamentální vlastnost. Čím těsnější obrana, tím víc se rozbíjejí legitimní úlohy agenta.

Prompt injection, tedy útok, při kterém útočník schová instrukce do obsahu, jejž AI zpracovává, provází jazykové modely od začátku. Květnová studie s výmluvným názvem „AI Agents May Always Fall for Prompt Injections" ale posouvá debatu jinam: možná nejde o chybu, kterou jednou opravíme.

V čem je fundamentální problém

Jazykový model nemá oddělený kanál pro „důvěryhodné instrukce" a „nedůvěryhodná data". Všechno (systémový prompt, dotaz uživatele i obsah webové stránky, kterou agent právě čte) přichází jako text ve stejném okně. Autoři argumentují, že jde o neřešitelné dilema:

Proč to letos eskaluje

Dokud byl chatbot jen okno s konverzací, škoda z podvržené instrukce byla omezená. Agent roku 2026 ale čte e-maily, kliká na webu, spouští kód a posílá zprávy. Podvržená instrukce v jediné navštívené stránce může znamenat odeslaná data nebo provedený nákup.

Výrobci reagují vrstvenou obranou: sandboxy, potvrzování citlivých akcí uživatelem, oddělené kanály pro systémové instrukce. Konsenzus výzkumníků je ale střízlivý: riziko lze řídit, ne odstranit.

Co s tím jako uživatelé? Dávat agentům nejmenší nutná oprávnění, u citlivých akcí vyžadovat potvrzení a nikdy nespouštět agenta s přístupem k datům, jejichž únik si nemůžete dovolit.

Proč na tom záleží

Agenti dostávají přístup k e-mailům, penězům a firemním systémům. Pokud je jejich zranitelnost fundamentální, je bezpečnostní otázkou číslo jedna, JAKÁ oprávnění agentům dáváme, ne jestli je AI „dost chytrá".

Zdroje a další čtení

👁 860 zobrazení Zpět na AI Briefing →

Další k tématu

5. 9. 2026

GPT-6 Astra překročil „kritickou" hranici kyberschopností. Poprvé v historii

4. 8. 2026

OpenAI, Anthropic a Google jednaly v Bílém domě o testování bezpečnosti AI

30. 7. 2026

88 % firemních AI agentů nikdy nedojde do produkčního provozu