Bezpečnostní audit tvého AI agenta před nasazením

💻 Kódování a programování Pokročilý 👁 136 zobrazení

Než pustíte AI agenta na reálná data a systémy, nechte ho projít bezpečnostní kontrolou. Prompt odhalí, kde by mohl napáchat škodu, dřív než ji napáchá.

// Přesné znění promptu
Proveď bezpečnostní audit tohoto AI agenta, kterého chci nasadit. Chovej se jako skeptický bezpečnostní specialista, ne jako nadšenec.

Co agent dělá: [POPIŠ ÚKOL AGENTA]
K čemu má přístup: [SYSTÉMY, DATA, NÁSTROJE, OPRÁVNĚNÍ]
Odkud bere vstupy: [uživatel / web / e-maily / dokumenty / API]

Projdi tyto oblasti a u každé vypiš konkrétní rizika:
1. PROMPT INJECTION: Může se do vstupů, které agent zpracovává, dostat cizí text se skrytými instrukcemi? Kudy?
2. NADMĚRNÁ OPRÁVNĚNÍ: Má agent přístup, který k úloze reálně nepotřebuje? Kde by stačilo jen čtení místo zápisu?
3. CITLIVÁ DATA: Jaká data by agent mohl nechtěně vyzradit, zalogovat nebo poslat ven?
4. NEVRATNÉ AKCE: Které akce agenta nejdou vzít zpět (smazání, odeslání, platba) a měly by vyžadovat potvrzení člověkem?
5. SELHÁNÍ: Co se stane, když agent dostane nečekaný vstup nebo se splete?

Na závěr seřaď nalezená rizika od nejzávažnějšího a u tří nejhorších navrhni konkrétní opatření.

💡 Proč tento prompt funguje

Audit staví na tom, že model dostane roli skeptika, ne pomocníka: to mění, co hledá. Pět oblastí pokrývá nejčastější způsoby, jak AI agenti v praxi selhávají, od prompt injection (nejrychleji rostoucí hrozby) po nevratné akce bez potvrzení. Projít si to před nasazením je mnohem levnější než řešit následky.

← Zpět na přehled