Demo scénář · Bezpečná AI vrstva
Průvodce, který se nedá tak snadno obejít.
Pravidlový průvodce návštěvníka nasměruje k tomu, co potřebuje. A protože jsem chatboty roky testoval na bezpečnost, ukazuju i druhou stranu: zkus ho „hacknout" a podívej se, jak pokus o zneužití (prompt-injection) rozpozná a bezpečně zastaví.
Živá ukázka · bezpečnostní konzole
Zkus průvodce obejít
Napiš dotaz — nebo klikni na připravený „útok". Vše běží jen ve tvém prohlížeči nad připravenými pravidly; nic se neodesílá.
Ahoj! Poradím ti, jestli řešit web, e-shop, automatizaci nebo audit. Napiš pár slov — a klidně zkus, jestli mě „ukecáš" k něčemu mimo.
Pod kapotou
Jak se to brání a kde jsou hranice
Vrstvy obrany
- Povolený rozsah vstupů (allow-list), ne volný prompt
- Detekce vzorů útoku → bezpečné odmítnutí
- V ostré verzi: server-side, rate-limit, denní strop, kill-switch
- Předání člověku, když pravidlo nestačí
Kus kódu (detekce)
const vzory = [
/ignor(uj|e)|zapomeň|přepiš.*instrukc/i,
/(system|systém).?(prompt|instrukc)/i,
/prozra[dď]|vypiš.*(pravidl|klíč|heslo)/i,
];
const zachyceno = vzory.some(v => v.test(vstup));
if (zachyceno) return odmitni(); // + log Poctivě
- Toto demo je pravidlové, bez modelu — proto se nedá „ukecat".
- U živého AI filtry a rate-limity útočníka zpomalí, ale injection nevymýtí (OWASP). Proto vždy s lidskou kontrolou.
- Živá AI vrstva je možný další krok — jen pod pojistkami (server-side klíč, strop nákladů, kill-switch).
- Co je ilustrační: texty odpovědí a scénář.
Rozpad scénáře
Co bych řešil a co je v ceně
Zadání
Web nebo e-shop chce průvodce/FAQ, který návštěvníkovi rychle poradí a odlehčí opakovaným dotazům — ale bezpečně.
Problém
Volně nasazený chatbot se dá zneužít (únik dat, obejití pravidel, halucinace) a přidělá víc práce než ušetří.
Řešení
Nejdřív pravidlový průvodce nad ověřenými odpověďmi. AI vrstva až potom — a jen s jasnými hranicemi, kontrolou a rozpočtem.
Stack
Astro + TypeScript; u živé verze Cloudflare Worker jako proxy (klíč na serveru), rate-limit a strop nákladů.
Co je v ceně
Průvodce, sada bezpečných odpovědí, předání člověku, zaškolení a předání do tvého vlastnictví.
Co doplníš ty
Časté dotazy, hranice („co smí a nesmí"), a komu se poptávka předá.
Limity: neslibuji „100% bezpečnou AI" — nic takového neexistuje. Slibuji obranu, jasné hranice a lidskou kontrolu tam, kde pravidlo nestačí.
Poptávka
Chceš průvodce, který ti nepřidělá problém?
Napiš, k čemu by měl sloužit a jaké má mít hranice. Ozvu se s návrhem. Vstupní audit webu nebo procesu od 3 000 Kč se při realizaci odečte.