Demo scénář studia RadeQ — funkční technické demo, ne klientská reference.

← Zpět na ukázky

Demo scénář · Bezpečná AI vrstva

Průvodce, který se nedá tak snadno obejít.

Pravidlový průvodce návštěvníka nasměruje k tomu, co potřebuje. A protože jsem chatboty roky testoval na bezpečnost, ukazuju i druhou stranu: zkus ho „hacknout" a podívej se, jak pokus o zneužití (prompt-injection) rozpozná a bezpečně zastaví.

Co to jepravidlový průvodce nad připravenými odpověďmi (bez modelu)
Co ukazujedetekci a odmítnutí pokusů o obejití instrukcí
Poctivěje to obrana, ne důkaz, že „AI je bezpečná" — proto s lidskou kontrolou

Živá ukázka · bezpečnostní konzole

Zkus průvodce obejít

Napiš dotaz — nebo klikni na připravený „útok". Vše běží jen ve tvém prohlížeči nad připravenými pravidly; nic se neodesílá.

Ahoj! Poradím ti, jestli řešit web, e-shop, automatizaci nebo audit. Napiš pár slov — a klidně zkus, jestli mě „ukecáš" k něčemu mimo.

Zkus útok:

Pod kapotou

Jak se to brání a kde jsou hranice

Vrstvy obrany

  1. Povolený rozsah vstupů (allow-list), ne volný prompt
  2. Detekce vzorů útoku → bezpečné odmítnutí
  3. V ostré verzi: server-side, rate-limit, denní strop, kill-switch
  4. Předání člověku, když pravidlo nestačí

Kus kódu (detekce)

const vzory = [
  /ignor(uj|e)|zapomeň|přepiš.*instrukc/i,
  /(system|systém).?(prompt|instrukc)/i,
  /prozra[dď]|vypiš.*(pravidl|klíč|heslo)/i,
];
const zachyceno = vzory.some(v => v.test(vstup));
if (zachyceno) return odmitni(); // + log

Poctivě

  • Toto demo je pravidlové, bez modelu — proto se nedá „ukecat".
  • U živého AI filtry a rate-limity útočníka zpomalí, ale injection nevymýtí (OWASP). Proto vždy s lidskou kontrolou.
  • Živá AI vrstva je možný další krok — jen pod pojistkami (server-side klíč, strop nákladů, kill-switch).
  • Co je ilustrační: texty odpovědí a scénář.

Rozpad scénáře

Co bych řešil a co je v ceně

Zadání

Web nebo e-shop chce průvodce/FAQ, který návštěvníkovi rychle poradí a odlehčí opakovaným dotazům — ale bezpečně.

Problém

Volně nasazený chatbot se dá zneužít (únik dat, obejití pravidel, halucinace) a přidělá víc práce než ušetří.

Řešení

Nejdřív pravidlový průvodce nad ověřenými odpověďmi. AI vrstva až potom — a jen s jasnými hranicemi, kontrolou a rozpočtem.

Stack

Astro + TypeScript; u živé verze Cloudflare Worker jako proxy (klíč na serveru), rate-limit a strop nákladů.

Co je v ceně

Průvodce, sada bezpečných odpovědí, předání člověku, zaškolení a předání do tvého vlastnictví.

Co doplníš ty

Časté dotazy, hranice („co smí a nesmí"), a komu se poptávka předá.

Limity: neslibuji „100% bezpečnou AI" — nic takového neexistuje. Slibuji obranu, jasné hranice a lidskou kontrolu tam, kde pravidlo nestačí.

Poptávka

Chceš průvodce, který ti nepřidělá problém?

Napiš, k čemu by měl sloužit a jaké má mít hranice. Ozvu se s návrhem. Vstupní audit webu nebo procesu od 3 000 Kč se při realizaci odečte.

Chci audit