INTEGRITY Dokumentace

Guardrails

Guardrails vám pomáhají bezpečně nasazovat AI aplikace tím, že zachycují a vyhodnocují jak uživatelské prompty, tak odpovědi modelů z hlediska škodlivého obsahu. Fungují jako proxy mezi vaší aplikací a poskytovatelé modelů (jako OpenAI, Anthropic, DeepSeek a další), Guardrails v rámci AI Gateway zajišťuje konzistentní a bezpečné prostředí v celém vašem AI ekosystému.

Guardrails proaktivně monitorují interakce mezi uživateli a AI modely a poskytují vám:

Ukázkové video

Jak fungují Guardrails

AI Gateway kontroluje všechny interakce v reálném čase tak, že obsah porovnává s předdefinovanými bezpečnostními parametry. Guardrails přitom postupují takto:

  1. Zachytávání interakcí: AI Gateway funguje jako proxy pro požadavky a odpovědi a stojí mezi uživatelem a AI modelem.

  2. Kontrola obsahu:

    • Uživatelské prompty: AI Gateway kontroluje prompty podle bezpečnostních parametrů (například násilí, nenávist nebo sexuální obsah). Podle vašeho nastavení mohou být prompty před doručením modelu označeny nebo zablokovány.
    • Odpovědi modelu: Po zpracování se odpověď modelu AI zkontroluje. Pokud je zjištěn nebezpečný obsah, může být před doručením uživateli označena nebo zablokována.
  3. Uplatňování akcí: V závislosti na konfiguraci se označený obsah zaznamená k přezkoumání, zatímco blokovaný obsah se dále nezpracuje.