← Cloudflare AI Gateway / ai-gateway / features
Guardrails
Guardrails vám pomáhají bezpečně nasazovat AI aplikace tím, že zachycují a vyhodnocují jak uživatelské prompty, tak odpovědi modelů z hlediska škodlivého obsahu. Fungují jako proxy mezi vaší aplikací a poskytovatelé modelů (jako OpenAI, Anthropic, DeepSeek a další), Guardrails v rámci AI Gateway zajišťuje konzistentní a bezpečné prostředí v celém vašem AI ekosystému.
Guardrails proaktivně monitorují interakce mezi uživateli a AI modely a poskytují vám:
- Konzistentní moderování: Jednotná vrstva moderování fungující napříč modely a poskytovateli.
- Vyšší bezpečnost a důvěra uživatelů: Proaktivně chraňte uživatele před škodlivými nebo nevhodnými interakcemi.
- Flexibilita a kontrola nad povoleným obsahem: Určete, které kategorie chcete sledovat, a zvolte mezi označením nebo přímým blokováním.
- Možnosti auditu a dodržování předpisů: Získávejte aktuální informace o vyvíjejících se regulačních požadavcích díky protokolům promptů uživatelů, odpovědí modelu a vynucených guardrails.
Ukázkové video
Jak fungují Guardrails
AI Gateway kontroluje všechny interakce v reálném čase tak, že obsah porovnává s předdefinovanými bezpečnostními parametry. Guardrails přitom postupují takto:
-
Zachytávání interakcí: AI Gateway funguje jako proxy pro požadavky a odpovědi a stojí mezi uživatelem a AI modelem.
-
Kontrola obsahu:
- Uživatelské prompty: AI Gateway kontroluje prompty podle bezpečnostních parametrů (například násilí, nenávist nebo sexuální obsah). Podle vašeho nastavení mohou být prompty před doručením modelu označeny nebo zablokovány.
- Odpovědi modelu: Po zpracování se odpověď modelu AI zkontroluje. Pokud je zjištěn nebezpečný obsah, může být před doručením uživateli označena nebo zablokována.
-
Uplatňování akcí: V závislosti na konfiguraci se označený obsah zaznamená k přezkoumání, zatímco blokovaný obsah se dále nezpracuje.