← Cloudflare AI Gateway / ai-gateway / features
Guardrails
Guardrails помогает безопасно развёртывать AI-приложения, перехватывая и оценивая как промпты пользователей, так и ответы моделей на предмет вредоносного содержимого. Выступая в роли прокси между вашим приложением и провайдеры моделей (например, OpenAI, Anthropic, DeepSeek и другие), Guardrails в AI Gateway обеспечивают единообразную и безопасную работу во всей вашей AI-экосистеме.
Guardrails проактивно отслеживает взаимодействия между пользователями и AI-моделями, предоставляя вам:
- Единообразная модерация: Единый уровень модерации, работающий для всех моделей и провайдеров.
- Повышенная безопасность и доверие пользователей: Заблаговременно защищайте пользователей от вредоносных или недопустимых взаимодействий.
- Гибкость и контроль над разрешённым контентом: Укажите категории для мониторинга и выберите между пометкой и полной блокировкой.
- Возможности аудита и соответствия требованиям: Получайте обновления об изменяющихся нормативных требованиях, а также журналы промптов пользователей, ответов модели и примененных политик Guardrails.
Демонстрационное видео
Как работают Guardrails
AI Gateway проверяет все взаимодействия в реальном времени, оценивая содержимое по заранее заданным параметрам безопасности. Guardrails работают следующим образом:
-
Перехват взаимодействий: AI Gateway проксирует запросы и ответы, находясь между пользователем и моделью ИИ.
-
Проверка содержимого:
- Промпты пользователей: AI Gateway проверяет промпты на соответствие параметрам безопасности (например, насилие, ненависть или контент сексуального характера). В зависимости от ваших настроек промпты могут быть помечены или заблокированы до того, как достигнут модели.
- Ответы модели: после обработки ответ ИИ-модели проверяется. Если обнаружен опасный контент, он может быть помечен или заблокирован до того, как будет доставлен пользователю.
-
Применение действий: В зависимости от настроек, помеченный контент логируется для проверки, а заблокированный контент не пропускается дальше.