INTEGRITY Документация

Guardrails

Guardrails помогает безопасно развёртывать AI-приложения, перехватывая и оценивая как промпты пользователей, так и ответы моделей на предмет вредоносного содержимого. Выступая в роли прокси между вашим приложением и провайдеры моделей (например, OpenAI, Anthropic, DeepSeek и другие), Guardrails в AI Gateway обеспечивают единообразную и безопасную работу во всей вашей AI-экосистеме.

Guardrails проактивно отслеживает взаимодействия между пользователями и AI-моделями, предоставляя вам:

Демонстрационное видео

Как работают Guardrails

AI Gateway проверяет все взаимодействия в реальном времени, оценивая содержимое по заранее заданным параметрам безопасности. Guardrails работают следующим образом:

  1. Перехват взаимодействий: AI Gateway проксирует запросы и ответы, находясь между пользователем и моделью ИИ.

  2. Проверка содержимого:

    • Промпты пользователей: AI Gateway проверяет промпты на соответствие параметрам безопасности (например, насилие, ненависть или контент сексуального характера). В зависимости от ваших настроек промпты могут быть помечены или заблокированы до того, как достигнут модели.
    • Ответы модели: после обработки ответ ИИ-модели проверяется. Если обнаружен опасный контент, он может быть помечен или заблокирован до того, как будет доставлен пользователю.
  3. Применение действий: В зависимости от настроек, помеченный контент логируется для проверки, а заблокированный контент не пропускается дальше.