Описание
DKnownAI Guard — это специализированный API безопасности AI-агентов, который сосредоточен на обнаружении инъекций команд, попыток jailbreak и извлечения системных подсказок. Он предназначен для защиты AI-агентов, выполняющих действия, обеспечивая их безопасность от манипуляций при эффективной работе. API классифицирует запросы на четыре различных категории риска: AGENT_HACK, SYS_FLAG, CONTENT_FLAG и SAFE. Эта система классификации позволяет разработчикам адекватно реагировать на различные типы запросов, повышая безопасность агентных рабочих процессов.
Основная функциональность DKnownAI Guard сосредоточена на его способности обнаруживать попытки манипуляции, нацеленные на AI-агентов. В отличие от традиционных систем модерации контента, которые в основном сосредоточены на вредоносном тексте, DKnownAI Guard придает приоритет выявлению обманных тактик, направленных на захват поведения агентов. Этот проактивный подход позволяет разработчикам блокировать вредоносные запросы, не нарушая законные рабочие процессы. Например, если запрос пытается манипулировать агентом, выдавая команды, которые переопределяют его предполагаемые управления, DKnownAI Guard классифицирует его как AGENT_HACK и рекомендует немедленное блокирование.
В дополнение к своим возможностям обнаружения манипуляций, DKnownAI Guard также предоставляет контекстно-осведомленное обнаружение. Включив контекст разговора в запросы, API может предоставить более точные классификации, минимизируя влияние задержки. Эта функция особенно полезна для приложений, где AI-агенты взаимодействуют в многоповоротных беседах, позволяя более тонко понимать намерения и риски.
DKnownAI Guard создан для Эры Агентов, где ожидается, что AI-агенты будут выполнять код, получать доступ к файлам и управлять реальными системами. Он поддерживает более 100 языков и бесшовно интегрируется с различными агентными фреймворками, такими как OpenClaw и Claude Code. API разработан для поддержания автономии AI-агентов, обеспечивая их защиту от манипуляций и операционных рисков. Разработчики могут начать с бесплатного уровня, который позволяет 1,000 вызовов API в месяц, что делает его доступным для тестирования и первоначальной реализации. По мере роста потребностей доступен Pro-план для 5,000 вызовов API в месяц, предоставляющий приоритетную поддержку и дополнительные функции.
В целом, DKnownAI Guard представляет собой значительный шаг вперед в области безопасности AI, сосредотачиваясь на уникальных вызовах, которые ставят агентные AI-системы. Приоритизируя обнаружение манипуляций и предоставляя четкие классификации рисков, он дает разработчикам возможность создавать более безопасные и надежные AI-приложения.
Основные функции API безопасности AI-агентов
Обнаружение инъекций команд
Защита от jailbreak
Защита извлечения системных подсказок
Четырехуровневая классификация рисков
Многоязычное обнаружение контента
Интеграция с агентными фреймворками
Контекстно-осведомленное обнаружение
Доступен бесплатный уровень
Как использовать API безопасности AI-агентов?
Настройка: Установите свой API-ключ в заголовке Authorization.
Интеграция: Используйте API в своих агентных рабочих процессах для обнаружения инъекций команд.
Классификация: Отправляйте запросы в API для классификации пользовательских вводов.
Ответ: Действуйте на основе результатов классификации, предоставленных API.
Варианты использования API безопасности AI-агентов
- Безопасность агентов
- Классификация рисков
- Многоповоротные беседы
- Мониторинг соблюдения
- Операционная помощь






