説明
DKnownAI Guardは、プロンプトインジェクション、脱獄試行、システムプロンプト抽出の検出に特化したAIエージェントセキュリティAPIです。これは、アクションを実行するAIエージェントを保護するために設計されており、操作に対して安全を保ちながら効果的に機能し続けることを保証します。APIは、リクエストを4つの異なるリスクカテゴリに分類します:AGENT_HACK、SYS_FLAG、CONTENT_FLAG、SAFE。この分類システムにより、開発者はさまざまなタイプのリクエストに適切に対応し、エージェントのワークフローのセキュリティを強化できます。
DKnownAI Guardのコア機能は、AIエージェントをターゲットにした操作試行を検出する能力にあります。従来のコンテンツモデレーションシステムが主に有害なテキストに焦点を当てるのに対し、DKnownAI Guardはエージェントの行動をハイジャックすることを目的とした欺瞞的な戦術の特定を優先します。この積極的なアプローチにより、開発者は正当なワークフローを妨げることなく悪意のあるリクエストをブロックできます。たとえば、リクエストがエージェントの意図された制御を上書きするコマンドを発行して操作しようとする場合、DKnownAI GuardはそれをAGENT_HACKとして分類し、即座にブロックを推奨します。
操作検出機能に加えて、DKnownAI Guardはコンテキストに応じた検出も提供します。リクエストに会話のコンテキストをオプションで含めることにより、APIはより正確な分類を提供し、レイテンシーの影響を最小限に抑えることができます。この機能は、AIエージェントが複数ターンの会話で相互作用するアプリケーションに特に有益であり、意図とリスクのより微妙な理解を可能にします。
DKnownAI Guardは、AIエージェントがコードを実行し、ファイルにアクセスし、実際のシステムを管理することが期待されるエージェント時代のために構築されています。100以上の言語をサポートし、OpenClawやClaude Codeなどのさまざまなエージェントフレームワークとシームレスに統合されます。APIは、AIエージェントの自律性を維持しながら、操作リスクや操作からの保護を確保するように設計されています。開発者は、月に1,000回のAPIコールを許可する無料プランから始めることができ、テストや初期実装にアクセス可能です。ニーズが増えると、月に5,000回のAPIコールを提供するProプランが利用可能で、優先サポートや追加機能が提供されます。
全体として、DKnownAI Guardは、エージェントAIシステムがもたらす独自の課題に焦点を当てたAIセキュリティの重要な進展を表しています。操作検出を優先し、明確なリスク分類を提供することで、開発者がより安全で信頼性の高いAIアプリケーションを作成できるようにします。
AIエージェントセキュリティAPIの主要機能
プロンプトインジェクション検出
脱獄防御
システムプロンプト抽出保護
4段階のリスク分類
多言語コンテンツ検出
エージェントフレームワーク統合
コンテキストに応じた検出
無料プランあり
AIエージェントセキュリティAPIの使い方は?
設定: 認証ヘッダーにAPIキーを設定します。
統合: プロンプトインジェクション検出のためにエージェントワークフローでAPIを使用します。
分類: ユーザー入力の分類のためにAPIにリクエストを送信します。
応答: APIが提供する分類結果に基づいて行動します。
AIエージェントセキュリティAPIの使用例
- エージェントセキュリティ
- リスク分類
- 複数ターンの会話
- コンプライアンスモニタリング
- 運用支援






