AI ガードレール プロファイルを使用すると、生成型 AI アプリを組織全体で規制および制御できます。これにより、ユーザーは安全かつ責任を持ってそれらを利用できます。 プロファイルを構成してから、 リアルタイム保護で 事前定義されたカテゴリ、キーワード、および事前定義されたプロンプトと応答に対する意味的な一致に基づいて、プロンプトや応答を許可またはブロックすることで、コンテンツをモデレートできます。
AIガードレールプロファイルを作成するには:
-
Policies > AI Guardrailsへ移動してください。
-
Profilesタブをクリックしてください。
-
Newをクリックしてください。
-
Name & Description内:
-
Nameプロフィール名を入力してください。
-
Description(任意)プロフィールに関するコメントやメモを入力してください。

-
-
Predefined Categoriesの場合:組織のポリシーに応じて、以下のカテゴリに基づいてコンテンツを検出およびモデレートすることを選択できます。
-
Prompt Injection and JailbreakingLLMの安全プロトコルを回避しようとするプロンプトに対する保護を有効または無効にします。このカテゴリ 信頼度一致しきい値レベルの代わりにコントロールを有効/無効にし、生成AIアプリに送信されるプロンプトのみを検出します。
-
Malicious URLs: フィッシング、詐欺、マルウェア配布、ボットネットのコマンド&コントロールサーバー、侵害・悪意のあるサイト、マルウェアの呼び出しなど、悪意のある活動やセキュリティリスクとして知られるプロンプトや応答内のURLを検出できるようにします。詳細については、 「定義済みカテゴリについて」をご覧ください。
-
Newly Registered and Observed Domainsプロンプトとレスポンス内で、新しく作成されたドメインおよび最近発見されたドメインへのトラフィックを検出できるようにします。詳細については、 「定義済みカテゴリについて」をご覧ください。
-
Hate Speech and Discrimination保護対象となる特性に基づく憎悪、偏見、または差別を助長するコンテンツ。
-
Crimes違法行為を助長、奨励、または指導するコンテンツ。
-
Weapons: 重大な傷害や破壊を引き起こすように設計された有害または危険なデバイスの作成、使用、または宣伝を伴うコンテンツ。
-
Suicide and Self-Harm自傷行為や自殺を助長、奨励、または議論するコンテンツ。
-
Sex-Related Crimes and Content性的人身売買、売春、性的暴行、嫌がらせ、児童性的搾取など、違法かつ有害な性的行為を助長または描写するコンテンツ。
-
Requests for Sensitive Data:本人の同意なしに、実在の人物に関する機密性の高い個人情報を違法に取得、抽出、または開示することを目的とした要求。
-
Piracy and Copyright著作権で保護された素材を無断で取得、漏洩、または取得について議論しようとするプロンプトまたは応答。
プロンプトまたはレスポンスの内容からカテゴリを検出する際に、Netskopeが実行する信頼度マッチングの種類を選択してください。
-
LowNetskopeは、一致の信頼度が低い場合に検出をトリガーします。組織のリスク許容度が非常に低い場合は、このオプションを選択してください。
-
MediumNetskopeは、一致の信頼度が中程度の場合に検出をトリガーします。組織のリスク許容度がバランスの取れたものかどうかを選択してください。
-
HighNetskopeは、一致の確信度が高く、違反が明白な場合に検出をトリガーします。組織のリスク許容度が高いかどうかを選択してください。
いつでもReset to Defaultクリックすると、Netskopeのデフォルト設定にリセットできます。

-
-
Custom Topicsで、プロンプトとレスポンスで検出するカスタムトピックSelect 。
この機能はベータ版です。テナントに対してこの機能を有効にするには、 Netskopeサポートまたは営業担当者にお問い合わせください。 -
Matched Keywordsに、プロンプトとレスポンスで検出したいキーワードをカンマで区切って入力してください。最大256キーワードを検出でき、合計入力長は2,048文字で、ケースに非依存なマッチを使います。 Netskopeは複数のキーワード(例:フォーム16、開会式、ワールドカップなど)もサポートしています。

-
Matched Prompts / Responsesに、プロンプトとレスポンス内で検出したい特定のフレーズを入力してください。誤検出を軽減したり、許可/ブロックしたり、プロンプトと応答を制限/禁止したりするために、 Netskope意味的マッチングを実行して、設定で定義されたフレーズに類似したプロンプトと応答を検出します。 プロンプトまたはレスポンスが定義済みのフレーズと意味的に一致するかどうかの信頼度を制御するためにLow 、 Medium 、またはHigh信頼度マッチングを選択してください。+クリックすると、コンテンツを追加してリストを作成できます。プロフィールごとに最大10件までアイテムを追加できます。各項目は500語以内、合計文字数は4,096文字以内とします。

-
Createをクリックしてください。
AIガードレールプロファイルを作成したら、それを新しいリアルタイム保護ポリシーに追加して、ユーザーに適用する必要があります。詳細はこちら:リアルタイム保護のためのAI Guardrails作成
AI Guardrailsの検出設定
AI Guardrailsを使用すると、次のことが可能になります。
-
NetskopeのパブリッククラウドLLMに接続することで、GPUベースの検出を有効にし、AIによるセキュリティ検出の効率性を向上させます。
-
Netskopeに一致するプロンプトとレスポンスのコンテンツを保存します。
これらの検出設定を有効にするには、セキュリティクラウド プラットフォーム設定をご覧ください。

