# DataRobotのモデレーションを備えたNVIDIA NeMo Guardrailsの使用

> DataRobotのモデレーションを備えたNVIDIA NeMo Guardrailsの使用 - デプロイ済みのテキスト生成モデルにNVIDIA NeMo
> Guardrailsを接続して、トピックから外れたディスカッション、安全でないコンテンツ、ジェイルブレイクの試みから保護します。

This Markdown file sits beside the HTML page at the same path (with a `.md` suffix). It summarizes the topic and lists links for tools and LLM context.

Companion generated at `2026-07-23T18:01:59.364257+00:00` (UTC).

## Primary page

- [DataRobotのモデレーションを備えたNVIDIA NeMo Guardrailsの使用](https://docs.datarobot.com/ja/docs/agentic-ai/genai-integrations/nvidia-nim-evaluation-moderation.html.md): Full documentation for this topic (Markdown sidecar).

## Sections on this page

- [デプロイされたNIMをNVIDIA NeMo Guardrailsで使用する](https://docs.datarobot.com/ja/docs/agentic-ai/genai-integrations/nvidia-nim-evaluation-moderation.html.md#use-a-deployed-nim-with-nvidia-nemo-guardrails): In-page section heading.

## Documentation content

> [!NOTE] プレミアム機能
> DataRobotでNVIDIA Inference Microservices (NIM)を利用するには、GenAIのエクスペリメントとGPUを使用した推論のためのプレミアム機能にアクセスする必要があります。 NVIDIA NeMo Guardrailsはプレミアム機能です。 この機能を有効にする方法については、DataRobotの担当者または管理者にお問い合わせください。
> 
> 追加の機能フラグ： モデレーションのガードレールを有効にする（ プレミアム機能 ）、モデルレジストリでグローバルモデルを有効にする（ プレミアム機能 ）、予測応答で追加のカスタムモデル出力を有効にする

DataRobotには、すぐに使用できるガードレールが用意されており、単純なルール、コード、またはモデルを使用してアプリケーションをカスタマイズできます。 NVIDIA Inference Microservices (NIM)を使用して、DataRobotのテキスト生成モデルにNVIDIA NeMo Guardrailsを接続することで、トピックから外れたディスカッション、安全でないコンテンツ、ジェイルブレイクの試みから保護できます。

以下のNVIDIA NeMo GuardrailsがNIMとして利用可能であり、関連する評価指標タイプを使用して実装できます。

| モデル名 | 評価指標のタイプ |
| --- | --- |
| llama-3.1-nemoguard-8b-topic-control | 入力のトピックを維持 / 出力のトピックを維持 |
| llama-3.1-nemoguard-8b-content-safety | コンテンツの安全性 |
| nemoguard-jailbreak-detect | ジェイルブレイク |

さらに、DataRobotでは、 NeMo指標 セクションの [評価とモデレーションを設定](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-workshop/nxt-configure-evaluation-moderation.html.md) パネルで、 NeMo Evaluator指標 （LLM Judge, Context Relevance, Response Groundedness, Topic Adherence, Agent Goal Accuracy, Response Relevancy, Faithfulness）を利用できます。 これらの指標には、NeMo Evaluatorワークロードのデプロイ（Workload APIを使用して作成）が必要であり、そのパネルの NeMo指標 セクションに一覧表示されます。 このページでは、NIMデプロイ経由の NVIDIA NeMo Guardrails （トピックの維持、コンテンツの安全性、ジェイルブレイク）について説明します。

## デプロイされたNIMをNVIDIA NeMo Guardrailsで使用する

トピック制御の評価指標を備えた、デプロイ済みの `llama-3.1-nemoguard-8b-topic-control` NVIDIA NIMを使用するには、NVIDIA NeMo Guardrailを登録してデプロイします。 ターゲットタイプがテキスト生成のカスタムモデルを作成したら、トピック制御の評価指標を設定します。

トピック制御のためにNVIDIA NeMo Guardrailsを選択して設定するには：

1. ワークショップにおいて、ターゲットタイプがテキスト生成のカスタムモデルのアセンブルタブを開き、モデルを構築します。構築方法は、DataRobot以外で作成したカスタムモデルから手動で行うか、ユースケースのLLMプレイグラウンドで構築されたモデルから自動で行うかのいずれかです。 モデレーションを使ってテキスト生成モデルを構築する場合、必要なランタイムパラメーター（資格情報など）の設定やリソース設定（パブリックネットワークへのアクセスなど）を必ず行います。 最後に、基本環境をモデレーション対応の環境（[GenAI] Python 3.12 with Moderationsなど）に設定します。 リソース設定DataRobotでは、より多くのメモリーおよびCPUリソースを備えた、より大きなリソースバンドルを使用してLLMカスタムモデルを作成することをお勧めします。
2. カスタムモデルに必要な設定を行ったら、評価とモデレーションセクションに移動し、設定をクリックします。
3. 評価とモデレーションを設定パネルで、NVIDIA NeMo GuardrailsまたはNVIDIAのタグが付いている指標を探し、使用したい指標を選択します。 評価指標要件説明1コンテンツの安全性NVIDIA GPU Cloud (NGC) Catalogからインポートされた、デプロイ済みのNIMモデルllama-3.1-nemoguard-8b-content-safety。プロンプトと回答を安全または安全でないものとして分類し、検出された安全でないカテゴリーのリストを返します。2ジェイルブレイクNVIDIA GPU Cloud (NGC) Catalogからインポートされた、デプロイ済みのNIMモデルnemoguard-jailbreak-detect。NemoGuard JailbreakDetectを使ってジェイルブレイクの試みを分類します。3入力のトピックを維持NVIDIA NeMoガードレールの設定NVIDIA NeMo Guardrailsを使用してトピックの境界を設定することで、プロンプトがトピックに関連し、禁止用語を使用しないようにします。4出力のトピックを維持NVIDIA NeMoガードレールの設定NVIDIA NeMo Guardrailsを使用してトピックの境界を設定することで、回答がトピックに関連し、禁止用語を使用しないようにします。
4. 評価とモデレーションを設定ページで、選択した指標に基づいて以下のフィールドを設定します。 トピック制御コンテンツの安全性ジェイルブレイクフィールド説明名前設定する指標にわかりやすい名前を入力します。適用対象入力トピック維持がプロンプトに適用されます。 出力トピック維持が回答に適用されます。LLMのタイプLLMのタイプをNIMに設定します。NIMのデプロイNVIDIA NIMのデプロイを選択します。 詳細については、NVIDIA NIMによるインポートとデプロイを参照してください。資格情報リストからDataRobot APIキーを選択します。 資格情報は、資格情報管理ページで定義されます。ファイル(オプション）NeMoファイルを設定します。 ファイルの横にあるをクリックして、NeMo Guardrailsの設定ファイルを変更します。 特に、prompts.ymlを許可されたトピックとブロックされたトピックで、blocked_terms.txtをブロックされた用語で更新し、NeMo Guardrailsに適用するルールを提供します。blocked_terms.txtファイルは、入力と出力のトピック制御指標間で共有されるため、入力指標のblocked_terms.txtを変更すると出力指標でも変更され、その逆も同様です。 カスタムモデルには、トピック制御指標が2つしか存在できません。1つは入力用、もう1つは出力用です。フィールド説明名前設定する指標にわかりやすい名前を入力します。適用対象プロンプトと回答の両方にコンテンツの安全性を適用します。デプロイ名リストで、DataRobotに登録およびデプロイされているllama-3.1-nemoguard-8b-content-safetyモデルの名前を探し、デプロイ名をクリックします。フィールド説明名前設定する指標にわかりやすい名前を入力します。適用先プロンプトにジェイルブレイクを適用します。デプロイ名リストで、DataRobotに登録およびデプロイされているnemoguard-jailbreak-detectモデルの名前を探し、デプロイ名をクリックします。
5. モデレーションセクションで、モデレーションの設定と適用を有効にして、評価指標ごとに以下を設定します。 フィールド説明モデレーション方法レポートまたはレポートとブロックを選択します。モデレーションのメッセージレポートとブロックを選択すると、オプションでデフォルトのメッセージを変更できます。
6. 必須フィールドを設定した後、追加をクリックして評価を保存し、評価選択ページに戻ります。 次に、別の指標を選択して設定するか、設定を保存をクリックします。 選択したガードレールは、アセンブルタブの評価とモデレーションセクションに表示されます。

テキスト生成カスタムモデルにガードレールを追加した後、モデルを [テスト](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-workshop/nxt-test-custom-model.html.md) 、 [登録](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-directory/nxt-register-cus-models.html.md) 、および [デプロイ](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-directory/nxt-deploy-models.html.md) して本番環境で予測を作成できます。 [予測](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-predictions/index.html.md) を作成した後、 [カスタム指標](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-monitoring/nxt-custom-metrics.html.md) タブで評価指標を表示し、 [データ探索](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-monitoring/nxt-data-exploration.html.md) タブでプロンプト、回答、およびフィードバック（設定されている場合）を表示できます。
