# 評価とモデレーションを設定

> 評価とモデレーションを設定 - How to configure evaluation and moderation guardrails for a custom text generation
> model and agentic workflows in the workshop.

This Markdown file sits beside the HTML page at the same path (with a `.md` suffix). It summarizes the topic and lists links for tools and LLM context.

Companion generated at `2026-07-23T18:01:59.337732+00:00` (UTC).

## Primary page

- [評価とモデレーションを設定](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md): Full documentation for this topic (Markdown sidecar).

## Sections on this page

- [評価とモデレーションのガードレールを選択する](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#select-evaluation-and-moderation-guardrails): In-page section heading.
- [資格情報を変更](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#change-credentials): In-page section heading.
- [トピック制御指標](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#topic-control-metrics): In-page section heading.
- [忠実度の指標](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#faithfulness-metric): In-page section heading.
- [NeMo Evaluatorの指標に関する注意事項](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#considerations-for-nemo-evaluator-metrics): In-page section heading.
- [評価指標デプロイのグローバルモデル](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#global-models-for-evaluation-metric-deployments): In-page section heading.
- [評価およびモデレーションガードレールの表示](https://docs.datarobot.com/ja/docs/agentic-ai/agentic-deploy/agentic-configure-evaluation-moderation.html.md#view-evaluation-and-moderation-guardrails): In-page section heading.

## Documentation content

> [!NOTE] プレミアム機能
> 評価およびモデレーションガードレールはプレミアム機能です。 この機能を有効にする方法については、DataRobotの担当者または管理者にお問い合わせください。
> 
> 機能フラグ： モデレーションのガードレールを有効にする（ プレミアム ）、モデルレジストリでグローバルモデルを有効にする（ プレミアム ）、予測応答で追加のカスタムモデル出力を有効にする

評価とモデレーションのガードレールは、組織がプロンプトインジェクションや、悪意のある、有害な、または不適切なプロンプトや回答をブロックするのに役立ちます。 また、ハルシネーションや信頼性の低い回答を防ぎ、より一般的には、モデルをトピックに沿った状態に保つこともできます。 さらに、これらのガードレールは、個人を特定できる情報（PII）の共有を防ぐことができます。 多くの評価およびモデレーションガードレールは、デプロイ済みのテキスト生成モデル（LLM）またはエージェントワークフローをデプロイ済みのガードモデルに接続します。 これらのガードモデルはLLMのプロンプトと回答について予測し、これらの予測と統計を中心的なLLMまたはエージェントワークフローのデプロイに報告します。

評価とモデレーションのガードレールを使用するには、まず、LLMのプロンプトや回答について予測するガードモデルを作成してデプロイします。たとえば、ガードモデルは、プロンプトインジェクションや有害な回答を識別することができます。 次に、ターゲットタイプが テキスト生成 または エージェントのワークフロー であるカスタムモデルを作成する場合、評価とモデレーションのガードレールを1つ以上定義します。

**重要な前提条件**

LLMに評価とモデレーションのガードレールを設定する前に、ガードモデルをデプロイし、LLMのデプロイを設定する際には、以下のガイドラインに従ってください。

- カスタムガードモデルを使用している場合、デプロイする前に、 moderations.input_column_name と moderations.output_column_name を 登録モデルバージョンのタグ型キー値 { target= blank }として定義します。 _これらのキー値を設定しない場合、ガードモデルのユーザーは、入力列名と出力列名を手動で入力する必要があります。
- 評価とモデレーションを設定する 前 に、中心的なLLMの監視に使用する グローバル またはカスタムガードモデルをデプロイします。
- デプロイされたガードモデルとは異なる予測環境に、中心的なLLMをデプロイします。
- デプロイされたLLMを介して予測を開始する前に、 関連付けID { target= blank }を設定して予測ストレージを有効にします。 _関連付けIDを設定せず、LLMの予測とともに関連付けIDを指定した場合、モデレーションの指標はカスタム指標タブでは計算されません。
- 関連付けIDを定義後、関連付けIDの自動生成を有効にして、これらの指標がカスタム指標タブに表示されるようにできます。 この設定は、デプロイ 中 やデプロイ 後 に有効化できます。
- NeMo Evaluator指標 （Agent Goal Accuracy、Context Relevance、Faithfulness (NeMo Evaluator)、LLM Judge、Response Groundedness、Response Relevancy、Topic Adherence）のいずれかを使用する場合は、まずWorkload APIを使用してNeMo Evaluatorワークロードとワークロードのデプロイを作成します。 Workload APIにはUIがありません。APIを使用してワークロードを作成してから、ワークロードのデプロイを作成する必要があります。 これらの指標のそれぞれについて、NeMo Evaluatorのデプロイが必要です。

**予測方法に関する注意事項**

[チャット生成Q&Aアプリケーションの](https://docs.datarobot.com/ja/docs/wb-apps/custom-apps/create-qa-app.html.md) 外部で予測を行う場合、評価とモデレーションは、 [リアルタイム予測](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-predictions/nxt-pred-api-snippets.html.md#real-time-prediction-snippet-settings) とのみ互換性があり、 [バッチ予測](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-predictions/nxt-pred-api-snippets.html.md#batch-prediction-snippet-settings) とは互換性がありません。 また、 [ボルトオンのガバナンスAPI](https://docs.datarobot.com/ja/docs/api/code-first-tools/drum/structured-custom-models.html.md#chat) を使ってストリーミングレスポンスをリクエストする場合、評価とモデレーションはストリーミングの効果を無効にします。 ガードレールは、LLMの完全なレスポンスのみを評価するため、レスポンステキストを1つのチャンクで返します。

## 評価とモデレーションのガードレールを選択する

ターゲットタイプが テキスト生成 または エージェントのワークフロー であるカスタムモデルを作成する場合、評価とモデレーションのガードレールを1つ以上定義します。

評価およびモデレーションガードレールを選択および設定するには：

1. ワークショップにおいて、ターゲットタイプがテキスト生成またはエージェントのワークフローのカスタムモデルのアセンブルタブを開き、モデルを構築します。構築方法は、DataRobot以外で作成したカスタムモデルから手動で行うか、ユースケースのLLMプレイグラウンドで構築されたモデルから自動で行うかのいずれかです。 モデレーションを使ってテキスト生成モデルを構築する場合、必要なランタイムパラメーター（資格情報など）の設定やリソース設定（パブリックネットワークへのアクセスなど）を必ず行います。 最後に、基本環境をモデレーション対応の環境（たとえば[GenAI] Python 3.12 with Moderations）に設定します。 リソース設定DataRobotでは、より多くのメモリーおよびCPUリソースを備えた、より大きなリソースバンドルを使用してLLMカスタムモデルを作成することをお勧めします。
2. カスタムモデルに必要な設定を行ったら、評価とモデレーションセクションに移動し、設定をクリックします。
3. 評価とモデレーションを設定パネルにある設定のサマリーで、以下の設定にアクセスします。 設定説明ワークフローを表示DataRobotでどのように評価が実行されているかを確認します。 すべての評価とそれぞれのモデレーションは並行して実行されます。モデレーション設定以下を設定します。モデレーションのタイムアウトを設定：モデレーションシステムが自動的にタイムアウトするまでの最大待機時間を設定します。タイムアウトアクション：モデレーションシステムがタイムアウトした場合に何が起こるかを定義します：プロンプト/回答をスコアリングするまたはプロンプト/回答をブロックする。NeMo Evaluatorの設定NeMo Evaluatorの指標で使用されるNeMo Evaluatorのデプロイを設定します。 Workload APIを使用してNeMo Evaluatorのワークロードとワークロードのデプロイを作成するまで、ドロップダウンには「利用可能なオプションはありません」と表示されます。 NeMo Evaluatorの指標を設定するには、その手順を完了する必要があります。
4. 評価とモデレーションを設定パネルで、以下の指標カードのいずれかをクリックし、必要なプロパティを設定します。 このパネルには、すべての指標とNeMoの指標の2つのセクションがあります。設定のサマリーサイドバーから、ワークフローを表示、モデレーション設定、またはNeMo Evaluatorの設定を開き、すべてのNeMo Evaluator指標で使用されるEvaluatorのデプロイを設定できます。 すべての指標NeMoの指標評価指標要件説明コンテンツの安全性NVIDIA GPU Cloud (NGC) Catalogからインポートされた、デプロイ済みのNIMモデルllama-3.1-nemoguard-8b-content-safety。プロンプトと回答を安全または安全でないものとして分類し、検出された安全でないカテゴリーのリストを返します。コストLLMコスト設定提供されたトークンあたりの入力コストと、トークンあたりの出力コストを使用して、LLM回答の生成コストを計算します。 コストの計算には、引用コストも含まれます。 詳細については、コスト指標の設定を参照してください。カスタムデプロイカスタムデプロイ任意のデプロイを使用して、LLM（サポートされているターゲットタイプ：連続値、二値分類、多クラス、テキスト生成）の評価とモデレーションを行います。感情分類器感情分類器のデプロイプロンプトまたはレスポンステキストを感情別に分類します。忠実度LLM、ベクターデータベースLLMの回答がソースと一致するかどうかを測定して、考えられるハルシネーションを識別します。ジェイルブレイクNVIDIA GPU Cloud (NGC) Catalogからインポートされた、デプロイ済みのNIMモデルnemoguard-jailbreak-detect。NemoGuard JailbreakDetectを使ってジェイルブレイクの試みを分類します。PII検出PresidioのPII検出Microsoft Presidioライブラリを使用して、テキスト内の個人識別情報 (PII) を検出します。プロンプトインジェクションプロンプトインジェクション分類器モデルの出力変更を意図した入力操作（システムプロンプトの上書きや変更など）を検出します。プロンプトトークンN/ALLMへの入力、およびベクターデータベースから取得されたテキスト、またはいずれか一方に関連付けられたトークンの数を追跡します。回答トークンN/ALLMからの出力、およびベクターデータベースから取得されたテキスト、またはいずれか一方に関連付けられたトークンの数を追跡します。ROUGE-1ベクターデータベースLLMブループリントから生成された回答とベクターデータベースから取得されたドキュメントの間で類似度を計算します。毒性毒性分類器コンテンツの有害性を分類してモデレーション技術を適用し、有害なコンテンツの拡散を防ぎます。エージェントのワークフロー指標Agent Goal AccuracyLLM既知のベンチマークがないシナリオにおいて、特定の目標を達成する際のエージェントワークフローのパフォーマンスを評価します。 （このエージェントワークフロー指標は、NeMoの指標に含まれる同名のNeMo Evaluator指標とは異なります。）Task AdherenceLLMエージェントワークフローの回答が適切で、完全であり、ユーザーの期待に沿っているかどうかを測定します。Guideline AdherenceLLM、ガイドライン設定ジャッジLLMを使用して、回答が定義されたガイドラインにどの程度沿っているかを評価します。 ガイドラインに従っている場合はtrue、そうでない場合はfalseを返します。 設定時に、ガイドラインを提供し、LLMを（Gatewayまたはデプロイから）選択する必要があります。評価指標デプロイのグローバルモデルPII検出、プロンプトインジェクション検出、感情分類、毒性分類に必要なデプロイは、レジストリのグローバルモデルとして使用できます。多クラスカスタムデプロイの指標の制限値多クラスカスタムデプロイの指標には、以下の制限があります。モデレーション基準の一致リストで定義できるクラスは最大で10個までです。ガードモデルで使用できるクラス名は最大で100個までです。NeMo Evaluator指標（Agent Goal Accuracy、Context Relevance、Faithfulness、LLM Judge、Response Groundedness、Response Relevancy、Topic Adherence）にはNeMo Evaluatorワークロードのデプロイが必要であり、これは設定のサマリーサイドバーのNeMo Evaluatorの設定で指定します。 ワークロードを選択する前に、Workload APIを使用してワークロードとワークロードのデプロイを作成します。デプロイが存在するまで、ワークロードデプロイの選択ドロップダウンには「利用可能なオプションはありません」と表示されます。 これらの各指標では、LLMジャッジ（DataRobotのデプロイまたはLLM Gateway）も使用されています。 Response Relevancyには、さらに埋め込みのデプロイが必要です。 Topic AdherenceとLLM Judgeには、追加の設定があります。入力のトピックを維持および出力のトピックを維持では、NeMo Evaluatorのデプロイを使用しません。 これらは、llama-3.1-nemoguard-8b-topic-controlモデルのNIMデプロイを使用します（コンテンツの安全性やジェイルブレイクがNIMモデルを使用するのと同様）。 これらを設定する際は、LLMのタイプをNIMに指定し、トピック制御用のNIMデプロイを選択します。必要に応じて、NeMo Guardrailsの設定ファイルを編集することも可能です。Evaluatorの指標要件説明Agent Goal AccuracyEvaluatorのデプロイ、LLMエージェントがユーザーのクエリーにどの程度応えているかを評価します。 これは、すべての指標（エージェントのワークフロー）に含まれるAgent Goal Accuracyという指標とは異なります。Context RelevanceEvaluatorのデプロイ、LLM提供されたコンテキストが回答に対してどの程度関連性があるかを測定します。忠実度Evaluatorのデプロイ、LLM指定されたコンテキストに忠実な回答となっているかどうかをNeMo Evaluatorを使用して評価します。 これは、すべての指標に一覧表示されるNeMo以外のFaithfulness指標とは異なります。LLM JudgeEvaluatorのデプロイ、LLMLLMをジャッジとして使用し、ユーザー定義の指標を評価します。Response GroundednessEvaluatorのデプロイ、LLM回答が、提供されたコンテキストに基づいているかどうかを評価します。Response RelevancyEvaluatorのデプロイ、LLM、埋め込みデプロイ回答がユーザーのクエリーにどの程度関連しているかを測定します。Topic AdherenceEvaluatorのデプロイ、LLM、指標モード、参照トピック回答が想定されたトピックに沿っているかどうかを評価します。トピック制御指標入力のトピックを維持llama-3.1-nemoguard-8b-topic-controlのNIMデプロイ、NVIDIA NeMo Guardrailsの設定NVIDIA NeMo Guardrailsを使用してトピックの境界を設定することで、プロンプトがトピックに関連し、禁止用語を使用しないようにします。出力のトピックを維持llama-3.1-nemoguard-8b-topic-controlのNIMデプロイ、NVIDIA NeMo Guardrailsの設定NVIDIA NeMo Guardrailsを使用してトピックの境界を設定することで、回答がトピックに関連し、禁止用語を使用しないようにします。NeMo Evaluatorの指標で使用されるNeMo Evaluatorのデプロイを設定するには、設定のサマリーサイドバーからNeMo Evaluatorの設定を開きます。 Evaluatorのデプロイは、NeMo Evaluatorのすべての指標に適用されます。ワークロードデプロイの選択ドロップダウンリストから、NeMo Evaluatorのワークロードデプロイを選択します。NeMo Evaluatorの設定パネルWorkload APIを使用してNeMo Evaluatorのワークロードとワークロードのデプロイを作成するまで、ドロップダウンには「利用可能なオプションはありません」と表示されます。 NeMo Evaluatorの指標を設定するには、その手順を完了する必要があります。
5. 上記で選択した指標に応じて、次のフィールドを設定します。 フィールド説明全般的な設定名前評価指標の複数のインスタンスを追加する場合は、一意の名前を入力します。適用先評価指標に応じて、プロンプトと回答のどちらか、または両方を選択します。プロンプトを選択すると、指標の計算に使用されるのは、最後のLLMプロンプトではなく、ユーザープロンプトであることに注意してください。 このフィールドは、プロンプトと回答の両方に適用される指標に対してのみ設定可能です。カスタムデプロイ、PII検出、プロンプトインジェクション、感情分類器、毒性設定デプロイ名ガードモデルによって計算された評価指標の場合、カスタムモデルデプロイを選択します。カスタムデプロイの設定入力列名この名前は、カスタムモデルの作成者によって定義されます。DataRobotによって作成されたグローバルモデルの場合、デフォルトの入力列名はtextです。 カスタムデプロイのガードモデルにmoderations.input_column_nameのキー値が定義されている場合、このフィールドには自動的に値が設定されます。出力列名この名前はカスタムモデル作成者によって定義され、モデルのターゲット列を参照する必要があります。 ターゲット名は、デプロイの概要タブに表示されます（多くの場合、_PREDICTIONが付加されます）。カスタムデプロイからCSVデータをエクスポートして表示することで、列名を確認できます。 カスタムデプロイのガードモデルにmoderations.output_column_nameのキー値が定義されている場合、このフィールドには自動的に値が設定されます。Guideline Adherenceの設定ガイドラインエージェントの回答が従うべきルールまたは基準。 選択されたLLMは、回答がこのガイドラインに準拠しているかどうかを評価するジャッジとして機能し、true（ガイドラインに従っている）またはfalse（ガイドラインに従っていない）を返します。 この指標の設定時に、ガイドラインを提供し、LLMを（Gatewayまたはデプロイから）選択する必要があります。Faithfulness、Task Adherence、およびGuideline Adherenceの設定LLM選択された指標を評価するLLMを選択します。 忠実度の場合、LLMを選択すると、DataRobotが提供する資格情報ではなく、ユーザー自身が指定した資格情報を使用するオプションがあります。NeMo Evaluator指標の設定LLMをジャッジとして選択選択された指標を評価するLLMを選択します。EvaluatorのデプロイNeMo Evaluatorの指標のみ対象です。NeMo Evaluatorの設定サイドバーパネル（ワークロードデプロイの選択）で設定します。 NeMo Evaluatorワークロードのデプロイは、それらの指標で共有されています。 設定を行う前に、Workload APIを使用してワークロードとワークロードのデプロイを作成します。上記の前提条件を参照してください。トピック制御の設定LLMタイプAzure OpenAI、OpenAI、またはNIMを選択します。 LLMのタイプがAzure OpenAIの場合、OpenAI APIのデプロイを追加で入力します。NIMの場合は、NIMのデプロイを入力します。 LLM Gatewayを使用する場合、デフォルトでは、DataRobotが提供する資格情報が指定されます。 LLMのタイプがAzure OpenAIまたはOpenAIの場合、資格情報を変更をクリックして、自身の認証情報を入力します。ファイルトピックの維持の評価については、ファイルの横にあるをクリックして、NeMoガードレール設定ファイルを変更します。 特に、prompts.ymlを許可されたトピックとブロックされたトピックで、blocked_terms.txtをブロックされた用語で更新し、NeMo Guardrailsに適用するルールを提供します。blocked_terms.txtファイルは、入力と出力のトピック制御指標間で共有されるため、入力指標のblocked_terms.txtを変更すると出力指標でも変更され、その逆も同様です。 カスタムモデルには、トピック制御指標が2つしか存在できません。1つは入力用、もう1つは出力用です。モデレーション設定モデレーションの設定と適用この設定を有効にすると、モデレーションセクションが展開され、モデレーションロジックが適用されるタイミングを判断する基準を定義できます。 コスト指標の設定コスト指標では、通貨額/トークン数形式での入力および出力コストを定義し、追加をクリックします。コスト指標には、モデレーションを設定して適用するためのモデレーションセクションが含まれていません。
6. モデレーションセクションで、モデレーションの設定と適用を有効にして、評価指標ごとに以下を設定します。 設定説明モデレーションの基準該当する場合、モデレーションロジックをトリガーするために評価されるしきい値を設定します。 数値指標（整数または浮動小数）の場合、より小さい、より大きい、または等しいを任意の値と組み合わせて使用できます。 二値指標（Agent Goal Accuracyなど）の場合、0または1に等しいを使用します。感情分類器の場合、一致または一致しないを選択し、モデレーションロジックをトリガーするクラス（感情）のリストを定義します。モデレーション方法レポート、レポートとブロック、または置換（該当する場合）を選択します。モデレーションのメッセージレポートとブロックを選択すると、オプションでデフォルトのメッセージを変更できます。
7. 必須フィールドを設定した後、追加をクリックして評価を保存し、評価選択ページに戻ります。 次に、別の指標を選択して設定するか、設定を保存をクリックします。 選択したガードレールは、アセンブルタブの評価とモデレーションセクションに表示されます。

テキスト生成カスタムモデルにガードレールを追加した後、モデルを [テスト](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-workshop/nxt-test-custom-model.html.md) 、 [登録](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-directory/nxt-register-cus-models.html.md) 、および [デプロイ](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-directory/nxt-deploy-models.html.md) して本番環境で予測を作成できます。 [予測](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-predictions/index.html.md) を作成した後、 [カスタム指標](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-monitoring/nxt-custom-metrics.html.md) タブで評価指標を表示し、 [データ探索](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-monitoring/nxt-data-exploration.html.md) タブでプロンプト、回答、およびフィードバック（設定されている場合）を表示できます。

> [!NOTE] 「トレース」タブ
> LLMデプロイにモデレーションを追加すると、 [データ探索 > トレース](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-monitoring/nxt-data-exploration.html.md) タブでカスタム指標データを行ごとに表示することはできません。

### 資格情報を変更

DataRobotは、LLM Gatewayを使用して、 [利用可能なLLM](https://docs.datarobot.com/ja/docs/reference/gen-ai-ref/llm-availability.html.md) の資格情報を提供します。 特定の指標やLLMまたはLLMのタイプによっては、認証に独自の資格情報を使用することも可能です。 続行する前に、 [資格情報管理](https://docs.datarobot.com/ja/docs/platform/acct-settings/stored-creds.html.md#credentials-management) ページでユーザー指定の資格情報を定義します。

#### トピック制御指標

入力のトピックを維持 または 出力のトピックを維持 の資格情報を変更するには、 LLMタイプ を選択し、 資格情報を変更 をクリックします。

**LLMのタイプ：Azure OpenAI:**
Azure OpenAI APIのデプロイとOpenAI APIのベースURLを指定します。 次に、ドロップダウンから、適用する資格情報のセットを選択します。

[https://docs.datarobot.com/ja/docs/images/change-metric-creds-azure.png](https://docs.datarobot.com/ja/docs/images/change-metric-creds-azure.png)

**LLMのタイプ：OpenAI:**
ドロップダウンから、適用する資格情報のセットを選択します。

[https://docs.datarobot.com/ja/docs/images/change-metric-creds-openai.png](https://docs.datarobot.com/ja/docs/images/change-metric-creds-openai.png)

**LLMのタイプ：NIM:**
NIMのデプロイ（例：トピック制御モデル）を選択します。 通常、資格情報はデプロイ設定を通じて指定されます。


DataRobotが提供する資格情報に戻すには、 資格情報を元に戻す をクリックします。

#### 忠実度の指標

忠実度 の資格情報を変更するには、 LLM を選択し、 資格情報を変更 をクリックします。

必須フィールドは、次の表のとおりです。

| プロバイダー | フィールド |
| --- | --- |
| Amazon | AWSアカウント（資格情報）AWSリージョン |
| Azure OpenAI | OpenAI APIのデプロイOpenAI APIのベースURL資格情報 |
| Google | サービスアカウント（資格情報）Googleのリージョン |
| OpenAI | 資格情報 |

DataRobotが提供する資格情報に戻すには、 資格情報を元に戻す をクリックします。

### NeMo Evaluatorの指標に関する注意事項

NeMo Evaluatorの指標を使用する際は、以下の点に注意してください。

- LLMジャッジの出力： NeMo Evaluatorは、LLMジャッジが正しいJSONスキーマでデータを返すことを想定しています。 一部のモデル（たとえば、特定のLlamaのバージョンなど）では、代わりにPythonコードやその他の形式が返されることがあり、その結果、Evaluatorが失敗する可能性があります。 期待される形式を確実に返すLLMジャッジを選択します。多くの場合、新しいモデルの方がJSON出力の指示に従うことができます。
- レートとトークン数の制限： NeMo Evaluatorガードを使用する際は、レートの制限とトークン数の制限に注意してください。これらの上限に達すると、評価が失敗する可能性があります。

[アクティビティログ > モデレーション](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-activity-log/nxt-moderation.html.md) タブとEvaluatorのログを使用して、リクエストがブロックされた理由やガードが失敗した理由をデバッグできます。

### 評価指標デプロイのグローバルモデル

PII検出、プロンプトインジェクション検出、感情分類、毒性分類に必要なデプロイは、 [レジストリのグローバルモデル](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-directory/nxt-global-models.html.md) として使用できます。 次のグローバルモデルを使用できます。

| モデル | タイプ | ターゲット | 説明 |
| --- | --- | --- | --- |
| プロンプトインジェクション分類器 | 二値 | injection | テキストをプロンプトインジェクションまたは正当なものとして分類します。 このガードモデルには、分類するテキストを含むtextという名前の列が1つ必要です。 詳しくは、 deberta-v3-base-injectionモデルの詳細を参照してください。 |
| 毒性分類器 | 二値 | toxicity | テキストを有毒か無毒に分類します。 このガードモデルには、分類するテキストを含むtextという名前の列が1つ必要です。 詳しくは、 toxic-comment-modelの詳細を参照してください。 |
| センチメント分類器 | 二値 | sentiment | テキストのセンチメントを肯定的か否定的に分類します。 このモデルには、分類するテキストを含むtextという名前の列が1つ必要です。 詳しくは、 distilbert-base-uncased-finetuned-sst-2-englishモデルの詳細を参照してください。 |
| 感情分類器 | 多クラス | target | テキストを感情で分類します。 これは多ラベルモデルです。つまり、複数の感情をテキストに適用できます。 このモデルには、分類するテキストを含むtextという名前の列が1つ必要です。 詳しくは、 roberta-base-go_emotions-onnxモデルの詳細を参照してください。 |
| 拒否スコア | 連続値 | target | プロンプトがモデルに設定されている回答範囲を超えているために、LLMがクエリーへの回答を拒否したケースのリストと、入力を比較して、最大類似度スコアを出力します。 |
| PresidioのPII検出 | 二値 | contains_pii | テキスト内の個人を特定できる情報（PII）を検出して置き換えます。 このガードモデルには、分類するテキストを含むtextという名前の列が1つ必要です。 必要に応じて、検出するPIIのタイプをコンマ区切りの文字列として列'entities'に指定できます。 この列が指定されていない場合は、サポートされているすべてのエンティティが検出されます。 エンティティのタイプは、PresidioがサポートするPIIエンティティのドキュメントに記載されています。 検出結果に加えて、モデルはanonymized_text列を返します。この列には、検出されたPIIがプレースホルダーに置き換えられた更新バージョンの入力が含まれています。 詳細については、Presidio: Data Protection and De-identification SDKのドキュメントを参照してください。 |
| ゼロショット分類器 | 二値 | target | ユーザー指定のラベルを持つテキストに対してゼロショット分類を実行します。 このモデルでは、textという名前の列に分類されたテキストが必要であり、labelsという名前の列にコンマ区切りの文字列としてクラスラベルが必要です。 すべての行に同じラベルセットが必要であるため、最初の行にあるラベルが使用されます。 詳しくは、 deberta-v3-large-zeroshot-v1モデルの詳細を参照してください。 |
| Pythonダミー二値分類 | 二値 | target | Positiveクラスでは、常に0.75となります。 詳しくは、 python3_dummy_binaryモデルの詳細を参照してください。 |

## 評価およびモデレーションガードレールの表示

ガードレールを含むテキスト生成モデルが登録およびデプロイされると、 [登録済みモデルの概要](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-model-directory/nxt-view-manage-reg-models.html.md#view-version-details) タブと [デプロイの概要](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-overview/nxt-overview.html.md) タブで設定済みのガードレールを表示できます。

**レジストリ:**
[https://docs.datarobot.com/ja/docs/images/nxt-evaluation-moderation-reg-overview.png](https://docs.datarobot.com/ja/docs/images/nxt-evaluation-moderation-reg-overview.png)

**コンソール:**
[https://docs.datarobot.com/ja/docs/images/nxt-evaluation-moderation-deploy-overview.png](https://docs.datarobot.com/ja/docs/images/nxt-evaluation-moderation-deploy-overview.png)


> [!NOTE] 評価とモデレーションのログ
> 評価とモデレーションが設定されたデプロイ済みLLMの [アクティビティログ > モデレーション](https://docs.datarobot.com/ja/docs/workbench/nxt-console/nxt-activity-log/nxt-moderation.html.md) タブで、デプロイの評価とモデレーションに関連するイベントの履歴を表示して、デプロイに設定された評価やモデレーションに関する問題を診断できます。
