# レジストリのデータを探索

> レジストリのデータを探索 - 個々のデータセットを開いて、データセットのプレビュー、メタデータ、インサイト、バージョン履歴、関連アセットを表示します。

This Markdown file sits beside the HTML page at the same path (with a `.md` suffix). It summarizes the topic and lists links for tools and LLM context.

Companion generated at `2026-07-27T18:44:30.770015+00:00` (UTC).

## Primary page

- [レジストリのデータを探索](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md): Full documentation for this topic (Markdown sidecar).

## Sections on this page

- [メタデータ情報](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#metadata-info): In-page section heading.
- [個人データ検出](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#personal-data-detection): In-page section heading.
- [インパクト分析](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#impact-analysis): In-page section heading.
- [プロフィール](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#profile): In-page section heading.
- [特徴量セット](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#feature-lists): In-page section heading.
- [単一の特徴量を変換](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#transform-single-features): In-page section heading.
- [バージョン履歴](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#version-history): In-page section heading.
- [スナップショットを更新](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#renew-snapshot): In-page section heading.
- [更新タスクのスケジュール](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#schedule-refresh-tasks): In-page section heading.
- [カレンダーピッカーの使用](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#use-the-calendar-picker): In-page section heading.
- [スケジュール済みタスクの操作](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#work-with-scheduled-tasks): In-page section heading.
- [更新制限設定](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#refresh-limit-settings): In-page section heading.
- [コメント](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#comments): In-page section heading.

## Documentation content

データの登録が完了したら、データセットを選択してさまざまなインサイトを表示し、データセットを操作できます。 ここでは以下の操作を行うことができます。

|  | 要素 | 説明 |
| --- | --- | --- |
| (1) | ナビゲーションタブ | データセットのさまざまな側面を調べます：情報：サマリー情報を表示し、個人データの検出を実行したり、スナップショットを更新したりすることができます。プロフィール：データセットの列名と行データをプレビューします。特徴量セット：新しい特徴量セットと変換を作成します。バージョン履歴：選択したアセットのすべてのバージョンを一覧表示します。コメント：選択したアセットにコメントやメモを追加します。 |
| (2) | スナップショットポリシー | アセットのスナップショットポリシーを表示します。 |
| (3) | アクションメニュー | 以下のことができます：スナップショットの作成：ソースからデータを抽出して、新しいスナップショットを作成します。データセットのダウンロード：データセットを.csvとしてダウンロードします。削除：データレジストリおよびリンクされたすべてのユースケースからアセットを削除します。 |
| (4) | 共有 | アセットを他のユーザー、グループ、組織と共有します。 |
| (5) | ユースケースへのリンク | アセットをユースケースに追加したり、アセットの現在のリンク先であるユースケースを管理したりできます。 |

データレジストリには2種類のデータが保存されています。

- マテリアライズされたデータ： このデータセットには「静的」、「スナップショット」、または「Spark」バッジが付いています。 インポート時の登録プロセスの一部として、データセットに対しEDA1が実行されるため、さらに多くのインサイトが得られます。
- マテリアライズされていないデータ： このデータセットに「動的」バッジが付いています。 これは、データ接続を使用して追加され、現在もデータソースに保存されているデータです。 インポート時にサンプルに対してEDA1を実行することを選択しなかった場合、取得できるインサイトは少なくなります。

## メタデータ情報

情報 タブでは、データセットの概要を確認したり、識別情報を追加したり、インパクト分析を参照したりできます。

|  | 要素 | 説明 |
| --- | --- | --- |
| (1) | 詳細情報 | 名前と説明を更新するか、検索に使用するタグを追加します。 |
| (2) | データセット情報 | 行数、その右に特徴量数、およびその他の詳細が表示されます。 |
| (3) | 検出を実行する | 個人データ検出を実行して、データセットから個人データを識別し、検出された場合は削除します。 |
| (4) | SQLクエリー | データセットの作成に使われたSQLクエリー。 |
| (5) | スナップショットを更新 | スケジュールされたスナップショットを追加します。 |
| (6) | インパクト分析 | DataRobotの他のエンティティが現在のアセットにどのように関連しているか、つまり依存しているかを確認します。 |

### 個人データ検出

規制された特定のユースケースでは、個人情報をモデルの特徴量として使用することは禁止されています。 DataRobotは、特定の種類の個人情報の検出を自動化して、データセットにこの情報が誤って含まれないように保護するレイヤーを提供し、モデリングおよび予測時に使用されないようにします。

データセットがデータレジストリを通して取り込まれた後、各特徴量に個人情報が存在するかどうかをチェックするオプションがあります。 その結果、データセットのすべてのセルを、この種の情報を識別するためにDataRobotが開発したパターンと照合する処理が行われます。 見つかった場合、警告メッセージが表示され、各特徴量で検出された個人情報の種類を知らせるとともに、今後どのように進めるかを決めるのに役立つサンプル値を提供します。 さらに、DataRobotは新しい特徴量セットを作成します。これは 有用な特徴量 と同等ですが、個人情報を含む特徴量がすべて削除されています。 新しいセットの名前は 有用な特徴量 - 個人情報を削除 です。

> [!WARNING] 注意
> このツールは個人データのすべてのインスタンスを識別することを保証するものではありません。 これは、自身の個人データ検出制御を補足することを目的としています。

現在、DataRobotは次のフィールドでの検出をサポートしています。

- Eメールアドレス
- IPv4アドレス
- 米国の電話番号
- 社会保障番号

データレジストリのデータセットで個人情報の検出を実行するには、 情報 ページに移動して 検出を実行する をクリックします。

- データセットで個人情報が検出されなかった場合、その旨のメッセージが表示されます。
- データセット内で個人データが検出されると注意メッセージが表示されます。詳細をクリックすると、検出された個人データに関する詳細情報が表示されます。却下をクリックすると、注意が消えて再度表示されなくなります。 警告は、プロフィールタブの列でも強調表示されます。

### インパクト分析

インパクト分析では、アプリケーション内の他のエンティティが現在のアセットにどのように関連しているか、つまり依存しているかを示します。 これはいくつかの理由で役立ち、次のことが可能になります。

- 項目が使用されているプロジェクトの数に基づいて、その項目の人気度を表示できます。
- 変更または削除を行った場合に影響を受ける可能性のある他のエンティティを把握できます。
- エンティティがどのように使用されているかを把握できます。

インパクト分析を見るには、 情報 タブの一番下までスクロールします。 タイルをクリックしてサマリーの詳細を表示し、関連するボタン（以下の例では ユースケースを開く ）をクリックして特定の詳細を表示します。

アセットにアクセスする権限がない場合は、アセットを表すエントリを表示できますが、エントリは追加情報を開示しません。

必要に応じて、次のすべての関連付けが（頻度値とともに）報告されます。

- プロジェクト
- 予測データセット
- 特徴量探索に関する設定
- 時系列カレンダー
- Spark SQLクエリー
- 外部モデルパッケージ
- デプロイの再トレーニング

この機能は、個々のデータセットバージョンの バージョン履歴 タブからも利用できます。

## プロフィール

プロフィール タブを使用して、データセットの列名と行データをプレビューできます。 列名の検索や確認に利用できます。

> [!NOTE] 情報タブとプロフィールタブ
> 情報 タブには、データの合計行数、特徴量数、サイズが表示されます。 プロフィール タブには、1MBの未処理サンプルに基づくデータのみプレビュー表示されますが、特徴量の型と詳細は500MBのサンプルに基づいて表示されます。 つまり、 プロフィール タブに表示される行数は、 情報 タブに表示される行数と一致しない場合があります。

プレビューは最大1MBのデータのランダムなサンプルであり、元のデータの順序とは異なる場合があります。 元の全データを確認するには、 データセットをダウンロード オプションを使用します。

特定の特徴量の詳細を表示するには、画面上で目的の特徴量にスクロールしてクリックします。

## 特徴量セット

データレジストリ内の任意のデータセットの特徴量に対して、新しい特徴量セットと特徴量変換を作成できます。 そのためには、データレジストリでデータセットを選択し、左側のナビゲーションパネルで 特徴量セット を選択します。

特徴量セットおよびカスタム特徴量セットの作成については、 [特徴量セット](https://docs.datarobot.com/ja/docs/reference/pred-ai-ref/custom-list-ref.html.md) のリファレンスページを参照してください。

|  | 要素 | 説明 |
| --- | --- | --- |
| (1) | 特徴量セットのドロップダウン | DataRobotが生成した、またはカスタムの特徴量セットのリストを表示します。 |
| (2) | 名前の変更 / 削除 | 特徴量セットのドロップダウンで選択したカスタム特徴量セットの名前を変更または削除します。 DataRobotのデフォルトの特徴量セットに変更を加えることはできません。 |
| (3) | 検索 | 特定の特徴量を検索します。 |
| (4) | + 選択内容から特徴量セットを新規作成 | 現在選択されている特徴量から新しい特徴量セットを作成します。 |
| (5) | 特徴量の変換を作成 | 特徴量の型を変更します。 |

#### 単一の特徴量を変換

また、 特徴量セット タブでは、単一の特徴量の型を変換するためのツールも利用できます。 概念やワークフローなど、詳細については、 [特徴量を変換する](https://docs.datarobot.com/ja/docs/workbench/nxt-workbench/dataprep/transform-features.html.md) を参照してください。

## バージョン履歴

バージョン履歴 タブでは、選択したアセットのすべてのバージョンを一覧表示します。

|  | 要素 | 説明 |
| --- | --- | --- |
| (1) | + データセットのリフレッシュをスケジュール | スケジュールされたスナップショットを追加します。 |
| (2) | データセットのバージョン情報 | 個々のデータセットバージョンについて、行数、その右に特徴量数、およびその他の詳細が表示されます。 |
| (3) | スナップショットのステータス | データセットバージョンのスナップショットステータス。正常に完了した場合は緑、失敗した場合は赤、元のバージョンにスナップショットがない場合はグレー。 |
| (4) | アクションメニュー | データセットのバージョンをダウンロードまたは削除できます。 |

### スナップショットを更新

> [!NOTE] 本機能の提供について
> セルフマネージドAIプラットフォームでのインストールの場合、モデル管理サービスもインストールする必要があります。

必要に応じてデータセットが常にデータソースと同期できるように、DataRobotでは自動化されたスケジュールされた更新メカニズムが提供されています。 データレジストリでは、 [コンシューマー](https://docs.datarobot.com/ja/docs/reference/misc-ref/roles-permissions.html.md) レベルより上のデータセットアクセス権を持つユーザーであれば、スナップショットを日単位、週単位、月単位、年単位でスケジュールできます。 ファイルを除く任意のデータアセットタイプ（JDBC、Spark、およびURL）を更新できます。

#### 更新タスクのスケジュール

複数の更新タスクをスケジュールできます。 [制限](https://docs.datarobot.com/ja/docs/workbench/nxt-registry/nxt-data-registry/nxt-explore-data.html.md#refresh-limit-settings) はデータセットとユーザーに個別に適用されます。

データセットのスナップショットをスケジュールするには：

1. データレジストリから、1つ以上の更新タスクをスケジュールしたいアセットを選択します。
2. 更新をスケジュールリンクをクリックしてスケジューラーを展開します。
3. アセットソースがJDBCの場合、ログインダイアログが表示されます。 アセットに関連付けられているアカウント資格情報を選択します。 DataRobotは、スケジュール済みタスクを実行するたびにこれらの資格情報を使用します。 資格情報が受け入れられると（または資格情報が必要ない場合も）、スケジューラーが開きます。
4. フィールドに入力してタスクを設定します。 要素説明1名前更新ジョブの名前を入力します（またはデフォルトのままにします）。2カレンダーピッカー間隔設定の基準を設定します。3間隔カレンダー設定に基づいて、間隔のドロップダウンで頻度を毎日、毎週、毎月、または毎年に設定します。 選択した日の時刻は、ジョブがスケジュールされたときのタイムスタンプに常に設定されます。4サマリー選択されたスケジュール済みタスクのサマリー（間隔、アクティブか一時停止中かなど）が表示されます。この情報はDataRobotから提供され、ジョブに変更を加えると更新されます。
5. 保存をクリックしてアセットの更新をスケジュールします。 最後の実行ステータスは、スケジュールされたジョブ名でレポートされます。

#### カレンダーピッカーの使用

カレンダーピッカーを使用して、更新の曜日、月の日付、または年の日の基準となる日付を選択します。

更新は（設定された時間に応じて）特定の日付またはそれ以降に開始されます。 たとえば、1月27日が選択されている場合、更新の開始は次のようになります。

- その日または翌日（1月27日）の タイムスタンプ の時間に毎日
- 毎週の特定の曜日（毎週月曜の タイムスタンプ の時刻）。
- 毎月のその日（毎月27日の タイムスタンプ の時刻)
- 毎年のその日（毎年1月27日の タイムスタンプ の時刻）。

タイムピッカーをクリックします。 矢印を使用して時間を変更し、スナップショットを更新する現地時間にタイムスタンプを設定します。 全体のカレンダービューに戻るには、日付をクリックします。

#### スケジュール済みタスクの操作

スケジュールすると、さまざまな方法でタスクを変更できます。 タスクに関連付けられたアクションメニューを使用して、オプションにアクセスします。

| オプション | 説明 |
| --- | --- |
| ジョブを一時停止 | スケジュール済みタスクを無期限に一時停止します。 一時停止すると、「スケジュール済み」ラベルが「一時停止」に変わり、メニュー項目が「ジョブを再開」に変わります。 スケジュール済みタスクを再度有効にするには、このアクションを使用します。 一時停止されたジョブはタスク制限の対象ではなくなります。 |
| 編集 | スケジューラーのインターフェイスを使用してタスク設定を変更できます。 |
| 資格情報を管理 | 資格情報の選択モーダルが開き、データセットに関連付けられた資格情報を変更できます。 |
| 削除 | スケジュールされたタスクを削除します。 |

#### 更新制限設定

更新に関連するアクティビティのデフォルトと最大値を次の表に示します。

> [!NOTE] 本機能の提供について
> この表に示されているデフォルト値は、マネージドAIプラットフォームでの値です。 セルフマネージドAIプラットフォームでは、最大値がデフォルトです。

| パラメーター | 説明 | デフォルト | Maximum（最大） |
| --- | --- | --- | --- |
| ユーザーに対して有効化されたデータセット更新ジョブ | データレジストリの全データセットでユーザーが保持できる更新ジョブの合計数。 | 100 | 100 |
| データセットに対して有効化されたデータセット更新ジョブ | 特定のデータセットで全ユーザーを対象として存在できる更新ジョブの合計数。 | 5 | 100 |
| データセットの更新ジョブが自動的に無効になるまで保存されるスナップショット | 特定のデータセットにおいて、更新ジョブが自動的に無効になるまで、そのデータセットで存在できる保存済みスナップショットの合計数。 | 100 | 1000 |

## コメント

コメント タブでは、データレジストリ内のアクセス可能な任意のアセットにコメントを追加したり、そのアセットに関するディスカッションを開始したりすることができます。 コメントを使用すると、以下の操作を行うことができます。

- コメントで他のユーザーにタグを付けます。タグ付けしたユーザーにはDataRobotからメール通知が送信されます。
- 追加したコメントを編集または削除します（他のユーザーのコメントを編集または削除することはできません）。
