---
title: "DataXrayプラットフォーム：読み取り、分類、処理"
description: "DataXrayはすべてのファイルを読み取り、見つかった内容を分類し、ラベル付け、保持、墨消し、保護を実行します。オンプレミス、クラウド、エアギャップ環境で稼働します。"
url: "https://www.dataxray.io/ja/platform/"
language: "ja"
---

プラットフォーム

# すべてのファイルを読み取り、分類し、実行する

DataXray は、データ環境内のすべてのファイルを扱う、ひとつのプラットフォームです。ネイティブコネクタがファイルのある場所に接続し、多層的な分類が各ファイルの中身を読み取り、単一の検索可能なインデックスが、すでにお使いのセキュリティ、ガバナンス、AI の各ツールへ結果を連携します。

[デモを予約](https://www.dataxray.io/ja/demo/)

プラットフォームの全体像

## データのある場所に DataXray を

DataXray は、閉域のエアギャップ環境を含むお客様の環境の中に導入されます。DataXray 単体で、すべてのファイルを発見から分類まで処理し、その結果をお客様のシステム環境へ連携します。記録管理、情報開示、法務レビュー、AI アクセス、分類体系のためのアドオンモジュールは、その上で動作します。

お客様の環境

- オンプレミス
- クラウド
- ハイブリッド
- エアギャップ

- エージェント不要
- コンテナで提供
- 数時間で稼働
- データは移動しない
- 言語モデルも境界内で実行

プラットフォーム

DataXray

1. あらゆるソースに接続
2. すべてのファイルを読む
3. 中身を分類
4. 既存ツールへ連携

モジュール

- [AI Platform](https://www.dataxray.io/ja/modules/ai-platform/)
- [Compass](https://www.dataxray.io/ja/modules/compass/)
- [Curator](https://www.dataxray.io/ja/modules/curator/)
- [AutoFOIA](https://www.dataxray.io/ja/modules/autofoia/)
- [eDiscovery](https://www.dataxray.io/ja/modules/ediscovery/)

## DataXrayの仕組み

DataXray は4つの段階で動作し、各段階が次の段階につながります。

1. **発見**

   DataXray は、お客様のファイルが存在するシステムに接続し、データ環境全体にわたって、すべてのファイルとその技術メタデータのインベントリを構築します。発見はエージェントレスかつ読み取り専用です。
2. **読み取り**

   各ファイルを開き、テキストを抽出します。OCRによるスキャン画像、階層化された圧縮ファイル、メールの添付ファイルも対象です。数百種類のファイル形式、100を超える言語に対応します。
3. **分類**

   各ファイルに何が含まれているかを判断します。たとえば、個人データ、決済カード番号、医療記録、管理対象非機密情報、知的財産などです。固定ルール、機械学習モデル、言語モデルが連携し、パターンの照合にとどまらず、各文書を文脈の中で読み取ります。お客様独自のカテゴリを追加でき、人による確認（Human-in-the-Loop）で結果を検証します。
4. **実行**

   分類結果を、保存期間ラベルや墨消し（リダクション）に活用できます。また DataXray は、ファイル単位の属性を、すでにお使いのセキュリティ・ガバナンスツールへ連携し、暗号化とアクセス制御はそれらのツールが担います。

## 同種のツールとDataXrayの違い

データマッピングや DLP のツールは、場所とメタデータから機密データがどこに存在しそうかを推定し、マップやアラートの提示で止まります。DataXray はファイルを開き、実際に何が含まれているかを特定したうえで、それに基づいて処理を実行します。ラベル、墨消し（リダクション）、保存期間ルールを確信をもって適用できるのは、それがファイルの中身に基づいている場合だけです。

実績

## 継続的な統制下にある、1BN+ のファイル

- 98.7%
- **分類成功率** テキストベースの英語文書における、文書単位の PII／PCI 検出で測定した値です。 72,000
- **ファイル／時** DataXray は、毎秒数十万（100,000s）語の速度で内容を読み取ります。 55+
- **ネイティブコネクタ** ネイティブコネクタがないソースには汎用コネクタで対応。

## 主な機能

DataXray はデータ環境をスキャンする際、すべてのファイル、そのメタデータ、ファイル内で見つかった内容を記録し、一箇所で検索できるようにします。以下のすべての機能はその記録を基に動作するため、ファイルのスキャンと分類は一度で済み、その結果をセキュリティ、コンプライアンス、ガバナンス、AI の各チームで活用できます。

- **単一の検索可能なインデックス**

  すべてのファイル、そのメタデータ、アノテーション、分類結果が1つのインデックスに格納され、機密度、人物、カテゴリで検索・フィルタリングできます。
- **多層のインテリジェンスで分類**

  事前定義されたアノテーターパックがGDPRやCPRAなどの規制をカバーし、お客様独自のカテゴリ向けにカスタム分類機能や抽出機能を構築できます。
- **文書から構造化データを抽出**

  LLM抽出機能がファイルの内容を構造化されたクエリ可能なフィールドに変換し、分析や検索パイプラインで利用できるようにします。
- **機密コンテンツを墨消し**

  開示、共有、公開のためにテキストを墨消し、匿名化、または仮名化します。
- **保存期間の適用とROTの検出**

  保存期間ラベルの付与と、冗長・陳腐化・不要なデータ（ROT）の検出を行います。
- **お使いのシステム環境への分類結果の連携**

  ファイル単位の属性を、Microsoft Purview MIP、Virtru、Netskope、Box Shield、Collibra、Thales、Atlan へ連携します。Virtru と組み合わせると、保護がファイルとともに移動します。
- **AIが参照できるデータを統制**

  RAGおよびエージェントパイプラインに取り込む前に分類を行い、モデルが参照すべきものだけをインデックス化します。
- **DSAR、訴訟対応のデータ保全、規制対応の根拠を支援**

  ファイルはケースファイルとしてまとめたり、訴訟対応のデータ保全（リーガルホールド）のために保管したり、レポートとして書き出したりできます。 すべての検出結果について、何が見つかったか、どのルールまたはモデルが検出したか、ファイルが最後に確認されたのはいつかが記録されるため、監査証跡として十分に機能します。

DataXray の連携

## ファイルのある場所に接続し、保護の仕組みにつなぐ

DataXray は、お客様がすでに導入しているシステム環境を置き換えるのではなく、その価値を高めます。55種類以上のネイティブコネクタに加え、ユニバーサルコネクタを備えています。ネイティブコネクタが存在しないデータソースについては、Python SDK を使ってエージェントが数日で gRPC 接続を構築できます。REST API により、お客様独自の下流プロセスにも対応できます。インテグレーションを見る。

[すべての連携を見る](https://www.dataxray.io/ja/integrations/)

## 導入

**データのある場所で動作**
DataXray はエージェントレスかつコンテナ化されています。クラウド、ハイブリッド、オンプレミス、完全な閉域環境（エアギャップ）に導入でき、RHEL 上で Podman または Docker を使用し、数時間で運用を開始できます。

**お客様のデータが環境の外に出ない**
DataXray の言語モデルはお客様自身のインフラ上で動作するため、ファイルが分析のために外部へ送られることはありません。DataXray は、初期設定では読み取り専用のアクセス権で各ソースに接続し、DataXray に必要な範囲に限定したアカウントを使用します。

企業・政府機関向け

### ベンダーセキュリティ審査で確認される認証

- DoW ATO

  米国戦争省の3つのネットワークにおける運用認可
- SOC 2 Type 2

  Ohalo Limited、年次監査
- ISO 27001

  情報セキュリティマネジメント
- FIPS

  FIPS 準拠の暗号
- STIG

  STIG 準拠の実装

[セキュリティと信頼を見る](https://www.dataxray.io/ja/security/)

モジュール

## DataXray がすでに読み取ったすべてのファイルの上に

モジュールは、お客様から特に要望の多いワークフローへ DataXray プラットフォームを拡張します。各モジュールは DataXray がすでに読み取り、分類したファイルの上で動作するため、同じファイルを二度読み取ることはありません。どのモジュールも、お客様のチームの進め方に合わせて構成します。

- **[AI Platform](https://www.dataxray.io/ja/modules/ai-platform/)**

  各ユーザーの権限の範囲内で、AI アシスタントがファイルを安全に利用できるようにします。
- **[Compass](https://www.dataxray.io/ja/modules/compass/)**

  データの中身を把握し、それを統制するための分類体系を構築します。
- **[Curator](https://www.dataxray.io/ja/modules/curator/)**

  保存期間、廃棄、記録の取り込みを管理し、すべての判断を改ざん検知可能な監査証跡に記録します。
- **[AutoFOIA](https://www.dataxray.io/ja/modules/autofoia/)**

  FOIA や Privacy Act の請求に、受付から、墨消し済みで Bates 番号付きの開示まで対応します。
- **[eDiscovery](https://www.dataxray.io/ja/modules/ediscovery/)**

  訴訟、規制当局、プライバシーの各請求に向けて、文書を外部に書き出すことなく、レビュー、墨消し、提出を行います。

**[AI Platform](https://www.dataxray.io/ja/modules/ai-platform/)**

各ユーザーの権限の範囲内で、AI アシスタントがファイルを安全に利用できるようにします。

[詳しく見る](https://www.dataxray.io/ja/modules/)

## よくある質問

### DataXray は何をする製品ですか？

DataXray は、エンタープライズのための非構造化データ・インテリジェンス層です。データ環境全体からすべてのファイルを見つけ出し、中身を読み取り、機密データや業務上重要なデータをファイル単位で分類します。そのうえで保存期間ラベルや墨消し（リダクション）を適用でき、その結果は、すでにお使いのセキュリティ、ガバナンス、AI の各ツールへ連携されます。

### DataXray の価値を得るのにモジュールは必要ですか？

いいえ。DataXray は単体で、発見から処理まで行います。モジュールは、統制された AI アシスタントのアクセス、記録管理、訴訟対応のレビューなど、専用のワークフローを必要とするチームのためのアドオンです。DataXray がすでにスキャン・分類したファイルを使うため、モジュールを追加しても新たなスキャンは必要ありません。

### DataXray の分類精度はどの程度ですか？

DataXray の分類成功率は98.7%です（テキストベースの英語文書における、文書単位の PII・PCI 検出で測定した値）。固定ルール、機械学習モデル、言語モデルが各文書を文脈の中で読み取り、お客様独自のルールや人による確認（Human-in-the-Loop）と組み合わせて機能します。

### スキャン速度はどの程度ですか？

DataXray は毎秒数十万語を読み取り、毎分約1,200ファイル、1時間あたり72,000ファイルを処理します。処理パイプラインは水平方向にスケールするため、ペタバイト規模のデータ環境でもスループットを向上させられます。

### 自社のデータが環境の外に出ることはありますか？

ありません。DataXray はお客様の環境内に導入され、閉域のエアギャップ環境にも対応します。お客様のデータが環境の外に出ることはなく、DataXray の言語モデルはお客様自身のインフラ上で動作します。

### 自社のシステム向けのコネクタがない場合はどうなりますか？

DataXray は55種類以上のネイティブコネクタを備えています。ネイティブコネクタが存在しない場合は、汎用コネクタを使ってお客様専用のコネクタを構築できるため、レガシーシステム、個別開発されたシステム、社内で独自開発されたシステムも、例外ではなく対応範囲に含まれます。

## 30分で、ほかのツールがラベルを付けるだけのファイルを DataXray がどう読み取るのかをご覧ください

[デモを予約](https://www.dataxray.io/ja/demo/)

[ドキュメントを見る](https://docs.ohalo.co/)
