

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

# サードパーティーの入力データの準備
<a name="prepare-third-party-input-data"></a>

サードパーティーのデータサービスは、既知の識別子と照合できる識別子を提供します。

AWS Entity Resolution は現在、以下のサードパーティーのデータプロバイダーサービスをサポートしています。


**データプロバイダーサービス**  

| 会社名 | 使用可能 AWS リージョン | 識別子 | 
| --- | --- | --- | 
| LiveRamp | 米国東部 (バージニア北部) (us-east-1)、米国東部 (オハイオ) (us-east-2)、米国西部 (オレゴン) (us-west-2) | ランプ ID | 
| TransUnion | 米国東部 (バージニア北部) (us-east-1)、米国東部 (オハイオ) (us-east-2)、米国西部 (オレゴン) (us-west-2) | TransUnion 個人 ID と世帯 IDs | 
| 統合 ID 2.0 | 米国東部 (バージニア北部) (us-east-1)、米国東部 (オハイオ) (us-east-2)、米国西部 (オレゴン) (us-west-2) | raw UID 2 | 

次の手順では、[プロバイダーのサービスベースのマッチングワークフロー](glossary.md#provider-service-matching)または[プロバイダーのサービスベースの ID マッピングワークフロー](create-IDMW-provider-services-one-acct.md)を使用するようにサードパーティーデータを準備する方法について説明します。

**Topics**
+ [ステップ 1: でプロバイダーサービスをサブスクライブする AWS Data Exchange](#subscribe-provider-service)
+ [ステップ 2: サードパーティーのデータテーブルを準備する](#prepare-third-party-data-tables)
+ [ステップ 3: 入力データテーブルをサポートされているデータ形式で保存する](#save-third-party-data-tables)
+ [ステップ 4: 入力データテーブルを Amazon S3 にアップロードする](#upload-third-party-data-tables)
+ [ステップ 5: AWS Glue テーブルを作成する](#create-glue-table-third-party-data-tables)

## ステップ 1: でプロバイダーサービスをサブスクライブする AWS Data Exchange
<a name="subscribe-provider-service"></a>

を通じてプロバイダーサービスのサブスクリプションをお持ちの場合は AWS Data Exchange、次のいずれかのプロバイダーサービスで一致するワークフローを実行して、既知の識別子を任意のプロバイダーと一致させることができます。データは、優先プロバイダーによって定義された一連の入力と照合されます。

でプロバイダーサービスをサブスクライブするには AWS Data Exchange

1. プロバイダーのリストを表示します AWS Data Exchange。次のプロバイダーリストを利用できます。
   + LiveRamp
     + [LiveRamp ID の解決](https://aws.amazon.com/marketplace/pp/prodview-v4557zxjo6ykq)
     + [LiveRamp のトランスコーディング](https://aws.amazon.com/marketplace/pp/prodview-bpp2fvfcxk2kg)
   + TransUnion
     + TruAudience アイデンティティ解決とエンリッチメント
   + 統合 ID 2.0
     + [統合 ID 2.0 アイデンティティ解決](https://aws.amazon.com/marketplace/pp/prodview-66zqls7iqsm6o?sr=0-4&ref_=beagle&applicationId=AWSMPContessa#offers)

1. オファータイプに応じて、次のいずれかの手順を実行します。
   + **プライベートオファー** – プロバイダーと既存の関係がある場合は、*AWS Data Exchange 「 ユーザーガイド*[」の「プライベート製品とオファー](https://docs.aws.amazon.com/data-exchange/latest/userguide/subscribe-to-private-offer.html)」の手順に従って、プライベートオファーを受け入れます AWS Data Exchange。
   + **独自のサブスクリプションを使用する** – プロバイダーに既存のデータサブスクリプションがある場合は、 *AWS Data Exchange ユーザーガイド*の [Bring Your Own Subscription (BYOS) オファー](https://docs.aws.amazon.com/data-exchange/latest/userguide/subscribe-to-byos-offer.html)手順に従って BYOS オファーを受け入れます AWS Data Exchange。

1. でプロバイダーサービスをサブスクライブしたら AWS Data Exchange、そのプロバイダーサービスで一致するワークフローまたは ID マッピングワークフローを作成できます。

APIs*AWS Data Exchange 「 ユーザーガイド*」の[「API 製品へのアクセス](https://docs.aws.amazon.com/data-exchange/latest/userguide/subscribing-to-product.html#use-API-product)」を参照してください。

## ステップ 2: サードパーティーのデータテーブルを準備する
<a name="prepare-third-party-data-tables"></a>

各サードパーティーサービスには、マッチングワークフローを成功させるのに役立つ推奨事項とガイドラインのセットがあります。

サードパーティーのデータテーブルを準備するには、次の表を参照してください。


**データプロバイダーサービスのガイドライン**  

| プロバイダーサービス | 一意の ID が必要ですか? | アクション | 
| --- | --- | --- | 
| LiveRamp | はい | 以下のことを確認してください。+  [一意の ID](glossary.md#unique-id-defn) は、独自の仮名識別子または行 ID のいずれかです。 <br />+  データ入力ファイルの形式と正規化は、LiveRamp ガイドラインに準拠しています。 <br />一致するワークフローの入力ファイルフォーマットガイドラインの詳細については、LiveRamp ドキュメントの[「ADX によるアイデンティティ解決の実行](https://docs.liveramp.com/identity/en/perform-identity-resolution-through-adx.html)」を参照してください。 <br />ID マッピングワークフローの入力ファイルフォーマットガイドラインの詳細については、LiveRamp ドキュメントの[「ADX によるトランスコーディングの実行](https://docs.liveramp.com/identity/en/perform-transcoding-through-adx.html)」を参照してください。  | 
| TransUnion | はい | 入力ビューの`string`型列が以下であることを確認します。+  [一意の ID](glossary.md#unique-id-defn) は必須であり、CRM ID、連絡先 ID、ユーザー ID、または任意の一意の ID にすることができます。 <br />+  **Name**   **First Name** は小文字でも大文字でもかまいません。ニックネームはサポートされていますが、タイトルとサフィックスは除外する必要があります。   **Last Name** は小文字でも大文字でもかまいません。ミドルネームは除外します。   <br />+  **Address**   **Street address1** と **Street address1** は、存在する場合は 1 **Full address** 行にまとめられます。   **City** は から分離されています**Full address**。   **Zip** (または **zip plus4**)。スペース、ハイフン、空白などの特殊文字は使用できません。データがない場合は null を使用します。   **State** は、大文字で 2 文字のコードとして指定されます。   <br />+    **Phone**   **Phone number** は 10 桁で、スペースやハイフンなどの特殊文字は使用できません。     <br />+  **Email addresses** は、プレーンテキストまたは SHA256-hashed小文字の文字列です。 <br />+  **Date of Birth** は y`yyy-mm-dd` 形式です。 <br />+  **Digital identifiers ** (デバイス IDs) にはIDsハイフン (36 文字長の raw デバイス IDs/MAIDs/IFAs) とハイフン (32 および 40 文字長のハッシュデバイス IDs/MAIDs/IFAs) のない ID を含めることができます。   **IPV4** は、ドット付きの 10 進表記で表される 32 ビット IP アドレスです。例: `192.0.2.1`   **IPV6** は、コロンで区切られた 16 進表記で表される 128 ビット IP アドレスです。例: `2001:db8:0000:0000:0000:0000:0000:0001`   **MAID** (モバイル広告 ID) は、広告目的でモバイルデバイスに割り当てられる一意の英数字の文字列です。MAID は通常 36 文字です。例: `a1b2c3d4-5678-90ab-cdef-EXAMPLE11111`    | 
| 統合 ID 2.0 | はい | 以下のことを確認してください。+  [一意の ID](glossary.md#unique-id-defn) をハッシュにすることはできません。 <br />+  スキーマでは、両方ではなく、 **Phone number **または のいずれか**Email addresses** が使用されます。 <br />+  UID2 は、UID2 生成用の E メールと電話番号の両方をサポートしています。ただし、両方の値がスキーママッピングに存在する場合、ワークフローは出力の各レコードを複製します。1 つのレコードは UID2 の生成に E メールを使用し、2 番目のレコードは電話番号を使用します。データに E メールと電話番号が混在していて、出力にこのレコードの重複を希望しない場合は、それぞれに個別のスキーママッピングを使用して個別のワークフローを作成するのが最善の方法です。このシナリオでは、ステップを 2 回実行します。E メールの場合は 1 つのワークフローを作成し、電話番号の場合は別のワークフローを作成します。  特定の E メールまたは電話番号は、リクエストを行ったユーザーに関係なく、任意の時点で同じ raw UID2 値になります。 <br />Raw UID2sは、1 年に約 1 回ローテーションされるソルトバケットからソルトを追加することで作成され、それに伴って raw UID2 もローテーションされます。異なるソルトバケットは年間を通じて異なる時間にローテーションされます。 AWS Entity Resolution は現在、ローテーションするソルトバケットと未加工UID2s を追跡しないため、未加工の UID2s毎日再生成することをお勧めします。詳細については、[「増分更新のために UID2s」を参照してください。](https://unifiedid.com/docs/getting-started/gs-faqs#how-often-should-uid2s-be-refreshed-for-incremental-updates) 「UID 2.0 ドキュメント」を参照してください。  | 

## ステップ 3: 入力データテーブルをサポートされているデータ形式で保存する
<a name="save-third-party-data-tables"></a>

サポートされているデータ形式でサードパーティーの入力データを既に保存している場合は、このステップをスキップできます。

を使用するには AWS Entity Resolution、入力データが が AWS Entity Resolution サポートする形式である必要があります。

AWS Entity Resolution は、次のデータ形式をサポートしています。
+ カンマ区切り値 (CSV)
**注記**  
LiveRamp は CSV ファイルのみをサポートします。
+ Parquet

## ステップ 4: 入力データテーブルを Amazon S3 にアップロードする
<a name="upload-third-party-data-tables"></a>

Amazon S3 にサードパーティーのデータテーブルがすでにある場合は、このステップをスキップできます。

**注記**  
入力データは、S3 がサポートされている商用パーティションの任意のリージョンの Amazon S3 リソースに保存できます。 AWS このデータは、別のリージョンから、または一致するワークフローを実行する AWS アカウント ときにアクセスできます。

**入力データテーブルを Amazon S3 にアップロードするには**

1. にサインイン AWS マネジメントコンソール し、[https://console.aws.amazon.com/s3/](https://console.aws.amazon.com/s3/) で Amazon S3 コンソールを開きます。

1. **バケット**を選択し、データテーブルを保存するバケットを選択します。

1. **[アップロード]** を選択し、プロンプトに従います。

1. **[オブジェクト]** タブを選択し、データが保存されているプレフィックスを表示します。フォルダの名前を書き留めます。

   フォルダを選択して、データテーブルを表示できます。

## ステップ 5: AWS Glue テーブルを作成する
<a name="create-glue-table-third-party-data-tables"></a>

Amazon S3 の入力データは、 でカタログ化 AWS Glue され、 AWS Glue テーブルとして表される必要があります。Amazon S3 を入力として AWS Glue テーブルを作成する方法の詳細については、「 [AWS Glue デベロッパーガイド」の「コンソールでのクローラの使用](https://docs.aws.amazon.com/glue/latest/dg/console-crawlers.html)*AWS Glue 」を参照してください。*

**注記**  
AWS Entity Resolution はパーティションテーブルをサポートしていません。

このステップでは、S3 バケット内のすべてのファイルをクロールし、 AWS Glue AWS Glue テーブルを作成するクローラを にセットアップします。

**注記**  
AWS Entity Resolution は現在、 に登録されている Amazon S3 ロケーションをサポートしていません AWS Lake Formation。

**AWS Glue テーブルを作成するには**

1. にサインイン AWS マネジメントコンソール し、[https://console.aws.amazon.com/glue/](https://console.aws.amazon.com/glue/) で AWS Glue コンソールを開きます。

1. ナビゲーションバーから、**[クローラ]** を選択します。

1. リストから S3 バケットを選択し、**[クローラを追加]** を選択します。

1. **[クローラを追加]** ページで **[クローラの名前]** を入力し、**[次へ]** を選択します。

1. 引き続き **[クローラを追加]** ページで、詳細を指定します。

1. **[IAM ロールの選択]** ページで **[既存の IAM ロールを選択]** を選択し **[次へ]** 選択します。

   **[IAM ロールを作成する]** を選択することも、必要に応じて管理者に IAM ロールを作成してもらうこともできます。

1. **[このクローラのスケジュールを設定する]** で、**[頻度]** をデフォルト (**[オンデマンドで実行]**) のままにして、**[次へ]** を選択します。

1. **クローラの出力を設定する **で、 AWS Glue データベースを入力し、**次へ** を選択します。

1. 詳細を確認し、**[完了]** を選択します。

1. **[クローラ]** ページで、S3 バケットの横にあるチェックボックスをオンにし、**[クローラの実行]** を選択します。

1. クローラの実行が完了したら、 AWS Glue ナビゲーションバーで**データベース**を選択し、データベース名を選択します。

1. **[データベース]** ページで、**[{データベース名} のテーブル]** を選択します。

   1.  AWS Glue データベース内のテーブルを表示します。

   1. テーブルのスキーマを表示するには、特定のテーブルを選択します。

   1.  AWS Glue データベース名と AWS Glue テーブル名を書き留めます。

これで、スキーママッピングを作成する準備が整いました。詳細については、「[スキーママッピングの作成](create-schema-mapping.md)」を参照してください。