このページでは

For AI agents: a documentation index is available at /docs/llms.txt. Append .md to any page URL for markdown, or send Accept: text/markdown.

プロフィール

プロファイルは、データウェアハウスからのカスタマープロファイルデータと、Amplitudeにすでに存在するプロダクトの行動データとを結合します。

プロファイルはスタンドアロンのプロパティとして機能します。 それぞれが特定のイベントではなくユーザープロフィールに関連付けられているため、従来のユーザープロパティとは異なり、より広範な分析をサポートしています。

プロファイルには、常にウェアハウスから同期された最新のデータが表示されます。

プロファイルは、傾向スコアやアカウント階層など、ユーザー属性の現在の値が必要な場合に使用します。 収益やヘルススコアなど、時間とともに変化する事前計算済みのメトリック値をインポートするには、代わりに入力メトリックを使用してください。

始める前に

Snowflakeを使用しているかDatabricksを使用しているかにかかわらず、変更データキャプチャ(CDC)は既存のテーブルの置換をサポートしていません。 代わりに、増分モデリングを使用する必要があります。 統合しているテーブルでデータが削除および置換されると、接続が切断されます。

プロファイルの制限

各プロファイルは user_id を参照する必要があります。

Snowflakeユーザー

このテーブルからデータを初めてインポートする場合は、以下のコマンドを使用してデータのリテンション期間を設定し、Snowflakeで変更追跡を有効にしてください。

sql
ALTER TABLE DATAPL_DB_STAG.PUBLIC.PROFILES_PROPERTIES_TABLE_1 SET DATA_RETENTION_TIME_IN_DAYS = 7;

ALTER TABLE DATAPL_DB_STAG.PUBLIC.PROFILES_PROPERTIES_TABLE_1 SET CHANGE_TRACKING = TRUE;

Snowflake Standard Editionプランの場合、最大リテンション期間は1日です。このプランをご利用の場合は、後の手順で頻度を 12 時間に設定してください。

Databricksユーザー

変更追跡を有効にするには、次の手順に従ってください。

  • 新しいテーブルを扱う場合は、CREATE TABLEコマンドでテーブルプロパティdelta.enableChangeDataFeed = trueを設定します: CREATE TABLE student (id INT, name STRING, age INT) TBLPROPERTIES (delta.enableChangeDataFeed = true)

    すべての新しいテーブルに対してspark.databricks.delta.properties.defaults.enableChangeDataFeed = trueも設定してください。

  • 既存のテーブルを扱う場合は、ALTER TABLEコマンドでテーブルプロパティdelta.enableChangeDataFeed = trueを設定します。 ALTER TABLE myDeltaTable SET TBLPROPERTIES (delta.enableChangeDataFeed = true)

データのリテンション期間を設定します。この期間は少なくとも1日である必要がありますが、ほとんどの場合、この期間は7日以上に設定してください。リテンション期間が短すぎると、インポート プロセスが失敗する可能性があります。

プロフィールの設定(Snowflakeユーザー)

Amplitudeでプロフィールを設定するには、以下の手順に従ってください。

  1. Amplitude データで、接続概要に移動します。次に、ソースパネルでさらに追加をクリックします。Snowflakeタイルが見つかるまで下にスクロールし、それをクリックします。

  2. [接続の設定] タブで、Snowflake データインポートガイドに記載されている [Snowflake 認証情報] の下のすべての関連フィールドに記入することにより、Amplitude をデータウェアハウスに接続します。新しい接続を作成することも、既存の接続を再利用することもできます。 完了したら「次へ」をクリックします。

  3. テーブルのリストは、「テーブルの選択」の下にあります。 列マッピングを開始するには、目的のテーブルをクリックします。

  4. *「列マッピング」*の下の必須フィールドのリストで、該当するフィールドに列名を入力して、列と必須フィールドを一致させます。フィールドをさらに追加するには、**[+ フィールドを追加] **をクリックします。

  5. [データの選択] タブで、profilesデータ型を選択します。Amplitudeは、必要な変更データキャプチャのインポート戦略を事前に選択します。これは、*「インポート戦略の選択」*ドロップダウンの下に表示されます。

    • 挿入:常にオンで、テーブルに追加されたときに新しいプロファイルを作成します。
    • 更新: テーブルからAmplitudeへの値の変更を同期します。
    • 削除:テーブルからの削除をAmplitudeに同期します。
  6. 完了したら、**[マッピングのテスト]**をクリックしてマッピング情報を確認します。次に、次へをクリックします。

  7. ソースに名前を付け、Amplitudeがデータウェアハウスからプロファイルを更新する頻度を設定します。 Snowflake Standard Editionを使用している場合は、この頻度を12時間に設定してください。

プロフィールの設定(Databricksユーザー)

Amplitudeでプロフィールを設定するには、以下の手順に従ってください。

  1. Amplitude データで、接続概要に移動します。次に、ソースパネルでさらに追加をクリックします。Databricksタイルが見つかるまでスクロールダウンし、それをクリックします。

  2. Set Up Connectionタブで、Amplitudeをデータウェアハウスに接続します。次の情報を準備してください。

    • サーバーホスト名:Databricksクラスターのホスト名です。これは、クラスター構成内で「*詳細オプション」>「JDBC/ODBC」>「サーバーホスト名」*に移動することで確認できます。
    • HTTPパス:接続したいクラスターのHTTPパスです。これは、クラスター構成の「詳細オプション」>「JDBC/ODBC」>「HTTP パス」に移動して確認できます。
    • パーソナル・アクセストークン:パーソナル・アクセストークンを使用して、Databricksクラスターとの認証を行います。作成方法については、こちらをご覧ください。

    完了したら「次へ」をクリックします。

  3. テーブルのリストは、「テーブルの選択」の下にあります。 列マッピングを開始するには、目的のテーブルをクリックします。

  4. *「列マッピング」*の下の必須フィールドのリストで、該当するフィールドに列名を入力して、列と必須フィールドを一致させます。フィールドをさらに追加するには、**[+ フィールドを追加] **をクリックします。

  5. *「データ選択」*タブで、profilesデータ型を選択します。

  6. 完了したら、**[マッピングのテスト]**をクリックしてマッピング情報を確認します。次に、次へをクリックします。

  7. ソースに名前を付け、Amplitudeがデータウェアハウスからプロファイルを更新する頻度を設定します。 デフォルトの頻度は12時間ですが、変更できます。

プロファイルの設定(S3ユーザー)

Amplitudeでプロファイルを設定するには:

  1. Amplitudeで、データ > ソースに移動し、+ ソースを追加をクリックします。Amazon S3を見つけてクリックします。

  2. AmplitudeをS3バケットに接続します。 AmplitudeにS3バケットへのアクセスを許可する方法の詳細については、「Amazon S3」を参照してください。 さらに、「Verify Instrumentation」タブに次の情報を用意してください。

    • バケット名とプロファイルが保存されているプレフィックスです。
    • AWS ロール ARN、AWS 外部 ID、AWS リージョン。

    「資格情報をテスト」をクリックしてAmplitudeがS3バケットにアクセスできることを確認し、「次へ」をクリックしてソースに名前を付けます。

  3. *「ファイルの選択」*タブでファイルの種類を選択し、**「プレビューを表示」をクリックしてインポートするファイルを確認してから、「次へ」**をクリックします。

  4. 「コンバータの設定」タブで、「プロファイル」データタイプを選択します。 user_idおよびmutation_typeのソースフィールドを記入し、必要に応じてプロパティを追加します。「データプレビュー」セクションには、Amplitudeが取り込むように設定されているものの例が表示されています。

    • mutation_type以下の文字列のいずれかと完全に一致する必要があります。そうしないと、Amplitudeはプロファイルを取り込みません。
      • INSERT 新しいファイルを作成するとき。
      • UPDATE 新しい値を同期する場合。
      • DELETE プロファイルを削除します。
  5. 完了したら、[保存と有効化] をクリックしてプロファイルのインポートと更新を有効にします。

データ仕様

例:

json
{
  "user_id": 12345,
  "number of purchases": 10,
  "title": "Data Engineer"
}

Snowflakeプロファイルに関する情報については、こちらの記事を参照してください。

SQLテンプレート

sql
SELECT
         AS "user_id",
         AS "profile_property_1",
         AS "profile_property_2"
FROM DATABASE_NAME.SCHEMA_NAME.TABLE_OR_VIEW_NAME

プロファイル値を消去する

データウェアハウス内のプロファイル値を削除すると、それらの値は次回の同期操作時にAmplitudeに同期されます。 Amplitudeデータを使用して、Amplitudeのユーザーから未使用のプロパティフィールドを削除することもできます。

サンプルクエリ

sql
SELECT
	user_id as "user_id",
	upgrade_propensity_score as "Upgrade Propensity Score",
	user_model_version as "User Model Version"
FROM
	ml_models.prod_propensity_scoring
sql
SELECT
	m.uid as "user_id",
	m.title as "Title",
	m.seniority as "Seniority",
	m.dma as "DMA"
FROM
	prod_users.demo_data m

これは役に立ちましたか?