For AI agents: a documentation index is available at /docs/llms.txt. Append .md to any page URL for markdown, or send Accept: text/markdown.
プロフィール
プロファイルは、データウェアハウスからのカスタマープロファイルデータと、Amplitudeにすでに存在するプロダクトの行動データとを結合します。
プロファイルはスタンドアロンのプロパティとして機能します。 それぞれが特定のイベントではなくユーザープロフィールに関連付けられているため、従来のユーザープロパティとは異なり、より広範な分析をサポートしています。
プロファイルには、常にウェアハウスから同期された最新のデータが表示されます。
プロファイルは、傾向スコアやアカウント階層など、ユーザー属性の現在の値が必要な場合に使用します。 収益やヘルススコアなど、時間とともに変化する事前計算済みのメトリック値をインポートするには、代わりに入力メトリックを使用してください。
始める前に
Snowflakeを使用しているかDatabricksを使用しているかにかかわらず、変更データキャプチャ(CDC)は既存のテーブルの置換をサポートしていません。 代わりに、増分モデリングを使用する必要があります。 統合しているテーブルでデータが削除および置換されると、接続が切断されます。
プロファイルの制限
| プラン | 制限事項 |
|---|---|
| エンタープライズ | 1か月あたり10億回の操作(挿入/更新/削除) |
| グロース | 1か月あたり3億回の操作(挿入/更新/削除) |
各プロファイルは user_id を参照する必要があります。
Snowflakeユーザー
このテーブルからデータを初めてインポートする場合は、以下のコマンドを使用してデータのリテンション期間を設定し、Snowflakeで変更追跡を有効にしてください。
ALTER TABLE DATAPL_DB_STAG.PUBLIC.PROFILES_PROPERTIES_TABLE_1 SET DATA_RETENTION_TIME_IN_DAYS = 7;
ALTER TABLE DATAPL_DB_STAG.PUBLIC.PROFILES_PROPERTIES_TABLE_1 SET CHANGE_TRACKING = TRUE;
Snowflake Standard Editionプランの場合、最大リテンション期間は1日です。このプランをご利用の場合は、後の手順で頻度を 12 時間に設定してください。
Databricksユーザー
変更追跡を有効にするには、次の手順に従ってください。
新しいテーブルを扱う場合は、
CREATE TABLEコマンドでテーブルプロパティdelta.enableChangeDataFeed = trueを設定します:CREATE TABLE student (id INT, name STRING, age INT) TBLPROPERTIES (delta.enableChangeDataFeed = true)すべての新しいテーブルに対して
spark.databricks.delta.properties.defaults.enableChangeDataFeed = trueも設定してください。既存のテーブルを扱う場合は、
ALTER TABLEコマンドでテーブルプロパティdelta.enableChangeDataFeed = trueを設定します。ALTER TABLE myDeltaTable SET TBLPROPERTIES (delta.enableChangeDataFeed = true)
データのリテンション期間を設定します。この期間は少なくとも1日である必要がありますが、ほとんどの場合、この期間は7日以上に設定してください。リテンション期間が短すぎると、インポート プロセスが失敗する可能性があります。
プロフィールの設定(Snowflakeユーザー)
Amplitudeでプロフィールを設定するには、以下の手順に従ってください。
Amplitude データで、接続概要に移動します。次に、ソースパネルでさらに追加をクリックします。Snowflakeタイルが見つかるまで下にスクロールし、それをクリックします。
[接続の設定] タブで、Snowflake データインポートガイドに記載されている [Snowflake 認証情報] の下のすべての関連フィールドに記入することにより、Amplitude をデータウェアハウスに接続します。新しい接続を作成することも、既存の接続を再利用することもできます。 完了したら「次へ」をクリックします。
テーブルのリストは、「テーブルの選択」の下にあります。 列マッピングを開始するには、目的のテーブルをクリックします。
*「列マッピング」*の下の必須フィールドのリストで、該当するフィールドに列名を入力して、列と必須フィールドを一致させます。フィールドをさらに追加するには、**[+ フィールドを追加] **をクリックします。
[データの選択] タブで、
profilesデータ型を選択します。Amplitudeは、必要な変更データキャプチャのインポート戦略を事前に選択します。これは、*「インポート戦略の選択」*ドロップダウンの下に表示されます。- 挿入:常にオンで、テーブルに追加されたときに新しいプロファイルを作成します。
- 更新: テーブルからAmplitudeへの値の変更を同期します。
- 削除:テーブルからの削除をAmplitudeに同期します。
完了したら、**[マッピングのテスト]**をクリックしてマッピング情報を確認します。次に、次へをクリックします。
ソースに名前を付け、Amplitudeがデータウェアハウスからプロファイルを更新する頻度を設定します。 Snowflake Standard Editionを使用している場合は、この頻度を12時間に設定してください。
プロフィールの設定(Databricksユーザー)
Amplitudeでプロフィールを設定するには、以下の手順に従ってください。
Amplitude データで、接続概要に移動します。次に、ソースパネルでさらに追加をクリックします。Databricksタイルが見つかるまでスクロールダウンし、それをクリックします。
Set Up Connectionタブで、Amplitudeをデータウェアハウスに接続します。次の情報を準備してください。
- サーバーホスト名:Databricksクラスターのホスト名です。これは、クラスター構成内で「*詳細オプション」>「JDBC/ODBC」>「サーバーホスト名」*に移動することで確認できます。
- HTTPパス:接続したいクラスターのHTTPパスです。これは、クラスター構成の「詳細オプション」>「JDBC/ODBC」>「HTTP パス」に移動して確認できます。
- パーソナル・アクセストークン:パーソナル・アクセストークンを使用して、Databricksクラスターとの認証を行います。作成方法については、こちらをご覧ください。
完了したら「次へ」をクリックします。
テーブルのリストは、「テーブルの選択」の下にあります。 列マッピングを開始するには、目的のテーブルをクリックします。
*「列マッピング」*の下の必須フィールドのリストで、該当するフィールドに列名を入力して、列と必須フィールドを一致させます。フィールドをさらに追加するには、**[+ フィールドを追加] **をクリックします。
*「データ選択」*タブで、
profilesデータ型を選択します。完了したら、**[マッピングのテスト]**をクリックしてマッピング情報を確認します。次に、次へをクリックします。
ソースに名前を付け、Amplitudeがデータウェアハウスからプロファイルを更新する頻度を設定します。 デフォルトの頻度は12時間ですが、変更できます。
プロファイルの設定(S3ユーザー)
Amplitudeでプロファイルを設定するには:
Amplitudeで、データ > ソースに移動し、+ ソースを追加をクリックします。Amazon S3を見つけてクリックします。
AmplitudeをS3バケットに接続します。 AmplitudeにS3バケットへのアクセスを許可する方法の詳細については、「Amazon S3」を参照してください。 さらに、「Verify Instrumentation」タブに次の情報を用意してください。
- バケット名とプロファイルが保存されているプレフィックスです。
- AWS ロール ARN、AWS 外部 ID、AWS リージョン。
「資格情報をテスト」をクリックしてAmplitudeがS3バケットにアクセスできることを確認し、「次へ」をクリックしてソースに名前を付けます。
*「ファイルの選択」*タブでファイルの種類を選択し、**「プレビューを表示」をクリックしてインポートするファイルを確認してから、「次へ」**をクリックします。
「コンバータの設定」タブで、「プロファイル」データタイプを選択します。
user_idおよびmutation_typeのソースフィールドを記入し、必要に応じてプロパティを追加します。「データプレビュー」セクションには、Amplitudeが取り込むように設定されているものの例が表示されています。mutation_type以下の文字列のいずれかと完全に一致する必要があります。そうしないと、Amplitudeはプロファイルを取り込みません。INSERT新しいファイルを作成するとき。UPDATE新しい値を同期する場合。DELETEプロファイルを削除します。
完了したら、[保存と有効化] をクリックしてプロファイルのインポートと更新を有効にします。
データ仕様
| フィールド | 概要 | 例 |
|---|---|---|
user_id | ユーザーの識別子です。 最小長さは5である必要があります。 | |
Profile Property 1 | ユーザーレベルで設定されたプロファイルプロパティ。 このフィールドの値は、前回同期以降に顧客のソースから得られた値です。 | |
Profile Property 2 | ユーザーレベルで設定されたプロファイルプロパティ。 このフィールドの値は、前回同期以降に顧客のソースから得られた値です。 |
例:
{
"user_id": 12345,
"number of purchases": 10,
"title": "Data Engineer"
}
Snowflakeプロファイルに関する情報については、こちらの記事を参照してください。
SQLテンプレート
SELECT
AS "user_id",
AS "profile_property_1",
AS "profile_property_2"
FROM DATABASE_NAME.SCHEMA_NAME.TABLE_OR_VIEW_NAME
プロファイル値を消去する
データウェアハウス内のプロファイル値を削除すると、それらの値は次回の同期操作時にAmplitudeに同期されます。 Amplitudeデータを使用して、Amplitudeのユーザーから未使用のプロパティフィールドを削除することもできます。
サンプルクエリ
SELECT
user_id as "user_id",
upgrade_propensity_score as "Upgrade Propensity Score",
user_model_version as "User Model Version"
FROM
ml_models.prod_propensity_scoring
SELECT
m.uid as "user_id",
m.title as "Title",
m.seniority as "Seniority",
m.dma as "DMA"
FROM
prod_users.demo_data m
これは役に立ちましたか?