Informatica PowerCenter でSpotify のデータを抽出、変換、ロードする

古川えりか
古川えりか
コンテンツスペシャリスト
Informatica PowerCenter でSpotify のデータのシンプルなWorkflow を作成。



Informatica は、データ転送用の強力で洗練された手段を提供します。CData ODBC Driver for API を利用することで、Informatica の強力なデータ転送と操作機能でシームレスに統合された、業界が認めた標準ドライバーにアクセスできるようになります。このチュートリアルでは、Informatica PowerCenter でシンプルなWorkflow を作成してSpotify のデータを抽出し、フラットファイルにロードする方法について説明します。

CData ODBC ドライバとは?

CData ODBC ドライバは、以下のような特徴を持ったリアルタイムデータ連携ソリューションです。

  1. Spotify をはじめとする、CRM、MA、会計ツールなど多様なカテゴリの270種類以上のSaaS / オンプレミスデータソースに対応
  2. 多様なアプリケーション、ツールにSpotify のデータを連携
  3. ノーコードでの手軽な接続設定
  4. 標準 SQL での柔軟なデータ読み込み・書き込み

CData ODBC ドライバでは、1.データソースとしてSpotify の接続を設定、2.Informatica PowerCenter 側でODBC Driver との接続を設定、という2つのステップだけでデータソースに接続できます。以下に具体的な設定手順を説明します。

CData ODBC ドライバのインストールとSpotify への接続設定

まずは、本記事右側のサイドバーからAPI ODBC Driver の無償トライアルをPowerCenter サーバーとクライアントマシーンにドライバーをインストールします。30日間無償で、製品版の全機能が使用できます。

どちらにおいても、データソースのODBC DSN で接続プロパティを指定します。これはドライバーインストール時の最後の手順にあたります。Microsoft ODBC データソースアドミニストレーターを使ってODBC DSN を作成および設定できます。

OAuth 認証の設定

Spotify は認証に OAuth 2.0 を使用します。クライアント認証情報を取得するには、Spotify Developer Dashboard でアプリケーションを作成する必要があります。

Spotify アプリケーションのセットアップ

  1. Spotify Developer Dashboard にアクセスします。
  2. Spotify アカウントでログインして Create app をクリックします。
  3. アプリ名、説明を入力し、Redirect URI を設定します(デスクトップアプリケーションの場合は
    http://localhost:33333
    など)。
  4. アプリ設定から Client IDClient Secret をコピーします。

接続プロパティ

以下の接続プロパティを設定して接続を確立してください:

  • AuthScheme:OAuth に設定します。
  • InitiateOAuthGETANDREFRESH に設定します。InitiateOAuth を使うと、OAuthAccessToken を取得するプロセスを管理できます。
  • OAuthClientId:Spotify アプリケーションの Client ID に設定します。
  • OAuthClientSecret:Spotify アプリケーションの Client Secret に設定します。
  • Scope:必要な OAuth スコープ(スペース区切り)に設定します。デフォルトには、このプロファイルのテーブルに必要なすべての読み取りスコープが含まれます。
  • CallbackURL:Spotify アプリケーションで設定したリダイレクト URI に設定します(例:http://localhost:33333)。

接続文字列の例

Profile=C:\profiles\Spotify.apip;AuthScheme=OAuth;InitiateOAuth=GETANDREFRESH;OAuthClientId=your_client_id;OAuthClientSecret=your_client_secret;CallbackURL=http://localhost:33333;

利用可能な OAuth スコープ

  • user-read-private:ユーザーのサブスクリプション詳細と露骨なコンテンツ設定への読み取りアクセス。
  • user-read-email:ユーザーのメールアドレスへの読み取りアクセス。
  • user-library-read:ユーザーが保存したトラック、アルバム、エピソード、ショー、オーディオブックへの読み取りアクセス。
  • playlist-read-private:ユーザーの非公開プレイリストへの読み取りアクセス。
  • playlist-read-collaborative:ユーザーがフォローしているコラボレーティブプレイリストへの読み取りアクセス。
  • user-follow-read:現在のユーザーがフォローしているアーティストの一覧への読み取りアクセス。
  • user-read-playback-state:ユーザーのプレーヤー状態(デバイス、現在のトラック、再生位置)への読み取りアクセス。
  • user-read-currently-playing:ユーザーが現在再生中のコンテンツへの読み取りアクセス。
  • user-read-playback-history:ユーザーが最近再生したトラックへの読み取りアクセス。
  • user-top-read:ユーザーのトップアーティストとトラックへの読み取りアクセス。

PowerCenter でETL ワークフローを作成する

次のステップに従ってPowerCenter でワークフローを作成し、Spotify のデータをプルしてフラットファイルにプッシュします。

ODBC ドライバーを使用してソースを作成する

  1. %INFA_HOME%\clients\PowerCenterClient\client\bin にあるpowrmart.ini ファイルで、次の行をODBCDLL セクションに追加します。
    CData=PMODBC.DLL
  2. PowerCenter Workflow Manager で新しいODBC リレーショナル接続を追加し、ユーザー名とパスワードのプロパティをODBC Driver がインストールされているマシンのユーザーに設定して、接続文字列をドライバーのSystem DSN(CData API Sys)に設定します。 Create a Relational Connection to the DSN (QuickBooks Online is shown.)
  3. PowerCenter Designer でリポジトリに接続し、フォルダを開きます。
  4. 「Source Analyzer」を選択してソースメニューをクリックし、「Import from Database」を選択します。 Import from Database
  5. ODBC データソースのドロップダウンメニューで、以前構成したDSN(CData API Sys)を選択します。
  6. 「connect」をクリックし、含めるテーブルとビューを選択します。
  7. 「OK」をクリックします。 Select DSN and Tables/Views to Import (QuickBooks Online is shown.)

ソースを使用してフラットファイルターゲットを作成する

  1. 「Targets Analyzer」を選択し、以前に作成したソースをワークスペースにドラッグアンドドロップします。既存のソースを使用することで、カラムがターゲットにコピーされます。
  2. 新しいターゲットを右クリックし、「edit」をクリックしてデータベースタイプをフラットファイルに変更します。 Create a Flat File target for the Workflow.

Spotify のデータとフラットファイル間のマッピングを作成する

  1. 「Mapping Designer」をクリックします。
  2. ソースとターゲットをワークスペースにドラッグします。(プロンプトが表示されたら、新しいマッピングに名前を付けます。) Create a new Mapping.
  3. ワークスペースで右クリックし、「Autolink by Name」を選択します。
  4. カラムをソース修飾子からターゲット定義にドラッグします。 Link columns from source to target.
  5. フォルダをセーブ(Ctrl + S)します。

マッピングを使用してワークフローを作成する

ソース、ターゲット、マッピングを作成して保存したら、ワークフローを作成することができるようになります。

  1. マッピングを右クリックして「generate workflow」を選択し、「Workflow Generation」ウィザードを開きます。
  2. 再利用不可のセッションでワークフローを作成します。
  3. (以前作成した関連する接続への)接続オブジェクトが適切に構成されていることを確認してプレフィックスを設定します。
  4. 必要に応じて接続を設定します。
  5. ワークフローを確認して「Finish」をクリックします。

ワークフローを作成したら、PowerCenter Workflow Manager を開いてワークフローにアクセスして開始し、Spotify のデータをフラットファイルに素早く転送できます。ODBC Driver for API を使用して、ソースとターゲットをPowerCenter から設定することで、Informatica PowerCenter でSpotify のデータをお好みのエレガントで強力な機能に統合することができます。

Spotify からInformatica PowerCenter へのデータ連携には、ぜひCData ODBC ドライバをご利用ください

このようにCData ODBC ドライバと併用することで、270を超えるSaaS、NoSQL データをコーディングなしで扱うことができます。30日の無償評価版が利用できますので、ぜひ自社で使っているクラウドサービスやNoSQL と合わせて活用してみてください。

CData ODBC ドライバは日本のユーザー向けに、UI の日本語化、ドキュメントの日本語化、日本語でのテクニカルサポートを提供しています。

はじめる準備はできましたか?

API Driver で Spotify のライブデータに接続

Spotify に接続