Pentaho Data Integration でSalesforce のデータを連携

Jerod Johnson
Jerod Johnson
Director, Technology Evangelism
Pentaho Data Integration で Salesforce のデータ をベースにした ETL パイプラインを構築します。

CData JDBC Driver for Salesforce を使用すると、データパイプラインからリアルタイムデータにアクセスできます。Pentaho Data Integration は、ETL(Extraction, Transformation, and Loading)エンジンであり、データをクレンジングし、アクセス可能な統一フォーマットでデータを格納します。この記事では、Salesforce のデータ に JDBC データソースとして接続し、Pentaho Data Integration で Salesforce のデータ をベースにしたジョブやトランスフォーメーションを構築する方法を説明します。

Salesforce データ連携について

CData を使用すれば、Salesforce のライブデータへのアクセスと統合がこれまでになく簡単になります。お客様は CData の接続機能を以下の目的で利用しています:

  • カスタムエンティティやフィールドにアクセスでき、Salesforce ユーザーは Salesforce のすべてにアクセスできます。
  • アトミックおよびバッチ更新操作を作成できます。
  • Salesforce データの読み取り、書き込み、更新、削除ができます。
  • SOAP API バージョン 30.0 のサポートにより、最新の Salesforce 機能を活用できます。
  • SOQL サポートによる複雑なクエリの Salesforce サーバーへのプッシュダウンにより、パフォーマンスの向上を実現できます。
  • SQL ストアドプロシージャを使用して、ジョブの作成・取得・中止・削除、添付ファイルやドキュメントのアップロード・ダウンロードなどのアクションを実行できます。

ユーザーは、Salesforce データを以下と頻繁に統合しています:

  • 他の ERP、マーケティングオートメーション、HCM など。
  • Power BI、Tableau、Looker などのお気に入りのデータツール。
  • データベースやデータウェアハウス。

CData ソリューションが Salesforce とどのように連携するかについての詳細は、Salesforce 統合ページをご覧ください。


はじめに


Salesforce への接続を設定

Salesforce 接続プロパティの設定方法

埋め込みOAuth(UI でのログイン)による接続設定

それでは、Salesforce への接続について説明していきましょう。最も簡単な方法として、Salesforce にログインする際と同様にUI 上からログインするだけで接続設定が完了します(埋め込みOAuth)。この方法をご利用になる場合は、「Salesforce への接続」をクリックしてください。

標準認証の設定

埋め込みOAuth 以外の方法を利用する場合、以下の3つの認証方式をご利用いただけます。標準的な認証方式では、以下の情報が必要となります。

  • ユーザー名
  • パスワード
  • セキュリティトークン

セキュリティトークンの取得方法については、セキュリティトークン取得手順をご確認ください。

OAuth 認証の設定

ユーザー名とパスワードによる認証がご利用いただけない(避けたい)場合は、OAuth 認証をお使いいただけます。

SSO(シングルサインオン)の設定

最後に、IDプロバイダー経由でのシングルサインオンをご利用になる場合は、以下のプロパティを設定してください。

  • SSOProperties
  • SSOLoginUrl
  • TokenUrl

より詳細な設定手順については、ヘルプドキュメントの「はじめに」セクションをご確認ください。

組み込みの接続文字列デザイナー

JDBC URL の構築を支援するには、Salesforce JDBC Driver に組み込まれている接続文字列デザイナーを使用してください。JAR ファイルをダブルクリックするか、コマンドラインから JAR ファイルを実行します。

java -jar cdata.jdbc.salesforce.jar

接続プロパティを設定し、接続文字列をクリップボードにコピーします。

JDBC URL を設定する際には、Max Rows 接続プロパティの設定も検討してください。これにより返される行数が制限され、レポートやビジュアライゼーションの設計時にパフォーマンスを向上させることができます。

一般的な JDBC URL は次のようになります:

jdbc:salesforce:User=username;Password=password;SecurityToken=Your_Security_Token;

接続文字列を保存して、Pentaho Data Integration で使用します。

Pentaho DI から Salesforce に接続

Pentaho Data Integration を開き、「Database Connection」を選択して CData JDBC Driver for Salesforce への接続を設定します。

  1. 「General」をクリックします。
  2. Connection name を設定します(例:Salesforce Connection)。
  3. Connection type を「Generic database」に設定します。
  4. Access を「Native (JDBC)」に設定します。
  5. Custom connection URL に Salesforce の接続文字列を設定します(例:
    jdbc:salesforce:User=username;Password=password;SecurityToken=Your_Security_Token;
    )。
  6. Custom driver class name を「cdata.jdbc.salesforce.SalesforceDriver」に設定します。
  7. 接続をテストし、「OK」をクリックして保存します。

Salesforce のデータパイプラインを作成

CData JDBC Driver を使用して Salesforce への接続が設定されたら、新しいトランスフォーメーションまたはジョブを作成する準備が整いました。

  1. 「File」>>「New」>>「Transformation/job」をクリックします。
  2. 「Table input」オブジェクトをワークフローパネルにドラッグし、Salesforce 接続を選択します。
  3. 「Get SQL select statement」をクリックし、Database Explorer を使用して利用可能なテーブルとビューを表示します。
  4. テーブルを選択し、必要に応じてデータをプレビューして確認します。

ここから、適切な同期先を選択し、レプリケーション中にデータを変更、フィルタリング、その他の処理を行うトランスフォーメーションを追加することで、トランスフォーメーションまたはジョブを続行できます。

無料トライアルと詳細情報

CData JDBC Driver for Salesforce の 30日間無料トライアルをダウンロードして、Pentaho Data Integration で Salesforce のデータ のリアルタイムデータを今すぐ活用しましょう。

はじめる準備はできましたか?

Salesforce Driver の無料トライアルをダウンロードしてお試しください:

 ダウンロード

詳細:

Salesforce Icon Salesforce JDBC Driver お問い合わせ

潜在顧客、連絡先、営業案件、アカウントなどのSalesforce.com アカウントデータを組み込んだパワフルなJava アプリケーションを短時間・低コストで作成して配布できます。