CData Connect AI を使用して Databricks でリアルタイムの HubSpot データに接続・クエリ

Mohsin Turki
Technical Marketing Engineer

CData Connect AI を使用して、リアルタイムのHubSpot のデータを Databricks に統合し、レプリケーションなしで直接クエリと分析を実現します。

Databricks は、データエンジニアリング、機械学習、アナリティクスを大規模に統合する AI クラウドネイティブプラットフォームです。データウェアハウスのパフォーマンスとデータレイクの柔軟性を兼ね備えた強力なデータレイクハウスアーキテクチャを提供しています。 Databricks を CData Connect AI と統合すると、複雑な ETL パイプラインやデータの複製を必要とせず、HubSpot のデータにリアルタイムでアクセスでき、運用の効率化とインサイトまでの時間短縮を実現できます。

この記事では、CData Connect AI を使用して Databricks から HubSpot へのセキュアなライブ接続を設定する方法を説明します。設定が完了すると、標準 SQL を使用して Databricks ノートブックから直接HubSpot のデータにアクセスでき、データエコシステム全体でリアルタイム分析を統合できます。

HubSpot データ連携について

CData は、HubSpot のライブデータにアクセスし、統合するための最も簡単な方法を提供します。お客様は CData の接続機能を以下の目的で使用しています：

API の更新や変更を気にすることなく、HubSpot にアクセスできます。
追加の構成手順なしで、HubSpot のカスタムオブジェクトやフィールドにアクセスできます。
SQL ストアドプロシージャを使用して、添付ファイルのアップロード・ダウンロード、エンゲージメントの挿入、カスタムオブジェクトやフィールドの作成・削除などの機能的な操作を実行できます。

ユーザーは、Tableau、Power BI、Excel などの分析ツールと HubSpot を統合し、当社のツールを活用して HubSpot データをデータベースやデータウェアハウスにレプリケートしています。

他のお客様が CData の HubSpot ソリューションをどのように使用しているかについては、ブログをご覧ください：Drivers in Focus: Simplified HubSpot Connectivity

はじめに

概要

シンプルなステップの概要は以下のとおりです：

ステップ 1 - 接続と設定： CData Connect AI で HubSpot ソースへの接続を作成し、ユーザー権限を設定して、 Personal Access Token（PAT）を生成します。
ステップ 2 - Databricks からクエリ： Databricks に CData JDBC ドライバーをインストールし、ノートブックに接続情報を設定して、 SQL クエリでリアルタイムのHubSpot のデータにアクセスします。

前提条件

始める前に、以下を準備してください：

アクティブな HubSpot アカウント
CData Connect AI アカウント。ログインまたは無料トライアルにサインアップできます。
Databricks アカウント。こちらからサインアップまたはログインできます。

ステップ 1：CData Connect AI で HubSpot 接続を設定

1.1 HubSpot への接続を追加

CData Connect AI は、利用可能なデータソースに接続するためのシンプルなポイント＆クリックインターフェースを提供しています。

Connect AI にログインし、左側の Sources をクリックして、右上の Add Connection をクリック

Add Connection パネルから 「HubSpot」 を選択

HubSpot に接続するために必要な認証プロパティを入力します。
HubSpot 接続プロパティの取得・設定方法

HubSpot はOAuth 認証およびPrivateAppToken ベース認証をサポートします。

OAuth

HubSpot は埋め込みOAuth 認証情報を提供しており、デスクトップアプリケーションまたはヘッドレスマシンから簡単に接続できます。 Web アプリケーションから接続するには、カスタムOAuth アプリケーションを作成する必要があります。 OAuth 経由で接続するには、すべての認証フローでAuthScheme をOAuth に設定します。ヘルプドキュメントでは、利用可能なOAuth フローでのHubSpot への認証について詳しく説明します。カスタムOAuth アプリケーションの作成についての情報と、すでに埋め込みOAuth 認証情報を持つ認証フローでもカスタムOAuth アプリケーションを作成したほうがよい場合の説明については、「カスタムOAuth アプリケーションの作成」セクションを参照してください。

また、PrivateAppToken ベース認証についてはヘルプドキュメントの「接続の確立」セクションを参照してください。
右上の Save & Test をクリック
HubSpot Connection ページで Permissions タブに移動し、お好みに応じてユーザーベースの権限を更新します。

1.2 Personal Access Token（PAT）を生成

REST API、OData API、または仮想 SQL Server 経由で Connect AI に接続する場合、 Personal Access Token（PAT）が Connect AI への接続認証に使用されます。PAT は、セキュアなトークンベースの認証としてログイン認証情報の代わりに機能します。アクセスの粒度を維持するため、サービスごとに個別の PAT を作成することをお勧めします。

Connect AI アプリの右上にある歯車アイコン（）をクリックして Settings ページを開く
Settings ページで Access Tokens セクションに移動し、 Create PAT をクリック
PAT に名前を付けて Create をクリック
注意：Personal Access Token は作成時にのみ表示されるので、必ずコピーして安全な場所に保存してください。

ステップ 2：Databricks で HubSpot データに接続・クエリ

以下の手順に従って、Databricks から HubSpot への接続を確立します。 CData JDBC Driver for Connect AI をインストールし、JAR ファイルをクラスターに追加して、ノートブックを設定し、 SQL クエリでリアルタイムのHubSpot のデータにアクセスします。

2.1 CData JDBC Driver for Connect AI をインストール

CData Connect AI で、左側の Integrations ページをクリック。 JDBC または Databricks を検索し、Download をクリックして、お使いの OS 用のインストーラーを選択します。
ダウンロード後、インストーラーを実行して指示に従います：
- Windows の場合：セットアップファイルを実行し、インストールウィザードに従います。
- Mac/Linux の場合：アーカイブを解凍し、フォルダを /opt または /Applications に移動します。実行権限があることを確認してください。

インストール後、インストールディレクトリで JAR ファイルを見つけます：

Windows：

C:\Program Files\CData\CData JDBC Driver for Connect AI\lib\cdata.jdbc.connect.jar

Mac/Linux：

/Applications/CData/CData JDBC Driver for Connect AI/lib/cdata.jdbc.connect.jar

2.2 Databricks に JAR ファイルをインストール

Databricks にログイン。左側のナビゲーションペインで Compute をクリック。コンピュートクラスターを開始または作成します。
実行中のクラスターをクリックし、Libraries タブに移動して、右上の Install New をクリック。
Install Library ダイアログで DBFS を選択し、 cdata.jdbc.connect.jar ファイルをドラッグ＆ドロップ。Install をクリック。

2.3 Databricks ノートブックで HubSpot データをクエリ

ノートブックスクリプト 1 - JDBC 接続を定義：

以下のスクリプトをノートブックセルに貼り付けます：

driver = "cdata.jdbc.connect.ConnectDriver"
url = "jdbc:connect:AuthScheme=Basic;User=your_username;Password=your_pat;URL=https://cloud.cdata.com/api/;DefaultCatalog=Your_Connection_Name;"

以下を置き換えます：
- your_username - CData Connect AI のユーザー名
- your_pat - CData Connect AI の Personal Access Token（PAT）
- Your_Connection_Name - Sources ページの Connect AI データソース名
スクリプトを実行します。

ノートブックスクリプト 2 -HubSpot のデータから DataFrame を読み込み：

2 番目のスクリプト用に新しいセルを追加します。ノートブック右側のメニューから Add cell below をクリック。
以下のスクリプトを新しいセルに貼り付けます：

remote_table = spark.read.format("jdbc") \
  .option("driver", "cdata.jdbc.connect.ConnectDriver") \
  .option("url", "jdbc:connect:AuthScheme=Basic;User=your_username;Password=your_pat;URL=https://cloud.cdata.com/api/;DefaultCatalog=Your_Connection_Name;") \
  .option("dbtable", "YOUR_SCHEMA.YOUR_TABLE") \
  .load()

以下を置き換えます：
- your_username - CData Connect AI のユーザー名
- your_pat - CData Connect AI の Personal Access Token（PAT）
- Your_Connection_Name - Sources ページの Connect AI データソース名
- YOUR_SCHEMA.YOUR_TABLE - スキーマとテーブル名（例：HubSpot.Prospects）
スクリプトを実行します。

ノートブックスクリプト 3 - カラムをプレビュー：

同様に、3 番目のスクリプト用に新しいセルを追加します。
以下のスクリプトを新しいセルに貼り付けます：

display(remote_table.select("ColumnName1", "ColumnName2"))

ColumnName1 と ColumnName2 を HubSpot 構造の実際のカラム名に置き換えます（例：Slug、PageViews など）。
スクリプトを実行します。

これで、バックエンド API の複雑さを意識することなく、またHubSpot のデータをレプリケーションすることなく、 Databricks ノートブック内で直接リアルタイムの HubSpot のデータ を探索、結合、分析できるようになりました。

CData Connect AI を 14 日間無料でお試しください

HubSpot のデータへのリアルタイムアクセスを簡素化する準備はできましたか？ CData Connect AI の 14 日間無料トライアルを今すぐ開始して、 Databricks から HubSpot へのシームレスなライブ接続を体験してください。

ローコード、インフラ不要、レプリケーション不要 - 重要なデータとインサイトへのシームレスでセキュアなアクセスを実現します。

はじめる準備はできましたか？

CData Connect AI の詳細、または無料トライアルにお申し込みください：

無料トライアルお問い合わせ