Amazon S3 のデータでDashのWebアプリを作る方法|CData Connect AI + Python
CData Connect AI の Python SDK(DB-API 2.0準拠)を使うと、pandas と Dash でリアルタイムのAmazon S3 のデータを可視化する Web アプリを、個別ドライバー不要で構築できます。接続・モジュールインストール・アプリ構築の3ステップで、約10分で完成します。
Python は豊富なモジュールのエコシステムを備えているため、素早く作業に取りかかり、システムをより効果的に連携できます。CData Connect AI Python SDK、pandas モジュール、そして Dash フレームワークを使えば、Amazon S3 のデータを扱う Amazon S3 連携の Web アプリケーションを構築できます。この記事では、Connect AI に接続し、pandas と Dash を使ってAmazon S3 のデータを可視化するシンプルな Web アプリを構築する方法をご紹介します。
Connect AI Python SDK(cdata-connect-ai)は DB-API 2.0(PEP 249)に準拠したクライアントなので、pandas は SDK の接続オブジェクトから直接クエリ結果を読み取れます。ソースごとにドライバーをインストールする必要はありません。パーソナルアクセストークンで接続して、アプリを構築しましょう。
Python + pandas + Dash でできること
Amazon S3 データの可視化ダッシュボード作成
SQL クエリで取得した Amazon S3 のレコードを pandas の DataFrame に読み込み、Dash のグラフコンポーネントに渡すだけで、業種別の傾向などを視覚的に確認できるダッシュボードを構築できます。
リアルタイムデータの自動更新レポート
Connect AI 経由の接続はパーソナルアクセストークンで認証されるため、スケジュール実行するスクリプトに組み込めば、Amazon S3 の最新データを反映したレポートを定期的に生成できます。
複数データソースとの統合分析
DB-API 2.0 準拠のクライアントなので、同じコードパターンで Amazon S3 以外のデータソースにも接続でき、pandas 上で結合・集計してから Dash で一元的に可視化できます。
Connect AI で Amazon S3 に接続する方法は?
CData Connect AI では、直感的なクリック操作ベースのインターフェースでデータソースに接続できます。
- Connect AI にログインし、Sources をクリックして、 Add Connection をクリックします
- 「Add Connection」パネルから「Amazon S3」を選択します
-
Amazon S3 に接続するために必要な認証プロパティを入力します。
Amazon S3 リクエストを認可するには、管理者アカウントまたはカスタム権限を持つIAM ユーザーの認証情報を入力します。AccessKey をアクセスキーID に設定します。SecretKey をシークレットアクセスキーに設定します。
Note: AWS アカウント管理者として接続できますが、AWS サービスにアクセスするにはIAM ユーザー認証情報を使用することをお勧めします。
尚、CData 製品はAmazon S3 のファイルの一覧表示やユーザー管理情報の取得用です。S3 に保管されているExcel、CSV、JSON などのファイル内のデータを読み込みたい場合には、Excel Driver、CSV Driver、JSON Driver をご利用ください。
アクセスキーの取得
IAM ユーザーの資格情報を取得するには:
- IAM コンソールにサインインします。
- ナビゲーションペインで「ユーザー」を選択します。
- ユーザーのアクセスキーを作成または管理するには、ユーザーを選択してから「セキュリティ認証情報」タブを選択します。
AWS ルートアカウントの資格情報を取得するには:
- ルートアカウントの資格情報を使用してAWS 管理コンソールにサインインします。
- アカウント名または番号を選択し、表示されたメニューで「My Security Credentials」を選択します。
- 「Continue to Security Credentials」をクリックし、「Access Keys」セクションを展開して、ルートアカウントのアクセスキーを管理または作成します。
AWS ロールとして認証
多くの場合、認証にはAWS ルートユーザーのダイレクトなセキュリティ認証情報ではなく、IAM ロールを使用することをお勧めします。RoleARN を指定することでAWS ロールを代わりに使用できます。これにより、CData 製品は指定されたロールの資格情報を取得しようと試みます。
(すでにEC2 インスタンスなどで接続されているのではなく)AWS に接続している場合は、ロールを引き受けるIAM ユーザーのAccessKey とSecretKey を追加で指定する必要があります。AWS ルートユーザーのAccessKey および SecretKey を指定する場合、ロールは使用できません。
SSO 認証
SSO 認証を必要とするユーザーおよびロールには、RoleARN およびPrincipalArn 接続プロパティを指定してください。各Identity Provider に固有のSSOProperties を指定し、AccessKey とSecretKey を空のままにする必要があります。これにより、CData 製品は一時的な認証資格情報を取得するために、リクエストでSSO 認証情報を送信します。
- 「Save & Test」をクリックします
- 「Permissions」タブに移動し、ユーザーベースの権限を更新します。

パーソナルアクセストークン(PAT)を生成する
Python SDK は、アカウントのメールアドレスとパーソナルアクセストークン(PAT)を使って Connect AI に認証します。アクセスの粒度を保つために、アプリケーションごとに個別の PAT を作成することをおすすめします。
- Connect AI アプリの右上にある歯車アイコン()をクリックして、設定ページを開きます。
- 設定ページの Access Tokens セクションに移動し、 Create PAT をクリックします。
- PAT に名前を付けて Create をクリックします。

- パーソナルアクセストークンは作成時にのみ表示されます。必ずコピーして安全な場所に保管してください。
必要なモジュールをインストールする
pip ユーティリティを使って、SDK(pandas エクストラ付き)、Dash、Plotly をインストールします。
pip install "cdata-connect-ai[full]" pip install dash pip install plotly
Python で Amazon S3 のデータの Web アプリを構築する
必要なモジュールをインストールしたら、Web アプリを構築する準備は完了です。以下にコードスニペットを紹介しますが、完全なソースコードは記事の末尾に掲載しています。
まずモジュールをインポートし、アカウントのメールアドレスと PAT で Connect AI に接続して、Amazon S3 のデータを DataFrame に読み込みます。識別子は <Connection>.<Schema>.<Table> という3つの部分で構成されており、接続名はデフォルトでソース名(例:AmazonS31)になります。
import dash
from dash import dcc, html
import pandas as pd
import plotly.graph_objs as go
import cdata_connect_ai
conn = cdata_connect_ai.connect(
username="[email protected]",
password="<your_pat>",
)
df = pd.read_sql(
"SELECT Name, OwnerId "
"FROM [AmazonS31].[AmazonS3].[ObjectsACL] "
"WHERE Name = 'TestBucket'",
conn,
)
conn.close()
アプリとレイアウトを設定する
クエリ結果を DataFrame に格納したら、Amazon S3 のデータから棒グラフを作成し、アプリのレイアウトを設定します。
app = dash.Dash(__name__)
app.title = 'CData Connect AI + Dash'
trace = go.Bar(x=df['Name'], y=df['OwnerId'], name='Name')
app.layout = html.Div(
children=[
html.H1("CData Connect AI + Dash", style={'textAlign': 'center'}),
dcc.Graph(
id='example-graph',
figure={
'data': [trace],
'layout': go.Layout(title='Amazon S3 ObjectsACL Data', barmode='stack'),
},
),
],
className="container",
)
アプリを実行できるようにする
接続、アプリ、レイアウトの設定が完了したら、アプリを実行する準備は整いました。
if __name__ == '__main__':
app.run(debug=True)
それでは、Python で Web アプリを実行し、ブラウザでAmazon S3 のデータを確認してみましょう。
python amazons3-dash.py
関連情報と無料トライアル
これで、CData Connect AI Python SDK を使って、リアルタイムのAmazon S3 のデータでインタラクティブな Dash の Web アプリを構築できるようになりました。Amazon S3(および数百種類のその他のデータソース)への接続について詳しくは、Connect AI のページをご覧ください。
CData Connect AI の詳細、または無料トライアルにお申し込みください:
完全なソースコード
import dash
from dash import dcc, html
import pandas as pd
import plotly.graph_objs as go
import cdata_connect_ai
conn = cdata_connect_ai.connect(
username="[email protected]",
password="<your_pat>",
)
df = pd.read_sql(
"SELECT Name, OwnerId "
"FROM [AmazonS31].[AmazonS3].[ObjectsACL] "
"WHERE Name = 'TestBucket'",
conn,
)
conn.close()
app = dash.Dash(__name__)
app.title = 'CData Connect AI + Dash'
trace = go.Bar(x=df['Name'], y=df['OwnerId'], name='Name')
app.layout = html.Div(
children=[
html.H1("CData Connect AI + Dash", style={'textAlign': 'center'}),
dcc.Graph(
id='example-graph',
figure={
'data': [trace],
'layout': go.Layout(title='Amazon S3 ObjectsACL Data', barmode='stack'),
},
),
],
className="container",
)
if __name__ == '__main__':
app.run(debug=True)