RapidMiner からClio のデータに連携
この記事では、CData JDBC Driver for API をRapidMiner のプロセスと簡単に統合する方法を示します。この記事では、CData JDBC Driver for API を使用してClio をRapidMiner のプロセスに転送します。
RapidMiner のClio にJDBC Data Source として接続する
以下のステップに従ってClio へのJDBC 接続を確認できます。
- Clio 用の新しいデータベースドライバーを追加します。[Connections]->[Manage Database Drivers]とクリックします。
- 表示されるウィザードで[Add]ボタンをクリックし、接続に名前を入力します。
- JDBC URL のプレフィックスを入力します。
jdbc:api:
- インストールディレクトリのlib サブフォルダにあるcdata.jdbc.api.jar ファイルにパスを入力して下さい。
- ドライバークラスを入力します。
cdata.jdbc.api.APIDriver
- 新しいClio 接続を作成します。[Connections]->[Manage Database Connections]とクリックします。
- 接続の名前を入力します。
- データベースシステムの場合は、以前構成したClio ドライバーを選択します。
- Host ボックスで接続文字列を入力します。
まず、Profile 接続プロパティをディスク上のClio プロファイルの場所に設定します(例:C:\profiles\Clio.apip)。次に、ProfileSettings 接続プロパティをClio の接続文字列に設定します(以下を参照)。
Clio API プロファイル設定
Clio はOAuth ベースの認証を使用します。
まず、Clio でOAuth アプリケーションを登録します。Developer アカウントにログインし、Add ボタンをクリックして登録できます。ここでアプリケーションの詳細とスコープを入力します。これらの詳細は、Clio ユーザーがアプリケーションの認可を求められたときに表示されます。OAuth アプリケーションにはclient id(キー)とclient secret(シークレット)が割り当てられます。また、ProfileSettings 接続プロパティでRegion を設定します。
以下の接続プロパティを設定すると、接続できるようになります。
- AuthScheme:OAuth に設定します。
- InitiateOAuth:GETANDREFRESH に設定します。InitiateOAuth を使用して、OAuthAccessToken を取得するプロセスを管理できます。
- OAuthClientId:アプリ設定で指定されたclient_id に設定します。
- OAuthClientSecret:アプリ設定で指定されたclient_secret に設定します。
- CallbackURL:アプリ設定で指定されたRedirect URI に設定します。
- Region:ProfileSettings でClio の地理的リージョンに設定します。デフォルトはapp.clio.com です。
ビルトイン接続文字列デザイナ
JDBC URL の構成については、Clio JDBC Driver に組み込まれている接続文字列デザイナを使用してください。JAR ファイルのダブルクリック、またはコマンドラインからJAR ファイルを実行します。
java -jar cdata.jdbc.api.jar
接続プロパティを入力し、接続文字列をクリップボードにコピーします。
以下は一般的な接続文字列です。
Profile=C:\profiles\Clio.apip;ProfileSettings='Region=your_region';Authscheme=OAuth;OAuthClientId=your_client_id;OAuthClientSecret=your_client_secret;CallbackUrl=your_callback_url;
- 必要であればユーザー名とパスワードを入力します。
プロセス内の様々なRapidMiner オペレーターとのClio 接続を使用できます。Clio を取得するには、[Operators]ビューから[Retrieve]をドラッグします。
[Retrieve]オペレータを選択した状態で、[repository entry]の横にあるフォルダアイコンをクリックして[Parameters]ビューで取得するテーブルを定義できます。表示されるRepository ブラウザで接続ノードを展開し、目的のサンプルセットを選択できます。
最後に、[Retrieve]プロセスから結果に出力をワイヤリングし、プロセスを実行してClio を確認します。