製品

ソリューション

コネクタ

サポート

価格

企業情報

事例

ブログ

検索お問い合わせ

製品をチェック

Bitbucket Driver の30日間無償トライアルをダウンロード

30日間の無償トライアルへ

製品の詳細

Bitbucket JDBC Driver 相談したい

Bitbucket データと連携するパワフルなJava アプリケーションを短時間・低コストで作成して配布できます。

Google Cloud Data Fusion でBitbucket データを扱う方法：CData JDBC Driver

CData JDBC ドライバを使って、Google Cloud Data fusion で Bitbucket データをBigQuery にETL。

宮本航太
プロダクトスペシャリスト
最終更新日：2022-05-16

CData

こんにちは！プロダクトスペシャリストの宮本です。

Google Cloud Data Fusion は、ノーコードでデータ連携の設定が可能な言わば GCP の ETL ツール（サービス）です。たくさんのコネクタや変換・分析機能がデフォルトで用意されているため、さまざまなデータソースを色々な組み合わせで扱うことが可能なようです。また JDBC を扱うこともできるため、この記事では、CData JDBC Driver for Bitbucket データを使って、Bitbucket データデータをCloud Data Fusion でGoogle BigQuery にノーコードでパイプラインします。

Cloud Data Fusion の準備

まずはCloud Data Fusion のインスタンスを作成します。

Data Fusion のトップ画面にある「CREATE INSTANCE」からインスタンスを作成します。
作成されたインスタンス名を先ほどの画面でクリックすると以下の画面に遷移しますので、画面下部にある Service Account をコピーします。

画面上部にある追加からメンバーを追加します。メンバー名は先ほどコピーした「Service Account」に合わせてください。役割は BiqQuery へもアクセスしますので、「BigQuery 管理者」、「Cloud Data Fusion 管理者」、「Cloud Data Fusion API サービスエージェント」を付与します。

CData JDBC Driver for Bitbucket のアップロード

ここからは実際に、Data Fusion の設定をしていきます。まずは JDBC Driver をアップロードを行います。

「View Instance」をクリックして、Data Fusion の Control Center を開きます。

Control Center が表示されたら、「＋」ボタンをクリックして JDBC Driver をアップロードしていきます。
- Name：アップロードしたドライバーに設定する名前
- Class name：cdata.jdbc.bitbucket.BitbucketDriver
アップロードする際の注意点として、Driver のファイル名を name-version の形式に変更してアップロードする必要があります。なお、jarファイルをダブルクリックした際に表示されているバージョンをもとに「bitbucket-connector-java-19.0.7115.0.jar」に変更しました。

アップロードが成功するとこのような画面が表示されるので、「Create a Pipeline」をクリックします。

Bitbucket からGoogle BigQuery へのパイプラインの作成

Data Fusion のパイプライン作成

インプット元はサイドメニューの「Source」から選択します。今回は先ほどアップロードした Bitbucket データの JDBC Driver を使用するため、「DataBase」を選択します。アウトプット先は同じくサイドメニューより「Sink」→「BigQuery」を選択します。

「DataBase」の設定

「DataBase」のアイコンにカーソルを持ってくるとプロパティというボタンが表示されるのでクリックし、下記内容を設定します。

Label：Bitbucket
Reference Name：Bitbucket
Plugin Name：Bitbucket Driver（Driver をアップロードした際の名前）
Plugin Type：jdbc
Connection String：Bitbucket へ接続する際の JDBC URL
Import Query：インプットしたいデータを抽出するクエリ

ほとんどのクエリでは、ワークスペースを設定する必要があります。唯一の例外は、Workspacesテーブルです。このテーブルはこのプロパティの設定を必要とせず、クエリを実行すると、Workspaceの設定に使用できるワークスペーススラッグのリストが提供されます。このテーブルにクエリを実行するには、スキーマを'Information'に設定し、SELECT * FROM Workspacesクエリを実行する必要があります。

Schemaを'Information'に設定すると、一般的な情報が表示されます。Bitbucketに接続するには、以下のパラメータを設定してください。

Schema: ワークスペースのユーザー、リポジトリ、プロジェクトなどの一般的な情報を表示するには、これを'Information'に設定します。それ以外の場合は、クエリを実行するリポジトリまたはプロジェクトのスキーマに設定します。利用可能なスキーマの完全なセットを取得するには、sys_schemasテーブルにクエリを実行してください。
Workspace: Workspacesテーブルにクエリを実行する場合を除き、必須です。Workspacesテーブルへのクエリにはこのプロパティは必要ありません。そのクエリはWorkspaceの設定に使用できるワークスペーススラッグのリストのみを返すためです。

Bitbucketでの認証

BitbucketはOAuth認証のみをサポートしています。すべてのOAuthフローからこの認証を有効にするには、カスタムOAuthアプリケーションを作成し、AuthSchemeをOAuthに設定する必要があります。

特定の認証ニーズ（デスクトップアプリケーション、Webアプリケーション、ヘッドレスマシン）に必要な接続プロパティについては、ヘルプドキュメントを必ず確認してください。

カスタムOAuthアプリケーションの作成

Bitbucketアカウントから、以下のステップを実行します。

設定（歯車アイコン）に移動し、ワークスペース設定を選択します。
アプリと機能セクションで、OAuthコンシューマーを選択します。
コンシューマーを追加をクリックします。
カスタムアプリケーションの名前と説明を入力します。
コールバックURLを設定します。
- デスクトップアプリケーションとヘッドレスマシンの場合、http://localhost:33333または任意のポート番号を使用します。ここで設定するURIがCallbackURLプロパティになります。
- Webアプリケーションの場合、信頼できるリダイレクトURLにコールバックURLを設定します。このURLは、ユーザーがアプリケーションにアクセスが許可されたことを確認するトークンを持って戻るWebの場所です。
クライアント認証情報を使用して認証する予定の場合、これはプライベートコンシューマーですを選択する必要があります。ドライバーでは、AuthSchemeをclientに設定する必要があります。
OAuthアプリケーションに与える権限を選択します。これにより、読み取りおよび書き込みできるデータが決まります。
新しいカスタムアプリケーションを保存するには、保存をクリックします。
アプリケーションが保存された後、それを選択して設定を表示できます。アプリケーションのKeyとSecretが表示されます。これらを将来の使用のために記録してください。Keyを使用してOAuthClientIdを設定し、Secretを使用してOAuthClientSecretを設定します。

Connection String は以下の形式です。

jdbc:bitbucket:Workspace=myworkspaceslug;Schema=InformationInitiateOAuth=GETANDREFRESH

上のキャプチャの赤枠は、Salesforce から BigQuery へアウトプットするデータの定義となります。こちらは「Import Query」のすぐ右上にある「Get Schema」をクリックすると下の画面が表示されますので、「Import Query」で入力したクエリを実行し、カラムを定義します。

「BigQuery」の設定

こちらも同様に BigQuery のプロパティから下記内容を設定します。

Label：BigQuery
Reference Name：BigQuery
Project ID：使用するProject ID
DataSet：使用するDataSet
Table：使用するテーブル名、例：Account_DataFusion

作成したBitbucket データからBigQuery のパイプラインの実行

まずは作成したパイプラインをデプロイします。赤枠の「Deploy」ボタンをクリックしてデプロイを行います。

デプロイ完了後、Runボタンが表示されますので、クリックします。

このようにCData JDBC ドライバをアップロードすることで、簡単にGoogle Cloud Data Fusion でBitbucket データデータをノーコードで連携し、BigQuery などへのパイプラインを作成することができます。

是非、CData JDBC Driver for Bitbucket 30日の無償評価版をダウンロードして、お試しください。

トライアル・お問い合わせ

30日間無償トライアルで、CData のリアルタイムデータ連携をフルにお試しいただけます。記事や製品についてのご質問があればお気軽にお問い合わせください。

無償トライアルへ

お問い合わせ

CData Software は、データアクセスおよびデータ接続ソリューションのリーディングプロバイダーです。CData の標準コネクタはあらゆるツール・ミドルウェアからのSaaS やDB データの連携を簡単にします。

お問い合わせ

製品概要

データコネクタ

ETL / ELT ソリューション

クラウド & API 接続

OEM & カスタムドライバー開発

お問い合わせ先

製品を知る

データ分析 & BI

企業情報

ニュース & 事例

ソリューション

サポート

ブログへ →

ナレッジベース

製品をチェック

目次

Google Cloud Data Fusion でBitbucket データを扱う方法：CData JDBC Driver

CData JDBC ドライバを使って、Google Cloud Data fusion で Bitbucket データをBigQuery にETL。

Cloud Data Fusion の準備

CData JDBC Driver for Bitbucket のアップロード

Bitbucket からGoogle BigQuery へのパイプラインの作成

Data Fusion のパイプライン作成

「DataBase」の設定

Bitbucketでの認証

カスタムOAuthアプリケーションの作成

「BigQuery」の設定

作成したBitbucket データからBigQuery のパイプラインの実行

関連コンテンツ

トライアル・お問い合わせ

ソリューション

サポート

ブログへ →

ナレッジベース

製品をチェック

目次

Google Cloud Data Fusion でBitbucket データを扱う方法：CData JDBC Driver

CData JDBC ドライバを使って、Google Cloud Data fusion で Bitbucket データ をBigQuery にETL。

Cloud Data Fusion の準備

CData JDBC Driver for Bitbucket のアップロード

Bitbucket からGoogle BigQuery へのパイプラインの作成

Data Fusion のパイプライン作成

「DataBase」の設定

Bitbucketでの認証

カスタムOAuthアプリケーションの作成

「BigQuery」の設定

作成したBitbucket データ からBigQuery のパイプラインの実行

関連コンテンツ

トライアル・お問い合わせ

CData JDBC ドライバを使って、Google Cloud Data fusion で Bitbucket データをBigQuery にETL。

作成したBitbucket データからBigQuery のパイプラインの実行