こんにちは!ウェブ担当の加藤です。マーケ関連のデータ分析や整備もやっています。
Microsoft Excel 365 はMicrosoft Excel のクラウドネイティブバージョンです。CData Connect Cloud と組み合わせることで、Excel 365 からSpark のデータに即座にアクセスして分析、共有、表計算などの用途に使用できます。この記事では、Connect Cloud でSpark に接続し、Excel 365 シートからSpark のデータにアクセスする方法を説明します。
Connect Cloud アカウントの取得
以下のステップを実行するには、CData Connect Cloud のアカウントが必要になります。こちらから製品の詳しい情報とアカウント作成、30日間無償トライアルのご利用を開始できますので、ぜひご利用ください。
CData Connect Cloud の特徴
Connect Cloud は、以下の特徴を持つクラウドアプリ間のリアルタイムデータ連携ソリューションです。
- クラウドアプリ間の連携機能を提供し、Excel 365 からSpark のデータへのリアルタイムアクセスを簡単に実現。
- Microsoft 認定のConnect Cloud アドインを使用するだけで、ノーコードでテーブルを取得・更新でき、自分でカスタムクエリを書くことも可能。
- データ処理のパフォーマンスも最適化されており、サポートされているすべてのSQL 操作(フィルタリング、JOIN など)をSpark に直接発行し、サーバーサイドで処理したSpark のデータを高速で取得。
サインアップが完了したら、以下のステップを実行することでSpark のデータにアクセスできます。
Connect Cloud からSpark への接続
CData Connect Cloud では、直感的なUI を使ってコーディングなしでデータソースに接続できます。
- Connect Cloud にログインし、 Add Connection をクリックします。
- 「Add Connection」パネルから「Spark」を選択します。
-
必要な認証プロパティを入力し、Spark に接続します。
SparkSQL への接続
SparkSQL への接続を確立するには以下を指定します。
- Server:SparkSQL をホストするサーバーのホスト名またはIP アドレスに設定。
- Port:SparkSQL インスタンスへの接続用のポートに設定。
- TransportMode:SparkSQL サーバーとの通信に使用するトランスポートモード。有効な入力値は、BINARY およびHTTP です。デフォルトではBINARY が選択されます。
- AuthScheme:使用される認証スキーム。有効な入力値はPLAIN、LDAP、NOSASL、およびKERBEROS です。デフォルトではPLAIN が選択されます。
Databricks への接続
Databricks クラスターに接続するには、以下の説明に従ってプロパティを設定します。Note:必要な値は、「クラスター」に移動して目的のクラスターを選択し、
「Advanced Options」の下にある「JDBC/ODBC」タブを選択することで、Databricks インスタンスで見つけることができます。
- Server:Databricks クラスターのサーバーのホスト名に設定。
- Port:443
- TransportMode:HTTP
- HTTPPath:Databricks クラスターのHTTP パスに設定。
- UseSSL:True
- AuthScheme:PLAIN
- User:'token' に設定。
- Password:パーソナルアクセストークンに設定(値は、Databricks インスタンスの「ユーザー設定」ページに移動して「アクセストークン」タブを選択することで取得できます)。
- Create & Test をクリックします。
- 「Add Spark Connection」ページの「Permissions」タブに移動し、ユーザーベースのアクセス許可を更新します。
コネクションの設定が完了したら、Excel 365 からSpark のデータに接続できます。
Spark のリアルタイムデータにExcel 365 からアクセス
以下のステップでは、Excel 365 からCData Connect Cloud に接続して新しいSpark のデータソースを作成する方法を説明します。
- Excel 365 にログインして、新しいシートを作成、または既存のシートを開きます。
- 「Insert」をクリックして「Office Add-ins」をクリックします(すでにアドインをインストールしている場合は、ステップ4に進んでください)。
- CData Connect Cloud アドインを検索してインストールします。
- 「Data」をクリックしてCData Connect Cloud アドインを開きます。
- アドインのパネルで、「Authorize」をクリックしてご利用のCData Connect Cloud インスタンスを認証します。
- Excel 365 のCData Connect Cloud パネルで、「IMPORT」をクリックします。
- コネクション(例:SparkSQL1)、テーブル(例:Customers)、カラムを選択してインポートします。
- オプションでFilters(フィルタ)、Sorting(ソート)、Limit(取得数制限)の設定を追加することもできます。
- 「Execute」をクリックしてデータをインポートします。
クラウドアプリケーションからSpark のデータへのライブアクセス
以上で、Excel 365 ブックからSpark リアルタイムデータへのクラウド連携を実現できます。データをさらに追加して表計算、集計、共有などの用途に使用できます。
クラウドアプリケーションから、ノーコードで150を超えるSaaS 、ローコードアプリ、NoSQL データソースへのリアルタイムデータアクセスを実現するには、CData Connect Cloud の30日間無償トライアルをぜひお試しください。