Jupyter
このガイドでは、ノートブック、コード、データのための最新のウェブベースのインタラクティブ開発環境である Jupyter と StarRocks クラスターを統合する方法を説明します。
これらはすべて、Jupyter 上で %sql、%%sql、%sqlplot マジックを介して SQL を実行し、大規模なデータセットをプロットできる JupySQL によって可能になります。
JupySQL を Jupyter 上で使用して、StarRocks 上でクエリを実行することができます。
データがクラスターにロードされると、SQL プロットを通じてクエリと視覚化が可能になります。
前提条件
始める前に、以下のソフトウェアがローカルにインストールされている必要があります:
- JupySQL:
pip install jupysql - Jupyterlab:
pip install jupyterlab - SKlearn Evaluation:
pip install sklearn-evaluation - Python
- pymysql:
pip install pymysql
注意
上記の要件を満たしたら、
jupyterlabと呼び出すだけで Jupyter lab を開くことができます - これによりノートブックインターフェースが開き ます。 Jupyter lab がすでにノートブックで実行されている場合は、以下のセルを実行して依存関係を取得できます。
# 必要なパッケージをインストールします。
%pip install --quiet jupysql sklearn-evaluation pymysql
注意
パッケージを更新した後、カーネルを再起動する必要があるかもしれません。
import pandas as pd
from sklearn_evaluation import plot
# SQL セルを作成するために JupySQL Jupyter 拡張機能をインポートします。
%load_ext sql
%config SqlMagic.autocommit=False
次のステージのために、StarRocks インスタンスが起動してアクセス可能であることを確認する必要があります。
注意
接続しようとしているインスタンスタイプ(url、ユーザー、パスワード)に応じて接続文字列を調整する必要があります。以下の例ではローカルインスタンスを使用しています。