基本的な使い方

MIDAS はブラウザで動作する探索的データ分析ツールです。データはブラウザ内で処理され、外部サーバーには送信されません(詳細)。インストール不要ですぐに使い始められます。

チュートリアル:Iris データセットの探索的データ分析

1. サンプルデータを開く

ここではサンプルデータを使います。自分の CSV ファイルを使いたい場合はデータの準備と読み込みをご覧ください。

データを持たずに始めたい場合は、ランチャー画面の New Empty Project をクリックします。データセットを持たないプロジェクトが「Untitled Project」の名前で開き、Project Overview タブが表示されます。プロジェクト名は Project Overview タブで変更できます。データセットは、Data メニューの New Dataset... で手入力するか、Generate Synthetic Data... で生成して追加します。

  1. MIDAS を開くと、ランチャー画面が表示されます
  2. "Sample Data" セクションから Iris データセットをクリックします
  3. プロジェクト画面が開きます

MIDAS のランチャー画面で Sample Data セクションから Iris データセットを選択する様子

Iris データセットは、3種類のアヤメの花弁とがく片の測定データです(150行 x 5列、測定値の単位: cm)。

2. データを確認する

プロジェクト画面は 2 つのペインに分かれ、3 つのタブが自動的に開きます:

  • Data Table(左):表形式でデータの内容を表示します
  • Statistics(右):全列のサマリーと統計情報です
  • Selected Columns(右、Statistics の隣のタブ):選択した列の詳細です

下のデモで実際に操作してみましょう。Statistics タブの行をクリックすると、その列の詳細が展開されます。

実際の画面を見る

クリックしてMIDASアプリケーションを起動

各列の上部には、データ型(float64、string など)と測定尺度(interval、nominal など)が表示されます。列の右端にあるボタンをクリックすると、その列でソートできます。

MIDAS はデータを読み込む際、自動的にデータ型と測定尺度を推論します。読み込みが終わると、元の値を文字列のまま保持する Iris (raw) と、推論した型へ変換した Iris の 2 つのデータセットができます。分析に使うのは Iris で、既定で開かれるのもこちらです。推論が正しくない場合は、列を右クリックして変更できます。測定尺度は統計分析やグラフ作成に影響します。たとえば名義尺度の列では平均や標準偏差は計算されません。詳しくはデータの準備と読み込みをご覧ください。

3. 基本統計量を見る

データの概要を把握するため、基本統計量を確認してみましょう。

  1. Data Table タブで列名をクリックします(例:sepal_length)
  2. 右の Statistics タブで該当する列の行が展開され、ヒストグラムや統計量が表示されます

Statistics タブに表示された sepal_length 列の統計量:ヒストグラム、Moments、Spread、Quantiles

表示される統計量:

  • Moments(モーメント): mean(平均)、std(標本標準偏差)、skewness(歪度)、ex. kurt(超過尖度)
  • Spread(ばらつき): iqr(四分位範囲)、range(範囲)
  • Quantiles(分位点): 0%(min)、1%、5%、10%、25%、50%、75%、90%、95%、99%、100%(max)

ヒストグラムから行を選択:

ヒストグラムのビンをクリックすると、その範囲に該当する行が選択されます。選択した行は Data Table でハイライトされます。

ビンをダブルクリックすると、そのビンに属するデータのみを含む Filtered Data タブが新しく開きます。フィルタされたデータで統計量やグラフを確認できます。元のデータセットは変更されません。

ダブルクリックによる FilteredData タブの表示

2列を選択して2列間の関係を表示する:

  1. sepal_lengthが選択された状態で、Ctrl/Cmd キーを押しながらsepal_widthをクリックします
  2. 右の Selected Columns タブに切り替えると、2 列の統計量と散布図が表示されます

Selected Columns タブに表示された2列間の関係:sepal_length と sepal_width の統計量と散布図

4. グラフを作成する

データを可視化してパターンを探してみましょう。

散布図を作成

  1. 上部のメニューバーから Analysis → Graph Builder... を選択
  2. Graph Type から Scatter Plot を選択
  3. 各ドロップダウンから以下を選択:
    • X-Axis: sepal_length (interval)(萼片の長さ)
    • Y-Axis: sepal_width (interval)(萼片の幅)
    • Color (Optional): species (nominal)(アヤメの種類)
  4. 散布図が表示され、種類ごとに色分けされます

Graph Builder で作成した散布図:sepal_length×sepal_width の関係を species ごとに色分けして可視化

種類ごとの分布の傾向を比較できます。

詳しくは Graph Builder タブや高度なグラフ作成をご覧ください。

5. プロジェクトを保存する

MIDAS では、作業内容を2つの方法で保存できます。

ブラウザに保存する

  1. File → Save to Browser を選択(または Ctrl/Cmd+S)
  2. プロジェクトが自動的にブラウザに保存されます

次回 MIDAS を開くと、ランチャー画面の「Quick Access」セクションに保存したプロジェクトが表示され、すぐに再開できます。ブラウザのデータ消去で失われるため、重要なプロジェクトはファイルとしてもエクスポートしてください。

ファイルとしてエクスポートする

  1. File → Export Project... を選択(または Ctrl/Cmd+Shift+S)
  2. ファイル名を確認・編集(デフォルトはプロジェクト名)
  3. 初めてエクスポートするときは、署名者名を入力します(この名前は署名に含まれ、受け取った人に表示されます)
  4. Save をクリック
  5. プロジェクトファイル(.mds 形式)がダウンロードされます

エクスポートした MDS ファイルは他のユーザーと共有できます。ファイルには必ず電子署名が付き、誰が作成したかの確認と改竄の検出ができます。詳しくはプロジェクトファイル(MDS)をご覧ください。

エクスポートしたファイルを開く

  1. MIDAS のランチャー画面で Open File をクリック
  2. 保存した .mds ファイルを選択
  3. プロジェクトが読み込まれ、保存時の状態が復元されます

次のステップ

関連ページ