data

Parquet Viewer

Parquetファイルの内容をブラウザだけで確認できるビューアです。

ローカル処理
ファイルについてこのツールで選択したファイルや入力内容は、Browser Kittyのバックエンドへアップロードせずブラウザ内で処理します。
操作デモ 実際の操作の流れを短い動画で確認できます。

このツールについて

Parquet Viewerは、Apache Parquetファイルを手早く中身確認するためのプレビュー・調査用ツールです。スキーマ、行数、row group、作成元情報、カスタムメタデータ、圧縮方式などを確認しながら、必要な範囲の行を表形式で表示できます。

ファイル全体を最初から展開するのではなく、メタデータを先に読み、表示している範囲を中心に読み込む設計です。データパイプラインのデバッグや、手元に届いたParquetの構造確認に向いています。

こんなときに便利

  • データパイプラインの途中で生成されたParquetのスキーマや行数を素早く確認したい
  • 受け取ったParquetがどの圧縮方式やrow group構成になっているか調べたい
  • SQL環境を用意せず、数十〜数百行だけ確認してCSVへコピー・保存したい

できること

このツールで利用できる主な機能です。

使い方

  1. 「ツールを開く」を押し、1つ以上の .parquet ファイルを選択またはドロップします。
  2. ファイルタブから確認したいParquetを選び、スキーマ・メタデータ・行数を確認します。
  3. データプレビューで1ページあたりの表示件数を選択し、必要なページへ移動します。
  4. 必要なら列見出しをクリックして、現在のプレビューページ内を昇順・降順に並べ替えます。
  5. 表示中のページをCSVとしてダウンロードするか、クリップボードへコピーします。

対応範囲

  • Parquet v1 / v2を読み込みます。
  • 圧縮: Uncompressed、Snappy、Gzip、Brotli、LZ4、LZ4_RAW、Zstandard。
  • 1ページあたり50 / 100 / 250 / 500 / 1,000行のプレビューに対応します。
  • 複数ファイルをタブで開き、スキーマ・メタデータ・データプレビューを切り替えて確認できます。

制限・注意点

  • このツールはプレビュー・調査用であり、SQLクエリエンジンではありません。
  • 並べ替えは現在表示しているプレビューページ内だけに適用されます。
  • CSVダウンロードとコピーも、現在表示しているページのデータが対象です。
  • ファイル内で使われているエンコーディングや構造によっては、埋め込みパーサーが読み取れない場合があります。

よくある質問

Parquetファイルはサーバーへアップロードされますか?

いいえ。選択したParquetはブラウザ内で読み取り、Browser Kittyへアップロードしません。

SnappyやZstandardで圧縮されたParquetも開けますか?

はい。Snappy、Gzip、Brotli、LZ4、LZ4_RAW、Zstandardなどに対応しています。

Parquet全体をCSVに変換できますか?

現在のCSV保存は表示中のプレビューページが対象です。ファイル全体を一括変換する用途ではありません。

複数のParquetを同時に開けますか?

はい。複数ファイルをタブで開いて切り替えながら確認できます。

オフライン版・ソースコード

GitHubの単一HTML版を保存すれば、インストールやサーバーなしでローカルから直接開けます。必要なParquetパーサーと圧縮処理もHTML内に含まれています。

GitHubでソースを見る