data

Graph Digitizer

グラフ画像やPDFページの軸を校正し、曲線やマーカーからXYデータを抽出・修正してCSV保存します。

ローカル処理
ファイルについてこのツールで選択したファイルや入力内容は、Browser Kittyのバックエンドへアップロードせずブラウザ内で処理します。
操作デモ 実際の操作の流れを短い動画で確認できます。

このツールについて

Graph Digitizerは、論文・資料・古いレポートなどに画像として残っているXYグラフから、再利用できる数値データを取り出すためのツールです。既知の目盛りを4点指定して軸を校正し、手動または色・マーカーを使って点を抽出します。

自動追跡結果はそのまま確定せず、元画像への重ね合わせ、数値から再描画したグラフ、要確認一覧、座標表で確認・修正できます。途中作業は.graphdigitizer.jsonへ保存でき、最終結果はCSVとして端末内へ保存します。

こんなときに便利

  • 論文や報告書のグラフ画像からXYデータをCSVへ取り出したい
  • PDFに埋め込まれたグラフをページから切り抜き、数値化したい
  • 古い資料の曲線グラフを再解析できる数値データへ戻したい
  • 色付きの複数系列を分けて抽出し、手動で誤差を修正したい
  • 折れ線グラフの丸・四角などのマーカー中心をデータ点として取り出したい
  • 線形軸や対数軸のグラフから数値を読み取りたい

できること

このツールで利用できる主な機能です。

使い方

  1. グラフ画像を追加するかPDFを開き、PDFの場合はページを選んで必要ならグラフ部分を切り抜きます。
  2. X/Y軸ごとに線形またはlog10を選び、X1 → X2 → Y1 → Y2の順に既知の目盛り位置を置いて対応する数値を入力します。
  3. 手動抽出ではグラフ上をクリックして点を追加し、必要ならドラッグやルーペ付き修正画面で1px単位に調整します。
  4. 自動抽出では通常の線なら曲線、見えている丸・四角などの点ならマーカーを選び、色・範囲・許容差などを設定します。
  5. 自動結果をプレビューし、不要な検出を除外してから系列へ反映します。長い欠損は自動補間されず、別区間として残ります。
  6. 結果画面で要確認点・区間の切れ目・元画像への重ね合わせ・再描画グラフ・座標表を確認し、必要な点を修正します。
  7. 長い作業は.graphdigitizer.jsonとして保存し、後から復元して続けられます。
  8. 対象系列とCSV形式を選び、実際のCSV本文をプレビュー・コピーしてから保存します。

対応範囲

  • 画像入力: PNG / JPEG / WebP。ファイル選択、Drag & Drop、クリップボード貼り付けに対応。最大20 MiB、展開後1600万ピクセル。
  • PDF入力: 最大80 MiB。ページ選択・切り抜きに対応し、作業ページのラスターは1600万ピクセル以内。パスワード保護PDFは非対応。
  • 軸校正: X/Yそれぞれ線形 / log10、逆向きの数値軸、わずかに回転した直線XY軸に対応。
  • 抽出: 手動点、色指定の曲線自動追跡、丸・四角などの可視データマーカー中心抽出。複数系列と区間を管理。
  • 修正: 点のドラッグ、ルーペ、1px / 10pxキーボード移動、Undo / Redo、誤検出の除外。
  • 作業保存: .graphdigitizer.json format v1。作業画像・校正・系列・区間・抽出点・追跡設定・CSV設定を保持。PDF由来でも元PDF自体は含めません。
  • CSV: 標準series,segment,x,y、または1系列・1区間で簡易x,y。保存前に本文を確認・コピーできます。
  • 実行時通信: PDF.js 6.3.289、Worker、必要なWASMを内包。CSPはconnect-src noneで、画像・PDF・作業ファイル・抽出座標をアプリのサーバーへ送信しません。

制限・注意点

  • 主な対象は各Xに対しておおむね1つのYがある一般的なXYグラフです。
  • 棒グラフ、ヒストグラム、極座標 / 三角座標 / 3D、塗りつぶし面積の解析、一般的なグラフOCRには対応しません。
  • 写真の遠近歪み、レンズ歪み、湾曲した紙、直線でない軸は自動補正しません。
  • マーカーモードは点の中心を抽出しますが、月名などのカテゴリラベルをOCRしてCSVへ入れる機能はありません。
  • 自動追跡は色・形状の分離しやすさに依存し、交差、濃いグリッド、JPEGノイズ、低解像度、系列の重なりや近い色では手動修正が必要になる場合があります。
  • 長い欠損区間を勝手に補間せず、別区間として保持します。
  • 抽出値は画像位置から読み取った推定値で、元画像に存在しない測定精度を復元するものではありません。
  • 作業ファイル上限は96 MiB。大画像や複雑なPDFでは端末メモリを多く消費し、ブラウザや端末の上限自体は回避できません。

よくある質問

グラフ画像から数値データを取り出せますか?

はい。既知の目盛りでX/Y軸を校正したあと、点を手動追加するか、色付き曲線や可視マーカーを自動検出し、確認・修正してCSVへ保存できます。

PDFのグラフも数値化できますか?

はい。PDFを開いてページを選び、必要ならグラフ部分を切り抜いて作業画像にできます。パスワード保護PDFはv1.0.0では対応しません。

対数グラフにも対応していますか?

X軸とY軸それぞれで線形またはlog10を選択できます。既知の目盛り位置と値を4点で校正して使います。

折れ線上の丸や四角だけをデータ点として拾えますか?

マーカーモードで、接続線を細かく拾う代わりに見えている丸・四角などのマーカー中心を検出できます。誤検出はプレビューで除外できます。

抽出結果は自動追跡のまま保存されますか?

いいえ。自動追跡はまずプレビューされ、要確認点や区間の切れ目、元画像への重ね合わせ、再描画グラフなどを確認・修正してからCSV保存できます。

途中作業を保存できますか?

.graphdigitizer.jsonとして保存し、後から復元できます。作業画像や校正、系列、抽出点、設定を保持しますが、PDF由来でも元PDFそのものは作業ファイルへ含めません。

棒グラフや円グラフも読み取れますか?

v1.0.0の主対象は一般的なXYグラフです。棒グラフ、ヒストグラム、極座標、3D、一般的なグラフOCRなどは対象外です。

画像やPDF、抽出した数値はサーバーへ送信されますか?

いいえ。Web版では最初のアプリHTML取得は発生しますが、その後の画像/PDF読込、校正、自動追跡、作業保存、CSV生成はブラウザ内で行い、選択ファイルや抽出値をアプリのサーバーへ送信しません。

オフライン版・ソースコード

単一HTML版にはPDF.js本体、Worker、必要なWASMが内包され、connect-src noneで実行時通信を遮断します。対象ブラウザで確認済みの生成HTMLをローカルから開けば、画像/PDF読込、校正、抽出、CSV生成をネットワークなしで行えます。

GitHubでソースを見る