text

文書→Markdown

DOCX・PPTX・XLSX・PDF・TXT・HTML・CSV・TSVを、アップロードせずブラウザ内でMarkdownへ変換します。

ローカル処理
ファイルについてこのツールで選択したファイルや入力内容は、Browser Kittyのバックエンドへアップロードせずブラウザ内で処理します。
操作デモ 実際の操作の流れを短い動画で確認できます。

このツールについて

文書→Markdown / Document to Markdownは、Word、PowerPoint、Excel、PDF、テキスト、HTML、CSV、TSVの内容をブラウザ内でMarkdownへ変換するツールです。元文書を外部の変換サーバーへアップロードせず、見出し・段落・リスト・表・リンクなど、再利用しやすい構造へ変換します。

変換結果だけでなく、「変換済み」「確認推奨」「変換対象外」「一部失敗」を文書情報で確認できます。DOCX / PPTXの埋め込み画像は、相対パスを使う画像付きZIPとして保存するか、Base64でMarkdownへ直接埋め込むこともできます。

こんなときに便利

  • WordやPowerPointの内容をMarkdownへ移して、README・Wiki・ノート・AI入力用のテキストとして再利用したい
  • PDFの文字レイヤーやExcelの表をMarkdownへ変換し、内容をコピーしやすい形にしたい
  • 複数の文書を外部サービスへアップロードせず、まとめてMarkdownへ変換して保存したい

できること

このツールで利用できる主な機能です。

使い方

  1. DOCX・PPTX・XLSX・PDF・TXT・HTML・CSV・TSVを選択するか、画面へドラッグ&ドロップします。
  2. 複数ファイルを追加した場合はキューで順番に変換されます。
  3. 完了したファイルを選び、「Markdown」「プレビュー」「文書情報」を確認します。
  4. 文書情報で「確認推奨」「変換対象外」「一部失敗」がある場合は、元文書と結果を見比べます。
  5. 必要に応じて出力ファイル名を変更し、Markdownをコピーまたは保存します。
  6. DOCX / PPTXの画像を残す場合は画像付きZIPまたはBase64埋め込みを選び、複数結果は「すべてZIP保存」でまとめて保存します。

対応範囲

  • 入力: DOCX / PPTX / XLSX / PDF / TXT / HTML / CSV / TSV。1ファイル100 MB、最大20ファイル、合計300 MB。
  • DOCX: 見出し、段落、リスト、表、リンク、埋め込み画像などを可能な範囲でMarkdown化します。
  • PPTX: スライド本文、表、リンク、Speaker Notes、埋め込み画像などを扱います。
  • XLSX: シート構造とセル内容を表として変換し、数式は実行せず保存済み結果または数式文字列を利用します。
  • PDF: PDF.jsで文字レイヤーを抽出し、見出し・段落・読み順を配置から推定します。OCRは行いません。
  • 保存: .md、画像付きZIP、Base64画像埋め込みMarkdown、複数結果ZIP。日本語 / 英語、PC / スマートフォン対応。

制限・注意点

  • スキャンPDFや画像だけのPDFに対するOCRはv1.0.0では行いません。
  • 複雑なPDFの段組み・表・縦書き・回転文字では、読み順や段落推定を確認する必要があります。
  • 暗号化・パスワード保護されたDOCX / PPTX / XLSXには対応していません。
  • PPTXのグラフ、SmartArt、動画・音声、アニメーションなどは完全にはMarkdown化しません。
  • XLSXの数式は実行しません。保存済み計算結果があれば利用し、ない場合は数式文字列を残します。
  • 旧Office形式の.doc / .ppt / .xls、EPUB、OpenDocument、URLからの変換には対応していません。
  • 変換結果は元文書の見た目を再現するものではありません。レイアウト依存の内容は品質レポートとプレビューで確認してください。

よくある質問

WordやPowerPointをMarkdownに変換できますか?

はい。DOCXとPPTXに対応しています。見出し、段落、リスト、表、リンク、PowerPointの発表者ノート、埋め込み画像などを可能な範囲でMarkdownへ変換します。

PDFをMarkdownにできますか?

はい。PDFの文字レイヤーをPDF.jsで読み取り、配置から見出し・段落・読み順を推定してMarkdown化します。ただしスキャンPDFや画像だけのPDFにOCRは行いません。

文書内の画像も残せますか?

DOCX / PPTXの埋め込み画像は、相対パスで参照する画像付きZIPとして保存できます。必要なら画像をBase64でMarkdownへ直接埋め込んだ1ファイルとして保存することもできます。

複数ファイルをまとめて変換できますか?

はい。最大20ファイル、合計300 MBまでキューへ追加できます。成功した結果は「すべてZIP保存」でまとめて保存できます。

文書ファイルはサーバーへ送信されますか?

いいえ。Web版を開くための最初のHTML取得はありますが、選択した文書の解析、Markdown生成、プレビュー、保存はブラウザ内で行い、文書内容を変換のために外部サーバーへ送信しません。

オフライン版・ソースコード

document-to-markdown.htmlはPDF.js本体・Worker・日本語CMapなど必要なランタイムを内包した単一HTMLです。保存したHTMLを対応ブラウザで直接開けば、文書解析とMarkdown変換を実行時の外部通信なしで利用できます。

GitHubでソースを見る