PDF から HTML への変換方法
- .PDF ファイルを追加してください。上のボックスにドロップするか、クリックしてブラウズします。
- 数秒で .HTML に変換されます。
- 新しい .HTML ファイルをダウンロードしてください。
期待される結果
- PDF の固定レイアウトを HTML で完全に再現できるコンバーターはありません。段組みが結合されたり、表が崩れたり、脚注が順不同で表示されたりすることがあります。
- スキャンされた PDF からは、選択可能なテキストのない画像ブロックのみを含む HTML が生成されます。まず PDF に OCR を実行してテキストレイヤーを追加してください。
- pdf2htmlEX はフォントを base64 データとして埋め込むため、出力ファイルが大きくなることがあります。2ページの PDF が 1 MB を超える HTML ファイルになる場合もあります。
よくある質問
出力された HTML は通常の Web ページのように編集できますか?
実用的ではありません。ほとんどのコンバーターは、意味論的な HTML 構造ではなく、絶対的な CSS 配置を使用して PDF のレイアウトを再現します。編集可能なコンテンツにするには、まず
DOCX に変換してから Word で HTML として保存してください。スキャンされた PDF を変換して、選択可能なテキストを取得できますか?
OCR 処理後のみ可能です。まず OCRmyPDF のようなツールで PDF を処理してから、生成されたファイルを HTML に変換してください。
PDF から HTML への変換はロスレス(無劣化)ですか?
いいえ - 本質的に非可逆(ロスあり)です。テキストの内容は通常正しく転送されますが、レイアウト、透明効果、複雑なグラフィックなどは維持されない場合があります。
pdf2htmlEX は Windows で動作しますか?
はい。WSL(
sudo apt install pdf2htmlex)経由、またはプロジェクトの GitHub リリースページから提供されているビルド済みの Windows バイナリを使用してください。無料のPDFツールすべてのツール →
PDF を変換するプログラム: Adobe Acrobat · Calibre · iStonSoft ePub Converter · Microsoft Word · Adobe InDesign · Adobe Acrobat for Mac · Calibre for Mac · Adobe InDesign for Mac