PDF から HTMLZ への変換方法
- .PDF ファイルを追加してください。上のボックスにドロップするか、クリックしてブラウズします。
- 数秒で .HTMLZ に変換されます。
- 新しい .HTMLZ ファイルをダウンロードしてください。
期待される結果
- PDF のテキストは抽出され、ZIP 圧縮された単一の HTML ファイルにリフローされます。固定ページレイアウトは保持されません。
- 複雑な多段組みや高度にスタイリングされたページは、きれいにリフローされない場合があります。
- OCR が実行されないため、画像のみのスキャン済み PDF からは利用可能なテキストはほとんど生成されません。
よくある質問
HTMLZ とは何ですか?なぜ PDF をこれに変換するのですか?
HTMLZ は、単一の HTML ファイルとそのリソースを ZIP アーカイブにパッケージ化したものです。変換することで、PDF のテキストをブラウザで表示・編集可能な自己完結型のバージョンとして取得できます。固定レイアウトのドキュメントではなく、リフロー可能な HTML が必要な場合に便利です。
変換後のレイアウトの再現性はどの程度ですか?
PDF は固定レイアウトであり、HTMLZ はリフロー可能な HTML を保持するため、テキストが抽出されて再配置されます。そのため、段組み、ヘッダー、複雑なデザインは崩れる可能性があります。シンプルな1段組みのドキュメントが最もきれいに変換されます。
HTMLZ ファイルはどうやって開きますか?
HTMLZ アーカイブを解凍し、任意のウェブブラウザやテキストエディタで HTML ファイルを開きます。この形式を作成する Calibre でも直接開くことができます。
スキャンされた PDF は HTMLZ にうまく変換できますか?
スキャンされた PDF はテキスト層のないページ画像であり、この変換では OCR(光学文字認識)を実行しないため、結果として選択可能なテキストはほとんど、あるいは全く含まれません。テキストベースの PDF が適切なソースとなります。
無料のPDFツールすべてのツール →