iformat.io ロゴ iformat.io
iformat.io ロゴ iformat.io

PDF から HTML へのコンバーター

オンラインで無料でPDFをHTMLに変換します。高速、プライベート、サインアップなし、透かしなし — ブラウザーで高品質の PDF から HTML への変換。

PDF ファイルをここにドロップします
または、このボックス内の任意の場所をクリックしてファイルを選択します

最大ファイルサイズは10MBです。 サインアップ さらに詳しく。

PDF を編集可能な HTML に戻す

PDF のレイアウトがフリーズします。契約条項を編集したり、レポートを更新したり、他の人の文書のタイプミスを修正したりするなど、凍結を解除する必要がある場合があります。

  1. 1

    PDFをアップロードする

    このツールは、無料プランでは最大 10 MB、Pro では最大 1 GB の PDF を受け入れます。 Word、LaTeX、またはブラウザからエクスポートされた種類のテキストベースの PDF は、きれいに変換されます。スキャンされた PDF または画像のみの PDF には、最初に OCR が必要です。ツールはこれを検出し、可能な場合には OCR パスを自動的に実行します。

  2. 2

    ツールに構造を推測させます

    PDF には段落、見出し、表という概念が組み込まれていません。変換では、視覚的なレイアウトを分析することによってそれらが再構築されます。適切にフォーマットされたソースはきれいな出力を生成します。異常な列、サイドバー、または脚注を含むソースの場合は、後で Word で簡単なクリーンアップが必要になる場合があります。

  3. 3

    変換してダウンロード

    出力 HTML は数秒で完成します。 Word、Google Docs、または LibreOffice で開きます。編集する必要があるものはすべてそこにあります。アップロードした PDF と変換されたドキュメントはどちらも 30 分以内にサーバーから完全に削除されます。

HTML に戻っても何が生き残るのか

テキストの内容、段落の区切り、ほとんどの見出しスタイル、ほとんどの場合の表、インライン画像、ハイパーリンク、基本的な書式設定 (太字、斜体、下線) がすべて反映されます。複数列のレイアウトは、明示的に保存しない限り、単一列にリフローされます。カスタム フォントは、一般的に最も近い同等のフォントに置き換えられます。複雑な図やベクター アートワークは通常、画像として埋め込まれます。

人をつまずかせるもの

  • スキャンした PDF には OCR が必要です。 ソースがページのスキャンまたは写真である場合、表示される「テキスト」は実際には画像コンテンツです。 OCR はそれを実際のテキストに変換します。ツールはそれを自動的に実行しますが、品質はソース スキャンがどれだけきれいかによって決まります。
  • 往復の損失は現実のものです。 PDF → Word → PDF に変換すると、パスごとに微妙な書式が失われます。オプションがある場合は、ラウンドトリップではなく、元のソースで編集してください。
  • テーブルは必ずしもテーブルであるとは限りません。 PDF の「テーブル」は、基礎となる構造を持たないテキスト ボックスのグリッドである場合があります。変換は最善を尽くしますが、頑固なケースは緩いテキストとして表示されることがあります。簡単な手動クリーンアップで修正されます。
  • パスワードで保護された PDF にはパスワードが必要です。 Adobe Reader でロックされた PDF は、同じパスワードを入力するまでツールにロックされたままになります。

実際に PDF を編集する必要がある場合

PDF を解凍して HTML に戻す 6 つの本当の理由。

PDF として送信された契約条項を編集する

PDF 契約書を受け取ったので、特定の条項について交渉する必要があります。 HTML に変換すると、適切に編集可能なドキュメントが得られます。変更を加えて PDF に変換し、送り返すだけです。単一の単語を微調整する以上の場合は、専用の PDF エディターよりもクリーンです。

古いレポートのコンテンツを再利用する

オリジナルの HTML ソースはとうの昔に失われていますが、アーカイブされた PDF はまだ残っています。変換すると基になるテキストが復元されるため、再入力することなく文章、表、または参考文献を新しい文書に取り込むことができます。

PDF からスプレッドシートにデータを取り込む

銀行取引明細書、請求書、レポートは、分析が必要な表形式のデータが満載の PDF として届くことがよくあります。編集可能な形式 (特に Excel) に変換すると、手動で行を再入力しなくても、並べ替え、フィルター、ピボットを行うことができます。

文書を翻訳する

翻訳メモリ ツール、DeepL、Google 翻訳は、PDF よりも編集可能な HTML ドキュメントの方がはるかにうまく機能します。最初に変換すると、翻訳はテキストの壁として現れるのではなく、段落構造とインライン書式設定をきれいに伝えることができます。

PDF をアクセシブルにする

スキャンされた PDF または画像のみの PDF は、スクリーン リーダーには表示されません。必要に応じて OCR を使用して HTML に変換すると、実際のテキストが抽出されるため、支援技術が読み上げることができ、後で検索で見つけることができます。

長い PDF を作業部分に分割する

200 ページの PDF は、凍結された 1 つの大きなブロックです。 HTML に変換すると、チャンクを新しいドキュメントに貼り付けたり、セクションを別の所有者に配布したり、コンテンツを単に読み取るだけでなく、コンテンツを操作したりできるようになります。

PDF と HTML: 並べて表示

2 つの形式の技術的な比較 - どちらを使用するかを決定する場合、または変換中に何が変更されるかを確認する場合に役立ちます。

プロパティ PDF HTML
フルネーム ポータブルドキュメントフォーマット ハイパーテキストマークアップ言語
導入年 1993 1993
開発者/標準ボディ アドビ W3C / ワットWG
MIMEタイプ 申請書/PDF テキスト/html
ファイル拡張子 .pdf .html / .htm
圧縮 内蔵(FlateDecode、DCTDecode) なし (転送時に gzip)
カラー/データ深度 ベクター + ラスター 該当なし
最大寸法/サイズ 381 km × 381 km (15,000 × 15,000 インチ) 無制限
透明性 はい いいえ
アニメーション いいえ はい
規格・仕様 ISO32000 W3C / WHATWG 生活基準
こんな方に最適 最終的な文書、契約書、アーカイブ - どこでも同じように見える ウェブページ、電子メールニュースレター、構造化ドキュメント

PDF形式について

PDF (Portable Document Format) は 1993 年に Adob​​e によって作成され、その後 ISO 標準 (ISO 32000) になりました。どのデバイス、オペレーティング システム、またはソフトウェアを使用してドキュメントを開くかに関係なく、ドキュメントの正確なレイアウト、フォント、画像、書式設定が保持されます。 PDF は、法的契約書から学術論文に至るまで、どこでも同じように見える必要がある文書を共有するための普遍的な標準です。

PDF は、単純なドキュメントの表示を超えて、インタラクティブなフォーム、デジタル署名、AES-256 暗号化、アクセシビリティ機能、埋め込みマルチメディアをサポートしています。 PDF/A バリアントは、電子ドキュメントの長期アーカイブ用に特別に設計されています。 PDF はデフォルトでは主に表示専用ですが、適切なツールを使用して編集可能にすることができます。 PDF は、公式文書、印刷可能な資料、およびプラットフォーム間で一貫したプレゼンテーションを必要とするあらゆるコンテンツにとって、依然として頼りになる形式です。

PDF から HTML へのコンバーターのドキュメント変換ガイド

PDF to HTML Converter に接続された PDF、Word、および編集可能なドキュメントのワークフローに関するガイドをお読みください。