この道具の仕組み
PDFのテキストレイヤーを読み、ページ内の文字要素を配置順に連結します。
入力と結果の例
処理例
- 入力
- 議事録PDF
- 結果
- ページ区切り付きテキスト
使う前に知っておくこと
- 01画像だけのスキャンPDFはOCR付きPDF化またはOCRテキスト化を使用してください。
- 02複雑な段組みでは読み順が前後する場合があります。
PDFテキスト抽出は、テキスト入りPDFから文字列をページごとに抽出します。 ファイルは端末内で読み込み、処理前の設定と出力内容を確認してから保存できます。
選択したファイルは端末内だけで処理します。
処理後の内容を確認してから保存できます。
ファイルを選んで実行すると、ここに結果が表示されます。
PDFのテキストレイヤーを読み、ページ内の文字要素を配置順に連結します。