PDF のテキスト抽出
PDF 内のテキストをページごとに抽出し、コピーや TXT 保存。OCR が必要なページを区別して表示します。
PDF のページを選んで JPG・PNG に変換。解像度を指定し、出力画像を確認して個別または ZIP で保存できます。
例:1-3,5 または 3,1,1。指定順と重複を保持します。
最大 200 ページ、1 ページ 1,600 万画素、合計 2 億 5,600 万画素、出力 128 MiB。超過時は解像度かページ数を減らしてください。
拡大・縮小や回転はプレビューにのみ反映され、書き出すファイルには影響しません。
処理はブラウザー内で完結し、アップロードや入力の保存は行いません。暗号化 PDF は非対応。キャンセル可能で、90 秒を超える処理は停止します。 サンプルはテキスト 1 ページと、意図的な空白 1 ページです。
PDF のページを選んで JPG・PNG に変換。解像度を指定し、出力画像を確認して個別または ZIP で保存できます。
PDF を選び、1-3,5 のようにページを指定します。写真は JPG、文字や図表は可逆圧縮の PNG が適しています。まずは 144 DPI を試し、必要に応じて変更してください。300 DPI ではメモリー使用量が増えます。出力は白背景のページ全体で、内部画像の取り出しではありません。上限に達した場合は DPI を下げるか、ページを分けて処理してください。
いいえ。描画する画素は増えますが、失われた細部は戻りません。JPG 品質は圧縮率に関わり、PNG は可逆形式です。どちらも白背景のページ全体を出力します。
はい。3,1,1 と入力すると 3 ページ目の後に 1 ページ目を 2 回出力します。ファイル名に連番が付くため、ZIP 内で上書きされません。
ファイル容量が小さくても、画像の画素数が少ないとは限りません。出力は 1 ページ 16 MP(1,600 万画素)、1 回の処理で合計 256 MP(2 億 5,600 万画素)、200 ページ、画像ファイル合計 128 MiB までです。1 ページの出力画素数が上限を超える場合は DPI を下げ、合計の上限を超える場合はページを分けて処理してください。これとは別に、PDF に埋め込まれた元画像 1 枚にも 16 MP の上限があります。この上限は出力 DPI を下げても変わりません。元の文書で画像の縦横のピクセル数を減らしてから、PDF を作り直してください。
コメント
0