Pro · Business · Enterprise · ファイルは1時間後に削除
スキャンしたPDFを検索可能に。
OCRはスキャンしたPDFに見えないテキスト層を追加します — Ctrl-Fで検索したり、引用をコピーしたり、他の文書に貼り付けたりできます。見た目はまったく同じままです。
PDFをOCR処理 →アカウント不要 · 無料プランは最大25 MBまで · 変換後1時間で完全削除
スキャンをCtrl-F
200ページのスキャン契約書も、検索できなければ役に立ちません。OCR後は、あらゆる単語がインデックス化されます — PDFリーダー、ファイルマネージャーの検索、そして取り込み先のあらゆる文書管理システムで。
スキャンから文字をコピー
OCR後、スキャンしたPDF内の文字を選択してコピーできます。Word、メール、Notion、どこへでも貼り付けられます。PDFから引用を打ち直す必要はもうありません。
プライベートで安全
文書はHTTPSでアップロードし、EUで処理、共有は一切なし、1時間以内に完全削除します。あなたの契約書をAI学習に使うことはありません。
使い方
1
スキャンしたPDFをアップロード
Pro / Business / Enterpriseアカウントにサインインし、「スキャンPDFをOCR」ツールを開いて、PDFをドラッグして入れます。
2
Tesseractを実行
各ページは、もともとHPで開発され現在はGoogleが保守するオープンソースの文字認識エンジンTesseractでOCRされます。認識されたテキストは、既存の視覚的なページの背後に見えない層として追加されます。
3
検索可能なPDFをダウンロード
元と同一に見えます。しかし今やCtrl-Fが効き、テキスト選択ができ、PDFのテキストを読むあらゆるツールがそれを読めます。
よくある質問
そもそも「OCR」とは?
光学文字認識(OCR)です。テキストのピクセル画像(スキャン、文書の写真)を、コンピューターが読める実際の文字に変換します。PDFの見た目は変えません — 検索やコピーが効くよう、見える画像の背後に、機械が読める見えないテキストを追加するだけです。
対応している言語は?
英語・フランス語・ドイツ語・日本語に対応 — ツール内で文書の言語を選ぶと精度が最も高くなります(既定は英語)。Tesseractの100以上の言語のうち他の言語が必要な場合は support@formatly.pro までご連絡ください。
精度はどれくらい?
きれいな最新のスキャンでは通常95〜99%の精度です。スマホで撮影したレシート、手書きメモ、低解像度のファックスでは80〜90%に下がります。最良の結果:印刷テキストの300 DPIスキャン。精度を最大化するため、OCR前にページの傾き補正と自動回転を行います。
どれくらい時間がかかりますか?
1ページあたりおよそ2〜5秒です。50ページの契約書で約3分かかります。5分を超えるものは明確なエラーでキャンセルされます — それより大きい文書は、先にPDFを分割するか、より上限の高いEnterprise処理についてお問い合わせください。
ファイルサイズの上限はありますか?
Proユーザーは1ファイル500MB。Businessは5GB。OCRエンジンは大きな文書にも対応します — 上限は標準プランの区分によるものだけです。