SKSolveKit

ファイルはこの端末から外に出ません

文字認識

スキャンしたページを 検索できるテキストに。

スキャンページのテキストをブラウザ内で直接認識します(英語またはスペイン語)。結果はプレーンテキスト、または検索可能なPDFコピーとしてダウンロードできます。アップロードは一切ありません。

ファイルを読み込み中…

解決できること

ただの画像だったページから、検索もコピーもできるテキストへ。

このツールは、このサイト自身から配信されブラウザ内で動くTesseractモデルを使って、スキャンページの文字を認識します。現在利用できるのは英語とスペイン語です。言語とページを選び、ページごとの進み具合をライブで確認しながら途中でキャンセルもでき、結果はプレーンテキストのTXTファイル、または元のページに見えないテキスト層を重ねた検索可能なPDFとしてダウンロードできます。

認識の精度はスキャンの品質に左右されます。きれいでまっすぐな高解像度のスキャンはよく読み取れますが、薄い文字や傾いたページはページごとの信頼度を下げます。端末のメモリを使い切らないよう、1回につき20ページまでに制限しています。

よくある使い方

01

契約書の改訂を確認する

送った草案と戻ってきた版を比較し、署名する前にどのページが変更されたかを正確に把握します。

02

スキャン書庫を使えるようにする

英語やスペイン語のスキャンのテキストを認識し、引用や検索ができる検索可能なコピーを書き出します。

03

公開前の事前チェック

専門レビューに出す前にレポートへ4項目のアクセシビリティチェックを実行し、明らかな問題を先に直します。

かんたんな手順

閉じた文書から、はっきりした答えへ。

  1. 01内容を知りたいPDFを開きます。比較の場合は2つのバージョンを追加します。
  2. 02実行する内容を選びます。テキスト比較、認識する言語とページ、または4項目のアクセシビリティチェックです。
  3. 03分析を実行し、ページそのものの上で進み具合をページごとに確認します。
  4. 04結果を画面で読み、必要ならテキストやレポートをファイルとしてダウンロードします。

知っておきたい制限

分析に見えるものについて、正直に。

  • 01

    比較は抽出可能なテキストを読みます。テキスト層のないスキャンページは比較できず、画像やレイアウトなど見た目だけの変更は検出されません。スキャンは先にOCRで認識してください。

  • 02

    文字認識で選べるのは現在、英語とスペイン語です。1回につき最大20ページという上限は端末のメモリを使い切らないための意図的なもので、精度はスキャンの品質に左右されます。

  • 03

    アクセシビリティの結果は実務的な事前チェックであり、PDF/UAやWCAGの認証ではありません。適合した公開物には専門的な検証が引き続き必要です。

  • 04

    すべてこの端末上で動くため、非常に大きな文書はブラウザのメモリに制限されます。どの結果も新しいダウンロードで、原本を上書きすることはありません。

よくある質問

PDFのOCRに関するFAQ。

01このツールはPDFをアップロードしますか?

いいえ。分析はブラウザ内で実行され、認識モデルもこのサイト自身から配信されます。文書のデータが端末の外に出たり、サーバーに届いたりすることはありません。

02スキャンページで何も見つからないのはなぜですか?

スキャンはページの写真であり、読み取れるテキスト層がありません。先にOCRを実行してテキスト層を追加してから、認識済みのコピーを比較・チェックしてください。

03認識されたテキストはどのくらい正確ですか?

スキャン次第です。きれいでまっすぐな高解像度のページはよく読み取れますが、薄い文字や傾いたページは、表示されるページごとの信頼度を下げます。頼る前に結果を確認してください。

04アクセシビリティの結果は公式な認証ですか?

いいえ。タグ・言語・タイトル・スキャンのみのページという4つの実務的な前提を確認するだけです。PDF/UAやWCAGへの完全な適合には、専門的な検証と手動レビューが必要です。

関連ツール

続けて文書を仕上げる。

すべてのPDFツール