画像の文字を読み取ってテキスト化(無料 OCR)
xFormat.space はブラウザ内で動く文字認識モデルで画像から文字を読み取り、英語・中国語・日本語・韓国語・フランス語・ドイツ語に対応し、画像をアップロードしません。
ブラウザで動作 — ファイルは端末から出ません。
使い方
スクリーンショットや書類の写真、スキャンしたレシートを、コピー・編集できるテキストに変換できます。文字認識モデルはお使いの端末で動くので、画像そのものがアップロードされることはありません。初回は約 15 MB のモデルをダウンロードし、次回以降はキャッシュされます。
- 1
画像(JPG、PNG、WebP)をページにドロップし、OCR を開きます。
- 2
文字に合った認識言語を選びます。
- 3
「文字認識を開始」を押し、テキストを編集・コピーするか、TXT ファイルとしてダウンロードします。
対応言語と選び方
選べるのは 6 つで、1 回に 1 つずつ選びます:中国語・英語、英語、日本語、韓国語、フランス語、ドイツ語。日本語の書類やスクショなら「日本語」を選んでください。「中国語・英語」は中国語(簡体字・繁体字)と英語を同時に読むので、混在した文章に使います。英語だけの書類なら「英語」が自然です。言語を切り替えると、初めて使うときに別のモデルを読み込みます。
精度を上げるコツ
OCR の精度はほとんど入力画像で決まります。チャットアプリで共有して圧縮されたコピーではなく、元のスクリーンショットを使いましょう。紙の写真は、正面から、均一な明るさで、文字が画面の大部分を占め、行に影がかからないように撮ってください。ごちゃごちゃした背景は先にトリミングし、強い反射も避けましょう。印刷された文字が最も得意で、手書きや装飾的なフォントはうまくいかないことがあります。
認識後には、見つかったテキスト領域の数と平均の信頼度が表示されます。これは目安であり保証ではないので、数字、名前、法律やお金に関わる部分は必ず見直してください。テキスト欄は編集できるので、コピーする前に間違いを直せます。初回のモデルのダウンロードにはインターネット接続が必要ですが、画像は端末に残ります。
よくある質問
画像やスクショの文字を読み取ってテキストにするには?
xFormat.space に画像をドロップし、言語を選んで「文字認識を開始」を押します。認識したテキストは編集できる欄に表示され、コピーするか TXT としてダウンロードできます。
OCR はどの言語に対応していますか?
中国語・英語(繁体字も読めます)、英語、日本語、韓国語、フランス語、ドイツ語です。1 回につき 1 つの言語を選びます。
OCR のために画像はサーバーにアップロードされますか?
いいえ。文字認識モデルはブラウザ内で動きます。ダウンロードされるのはモデルファイル(初回約 15 MB)だけで、画像は端末に残ります。
初回の OCR が遅いのはなぜ?
初回は文字認識モデルとそのエンジンをダウンロードする必要があるからです。その後はキャッシュされるので、次回からはずっと速く始まります。
手書きの文字も読み取れますか?
印刷された文字向けに作られています。きれいな手書きなら部分的に読めることもありますが、結果は不安定なので、必ず出力を確認してください。