写真の中の文字を取り出したいことはありませんか? スキャンしたレシート、ホワイトボードの写真、書類のスクリーンショット、看板の写真など、**OCR(光学文字認識:Optical Character Recognition)**を使えば、画像のピクセルをコピー・編集・検索できる本物のテキストに変換できます。このガイドでは、当サイトの無料の画像 文字起こし(OCR)ツールの使い方を説明します。認識処理は当社のサーバー上で行われます。ファイルは暗号化された通信で送信され、テキストの抽出が終わりしだい削除されます。
OCRとは?
OCRは**Optical Character Recognition(光学文字認識)**の略です。画像を解析して、文字・数字・句読点の形を識別し、機械が読み取れるテキストを生成する技術です。
最新のOCRエンジンは、何百万もの印刷文字や手書き文字で学習したニューラルネットワークを使っています。さまざまなフォント、サイズ、言語、画像の状態でも、多少の傾きやぼやけがあっても文字を認識できます。
OCRは次のような場面を支えています。
- 銀行が小切手や本人確認書類をデジタル化する
- Google Searchが画像内のテキストをインデックスする
- 郵便サービスが封筒の手書きの宛名を読み取る
- アーカイブ担当者が何百万冊ものスキャンした書籍を検索可能にする
同じ技術を、ここで無料でお使いいただけます。
画像からテキストを抽出する方法(ステップごとの手順)
画像 文字起こし(OCR)ツールは、当社のサーバー上でTesseract OCRを実行します。画像は暗号化されたHTTPS接続でアップロードされ、テキストが抽出されたあと、アップロードされたファイルはサーバーから削除されます。
ステップ1:画像 文字起こし(OCR)ツールを開く
want2convert.com/image-to-textにアクセスします。シンプルなアップロードエリアと言語の選択欄が表示されます。
ステップ2:画像をアップロードする
画像をアップロードエリアにドラッグ&ドロップするか、クリックしてデバイスから選択します。対応形式はJPG、PNG、TIFF、BMP、WebP、PDFで、サイズは50 MBまでです。スキャンした書類は、できるだけ高い解像度でスキャンしてください。300 DPI以上が最も良い結果になります。
ステップ3:言語を選ぶ(必要な場合)
初期設定では英語を認識します。このツールはスワヒリ語(キスワヒリ)、フランス語、アラビア語にも対応しています。抽出する前に、ドロップダウンから画像内の文字の言語を選んでください。正しい言語モデルを使うと、アクセント付き文字や言語特有の文字パターンの精度が大きく向上します。それ以外の言語には現在対応していません。
ステップ4:「テキストを抽出」をクリックする
ボタンをクリックします。ファイルが当社のサーバーに送信され、認識精度を高めるために拡大とグレースケール変換が行われ、その後Tesseractが読み取ります。処理時間は通常数秒ですが、画像のサイズや文字の密度によって変わります。リクエストは約2分でタイムアウトします。
ステップ5:結果をコピーまたはダウンロードする
抽出されたテキストがテキストエリアに表示されます。次のことができます。
- クリップボードにコピー — Word、Googleドキュメント、その他のテキストエディターにそのまま貼り付けられます
- .txtをダウンロード — 結果を
.txtファイルとして保存します
OCRに向いた元画像とは
OCRの精度は、入力画像の品質に大きく左右されます。特に差が出るのは次の点です。
解像度: 文字を読み取るには十分なピクセル数が必要です。明るい場所で、無理のない距離(30〜50 cm)から撮影したスマートフォンの書類写真は、たいていうまくいきます。小さな文字をはっきり読み取るための実用的な最低解像度は約150〜200 DPIで、300 DPIはアーカイブ用スキャンにおけるOCRの標準です。
コントラスト: 明るい背景に濃い文字という組み合わせが、エンジンにとって最もわかりやすい信号になります。インクのかすれ、白い紙に薄いグレーの文字、模様のある背景に色付きの文字などは、精度を下げます。
シャープさ: 手ブレやピント不良によるぼやけた画像は、OCRエラーの最大の原因です。書類を撮影するときは、安定した場所にスマートフォンを置いてください。文字が小さい書類には、スマートフォンのマクロモードが効果的です。
向き: 大きく傾いたり回転したりした文字は精度を下げます。OCRエンジンはわずかな傾き(数度)なら処理できますが、急な角度で撮影したページは結果が悪くなります。必要に応じて、先に画像 回転ツールで写真の向きを正しく直してください。
ノイズと影: 折り目、ページにかかる影、背景の質感は精度を下げます。書類は明るい色の机の上に平らに置き、均一な照明で撮影してください。
精度:OCRにできること、できないこと
OCRは、きれいでコントラストの高い印刷書類では非常に高精度で、入力が良好なら文字の99%以上が正しく認識されることもよくあります。ただし、この技術には知っておくべき現実的な限界があります。
| 入力の種類 | 期待される精度 | |------------|------------------| | きれいにスキャンした印刷書類(300 DPI) | 98〜99%以上 | | 印刷文字を鮮明に撮影したスマートフォン写真 | 90〜97% | | かすれた、またはコントラストの低い印刷物 | 70〜85% | | 手書き(丁寧で一定の筆跡) | 60〜80% | | 手書き(続け字・筆跡にばらつきあり) | 40〜65% | | 装飾の強いフォントやロゴ | 30〜60% | | ノイズや背景が多い画像内の文字 | 50〜75% |
良好な条件の印刷文字なら、ほぼ完璧な結果が期待できます。ただし、出力は必ず校正してください。数字や名前の1文字の誤りが重大な結果につながることがあります。
画像からテキストへの主な使い道
スキャンした書類とPDF
オフィスでは今も大量の紙の書類を扱っています。スキャンした契約書、フォーム、手紙をPDFや画像で受け取ったとき、OCRを使えば検索・編集できる文書に変換できます。テキストを抽出したら、WordやGoogleドキュメントに貼り付けて編集するか、Ctrl+Fで検索できるファイルとして保存しましょう。
レシートと請求書
経費管理のためにレシートを撮影するのは一般的な方法です。OCRで明細、合計金額、店名を抽出すれば、打ち直さずにそのままスプレッドシートや経費報告書に貼り付けられます。
名刺
スマートフォンで撮影した名刺の写真をOCRにかけると、相手の名前、役職、電話番号、メールアドレス、会社名が取り出せ、そのまま連絡先アプリにコピーできます。
記事やWebページのスクリーンショット
スクリーンショットから引用したい場合や、画像ベースのPDF(スキャンした書籍、テキストを選択できないPDF)から文字をコピーしたい場合も、OCRなら実際に使えるテキストとして抽出できます。
ホワイトボードの写真
会議のあと、ホワイトボードのメモの写真はカメラロールに眠ったままになりがちです。OCRで、テキストファイルや検索できるメモに変えられます。
書籍やアーカイブのデジタル化
古い書籍、新聞、歴史的な記録をスキャンする研究者や系譜研究者は、OCRでそれらのアーカイブを検索可能にしています。ここで使っているオープンソースのエンジンTesseractは、アーカイブのデジタル化プロジェクトで広く使われています。
翻訳の作業フロー
まず画像からテキストを抽出し、それを翻訳ツールに貼り付けます。外国語の書類、メニュー、看板の写真から文字を手で打ち直すよりも、はるかに速く済みます。
OCRとコピー&ペースト:どちらを使うべきか
テキストレイヤーのあるデジタルPDFなら、Ctrl+A+Ctrl+C(すべて選択してコピー)のほうがOCRより速く正確です。OCRを使うのは次のような場合です。
- PDFがスキャンした画像である(テキストレイヤーがない)
- 元データが写真またはスクリーンショットである
- 書類でテキストを選択できない(ロックされたPDF。先にロックを解除したほうがよい場合もあります)
- 文字が紙の書類、看板、ホワイトボードにある
よくある質問
OCRツールは本当に無料ですか?
はい、完全無料です。アカウントも定期購入も不要で、出力に透かしも入りません。
画像は安全ですか?
画像やPDFは暗号化された(HTTPS)接続で当社のサーバーに送信され、そこでTesseract OCRにより処理され、テキストの抽出が終わりしだい削除されます。コピーは保存せず、アカウントも不要です。ファイルはサーバー上で処理されるため、インターネット経由で送ることに抵抗のある書類はアップロードしないでください。
どの言語に対応していますか?
初期設定は英語です。言語の選択欄から、スワヒリ語(キスワヒリ)、フランス語、アラビア語も選べます。それ以外の言語には現在対応していません。
精度はどのくらいですか?
十分な解像度のきれいな印刷文字なら、精度は通常とても高くなります。手書きや品質の低い画像では下がります。重要な書類では、出力を必ず校正してください。
手書き文字は読み取れますか?
OCRの手書き認識には限界があります。印刷文字で最も良く動作し、手書きのメモ、特に続け字では結果が悪くなることがあります。
画像の最大サイズは?
アップロードは50 MBまで、リクエストは約2分でタイムアウトします。非常に大きな画像は処理が遅くなることがあります。OCRの前に画像リサイズツールで幅2000〜3000ピクセルに縮小すると、精度を落とさずに処理が速くなることがよくあります。
PDFからテキストを抽出できますか?
はい、PDFを直接アップロードできます。ページがレンダリングされ、1ページずつ読み取られます。PDFが大きい場合や細かく制御したい場合は、先にPDF JPG 変換ツールでページをJPGまたはPNGとして保存し、その画像にOCRをかけることもできます。
なぜ一部の文字が間違うのですか?
OCRのエラーは、解像度の低さ、ぼやけ、コントラスト不足、珍しいフォントが原因であることがほとんどです。入力画像の品質を改善して、もう一度実行してみてください。lが1と読まれるなど、毎回同じ誤りが出る場合は、抽出後に手作業で修正してください。
関連ツール
- 画像リサイズ — 精度を上げるため、OCRの前に小さい画像を拡大します
- 画像 回転 — OCRの前に、傾いた写真をまっすぐに直します
- PDF JPG 変換 — OCR用に、スキャンしたPDFのページを画像に変換します
- 画像 圧縮 — OCRに必要な解像度を保ったまま、画像サイズを小さくします
- JPG PNG 変換 — 小さな文字の書類をOCRする前に、劣化のない品質にするためPNGに変換します
- 画像トリミング — OCRを実行する前に、写真の文字部分だけを切り出します
無料でお試しください — 登録は不要です
ほとんどのツールはブラウザ内で動作するため、ファイルはお使いの端末の外に出ません。一部のツールはファイルを当社のサーバーにアップロードし、処理後に削除します。