メニュー
すべての記事

画像から文字起こし:どんな写真からも無料でテキスト抽出(OCRオンライン)

読了目安:10分無料 · 登録不要

写真の中の文字を取り出したいことはありませんか? スキャンしたレシート、ホワイトボードの写真、書類のスクリーンショット、看板の写真など、**OCR(光学文字認識:Optical Character Recognition)**を使えば、画像のピクセルをコピー・編集・検索できる本物のテキストに変換できます。このガイドでは、当サイトの無料の画像 文字起こし(OCR)ツールの使い方を説明します。認識処理は当社のサーバー上で行われます。ファイルは暗号化された通信で送信され、テキストの抽出が終わりしだい削除されます。


OCRとは?

OCRは**Optical Character Recognition(光学文字認識)**の略です。画像を解析して、文字・数字・句読点の形を識別し、機械が読み取れるテキストを生成する技術です。

最新のOCRエンジンは、何百万もの印刷文字や手書き文字で学習したニューラルネットワークを使っています。さまざまなフォント、サイズ、言語、画像の状態でも、多少の傾きやぼやけがあっても文字を認識できます。

OCRは次のような場面を支えています。

  • 銀行が小切手や本人確認書類をデジタル化する
  • Google Searchが画像内のテキストをインデックスする
  • 郵便サービスが封筒の手書きの宛名を読み取る
  • アーカイブ担当者が何百万冊ものスキャンした書籍を検索可能にする

同じ技術を、ここで無料でお使いいただけます。


画像からテキストを抽出する方法(ステップごとの手順)

画像 文字起こし(OCR)ツールは、当社のサーバー上でTesseract OCRを実行します。画像は暗号化されたHTTPS接続でアップロードされ、テキストが抽出されたあと、アップロードされたファイルはサーバーから削除されます。

ステップ1:画像 文字起こし(OCR)ツールを開く

want2convert.com/image-to-textにアクセスします。シンプルなアップロードエリアと言語の選択欄が表示されます。

ステップ2:画像をアップロードする

画像をアップロードエリアにドラッグ&ドロップするか、クリックしてデバイスから選択します。対応形式はJPG、PNG、TIFF、BMP、WebP、PDFで、サイズは50 MBまでです。スキャンした書類は、できるだけ高い解像度でスキャンしてください。300 DPI以上が最も良い結果になります。

ステップ3:言語を選ぶ(必要な場合)

初期設定では英語を認識します。このツールはスワヒリ語(キスワヒリ)、フランス語、アラビア語にも対応しています。抽出する前に、ドロップダウンから画像内の文字の言語を選んでください。正しい言語モデルを使うと、アクセント付き文字や言語特有の文字パターンの精度が大きく向上します。それ以外の言語には現在対応していません。

ステップ4:「テキストを抽出」をクリックする

ボタンをクリックします。ファイルが当社のサーバーに送信され、認識精度を高めるために拡大とグレースケール変換が行われ、その後Tesseractが読み取ります。処理時間は通常数秒ですが、画像のサイズや文字の密度によって変わります。リクエストは約2分でタイムアウトします。

ステップ5:結果をコピーまたはダウンロードする

抽出されたテキストがテキストエリアに表示されます。次のことができます。

  • クリップボードにコピー — Word、Googleドキュメント、その他のテキストエディターにそのまま貼り付けられます
  • .txtをダウンロード — 結果を.txtファイルとして保存します

OCRに向いた元画像とは

OCRの精度は、入力画像の品質に大きく左右されます。特に差が出るのは次の点です。

解像度: 文字を読み取るには十分なピクセル数が必要です。明るい場所で、無理のない距離(30〜50 cm)から撮影したスマートフォンの書類写真は、たいていうまくいきます。小さな文字をはっきり読み取るための実用的な最低解像度は約150〜200 DPIで、300 DPIはアーカイブ用スキャンにおけるOCRの標準です。

コントラスト: 明るい背景に濃い文字という組み合わせが、エンジンにとって最もわかりやすい信号になります。インクのかすれ、白い紙に薄いグレーの文字、模様のある背景に色付きの文字などは、精度を下げます。

シャープさ: 手ブレやピント不良によるぼやけた画像は、OCRエラーの最大の原因です。書類を撮影するときは、安定した場所にスマートフォンを置いてください。文字が小さい書類には、スマートフォンのマクロモードが効果的です。

向き: 大きく傾いたり回転したりした文字は精度を下げます。OCRエンジンはわずかな傾き(数度)なら処理できますが、急な角度で撮影したページは結果が悪くなります。必要に応じて、先に画像 回転ツールで写真の向きを正しく直してください。

ノイズと影: 折り目、ページにかかる影、背景の質感は精度を下げます。書類は明るい色の机の上に平らに置き、均一な照明で撮影してください。


精度:OCRにできること、できないこと

OCRは、きれいでコントラストの高い印刷書類では非常に高精度で、入力が良好なら文字の99%以上が正しく認識されることもよくあります。ただし、この技術には知っておくべき現実的な限界があります。

| 入力の種類 | 期待される精度 | |------------|------------------| | きれいにスキャンした印刷書類(300 DPI) | 98〜99%以上 | | 印刷文字を鮮明に撮影したスマートフォン写真 | 90〜97% | | かすれた、またはコントラストの低い印刷物 | 70〜85% | | 手書き(丁寧で一定の筆跡) | 60〜80% | | 手書き(続け字・筆跡にばらつきあり) | 40〜65% | | 装飾の強いフォントやロゴ | 30〜60% | | ノイズや背景が多い画像内の文字 | 50〜75% |

良好な条件の印刷文字なら、ほぼ完璧な結果が期待できます。ただし、出力は必ず校正してください。数字や名前の1文字の誤りが重大な結果につながることがあります。


画像からテキストへの主な使い道

スキャンした書類とPDF

オフィスでは今も大量の紙の書類を扱っています。スキャンした契約書、フォーム、手紙をPDFや画像で受け取ったとき、OCRを使えば検索・編集できる文書に変換できます。テキストを抽出したら、WordやGoogleドキュメントに貼り付けて編集するか、Ctrl+Fで検索できるファイルとして保存しましょう。

レシートと請求書

経費管理のためにレシートを撮影するのは一般的な方法です。OCRで明細、合計金額、店名を抽出すれば、打ち直さずにそのままスプレッドシートや経費報告書に貼り付けられます。

名刺

スマートフォンで撮影した名刺の写真をOCRにかけると、相手の名前、役職、電話番号、メールアドレス、会社名が取り出せ、そのまま連絡先アプリにコピーできます。

記事やWebページのスクリーンショット

スクリーンショットから引用したい場合や、画像ベースのPDF(スキャンした書籍、テキストを選択できないPDF)から文字をコピーしたい場合も、OCRなら実際に使えるテキストとして抽出できます。

ホワイトボードの写真

会議のあと、ホワイトボードのメモの写真はカメラロールに眠ったままになりがちです。OCRで、テキストファイルや検索できるメモに変えられます。

書籍やアーカイブのデジタル化

古い書籍、新聞、歴史的な記録をスキャンする研究者や系譜研究者は、OCRでそれらのアーカイブを検索可能にしています。ここで使っているオープンソースのエンジンTesseractは、アーカイブのデジタル化プロジェクトで広く使われています。

翻訳の作業フロー

まず画像からテキストを抽出し、それを翻訳ツールに貼り付けます。外国語の書類、メニュー、看板の写真から文字を手で打ち直すよりも、はるかに速く済みます。


OCRとコピー&ペースト:どちらを使うべきか

テキストレイヤーのあるデジタルPDFなら、Ctrl+A+Ctrl+C(すべて選択してコピー)のほうがOCRより速く正確です。OCRを使うのは次のような場合です。

  • PDFがスキャンした画像である(テキストレイヤーがない)
  • 元データが写真またはスクリーンショットである
  • 書類でテキストを選択できない(ロックされたPDF。先にロックを解除したほうがよい場合もあります)
  • 文字が紙の書類、看板、ホワイトボードにある

よくある質問

OCRツールは本当に無料ですか?
はい、完全無料です。アカウントも定期購入も不要で、出力に透かしも入りません。

画像は安全ですか?
画像やPDFは暗号化された(HTTPS)接続で当社のサーバーに送信され、そこでTesseract OCRにより処理され、テキストの抽出が終わりしだい削除されます。コピーは保存せず、アカウントも不要です。ファイルはサーバー上で処理されるため、インターネット経由で送ることに抵抗のある書類はアップロードしないでください。

どの言語に対応していますか?
初期設定は英語です。言語の選択欄から、スワヒリ語(キスワヒリ)、フランス語、アラビア語も選べます。それ以外の言語には現在対応していません。

精度はどのくらいですか?
十分な解像度のきれいな印刷文字なら、精度は通常とても高くなります。手書きや品質の低い画像では下がります。重要な書類では、出力を必ず校正してください。

手書き文字は読み取れますか?
OCRの手書き認識には限界があります。印刷文字で最も良く動作し、手書きのメモ、特に続け字では結果が悪くなることがあります。

画像の最大サイズは?
アップロードは50 MBまで、リクエストは約2分でタイムアウトします。非常に大きな画像は処理が遅くなることがあります。OCRの前に画像リサイズツールで幅2000〜3000ピクセルに縮小すると、精度を落とさずに処理が速くなることがよくあります。

PDFからテキストを抽出できますか?
はい、PDFを直接アップロードできます。ページがレンダリングされ、1ページずつ読み取られます。PDFが大きい場合や細かく制御したい場合は、先にPDF JPG 変換ツールでページをJPGまたはPNGとして保存し、その画像にOCRをかけることもできます。

なぜ一部の文字が間違うのですか?
OCRのエラーは、解像度の低さ、ぼやけ、コントラスト不足、珍しいフォントが原因であることがほとんどです。入力画像の品質を改善して、もう一度実行してみてください。lが1と読まれるなど、毎回同じ誤りが出る場合は、抽出後に手作業で修正してください。


関連ツール

  • 画像リサイズ — 精度を上げるため、OCRの前に小さい画像を拡大します
  • 画像 回転 — OCRの前に、傾いた写真をまっすぐに直します
  • PDF JPG 変換 — OCR用に、スキャンしたPDFのページを画像に変換します
  • 画像 圧縮 — OCRに必要な解像度を保ったまま、画像サイズを小さくします
  • JPG PNG 変換 — 小さな文字の書類をOCRする前に、劣化のない品質にするためPNGに変換します
  • 画像トリミング — OCRを実行する前に、写真の文字部分だけを切り出します

無料でお試しください — 登録は不要です

ほとんどのツールはブラウザ内で動作するため、ファイルはお使いの端末の外に出ません。一部のツールはファイルを当社のサーバーにアップロードし、処理後に削除します。

すべてのツールを見る