画像から文字起こし
写真・スクリーンショット・スキャンから文字を取り出します。ブラウザ内で完結し、何もアップロードされません。
何もアップロードしません
OCR エンジンはこのページの中で動きます。身分証も請求書も契約書も端末から出ません。
小さい画像は自動で拡大
小さすぎるスクリーンショットは、エンジンが必要とする文字の高さまで拡大します。突き返したりしません。
複数言語を同時に認識
文字種が混ざったスクリーンショットも一度で読み切ります。片方の言語だけ選んで半分を落とす必要はありません。
最大 20 枚
まとめて処理し、結果を一括ダウンロード。アカウント不要、1 日あたりの上限もありません。
ひとことで: 画像から文字を抽出するには、写真やスクリーンショットをドロップし、含まれている言語を選ぶだけです。すべてブラウザ内で行われるため、何もアップロードされません。スキャンや斜めから撮った写真なら、下処理のオプションはオンのままに —— どのツールを選ぶかより効いてきます。
同じ写真なのに、サイトによって結果が違う理由
宣伝ページが触れない事実があります。画像から文字を抽出する無料ツールの多くは、同じオープンソースのエンジン Tesseract を WebAssembly にコンパイルして動かしているのです。10 社を調べ、うち少なくとも 5 社は自らそう明記していました。ですから同じ写真であるサイトはきれいな文字を返し、別のサイトは意味不明な羅列を返すとき、エンジンが変数であることはまずありません。
画像から文字への変換で違うのは、エンジンに届くものの方です。そして最も効く要因は、どこも宣伝しません —— 文字の高さが何ピクセルあるか、です。Tesseract は小文字 1 字あたり約 20 ピクセルの高さを求めます。チャットアプリを 2 つ経由して転送されたスクリーンショットや、アップロード用に縮小された写真は、その半分しかないことがよくあります。すると精度は崖から落ちるように下がります。
他のツールが勧めてくること
撮り直し。テストした 10 社では、結果が悪いときの定番の助言は「より高い解像度で撮り直す・取り直す」です。もっともな助言ですが、その画像が手元にある唯一のものであるときには、まったく役に立ちません。
このページは代わりに、小さすぎる画像を読み取り前に拡大し、そうしたことを明示します。実測では、400 × 184 ピクセルのスクリーンショット —— 多くのツールならやり直しを勧める小ささ —— が確信度 94%、全行正しく返ってきました。拡大しても、そもそも写っていない情報は生まれません。しかし、エンジンが本来想定している文字の高さを与えることはできます。
OCR が実際にしていること、していないこと
光学文字認識は、画像内の明暗の画素の並びを見て、その形が最も可能性高くどの文字を表すかを判定します。ページを読んでいるのでも理解しているのでもなく、形を 1 文字ずつ文字に対応づけているだけです。
この区別が、OCR に対する不満のほとんどを説明します。珍しい書体の単語が誤認される理由、コーヒーの染みの向こうの文字が別の文字になる理由、そしてエンジンが存在しない単語を平然と、しかも自信ありげに出力する理由。これはパターン照合であって、理解ではありません。
同じ理由で、画像から文字を抽出できるツールはどれも、出力した一語ごとに確信度スコアを返します。このスコアは本物の情報であり、このページはそれを表示します。平均が 70% を下回ったときは、確定事項のように手渡すのではなく、結果に印を付けます。多くのツールはこの数値を隠しています。
実際に何に使われているか
スクリーンショットとエラーメッセージ
送られてきたスクリーンショットから、あるいは選択させてくれないエラーダイアログから、文字をコピーする。
レシートと請求書
撮影したレシートから金額や伝票番号を取り出す。表計算に打ち直さずに済みます。
撮影した紙のページ
印刷物・書籍・申込書の写真を、検索・編集・貼り付けできる文字に変える。
そもそもアップロードすべきでない書類
身分証、診断書、契約書。他人のサーバーに置かずに済ませたい画像の筆頭です。
画像から文字を抽出する手順
画像から文字を抽出する手順は 3 つです。インストールもアカウントもアップロードもありません。初回に OCR エンジンと選んだ言語データをブラウザのキャッシュへ取得し、以降はオフラインでも動きます。
- 1
画像を追加する
写真・スクリーンショット・スキャンをドラッグしてください。JPG、PNG、WebP、BMP、GIF に対応しています。一度に最大 20 枚まで追加でき、順番に処理されます。
- 2
言語と下処理を選ぶ
主な言語だけでなく、画像に現れるすべての言語を選んでください。スキャンや写真では下処理をオンのままに。スクリーンショットは元から整っているのでオフで構いません。傾き補正は、斜めから撮ったページのときだけオンにします。
- 3
抽出し、確認してコピーする
画像ごとに編集可能な枠へ文字が表示され、確信度も付きます。コピー、.txt でダウンロード、あるいはまとめて ZIP で取得できます。必ず元の画像と見比べてざっと確認してください —— OCR の出力は、間違っていても自信ありげに見えます。
エンジンと言語データは初回でキャッシュされるため、2 枚目以降はすぐに読み取りが始まります。
成否を決める 3 つのこと
画像から文字を抽出するとき、結果が悪い原因はほぼ必ずこのいずれかです。そして 1 つ目が、残り 2 つを合わせたより重く効きます。
解像度 —— 他を大きく引き離して
Tesseract は小文字 1 字あたり約 20 ピクセルの高さを求めます。文字が詰まったページなら、画像の短辺が千ピクセル前後ということです。それを下回ると精度は急激に落ちます。このページは小さすぎる画像を読み取り前に拡大し、そのことを明示します。実測では 400 × 184 のスクリーンショットでも全行正しく返りました。とはいえ、ぼやけた写真を拡大しても、大きくぼやけた写真になるだけです。撮り直せるなら、ページで画面いっぱいを満たしてください —— それはこのサイトでも他のどのサイトでも、どんな設定より効きます。
コントラスト —— そして下処理が思ったほど効かない理由
エンジンはインクと紙を分ける必要があるので、くすんだスキャンや半分に落ちた影は仕事を難しくします。下処理は、画像全体で 1 回ではなく領域ごとに計算する局所適応しきい値で白黒化します。照明にムラのある写真に必要なのは、まさにこれです。効果の大きさについて率直に言うと、現代の Tesseract は内部で独自の二値化をすでに行っているため、そこそこ明るい写真では差はわずかです。実測では確信度が数ポイント動き、ときに余計な文字が 1 つ混じりました。本当にくすんだスキャンや暗所の写真でこそ意味があり、スクリーンショットでは必要ありません。
角度 —— 撮影したページにだけ意味がある
OCR は水平の行として読むため、数度でも傾いたページでは、単語がエンジンの走査している画素の行をまたいでずれていきます。傾き補正は文字の主たる角度を検出し、読み取り前に画像を戻します。手持ちで斜めに撮ったものではオンに。スクリーンショットやフラットベッドスキャンではオフのままに —— 補正すべき傾きがなく、検出は誤差を持ち込むだけです。
率直なまとめ:手元にある中で最も大きく鮮明な版から始めてください。その上で、スキャンや暗い写真なら下処理を、斜めに撮ったものなら傾き補正を。どちらも、最初から小さすぎた画像を救うことはできません。
複数言語が混ざったスクリーンショット —— 他のどのツールもやっていない唯一のこと
ここで多くの人がつまずきます。テストしたツールはどれも、抽出前に言語を 1 つだけ選ばせます。日本語だけのページなら問題ありませんが、現実の画像の多くはそうではありません。英語の商品名が並ぶ中国語の請求書、ラテン文字のブランド名が出てくる日本語の画面、英語の URL を引用したロシア語の文書。
言語を 1 つだけ選ぶと、画像内のもう一方の文字種の領域から文字を抽出しようとする試みは、ことごとくうまくいきません。エンジンにその文字が見えていないからではなく、間違ったモデルと照合しているからです。結果として、文字の半分と、残り半分があるはずの場所に大量の無意味な羅列が返ってきます。
Tesseract は複数の言語モデルを同時に読み込めます。このページでは必要なだけ選べます。テストした 10 社のうち、これを提供しているところは 1 つもありませんでした。例外なく、抽出前に 1 言語へ絞ることを求められます。引き換えについても正直に書いておきます。言語が増えるほど初回に取得するデータは増え、複数読み込むと認識はやや遅くなります。一覧を全部チェックするのではなく、画像に実際に現れている言語だけを選んでください。
これができないこと
OCR には実際の限界があります。画像から文字を抽出する前にそれを知っておくことは、どんな設定をいじるよりも時間の節約になります。
手書き、とくに筆記体
Tesseract は活字で訓練されています。丁寧なブロック体の大文字なら通ることもありますが、普通の続け字はまず無理です。これはこのページではなくエンジンの限界であり、Tesseract を土台にした無料ツール —— つまりほとんど —— すべてに当てはまります。ただし、そう書いているところは多くありません。
書式とレイアウト
得られるのはプレーンテキストです。太字、斜体、見出し、色、書体はすべて失われます。表は構造を失って単語の並びになり、2 段組のページは段ごとではなく横に読み通されることがあります。
本当に写りの悪い写真を救うこと
下処理は、そこそこの画像を改善します。写っていなかった情報を作り出すことはできません —— 小さな文字を写したぼやけた・暗い・とても小さい写真が読めるようにはなりません。高い解像度で撮り直すことが、どんな処理にも勝ります。
書類の内容を理解すること
見えた文字を読み順で返す、それだけです。どの数字が合計でどの行が日付かは分かりません。それに基づいて何かをするなら、必ず確認してください。
無料ツールの比較
画像から文字を抽出するツール 10 種を、2026 年 9 月に実際に使って確認しました。無料枠の挙動のみ、かつ差の出る項目のみを載せています —— どれも無料で、多くはブラウザ内で動きます。
| ツール | 処理場所 | 一括処理 | 複数言語を同時に |
|---|---|---|---|
| このページ | あなたのブラウザ | 最大 20 枚 | 可 —— 任意の組み合わせ |
| PixConvert | あなたのブラウザ | 1 枚ずつ | 不可 —— 1 言語のみ |
| UtiloKit | あなたのブラウザ | 1 枚ずつ | 不可 —— 1 言語のみ |
| OpenConvert | あなたのブラウザ | 可 | 不可 —— 1 言語のみ |
| Pixellize | あなたのブラウザ | 1 枚ずつ | 不可 —— 1 言語のみ |
| imagetotext.info | 記載なし | 有料プラン | 不可 —— 1 言語のみ |
| OnlineOCR.net | 先方のサーバー | ログイン時のみ | 不可 —— 1 言語のみ |
正直にまとめると、ここに挙げた画像から文字起こしするツールのいくつかはまったく良質で、ブラウザ内で動くものはその点で評価に値します —— かつてはそれが差別化でしたが、今はもう違います。今も差があるのは 2 点です。一括で渡せるかどうか、そして文字種の混ざった画像を一度で読めるかどうか。後者については、それができる別のツールを見つけられませんでした。
充実の PDF ツール一式
あらゆる文書作業に対応する、当社の充実した PDF ツール群をご覧ください
PNG を PDF に変換
PNG 画像をまとめて、印刷対応の 1 つの PDF に
JPG を PDF に変換
JPG 画像を PDF 形式に変換
PDF 結合
複数の PDF ファイルを 1 つに結合
PDF 圧縮
PDF のファイルサイズを効率よく縮小
PDF を PNG に変換
PDF のページを PNG 画像に変換
PDF を JPG に変換
PDF のページを JPG 画像に変換
PDF をテキストに変換
PDF ファイルからテキスト内容を抽出
PDF 分割
PDF を個別のページに分割
PDF 編集
PDF 文書を編集・注釈
PDF 整理
PDF のページを整理・並べ替え
PDF を回転
PDF のページを回転して永続的に保存
ページ番号
ライブプレビュー付きで PDF にページ番号を追加
PDF 透かし
ライブプレビュー付きで PDF にテキスト透かしを追加
HEIC を JPG に変換
iPhone の HEIC 写真を JPG に変換
PDF ページ削除
不要なページを削除して、きれいな PDF をダウンロード
PDF ページ抽出
選んだページを新しい PDF または個別ファイルとして保存
PDF 署名
手書き・入力・画像アップロードで署名を作成し、任意のページに配置
PDF サイズ変更
ページサイズを A4・レターやカスタム寸法に変更
PDF トリミング
余白の切り取り・ドラッグ選択・余白の自動トリミング
PDF のフラット化
フォームを読み取り専用に — テキストの検索を保つか、画像に固定
PDF メタデータ
作成者・タイトル・日付などのメタデータを表示・編集・削除
PDF グレースケール
グレースケールや白黒に変換してカラーインクを節約
PDF から画像を抽出
PDF に埋め込まれた写真を取り出して PNG や JPG で保存
WebP を PDF に変換
WebP 画像を PDF に変換し、複数を 1 つのファイルにまとめる
PDF をパスワード保護
ブラウザだけで PDF に開くためのパスワードを追加
PDF のロック解除
パスワードがわかっている PDF からパスワードや制限をブラウザで解除
HEIC を PDF に変換
iPhone の HEIC 写真を PDF に変換
AVIF を PDF に変換
AVIF 画像を PDF に変換
TIFF を PDF に変換
TIFF 画像やスキャンを PDF に変換
BMP を PDF に変換
BMP ビットマップを PDF に変換
PDF OCR
スキャンしたPDFを検索可能に。すべてブラウザ内で完結
PDF 墨消し
PDFの機密部分を完全に削除。すべてブラウザ内で完結
画像を圧縮
JPEG・PNG・WebP をまとめて圧縮。すべてブラウザ内で完結
画像サイズ変更
よく使うプリセット付きで、画像サイズをまとめて変更
PNG を JPG に変換
PNG 画像を一括で JPG に変換。ダウンロード前に出力サイズを確認できます
JPG を PNG に変換
JPG 画像を一括で PNG に変換。単色の背景を透明にすることもできます
WebP を JPG に変換
WebP ファイルを一括で JPG に変換。アニメーション WebP は全フレームを書き出せます
WebP を PNG に変換
WebP を PNG に変換して透明を保持。単色の背景を取り除くこともできます
画像を WebP に変換
JPG や PNG などを一括で WebP に変換。KB 単位の目標サイズも指定できます
SVG を PNG に変換
好きなサイズで SVG をラスタライズ、ロゴ 1 つからアイコン一式も作成
AVIF を JPG に変換
どこでも開ける JPG に変換、KB 単位で目標サイズも指定できます
PDF比較
2つのPDFのどこが変わったかを正確に確認。どちらもアップロードしません
SVG→JPG
SVG を好きなサイズで JPG に書き出し、透明部分を何色にするかも選べます
GIF→PNG
静止画を 1 枚取るか、アニメーション GIF を 1 フレーム 1 枚の連番 PNG に分解
GIF→JPG
透明の代わりに何を敷くか選び、1 フレームか全部かを決められます。PNG の方がよい場合ははっきり伝えます
PDF を TIFF に変換
PDF を 1 つのマルチページ TIFF に変換
画像から文字起こし
写真やスクリーンショットから文字を抽出
画像からの文字抽出について
画像から文字を抽出して結果を使う前に、実際によく聞かれること。
無料ですか。制限はありますか。
無料です。アカウント不要、1 日あたりの上限なし、透かしもありません。 一度に 20 枚、1 枚 25 MB まで処理できます。この上限があるのは OCR が CPU を大きく使い、しかもお使いのマシンで動くからで、有料プランのためではありません。終わったらそのまま次の一括処理を始めてください。
画像はどこかにアップロードされますか。
いいえ。OCR エンジンはこのページの中で動きます。 画像はお使いのブラウザが読み取り、送信されることはありません。ここでは多くの変換以上にこの点が重要です。人が OCR にかける画像は、身分証・請求書・診断書・契約書だからです。
初回に数 MB ダウンロードされたのはなぜですか。
OCR エンジンと言語データで、一度きりです。 認識がサーバーではなく手元で動く以上、エンジンが端末に届く必要があります。その後はキャッシュされるので、次からはすぐに始まり、オフラインでも動作します。
手書きは読めますか。
当てになりません。筆記体はたいてい読めません。 エンジンは活字で訓練されています。丁寧なブロック体の大文字なら読めることもあります。Tesseract を土台にした無料ツールすべてに当てはまり、それはほとんどのツールを意味します。
結果が間違っていました。何を変えればよいですか。
まず解像度、次に下処理、最後に角度です。 画像から文字を抽出するとき、より大きく鮮明な元画像はどんな設定にも勝ります —— しかも僅差ではありません。次に、くすんだスキャンや暗い写真なら下処理を、斜めに撮ったページなら傾き補正をオンに。画像に 2 種類の文字が含まれるなら、どちらが主かを当てずに両方の言語を選んでください。
2 つの言語が混ざった画像も扱えますか。
はい —— 主な言語だけでなく、含まれるすべてを選んでください。 エンジンが複数モデルを同時に読み込み、両方の文字種を一度の処理で読み取ります。他の多くのツールはちょうど 1 つを選ばせるため、混在したスクリーンショットが半分空のまま返ってくるのです。
レイアウトや表、太字は保たれますか。
いいえ。出力はプレーンテキストです。 書式・色・書体は失われ、表は構造を失い、多段組のページは上から下ではなく横に読み通されることがあります。レイアウトを保ちたいのであれば、必要なのは抽出したテキストではなく、テキスト層を持つ PDF です。
画像ではなく PDF を持っている場合は。
PDF 用の OCR ツールをお使いください —— ページをそのまま保てます。 各ページを描画して読み取り、元のページの上に見えないテキスト層を書き戻すので、見た目は変わらないまま検索可能になります。先に PDF を画像に変換してここへ通すと、文書としての構造が失われます。
関連ツール
画像から文字を抽出する前後で役に立つもの。いずれも無料で、いずれもお使いの端末上で動きます。
- PDF に OCR をかける — 写真ではなく文書向け —— 検索可能なテキスト層を加え、ページはそのまま保ちます。
- PDF をテキストに — PDF に本物の文字がすでに入っていて、取り出すだけでよいとき。OCR は不要です。
- 画像のサイズ変更 — 小さすぎるスクリーンショットを読み取り前に拡大したり、大きすぎる写真を縮めたり。
- 画像を圧縮 — 画像自体は問題ないのに、ファイルが大きくて送れないときに。
- PDF を PNG に変換 — 文字ではなく絵の方が必要なとき、PDF のページを画像として取り出します。