OCRツール
クラウドサービスによるインテリジェント認識で画像からテキストを抽出。英語・簡体字・繁体字中国語に対応。
ファイルをアップロード
JPG, PNG, WebP
使い方
テキストを含む画像をアップロード
テキストを含む画像を選択してください。スクリーンショット、スキャンされたドキュメント、看板の写真に対応しています。対応形式:JPEG、PNG、WebP。最大ファイルサイズ:50 MB。
言語を選択して処理
テキストの言語(英語、簡体字中国語、または繁体字中国語)を選択してください。「テキスト抽出」をクリックしてください。初回実行時に言語データ(約 10〜20 MB)をダウンロードしますが、以降の実行はより高速になります。
テキストをコピーまたはダウンロード
抽出されたテキストを確認し、エディタで修正してから、クリップボードにコピーするか .txt ファイルとしてダウンロードしてください。テキストエリアは編集可能なので、簡単に修正できます。
OCRツールとは?
OCRツールは、WebAssembly版の業界標準Tesseract OCRエンジンであるTesseract.jsを使用して、画像からテキストを完全にブラウザ内で抽出します。画像データはサーバーに一切送信されません。英語・簡体字中国語・繁体字中国語のテキスト認識をサポートしています。この無料ブラウザベースのOCRツールは、スクリーンショット・スキャン文書・印刷物の写真からテキストを抽出するのに最適です。
なぜOCRツールを使うのか?
クライアントサイド処理が決定的な特徴です。Tesseract.jsはブラウザでローカルに実行されるため、契約書・医療記録・身分証明書などの機密文書がどこにもアップロードされることがなく、プライベートなコンテンツに安全に使用できます。英語と並んで中国語文字認識をサポートしているため、バイリンガル文書や東アジア言語コンテンツに役立ちます。登録不要・ファイルサイズのアップロード制限なし・ページごとの料金なしで利用できます。
- lock完全なプライバシー — ファイルはデバイスやブラウザから出ることはありません。
- bolt即時処理 — 待ち時間なし、サーバーキューなし、アップロード遅延なし。
- money_off100%無料 — サブスクリプションなし、クレジットなし、隠れた料金なし。
- person_off登録不要 — アカウント不要ですぐに使用開始。
- devicesどこでも動作 — デスクトップ、タブレット、モバイルの最新ブラウザで動作。
仕組み
学生は教科書のページを撮影し、メモ作成や翻訳のために読み取り可能なテキストを抽出するためにこのツールを使用します。専門家はスキャンされたPDFや画像ベースの文書を受け取り、ワープロで編集するためにテキストを抽出するために使用します。開発者はOCRパイプラインをテストする際に、バックエンド実装にコミットする前に特定の文書タイプでのTesseract精度をすばやくベンチマークするために使用します。
プロのヒント
OCRの精度は、高解像度の画像とテキストと背景の強いコントラストにより大幅に向上します。結果にエラーが多い場合は、再処理前に画像解像度を少なくとも300 DPI以上に上げ、テキストが明るい背景に暗く表示されるようにしてください。
よくある質問
関連チュートリアル
チュートリアル