画像から文字を抽出
JPG、PNG、WebP 画像を数秒で編集可能な文字に変換します。
画像から文字を抽出する方法
- 01端末から JPG、PNG、WebP 画像を選びます。
- 02画像内の文字の言語を選び、必要ならプレビューを回転します。
- 03文字を抽出して確認し、コピーするか TXT ファイルをダウンロードします。
この OCR が対応する内容
英語、ベトナム語、ドイツ語、オランダ語、簡体字中国語、日本語、韓国語、アラビア語の印刷文字を認識します。ぼやけたり歪んだ写真より、鮮明なスキャンやスクリーンショットの方が良好です。
OCRの制限
段組み、表、手書き文字、大きく湾曲した文字では読み順が不正確になる場合があります。
画像 OCR のよくある質問
より良い OCR 結果を生み出す画質はどれですか?
鮮明でコントラストの高い印刷テキストが最適です。小さな文字を表示するのに十分なピクセルを備えた鮮明なソース、均一な照明、制限された圧縮、およびできるだけ平らでまっすぐに撮影されたページを使用してください。抽出する前に、無関係な背景をトリミングし、テキストを直立に回転させます。非常に低い解像度、モーション ブラー、グレア、影、テクスチャード紙、湾曲したページ、装飾的なフォント、および積極的な画像強調により、文字の形状が融合したり壊れたりする可能性があります。純粋に低解像度のソースを拡大すると視認性は向上しますが、キャプチャされなかった細部を再現することはできません。
正しい OCR 言語を選択することが重要なのはなぜですか?
言語の選択によって、どの認識モデルと文字パターンが期待されるかが決まります。中国語、日本語、韓国語、アラビア語、ベトナム語、またはドイツ語のテキストに対して英語を選択すると、予想されるアルファベット、アクセント、方向、単語のパターンが異なるため、妥当ではありますが不正確な置換が生成される可能性があります。画像に表示されている主な言語を選択してください。 1 つの画像に複数の言語が混在している場合は、最も重要なセクションを対応する言語で個別に抽出し、名前、数字、日付、および専門用語を注意深く比較してください。これは、通常の言語パターンからの助けが少ないためです。
検出された読み取り順序に影響を与えるものは何ですか?
OCR はテキスト領域を識別し、その位置から順序付けします。複数段組みの記事、表、サイドバー、フォーム、キャプション、縦書きテキスト、曲線ラベル、重複するスタンプ、手書きのメモなどにより、意図した順序が曖昧になる可能性があります。順序が重要な場合は、独立した領域を切り取って個別に抽出します。抽出後、完全な文書レイアウトが再構築されたと仮定するのではなく、結果をソースと上から下に比較し、段落区切りを復元し、見出し、表の行、ラベル、脚注、画像の横にあるテキストを検証します。
OCR は表や文書の書式を保持できますか?
いいえ。このツールは、Word、スプレッドシート、または元のデザインの検索可能な PDF の再作成ではなく、編集可能なテキストと検出された領域を返します。列が予期しない順序で読み取られる可能性があり、表のセルで行と列の関係が失われる可能性があり、フォント、色、間隔、境界線、画像、およびページ家具が一致するレイアウトとして保持されないことがあります。結果を使用して再入力を回避し、宛先アプリケーションで必要な構造を再構築し、重要な値を信頼する前にソースと比較します。
OCR の処理時間が異なるのはなぜですか?
時間は、画像の寸法、テキスト領域の数とサイズ、レイアウトの複雑さ、選択した言語、回転、認識の準備に必要なリソースによって異なります。大きな写真と中央に小さな文書がある場合は、より多くの作業が必要になる可能性がありますが、厳密にトリミングされたスキャンよりも品質の悪いテキストが生成される可能性があります。必要な文字を保持する最小の鮮明な画像を使用し、無関係な領域をトリミングし、すでに鮮明なソースを繰り返し拡大することは避けてください。結果または有用なエラーが表示されるまで、ページを開いたままにしてください。
抽出された OCR テキストを検証するにはどうすればよいですか?
名前、日付、住所、合計、小数点区切り文字、口座番号、識別子、句読点、および 1 つの間違いで意味が変わってしまう文字を比較します。よくある混同には、ゼロと O、1 と小文字の l、同様の句読点、アクセント付きの文字、CJK またはアラビア文字の視覚的に関連する文字などがあります。行の順序と、画像または表の周囲のテキストの欠落を確認します。法律、財務、医学、学術、またはアーカイブ資料の場合は、結果を別の記録にコピーする前に、元の画像に対して 2 回目のレビューを使用します。