[{"data":1,"prerenderedAt":27},["ShallowReactive",2],{"blog-ja-prepare-scanned-images-for-ocr-guide":3},{"slug":4,"locale":5,"title":6,"description":7,"date":8,"author":9,"tags":10,"keywords":15,"h1":16,"readingTime":17,"html":18,"recommendedTools":19,"faqs":26},"prepare-scanned-images-for-ocr-guide","ja","OCRの前に確認したい画像の準備と撮影のポイント","ぼけ、傾き、反射、切り抜きをOCR前に確認。代表的な一ページで試してから一括処理し、文字や表を原画像と照合します。","2026-09-15","DocCrunch Team",[11,12,13,14],"OCR画像の準備","スキャン文字認識","画像をWordに変換","画像をExcelに変換",[11,12,13,14],"画像を文字に変換する前に、OCRに適した画像か確認しましょう",5,"\u003Cp>文字認識の誤りは、ツール選びが原因とは限りません。同じページでも撮影角度、光、文字の大きさで結果が変わります。\u003C\u002Fp>\n\u003Cp>OCRが受け取るのは紙の原文ではなく画素です。ぼけた線、欠けた線、隠れた線が正しく補われるとは期待できません。同じ画像で繰り返すより、元の画像を確認する方が時間を節約できます。\u003C\u002Fp>\n\u003Ch2>撮影の問題とレイアウトの問題を区別する\u003C\u002Fh2>\n\u003Cp>一文字ずつ間違う場合もあれば、文字はおおむね正しくても段落順が乱れる場合もあります。対処は異なります。\u003C\u002Fp>\n\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>画像の問題\u003C\u002Fth>\n\u003Cth>起こり得る結果\u003C\u002Fth>\n\u003Cth>最初にすること\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\n\u003Ctr>\n\u003Ctd>ピンぼけ、手ぶれ、小さすぎる文字\u003C\u002Ftd>\n\u003Ctd>線の混同、数字の誤認識\u003C\u002Ftd>\n\u003Ctd>撮り直すか鮮明な原本を入手\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>反射、遮り、白飛び\u003C\u002Ftd>\n\u003Ctd>一部の文字が欠落\u003C\u002Ftd>\n\u003Ctd>光や遮りを調整して再撮影\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>傾き、遠近のゆがみ\u003C\u002Ftd>\n\u003Ctd>行順の乱れ、領域の読み落とし\u003C\u002Ftd>\n\u003Ctd>角度の改善や文書画像の補正\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>段組み、複雑な表、図文混在\u003C\u002Ftd>\n\u003Ctd>読み順と構造の誤り\u003C\u002Ftd>\n\u003Ctd>領域ごとに処理して手作業で整理\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\n\u003C\u002Ftable>\n\u003Cp>誤りの場所を原画像で拡大します。人にも文字が判別できなければ、設定変更だけでは解決しないことがあります。\u003C\u002Fp>\n\u003Ch2>容量よりページ全体の鮮明さを優先する\u003C\u002Fh2>\n\u003Cp>十数MBの写真でも中央の数行しか鮮明でないことがあります。容量はページ全体の読みやすさを保証しません。\u003C\u002Fp>\n\u003Cp>紙を平らにし、カメラを正面に向け、文書が画面の主要部分を占めるようにします。撮影後はサムネイルだけでなく四隅、端、小さな文字も確認します。\u003C\u002Fp>\n\u003Cp>下部だけがぼけたり、綴じ目の近くで文字が曲がったりしても、出力品質を上げるだけでは直りません。可能なら撮影条件を改善します。\u003C\u002Fp>\n\u003Cp>スキャナーでは適切な解像度を選びます。既存写真のDPI値だけを変更しても線の情報は増えません。文字の実際の画素が鮮明かを確認します。\u003C\u002Fp>\n\u003Ch2>不要部分を切り抜いても文字に密着させない\u003C\u002Fh2>\n\u003Cp>机の模様、隣の紙、黒いスキャン枠も認識に入ることがあります。適切な切り抜きで対象を明確にできます。\u003C\u002Fp>\n\u003Cp>\u003Ca href=\"\u002Fja\u002Fimage-crop\u002F\">画像の切り抜き\u003C\u002Fa>では文字全体と少しの余白を残し、最初の行や最後の文字に枠を密着させないでください。表の見出し、単位、注記も数字を解釈するために必要です。\u003C\u002Fp>\n\u003Cp>傾きも確認します。大きく傾いた行は行分割に影響します。\u003Ca href=\"https:\u002F\u002Ftesseract-ocr.github.io\u002Ftessdoc\u002FImproveQuality.html\">Tesseractの品質ガイド\u003C\u002Fa>でも傾き補正と適度な余白が説明されています。\u003C\u002Fp>\n\u003Cp>ただし回転と遠近補正は別です。台形に撮れたページを回すだけでは各部分の文字比率はそろいません。\u003C\u002Fp>\n\u003Ch2>欠けた線を画像補正で推測しない\u003C\u002Fh2>\n\u003Cp>明るさ調整で改善する場合もあれば、情報自体が撮れていない場合もあります。\u003C\u002Fp>\n\u003Cp>影の下の文字は低コントラストでも残っている可能性があります。反射で真っ白になった部分には使える線がないかもしれません。\u003C\u002Fp>\n\u003Cp>強い白黒処理も細線を消したり隣の線と結合させたりします。きれいに見えるページが必ず認識向きとは限りません。\u003C\u002Fp>\n\u003Cp>AI拡大も原文確認の根拠にはできません。読みやすくなった文字が別の文字かもしれないためです。金額、番号、名前は補正結果から埋めず、鮮明な資料を優先します。\u003C\u002Fp>\n\u003Ch2>一括処理の前に一ページで試す\u003C\u002Fh2>\n\u003Cp>本文に加え、小文字、数字、表を含む代表的な画像を選びます。利用できる結果か確認してから全体を処理します。\u003C\u002Fp>\n\u003Cp>本文には\u003Ca href=\"\u002Fja\u002Fimage-to-word\u002F\">画像からWordへの変換\u003C\u002Fa>、表には\u003Ca href=\"\u002Fja\u002Fimage-to-excel\u002F\">画像からExcelへの変換\u003C\u002Fa>を使えます。形式選びは整理を助けますが、元の配置の完全再現を保証しません。\u003C\u002Fp>\n\u003Cp>最初の段落だけでなく中央と末尾も確認します。文章が自然でも番号、日付、小数点が正しいとは限りません。\u003C\u002Fp>\n\u003Cp>端の読み落としや列ずれが繰り返されるなら、まず入力画像へ戻ります。一括処理すると同じ誤りを増やすだけかもしれません。\u003C\u002Fp>\n\u003Ch2>認識前後にそれぞれ確認する\u003C\u002Fh2>\n\u003Cp>OCR前は次を確認します。\u003C\u002Fp>\n\u003Cul>\n\u003Cli>ページが完全で向きが正しい。\u003C\u002Fli>\n\u003Cli>小さな文字と四隅が鮮明で、目立つ手ぶれがない。\u003C\u002Fli>\n\u003Cli>重要領域に反射、遮り、白飛びがない。\u003C\u002Fli>\n\u003Cli>切り抜きが適切で必要な余白や説明がある。\u003C\u002Fli>\n\u003Cli>繰り返し転送、画面撮影、圧縮したコピーではなく鮮明な原画像を使う。\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>認識後は原画像と段落順、抜けた行、金額、日付、番号、固有名詞を照合します。表では各値の行と列も確認します。\u003C\u002Fp>\n\u003Cp>DocCrunchの\u003Ca href=\"\u002Fja\u002Fimage-to-word\u002F\">画像からWordへの変換\u003C\u002Fa>はブラウザー内で認識しますが、照合は必要です。原画像が根拠となり、OCRが入力を減らし、校正が結果を確かめます。\u003C\u002Fp>\n\u003Cp>一文字ずつ直すより入力の準備が効果的な場合があります。変換文書だけでなく、いつでも比較できる鮮明な原画像も残してください。\u003C\u002Fp>\n",[20,22,24],{"slug":21},"image-crop",{"slug":23},"image-to-word",{"slug":25},"image-to-excel",[],1789443216045]