> ## Documentation Index
> Fetch the complete documentation index at: https://docs.abbyy.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 数字列の検索

> 8 に対する B や 5 に対する S などの誤認識文字を Character String のアルファベットに追加することで、FlexiLayout Studio での数字列の検出を改善します。

型が **Character String** の要素は、数字列を検索するために使用します。画質が非常に良好であれば、アルファベットに正規表現を指定することもできます。しかし、バッチ内の画像の品質にばらつきがある場合は、対応する field で認識される可能性のある文字の一覧を指定する必要があります。

画像や印字の品質が十分でないと、数字が別の文字として誤認識されることがあります。たとえば、`8` が `B`、`7` が `?`、`5` が `S`、`4` が `H` や文字の組み合わせ `LI` として認識されることがあります。このようなことは、数字同士が「くっついて」いる場合に起こることがあり、タイプライターで記入された文書ではよく見られます。

<div id="add-misrecognized-characters-to-the-alphabet">
  ## 誤認識文字をアルファベットに追加する
</div>

認識結果が実際の文字とどの程度一致するかは、画質に左右されます。

処理する画像のすべて、または大部分で文字の誤認識が起こる傾向がある場合は、対応する **Character String** 要素の **Edit Alphabet** ウィンドウで、それらの認識候補をアルファベットに追加してください。これらの文字を指定すると、検索領域内でそれらの文字が見つかった場合に、FlexiLayout Studio はその仮説にペナルティを課さなくなります。

<Note>
  もちろん、考えられる認識候補を*すべて*指定する必要はありません。画像の品質が悪い場合、そのような候補をすべて見つけ出すのは非常に時間のかかる作業になることがあります。画質が低く、認識結果を予測できない場合は、文字列の長さや文字列内の空白の長さなど、他の要素のプロパティを使用して検索を実行してください。
</Note>

数字と形が似ている文字を指定してください。そのような文字は、他の文字よりも誤認識される可能性が高くなります。数字とよく取り違えられる文字であれば、他の文字を指定することもできます。

<Frame>
  <img src="https://mintcdn.com/abbyy/lqYknuOmCa79141v/images/flexi-capture/fls/edit_alph3.gif?fit=max&auto=format&n=lqYknuOmCa79141v&q=85&s=e7d8b86d6d82f62954238b74cc132e15" alt="数字と、Character String 要素のアルファベットに誤認識文字が追加された Edit Alphabet ウィンドウのスクリーンショット" width="536" height="350" data-path="images/flexi-capture/fls/edit_alph3.gif" />
</Frame>

<div id="match-with-a-digits-only-alphabet">
  ## 数字のみのアルファベットでマッチングする
</div>

プロジェクト `1.fsp` (フォルダー `Digital strings\Project1`) を考えます。

このプロジェクトには3つのページがあり、それぞれに異なる認識エラーがあります。

| ページ   | 認識エラー                                                   |
| :---- | :------------------------------------------------------ |
| ページ 1 | 数字 `4` は文字 `LI` の組み合わせとして認識されます。                        |
| ページ 2 | 部分文字列 `13` は文字 `å` として認識されます。                           |
| ページ 3 | 数字 `0` は `a`、`2` と `5` は `S`、`6` と `8` は `B` として認識されます。 |

数字列を検出するために、このプロジェクトでは **DigitalString** という名前の **Character String** 要素を使用し、そのアルファベットには数字のみを指定しています。数字以外の文字の最大割合は 20% に設定されています。

すべてのページに対して FlexiLayout マッチング手順を実行すると、ページ 3 の数字fieldは完全には検出されませんでした。仮説のQuality値は約 0.98 です。ページ 1 と 2 では文字列は検出されましたが、アルファベットに含まれない文字が含まれているため、対応する仮説にはペナルティが課され、Qualityはそれぞれ 0.978 と 0.982 になっています。

<div id="rematch-with-the-extended-alphabet">
  ## 拡張したアルファベットで再マッチングする
</div>

次に、数字の代わりに誤認識された文字 `L`、`I`、`e`、`a`、`B`、`S` をアルファベットに追加した場合の FlexiLayout のマッチング結果を見てみましょう。

FlexiLayout のマッチング結果は、プロジェクト `2.fsp` (フォルダー `%public%\ABBYY\FlexiCapture\12.0\Samples\FLS\Tips and Tricks\Digital strings\Project2`) で確認できます。

プロジェクト内のその他の設定は同一です。

ご覧のとおり、ページ 3 の文字列は完全に検出され、生成されたすべての仮説の品質は 1 です。
