Skip to main content
自動学習では、文書処理中のオペレーターの判断をシステムが学習し、field検出の精度を向上させることができます。システムがfieldを見つけられない場合、オペレーターはその正しい位置を指定します。修正された文書がエクスポートされると、システムはそれらの修正内容を学習用の入力として使用します。 オペレーターが作業を開始する前にプロジェクトを学習させる必要がある場合は、管理者がフィールド抽出学習を実行することもできます

自動学習を設定する

1

Document Definition を作成する

Document Definition を作成します。セクションのプロパティで、Allow field location training を選択します。
2

field を作成する

セクション内に field を作成し、各 field のプロパティで Can have region を選択します。
3

保存して公開する

Document Definition を保存して公開します。
4

学習ステージを有効にする

バッチタイプのプロパティで Workflow をクリックし、Training ステージを有効にします。
管理者が Document Definition を設定すると、システムは Verification Station でオペレーターが行った修正から自動的に学習します。

自動学習用の候補を設定する

外観が大きく異なる同じタイプの文書では、field レイアウトごとに候補を作成し、それらを識別する分類器を学習します。詳細については、「同じタイプの文書における可変 field の位置」を参照してください。
1

セクション候補を追加する

次のいずれかの方法で セクション候補を追加します。
  • 候補を手動で作成する: セクション のプロパティの Data Sets タブで、ViewAdd の順にクリックします。
  • データベースから候補をロードする: Data Sets タブで Set Up をクリックし、データソースとして Database を選択します。
  • script を使用して候補を作成する: Data Sets タブで Set Up をクリックし、データソースとして Script を選択します。
2

保存して公開する

Document Definition を保存して公開します。
3

候補を使用して分類器を学習する

  1. Open Classifier Training Batches モードに切り替え、新しい バッチ に文書画像をロードします。
  2. 候補をそれぞれ別の class として使用し、各文書に参照クラスを割り当てます。Set Class → Add → Add をクリックし、Specify variant を選択してから、リストから候補を選択します。
  3. Project → Classification Training → Train を使用して分類器を学習します。
オペレーター が文書に割り当てられた候補を確認・変更できるようにするには、service field を使用してフォームに候補 ID を表示します。詳細については、「オペレーター による候補の変更を有効にする」を参照してください。

自動学習 の仕組み

オペレーターが field の位置を検証・修正したドキュメントは、学習用バッチに追加され、学習済み FlexiLayout の現在のバージョンと照合されます。すべての field が正しく検出されれば、FlexiLayout を再学習する必要はありません。 オペレーターによる修正が必要だったにもかかわらず、FlexiLayout が field を正しく検出することがあります。これは、ドキュメントが検証待ちの間に古いバージョンまたは未学習のバージョンで処理され、その間にシステムが他のドキュメントを使用して FlexiLayout を学習したためです。これらのドキュメントは For testing ステータスで学習用バッチに保持され、将来のバージョンの性能低下を防ぐための回帰テストに使用されます。 学習済みの FlexiLayout が適用され、一部の field region が一致しない場合、それらのドキュメントは新しいバージョンの学習に使用され、For training ステータスが割り当てられます。その結果、新しい FlexiLayout バージョンが作成されます。FlexiCapture は、新しいバージョンと以前のバージョンの両方を For training および For testing のドキュメントに適用し、検出された field region がユーザーによる確認内容とどの程度一致するかを確認します。そして、最も一致度の高いバージョンを保持し、もう一方を削除します。