Den Suchtext beschreiben

Suchtext mithilfe eines regulären Ausdrucks beschreiben
Syntax für reguläre Ausdrücke
| Name in der Liste | Symbol im Feld | Beispiel | ||
|---|---|---|---|---|
| Beliebiges Zeichen | * | “k”*“t” – erlaubt ‘kit’, ‘kat’ usw. | ||
| Buchstabe | C | C”at” – erlaubt cat, bat, Rat, mat usw. | ||
| Großbuchstabe | A | A”at” – erlaubt Cat, Bat, Rat, Mat usw. | ||
| Kleinbuchstabe | a | a”at” – erlaubt cat, bat, rat, mat usw. | ||
| Buchstabe oder Ziffer | X | X – erlaubt einen beliebigen einzelnen Buchstaben oder eine beliebige einzelne Ziffer. | ||
| Ziffer | N | N”th” – erlaubt 5th, 4th, 6th usw. | ||
| string | "" | "cat” | ||
| Oder | ”dr”(“i" | "u”)“nk” – erlaubt “drink” oder “drunk”. | ||
| Zeichen aus der Menge | [] | [hm]“at” – erlaubt ‘hat’ oder ‘mat’. | ||
| Zeichen nicht aus der Menge | [^] | [^b]“at” – erlaubt ‘cat’, ‘mat’, ‘rat’, aber nicht bat. | ||
| Beliebige Anzahl von Wiederholungen (gilt für den Ausdruck oder Teilausdruck links) | {-} | [AB74]{-} – erlaubt jede beliebige Kombination aus A, B, 7 und 4 in beliebiger Länge. | ||
| Anzahl der Wiederholungen ist n | {n} | N{2}“th” – erlaubt 25th, 84th, 11th usw. | ||
| n bis m Wiederholungen | {n-m} | N{1-3}“th” – erlaubt 5th, 84th, 111th usw. | ||
| 0 bis n Wiederholungen | {-n} | N{-2}“th” – erlaubt th, 84th, 4th usw. | ||
| n oder mehr Wiederholungen | {n-} | N{2-}“th” – erlaubt 25th, 834th, 311th, 34576th usw. | ||
| Teilausdruck | () |
Suchtext mit einem Alphabet beschreiben
- Wählen Sie einen Modus für die Hypothesengenerierung aus. Um mithilfe der Zeichen im Suchbereich alle möglichen Hypothesen zu generieren, einschließlich sich überschneidender und eingebetteter Hypothesen, wählen Sie Eingebettete Hypothesen zulassen. Um Hypothesen maximaler Länge zu generieren, deaktivieren Sie Eingebettete Hypothesen zulassen.
- Erstellen Sie ein oder mehrere Alphabete.
- Klicken Sie auf Add….
- Wählen Sie im Dialogfeld Add New Alphabet die gewünschte Codepage aus der Liste Code page aus.
- Wählen Sie in der Character map die Zeichen aus, die im Suchtext vorkommen. Die ausgewählten Zeichen und ihre Anzahl werden im Feld Selected on screen/selected in all angezeigt.
- Geben Sie im Feld Percentage of alphabet characters den erforderlichen Prozentsatz an Alphabetzeichen im Suchtext an.
Sie können mehrere Alphabete angeben, sie dürfen sich jedoch nicht überschneiden, also nicht dieselben Zeichen enthalten.
- Wählen Sie Whole words only, um nur ganze Wörter zu finden.
-
Verwenden Sie die Option Detect words by interword space, um festzulegen, wie Zeilen in Wörter unterteilt werden. Deaktivieren Sie diese Option, um Wörter automatisch zu erkennen. Wenn diese Option aktiviert ist, wird eine Zeile immer dann in Wörter unterteilt, wenn der Abstand zwischen benachbarten Zeichen größer oder gleich dem in Min interword space eingegebenen Wert ist.
Bei der automatischen Worterkennung werden Wortenden anhand von Leerzeichen oder anderen Symbolen erkannt, die Wörter voneinander trennen (z. B.
,,;,/,?– die genaue Symbolmenge hängt von der ausgewählten Vorerkennungssprache ab), oder anhand anderer Attribute. Um sicherzustellen, dass das Programm Zeilen korrekt in Wörter unterteilt, prüfen Sie die Textobjekte in den Testbildern (View → Images → Objects → erkanntes Wort). - Geben Sie in den Feldern Word count die Anzahl der Wörter in der Zeichenkette an. Die Anzahl der Wörter wird mit einem Fuzzy-Intervall angegeben. Das Standardintervall ist {-1,-1,INF,INF} (das heißt, das Programm sucht nach Hypothesen mit einer beliebigen Anzahl von Wörtern).
- Geben Sie im Feld Max. Leerraumlänge die maximale Länge des Leerzeichens innerhalb des Objekts an. Sie wird in benutzerdefinierten Maßeinheiten gemessen. Sie können die Länge des Leerzeichens abschätzen, indem Sie sich die Koordinaten der benachbarten Objekte ansehen. Bewegen Sie den Mauszeiger auf ein benachbartes Objekt, um dessen Koordinaten in der Statusleiste anzuzeigen. Bei der Textsuche werden der Zeichenkette so lange Zeichen hinzugefügt, bis die Distanz zwischen benachbarten Elementen Max. Leerraumlänge überschreitet.
-
Geben Sie im Feld Character count die Länge der Zeichenkette an (also die Anzahl der Zeichen in der Zeichenkette). Die Anzahl der Zeichen wird mithilfe eines Fuzzy-Intervalls angegeben, und die Qualität der Hypothese wird anhand ihrer Länge bewertet.
Verwenden Sie die Schaltfläche
, um Fuzzy-Intervalle in einem separaten Fenster anzugeben, in dem sie visualisiert werden.
