'moin die Forumsiker, tl;dr: meine Frage ist wie komme ich an die Parameter ran, welche gImageReader bei der verwendung von Tesseract-OCR konkret einsetzt? Hintergrund ist der Faden Beitrag "Knacknuss Text aus PDF extrahieren" Nach dem zwar guten aber nicht perfekten Einstieg in Tesseract per CLI, habe ich auch mit gImageReader Versuche angestellt auch wenn dies von Hand per Maus zu bedienen ist. Dabei habe ich freudig festgestellt dass dieser Weg 100% Erkennungsrate hinbekommt! (besser als wenn ich convert & tesseract auf der CLI selber anwerfe) Also moechte ich nun von gImageReader lernen, WIE da tesseract verwendet wird, damit ich mir das automatisieren kann. * Wie komme ich an die "Kommandozeilenparameter" ran welche gImageReader im Hintergrund verwendet? * nur ueber den Quellcode von gImageReader? * und wenn diese dynamisch an das konkret zum OCR-en vorgelegte "Bild" angepasst werden? Mir ist bewusst dass es nicht nur am Aufruf von tesseract liegen wird, sondern auch an den Parameter fuer das rendern der Pixelwueste und ev. auch am eingesetzten spell-checking. NB: bis ich herausfand dass gImageReader die Packete von hunspell benoetigt, vergingen ein paar Stunden Raetselraten denn gImageReaders Fehlermeldungen liefern kein brauchbarer Hinweis...
https://github.com/manisandro/gImageReader da wäre die Entwicklerseite. Ich habe es unter Ubuntu installiert und gelegentlich benutzt, aber noch nicht versucht irgendwelche Parameter zu verändern, wenn das überhaupt irgendwo möglich ist. Mit der Einstellung für Frakturschrift konnte ich alte Texte (nicht ganz so gut) erkennen, in der Zeit wurde eben noch von Hand gesetzt. Aber kommerzielle Programme wie FineReader verlangen für diese Möglichkeit einen Haufen zusätzliches Geld.
> Ich habe es unter Ubuntu installiert und gelegentlich benutzt, aber noch > nicht versucht irgendwelche Parameter zu verändern, wenn das überhaupt > irgendwo möglich ist. Ich habe keine Möglichkeit gefunden weder die Parameter einzusehen noch zu verändern. Zudem will ich ja gar nicht verändern sondern eben von gImageReader lernen = von gImageReader seine Parameter (sein Ablauf) übernehmen .
Gast
#5330460
Eine Möglichkeit: Originale Programmdatei (/usr/bin/tesseract) umbenennen, anhängenden Programmschnipsel kompilieren, das Kompilat, an die Stelle der originaldatei setzen; der Schnipsel gibt nur die Aufrufparameter aus; Alten Zustand wiederherstellen.
R. M. schrieb: > Eine Möglichkeit: ich sehe im Quellcode von gImageReader folgendes: (Datei ".../gimagereader-3.1.2/gtk/src/Recognizer.cc")
1 | |
2 | |
3 | |
4 | |
5 | |
6 | |
7 | |
8 | |
9 | |
10 | |
11 | |
12 | |
13 | |
14 | |
15 | |
16 | |
17 | |
18 | |
19 | |
20 | |
21 | |
22 | |
23 | |
24 | |
also denke ich dass es nicht via externe Programme geht. Ist diese meine Annahme falsch? Gibt es eine andere Möglichkeit, Deinen Ansatz zu verfolgen (Aufruf von externen Programme zu protokollieren), als die vorhandene Systeminstallation (Lubuntu 16.04 LTS) zu verpfuschen, in dem Binaries ausgetauscht werden? JEDENFALLS Danke fuer's mitdenken! :-)
Gast
#5332049
Hallo, es könnte auch sein das gImageReader das Bild selbst nochmal aufbereitet wie z.b. 300DPI, Blob-Detection, Spellchecker usw. Vielmehr stellt sich mir die Frage, ob du das richtige Wörterbuch und Language File benutzt hast. Hast Du Tesseract mit LSM genommen oder 3.04? Hast Du falsch erkanten Buchstaben selbst nochmal nachgelernt?
Antwort schreiben
Bitte melde dich an, um einen Beitrag zu schreiben.