Projektbeschreibung: Unterschied zwischen den Versionen
Aus Kallimachos
Keine Bearbeitungszusammenfassung |
|||
| Zeile 50: | Zeile 50: | ||
==OCR-Modul== | ==OCR-Modul== | ||
[[File:NarragonienOCR.png|thumbnail|OCR von Scanseiten einer lateinischen Ausgabe des [[Narragonien|Narrenschiffs]].|link=http://kallimachos.de/kallimachos/images/kallimachos/d/d0/NarragonienOCR.png|alt=Darstellung des OCR-Prozesses: Links die Originalscans als Graustufenbild, rechts der e-Text]] | [[File:NarragonienOCR.png|thumbnail|OCR von Scanseiten einer lateinischen Ausgabe des [[Narragonien|Narrenschiffs]].|link=http://kallimachos.de/kallimachos/images/kallimachos/d/d0/NarragonienOCR.png|alt=Darstellung des OCR-Prozesses: Links die Originalscans als Graustufenbild, rechts der e-Text]] | ||
Das OCR-Modul stellt eine automatisierte Vorverarbeitung für die Volltexterstellung zur Verfügung. Hierzu entwickeln zwei Arbeitsgruppen am [https://www.dfki.de/web Deutsche Forschungszentrum für Künstliche Intelligenz (DFKI)] und an der Universität Würzburg bestehende Tools und Software-Bausteine weiter, um auch solche Texte erschließen zu können, für die bislang keine qualitativ hochwertigen OCR-Lösungen vorliegen. Im Zentrum dieser Arbeiten steht der Use-Case [[Narragonien:Main | Narragonien]]. | Das OCR-Modul stellt eine automatisierte Vorverarbeitung für die Volltexterstellung zur Verfügung. Hierzu entwickeln zwei Arbeitsgruppen am [https://www.dfki.de/web Deutsche Forschungszentrum für Künstliche Intelligenz (DFKI)] und an der Universität Würzburg bestehende Tools und Software-Bausteine weiter, um auch solche Texte erschließen zu können, für die bislang keine qualitativ hochwertigen OCR-Lösungen vorliegen. Im Zentrum dieser Arbeiten steht der Use-Case [[Narragonien:Main | Narragonien]]. | ||
<br clear=all> | <br clear=all> | ||
===''anyOCR'': ein lernendes Zeichenerkennungssystem=== | ===''anyOCR'': ein lernendes Zeichenerkennungssystem=== | ||