Classification of Document Languages Using Low-Level Information

Nonfiction, Computers, Programming
Cover of the book Classification of Document Languages Using Low-Level Information by Kerim Galal, GRIN Verlag
View on Amazon View on AbeBooks View on Kobo View on B.Depository View on eBay View on Walmart
Author: Kerim Galal ISBN: 9783638389679
Publisher: GRIN Verlag Publication: June 22, 2005
Imprint: GRIN Verlag Language: German
Author: Kerim Galal
ISBN: 9783638389679
Publisher: GRIN Verlag
Publication: June 22, 2005
Imprint: GRIN Verlag
Language: German

Studienarbeit aus dem Jahr 2003 im Fachbereich Informatik - Angewandte Informatik, Note: 1,3, Westfälische Wilhelms-Universität Münster (Informatik), Veranstaltung: Document Analysis and Recognition, 13 Quellen im Literaturverzeichnis, Sprache: Deutsch, Abstract: Die heutige Welt ist geprägt ist von einer zunehmenden globalen Kommunikation. In Zeiten der weltweiten Vernetzung findet ein schneller Informationsaustausch statt. Vor allem das Internet bietet eine enorme Fülle an leicht zugänglichen Informationen. Um dieser Fülle an Informationen beizukommen, sind in den letzten Jahren verstärkt Bemühungen unternommen worden diese Informationsflut zu kontrollieren und zu kategorisieren. Das Kategorisieren von Informationen ist am effektivsten und effizientesten, wenn die zu ordnenden Dokumente in elektronischer Form vorliegen. Dies und allgemein die enorm gestiegene Bedeutung der elektronischen Datenverarbeitung haben dazu beigetragen, dass Organisationen aus allen Bereichen versucht sind, ihre Dokumenteausschließlich in digitaler Form zu verwalten. Das erklärte Ziel ist analoge Dokumente in elektronische zu konvertieren [2]. Dieses Bestreben führte zu der Entwicklung von Optical Character Recognition (OCR), Software die es ermöglicht eingescannte Dokumente in elektronische Textfiles zu konvertieren. Jedoch treffen die meisten OCR Systeme die implizite Prämisse, dass die Sprache des zu verarbeitenden Dokumentes im Voraus bekannt ist [2]. Zwar erkennen manche Programme unterschiedliche romanische Sprachen mit einer akzeptablen Zuverlässigkeit, doch sobald ein anderes Schriftsystem auftritt, werden die Dokumente nicht mehr zuverlässig konvertiert. Daher ist es von großem Vorteil, die Sprache eines Dokuments vor der Anwendung eines OCR Systems zu kennen. Die vorliegende Arbeit beschäftigt sich mit der Spracherkennung von Dokumenten basierend auf low- level Informationen. Im ersten Teil wird ein kurzer Überblick über verschiedene Sprach- und Schriftklassen gegeben. Der zweite Teil der Arbeit beschäftigt sich mit der Art und Weise wie ein zu untersuchendes Dokument vorbereitet wird und welche Merkmale zur anschließenden Schrift- und Spracherkennung dienen. Im Haup tteil der Arbeit werden einige Verfahren zur Schriftklassifizierung und zur Spracherkennung vorgestellt. Abschließend folgt ein Abschnitt über ausgewählte Testverfahren, die die Qualität der vorgestellten Systeme beleuchten.

View on Amazon View on AbeBooks View on Kobo View on B.Depository View on eBay View on Walmart

Studienarbeit aus dem Jahr 2003 im Fachbereich Informatik - Angewandte Informatik, Note: 1,3, Westfälische Wilhelms-Universität Münster (Informatik), Veranstaltung: Document Analysis and Recognition, 13 Quellen im Literaturverzeichnis, Sprache: Deutsch, Abstract: Die heutige Welt ist geprägt ist von einer zunehmenden globalen Kommunikation. In Zeiten der weltweiten Vernetzung findet ein schneller Informationsaustausch statt. Vor allem das Internet bietet eine enorme Fülle an leicht zugänglichen Informationen. Um dieser Fülle an Informationen beizukommen, sind in den letzten Jahren verstärkt Bemühungen unternommen worden diese Informationsflut zu kontrollieren und zu kategorisieren. Das Kategorisieren von Informationen ist am effektivsten und effizientesten, wenn die zu ordnenden Dokumente in elektronischer Form vorliegen. Dies und allgemein die enorm gestiegene Bedeutung der elektronischen Datenverarbeitung haben dazu beigetragen, dass Organisationen aus allen Bereichen versucht sind, ihre Dokumenteausschließlich in digitaler Form zu verwalten. Das erklärte Ziel ist analoge Dokumente in elektronische zu konvertieren [2]. Dieses Bestreben führte zu der Entwicklung von Optical Character Recognition (OCR), Software die es ermöglicht eingescannte Dokumente in elektronische Textfiles zu konvertieren. Jedoch treffen die meisten OCR Systeme die implizite Prämisse, dass die Sprache des zu verarbeitenden Dokumentes im Voraus bekannt ist [2]. Zwar erkennen manche Programme unterschiedliche romanische Sprachen mit einer akzeptablen Zuverlässigkeit, doch sobald ein anderes Schriftsystem auftritt, werden die Dokumente nicht mehr zuverlässig konvertiert. Daher ist es von großem Vorteil, die Sprache eines Dokuments vor der Anwendung eines OCR Systems zu kennen. Die vorliegende Arbeit beschäftigt sich mit der Spracherkennung von Dokumenten basierend auf low- level Informationen. Im ersten Teil wird ein kurzer Überblick über verschiedene Sprach- und Schriftklassen gegeben. Der zweite Teil der Arbeit beschäftigt sich mit der Art und Weise wie ein zu untersuchendes Dokument vorbereitet wird und welche Merkmale zur anschließenden Schrift- und Spracherkennung dienen. Im Haup tteil der Arbeit werden einige Verfahren zur Schriftklassifizierung und zur Spracherkennung vorgestellt. Abschließend folgt ein Abschnitt über ausgewählte Testverfahren, die die Qualität der vorgestellten Systeme beleuchten.

More books from GRIN Verlag

Cover of the book Selbst- und Zeitmanagement als Erfolgsfaktoren im Studium. Konzept für eine Präsentation by Kerim Galal
Cover of the book Kommunikation zweier Autoritäten im Krankenhaus am Beispiel Pflegeperson und Arzt by Kerim Galal
Cover of the book Das Training der aeroben Ausdauer am Beispiel des Laufs by Kerim Galal
Cover of the book Die interdisziplinären Zentrenbildung in Krankenhäusern. Das Herz-Gefäß-Zentrum am Klinikum Nürnberg by Kerim Galal
Cover of the book Judeoespanol. Sephardengemeinden und ihre Sprache im Osmanischen Reich by Kerim Galal
Cover of the book Mission und Obrigkeit in Tranquebar im frühen 18. Jahrhundert unter Berücksichtigung einzelner Briefe Ziegenbalgs by Kerim Galal
Cover of the book Die Rolle des Islam im religiösen Pluralismus Indonesiens by Kerim Galal
Cover of the book Lösungsansätze der mystischen Philosophie des Meister Eckart zum Theodizeeproblem by Kerim Galal
Cover of the book Operational Objectives and the Transformation Process in the Energy/Electricity Industry by Kerim Galal
Cover of the book Das VALE-Urteil des EuGH und die Konsequenzen für die Sitzverlegungsrichtlinie by Kerim Galal
Cover of the book Die Rolle der Funktionshäftlinge im Vernichtungslager Auschwitz und das Beispiel Otto Küsels by Kerim Galal
Cover of the book Das 'Andere' im Fremdsprachenunterricht by Kerim Galal
Cover of the book Diagnostik von verhaltensauffälligen Schülerinnen und Schülern by Kerim Galal
Cover of the book Fächerübergreifender Unterrricht an beruflichen Schulen by Kerim Galal
Cover of the book Konstruktivismus als Perspektive für den Sachunterricht by Kerim Galal
We use our own "cookies" and third party cookies to improve services and to see statistical information. By using this website, you agree to our Privacy Policy