Syxtus Gaal

Automatisierte Erstellung neuer Sprachkorpora: Ein Beispiel anhand des Lëtzebuergeschen

Leseprobe

Fotogalerie

Syxtus Gaal

Automatisierte Erstellung neuer Sprachkorpora: Ein Beispiel anhand des Lëtzebuergeschen

Broschiertes Buch

Jetzt bewerten Jetzt bewerten

Andere Kunden interessierten sich auch für

Produktbeschreibung

Sprachtechnologien, einmal ein Thema für theoretische Forschung und Science-Fiction-Filme, sind Alltag geworden. Dank stetig steigender Rechenleistung und jahrzehntelangem Forschungsaufwand kann man heute Sprachsteuerung vielfältig einsetzen - beim Autofahren, Telefonieren, Surfen und Arbeiten. Hinter dieser ausgereiften Technologie steckt viel Arbeitsaufwand. Um Spracherkennung und Sprachsynthese, also die künstliche Erzeugung einer Stimme, möglich zu machen, müssen große Mengen von Sprachdaten analysiert und verarbeitet werden. Forscher und Entwickler verwenden diese Daten, um ihrer Computersoftware beizubringen, einen Begriff zu erkennen oder richtig auszusprechen.
Sprachtechnologien stehen und fallen mit der Menge guter Sprachdaten. Diese bestehen nicht nur aus reinen Aufnahmen; sie können auch Informationen über die einzelnen Phoneme, Silben und Wörter beinhalten. Sie beschreiben, wo jeder Laut anfängt und aufhört, welche Wortteile verwendet wurden und wie die Wörter, Phrasen und Sätze akzentuiert sind. Alle diese Informationen müssen für jeden Laut, jede Silbe, jedes Wort und jeden Satz vorhanden sein. Die Bereitstellung solcher annotierten Sprachdaten ist ein gewaltiger Aufwand. Gebildete Fachkräfte müssen zwischen 30 Minuten und einer Stunde Zeit opfern um eine Minute der Sprachaufnahmen zu bearbeiten. Oft sind dutzende oder hunderte Stunden solcher bearbeiteter Sprachaufnahmen notwendig, um ein ausgereiftes Spracherkennungs- oder Sprachsynthesesystem zu entwickeln. Wenn man bedenkt, dass die Zeit der notwendigen manuellen Bearbeitung mit 30 bzw. 60 multipliziert werden muss, so ist ein hoher Kostenfaktor erkennbar. Dieser Faktor lässt sich für große Sprachen rechtfertigen, da die Endsysteme für eine große Benutzergruppe zur Verfügung stehen werden. Bei kleineren Sprachen ist der Entwicklungsaufwand genau so groß, da die Zielgruppe jedoch viel kleiner ist, kann er oft nicht gerechtfertigt werden. So führt es dazu, dass kleinere Sprachen oft bei der Entwicklung moderner Technologien benachteiligt werden.
Diese Arbeit zeigt, wie man die Bearbeitung der Sprachdaten automatisieren kann um so den manuellen Bearbeitungsaufwand zu senken. Ziel ist es Sprachdaten, auch Sprachkorpora genannt, für kleinere Sprachen einfach und günstig verfügbar zu machen. Dabei soll ein Aligner etnwickelt werden, ein Programm, das Sprachaufnahmen und deren Transkription analysiert und den Lauten, Silben und Wörtern Zeitstempel zuweist. Die Zeitstempel müssen lediglich noch manuell überprüft werden.

Hinweis: Dieser Artikel kann nur an eine deutsche Lieferadresse ausgeliefert werden.

Produktdetails

Produktdetails
Verlag: Bachelor + Master Publishing
Artikelnr. des Verlages: 17162
Seitenzahl: 46
Erscheinungstermin: 21. März 2012
Deutsch
Abmessung: 270mm x 190mm x 4mm
Gewicht: 142g
ISBN-13: 9783863411428
ISBN-10: 3863411420
Artikelnr.: 35035366

Herstellerkennzeichnung
Books on Demand GmbH
In de Tarpen 42
22848 Norderstedt
info@bod.de
040 53433511

Produktdetails

Verlag: Bachelor + Master Publishing
Artikelnr. des Verlages: 17162
Seitenzahl: 46
Erscheinungstermin: 21. März 2012
Deutsch
Abmessung: 270mm x 190mm x 4mm
Gewicht: 142g
ISBN-13: 9783863411428
ISBN-10: 3863411420
Artikelnr.: 35035366

Herstellerkennzeichnung
Books on Demand GmbH
In de Tarpen 42
22848 Norderstedt
info@bod.de
040 53433511

Autorenporträt

Diplom-Linguist Syxtus Gaal hat ein Studium der Computerlinguistik und Informatik an der Universität Stuttgart abgeschlossen. Sein Studium war auf die Bereiche Phonetik, Spracherkennung und Sprachsynthese, sowie Architektur großer Anwendungssysteme fokussiert. Diese Ausbildung wurde durch einen Aufenthalt an der Trinity College in Dublin erweitert. Während des Studiums war er in die Entwicklung des ersten kommerziellen Spracherkenners für das Lëtzebuergesche involviert. Heute arbeitet Syxtus Gaal als Berater für Sprachtechnologien im Kundenservice. Er hilft führenden Unternehmen aus den Bereichen Versicherung, Telekommunikation, Finanzen und Einzelhandel, ihre Kundenbetreuung durch den gezielten Einsatz von Sprachtechnologien zu erweitern und zu optimieren.

Automatisierte Erstellung neuer Sprachkorpora: Ein Beispiel anhand des Lëtzebuergeschen

Rechnungen

Retourenschein anfordern

Bestellstatus

Storno

Serviceseiten

Schließen

Automatisierte Erstellung neuer Sprachkorpora: Ein Beispiel anhand des Lëtzebuergeschen

Automatisierte Erstellung neuer Sprachkorpora: Ein Beispiel anhand des Lëtzebuergeschen

Bitte wählen Sie Ihr Anliegen aus.

Rechnungen

Retourenschein anfordern

Bestellstatus

Storno

Serviceseiten

Schließen