Teilautomatisierter Workflow zur Aufbereitung grosser Audiodatenmengen für Signalbasierte Analysen

Abstract:

Dieser Beitrag stellt eine teilautomatisierte Aufbereitung umfangreicher Audiodatenmengen für phonetisch-linguistische Korpora vor. Im konkreten Projekt handelt es sich um Nachrichtensendungen, die in großer Zahl täglich produziert werden und sich aufgrund sprechstilistischer Ähnlichkeiten besonders gut für linguistische und phonetische Analysen anbieten. Der Workflow umfasst u. a. eine orthographische Transkription mittels automatischer Spracherkennung, deren Prüfung und Vorsegmentierung im webbasierten Transkriptionseditors Octra, der auch das anschließende Schneiden in Einzeldateien ermöglicht, sowie die automatische Segmentierung auf phonetischer Ebene und Speicherung der Daten in diversen Outputformaten mittels der BAS Webservices. Die hier erstmals größere und dokumentierte Verwendung des Octra-Backends wird u.a. durch Bearbeitungszeiten evaluiert.


Year: 2025
In session: Multilingual Speech and Language Data Processing
Pages: 138 to 145