VSAVS
Der Visual Audio Video Synchronisator liest eine Bildbeschreibung per Sprachsynthese vor und legt sie als Tonspur unter das Video – kapitelgenau synchronisiert.
- C#
- .NET 2.0
- DirectShow
- Microsoft SAPI 5.1
- UML 2.0
Die Idee
VSAVS entstand im Rahmen meiner gleichnamigen Studienarbeit an der Hochschule Aalen. Die Anwendung versieht Videos mit einer Tonspur, die den sichtbaren Inhalt beschreibt: Zu jedem Kapitel wird ein Beschreibungstext eingegeben, per Sprachsynthese vorgelesen und passend unter den Videostrom gelegt.
Technik
Die Sprachausgabe nutzt Microsoft SAPI 5.1, die Videobearbeitung läuft über DirectShow aus dem DirectX-Paket, angebunden über die Wrapper-Klasse DirectShowLib.NET. Die RichTextBoxHighlighterLib hebt Schlüsselwörter in den Textfeldern farbig hervor.
Für die Verwaltung temporärer Dateien habe ich eine eigene, selbstverwaltende Manager-Klasse entwickelt, die temporäre Dateien im System erzeugt, reserviert und wieder aufräumt.
Architektur
Die Anwendung folgt dem Model-View-Controller-Konzept und nutzt alle drei Schichten. Die Klassenstruktur ist in einem Klassendiagramm nach UML-2.0-Notation modelliert.
Ergebnis
Die Studienarbeit habe ich mit der Note 1,0 abgeschlossen. Die finale Version 1.00.00 steht im Downloadbereich bereit – inklusive vollständigem Changelog.
Verwendete Bibliotheken: DirectShowLib.NET und DESCombine.NET. Eine Readme-Datei liegt im Installationsverzeichnis.