STT-Helper¶
STT-Helper ist eine Anwendung zur sprachlichen Aufbereitung automatisch erzeugter Transkripte. Der eingegebene Text durchläuft eine dreistufige LLM-gestützte Pipeline aus Korrektur, stilistischer Überarbeitung und Strukturierung. Die Verarbeitung erfolgt im Hintergrund; das Ergebnis wird per E-Mail zugestellt.
Im Unterschied zu einem direkten LLM-Aufruf zerlegt die Anwendung den Eingabetext in überlappende Abschnitte, durchläuft je Stufe eine eigene Prompt-Konfiguration und führt die Teilergebnisse mit einer Fehlertoleranz-Strategie wieder zusammen. Lange Transkripte werden so in einem Durchlauf verarbeitet, ohne dass Kontext über Chunkgrenzen verloren geht.
Auf einen Blick¶
- Aus Rohtranskripten lesbare und sprachlich bereinigte Texte gewinnen
- Mündlich formulierte Inhalte in einen sachlichen, schriftnahen Stil überführen
- Markdown-strukturierte Dokumente mit Überschriften und Absätzen erzeugen
- Lange Transkripte ohne manuelle Aufteilung in einem Durchlauf bearbeiten
- Aufzeichnungen für die spätere Verwendung in RAG-Anwendungen vorbereiten
- Fachgebiete und Terminologie als Kontext mitgeben, um fachsprachliche Korrekturen zu lenken
- Ergebnisse asynchron per E-Mail erhalten, ohne auf eine offene Browsersitzung angewiesen zu sein
Highlights¶
Die Anwendung unterscheidet sich von einem einfachen Aufruf eines LLM-Chat-Endpunkts durch eine mehrstufige, ausfalltolerante Verarbeitungspipeline. Daraus folgt für die Ergebnisqualität: längere Texte bleiben verarbeitbar, Teilstörungen führen nicht zum Komplettverlust, und jede Phase verfolgt ein klar umrissenes Ziel.
- Dreistufige Pipeline: Korrektur, Überarbeitung und Formatierung sind eigenständige Phasen mit dedizierten Prompts. Jede Phase baut auf dem Ergebnis der vorhergehenden auf; die gewünschte Endstufe wird im UI gewählt.
- Chunking mit Überlappung: Eingabetexte werden in Abschnitte fester Länge mit Überlappung zerlegt, um Satz- und Sinnkontext über Chunkgrenzen hinweg zu erhalten.
- Parallele Verarbeitung mit Retry: Mehrere Chunks werden parallel an die LLM-API geschickt; bei vorübergehenden Fehlern wiederholt die Anwendung den Aufruf mit progressiver Verzögerung.
- Robuste Zusammenführung: Schlägt eine Phase für einzelne Chunks dauerhaft fehl, übernimmt das Verfahren das jeweils höchstwertige erfolgreiche Zwischenergebnis und fällt im Notfall auf den Originalabschnitt zurück, statt den gesamten Lauf abzubrechen.
- Kontextgesteuerte Terminologie: Ein freies Kontextfeld (Fachgebiet, Spezialvokabular) wird in alle Stufen-Prompts eingespeist und steuert die Erkennung und Korrektur von Fachbegriffen.
- Asynchrone Hintergrundverarbeitung: Eine Job-Queue trennt das interaktive Frontend von der langlaufenden Verarbeitung. Die Sitzung kann nach Auftragserteilung geschlossen werden.
- Mehrere Eingangswege: Datei-Upload (Textformate) oder direkte Eingabe in das Webformular.
- Eingabevalidierung: Encoding-Fallback über mehrere Zeichensätze, Erkennung binärer Inhalte, Größen- und Längenprüfung.
- Zweisprachige Bedienoberfläche: Deutsch und Englisch, abhängig von Browsersprache oder URL-Parameter.