Zum Inhalt

STT-Helper

STT-Helper ist eine Anwendung zur sprachlichen Aufbereitung automatisch erzeugter Transkripte. Der eingegebene Text durchläuft eine dreistufige LLM-gestützte Pipeline aus Korrektur, stilistischer Überarbeitung und Strukturierung. Die Verarbeitung erfolgt im Hintergrund; das Ergebnis wird per E-Mail zugestellt.

Im Unterschied zu einem direkten LLM-Aufruf zerlegt die Anwendung den Eingabetext in überlappende Abschnitte, durchläuft je Stufe eine eigene Prompt-Konfiguration und führt die Teilergebnisse mit einer Fehlertoleranz-Strategie wieder zusammen. Lange Transkripte werden so in einem Durchlauf verarbeitet, ohne dass Kontext über Chunkgrenzen verloren geht.

Auf einen Blick

  • Aus Rohtranskripten lesbare und sprachlich bereinigte Texte gewinnen
  • Mündlich formulierte Inhalte in einen sachlichen, schriftnahen Stil überführen
  • Markdown-strukturierte Dokumente mit Überschriften und Absätzen erzeugen
  • Lange Transkripte ohne manuelle Aufteilung in einem Durchlauf bearbeiten
  • Aufzeichnungen für die spätere Verwendung in RAG-Anwendungen vorbereiten
  • Fachgebiete und Terminologie als Kontext mitgeben, um fachsprachliche Korrekturen zu lenken
  • Ergebnisse asynchron per E-Mail erhalten, ohne auf eine offene Browsersitzung angewiesen zu sein

Highlights

Die Anwendung unterscheidet sich von einem einfachen Aufruf eines LLM-Chat-Endpunkts durch eine mehrstufige, ausfalltolerante Verarbeitungspipeline. Daraus folgt für die Ergebnisqualität: längere Texte bleiben verarbeitbar, Teilstörungen führen nicht zum Komplettverlust, und jede Phase verfolgt ein klar umrissenes Ziel.

  • Dreistufige Pipeline: Korrektur, Überarbeitung und Formatierung sind eigenständige Phasen mit dedizierten Prompts. Jede Phase baut auf dem Ergebnis der vorhergehenden auf; die gewünschte Endstufe wird im UI gewählt.
  • Chunking mit Überlappung: Eingabetexte werden in Abschnitte fester Länge mit Überlappung zerlegt, um Satz- und Sinnkontext über Chunkgrenzen hinweg zu erhalten.
  • Parallele Verarbeitung mit Retry: Mehrere Chunks werden parallel an die LLM-API geschickt; bei vorübergehenden Fehlern wiederholt die Anwendung den Aufruf mit progressiver Verzögerung.
  • Robuste Zusammenführung: Schlägt eine Phase für einzelne Chunks dauerhaft fehl, übernimmt das Verfahren das jeweils höchstwertige erfolgreiche Zwischenergebnis und fällt im Notfall auf den Originalabschnitt zurück, statt den gesamten Lauf abzubrechen.
  • Kontextgesteuerte Terminologie: Ein freies Kontextfeld (Fachgebiet, Spezialvokabular) wird in alle Stufen-Prompts eingespeist und steuert die Erkennung und Korrektur von Fachbegriffen.
  • Asynchrone Hintergrundverarbeitung: Eine Job-Queue trennt das interaktive Frontend von der langlaufenden Verarbeitung. Die Sitzung kann nach Auftragserteilung geschlossen werden.
  • Mehrere Eingangswege: Datei-Upload (Textformate) oder direkte Eingabe in das Webformular.
  • Eingabevalidierung: Encoding-Fallback über mehrere Zeichensätze, Erkennung binärer Inhalte, Größen- und Längenprüfung.
  • Zweisprachige Bedienoberfläche: Deutsch und Englisch, abhängig von Browsersprache oder URL-Parameter.