MonoWhisper

Aufnahmen abschreiben lassen,
die Abschrift gegen den Ton prüfen.

Nur zum Lesen — hören, suchen, herunterladen. Ändern geht am Rechner, auf dem MonoWhisper läuft.

In Arbeit
Abschriften

Neue Abschrift

Tondateien oder ZIP-Pakete hierher ziehen MP3, M4A, WAV, WMA, FLAC, OGG — auch mehrere auf einmal. Ein ZIP wird ausgepackt, jede Tondatei darin bekommt einen eigenen Auftrag.
… oder ein Pfad auf diesem Rechner (eine Datei je Zeile)
Abschrift
Sprechertrennung

Beim Fernbetrieb muss der Token auf dem anderen Rechner liegen — in ~/.cache/huggingface/token oder als HF_TOKEN.

Ohne Trennung bekommt die Abschrift keine Stimmnummern. Das Modell pyannote/speaker-diarization-community-1 muss auf huggingface.co einmal freigeschaltet und der Token hier hinterlegt werden. Alternativ HF_TOKEN in die Umgebung legen.


    

Einstellungen

Gilt für alle Aufträge. Was je Aufnahme anders sein darf — Modell, Sprache, Sprechertrennung — steht beim Aufgeben.

Wo gerechnet wird

      

Der Ton geht über SSH hinüber, die Abschrift kommt zurück, drüben wird aufgeräumt. Der Hugging-Face-Token bleibt dabei dort, wo er hinterlegt ist — von hier geht keiner mit.

Sprechertrennung

Beim Fernbetrieb liegt der Token auf dem anderen Rechner — von hier geht keiner mit.

Wer die Zusammenfassung schreibt

Hier verlässt Text das Haus. Für die Zusammenfassung gehen die Sprachabschnitte an den gewählten Dienst — nicht der Ton, nicht die Musikstellen. Alles andere in MonoWhisper bleibt auf diesen Rechnern.

Ein Chat-Abo (ChatGPT Plus, Claude Pro) ist kein Programmierzugang; damit kann kein Programm etwas abfragen. Dafür ist der Weg über die Zwischenablage gedacht — noch nicht eingebaut.

Sprecher benennen

Druck auf eine Nummer springt an eine Stelle, an der sie redet — nochmal drücken, nächste Stelle. ist eigentlich … führt zwei Nummern zusammen, die dieselbe Person sind. Die Nummern gelten nur innerhalb dieser Aufnahme.

0:00 / 0:00
Leer Pause · ←→ 15 s · ↑↓ Abschnitt · 1–9 Aufnahme · / Suche · Klick auf ein Wort springt wortgenau