So funktioniert es

Von der Aufnahme zum Text, Schritt für Schritt

Der Ablauf hat drei Schritte. Hier ist jeder im Detail: was wir zusichern und was Sie im Kopf behalten sollten.

Die drei Schritte

  1. 01

    Laden Sie Ihre Datei hoch

    Ziehen Sie sie auf die Seite oder wählen Sie sie auf Ihrem Gerät aus. Sie geht direkt in unseren Speicher, an der Anwendung vorbei, damit eine zweistündige Aufnahme nie auf halbem Weg hängen bleibt.

    • Der Fortschrittsbalken zeigt die wirklich hochgeladenen Daten.
    • Sie können den Tab schließen: der Upload läuft weiter und Ihr Text wartet auf Sie.
    • Die Verarbeitung beginnt erst, wenn die Datei vollständig oben ist.
  2. 02

    Wir verarbeiten das Audio

    Wir messen die tatsächliche Länge, erkennen die Sprache, trennen die Stimmen und erzeugen den Text mit einer genauen Zeitmarke für jedes Wort.

    • Sprecher starten als «Sprecher A», «Sprecher B»; benennen Sie sie um und der ganze Text folgt.
    • Die Zeitmarken gelten pro Wort, nicht pro Absatz, und deshalb bleibt der Player im Takt.
    • Der Fortschritt, den Sie sehen, entspricht der Arbeit, die gerade läuft.
  3. 03

    Prüfen und herunterladen

    Bearbeiten Sie jede Zeile direkt im Text. Die früheren Fassungen bleiben erhalten, und der Suchindex zieht Ihre Änderungen nach.

    • Suchen Sie nach Inhalt, nicht nur nach dem Dateinamen.
    • Laden Sie als DOCX, PDF, SRT, CSV oder JSON herunter, mit gebrauchsfertigen Untertiteln.
    • War es eine Besprechung, erzeugen Sie eine Zusammenfassung mit den Absprachen und Aufgaben.

Unter der Haube

Die technischen Entscheidungen, die zählen

Drei Entscheidungen, die den Unterschied erklären zwischen einer brauchbaren Transkription und einem formlosen Textblock.

Wir messen die Länge selbst

Die abgerechneten Minuten stammen aus der direkten Messung Ihrer Datei, nicht aus der Zahl, die der Anbieter meldet. Weichen die beiden ab, gilt Ihre Datei.

Wir behalten das ursprüngliche Ergebnis

Wir speichern, was das Modell geliefert hat, vor jeder Nachbearbeitung. Wenn wir das System später verbessern, lassen sich alte Transkriptionen ohne Zusatzkosten neu erzeugen.

Jeder Sprecher hat einen einzigen Eintrag

Sein Name steht einmal, nicht in jeder Zeile wiederholt. Deshalb ist Umbenennen sofort erledigt und deshalb können zwei Zeilen sich nicht widersprechen.

Formate und Grenzen

Was wir annehmen

Audio

MP3, WAV, M4A, AAC, FLAC, OGG, OPUS

Video

MP4, MOV, WEBM, MKV, AVI

Maximale Größe
50 GB pro Datei
Maximale Länge
10 Stunden pro Aufnahme
Sprachen
Über 90, automatisch erkannt
Sprecher
Bis zu 32 pro Aufnahme

Video ist kein Problem: wir holen nur das Audio heraus, ohne Zusatzkosten.

Genauigkeit

Welche Genauigkeit zu erwarten ist

Mit klarem Audio auf Spanisch oder Englisch liegt die Genauigkeit bei etwa 98 % Wort für Wort. Mit Hintergrundgeräusch, sich überlagernden Stimmen oder starkem Akzent liegt sie meist zwischen 92 % und 96 %.

Was hilft

  • Das Mikrofon nah bei dem halten, der spricht.
  • Vermeiden, dass Leute durcheinandersprechen.
  • Die Sprache von Hand setzen, wenn Sie sie schon kennen.

Was der Genauigkeit schadet

  • Mit dem Handy weit weg von den Stimmen aufnehmen.
  • Musik oder Fernsehen im Hintergrund.
  • In einer lauten Umgebung aufnehmen.

Ihre Aufnahmen

Wo Ihre Daten liegen

Vollständig innerhalb der Europäischen Union

Ihre Aufnahme und Ihre Transkription werden auf europäischen Servern verarbeitet und gespeichert.

Audio wird von selbst gelöscht

Nach 14 Tagen ohne bezahlten Tarif, oder nach 90 mit einem. Der Text bleibt, solange Ihr Konto besteht.

Ihre Inhalte bleiben Ihre

Wir nutzen Ihre Aufnahmen nie zum Trainieren von Modellen. Löschen Sie eine Transkription und ihr Audio verschwindet am selben Tag.

Testen Sie es mit einer eigenen Aufnahme

Sie bekommen eine transkribierte Probe, ohne Karte.