Audio transkribieren
Mit Sprechern · Zeitstempel · Export DOCX, SRT, TXT, XLSX · über 90 Sprachen
Laden Sie eine Datei hoch – wenige Minuten später haben Sie einen genauen Text: wer gesprochen hat, was gesagt wurde und wann.
Ziehen Sie eine Audio- oder Videodatei hierher – MP3, WAV, eine Meeting-Aufnahme oder ein Handyvideo (auch .MOV vom iPhone)
Ob Sprachnachricht vom Handy, aufgezeichnetes Interview, Team-Meeting oder Podcast-Folge: Loquino verwandelt jede Audioaufnahme in einen klar strukturierten Text. Jede Wortmeldung wird einem Sprecher zugeordnet – „Sprecher 1“, „Sprecher 2“ – und mit einem Zeitstempel versehen, damit Sie die passende Stelle in der Aufnahme sofort wiederfinden. Die Sprache muss dabei nicht angegeben werden: Loquino erkennt sie automatisch und verarbeitet Aufnahmen in über 90 Sprachen. Laden Sie MP3, WAV, M4A, OGG, OPUS, AAC oder WMA hoch – auch die Tonspur aus einer Videodatei wird angenommen, falls Sie kein reines Audio zur Hand haben. Das fertige Transkript steht zum Download als DOCX, SRT, TXT oder XLSX bereit, je nachdem, ob Sie Fließtext, Untertitel oder eine Tabelle brauchen.
So sieht ein Transkript aus
Jede Wortmeldung mit Sprecher und Zeitstempel – kein Textbrei, sondern eine Struktur, in der man sieht, wer wann was gesagt hat.
- 00:00
Sehen Sie, ein Interview hören wir fast nie ganz nach – den Text liest man in einer Minute.
- 00:11
Früher hat mich das Abtippen einen halben Tag gekostet. Vor allem, wenn zwei gleichzeitig reden.
- 00:18
Genau deshalb muss man sehen, wer den Satz gesagt hat – sonst zerfällt der Sinn.
- 00:26
Und der Zeitstempel – um sofort an die richtige Stelle zu springen, statt alles noch einmal anzuhören.
- 00:34
Vier Exportformate – ich arbeite direkt im gewohnten Programm weiter.
Verarbeitung in Deutschland
Ihre Aufnahmen und Transkripte werden auf Servern in Deutschland verarbeitet – Ihre Daten verlassen Deutschland nicht.
Für lange Aufnahmen gebaut
Die meisten Werkzeuge sind für den Fünf-Minuten-Clip gemacht. Loquino ist für das Zwei-Stunden-Interview gemacht, das Sie danach wirklich lesen müssen.
Sprecher getrennt
Wer wann gesprochen hat, steht am Rand – Sprecher 1, Sprecher 2. Keine Stimmerkennung, keine Zuordnung zu realen Personen.
Dateien bis 10 GB
Zwei Stunden Interview sind kein Sonderfall, sondern der Normalfall. Kein Zerschneiden, kein Hochladen in Teilen.
Über 90 Sprachen
Die Sprache wird automatisch erkannt – Deutsch, Englisch und der Rest der Liste, dieselbe Oberfläche.
Preise
Drei Tarife – monatlich oder jährlich, mit zwei Gratis-Monaten im Jahresabo.