Loquino

Audio transkribieren

Mit Sprechern · Zeitstempel · Export DOCX, SRT, TXT, XLSX · über 90 Sprachen

Laden Sie eine Datei hoch – wenige Minuten später haben Sie einen genauen Text: wer gesprochen hat, was gesagt wurde und wann.

Ziehen Sie eine Audio- oder Videodatei hierher – MP3, WAV, eine Meeting-Aufnahme oder ein Handyvideo (auch .MOV vom iPhone)

Ob Sprachnachricht vom Handy, aufgezeichnetes Interview, Team-Meeting oder Podcast-Folge: Loquino verwandelt jede Audioaufnahme in einen klar strukturierten Text. Jede Wortmeldung wird einem Sprecher zugeordnet – „Sprecher 1“, „Sprecher 2“ – und mit einem Zeitstempel versehen, damit Sie die passende Stelle in der Aufnahme sofort wiederfinden. Die Sprache muss dabei nicht angegeben werden: Loquino erkennt sie automatisch und verarbeitet Aufnahmen in über 90 Sprachen. Laden Sie MP3, WAV, M4A, OGG, OPUS, AAC oder WMA hoch – auch die Tonspur aus einer Videodatei wird angenommen, falls Sie kein reines Audio zur Hand haben. Das fertige Transkript steht zum Download als DOCX, SRT, TXT oder XLSX bereit, je nachdem, ob Sie Fließtext, Untertitel oder eine Tabelle brauchen.

So sieht ein Transkript aus

Jede Wortmeldung mit Sprecher und Zeitstempel – kein Textbrei, sondern eine Struktur, in der man sieht, wer wann was gesagt hat.

Interview · 00:00–00:42
  1. 00:00

    Sehen Sie, ein Interview hören wir fast nie ganz nach – den Text liest man in einer Minute.

  2. 00:11

    Früher hat mich das Abtippen einen halben Tag gekostet. Vor allem, wenn zwei gleichzeitig reden.

  3. 00:18

    Genau deshalb muss man sehen, wer den Satz gesagt hat – sonst zerfällt der Sinn.

  4. 00:26

    Und der Zeitstempel – um sofort an die richtige Stelle zu springen, statt alles noch einmal anzuhören.

  5. 00:34

    Vier Exportformate – ich arbeite direkt im gewohnten Programm weiter.

Verarbeitung in Deutschland

Ihre Aufnahmen und Transkripte werden auf Servern in Deutschland verarbeitet – Ihre Daten verlassen Deutschland nicht.

Für lange Aufnahmen gebaut

Die meisten Werkzeuge sind für den Fünf-Minuten-Clip gemacht. Loquino ist für das Zwei-Stunden-Interview gemacht, das Sie danach wirklich lesen müssen.

Sprecher getrennt

Wer wann gesprochen hat, steht am Rand – Sprecher 1, Sprecher 2. Keine Stimmerkennung, keine Zuordnung zu realen Personen.

Dateien bis 10 GB

Zwei Stunden Interview sind kein Sonderfall, sondern der Normalfall. Kein Zerschneiden, kein Hochladen in Teilen.

Über 90 Sprachen

Die Sprache wird automatisch erkannt – Deutsch, Englisch und der Rest der Liste, dieselbe Oberfläche.

Preise

Drei Tarife – monatlich oder jährlich, mit zwei Gratis-Monaten im Jahresabo.

Häufige Fragen

Welche Audioformate werden unterstützt?
MP3, WAV, M4A, OGG, OPUS, AAC und WMA – dazu die Tonspur aus Videodateien, falls Sie kein reines Audio zur Hand haben.
Muss ich vorher angeben, in welcher Sprache die Aufnahme ist?
Nein. Die Sprache wird automatisch erkannt, unterstützt werden über 90 Sprachen.
Werden verschiedene Sprecher in der Aufnahme unterschieden?
Ja. Jede Wortmeldung wird als „Sprecher 1“, „Sprecher 2“ usw. gekennzeichnet – eine Unterscheidung innerhalb der Aufnahme, kein Abgleich mit echten Personen.
In welchen Formaten kann ich das Ergebnis herunterladen?
DOCX, SRT, TXT oder XLSX – je nachdem, ob Sie Fließtext, Untertitel oder eine Tabelle brauchen.
Wie lange dauert die Transkription?
Das hängt von der Länge der Aufnahme ab. Sie müssen die Aufnahme dafür nicht selbst anhören oder abtippen.
Wie groß darf meine Audiodatei sein?
Bis zu 10 GB pro Datei.
Kann ich den Text nachträglich ändern?
Ja – nach dem Download liegt er als DOCX oder TXT vor und lässt sich in jedem Textprogramm bearbeiten.