Loquino

MP3 transkribieren

Mit Sprechern · Zeitstempel · Export DOCX, SRT, TXT, XLSX · über 90 Sprachen

Laden Sie eine Datei hoch – wenige Minuten später haben Sie einen genauen Text: wer gesprochen hat, was gesagt wurde und wann.

Ziehen Sie eine Audio- oder Videodatei hierher – MP3, WAV, eine Meeting-Aufnahme oder ein Handyvideo (auch .MOV vom iPhone)

MP3 ist das Format, das fast jedes Aufnahmegerät und jede Diktier-App ausspuckt – klein genug zum Verschicken, überall abspielbar, und deshalb landet ein Großteil aller Sprachaufnahmen genau darin. Nur lesen lässt sich eine MP3 eben nicht. Loquino nimmt die Datei, so wie sie ist, und schreibt den Inhalt aus: Jede Wortmeldung bekommt einen Sprecher – „Sprecher 1“, „Sprecher 2“ – und einen Zeitstempel, mit dem Sie die Stelle in der Aufnahme sofort wiederfinden. In welcher Sprache gesprochen wird, müssen Sie nicht angeben; Loquino erkennt sie selbst und kommt mit über 90 Sprachen zurecht. Auch lange MP3s sind kein Problem – eine Datei darf bis zu 10 GB groß sein. Das Ergebnis laden Sie als DOCX, TXT, SRT oder XLSX herunter, je nachdem, ob Sie Fließtext, Untertitel oder eine Tabelle brauchen.

So sieht ein Transkript aus

Jede Wortmeldung mit Sprecher und Zeitstempel – kein Textbrei, sondern eine Struktur, in der man sieht, wer wann was gesagt hat.

Interview · 00:00–00:42
  1. 00:00

    Sehen Sie, ein Interview hören wir fast nie ganz nach – den Text liest man in einer Minute.

  2. 00:11

    Früher hat mich das Abtippen einen halben Tag gekostet. Vor allem, wenn zwei gleichzeitig reden.

  3. 00:18

    Genau deshalb muss man sehen, wer den Satz gesagt hat – sonst zerfällt der Sinn.

  4. 00:26

    Und der Zeitstempel – um sofort an die richtige Stelle zu springen, statt alles noch einmal anzuhören.

  5. 00:34

    Vier Exportformate – ich arbeite direkt im gewohnten Programm weiter.

Verarbeitung in Deutschland

Ihre Aufnahmen und Transkripte werden auf Servern in Deutschland verarbeitet – Ihre Daten verlassen Deutschland nicht.

Für lange Aufnahmen gebaut

Die meisten Werkzeuge sind für den Fünf-Minuten-Clip gemacht. Loquino ist für das Zwei-Stunden-Interview gemacht, das Sie danach wirklich lesen müssen.

Sprecher getrennt

Wer wann gesprochen hat, steht am Rand – Sprecher 1, Sprecher 2. Keine Stimmerkennung, keine Zuordnung zu realen Personen.

Dateien bis 10 GB

Zwei Stunden Interview sind kein Sonderfall, sondern der Normalfall. Kein Zerschneiden, kein Hochladen in Teilen.

Über 90 Sprachen

Die Sprache wird automatisch erkannt – Deutsch, Englisch und der Rest der Liste, dieselbe Oberfläche.

Preise

Drei Tarife – monatlich oder jährlich, mit zwei Gratis-Monaten im Jahresabo.

Häufige Fragen

Wie wandle ich eine MP3 in Text um?
Laden Sie die MP3-Datei hoch – Loquino erkennt die Sprache, schreibt den gesprochenen Inhalt aus und ordnet ihn den Sprechern zu. Abtippen müssen Sie nichts.
Muss ich die MP3 vorher in ein anderes Format umwandeln?
Nein. MP3 wird direkt angenommen, ebenso WAV, M4A, OGG, OPUS und AAC.
Wie groß darf die MP3 sein?
Bis zu 10 GB pro Datei – das reicht auch für mehrstündige Mitschnitte.
Werden mehrere Sprecher in der MP3 auseinandergehalten?
Ja, jede Passage wird „Sprecher 1“, „Sprecher 2“ usw. zugeordnet – innerhalb der Aufnahme, ohne Abgleich mit echten Personen.
Kann ich aus der MP3 Untertitel erzeugen?
Ja, neben dem Text steht ein SRT-Export mit Zeitstempeln bereit.
Erkennt Loquino die Sprache der MP3 selbst?
Ja, die Sprache wird automatisch erkannt, über 90 Sprachen werden unterstützt.
In welchem Format bekomme ich das Ergebnis?
Als DOCX, TXT, SRT oder XLSX – Sie wählen beim Download.