Loquino

Sprache zu Text

Mit Sprechern · Zeitstempel · Export DOCX, SRT, TXT, XLSX · über 90 Sprachen

Laden Sie eine Datei hoch – wenige Minuten später haben Sie einen genauen Text: wer gesprochen hat, was gesagt wurde und wann.

Ziehen Sie eine Audio- oder Videodatei hierher – MP3, WAV, eine Meeting-Aufnahme oder ein Handyvideo (auch .MOV vom iPhone)

Gesprochenes ist flüchtig – gesagt, gehört, vergessen. Sobald es aber aufgezeichnet ist, lässt es sich in geschriebenen Text überführen, und genau das macht Loquino: Sie laden eine vorhandene Aufnahme hoch, und daraus wird ein Dokument, das man lesen, durchsuchen und zitieren kann. Dabei ist gleichgültig, worum es geht – ein Gespräch, ein Vortrag, ein Diktat, eine Besprechung. Die Sprache müssen Sie nicht auswählen: Loquino erkennt sie selbst und verarbeitet über 90 Sprachen, Deutsch und Englisch ebenso wie den Rest der Liste. Sprechen mehrere Menschen, werden ihre Beiträge als „Sprecher 1“, „Sprecher 2“ auseinandergehalten, jeweils mit Zeitstempel. Gängige Audio- und Videoformate werden angenommen – von MP3 und WAV bis MP4 und MOV, denn aus Video löst Loquino die Tonspur automatisch heraus. Das fertige Transkript steht als DOCX, SRT, TXT oder XLSX bereit.

So sieht ein Transkript aus

Jede Wortmeldung mit Sprecher und Zeitstempel – kein Textbrei, sondern eine Struktur, in der man sieht, wer wann was gesagt hat.

Interview · 00:00–00:42
  1. 00:00

    Sehen Sie, ein Interview hören wir fast nie ganz nach – den Text liest man in einer Minute.

  2. 00:11

    Früher hat mich das Abtippen einen halben Tag gekostet. Vor allem, wenn zwei gleichzeitig reden.

  3. 00:18

    Genau deshalb muss man sehen, wer den Satz gesagt hat – sonst zerfällt der Sinn.

  4. 00:26

    Und der Zeitstempel – um sofort an die richtige Stelle zu springen, statt alles noch einmal anzuhören.

  5. 00:34

    Vier Exportformate – ich arbeite direkt im gewohnten Programm weiter.

Verarbeitung in Deutschland

Ihre Aufnahmen und Transkripte werden auf Servern in Deutschland verarbeitet – Ihre Daten verlassen Deutschland nicht.

Für lange Aufnahmen gebaut

Die meisten Werkzeuge sind für den Fünf-Minuten-Clip gemacht. Loquino ist für das Zwei-Stunden-Interview gemacht, das Sie danach wirklich lesen müssen.

Sprecher getrennt

Wer wann gesprochen hat, steht am Rand – Sprecher 1, Sprecher 2. Keine Stimmerkennung, keine Zuordnung zu realen Personen.

Dateien bis 10 GB

Zwei Stunden Interview sind kein Sonderfall, sondern der Normalfall. Kein Zerschneiden, kein Hochladen in Teilen.

Über 90 Sprachen

Die Sprache wird automatisch erkannt – Deutsch, Englisch und der Rest der Liste, dieselbe Oberfläche.

Preise

Drei Tarife – monatlich oder jährlich, mit zwei Gratis-Monaten im Jahresabo.

Häufige Fragen

Was bedeutet „Sprache zu Text“ bei Loquino?
Sie laden eine Aufnahme hoch, und das darin Gesprochene wird als geschriebener Text ausgegeben. Es geht um die Verschriftlichung vorhandener Aufnahmen, nicht um Live-Diktat.
Kann ich direkt ins Mikrofon sprechen?
Nein. Loquino verarbeitet fertige Aufnahmen, die Sie hochladen – kein Mitschreiben in Echtzeit.
Welche Sprachen werden erkannt?
Über 90, mit automatischer Erkennung – eine Vorauswahl ist nicht nötig.
Werden verschiedene Sprecher getrennt?
Ja, als „Sprecher 1“, „Sprecher 2“ innerhalb der Aufnahme, ohne Zuordnung zu realen Personen.
Kann ich auch aus einem Video Text gewinnen?
Ja, laden Sie die Videodatei hoch – die Tonspur wird automatisch verarbeitet.
Welche Formate kann ich hochladen?
Gängige Audio- und Videoformate, darunter MP3, WAV, M4A, OGG, AAC sowie MP4, MOV und WEBM.
In welchem Format erhalte ich den Text?
DOCX, SRT, TXT oder XLSX, je nach Verwendung.