Loquino

Podcast transkribieren

Mit Sprechern · Zeitstempel · Export DOCX, SRT, TXT, XLSX · über 90 Sprachen

Laden Sie eine Datei hoch – wenige Minuten später haben Sie einen genauen Text: wer gesprochen hat, was gesagt wurde und wann.

Ziehen Sie eine Audio- oder Videodatei hierher – MP3, WAV, eine Meeting-Aufnahme oder ein Handyvideo (auch .MOV vom iPhone)

Eine Podcast-Folge steckt voller Text, der nie geschrieben wird: Show-Notes, ein Blogartikel aus dem Gespräch, Zitate für Social Media, Untertitel für die Videofassung. Loquino verschriftlicht die Folge, sodass Sie dieses Material nicht mühsam von Hand aus der Tonspur klauben müssen. Gastgeber und Gäste werden als „Sprecher 1“, „Sprecher 2“ getrennt, jede Passage bekommt einen Zeitstempel – praktisch, um Kapitelmarken zu setzen oder eine bestimmte Aussage schnell zu finden. Wollen Sie die Folge auch als Video veröffentlichen, exportieren Sie fertige Untertitel als SRT. Laden Sie die Audiodatei hoch – MP3, WAV, M4A oder ein anderes gängiges Format – oder gleich die Videofassung; das fertige Transkript gibt es als DOCX, TXT, SRT oder XLSX.

Wozu ein Transkript

Ein Transkript verlängert die Lebensdauer jeder Folge. Aus dem gesprochenen Gespräch werden Show-Notes, ein durchsuchbarer Blogartikel und zitierfähige Passagen für Social Media – Inhalte, die neue Hörer über die Suche finden, lange nachdem die Folge erschienen ist. Untertitel machen die Videofassung ohne Ton verständlich, und die Zeitstempel helfen, Kapitel zu setzen und Ausschnitte gezielt herauszuschneiden. Statt jede Minute erneut abzuhören, arbeiten Sie am fertigen Text weiter.

Für wen das nützlich ist

  • Podcast-Hosts – Show-Notes und Kapitelmarken aus der fertigen Folge

  • Content-Teams – Blogartikel und Zitate aus dem Gespräch gewinnen

  • Video-Podcasts – SRT-Untertitel für die Fassung auf Video-Plattformen

  • Barrierefreiheit – die Folge auch als Text zum Mitlesen anbieten

Tipps für ein sauberes Transkript

  1. Nehmen Sie jede Stimme möglichst sauber getrennt auf – klar getrennte Stimmen werden zuverlässiger zugeordnet

  2. Für die Videofassung wählen Sie den SRT-Export – ihn erkennen Player und Schnittprogramme direkt

  3. Nutzen Sie die Zeitstempel, um Kapitelmarken zu setzen und Ausschnitte gezielt zu finden

So sieht ein Transkript aus

Jede Wortmeldung mit Sprecher und Zeitstempel – kein Textbrei, sondern eine Struktur, in der man sieht, wer wann was gesagt hat.

Interview · 00:00–00:42
  1. 00:00

    Sehen Sie, ein Interview hören wir fast nie ganz nach – den Text liest man in einer Minute.

  2. 00:11

    Früher hat mich das Abtippen einen halben Tag gekostet. Vor allem, wenn zwei gleichzeitig reden.

  3. 00:18

    Genau deshalb muss man sehen, wer den Satz gesagt hat – sonst zerfällt der Sinn.

  4. 00:26

    Und der Zeitstempel – um sofort an die richtige Stelle zu springen, statt alles noch einmal anzuhören.

  5. 00:34

    Vier Exportformate – ich arbeite direkt im gewohnten Programm weiter.

Verarbeitung in Deutschland

Ihre Aufnahmen und Transkripte werden auf Servern in Deutschland verarbeitet – Ihre Daten verlassen Deutschland nicht.

Für lange Aufnahmen gebaut

Die meisten Werkzeuge sind für den Fünf-Minuten-Clip gemacht. Loquino ist für das Zwei-Stunden-Interview gemacht, das Sie danach wirklich lesen müssen.

Sprecher getrennt

Wer wann gesprochen hat, steht am Rand – Sprecher 1, Sprecher 2. Keine Stimmerkennung, keine Zuordnung zu realen Personen.

Dateien bis 10 GB

Zwei Stunden Interview sind kein Sonderfall, sondern der Normalfall. Kein Zerschneiden, kein Hochladen in Teilen.

Über 90 Sprachen

Die Sprache wird automatisch erkannt – Deutsch, Englisch und der Rest der Liste, dieselbe Oberfläche.

Preise

Drei Tarife – monatlich oder jährlich, mit zwei Gratis-Monaten im Jahresabo.

Häufige Fragen

Kann ich aus meinem Podcast Show-Notes gewinnen?
Ja, das Transkript liefert die Textgrundlage – daraus lassen sich Show-Notes, ein Blogartikel und Zitate zusammenstellen.
Bekomme ich Untertitel für die Videofassung?
Ja, neben dem Text steht ein SRT-Export mit Zeitstempeln bereit.
Werden Gastgeber und Gäste getrennt?
Ja, die Stimmen werden als „Sprecher 1“, „Sprecher 2“ auseinandergehalten, ohne Zuordnung zu realen Personen.
Kann ich eine ganze Folge auf einmal hochladen?
Ja, eine Datei darf bis zu 10 GB groß sein – auch lange Folgen passen hinein.
Welche Formate kann ich hochladen?
Audio wie MP3, WAV, M4A, OGG oder AAC, ebenso die Videofassung als MP4 oder MOV.
Werden fremdsprachige Folgen erkannt?
Ja, die Sprache wird automatisch erkannt; über 90 Sprachen werden unterstützt.