Für Podcaster

Aufnahme beenden.Den Rest übernehmen wir.

Transkription mit automatischen Sprecherlabels, Shownotes aus dem Transkript, Sponsorenblöcke in deiner geklonten Stimme und lizenzfreie Intromusik. Alles nach der Aufnahme, in einem Konto auf einem Guthaben.

faktry transcription and show notes workflow for podcasters

Die Postproduktion frisst die Woche

Eine Episode aufzunehmen dauert eine Stunde. Daraus ein Transkript, Shownotes, Kapitelmarken, drei Social Clips und einen Sponsorenblock zu machen, dauert deutlich länger und bedeutet üblicherweise einen Transkriptionsdienst, ein TTS-Tool, eine Musikbibliothek und einen Audioeditor mit vier getrennten Rechnungen. faktry erledigt das alles aus derselben Datei, die du gerade hochgeladen hast, und jedes Ergebnis landet in einer Bibliothek, bereit für den nächsten Schritt.

Das Podcaster-Toolkit

Die Operationen, die Transkriptionsdienst, Musikbibliothek, TTS-Tool und Audioeditor ersetzen.

Von der Aufnahme zum Text

Transkription mit Sprecherlabels

Transkribieren mit Whisper-1 oder ElevenLabs Scribe v2, das jeden Sprecher automatisch erkennt und benennt. Export als Text, SRT, VTT oder JSON mit Zeitstempeln. Ein 60-Minuten-Interview ist in wenigen Minuten fertig.

Voice Cloning

Die eigene Stimme aus einer kurzen Probe klonen und damit Sponsorenblöcke, Teaser und Narration erzeugen. Konsistentes Branding über alle Episoden, ohne jedes Segment neu einzusprechen.

Intro- und Outromusik

Lizenzfreie Instrumentals passend zur Stimmung aus einem Textprompt erzeugen, oder komplette Tracks mit Gesang. Keine Lizenzgebühren und keine Namensnennung bei kommerzieller Nutzung.

Vom Text zum veröffentlichten Content

Shownotes und Textinhalte

Das Transkript in den KI-Writer geben und strukturierte Shownotes, Kapitel-Zeitstempel, eine Zusammenfassung, Social Posts und einen ganzen Blogbeitrag bekommen. Ohne Copy-Paste aus dem Transkript.

Audio beschaffen

Audio direkt von YouTube, SoundCloud, Vimeo oder Bandcamp holen. Praktisch für Gästeclips, Referenztracks und das Archivieren eigener Episoden für Highlight-Zusammenschnitte.

Audio schneiden und exportieren

Zwischen MP3, WAV, OGG, AAC und M4A konvertieren, mehrere Spuren mischen, Segmente trimmen und zusammenfügen. Die klassischen Schnitte liegen direkt neben den KI-Schritten statt in einer separaten App.

Die Modelle hinter dem Workflow

Modelle per Auswahlfeld wechseln. Gleiches Guthaben, keine separaten Anbieterkonten.

Stimme und Musik

Transkription, Text-to-Speech, Voice Cloning und Musikerzeugung

ElevenLabsOpenAI TTSGemini TTSMiniMax Music

Coverart und Clips

Episodengrafiken, Audiogramm-Hintergründe und Social Images

Videoversionen

Clips und Shorts aus der Episode für Social Media

Die Podcast-Postproduktions-Pipeline

Was faktry übernimmt, nachdem du die Aufnahme beendest.

Beschaffen und vorbereiten

Referenzaudio und Gästeclips von YouTube oder SoundCloud laden, auf die gebrauchten Segmente trimmen, zu einer Datei zusammenfügen und in das Format konvertieren, das dein Editor erwartet.

Audio-Download
Präziser Trim
Formatkonvertierung

Episode transkribieren

Rohaufnahme hochladen und mit Scribe v2 transkribieren. Sprecherlabels erkennen jeden Gast automatisch. SRT für die Videoversion exportieren oder Text für alles Weitere.

Sprecherlabels
50+ Sprachen
SRT und VTT

Aus dem Transkript Content machen

Ein Transkript wird zu Shownotes, Kapitelmarken, einer Zusammenfassung, einem Newsletter-Abschnitt und einem Satz Social Posts, alles im KI-Writer erzeugt und direkt bearbeitbar.

Shownotes
Kapitel
Social Posts

Videoversion schneiden

Coverart und Audiogramm-Hintergründe erzeugen, Untertitel aus der bereits vorhandenen SRT einbrennen und vertikale Clips für Shorts, Reels und TikTok exportieren.

Clip-Export
Coverart
Eingebrannte Untertitel

Funktionen im Überblick

Was ein Podcast-Konto plattformweit tatsächlich nutzt.

Sprechererkennung bei Interviews mit mehreren Gästen
Transkription in 50+ Sprachen
Transkript-Export als SRT, VTT, JSON und Text
Voice Cloning aus einer kurzen Referenzprobe
Lizenzfreie Musik mit vollen kommerziellen Rechten
Jedes Ergebnis in einer durchsuchbaren Bibliothek

Transkription

  • Whisper-1
  • ElevenLabs Scribe v2
  • Sprecherlabels
  • Export mit Zeitstempeln

Stimme

  • Voice Cloning
  • ElevenLabs v3
  • Gemini TTS
  • OpenAI TTS

Musik

  • Instrumentals
  • Komplette Tracks
  • Soundeffekte
  • Lizenzfrei

Schnitt

  • Trimmen und Zusammenfügen
  • Mehrspurmix
  • Formatkonvertierung
  • Audio-Download

Nur für die Episoden zahlen, die entstehen

Credits statt vier Monatsabos. Ein ruhiger Monat kostet nichts.

In jedem Konto enthalten

100 kostenlose Credits, ohne Karte
Credits 12 Monate gültig
Volle kommerzielle Rechte an jedem Ergebnis
Alle 65+ Operationen und 150+ Modelle

Fragen von Podcastern

Erkennt das meine Gäste in einem Interview mit mehreren Personen?

Ja. ElevenLabs Scribe v2 führt eine Sprechererkennung durch, das Transkript wird also automatisch pro Sprecher segmentiert und beschriftet. Du benennst die Labels einmal um und das ganze Transkript aktualisiert sich.

Wie lange dauert die Transkription einer ganzen Episode?

Ein 60-Minuten-Interview ist üblicherweise in unter zwei Minuten fertig. Datei hochladen, Modell wählen, und das Ergebnis landet als Text plus den gewählten Untertitelformaten in der Contentbibliothek.

Kann ich Shownotes erzeugen, ohne das Transkript zu kopieren?

Ja. Das Transkript liegt bereits in der Bibliothek, der KI-Writer liest es also direkt. Ein Durchlauf erzeugt Shownotes, Kapitel-Zeitstempel, eine Zusammenfassung und Social Posts, die du vor dem Export direkt bearbeitest.

Ist die erzeugte Intromusik wirklich kommerziell frei nutzbar?

Ja. Für erzeugte Musik verlangt faktry keine zusätzliche Lizenzgebühr, und sie darf kommerziell genutzt werden, im Rahmen unserer AGB und der Nutzungsrichtlinie des Musikmodell-Anbieters. Das gilt für Instrumentals, komplette Tracks mit Gesang und Soundeffekte.

Wie gut muss eine geklonte Stimme für Sponsorenblöcke klingen?

Das Klonen funktioniert aus einer kurzen Referenzprobe und ist für Sponsorenblöcke, Teaser und Narration gedacht, nicht als Ersatz für eine ganze moderierte Episode. Die meisten Podcaster nutzen es für die wiederkehrenden Segmente, die sonst eine weitere Aufnahmesession bedeuten.

Kann ich Audio von YouTube oder SoundCloud für Gästeclips holen?

Ja. Die Download-Operation deckt YouTube, SoundCloud, Vimeo und Bandcamp ab, du brauchst also keinen separaten Downloader für Referenztracks, Gästeclips oder das Archivieren eigener Episoden.

Was brauche ich für die Videoversion einer Episode?

Die bei der Transkription exportierte SRT lässt sich direkt in ein Video einbrennen, und die Video-Operationen decken vertikales Resize, Clip-Trimming, Thumbnail-Übersichten und Frame-Export ab. Coverart und Audiogramm-Hintergründe kommen aus den Bildmodellen.

Brauche ich eigene Konten bei OpenAI und ElevenLabs?

Nein. Alles läuft über das faktry-Gateway auf einem Guthaben. Es gibt kein Anbieterkonto anzulegen, keinen API-Schlüssel zu hinterlegen und keine zweite Rechnung abzugleichen.