Flux 3
Ein Modell für Bild, Video & Audio
Flux 3 ist das neue multimodale Basismodell von Black Forest Labs. Es erzeugt Bilder, Videos und Audio aus einer einzigen Architektur heraus, mit Ergebnissen, die in jedem Stil noch lebensechter wirken.
Black Forest Labs hat Flux 3 gerade angekündigt. Sobald wir Zugang erhalten, schalten wir es bei faktry frei.
Was Flux 3 anders macht
Dank der Self-Flow-Architektur versteht ein einziges Modell, wie die Welt aussieht, sich bewegt und klingt.
Wirklich multimodal
Ein einziges Modell erzeugt Bild, Video und Audio, statt mehrerer separater Systeme, die aneinander gekoppelt sind.
Self-Flow-Architektur
Flow Matching bringt Generierung und Verständnis über verschiedene Datentypen hinweg in Einklang, das Modell lernt, wie Objekte zusammenhängen, sich bewegen und klingen.
Video mit nativem Ton
Erzeugt Videos mit synchronisiertem, direkt integriertem Ton bis zu 20 Sekunden Länge, inklusive Text-zu-Video, Bild-zu-Video und Video-zu-Video.
Präzisere Bildgenerierung
Versteht komplexe Prompts und stellt Text besser dar als frühere FLUX-Modelle, über verschiedene Stile, Seitenverhältnisse und Auflösungen hinweg.
Von Haus aus mehrsprachig
Sehr genaue mehrsprachige Textdarstellung in Bildern und mehrsprachige Dialoge in generierten Videos.
Lebensechte Bewegung & Ton
Überzeugende Mimik und stimmige Bild-Ton-Synchronisation, mit Steuerung über Keyframes.
Funktionen im Detail
Ein genauerer Blick darauf, was Flux 3 bei Video und Bild leistet.
Videogenerierung
Bildgenerierung
Erste Benchmarks
In vorläufigen Tests von Black Forest Labs wurde FLUX 3 Video gegenüber anderen führenden Videomodellen bevorzugt.
Vorläufige Ergebnisse, veröffentlicht von Black Forest Labs zur Ankündigung. Nicht unabhängig von faktry überprüft.
Ein erster Eindruck
Frühe Beispiele, generiert mit FLUX 3 und veröffentlicht von Black Forest Labs.
Wofür sich Flux 3 eignen wird
Ein Modell deckt Workflows ab, für die bisher mehrere einzelne Tools nötig waren.
Content-Erstellung
Von einem einzelnen Prompt direkt zu markenkonformen Bildern und Videos in einem durchgängigen Stil.
Marketing-Videos
Kurze Videos mit nativem Ton und mehrsprachigen Dialogen für Kampagnen und Social Media.
Produktvisualisierung
Produktideen ohne separate Rendering-Pipeline direkt in fotorealistische Bilder und Bewegtbild verwandeln.
Internationale Inhalte
Korrekter mehrsprachiger Text in Bildern und mehrsprachige Dialoge in Videos für ein globales Publikum.
Häufig gestellte Fragen
Was ist Flux 3?
Flux 3 ist das neue multimodale Basismodell von Black Forest Labs. Es erzeugt Bild, Video mit nativem Ton und Text aus einem einzigen, auf Self-Flow basierenden Modell.
Kann ich Flux 3 schon bei faktry nutzen?
Noch nicht, Flux 3 wurde gerade erst von Black Forest Labs angekündigt. Wir bringen es zu faktry, sobald wir Zugang dazu erhalten.
Was unterscheidet Flux 3 von Flux 2?
Flux 2 erzeugt nur Bilder. Flux 3 ist multimodal: Es generiert Bilder und Videos mit nativem Ton aus einem Modell, mit besserem Prompt-Verständnis und präziserer mehrsprachiger Textdarstellung.
Was kann Flux 3 tatsächlich erzeugen?
Videos bis zu 20 Sekunden mit nativem Ton und mehrsprachigen Dialogen sowie Bilder in vielen Stilen, Seitenverhältnissen und Auflösungen, alles aus demselben zugrunde liegenden Modell.
Welche anderen Modelle kann ich schon bei faktry nutzen?
Flux 2, Sora 2, Veo 3.1, Kling 3.0, Seedance und weitere sind bereits bei faktry verfügbar. Die komplette Übersicht findest du auf unserer KI-Modelle-Seite.