Video med lyd: FLUX 3 kan generere videoklipp på opptil 20 sekunder med synkronisert lyd i samme generering . Modellen støtter tekst-til-video, bilde-til-video, video-til-video, nøkkelbilde-til-video og såkalt agentisk kjeding, der flere klipp settes sammen i en arbeidsflyt .
Ifølge tilgjengelig omtale kan resultatet nå 1080p med 24 bilder per sekund, samtidig som modellen tilbyr kamerakontroller og konsistent utseende på tvers av flere scener .
Lyd som følger handlingen: Lyd genereres sammen med videoen. Det omfatter blant annet flerspråklig dialog og lydeffekter som er koblet til det som skjer visuelt, i stedet for å bli lagt på som et separat etterarbeid . Formatet er 48 kHz stereo .
Bildegenerering og redigering: Modellen skal kunne lage og redigere bilder i ulike stiler, størrelsesforhold og oppløsninger. BFL fremhever også bedre tekstgjengivelse og håndtering av komplekse beskrivelser . Ved lanseringen var bildefunksjonen imidlertid ikke tilgjengelig for alle; tidlig tilgang skulle åpnes «i løpet av de kommende ukene» .
Forutsigelse av robotbevegelser: FLUX 3s forståelse av verden kan kobles til robotstyring. Dette kan skje direkte eller gjennom en spesialtilpasset handlingsdekoder . Dermed kan den samme grunnmodellen fungere som utgangspunkt både for kreativ innholdsproduksjon og for fysisk manipulering med roboter .
FLUX 3 bygger på BFLs Self-Flow-metode, som skal samle multimodal generering og representasjonslæring i ett rammeverk . Tanken er at bilder, video og lyd ikke bør læres som helt separate ferdigheter, fordi de beskriver ulike sider av den samme virkeligheten.
BFLs egen beskrivelse viser samtidig en interessant avveining: Når modellen får funksjon for handlingsprediksjon, kan videokvaliteten først falle med opptil 10 prosent. Etter rundt 3 500 treningstrinn skal kvaliteten være tilbake på fullt nivå, samtidig som modellen beholder evnen til å forutsi handlinger .
Black Forest Labs har samarbeidet med det sveitsiske oppstartsselskapet mimic robotics om FLUX-mimic, en video-til-handling-modell bygget på FLUX 3-ryggraden .
Systemet bruker en lett handlingsdekoder som trenes på mellomliggende trekk fra FLUX 3s videoprediksjon. På den måten kan den oversette modellens interne forståelse av en situasjon til fysiske bevegelser .
FLUX-mimic er testet og tatt i bruk på reelle produksjonsoppgaver hos Audi . Partnerne sier at robotene har håndtert komplekse oppgaver med myke objekter – arbeid som ifølge dem ville vært «helt umulig» å løse med tradisjonell programmering .
En annen påstått fordel er at systemet trenger færre demonstrasjoner for å lære nye oppgaver enn flere eksisterende metoder . Samarbeidet kombinerer BFLs ekspertise innen visuelle grunnmodeller med mimic robotics' erfaring med robotlæring, fingerferdig manipulering og bruk i produksjonsmiljøer .
Det har blitt vist til konkrete tall i enkelte nettfora: under 80 millisekunder inferenstid på ett NVIDIA RTX 5090-kort og 101 millisekunders total systemreaksjon. Disse tallene finnes imidlertid ikke i de tilgjengelige offisielle kildene fra BFL, Bloomberg eller de aktuelle pressemeldingene .
BFLs egne innlegg og pressedekningen fra lanseringsdagen 23. juli 2026 oppgir heller ingen maskinspesifikke latenstider . Tallene kan stamme fra en teknisk rapport som ennå ikke er offentlig, en tredjepartsanalyse eller senere testing, men det finnes ikke nok dokumentasjon i kildematerialet til å bekrefte dem.
Det er derfor riktig å si at FLUX 3 er utviklet med tanke på robotstyring i nær sanntid – ikke at en bestemt RTX 5090-ytelse er dokumentert. Til sammenligning viser uavhengige tester av tidligere FLUX-modeller at bildegenerering på RTX 5090 normalt tar flere sekunder, avhengig av modell, innstillinger og optimalisering . Video- og handlingsprediksjon er riktignok andre arbeidsbelastninger, så disse tallene kan ikke brukes som direkte mål på FLUX 3.
Dette er statusen som er oppgitt rundt lanseringen:
Det finnes foreløpig heller ingen offentlig teknisk rapport med fullstendige arkitekturdetaljer eller antall parametere. De som vil søke om tidlig tilgang, kan bruke skjemaet på BFLs modellside: bfl.ai/models/flux-3 .