יצירת וידאו: FLUX 3 מסוגל ליצור סרטונים באורך של עד 20 שניות, עם אודיו מסונכרן שנוצר יחד עם הווידאו בתהליך אחד . הוא תומך ביצירת וידאו מטקסט, מתמונה, מסרטון ומפריימים מרכזיים, וכן בשרשור אוטונומי של כמה קליפים . לפי המידע הזמין, הפלט מגיע עד רזולוציית 1080p ובקצב של 24 פריימים לשנייה, עם עקביות בין שוטים ושליטה בתנועות המצלמה .
יצירת אודיו: האודיו נוצר באופן מובנה לצד הווידאו, וכולל דיאלוג רב-לשוני ואפקטים קוליים הקשורים לאירועים המתרחשים בתמונה . הפלט הוא אודיו סטריאופוני בקצב דגימה של 48 קילוהרץ .
יצירה ועריכה של תמונות: המודל מיועד ליצירה ולעריכה של תמונות במגוון סגנונות, יחסי תמונה ורזולוציות, עם שיפור ברינדור טקסט ובהתמודדות עם הוראות מורכבות . עם זאת, בעת ההשקה יצירת התמונות עדיין לא הייתה זמינה, ו-BFL מסרה שגישה מוקדמת תיפתח "בשבועות הקרובים" .
חיזוי פעולות: הייצוג שהמודל לומד על העולם יכול לשמש גם לחיזוי פעולות רובוטיות — ישירות או באמצעות מפענח פעולות שעבר התאמה ייעודית . בכך FLUX 3 הופך לבסיס משותף לשני עולמות שבדרך כלל מופרדים זה מזה: יצירת תוכן דיגיטלי ושליטה ברובוטים בעולם הפיזי .
ארכיטקטורה מאוחדת: FLUX 3 מבוסס על גישת Self-Flow של BFL, שנועדה ליישר בין יצירה מולטימודלית לבין למידת ייצוג בתוך אותה מסגרת . החברה מתארת תופעה מעניינת בתהליך האימון: הוספת חיזוי פעולות הורידה זמנית את איכות הווידאו בשיעור של עד 10%, אך לאחר כ-3,500 צעדי אימון המודל חזר לאיכות מלאה — תוך שמירה על יכולות חיזוי הפעולות .
Black Forest Labs שיתפה פעולה עם הסטארט-אפ השווייצרי mimic robotics כדי לפתח את FLUX-mimic — מודל וידאו-פעולה המבוסס על ליבת FLUX 3 . המערכת מאמנת מפענח פעולות קל משקל על גבי מאפיינים פנימיים מנתיב חיזוי הווידאו של FLUX 3. כך היא מפיקה פעולות פיזיות מתוך הייצוג שהמודל למד על העולם .
לפי BFL ו-mimic robotics, FLUX-mimic כבר נבחן והופעל במשימות ייצור אמיתיות אצל Audi . השותפות מסרו כי הרובוטים הצליחו להתמודד עם "משימות מורכבות של מניפולציה בחומרים גמישים, שפשוט היו בלתי אפשריות" באמצעות תכנות מסורתי . עוד נטען כי המערכת זקוקה לכמות קטנה יותר של נתוני הדגמה כדי ללמוד משימות חדשות, בהשוואה לגישות קיימות .
החיבור בין החברות משלב את הידע של BFL במודלי ראייה כלליים עם המומחיות של mimic בלמידת רובוטים, מניפולציה מדויקת והטמעה בסביבת ייצור .
ברשת הופיעו מספרים שלפיהם FLUX 3 מסוגל לבצע הסקה בתוך פחות מ-80 מילישניות על GPU יחיד מסוג RTX 5090, ולהגיע לזמן תגובה מערכתי של 101 מילישניות. אולם המספרים האלה אינם מופיעים במקורות הרשמיים הזמינים של BFL, בכתבות ההשקה של Bloomberg או בהודעות לעיתונות שנבדקו . גם פוסטים רשמיים של BFL מיום ההשקה, 23 ביולי 2026, אינם מציגים מדדי חומרה כאלה .
ייתכן שמדובר בדוח טכני שטרם פורסם, בניתוח של צד שלישי או בבדיקה מאוחרת יותר — אך במערך המקורות הנוכחי אין מספיק ראיות כדי לאמת את הנתונים או לייחס אותם ל-BFL. מה שכן ניתן לומר הוא שהמערכת נבנתה מתוך שאיפה לשליטה רובוטית בזמן אמת או כמעט בזמן אמת; מפרט רשמי של זמני השהיה על כרטיסי GPU לצרכנים עדיין לא פורסם.
לשם השוואה בלבד, בדיקות של דגמי FLUX קודמים מדווחות על זמני יצירה של כמה שניות לתמונה בגודל 1024×1024 על RTX 5090, בהתאם לדגם, להגדרות ולאופטימיזציה . עם זאת, יצירת וידאו וחיזוי פעולות הם עומסי עבודה שונים לחלוטין, ולכן אי אפשר להסיק מהם ש-FLUX 3 אכן מגיע לזמן תגובה של פחות מ-100 מילישניות.
בקשות להצטרפות לתוכנית הגישה המוקדמת ניתן להגיש דרך הטופס באתר BFL: bfl.ai/models/flux-3 .