Không giống như các mô hình đường ống chuyển đổi đầu vào tuần tự, Gemini Omni Flash xử lý văn bản, hình ảnh, âm thanh và video như một đầu vào thống nhất duy nhất và tạo ra đầu ra là video — một khả năng được gọi là "bất kỳ-đầu-vào-nào" (any-to-any) AAB. Mô hình tạo ra các clip 3–10 giây, chất lượng 720p ở tốc độ 24 khung hình/giây với tỷ lệ khung hình 16:9, 9:16 hoặc 1:1, cùng với âm thanh gốc được đồng bộ hóa được tạo ra trong cùng một lần xử lý HG.
Bạn có thể cung cấp cho mô hình tối đa bảy hình ảnh tham chiếu, một clip video và một bản tóm tắt văn bản trong một lời nhắc duy nhất và mô hình sẽ kết hợp chúng thành một đầu ra mạch lạc BG. Ví dụ: người dùng có thể cung cấp ảnh sản phẩm, video nền và mô tả, và Omni Flash sẽ tạo ra một clip quảng cáo ngắn.
Khả năng nổi bật là chỉnh sửa video thông qua hội thoại, được hỗ trợ bởi Interactions API AA. Thay vì xuất clip sang một công cụ chỉnh sửa riêng biệt, người dùng có thể tinh chỉnh đầu ra một cách lặp đi lặp lại thông qua ngôn ngữ tự nhiên — hoán đổi nhân vật, hoán đổi sản phẩm, chuyển đổi phong cách, thêm đối tượng và điều chỉnh ánh sáng — trong khi mô hình vẫn giữ nguyên những phần video mà người dùng muốn giữ lại AA. Mỗi lượt tương tác trong cuộc hội thoại sẽ tạo ra một video mới và mô hình hiểu ngữ cảnh từ các lượt trước đó A.
Giá API được đặt ở mức 0,10 USD mỗi giây video được tạo, tương đương với 1 USD cho mỗi clip 10 giây AH. Mức giá này ngang bằng với Veo 3.1 Fast, định vị Omni Flash như một giải pháp thay thế chi phí thấp hơn, lặp lại nhanh hơn cho các quy trình làm việc video Y. Giá cũng là 1,50 USD cho mỗi triệu token đầu vào và 17,50 USD cho mỗi triệu token đầu ra video H.
Đối với người dùng phổ thông, Gemini Omni Flash miễn phí trên YouTube Shorts cho người dùng từ 18 tuổi trở lên AWN. Nó cũng được bao gồm trong các gói đăng ký Google AI Plus, Pro và Ultra AG.
Giới hạn 10 giây là một quyết định có chủ đích về sản phẩm khi ra mắt, với thời lượng dài hơn dự kiến sẽ được phát hành trong tương lai HY. Google đã mô tả đây là một chiến lược triển khai có trách nhiệm, cân bằng giữa khả năng và sự an toàn T. Một số nhà bình luận lưu ý rằng giới hạn này có thể là một hạn chế ở phía triển khai chứ không phải là giới hạn của kiến trúc mô hình N.
Mọi clip được tạo hoặc chỉnh sửa bằng Omni Flash đều bao gồm hình mờ kỹ thuật số SynthID vô hình YNN. Người dùng có thể xác minh nội dung do AI tạo ra thông qua ứng dụng Gemini, Gemini trong Chrome và Google Search bằng cách hỏi "Video này có được tạo bằng Google AI không?" NB. Trên các bề mặt Google được hỗ trợ, nội dung cũng mang C2PA Content Credentials NC. Không có nút API nào để tắt tính năng này DG.
Vào ngày 1 tháng 7 năm 2026, Adobe đã thêm Gemini Omni Flash làm mô hình đối tác trong Adobe Firefly, cho phép chỉnh sửa video bằng tiếng Anh đơn giản thông qua giao diện và hệ thống tín dụng của Firefly D. Chi phí là 30 tín chỉ mỗi giây video D. Điều này tiếp nối một quan hệ đối tác rộng lớn hơn đã được công bố tại Google I/O nhằm mang kết nối Adobe đến Gemini B. Người dùng có thể truy cập nó từ menu thả xuống Model trong mô-đun Text to Video A.
Được phát hành cùng với Omni Flash, Nano Banana 2 Lite (ID mô hình: gemini-3.1-flash-lite-image) là mô hình hình ảnh nhanh nhất và rẻ nhất trong gia đình Nano Banana của Google AA. Nó tạo ra hình ảnh trong chưa đầy 4 giây với chi phí dưới 0,04 USD cho mỗi 1.000 hình ảnh BHB. Tính khả dụng chung được công bố vào ngày 30 tháng 6 năm 2026 trên Google Cloud và nó có sẵn trong Google AI Studio, Gemini API và Gemini Enterprise Agent Platform HCB.
Google đã giới thiệu Omni Product Studio tại Google I/O 2026, một ứng dụng demo biến hình ảnh sản phẩm tĩnh thành video thương mại điện tử điện ảnh bằng Gemini Omni Flash GC.
Chỉnh sửa video đã tải lên bị chặn đối với người dùng ở Khu vực Kinh tế Châu Âu (EEA), Thụy Sĩ và Vương quốc Anh A. Các báo cáo từ cộng đồng cũng ghi nhận tình trạng chặn ở Ấn Độ và một số bang của Hoa Kỳ A. Mô hình này cũng chỉ chỉnh sửa đáng tin cậy các clip do chính nó tạo ra — chứ không phải các video tải lên từ bên thứ ba tùy ý — như một biện pháp an toàn chống lại việc lạm dụng deepfake A. Khả năng chỉnh sửa giọng nói và âm thanh bị cố tình giữ lại khi ra mắt do lo ngại về deepfake TGL.