גוגל השיקה יכולת ישירה ליצירת ועריכת תמונות בזמן אמת בתוך שירות השיחה הקולית "ג'מיני לייב" (Gemini Live) [8]. במהלך שיחה קולית, משתמשים יכולים להפעיל את מצלמת הטלפון, להצביע על אובייקט ולתת הוראות בשפה טבעית ליצירה או עריכה של תמונות בו במקום [8].

Create a landscape editorial hero image for this Studio Global article: What real-time image generation and editing capability has Google added to Gemini Live, how does it work on Android and iOS, what technology. Article summary: ## What Google Added to Gemini Live. Topic tags: general, documentation, general web, user generated, education. Reference image context from search candidates: Reference image 1: visual subject "Google has begun the deployment of Gemini's innovative real-time AI video functionalities, enabling the platform to interpret visual input from a user's device" source context "Google's Gemini update that can tell you live what it sees through your camera is now rolling out - PhoneArena" Reference image 2: visual subject "Smartphones must have user-replaceable batteries by 2027. But not your iPhone. Here's why" source context "Google's Gemini update that can tell you l
גוגל השיקה יכולות ישירות של יצירה ועריכה של תמונות בזמן אמת בתוך ג'מיני לייב (Gemini Live), מצב השיחה הקולית המתקדם שלה . בעבר, יצירת תמונות דרשה מעבר בין מצבי שיחה וכתיבת פקודות טקסטואליות. כעת, בזמן שאתם מנהלים שיחה קולית עם ג'מיני, תוכלו להפעיל את מצלמת הטלפון, להראות לה נושא כלשהו, ולתת הוראות קוליות כמו "תיצור תמונה של החדר הזה בעיצוב יפני מינימליסטי" או "תחליף את צבע הקיר לכחול". התוצאה תיווצר או תיערך ישירות על המסך, ללא צורך לעזוב את חוויית השיחה
.
העדכון החדש זמין כעת באפליקציית ג'מיני לשני סוגי המכשירים, אך ישנם ניואנסים קלים:
ההבחנה המרכזית היא שבעוד שמודל Gemini 2.5 Flash Image תומך ביצירה ועריכה על בסיס פקודות טקסט ותמונות, השדרוג החדש לג'מיני לייב משלב את הלולאה היצירתית הזו לתוך שיחה קולית רציפה מול המצלמה .
מודל התמונה שמניע את החוויה הוא Gemini 2.5 Flash Image, שגוגל מכנה בחיבה "ננו-בננה". גוגל מתארת אותו כמודל יצירת ועריכת התמונות המתקדם ביותר שלה . בין היכולות המרכזיות שלו:
המודל זמין למפתחים דרך Gemini API ו-Google AI Studio, והמחיר שלו עומד על 30 דולר למיליון טוקנים בפלט, כאשר כל תמונה נחשבת כ-1,290 טוקנים .
כנס המפתחים Google I/O 2026, שהתקיים במאי 2026, היה במה מרכזית לשורה של הכרזות בינה מלאכותית שאפתניות, אשר בונות על המומנטום של ג'מיני לייב:
Gemini Omni: "ננו-בננה" לוידאו
Gemini 3.5 Flash: המודל המהיר והחכם החדש
שדרוגים נוספים:
המהלך של גוגל אינו רק שדרוג פיצ'ר בודד, אלא הצהרת כוונות על בניית צינור עיבוד רב-מודאלי ואחיד בזמן אמת. המיקום של גוגל מתבסס על עומק האינטגרציה בין כל חלקי המערכת:
היתרון התחרותי של גוגל, על סמך ההכרזות הללו, טמון ביכולתה להציע חוויה אינטואיטיבית, מהירה ומשולבת, ממצלמת הטלפון ועד לעריכת וידאו מורכבת. השאלה הגדולה שנותרה פתוחה היא כיצד יתפקדו זרימות העבודה המשולבות הללו בפועל, בקנה מידה רחב, כאשר יהפכו לזמינות לכלל המשתמשים .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
גוגל השיקה יכולת ישירה ליצירת ועריכת תמונות בזמן אמת בתוך שירות השיחה הקולית "ג'מיני לייב" (Gemini Live) [8].
גוגל השיקה יכולת ישירה ליצירת ועריכת תמונות בזמן אמת בתוך שירות השיחה הקולית "ג'מיני לייב" (Gemini Live) [8]. במהלך שיחה קולית, משתמשים יכולים להפעיל את מצלמת הטלפון, להצביע על אובייקט ולתת הוראות בשפה טבעית ליצירה או עריכה של תמונות בו במקום [8].
התכונה זמינה באפליקציית ג'מיני הן למכשירי אנדרואיד והן למכשירי iOS [8].