Gemini 3.8 Live mit Live Avatar ergänzt den gesprochenen KI Dialog um eine Videofigur mit synchronisierten Lippenbewegungen und Gesichtsausdrücken. Google nennt Unterstützung für 97 Sprachen; die Funktion ist allgemein in Gemini Enterprise verfügbar, nicht als allgemeines Verbraucherangebot.
Veröffentlicht vonBearbeitet mit GPT-6 LunaBilder erstellt mit GPT Image 2
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What is Google’s Live Avatar feature for Gemini 3.8 Live, how do its synchronized video avatars, speech-to-speech conversations, interruptio. Article summary: Google’s Live Avatar adds a low-latency, speaking video persona to Gemini 3.8 Live, so an enterprise AI agent can respond with synchronized voice, lip movements and facial expressions rather than voice alone. Google says. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Google erweitert Gemini 3.8 Live um einen sichtbaren Auftritt: Mit Live Avatar kann ein KI-Agent nicht nur sprechen, sondern als Videofigur mit passenden Lippenbewegungen und Gesichtsausdrücken erscheinen. Dafür verbindet Google seine Live-Dialogfunktionen mit Video, das mit geringer Verzögerung gestreamt wird. Die Funktion ist für Unternehmen gedacht und laut Google allgemein in Gemini Enterprise verfügbar – nicht als allgemeines Verbraucherangebot von Gemini.10
12
Live Avatar soll Sprache und Video in einem Gespräch miteinander verknüpfen. Die Figur wird passend zur erzeugten Sprache animiert; es handelt sich also nicht einfach um ein vorab aufgenommenes Video. Google gibt an, dass die Sprach- und Lippenbewegungssynchronisierung 97 Sprachen unterstützt und sich an Sprachwechsel im Gespräch anpassen kann.10
Berichte nennen außerdem automatische Spracherkennung und Wechsel zwischen Sprachen.5
8 Wie genau das System Sprecherwechsel oder Unterbrechungen erkennt und verarbeitet, wird in den verfügbaren Angaben jedoch nicht im Detail erklärt. Aus der allgemeinen Beschreibung eines flüssigen Gesprächs lässt sich daher kein konkretes Verhalten bei Unterbrechungen ableiten.
7
10
Einige Berichte zufolge kann ein Agent Kamera- oder Bildschirmfreigaben als Eingabe nutzen und währenddessen weiter mit Nutzern sprechen, während im Hintergrund Werkzeuge oder API-Aufrufe ausgeführt werden.2
15
16 Die verfügbaren Quellen erläutern allerdings nicht vollständig, welche Integrationen unterstützt werden, wie schnell solche Aktionen ablaufen oder wo ihre Grenzen liegen. Diese Angaben sind daher als berichtete Funktionen zu verstehen, nicht als vollständige technische Spezifikation.
Google Cloud zufolge ist Gemini 3.8 Live mit Live Avatar allgemein in Gemini Enterprise verfügbar. Zuvor war die Technologie bei Google Cloud Next 2026 vorgestellt worden.12 Für Unternehmen bedeutet „allgemein verfügbar“ dabei nicht automatisch, dass jede Organisation auch eigene Avatare erstellen kann: Google zufolge ist die Erstellung benutzerdefinierter Avatare nur für Nutzer auf einer Freigabeliste zugänglich.
12 Ein Bericht nennt außerdem vorgefertigte Avatare als Option.
4
Welche weiteren Verwaltungs- und Zugriffskontrollen gelten und wie Unternehmen für die Freigabeliste berücksichtigt werden, geht aus den hier verfügbaren Quellen nicht hervor.4
12
Ein Bericht schreibt, dass Live-Avatar-Ausgaben ein SynthID-Wasserzeichen tragen sollen, das beim Erkennen KI-generierter Medien helfen kann.6 Googles verfügbare Ankündigung bestätigt diese Einzelheit nicht. Auch ist nicht belegt, ob tatsächlich jede Ausgabe markiert wird oder wie zuverlässig ein Wasserzeichen nach einer Bearbeitung erhalten bleibt.
Die Beschränkung der Erstellung individueller Avatare auf freigeschaltete Nutzer ist eine dokumentierte Zugangsbeschränkung. Die Quellen beschreiben aber weder konkrete Einwilligungsprüfungen noch ein umfassendes Verfahren zur Identitätsprüfung. Solche Schutzmaßnahmen sollten daher nicht aus der Freigaberegel allein abgeleitet werden.4
12
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
Gemini 3.8 Live mit Live Avatar ergänzt den gesprochenen KI Dialog um eine Videofigur mit synchronisierten Lippenbewegungen und Gesichtsausdrücken.
Gemini 3.8 Live mit Live Avatar ergänzt den gesprochenen KI Dialog um eine Videofigur mit synchronisierten Lippenbewegungen und Gesichtsausdrücken. Google nennt Unterstützung für 97 Sprachen; die Funktion ist allgemein in Gemini Enterprise verfügbar, nicht als allgemeines Verbraucherangebot.
Berichte erwähnen Kamera und Bildschirmfreigaben sowie SynthID Wasserzeichen. Wie umfassend diese Funktionen und Schutzmaßnahmen gelten, ist anhand der verfügbaren Angaben nicht geklärt.