Google baut die nächste Stufe seiner KI-Videowerkzeuge aus – und diesmal wird es persönlich. Mit einem eigenen KI-Avatar in Gemini und Google Flow kannst du dich als digitale Version deiner selbst in generierte Bilder und Videos einsetzen. Dafür reicht nach der Einrichtung eine Erwähnung im Prompt: In Gemini wird der Avatar über den eigenen Google-Nutzernamen angesprochen, in Google Flow genügt @me. Aus einem normalen Textprompt kann damit eine Szene entstehen, in der eine KI-Version von dir auftritt, spricht und in eine Umgebung gesetzt wird, die nie gefilmt wurde. Google beschreibt den Avatar ausdrücklich als digitale Darstellung, die das eigene Aussehen und die Stimme übernimmt.

Das klingt zunächst nach einer weiteren Avatar-Funktion, wie sie seit Jahren in Präsentationsprogrammen oder spezialisierten KI-Diensten angeboten wird. Bei Google ist der Ansatz inzwischen deutlich weiter gefasst. Der persönliche Avatar wird mit dem Google-Konto verbunden und lässt sich anschließend in mehreren KI-Werkzeugen verwenden. In Gemini kann er Teil eines Bildes oder eines mit Gemini Omni erzeugten Videos werden. In Google Flow dient die eigene digitale Person als Referenz innerhalb umfangreicherer Videoprojekte. Google hat persönliche Avatare inzwischen außerdem in Google Vids integriert. Damit entwickelt sich aus einem einzelnen Avatar-Generator eher eine wiederverwendbare digitale Identität innerhalb des Google-KI-Ökosystems.

Für Content Creator ist dabei vor allem ein Punkt interessant: Du musst nicht für jede Szene erneut ein Foto deiner Person hochladen und darauf hoffen, dass das Modell daraus wieder ungefähr dieselbe Figur erzeugt. Nach der einmaligen Einrichtung kennt Google die hinterlegte Avatar-Referenz. Anschließend kann ein Prompt beispielsweise beschreiben, dass du durch Tokio läufst, in einem futuristischen Studio moderierst oder vor einer Kamera ein Produkt erklärst. Kleidung, Umgebung, Handlung und Bildstil können über den Prompt verändert werden. Das eigentliche Gesicht und die Stimme sollen über den persönlichen Avatar wiedererkennbar bleiben.

Damit rückt ein Szenario näher, das bisher häufig mehrere Werkzeuge erforderte: ein konsistenter virtueller Moderator, der sich per Text steuern lässt. Google kombiniert dafür seine generativen Medienmodelle mit Gemini und Flow. Besonders Flow ist inzwischen als umfangreiches KI-Kreativstudio ausgelegt und unterstützt neben Veo-Modellen auch Gemini Omni Flash für Generierung und Bearbeitung.

Allerdings gibt es für Nutzer in Deutschland einen ziemlich wesentlichen Haken. Persönliche Gemini- und Flow-Avatare sind im Europäischen Wirtschaftsraum derzeit nicht verfügbar. Google nennt in seinen aktuellen Hilfeseiten ausdrücklich den EWR, die Schweiz und Großbritannien als ausgeschlossene Regionen. Wer die Funktion in Deutschland im August 2026 nicht in seinem Gemini- oder Flow-Konto findet, hat daher sehr wahrscheinlich weder eine versteckte Einstellung übersehen noch den falschen Tarif gebucht. Google hat die Funktion hier schlicht noch nicht freigeschaltet.

Googles persönlicher KI-Avatar speichert Gesicht und Stimme als wiederverwendbare Referenz

Für die Einrichtung erstellt Google keine Figur aus einem einzelnen Profilfoto. Du musst dein Gesicht und deine Stimme zunächst erfassen lassen. In Gemini beginnt die Einrichtung am Computer, anschließend wird ein QR-Code mit Smartphone oder Tablet gescannt. Auf dem Mobilgerät folgen die Aufnahmen von Gesicht und Stimme. Google empfiehlt dafür eine ruhige Umgebung, gleichmäßiges Licht und ein vollständig sichtbares Gesicht. Masken, Sonnenbrillen oder Hüte sollen während der Erfassung nicht getragen werden.

Bei Google Flow ist der Ablauf ähnlich. Die Einrichtung kann am Rechner gestartet werden, für die eigentliche Erfassung wird weiterhin ein Mobilgerät benötigt. Dabei werden unterschiedliche Winkel des Gesichts aufgenommen und eine kurze Sprachsequenz eingesprochen. Google überprüft anschließend die Identität beziehungsweise Ähnlichkeit, bevor der Avatar verwendet werden kann.

Das ist ein wichtiger Unterschied zu klassischen Bildreferenzen. Ein hochgeladenes Porträt liefert einem generativen Modell lediglich visuelle Informationen für die aktuelle Generierung. Der persönliche Google-Avatar wird dagegen mit dem Konto verknüpft und kann später erneut angesprochen werden. Google beschränkt die hinterlegte Ähnlichkeit dabei auf den jeweiligen Kontoinhaber.

So kannst du deinen Gemini-Avatar später erstellen

Sobald Google persönliche Avatare auch für dein Konto und deine Region freigeschaltet hat, erfolgt die Einrichtung laut aktueller Gemini-Hilfe über die Eingabeoberfläche. Dort wählst du bei den Dateifunktionen den Bereich für Avatare aus und startest die Erfassung. Nach dem Scan des eingeblendeten QR-Codes zeichnest du Gesicht und Stimme mit einem Smartphone oder Tablet auf. Anschließend kehrst du zu Gemini zurück und aktivierst den Avatar mit „Use Avatar“.

Voraussetzung für die Erstellung ist ein persönliches Google-Konto mit einem Google-AI-Tarif. Außerdem musst du mindestens 18 Jahre alt sein. Google weist derzeit zusätzlich darauf hin, dass die Avatar-Funktion nur Englisch unterstützt.

Nach der Einrichtung taucht der Avatar in Gemini als Referenz mit deinem Google-Nutzernamen auf. Ein Prompt kann dann beispielsweise nach folgendem Prinzip aufgebaut werden:

Erstelle ein Video von @deinname in einem modernen Technikstudio. Die Person blickt in die Kamera und erklärt ein neues Smartphone.

Gemini behandelt @deinname dabei als Verweis auf die zuvor hinterlegte persönliche Avatar-Referenz. Google nennt in seiner Dokumentation ausdrücklich die Möglichkeit, den Avatar sowohl für Bilder als auch für Gemini-Omni-Videos einzusetzen.

In Google Flow reicht später @me

In Google Flow ist die Verwendung noch etwas direkter gelöst. Sobald ein persönlicher Avatar für das Konto existiert, kannst du innerhalb eines Projekts @me in das Promptfeld schreiben. Danach beschreibst du, wie deine digitale Version in der Szene eingesetzt werden soll.

Ein Prompt könnte beispielsweise lauten:

@me steht auf dem Deck eines Segelboots bei Sonnenuntergang und spricht direkt in die Kamera. Ruhige Kamerafahrt, realistischer Stil, 16:9.

Oder deutlich absurder:

@me sitzt im Cockpit eines kleinen Raumschiffs und hält ein freundlich aussehendes außerirdisches Wesen in den Armen.

Das Interessante daran ist weniger die jeweilige Szene. Entscheidender ist die Kombination aus wiederverwendbarer Identität und generativem Video. Das Modell muss die dargestellte Person nicht bei jedem Prompt neu interpretieren. Der Avatar liefert die persönliche Referenz, während Flow die eigentliche Szene generiert.

Flow macht aus dem Avatar ein Werkzeug für ganze Videoprojekte

Gemini eignet sich für einzelne Generierungen. Google Flow ist stärker auf die Produktion und Weiterbearbeitung von Videomaterial ausgelegt. Projekte können mehrere generierte Clips und Assets enthalten, Szenen lassen sich aufbauen und vorhandene Generierungen anschließend weiterverwenden. Googles aktuelle Dokumentation nennt für Flow unter anderem 4-, 6-, 8- und 10-Sekunden-Clips bei Gemini Omni Flash.

Mit Gemini Omni lassen sich generierte Videos außerdem durch weitere Prompts verändern. Google nennt etwa den Austausch von Objekten, andere Kamerawinkel oder Änderungen einer Szene als mögliche Bearbeitungen. Bei Gemini selbst unterstützt Omni ebenfalls mehrstufiges Editing innerhalb einer Unterhaltung.

Für einen persönlichen KI-Avatar bedeutet das beispielsweise, dass aus einer Grundidee mehrere Varianten entstehen können. Die Figur kann in einer neuen Umgebung platziert, Kleidung kann verändert oder eine andere Inszenierung ausprobiert werden. Damit wird der Avatar für Content-Produktion interessanter als ein klassischer Talking Head mit festem Hintergrund.

Ein digitaler Moderator ohne Kamera wird plötzlich realistisch

Der naheliegendste Einsatzbereich sind Moderationsvideos. Statt Kamera, Licht, Mikrofon und mehreren Takes könnte ein Creator einen Text schreiben und diesen von seiner digitalen Version sprechen lassen. Auch Varianten eines Clips wären wesentlich einfacher herzustellen: gleicher Sprecher, andere Szene, anderer Hintergrund oder eine angepasste Ansprache.

Für kurze Informationsvideos, Erklärstücke, interne Unternehmenskommunikation oder lokalisierte Inhalte kann das praktisch sein. Gleichzeitig dürfte die Technik schnell an Grenzen stoßen, sobald Authentizität entscheidend wird. Ein persönliches Statement wirkt anders, wenn die dargestellte Person tatsächlich vor der Kamera steht. Der technisch perfekte Avatar ersetzt diesen Unterschied nicht automatisch.

Interessanter wird deshalb vermutlich eine Mischform. Reale Aufnahmen können dort eingesetzt werden, wo Persönlichkeit und Glaubwürdigkeit zählen. Generierte Szenen übernehmen Sequenzen, die aufwendig, teuer oder real überhaupt nicht produzierbar wären.

Dass der Avatar auch deine Stimme übernimmt, verändert die Sache erheblich

Ein wiedererkennbares Gesicht allein wäre bereits nützlich. Google erfasst bei der Avatar-Erstellung jedoch zusätzlich die Stimme. Damit entsteht ein Modell, das zwei der wichtigsten persönlichen Erkennungsmerkmale einer Person kombiniert.

Google behandelt diese Daten entsprechend als besonders sensible Avatar-Daten. Die Aufzeichnungen werden mit dem Google-Konto verbunden. Laut Googles Datenschutzinformationen werden die Aufnahmen automatisch gelöscht, wenn drei Jahre lang nicht auf sie zugegriffen beziehungsweise der Avatar nicht verwendet wurde. Nutzer können den Avatar außerdem selbst löschen.

Beim Löschen der hinterlegten Aufzeichnung werden die gespeicherten Gesicht- und Sprachdaten des Avatars aus Googles Systemen entfernt. Bereits erzeugte oder veröffentlichte Inhalte verschwinden dadurch allerdings nicht automatisch.

Gerade bei einer digitalen Kopie der eigenen Stimme und des eigenen Gesichts lohnt es sich deshalb, diese Funktion nicht wie einen gewöhnlichen Profilbild-Generator zu behandeln. Die praktische Stärke des Systems entsteht schließlich genau dadurch, dass es eine möglichst präzise persönliche Referenz speichert.

Google begrenzt die Weitergabe der Avatar-Daten

Google hat zusätzlich einige technische Schranken eingebaut. Avatar-Daten können laut Flow-Dokumentation aus Sicherheitsgründen nicht über öffentlich freigegebene Projektlinks oder Flow-Tools weitergegeben werden. Außerdem führt Google bei generierten Inhalten mit persönlichen Ähnlichkeiten zusätzliche Sicherheitsprüfungen durch.

Das dürfte auch erklären, weshalb Google den Avatar direkt an das jeweilige Nutzerkonto bindet. Die Funktion soll nicht zum komfortablen Generator beliebiger digitaler Doppelgänger anderer Personen werden.

Bei der normalen Videogenerierung weist Google ohnehin darauf hin, dass Nutzer die Rechte an hochgeladenem Material besitzen müssen und generierte Videos nicht zur Täuschung, Belästigung oder Schädigung anderer Personen verwendet werden dürfen.

Flow versieht KI-Inhalte mit SynthID

Für generierte Inhalte setzt Google weiterhin auf SynthID. Nach Angaben des Unternehmens enthalten mit Veo, Gemini Omni oder Nano Banana in Flow erzeugte Inhalte ein unsichtbares SynthID-Wasserzeichen. Damit können entsprechende Bilder und Videos als KI-generierte Medien identifiziert werden.

Das ist bei persönlichen Avataren besonders relevant. Schließlich kann damit ein realistisches Video entstehen, in dem eine reale Person Dinge tut oder sagt, die sie nie aufgenommen hat. Technisch ist genau das der Zweck der Funktion.

Die Grenze zwischen einem echten Kameraclip und einer vollständig generierten Aufnahme wird dadurch für Zuschauer immer schwerer zu erkennen. Für Creator wird eine klare Kennzeichnung solcher Inhalte deshalb eher wichtiger als überflüssig.

Warum sehe ich den Google AI Avatar in Deutschland noch nicht?

Für deutsche Nutzer lässt sich diese Frage derzeit ziemlich eindeutig beantworten. Google hat persönliche Avatare in Gemini und Flow im Europäischen Wirtschaftsraum noch nicht freigegeben. Die Einschränkung steht ausdrücklich in den aktuellen Supportdokumenten.

Ein Google-AI-Abo allein ändert daran nichts. Auch ein VPN ist zumindest für Flow keine vorgesehene Lösung: Google weist in seiner allgemeinen Flow-Hilfe ausdrücklich darauf hin, dass VPN-Verbindungen keinen Zugriff auf Funktionen beziehungsweise Regionen ermöglichen sollen, die offiziell noch nicht unterstützt werden.

Wann der persönliche Gemini-Avatar in Deutschland startet, nennt Google derzeit nicht. Eine konkrete Prognose wäre deshalb Spekulation.

Google baut aus dem eigenen Avatar eine neue Art von Medien-Asset

Der spannendste Teil der Funktion steckt am Ende gar nicht in einzelnen spektakulären KI-Clips. Fotos, Logos, Musik und Videomaterial sind für Creator längst wiederverwendbare Assets. Mit persönlichen Avataren wird nun auch die eigene Erscheinung zu einem solchen Produktionsbaustein.

Du erstellst deine digitale Referenz einmal und kannst sie danach in unterschiedliche generierte Situationen schicken. Gemini kann daraus einzelne Bilder und Videos erzeugen. Flow erweitert das Prinzip um Projekte, Varianten und weitere Bearbeitungsschritte. Google Vids bringt dieselbe Idee in stärker geschäftlich geprägte Videoproduktion.

Gerade deshalb ist der Google AI Avatar mehr als ein weiterer lustiger Avatar-Generator. Die Technik reduziert den Abstand zwischen klassischer Videoaufnahme und generativem Content erheblich. Für Nutzer in Deutschland bleibt das im Moment allerdings vor allem ein Ausblick: Die Funktion existiert bereits und ist dokumentiert, der EWR steht weiterhin auf Googles Ausschlussliste.

Teile den Beitrag:

Alle Beiträge kennzeichnen wir hiermit als Werbung. Die Werbekennzeichnung erfolgt, da Marken von Hard- und Software genannt werden. Oftmals werden App-Codes zur Verfügung gestellt sowie Gadgets zum Test. Als Amazon-Partner verdienen wir an qualifizierten Verkäufen. Zudem gehen wir Contentpartnerschaften oder Kooperationen ein. Hilf uns, indem du mit diesem Amazon-Link einkaufst! Lade dir unsere kostenlosen Quiz-Spiele hier herunter!

Hinterlasse eine Antwort