Maak kennis met Gemini Omni

Gemini Omni Flash is een model dat, op basis van alle soorten invoer, kan maken wat je maar wilt, te beginnen met video.


Koray Kavukcuoglu

CTO, Google DeepMind and Chief AI Architect, Google


Vorig jaar brachten we met Nano Banana de intelligentie van Gemini naar beeldgeneratie en -bewerking. Sindsdien hebben miljoenen mensen hiermee oude foto’s hersteld, schetsen omgezet in ontwerpen en ideeën kunnen visualiseren op manieren die daarvoor onmogelijk waren. We hebben Gemini vanaf dag één en vanuit de basis multimodaal ontwikkeld, en nu zetten we hierin de volgende stap.

Vandaag introduceren we Gemini Omni, waarin de mogelijkheid van Gemini om te redeneren samenkomt met de mogelijkheid om te maken. Met Omni kun je afbeeldingen, audio, video en tekst als invoer combineren en video’s van hoge kwaliteit genereren, gebaseerd op wat Gemini weet van de echte wereld. Bovendien kun je je video’s makkelijk bewerken door met Gemini te praten.

Vanaf nu rollen we het eerste Omni-model, Gemini Omni Flash, uit naar de Gemini-app, Google Flow en YouTube Shorts. De komende maanden ondersteunen we uitvoermodaliteiten zoals beeld en audio. Hieronder vind je meer informatie over wat Omni zo bijzonder maakt.

Bewerk je video’s via een gesprek

Omni biedt een makkelijkere manier om video’s te bewerken, namelijk door middel van natuurlijke taal. Elke instructie bouwt voort op de vorige. Je personages blijven consistent, de fysieke aspecten blijven behouden en de scène onthoudt wat er daarvoor gebeurde.

Transformeer de wereld om je heen. Pas bepaalde dingen aan, of alles. Je video wordt het begin van iets dat je zelf nooit had kunnen filmen.

Prompt: Make the sculpture out of bubbles.

Bedenk compleet nieuwe acties. Kies een video die je gemaakt hebt en vraag Omni gewoon om te veranderen wat erin gebeurt. Bewerk de actie, voeg nieuwe personages of objecten toe of transformeer een moment naar iets onverwachts.

Verfijn je video’s in meerdere stappen. Pas de omgeving, de hoek, de stijl of zelfs specifieke details aan zonder dat je de draad van je originele scène kwijtraakt.

Breng ideeën tot leven, gebaseerd op wat Gemini weet over de wereld

Omni maakt niet alleen scènes die er levensecht uitzien, het redeneert ook over wat er vervolgens zou kunnen gebeuren. Het combineert een intuïtief begrip van natuurkundige aspecten met de kennis die Gemini heeft over geschiedenis, wetenschap en culturele context. Daarmee slaat Omni een brug tussen fotorealisme en zinvolle verhalen vertellen.

Maak visuals met een grotere natuurkundige nauwkeurigheid. Omni heeft een beter intuïtief begrip van natuurkundige aspecten zoals zwaartekracht, kinetische energie en vloeistofmechanica om nog realistischere scènes te maken.

Prompt: A marble rolling fast on a chain reaction style track, continuous smooth shot.

Combineer kennis en creativiteit. Omni is in staat om wat Gemini weet over taal, afbeeldingen en betekenis toe te passen, en gaat hierin veel verder dan het herkennen van patroonovereenkomsten.

Prompt: The video shows items of the alphabet. An unusual item starting with each letter is shown sitting on a table (like a Capybara for C, disco globe for D and Lava Lamp for L). All 26 letters must be represented by 26 items with matching lower thirds displaying the letter. Only one item and lower third at a time. Each lower third must look like a black marker written on a slip of paper in the bottom left. Rapid fire, roughly 9 frames per item at 24FPS. Last frame is a slip of paper "THE END". The whole video is accompanied by calm smooth music.

Complexe ideeën gevisualiseerd. Omni kan overtuigende uitlegvideo’s maken van korte prompts door visuals te genereren waarin complexere concepten worden uitgesplitst.

Prompt: claymation explainer of protein folding, everything is made out of clay, no hands, stop motion, accurate

Maak video’s van elke combinatie van invoer

Gebruik elk soort referentiemateriaal. Omni maakt van elk referentiemateriaal eenduidige, samenhangende uitvoer, of je nu afbeeldingen, tekst, video of audio invoert. Momenteel wordt alleen stemgeluid als audiomateriaal ondersteund, maar binnenkort rollen we ook andere typen audio uit.

Begin met wat je hebt. Met referentiemateriaal als invoer kun je afbeeldingen van personages, scènes of tekeningen gebruiken om video’s te maken die aansluiten bij je visie.

Pas stijlen, beweging en effecten toe. Bepaal de visuele taal die je wilt overbrengen door referentiemateriaal als invoer te gebruiken, of beschrijf wat je wilt in natuurlijke taal. Omni combineert de gegeven referenties om een samenhangend videofragment te maken.

Maak video’s met je eigen digitale avatar

We verwachten dat de mogelijkheid om audio en spraak aan te passen een van de meest voorkomende verzoeken voor videobewerking zal zijn. We werken eraan om deze functie beter te testen en te achterhalen hoe we die op een verantwoorde manier naar gebruikers kunnen uitrollen. Om te beginnen kun je video’s maken met daarin je eigen stem door je eigen AI-avatar te gebruiken. Avatars maken een digitale versie van jezelf, zodat je video’s kan genereren die eruitzien en klinken zoals jij.

Alle video’s die met Omni worden gemaakt, bevatten ons onzichtbare, digitale SynthID-watermerk en C2PA Content Credentials. Via de Gemini-app, Gemini in Chrome en Google Zoeken kun je makkelijk verifiëren dat video’s gemaakt zijn met Gemini Omni. In onze blogpost vind je meer over hoe we onze transparantie over content en verificatietools uitbreiden, zodat je kunt nagaan hoe content op het web is gemaakt en bewerkt.

Probeer Omni vandaag nog

Vanaf vandaag kunnen alle abonnees van Google AI Pro en Ultra wereldwijd Gemini Omni Flash gebruiken via de Gemini-app en Google Flow. Het model wordt vanaf deze week ook kosteloos uitgerold naar gebruikers op YouTube Shorts en de YouTube Create-app.

Verder gaan we het model de komende weken ook via API’s uitrollen naar ontwikkelaars en zakelijke klanten.

Get the latest news from Google in your inbox

Sign up for our newsletters with product updates, event information, special offers, and more.

Your information will be used in accordance with Google's privacy policy. You may opt out at any time.