Google heeft de eerste resultaten vrijgegeven van ontwikkelaars die met Gemini Omni Flash werken, het eerste model uit de nieuwe Omni-familie. Omni maakt het mogelijk om video’s te genereren en bewerken met gesproken of getypte instructies. Het model combineert begrip van natuurkunde met Gemini’s kennis van de echte wereld, wat realistischere output oplevert dan eerdere generatoren.

Vijf bouwers lieten zien wat er mogelijk is. Leon Lin filmde een vrouw in een stad vanuit twintig verschillende camerastandpunten die Omni allemaal vloeiend genereerde. Carlos Santana veranderde een buitenscène met zijn stem: dag werd nacht, bomen kregen herfstbladeren en de grond vulde zich met sneeuw. In Google Flow zette een ontwikkelaar schetsen om in bewegende objecten: een citroen werd een onderzeeer, een kop espresso een heteluchtballon.

Andere voorbeelden laten zien hoe Omni visuele stijlen kan mengen: een video verschuift van live-action naar anime naar claymation zonder de beweging te onderbreken. Het team van Hyperagent gebruikte Omni om lege parken te vullen met landschapsontwerp, dashboards te visualiseren met een animatiefiguur en todo-lijsten om te zetten in een spelletje. Gemini Omni is beschikbaar in de Gemini-app, Google Flow, Google AI Studio en via de Gemini API.