
Googles multimodales KI-Modell für Video
Gemini Omni ist eine neue Modellfamilie von Google, die Text, Bild, Audio und Video in einem einzigen Prompt verarbeitet und daraus Video erzeugt. Google stellte das Modell am 19. Mai 2026 auf der Entwicklerkonferenz Google I/O vor. Das erste verfügbare Modell heisst Gemini Omni Flash und ist seit dem Launchtag live in der Gemini App, in Google Flow sowie kostenlos in YouTube Shorts Remix und YouTube Create. Die Clips sind aktuell auf zehn Sekunden begrenzt, und zwar bewusst als Rollout-Entscheidung, nicht aufgrund einer technischen Grenze. Für Marketingteams ist das relevant, weil schnelle, kostengünstige Videovarianten direkt verfügbar werden — mit klaren Einschränkungen bei Länge und Audiobearbeitung, die man kennen sollte.



