
Google DeepMind startet Gemini Omni 1.1 Flash mit erweiterter Videokontrolle
Gemini Omni 1.1 Flash ist das erste produktionsreife Update der Omni-Reihe von Google DeepMind und richtet sich explizit an Entwickler, die generative Video-Workflows, kreative Tools oder Medien-Editing-Software bauen. Ein zentrales Feature ist die verbesserte Szenen-Extension: Das Modell analysiert nun bis zu 10 Sekunden vorheriger Kontext – gegenüber nur einer Sekunde bei Vorgängermodellen – und ermöglicht dadurch deutlich konsistentere visuelle Fortsetzungen und kohärentere Narration. Videos lassen sich in 10-Sekunden-Schritten auf insgesamt 40 Sekunden verlängern. Die First/Last-Frame-Interpolation erlaubt es, Keyframes zu Beginn und Ende eines Clips festzulegen, sodass das Modell dazwischen cinematische Bewegungen wie Dolly-Zooms, 360-Grad-Orbitalschwenks oder nahtlose Loop-Übergänge generiert. Für schnelles und kostengünstiges Prototyping können Entwickler zunächst 360p-Vorschauversionen erzeugen und erst den finalen Output auf 4K hochskalieren. Der Zugang erfolgt über die Gemini API in Google AI Studio sowie die Gemini Enterprise Agent Platform. Die Produktmanager Anish Nangia und Alisa Fortin von Google DeepMind verantworten das Release.
- Kontextfenster für Szenen-Extension: Omni 1.1 liest bis zu 10 Sekunden Prior-Video – 10× mehr als der direkte Vorgänger (1 Sekunde).
- Erweiterung erfolgt iterativ in 10-Sekunden-Schritten, maximal bis zu einer kumulierten Gesamtlänge von 40 Sekunden.
- API-Zugriff über das Python-SDK mit `client.interactions.create()` und Parameter `previous_interaction_id` für nahtlose Szenenfortsetzung.
- 360p-Preview-Modus als explizite Kostenspar-Option vor dem finalen 4K-Upscaling-Schritt.
- Verfügbar sowohl über Google AI Studio als auch über die Gemini Enterprise Agent Platform.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge

Google DeepMind startet Gemini Omni 1.1 Flash mit erweiterter Videokontrolle
Gemini Omni 1.1 Flash ist das erste produktionsreife Update der Omni-Reihe von Google DeepMind und richtet sich explizit an Entwickler, die generative Video-Workflows, kreative Tools oder Medien-Editing-Software bauen. Ein zentrales Feature ist die verbesserte Szenen-Extension: Das Modell analysiert nun bis zu 10 Sekunden vorheriger Kontext – gegenüber nur einer Sekunde bei Vorgängermodellen – und ermöglicht dadurch deutlich konsistentere visuelle Fortsetzungen und kohärentere Narration. Videos lassen sich in 10-Sekunden-Schritten auf insgesamt 40 Sekunden verlängern. Die First/Last-Frame-Interpolation erlaubt es, Keyframes zu Beginn und Ende eines Clips festzulegen, sodass das Modell dazwischen cinematische Bewegungen wie Dolly-Zooms, 360-Grad-Orbitalschwenks oder nahtlose Loop-Übergänge generiert. Für schnelles und kostengünstiges Prototyping können Entwickler zunächst 360p-Vorschauversionen erzeugen und erst den finalen Output auf 4K hochskalieren. Der Zugang erfolgt über die Gemini API in Google AI Studio sowie die Gemini Enterprise Agent Platform. Die Produktmanager Anish Nangia und Alisa Fortin von Google DeepMind verantworten das Release.
- Kontextfenster für Szenen-Extension: Omni 1.1 liest bis zu 10 Sekunden Prior-Video – 10× mehr als der direkte Vorgänger (1 Sekunde).
- Erweiterung erfolgt iterativ in 10-Sekunden-Schritten, maximal bis zu einer kumulierten Gesamtlänge von 40 Sekunden.
- API-Zugriff über das Python-SDK mit `client.interactions.create()` und Parameter `previous_interaction_id` für nahtlose Szenenfortsetzung.
- 360p-Preview-Modus als explizite Kostenspar-Option vor dem finalen 4K-Upscaling-Schritt.
- Verfügbar sowohl über Google AI Studio als auch über die Gemini Enterprise Agent Platform.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.