Beobachtetes Signal · 11. Mai 2026 · Technical Release · Quelle: onlinemarketing.de · Relevanz: 4/5 · Sentiment: Positiv
Google testet multimodales Videomodell Gemini Omni in der App
Berichten zufolge testet Google ein neues multimodales Videomodell namens Gemini Omni direkt in der Gemini App. Nutzer und Fachportale wie TestingCatalog entdeckten UI-Strings und Testläufe, die darauf hindeuten, dass Omni als Option in Verbindung mit Gemini Flash angeboten werden könnte. Dies würde es Anwendern ermöglichen, Videoclips direkt im Chat zu bearbeiten und zu remixen. Erste Beobachtungen zeigen eine starke Prompt-Umsetzung, eine verbesserte Tonqualität sowie automatisierte Hintergrundmusik, wobei Testguthaben allerdings schnell verbraucht wurden. Spekulationen zufolge kombiniert Gemini Omni Fähigkeiten von Googles Veo 3.1 und Nano Banana 2. Eine offizielle Ankündigung seitens Google steht noch aus; Branchenbeobachter spekulieren auf eine Enthüllung im Rahmen der Google I/O im Mai 2026. Der Artikel erschien ursprünglich am 11. Mai 2026 auf OnlineMarketing.de.
Die Integration eines leistungsstarken Video-Modells direkt in den Chat verändert kreative Workflows im MarTech-Bereich fundamental, bindet Creator und Marketer enger an das Google-Ökosystem und wird durch eine mögliche Google-I/O-Präsentation hochrelevant für die Branche.
Marktsignale zu Google in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Google testet Berichten zufolge ein multimodales Videomodell namens Gemini Omni in der Gemini App.
- Nutzer und TestingCatalog entdeckten UI-Strings, die Omni als Option bei der Nutzung von Gemini Flash anzeigen.
- Frühe Tests zeigen, dass Omni Videos im Chat bearbeiten, präzise auf Prompts reagieren und verbesserte Audio-Features liefern kann.
- Branchenbeobachter vermuten eine Kombination aus Googles Veo 3.1 und Nano Banana 2.
- Eine offizielle Bestätigung gab es bis zum 11. Mai 2026 nicht; eine Präsentation zur Google I/O im Mai 2026 gilt als möglich.
Verknüpfte Unternehmen
2 verknüpfte UnternehmenOntologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Google startet Gemini Omni: KI-Videoediting direkt im Chat
Google hat auf der I/O 2026 Gemini Omni vorgestellt, ein multimodales generatives KI-Videomodell, mit dem Nutzer Videos direkt im Gemini Chat über Spracheingaben bearbeiten, erweitern und remixen können. Das System vereint Text-, Bild-, Audio- und Videoverständnis in einer einzigen Architektur. Das erste Modell, Gemini Omni Flash, wird weltweit für Abonnenten von Google AI Plus, Pro und Ultra über die Gemini App sowie Google Flow ausgerollt und zudem kostenlos in YouTube Shorts und YouTube Create integriert. Entwickler und Unternehmenskunden sollen in den kommenden Wochen API-Zugriff erhalten. Erste Tests und Berichte über Plattformen wie Reddit und TestingCatalog verweisen auf präzise Befehlsausführung und eine verbesserte Audioqualität im Vergleich zu früheren Veo-Modellen. Die Innovation verändert die kreativen Workflows sowie die Toolchains für Creator und Marken im Bereich der Content-Produktion nachhaltig.
Google launcht Gemini Omni 1.1 Flash für KI-Videogenerierung
Google hat Gemini Omni 1.1 Flash veröffentlicht, ein aktualisiertes KI-Videomodell mit erweiterten Funktionen wie 4K-Upscaling, Szenenerweiterung, präziser Start- und End-Frame-Kontrolle sowie optimierter Unterstützung von Referenzvideos. Das Modell ist über die Gemini API, die Agent Platform API und das Google AI Studio verfügbar; Abonnenten von Ultra, Plus und Pro erhalten zudem Zugriff über Google Flow und die Gemini-App. Gemini Omni 1.1 Flash kann Videos in 10-Sekunden-Schritten auf bis zu 40 Sekunden verlängern und nutzt dabei bis zu 10 Sekunden Kontext der vorherigen Szenen. Zudem ermöglichen bis zu dreisekündige Referenzvideos eine konsistente Darstellung von Charakteren und Bewegungen. Das Preismodell skaliert nach Ausgabeauflösung von 360p bis 4K, ergänzt durch kostengünstige Preview-Renderings zur Reduzierung der Prototyping-Kosten.
Google präsentiert Gemini 3.5, Omni und KI-Agenten Gemini Spark
Auf der Google I/O am 19. Mai 2026 kündigte Google umfassende Updates für sein KI-Ökosystem an, darunter Gemini 3.5 Flash, Gemini 3.5 Pro, den Agenten Gemini Spark sowie das World Model Omni. Gemini 3.5 Flash ist ein leichtgewichtiges Modell, das Spitzenleistung zu einem Bruchteil der Kosten vergleichbarer Frontier-Modelle bieten soll und zum Standard in der Gemini-App sowie im KI-Modus der Google-Suche wird. Gemini Spark ist ein Beta-Agent, der anwendungsübergreifend agiert und zunächst für Tester sowie Google AI Ultra-Abonnenten verfügbar ist. Omni fungiert als multimodales World Model zur Simulation physischer Umgebungen sowie zur Erstellung und Bearbeitung von Kurzvideos in Produkten wie YouTube Shorts und Google Flow. Mit diesen Releases positioniert sich Google im direkten Wettbewerb mit OpenAI und Anthropic bei Foundation Models und agentischen KI-Diensten.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
