Beobachtetes Signal · 16. Sept. 2026 · Product Launch · Quelle: OnlineMarketing.de · Relevanz: 4/5 · Sentiment: Positiv
Google launcht Gemini 3.8 Live und Extended Thinking Audiomodelle
Google hat zwei neue KI-Audiomodelle vorgestellt: Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking. Beide Modelle sind für latenzfreie Echtzeit-Konversationen sowie komplexe, mehrstufige Aufgaben konzipiert. Sie unterstützen die parallele Verarbeitung von Sprache, visuellen Inputs und Function Calls, was unterbrechungsfreie Interaktionen ermöglicht. Verfügbar sind die Modelle über die Gemini Live API und Google AI Studio zu Preisen von 0,005 US-Dollar pro Minute für Audio-Input und 0,018 US-Dollar für Output. Während Gemini 3.8 Live in Search Live für kamerabasierte Interaktionen integriert wird, richtet sich Extended Thinking an Google AI-Abonnenten in Gemini Live und Google Workspace (Docs, Gmail, Keep). Zur Sicherstellung der Transparenz versieht Google alle generierten Audiosignale mit einem SynthID-Wasserzeichen. Ergänzend stellte Google das Streaming-Speech-to-Text-Modell Gemini 3.5 Transcribe mit einer Word Error Rate von nur 4,0 % vor.
Der Rollout markiert einen wesentlichen Fortschritt in der Conversational AI und hat das Potenzial, Interaktionsparadigmen in Suche, Produktivitätsumgebungen und künftig auch AdTech-Schnittstellen grundlegend zu verändern.
Marktsignale zu Google in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Google führt Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking für latenzarme Sprachinteraktionen ein.
- Gemini 3.8 Live unterstützt parallele Kamera- und Sprachverarbeitung, automatischen Wechsel zwischen 97 Sprachen sowie zeitgleiche API- und Tool-Aufrufe.
- Gemini 3.8 Live Extended Thinking wird in Google Workspace integriert und erreicht 82,6 Punkte im Speech-to-Speech Quality Index.
- Das API-Pricing liegt bei 0,005 USD/Minute für Input und 0,018 USD/Minute für Output.
- Alle Audios werden mit SynthID-Wasserzeichen versehen; Gemini 3.5 Transcribe erzielt eine Word Error Rate von 4,0 %.
Verknüpfte Unternehmen
1 verknüpfte Unternehmen“Google has introduced two new AI audio models, Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking....”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Google launcht Gemini 3.8 Live mit Echtzeit-Avataren für Enterprise-Kunden
Google hat Gemini 3.8 Live mit einer neuen Live-Avatar-Funktion für Unternehmenskunden vorgestellt. Die Technologie kombiniert Sprachdialoge mit nahezu in Echtzeit generiertem Video, wodurch digitale Assistenten eine animierte visuelle Präsenz erhalten. Das Feature ist ab sofort über Gemini Enterprise verfügbar und verarbeitet Audio- sowie visuelle Inputs simultan, um Sprache, Mimik und Lippenbewegungen digitaler Avatare zu steuern. Die Lösung unterstützt native Speech-to-Speech-Kommunikation in 97 Sprachen, wobei Lippen-Synchronität und Gesichtsausdrücke dynamisch angepasst werden. Google positioniert die Technologie primär für Customer Service, Beratung und interaktive digitale Begleitung. Unternehmen können anhand von Referenzbildern eigene Custom-Avatare erstellen (zunächst via Allowlist). Sämtliche Outputs werden zur Authentizitätsprüfung mit SynthID-Wasserzeichen versehen. Zudem erlaubt das System die asynchrone Tool-Ausführung während laufender Konversationen, um komplexe Geschäftsprozesse ohne Dialogunterbrechung zu steuern.
Google Gemini 3 stärkt KI-Fähigkeiten in Suche und App-Ökosystem
Google hat Gemini 3 vorgestellt, sein neuestes KI-Modell, das direkt in die Gemini-App integriert und im AI-Mode der Google-Suche aktiviert wird. Das Modell bietet multimodales Verständnis, nuancierte Antworten sowie generative Layouts, ergänzt durch agentische Fähigkeiten für mehrstufige Aufgaben und Coding. Flankiert wird der Launch von der neuen Plattform Antigravity für „Vibe Coding“, die autonome Agenten-Aktionen und Workflows auf App-Ebene ermöglicht. Entwickler erhalten Zugriff über Google AI Studio, Vertex AI, Gemini CLI und Antigravity. Die Veröffentlichung forciert die tiefe Integration über Google-Dienste wie Maps, Canvas und Chrome hinweg. Google verweist auf eine Reichweite von 650 Millionen monatlich aktiven Nutzern sowie 13 Millionen Entwicklern. Der Rollout startet für Pro/Ultra-Nutzer in den USA, während Deutschland zu einem späteren Zeitpunkt folgt. Google positioniert Gemini 3 als zentralen Schritt im Wettbewerb gegen OpenAI, Meta und Anthropic.
Google erweitert Gemini Notebook um sichtbare Denkschritte
Google hat NotebookLM in Gemini Notebook umbenannt und zu einem integrierten Recherche-Workspace ausgebaut, der die Gemini App, Google Search und Google Workspace vernetzt. Zu den neuen Funktionen für Abonnenten von Google AI Ultra und Pro gehören expandierbare Denkschritte zur Transparenz des Modellverhaltens, die Ausführung von Code direkt im Notebook sowie bewährte zitierbasierte Ausgabeformate wie Audio Overviews und Mind Maps. Die Rollout-Phase erfolgt stufenweise, beginnend mit Ultra-Kunden und gefolgt von der Web-Verfügbarkeit für Pro-Nutzer sowie einer späteren Expansion auf mobile Endgeräte. Google betont, dass hochgeladene Quellen vertraulich behandelt und nicht zum Training der Modelle verwendet werden. Die neuen Denkschritte werden als experimentelles Hilfsmittel zur Überprüfung eingestuft, nicht als absoluter Korrektheitsbeweis. Diese Produktentwicklung stärkt die plattformübergreifende KI-Integration und beeinflusst enterprise KI-Workflows sowie datenschutzkonforme Analyseprozesse.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
