Beobachtetes Signal · 16. Sept. 2026 · Product Launch · Quelle: OnlineMarketing.de · Relevanz: 4/5 · Sentiment: Positiv

Google launcht Gemini 3.8 Live und Extended Thinking Audiomodelle

Zusammenfassung des Signals

Google hat zwei neue KI-Audiomodelle vorgestellt: Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking. Beide Modelle sind für latenzfreie Echtzeit-Konversationen sowie komplexe, mehrstufige Aufgaben konzipiert. Sie unterstützen die parallele Verarbeitung von Sprache, visuellen Inputs und Function Calls, was unterbrechungsfreie Interaktionen ermöglicht. Verfügbar sind die Modelle über die Gemini Live API und Google AI Studio zu Preisen von 0,005 US-Dollar pro Minute für Audio-Input und 0,018 US-Dollar für Output. Während Gemini 3.8 Live in Search Live für kamerabasierte Interaktionen integriert wird, richtet sich Extended Thinking an Google AI-Abonnenten in Gemini Live und Google Workspace (Docs, Gmail, Keep). Zur Sicherstellung der Transparenz versieht Google alle generierten Audiosignale mit einem SynthID-Wasserzeichen. Ergänzend stellte Google das Streaming-Speech-to-Text-Modell Gemini 3.5 Transcribe mit einer Word Error Rate von nur 4,0 % vor.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Der Rollout markiert einen wesentlichen Fortschritt in der Conversational AI und hat das Potenzial, Interaktionsparadigmen in Suche, Produktivitätsumgebungen und künftig auch AdTech-Schnittstellen grundlegend zu verändern.

SIGNAL RADAR

Marktsignale zu Google in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • Google führt Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking für latenzarme Sprachinteraktionen ein.
  • Gemini 3.8 Live unterstützt parallele Kamera- und Sprachverarbeitung, automatischen Wechsel zwischen 97 Sprachen sowie zeitgleiche API- und Tool-Aufrufe.
  • Gemini 3.8 Live Extended Thinking wird in Google Workspace integriert und erreicht 82,6 Punkte im Speech-to-Speech Quality Index.
  • Das API-Pricing liegt bei 0,005 USD/Minute für Input und 0,018 USD/Minute für Output.
  • Alle Audios werden mit SynthID-Wasserzeichen versehen; Gemini 3.5 Transcribe erzielt eine Word Error Rate von 4,0 %.

Verknüpfte Unternehmen

1 verknüpfte Unternehmen

“Google has introduced two new AI audio models, Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking....”

Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: OnlineMarketing.de•Veröffentlicht: 16. Sept. 2026
Ursprünglicher Berichttitel: “Google: 2 neue Gemini-Audiomodelle für Live-Gespräche und komplexe Aufgaben”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

AI & Technology25. Sept. 2026

Google launcht Gemini 3.8 Live mit Echtzeit-Avataren für Enterprise-Kunden

Google hat Gemini 3.8 Live mit einer neuen Live-Avatar-Funktion für Unternehmenskunden vorgestellt. Die Technologie kombiniert Sprachdialoge mit nahezu in Echtzeit generiertem Video, wodurch digitale Assistenten eine animierte visuelle Präsenz erhalten. Das Feature ist ab sofort über Gemini Enterprise verfügbar und verarbeitet Audio- sowie visuelle Inputs simultan, um Sprache, Mimik und Lippenbewegungen digitaler Avatare zu steuern. Die Lösung unterstützt native Speech-to-Speech-Kommunikation in 97 Sprachen, wobei Lippen-Synchronität und Gesichtsausdrücke dynamisch angepasst werden. Google positioniert die Technologie primär für Customer Service, Beratung und interaktive digitale Begleitung. Unternehmen können anhand von Referenzbildern eigene Custom-Avatare erstellen (zunächst via Allowlist). Sämtliche Outputs werden zur Authentizitätsprüfung mit SynthID-Wasserzeichen versehen. Zudem erlaubt das System die asynchrone Tool-Ausführung während laufender Konversationen, um komplexe Geschäftsprozesse ohne Dialogunterbrechung zu steuern.

Signal analysieren
Large Language Models (LLM) & AI19. Nov. 2025

Google Gemini 3 stärkt KI-Fähigkeiten in Suche und App-Ökosystem

Google hat Gemini 3 vorgestellt, sein neuestes KI-Modell, das direkt in die Gemini-App integriert und im AI-Mode der Google-Suche aktiviert wird. Das Modell bietet multimodales Verständnis, nuancierte Antworten sowie generative Layouts, ergänzt durch agentische Fähigkeiten für mehrstufige Aufgaben und Coding. Flankiert wird der Launch von der neuen Plattform Antigravity für „Vibe Coding“, die autonome Agenten-Aktionen und Workflows auf App-Ebene ermöglicht. Entwickler erhalten Zugriff über Google AI Studio, Vertex AI, Gemini CLI und Antigravity. Die Veröffentlichung forciert die tiefe Integration über Google-Dienste wie Maps, Canvas und Chrome hinweg. Google verweist auf eine Reichweite von 650 Millionen monatlich aktiven Nutzern sowie 13 Millionen Entwicklern. Der Rollout startet für Pro/Ultra-Nutzer in den USA, während Deutschland zu einem späteren Zeitpunkt folgt. Google positioniert Gemini 3 als zentralen Schritt im Wettbewerb gegen OpenAI, Meta und Anthropic.

Signal analysieren
Large Language Models & AI5. Aug. 2026

Google erweitert Gemini Notebook um sichtbare Denkschritte

Google hat NotebookLM in Gemini Notebook umbenannt und zu einem integrierten Recherche-Workspace ausgebaut, der die Gemini App, Google Search und Google Workspace vernetzt. Zu den neuen Funktionen für Abonnenten von Google AI Ultra und Pro gehören expandierbare Denkschritte zur Transparenz des Modellverhaltens, die Ausführung von Code direkt im Notebook sowie bewährte zitierbasierte Ausgabeformate wie Audio Overviews und Mind Maps. Die Rollout-Phase erfolgt stufenweise, beginnend mit Ultra-Kunden und gefolgt von der Web-Verfügbarkeit für Pro-Nutzer sowie einer späteren Expansion auf mobile Endgeräte. Google betont, dass hochgeladene Quellen vertraulich behandelt und nicht zum Training der Modelle verwendet werden. Die neuen Denkschritte werden als experimentelles Hilfsmittel zur Überprüfung eingestuft, nicht als absoluter Korrektheitsbeweis. Diese Produktentwicklung stärkt die plattformübergreifende KI-Integration und beeinflusst enterprise KI-Workflows sowie datenschutzkonforme Analyseprozesse.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.