Beobachtetes Signal · 21. Juli 2026 · Product Launch · Quelle: CNBC Technology · Relevanz: 4/5 · Sentiment: Positiv
Google erweitert Gemini-Portfolio um kostengünstigere Modelle
Google DeepMind hat drei neue Gemini-Modelle veröffentlicht – Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber –, die speziell für die Entwicklung und Ausführung von KI-Agenten konzipiert wurden und signifikante Verbesserungen bei Effizienz, Latenz und Zuverlässigkeit bieten. Gemini 3.6 Flash fungiert als Arbeitstier, verbraucht rund 17 Prozent weniger Token als der Vorgänger und steigert die Leistung bei Coding, Multimodalität und Knowledge-Work. Flash-Lite richtet sich an kostenintensive Workloads mit hohem Volumen, während Flash-Cyber auf das Erkennen und Schließen von Sicherheitslücken spezialisiert ist und zunächst exklusiv für Behörden und ausgewählte Partner verfügbar ist. Zudem testet Google Gemini 3.5 Pro, entwickelt spezialisierte Chips zur Leistungssteigerung und hat das Pretraining für Gemini 4 gestartet.
Modelllaunches von Google beeinflussen direkt die Preisstrukturen im KI-Markt, die Wettbewerbsposition gegenüber OpenAI, Anthropic und chinesischen Rivalen sowie die Wirtschaftlichkeit von AI-Serving-Infrastrukturen.
Marktsignale zu Google in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Google hat drei neue Gemini-Modelle vorgestellt: 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber.
- Gemini 3.6 Flash reduziert den Token-Verbrauch um rund 17 Prozent und optimiert die Performance bei Coding sowie multimodalen Aufgaben.
- Gemini 3.5 Flash-Lite positioniert sich als schnellste und kosteneffizienteste Option für Workloads mit hohem Datenvolumen.
- Gemini 3.5 Flash Cyber wurde zur Erkennung und Behebung von Sicherheitslücken entwickelt und startet als limitiertes Pilotprojekt für Behörden und Partner.
- Google testet Gemini 3.5 Pro, entwickelt eigene KI-Chips und bereitet die nächste Generation Gemini 4 im Pretraining vor.
Verknüpfte Unternehmen
7 verknüpfte Unternehmen“Google is also launching Gemini 3.6 Flash, which improves coding, multimodal and knowledge-work performance while using up to 17% fewer toke...”
“Alphabet is releasing three new Gemini models on Tuesday, including its clearest answer yet to Anthropic’s lead in cybersecurity, as the com...”
“A Google Cloud spokesperson told CNBC in a statement that its teams are 'constantly researching and experimenting with new innovations to de...”
“The new model could help Google narrow its cybersecurity gap with Anthropic, which has built an early lead in automated code defense with it...”
“Artificial Analysis data shows Gemini Flash already undercuts comparable models from Anthropic, OpenAI and Chinese rivals on cost....”
“Moonshot AI’s Kimi K3 drew enough demand that the company limited new subscriptions and API access because of capacity constraints....”
“Alibaba is teasing Qwen 3.8 Max, which it said trails only Anthropic’s Fable 5 in overall performance....”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Google lanciert Gemini 3.8 Flash und spezialisierte Cyber-KI-Modelle
Google hat am 3. September 2026 die Modelle Gemini 3.8 Flash und Gemini 3.8 Flash Cyber veröffentlicht, die auf demselben Foundation Model basieren. Flash ist auf Coding, Reasoning und AI Agents optimiert, während Flash Cyber auf defensive Cybersecurity und Vulnerability Patching spezialisiert ist. Die Modelle führen den HLE-Verified-Benchmark mit 54,9 % an; Flash Cyber erreicht 86,2 % im Cybergym und schlägt damit GPT-5.5 Cyber. Die Preisgestaltung liegt bei 0,75 US-Dollar pro Million Input-Token und 3,75 US-Dollar pro Million Output-Token bis Ende 2026, bevor sie sich 2027 verdoppelt – womit Konkurrenten wie OpenAI und Anthropic unterboten werden. Der Cyber-Zugang ist über das Fairwind Program streng limitiert, unter anderem für Partner wie CrowdStrike und Snowflake sowie Behörden. Die Integration erfolgt über alle Google-Plattformen.
Gemini 3.1 Flash-Lite veröffentlicht: Schneller und kosteneffizienter
Google hat Gemini 3.1 Flash-Lite vorgestellt, eine besonders kosteneffiziente Modellvariante für maximale Geschwindigkeit und Unternehmenseinsätze. Das Modell arbeitet laut Google 2,5-mal schneller als Gemini 2.5 Flash und bietet eine um 45 Prozent höhere Ausgabegeschwindigkeit bei Preisen von 0,25 USD pro Million Input-Token und 1,50 USD pro Million Output-Token. Zu den Kernfunktionen gehören dynamische Thinking Levels zur flexiblen Steuerung der Analysetiefe. Gemini 3.1 Flash-Lite ist ab sofort als Vorschau über die Gemini API in Google AI Studio sowie für Enterprise-Kunden auf Vertex AI verfügbar. In Benchmarks wie GPQA Diamond erreichte das Modell rund 86,9 Prozent. Google demonstriert praxisnahe Einsatzszenarien von Übersetzung und Content-Moderation bis hin zu CRM-Prozessen, darunter einen Retail Business Agent für automatisierte Reportings und Dashboards.
Google macht Gemini 3 Flash zum Standardmodell für den AI Mode
Google hat Gemini 3 Flash als neues Standardmodell für die Gemini App, den AI Mode in der Google Suche sowie assoziierte AI-Workflows vorgestellt. Das Modell fokussiert sich primär auf Geschwindigkeit sowie operative Effizienz und führt neue Funktionen wie Agent CC für Gmail und einen Disco Browser ein. Im Vergleich zu Gemini 2.5 verarbeitet Gemini 3 Flash Anfragen dreimal schneller und benötigt durchschnittlich rund 30 % weniger Tokens bei einer signifikant reduzierten Output-Latenz. In Benchmarks erzielt das Modell einen Score von 33,7 % bei „Humanity’s Last Exam“. Die API-Kosten liegen bei etwa 0,50 US-Dollar pro Million Input-Tokens und 3,00 US-Dollar pro Million Output-Tokens. Der weltweite Enterprise-Rollout erfolgt über Vertex AI und Gemini Enterprise, während Developer Zugriff über die Gemini API in Google AI Studio, Gemini CLI und Google Antigravity erhalten.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
