Beobachtetes Signal · 20. Mai 2026 · Technical Release · Quelle: DEV Community · Relevanz: 4/5 · Sentiment: Positiv

Google DeepMind veröffentlicht Gemma 4 mit massivem Agentic-Sprung

Zusammenfassung des Signals

Google DeepMind hat Gemma 4 vorgestellt, was einen Paradigmenwechsel für Open-Weight-Modelle und deren agentische Tool-Nutzung markiert. Das dichte 31B-Modell erreicht 86,4 Prozent im τ2-bench Retail für agentische Tool-Nutzung im Vergleich zu 6,6 Prozent bei Gemma 3 27B, während eine 26B Mixture-of-Experts-Variante (MoE) 85.5 Prozent erzielt und dabei nur rund 3,8 Milliarden Parameter pro Forward Pass aktiviert. Gemma 4 führt natives Function Calling über Steuerungstoken, konfigurierbares Long-Form Reasoning sowie native System-Prompt-Unterstützung ein, wird unter der Apache 2.0-Lizenz bereitgestellt und ist über gängige Toolings wie Hugging Face, vLLM und Ollama verfügbar. Diese Veröffentlichung macht lokale, datenschutzkonforme und kosteneffiziente agentische Deployments deutlich praktikabler und fördert die breite Entwickleradoption.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Ein bedeutendes technisches Release von Google DeepMind mit Apache 2.0-Lizenz, das die agentische Tool-Nutzung massiv verbessert und praxisnahe, datenschutzkonforme sowie kosteneffiziente lokale AI-Deployments ermöglicht.

SIGNAL RADAR

Marktsignale zu Google DeepMind in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • Google DeepMind hat Gemma 4 am 2. April 2026 angekündigt.
  • Das dichte Gemma 4 31B-Modell erzielt 86,4 Prozent im τ2-bench Retail für agentische Tool-Nutzung; Gemma 3 27B erreichte hier lediglich 6,6 Prozent.
  • Die 26B MoE-Variante erreicht 85.5 Prozent im τ2-bench bei Aktivierung von ca. 3,8 Milliarden Parametern pro Forward Pass, erfordert jedoch das Laden aller 26B Parameter in den Arbeitsspeicher.
  • Gemma 4 führt natives Function Calling über dedizierte Steuerungstoken, konfigurierbares Long-Form Reasoning und native System-Prompt-Unterstützung ein.
  • Gemma 4 ist das erste Gemma-Release unter Apache 2.0 und erscheint als Modellfamilie (31B dense, 26B MoE, E4B 4B Edge mit nativem Audio und E2B 2B Edge).
Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: DEV Community•Veröffentlicht: 20. Mai 2026
Ursprünglicher Berichttitel: “Gemma 4 Didn't Just Get Smarter. It Became a Different Kind of Model. Here's What the Agentic Numbers Actually Mean.”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

Large Language Models (LLM) & AI14. Mai 2026

Gemma 4 ermöglicht agentische KI auf Consumer Devices

Diese Zusammenfassung der The Agent Factory-Episode mit Omar Sanseviero von Google DeepMind beleuchtet die Veröffentlichung und die Fähigkeiten von Gemma 4, einer Open-Model-Familie, die für die lokale Bereitstellung auf Geräten optimiert ist. Seit dem Start im vergangenen Monat verzeichnete Gemma 4 über 50 Millionen Downloads. Die Modellfamilie umfasst kleine, für Edge-Anwendungen optimierte Varianten (E2B & E4B), ein dichtes 31B-Modell sowie ein 26B Mixture-of-Experts-Modell (MoE). Google DeepMind hat Gemma 4 unter eine Apache 2-Lizenz gestellt, um kommerzielle Nutzung und lokales Fine-Tuning in regulierten oder luftisolierten Umgebungen zu ermöglichen. Demonstrationen zeigten Offline-Agenten-Workflows (lokaler Food-Tour-Agent, Android Skill Selection), autonome Python-Ausführungen einschließlich einer Physik-Simulation sowie Architekturentscheidungen wie per-layer Embeddings und Unterstützung für Vision-Modelle mit variablen Seitenverhältnissen.

Signal analysieren
Large Language Models (LLM) & AI3. Apr. 2026

Google DeepMind veröffentlicht multimodale Open-Weight-Modelle der Gemma-4-Familie

Google DeepMind hat Gemma 4 vorgestellt, eine neue Familie von Open-Weight-Modellen unter einer Apache-2.0-Lizenz mit nativer Unterstützung für Text, Vision und Audio. Das Line-up umfasst ein 31B-Dense-Modell, eine 26B-MoE-Variante sowie zwei Edge-fokussierte Modelle (E4B, E2B). Die großen Modelle unterstützen Kontextfenster von bis zu 256K Token und wurden für Agenten-Workflows sowie lokale Deployments optimiert. Erste Benchmarks zeigen eine starke Performance bei Reasoning und Token-Effizienz. Zudem gab es einen Day-0-Support in gängigen Serving-Stacks wie llama.cpp, Ollama, vLLM und LM Studio. Die Veröffentlichung markiert einen signifikanten Fortschritt für On-Device-Agents und Open-Agent-Architekturen.

Signal analysieren
Large Language Models (LLM) & AI23. Mai 2026

Google veröffentlicht Gemma 4: Open-Weight-LLMs für Edge und Cloud

Google hat im April 2026 Gemma 4 vorgestellt, eine Familie offener, multimodaler Large Language Models unter der Apache-2.0-Lizenz. Die vier Varianten E2B, E4B, 26B MoE und 31B ermöglichen die vollständige Offline-Ausführung auf lokalen Geräten wie Smartphones und Laptops. Die kleineren Modelle unterstützen ein Kontextfenster von 128.000 Token, während die größeren Varianten 256.000 Token bewältigen. Gemma 4 bietet erweiterte Funktionen wie Function Calling, agentenbasierte Workflows, multimodale Vision- und Audio-Eingaben sowie einen Thinking Mode für schrittweises Reasoning. Die Veröffentlichung legt den Fokus auf lokale, kostenfreie Inferenz ohne Cloud-Gebühren sowie auf maximale Datensouveränität für Entwickler. Dank gängiger Runtimes wie Ollama und LM Studio gestaltet sich die Bereitstellung unkompliziert. Architektonische Innovationen bei der Skalierung langer Kontexte ermöglichen eine effiziente On-Device-Inferenz für breite kommerzielle Anwendungen ohne laufende API-Kosten.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.