Beobachtetes Signal · 24. Juni 2026 · Product Launch · Quelle: OpenAI Blog · Relevanz: 4/5 · Sentiment: Positiv

OpenAI und Broadcom präsentieren Jalapeño-Inferenzchip für LLMs

Zusammenfassung des Signals

OpenAI und Broadcom haben Jalapeño vorgestellt, einen auf LLM-Inferenz optimierten Beschleuniger, der als erster „Intelligence Processor“ von OpenAI bezeichnet wird. Die gemeinsam mit Broadcom und Celestica entwickelte Hardware wurde von Grund auf für moderne sowie zukünftige LLM-Inferenz konzipiert und mithilfe von OpenAI-Modellen in nur neun Monaten vom Design zum Tape-out geführt. Erste Engineering-Samples laufen im Labor mit ML-Workloads wie GPT‑5.3‑Codex‑Spark. Laut internen Tests übertrifft die Performance pro Watt den aktuellen Branchenstandard deutlich; ein detaillierter technischer Bericht soll folgen. Ab 2026 planen die Partner gigawattgroße Deployments mit Rechenzentrumspartnern wie Microsoft, um die Inferenzkosten sowie Latenzen zu senken und die Zuverlässigkeit für interaktive LLM-Produkte im großen Maßstab zu verbessern.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Die Ankündigung eines maßgeschneiderten LLM-Inferenzbeschleunigers mit erheblich besserer Energieeffizienz und geplanten Gigawatt-Deployments kann die Inferenzkosten senken, die Infrastruktur-Beschaffung verändern und die Ökonomie sowie Verfügbarkeit KI-gestützter Produkte branchenweit beeinflussen.

SIGNAL RADAR

Marktsignale zu OpenAI in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • OpenAI und Broadcom haben Jalapeño enthüllt, den ersten für LLM-Inferenz optimierten „Intelligence Processor“-Beschleuniger von OpenAI.
  • Jalapeño wurde gemeinsam mit Broadcom und Celestica entwickelt und in neun Monaten vom Design zum Tape-out geführt.
  • Engineering-Samples von Jalapeño verarbeiten im Labor bereits ML-Workloads mit Ziel-Taktfrequenz und -Leistung, darunter GPT‑5.3‑Codex‑Spark.
  • Ersten Tests zufolge liefert Jalapeño eine substanziell bessere Performance pro Watt als der aktuelle State-of-the-Art; ein technischer Bericht folgt.
  • Die Partner planen ab 2026 mehrgenerationale Deployments im Gigawatt-Maßstab zusammen mit Rechenzentrumspartnern wie Microsoft.

Verknüpfte Unternehmen

3 verknüpfte Unternehmen

“OpenAI and Broadcom (NASDAQ: AVGO) today unveiled Jalapeño, OpenAI’s first Intelligence Processor: an accelerator architected around OpenAI’...”

“OpenAI and Broadcom (NASDAQ: AVGO) today unveiled Jalapeño, OpenAI’s first Intelligence Processor: an accelerator architected around OpenAI’...”

“By co-developing our industry-leading silicon directly with OpenAI, we are enabling the deployment of gigawatt scale data centers with Micro...”

Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: OpenAI Blog•Veröffentlicht: 24. Juni 2026
Ursprünglicher Berichttitel: “OpenAI and Broadcom unveil LLM-optimized inference chip”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

Large Language Models (LLM) & AI24. Juni 2026

OpenAI präsentiert ersten eigenen Inference-Chip mit Broadcom

OpenAI hat mit dem gemeinsam mit Broadcom entwickelten Jalapeño seinen ersten maßgeschneiderten Inference-Prozessor vorgestellt. Der Chip wurde speziell für Inference-Workloads konzipiert; laut OpenAI belegen frühe Tests eine deutlich bessere Performance-per-Watt im Vergleich zu gängigen Alternativen. Bei der Entwicklung setzte das Unternehmen demnach auf die Unterstützung eigener KI-Modelle. Die bereits im Oktober angekündigte Partnerschaft gilt als strategischer Schritt, um die Abhängigkeit von Nvidia GPUs bei der Inferenz zu verringern, während rechenintensivere Aufgaben wie das Pre-Training voraussichtlich weiterhin auf bestehender GPU-Hardware laufen. OpenAI positioniert den neuen Chip als Teil einer umfassenderen Strategie zur Optimierung des gesamten Stacks – von der Chip-Architektur bis hin zu Deployment-Systemen –, um den Betrieb von KI-Modellen schneller, zuverlässiger und kostengünstiger zu gestalten.

Signal analysieren
Large Language Models (LLM) & AI24. Juni 2026

OpenAI and Broadcom Reveal Jalapeño AI Chip

OpenAI and Broadcom publicly unveiled Jalapeño, their first jointly developed custom AI inference accelerator, positioning it as an “Intelligence Processor” designed to improve performance‑per‑watt and lower token costs for large language model inference. Broadcom has already delivered engineering silicon to OpenAI; Broadcom CEO Hock Tan expects initial deployment late 2026, a ramp in 2027 and full-scale deployment in 2028. The announcement arrives as Broadcom shares have fallen sharply since early June, and follows market reports that hyperscalers (Alphabet, ByteDance) are exploring additional chip design partners to diversify supply. OpenAI’s Greg Brockman emphasized Jalapeño is complementary to, not a replacement for, GPU-based solutions from firms like Nvidia. The collaboration signals increased vertical integration by an AI provider and a potential pathway to reduce inference costs and diversify compute beyond dominant GPU suppliers.

Signal analysieren
Large Language Models (LLM) & AI25. Aug. 2026

OpenAI’s Jalapeño Chip Shows Leading Inference Efficiency

OpenAI revealed Jalapeño — its first custom inference ASIC and rack-scale platform co-developed with Broadcom and Celestica and shown at Hot Chips — with A0 engineering samples taped out Nov 2025. The compute die uses TSMC N3P, MXFP numeric formats and HBM4 (15.4 TB/s per package); package TDP is ~700 W with sustained test power ≲ ~550 W. The rack design keeps model state (KV cache) local, simplifies on-node fabric and can scale to 2,048 XPUs. OpenAI and SemiAnalysis/InferenceX benchmarks report substantial performance-per-watt and latency gains (and partial advantages vs Nvidia GB300), but results are not independently verified and did not include Nvidia Vera Rubin. OpenAI targets small-volume deployment end‑2026 and broader ramp in 2027, pursuing a multi‑vendor production strategy while production economics, yield and fleet reliability remain unproven.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.