Beobachtetes Signal · 24. Juni 2026 · Product Launch · Quelle: techcrunch · Relevanz: 4/5 · Sentiment: Positiv

OpenAI präsentiert ersten eigenen Inference-Chip mit Broadcom

Zusammenfassung des Signals

OpenAI hat mit dem gemeinsam mit Broadcom entwickelten Jalapeño seinen ersten maßgeschneiderten Inference-Prozessor vorgestellt. Der Chip wurde speziell für Inference-Workloads konzipiert; laut OpenAI belegen frühe Tests eine deutlich bessere Performance-per-Watt im Vergleich zu gängigen Alternativen. Bei der Entwicklung setzte das Unternehmen demnach auf die Unterstützung eigener KI-Modelle. Die bereits im Oktober angekündigte Partnerschaft gilt als strategischer Schritt, um die Abhängigkeit von Nvidia GPUs bei der Inferenz zu verringern, während rechenintensivere Aufgaben wie das Pre-Training voraussichtlich weiterhin auf bestehender GPU-Hardware laufen. OpenAI positioniert den neuen Chip als Teil einer umfassenderen Strategie zur Optimierung des gesamten Stacks – von der Chip-Architektur bis hin zu Deployment-Systemen –, um den Betrieb von KI-Modellen schneller, zuverlässiger und kostengünstiger zu gestalten.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Die Einführung eines eigenen Inference-Chips durch eine führende KI-Plattform verändert die Ökonomie der KI-Infrastruktur sowie den Hardware-Wettbewerb, verringert die Abhängigkeit von Nvidia GPUs, senkt die Betriebskosten und beeinflusst die Strategien von Cloud-, Rechenzentrum- und KI-Dienstanbietern.

SIGNAL RADAR

Marktsignale zu OpenAI in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • OpenAI hat am 24.06.2026 seinen ersten maßgeschneiderten Inference-Prozessor namens Jalapeño vorgestellt.
  • Der Jalapeño-Chip wurde in Zusammenarbeit mit Broadcom entwickelt und gefertigt.
  • OpenAI setzte nach eigenen Angaben eigene KI-Modelle zur Unterstützung bei der Chip-Entwicklung ein.
  • Erste Tests zeigen laut Berichten eine signifikant bessere Performance-per-Watt als aktuelle State-of-the-Art-Alternativen.
  • Die Broadcom-Partnerschaft wurde im Oktober offiziell bekannt gegeben und soll die Abhängigkeit von Nvidia GPUs bei Inference-Workloads reduzieren.

Verknüpfte Unternehmen

5 verknüpfte Unternehmen

“On Wednesday, OpenAI unveiled its first custom-built inference processor, designed and manufactured in collaboration with Broadcom....”

“On Wednesday, OpenAI unveiled its first custom-built inference processor, designed and manufactured in collaboration with Broadcom....”

“The partnership was officially announced in October, but OpenAI’s chip plans have long been rumored as a way to reduce the company’s depende...”

“Google and Amazon have both built custom chips to serve a similar purpose, often called “AI accelerators” — silicon designed specifically to...”

“Google and Amazon have both built custom chips to serve a similar purpose, often called “AI accelerators” — silicon designed specifically to...”

Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: techcrunch•Veröffentlicht: 24. Juni 2026
Ursprünglicher Berichttitel: “OpenAI unveils its first custom chip, built by Broadcom”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

Large Language Models (LLM) & AI24. Juni 2026

OpenAI und Broadcom präsentieren Jalapeño-Inferenzchip für LLMs

OpenAI und Broadcom haben Jalapeño vorgestellt, einen auf LLM-Inferenz optimierten Beschleuniger, der als erster „Intelligence Processor“ von OpenAI bezeichnet wird. Die gemeinsam mit Broadcom und Celestica entwickelte Hardware wurde von Grund auf für moderne sowie zukünftige LLM-Inferenz konzipiert und mithilfe von OpenAI-Modellen in nur neun Monaten vom Design zum Tape-out geführt. Erste Engineering-Samples laufen im Labor mit ML-Workloads wie GPT‑5.3‑Codex‑Spark. Laut internen Tests übertrifft die Performance pro Watt den aktuellen Branchenstandard deutlich; ein detaillierter technischer Bericht soll folgen. Ab 2026 planen die Partner gigawattgroße Deployments mit Rechenzentrumspartnern wie Microsoft, um die Inferenzkosten sowie Latenzen zu senken und die Zuverlässigkeit für interaktive LLM-Produkte im großen Maßstab zu verbessern.

Signal analysieren
Large Language Models (LLM) & AI24. Juni 2026

OpenAI und Broadcom präsentieren eigenen KI-Chip namens Jalapeño

OpenAI und Broadcom haben mit Jalapeño ihren ersten gemeinsam entwickelten Custom-AI-Inferenzbeschleuniger vorgestellt, der als sogenannter „Intelligence Processor“ die Leistung pro Watt verbessern und die Token-Kosten für Large Language Models senken soll. Broadcom hat bereits erste Engineering-Silicon-Proben ausgeliefert; CEO Hock Tan rechnet mit einer ersten Implementierung Ende 2026, einer Hochlaufphase 2027 und dem vollständigen Rollout im Jahr 2028. Diese Ankündigung erfolgt in einer Phase, in der Broadcom-Aktien seit Anfang Juni stark gefallen sind, und vor dem Hintergrund, dass Hyperscaler wie Alphabet und ByteDance alternative Chip-Partner zur Diversifizierung ihrer Lieferketten prüfen. Greg Brockman von OpenAI betont, dass Jalapeño Nvidia-GPUs ergänzt, statt sie zu ersetzen. Die Partnerschaft verdeutlicht die zunehmende vertikale Integration von KI-Anbietern, um Inferenzkosten zu senken und die Rechenleistung über dominierende GPU-Lieferanten hinaus breiter aufzustellen.

Signal analysieren
Large Language Models (LLM) & AI25. Aug. 2026

OpenAI’s Jalapeño Chip Shows Leading Inference Efficiency

OpenAI revealed Jalapeño — its first custom inference ASIC and rack-scale platform co-developed with Broadcom and Celestica and shown at Hot Chips — with A0 engineering samples taped out Nov 2025. The compute die uses TSMC N3P, MXFP numeric formats and HBM4 (15.4 TB/s per package); package TDP is ~700 W with sustained test power ≲ ~550 W. The rack design keeps model state (KV cache) local, simplifies on-node fabric and can scale to 2,048 XPUs. OpenAI and SemiAnalysis/InferenceX benchmarks report substantial performance-per-watt and latency gains (and partial advantages vs Nvidia GB300), but results are not independently verified and did not include Nvidia Vera Rubin. OpenAI targets small-volume deployment end‑2026 and broader ramp in 2027, pursuing a multi‑vendor production strategy while production economics, yield and fleet reliability remain unproven.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.