Beobachtetes Signal · 24. Juni 2026 · Product Launch · Quelle: techcrunch · Relevanz: 4/5 · Sentiment: Positiv
OpenAI präsentiert ersten eigenen Inference-Chip mit Broadcom
OpenAI hat mit dem gemeinsam mit Broadcom entwickelten Jalapeño seinen ersten maßgeschneiderten Inference-Prozessor vorgestellt. Der Chip wurde speziell für Inference-Workloads konzipiert; laut OpenAI belegen frühe Tests eine deutlich bessere Performance-per-Watt im Vergleich zu gängigen Alternativen. Bei der Entwicklung setzte das Unternehmen demnach auf die Unterstützung eigener KI-Modelle. Die bereits im Oktober angekündigte Partnerschaft gilt als strategischer Schritt, um die Abhängigkeit von Nvidia GPUs bei der Inferenz zu verringern, während rechenintensivere Aufgaben wie das Pre-Training voraussichtlich weiterhin auf bestehender GPU-Hardware laufen. OpenAI positioniert den neuen Chip als Teil einer umfassenderen Strategie zur Optimierung des gesamten Stacks – von der Chip-Architektur bis hin zu Deployment-Systemen –, um den Betrieb von KI-Modellen schneller, zuverlässiger und kostengünstiger zu gestalten.
Die Einführung eines eigenen Inference-Chips durch eine führende KI-Plattform verändert die Ökonomie der KI-Infrastruktur sowie den Hardware-Wettbewerb, verringert die Abhängigkeit von Nvidia GPUs, senkt die Betriebskosten und beeinflusst die Strategien von Cloud-, Rechenzentrum- und KI-Dienstanbietern.
Marktsignale zu OpenAI in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- OpenAI hat am 24.06.2026 seinen ersten maßgeschneiderten Inference-Prozessor namens Jalapeño vorgestellt.
- Der Jalapeño-Chip wurde in Zusammenarbeit mit Broadcom entwickelt und gefertigt.
- OpenAI setzte nach eigenen Angaben eigene KI-Modelle zur Unterstützung bei der Chip-Entwicklung ein.
- Erste Tests zeigen laut Berichten eine signifikant bessere Performance-per-Watt als aktuelle State-of-the-Art-Alternativen.
- Die Broadcom-Partnerschaft wurde im Oktober offiziell bekannt gegeben und soll die Abhängigkeit von Nvidia GPUs bei Inference-Workloads reduzieren.
Verknüpfte Unternehmen
5 verknüpfte Unternehmen“On Wednesday, OpenAI unveiled its first custom-built inference processor, designed and manufactured in collaboration with Broadcom....”
“On Wednesday, OpenAI unveiled its first custom-built inference processor, designed and manufactured in collaboration with Broadcom....”
“The partnership was officially announced in October, but OpenAI’s chip plans have long been rumored as a way to reduce the company’s depende...”
“Google and Amazon have both built custom chips to serve a similar purpose, often called “AI accelerators” — silicon designed specifically to...”
“Google and Amazon have both built custom chips to serve a similar purpose, often called “AI accelerators” — silicon designed specifically to...”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
OpenAI und Broadcom präsentieren Jalapeño-Inferenzchip für LLMs
OpenAI und Broadcom haben Jalapeño vorgestellt, einen auf LLM-Inferenz optimierten Beschleuniger, der als erster „Intelligence Processor“ von OpenAI bezeichnet wird. Die gemeinsam mit Broadcom und Celestica entwickelte Hardware wurde von Grund auf für moderne sowie zukünftige LLM-Inferenz konzipiert und mithilfe von OpenAI-Modellen in nur neun Monaten vom Design zum Tape-out geführt. Erste Engineering-Samples laufen im Labor mit ML-Workloads wie GPT‑5.3‑Codex‑Spark. Laut internen Tests übertrifft die Performance pro Watt den aktuellen Branchenstandard deutlich; ein detaillierter technischer Bericht soll folgen. Ab 2026 planen die Partner gigawattgroße Deployments mit Rechenzentrumspartnern wie Microsoft, um die Inferenzkosten sowie Latenzen zu senken und die Zuverlässigkeit für interaktive LLM-Produkte im großen Maßstab zu verbessern.
OpenAI und Broadcom präsentieren eigenen KI-Chip namens Jalapeño
OpenAI und Broadcom haben mit Jalapeño ihren ersten gemeinsam entwickelten Custom-AI-Inferenzbeschleuniger vorgestellt, der als sogenannter „Intelligence Processor“ die Leistung pro Watt verbessern und die Token-Kosten für Large Language Models senken soll. Broadcom hat bereits erste Engineering-Silicon-Proben ausgeliefert; CEO Hock Tan rechnet mit einer ersten Implementierung Ende 2026, einer Hochlaufphase 2027 und dem vollständigen Rollout im Jahr 2028. Diese Ankündigung erfolgt in einer Phase, in der Broadcom-Aktien seit Anfang Juni stark gefallen sind, und vor dem Hintergrund, dass Hyperscaler wie Alphabet und ByteDance alternative Chip-Partner zur Diversifizierung ihrer Lieferketten prüfen. Greg Brockman von OpenAI betont, dass Jalapeño Nvidia-GPUs ergänzt, statt sie zu ersetzen. Die Partnerschaft verdeutlicht die zunehmende vertikale Integration von KI-Anbietern, um Inferenzkosten zu senken und die Rechenleistung über dominierende GPU-Lieferanten hinaus breiter aufzustellen.
OpenAI’s Jalapeño Chip Shows Leading Inference Efficiency
OpenAI revealed Jalapeño — its first custom inference ASIC and rack-scale platform co-developed with Broadcom and Celestica and shown at Hot Chips — with A0 engineering samples taped out Nov 2025. The compute die uses TSMC N3P, MXFP numeric formats and HBM4 (15.4 TB/s per package); package TDP is ~700 W with sustained test power ≲ ~550 W. The rack design keeps model state (KV cache) local, simplifies on-node fabric and can scale to 2,048 XPUs. OpenAI and SemiAnalysis/InferenceX benchmarks report substantial performance-per-watt and latency gains (and partial advantages vs Nvidia GB300), but results are not independently verified and did not include Nvidia Vera Rubin. OpenAI targets small-volume deployment end‑2026 and broader ramp in 2027, pursuing a multi‑vendor production strategy while production economics, yield and fleet reliability remain unproven.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
