Beobachtetes Signal · 7. Juli 2026 · Technical Release · Quelle: Chipstrat · Relevanz: 4/5 · Sentiment: Positiv
High-Bandwidth Flash etabliert sich als neue Speicheroption für KI-Inferenz
Der Bericht analysiert High Bandwidth Flash (HBF), ein Packaging-Konzept für gestapelten NAND-Speicher, das dem HBM-Stacking (TSVs und gebondete Controller/CBA) ähnelt. HBF erzielt eine sehr hohe Lesebandbreite von rund 1,6 TB/s bei drastisch höherer Kapazität (SanDisk nennt ca. 512 GB pro Stack). Zwar bedingt HBF eine höhere Latenz sowie eine geringere Schreibausdauer als HBM, bietet dafür jedoch ein Vielfaches an Stack-Kapazität. Damit positioniert sich die Technologie ideal für die Speicherung von Modellgewichten in KI-Inferenz-Decode-Workloads. SanDisk rechnet mit Speicher-Samples im zweiten Halbjahr 2026 und ersten Inferenz-Geräten Anfang 2027. Gemeinsam mit SK Hynix treibt SanDisk seit Februar 2026 die OCP-Standardisierung voran. Der Report beleuchtet Auswirkungen auf die Supply-Chain, Leistungs- und Kostenvorteile gegenüber HBM4 sowie das Wettbewerbsumfeld um SanDisk, SK Hynix, Samsung und YMTC.
HBF könnte die Wirtschaftlichkeit der KI-Inferenz-Infrastruktur grundlegend transformieren, da es bandbreitenseitig mit HBM konkurriert, aber die rund zehnfache Kapazität pro Stack bietet – mit direkten Auswirkungen auf GPU-Dichten, Interconnects und die Total-Cost-per-Token großer Modelle.
Marktsignale zu Sandisk in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- HBF stapelt 16 per Through-Silicon Vias (TSVs) verbundene NAND-Dies und bondet ein Controller-Logic-Die direkt auf das Array (CBA).
- Ein HBF-Stack liefert ca. 1,6 TB/s Lesebandbreite – vergleichbar mit einem HBM4-Stack beim JEDEC-Betriebspunkt von 6,4 Gb/s.
- Laut SanDisk bietet ein HBF-Stack rund 512 GB Kapazität (8- bis 16-mal mehr als HBM4, je nach Generation).
- SanDisk erwartet erste Speicher-Samples in H2 2026 sowie HBF-basierte KI-Inferenz-Systeme Anfang 2027.
- SanDisk und SK Hynix haben im Februar 2026 eine OCP-Standardisierungsinitiative für HBF initiiert.
Verknüpfte Unternehmen
4 verknüpfte Unternehmen“SanDisk also claims a [similar cost to an HBM stack] despite 8-16x the capacity, which works out to roughly 10x lower cost per GB....”
“So SK Hynix is the stacking partner....”
“Competitive landscape: Sandisk, SK Hynix, Samsung, YMTC...”
“[Paid] Nvidia is the certification gate; custom silicon moves first...”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Samsung liefert erste Muster des Next-Gen-KI-Speichers HBM4E aus
Samsung Electronics hat mit der weltweiten Bemusterung seines Next-Generation-Speichers HBM4E mit 12 Layern begonnen, was die Aktie um bis zu 6,51 % steigen ließ. Laut Samsung erreicht der HBM4E Geschwindigkeiten von bis zu 16 Gbit/s bei optimierter Energieeffizienz und verbesserter thermischer Leistung. Die 12-Layer-Variante bietet eine Kapazität von 48 GB – eine Steigerung von über 30 % gegenüber der Vorgängergeneration. Je nach Kundenanforderung plant Samsung zudem Konfigurationen mit 8 Layern (32 GB) sowie 16 Layern (64 GB). Nach dem Start von HBM4 im Februar forciert der Konzern den Wettbewerb mit SK Hynix und Micron im Markt für fortschrittlichen KI-Speicher. Sang Joon Hwang, Executive Vice President und Head of Memory Development bei Samsung, betonte die massiven Fertigungsinvestitionen, um das Wachstum im AI-Memory-Segment voranzutreiben.
Die AI Memory Tax und die Bifurkation der Scaling Laws
Der Artikel analysiert, wie sich der Arbeitsspeicher von einer zyklischen Standardkomponente zu einem strategischen Engpass für die AI-Infrastruktur entwickelt hat. Zwei Haupttreiber prägen diesen Wandel: das bereits 1995 von Wulf und McKee beschriebene Problem der ‚Memory Wall‘ sowie die Etablierung von High Bandwidth Memory (HBM). HBM, ursprünglich von AMD und SK hynix gemeinsam entwickelt und von NVIDIA für Höchstleistungsrechner adaptiert, ist heute der entscheidende Enabler für Transformer-Workloads. Die extreme Bandbreitenabhängigkeit von Transformer-Architekturen hat die strategische Bedeutung von HBM massiv gesteigert, zu einer starken Marktkonzentration bei wenigen Lieferanten geführt und anhaltende Versorgungsknappheit sowie hohe Margen erzeugt. Diese Entwicklung markiert einen strukturellen Regimewechsel mit weitreichenden Konsequenzen für das Design von AI-Systemen, Produkt-Roadmaps und den gesamten Halbleitermarkt, wobei künftige Analysen tiefergehende Einblicke in Infrastruktur- und Eigentümerstrukturen versprechen.
Nvidia entwickelt proprietären KI-Speicher NVHBM
Nvidia hat mit NVHBM eine proprietäre Variante des HBM4-Standards (High Bandwidth Memory) entwickelt, die den Speicher-Controller direkt in das Base-Die des gestapelten Speichers verlagert. Diese Architektur macht separate Controller auf CPU, GPU oder einem I/O-Die überflüssig und nutzt kompakte NVLink-Schnittstellen als Verbindungsmethode innerhalb der NVLink Fusion-Plattform. Nvidia positioniert NVHBM strategisch, um Partner und Kunden enger an das eigene Ökosystem zu binden und die Relevanz des herstellerübergreifenden Standards Compute Express Link (CXL) einzuschränken. Während mehrere Speicherhersteller die NVHBM-Technologie evaluieren, gilt Annapurna Labs – die Halbleitertochter von Amazon – bereits als erster Partner, der die neue Speicherarchitektur implementiert.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
