Beobachtetes Signal · 11. Sept. 2026 · Technical Release · Quelle: OpenAI Blog · Relevanz: 3/5 · Sentiment: Positiv
OpenAI skaliert Speicherplattform Habitat für eine Milliarde Nutzer
OpenAI hat Einblicke in die Skalierung seiner internen Speicherplattform Habitat gegeben, um wöchentlich über eine Milliarde Nutzer zu unterstützen. Habitat verarbeitet mittlerweile mehr als 70 Millionen Anfragen pro Sekunde und verwaltet über 500 Petabyte an Daten in knapp 40 Regionen. Die Plattform entwickelte sich von einer einfachen Python-Client-Bibliothek zu einem eigenständigen Service, um die operationelle Komplexität bereichsübergreifender Deployments zu bewältigen. Zu den wichtigsten architektonischen Schritten zählte die spätere Migration des Dienstes nach Rust, wodurch die CPU-Effizienz verfünffacht und die Speichereffizienz massiv gesteigert wurde. Das Engineering-Team bewältigte Herausforderungen wie asyncio-Verzögerungen, instabile Verbindungspooling-Prozesse und Thundering-Herd-Probleme durch den Einsatz von Envoy als Connection Manager. Als Backend dient Azure Cosmos DB, ergänzt durch eine analytische Offline-Sicht über Rockset. Dieser Bericht ist der erste Teil einer Reihe über die Skalierung von Online-Speicherinfrastrukturen im KI-Zeitalter.
OpenAI gewährt Einblicke in die Skalierung seiner Speicherinfrastruktur für massives Nutzerwachstum und demonstriert architektonische Architekturentscheidungen sowie Leistungsoptimierungen, die auch für hochskalierte KI-gestützte Werbe- und Marketingplattformen von hoher Relevanz sind.
Marktsignale zu OpenAI in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Habitat verarbeitet mittlerweile über 70 Millionen Anfragen pro Sekunde.
- Die Plattform unterstützt Produkte, die wöchentlich von über einer Milliarde Menschen genutzt werden.
- Habitat verwaltet mehr als 500 Petabyte an Daten.
- Die Neuentwicklung in Rust im Q2 2026 verbesserte die CPU-Effizienz um das 6-fache und die Speichereffizienz um das 15-fache.
- Der neue Rust-Service bewältigt 95 Prozent aller Produktionsanfragen.
Verknüpfte Unternehmen
2 verknüpfte Unternehmen“Every OpenAI product depends on fast, reliable access to data... Habitat is the online storage platform we built so OpenAI products can quic...”
“we scaled our partnership with Azure Cosmos DB to reliably handle unprecedented demand....”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
OpenAI skaliert PostgreSQL für 800 Millionen ChatGPT-Nutzer
OpenAI hat Einblicke in die Skalierung von PostgreSQL gegeben, um Millionen Queries pro Sekunde und 800 Millionen ChatGPT-Nutzer zu unterstützen. Das Team nutzt eine zentrale Azure PostgreSQL Flexible Server Instanz für Write-Operationen sowie knapp 50 geoverteilte Read-Replicas, während schreibintensive Workloads zu Systemen wie Azure Cosmos DB migriert wurden. Zu den zentralen Techniken gehören aggressive Query-Optimierung, Workload-Isolierung, PgBouncer Connection Pooling – wodurch die durchschnittliche Verbindungszeit von 50 ms auf 5 ms sank –, Cache-Locking gegen Cache-Miss-Stürme, Rate Limiting sowie strenge Schema-Änderungskontrollen. OpenAI verzeichnet eine geringe P99-Read-Latenz, eine Verfügbarkeit von Five-Nines und lediglich einen schwerwiegenden Postgres-Vorfall in den letzten zwölf Monaten. Diese Architekturentscheidungen unterstreichen, wie selbst extrem laststarke Applikationen klassische relationale Datenbanken durch gezielte Replikation und Auslagerung performant betreiben können.
OpenAI und AWS schliessen strategische 38-Milliarden-Dollar-KI-Partnerschaft
Amazon Web Services (AWS) und OpenAI haben eine mehrjährige strategische Partnerschaft angekündigt, in deren Rahmen OpenAI seine zentralen KI-Workloads auf der AWS-Infrastruktur betreiben und skalieren wird. Die Vereinbarung umfasst ein Volumen von 38 Milliarden US-Dollar über die nächsten sieben Jahre mit weiterem Wachstumspotenzial. OpenAI erhält dadurch direkten Zugriff auf Hunderttausende NVIDIA-GPUs (GB200 und GB300) über Amazon EC2 UltraServers sowie die Möglichkeit, auf Dutzende Millionen CPUs zu skalieren. AWS plant die Bereitstellung der zielgerichteten Kapazitäten bis Ende 2026, mit Optionen zur Expansion in das Jahr 2027 und darüber hinaus. Die Infrastruktur ist auf latenzarme, geclusterte GPU-Performance ausgelegt, um sowohl Inferenzprozesse für ChatGPT als auch das Training von Modellen der nächsten Generation zu unterstützen. Die Bekanntmachung verweist zudem auf die bereits bestehende Zusammenarbeit durch die Verfügbarkeit von OpenAI-Modellen auf Amazon Bedrock.
Anthropic und OpenAI setzen auf kleinere Rechenzentrumskapazitäten zur schnelleren KI-Skalierung
Anthropic und OpenAI forcieren laut CNBC kleinere Rechenzentrumskapazitäten im Bereich von 20 bis 30 MW, um den Rollout von KI-Workloads in den USA, Großbritannien und den nordischen Ländern zu beschleunigen. Da Gigawatt-Großprojekte zunehmend auf infrastrukturelle Hürden und lokalen Widerstand stoßen, priorisieren beide KI-Labore eine schnellere „Time-to-Capacity“ an bestehenden Standorten mit gesicherter Stromversorgung. Dieser strategische Schwenk reflektiert den wachsenden Fokus auf Inference-Workloads, die effizient auf kleineren, dezentralen Clustern betrieben werden können. Während OpenAI sein Stargate-Ziel von 10 GW übertrifft und Standorte in Georgia und Ohio ausbaut, schloss Anthropic einen 45-Milliarden-Dollar-Deal mit Nscale ab. Kleinere Kapazitätsverträge bieten unmittelbare operative Flexibilität gegenüber langwierigen Mega-Bauprojekten.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
