Observed Signal · Sep 28, 2026 · Technical Release · Source: Hello China Tech · Impact: 4/5 · Sentiment: Positive
Alibaba's T-Head AI Chips: Cloud Customers or Qwen Training?
Alibaba kündigte auf seiner Apsara-Konferenz an, dass sein neuer KI-Chip Zhenwu V900 im ersten Quartal 2027 in Massenproduktion gehen und verkauft wird, zwei Quartale früher als geplant. Dies folgt auf Huaweis Ankündigung, dass sein Ascend-960DT-Chip im ersten Quartal 2027 fertig sein wird. Beide Unternehmen sehen sich einer hohen Nachfrage und begrenzten Angebot für ihre Chips gegenüber. IDC-Daten zeigen, dass Nvidia 55 % der chinesischen Server-KI-Beschleuniger-Lieferungen hält, Huawei 20 % und T-Head 7 %. Alibaba plant, Qwen-Modelle mit 5-10 Billionen Parametern zu trainieren, hat aber nicht offengelegt, welche Chips verwendet werden, was Bedenken über Konkurrenz zwischen internem Modelltraining und zahlenden Cloud-Kunden um knappe Chip-Kapazitäten aufwirft.
Diese Nachricht beleuchtet die Wettbewerbslandschaft in der KI-Chip-Entwicklung in China, einem wichtigen Markt für AdTech und KI-gesteuerte Werbung. Der anhaltende Mangel und strategische Entscheidungen großer Player wie Alibaba und Huawei wirken sich direkt auf Cloud-Dienste und Verfügbarkeit von KI-Modellen aus, was das digitale Werbe-Ökosystem beeinflusst.
Marktsignale zu Huawei in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Alibaba kündigte an, dass sein Zhenwu-V900-Chip im ersten Quartal 2027 in Massenproduktion gehen und verkauft wird.
- Huawei kündigte an, dass sein Ascend-960DT-Chip im ersten Quartal 2027 fertig sein wird, drei Quartale früher als geplant.
- IDC berichtete, dass Nvidia 2025 55 % der chinesischen Server-KI-Beschleuniger-Lieferungen hielt, Huawei 20 % und T-Head 7 %.
- Alibaba plant Qwen-Modelle mit 5-10 Billionen Parametern.
- Beide Unternehmen sehen sich KI-Chip-Engpässen gegenüber und sind von begrenzter heimischer Foundry-Kapazität abhängig.
- Alibabas CEO Eddie Wu sagte, der KI-Computing-Engpass werde bis mindestens 2030 anhalten.
Verknüpfte Unternehmen
5 verknüpfte Unternehmen“Huawei said at its annual Huawei Connect conference that its next training chip, the Ascend 960DT, will be ready in the first quarter of 202...”
“IDC put shipments of server AI accelerator cards in China at about 4m in 2025; Nvidia shipped about 2.2m, or 55%....”
“Alibaba said its new Zhenwu V900 chip will enter mass production and go on sale in the same quarter....”
“A letter from the US Commerce Department led TSMC to stop shipping certain AI and graphics chips to affected Chinese customers....”
“IDC, a market research firm, put shipments of server AI accelerator cards in China at about 4m in 2025....”
Ontology Mapping & Concepts
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Samsung investiert 1 Mrd. Dollar in KI-Infrastruktur-Firma Helix
Samsung Electronics und fünf Tochtergesellschaften investieren gemeinsam 1 Milliarde US-Dollar in Helix Digital Infrastructure, ein von KKR gegründetes und von Nvidia unterstütztes KI-Infrastrukturunternehmen. Samsung Electronics steuert 500 Millionen US-Dollar bei, den Rest übernehmen Samsung C&T, Samsung SDS, Samsung SDI, Samsung Life Insurance und Samsung Fire & Marine Insurance. Helix, geführt vom ehemaligen AWS-CEO Adam Selipsky, konzentriert sich auf Hyperscale-Rechenzentren, Stromerzeugung, Übertragung und Glasfasernetze. Die Investition ergänzt die bereits zugesagten über 10 Milliarden US-Dollar anderer Investoren wie KKR, Kuwait Investment Authority, Nvidia und Vistra. Der Schritt ermöglicht es Samsung, seine Halbleiter-, Kühlungs-, Rechenzentrumsbau- und Batteriekompetenzen zu nutzen, um im KI-Infrastrukturmarkt zu expandieren.
Sparse Attention in GLM-5.3 und ihre Auswirkungen auf DRAM-Speicher
Dieser Artikel analysiert die Auswirkungen von Sparse-Attention-Mechanismen, insbesondere DeepSeek Sparse Attention (DSA), die im GLM-5.3-Modell von Z.ai verwendet werden, auf den adressierbaren Gesamtmarkt (TAM) für DRAM-Speicher, einschließlich HBM und NAND. Es wird erklärt, dass Sparse Attention zwar KV-Cache-Speicher und Bandbreite während der Attention-Operation reduziert, jedoch nicht den Gesamtspeicherbedarf, da die Top-k-Auswahl den vollständigen Kontext im HBM erfordert. Der Artikel diskutiert Systemoptimierungen wie HiSparse, das KV-Cache auf Host-DRAM auslagert, um Kapazitätsengpässe zu überwinden. Er enthält auch detaillierte Leistungs- und Kostenvergleiche für das Serving von GLM-5.3 auf verschiedenen Hardware-Plattformen (GB200, GB300, MI355X) mit Inferenz-Engines wie Dynamo-SGLang, Dynamo-TRT-LLM und ATOM, wobei Kosteneffizienz und Interaktivitäts-Kompromisse hervorgehoben werden. Die Analyse umfasst einen tiefen Einblick in die Architektur von GLM-5, einschließlich Lightning Indexer, MLA-Konfiguration und Post-Training-Pipeline.
Nscale Files for US IPO Targeting $30B Valuation
British AI infrastructure company Nscale has filed its IPO prospectus with the US SEC, aiming to list on the New York Stock Exchange under the ticker 'NSCL'. The company seeks a valuation of around $30 billion, as reported by CNBC via Reuters, a significant jump from its last private round valuation of $14.6 billion. Nscale, which transitioned from Bitcoin mining to AI compute, reported first-half 2026 revenue of $140.6 million, a 1,252% increase, but also a net loss of $1.02 billion. Its order book stands at $103.4 billion, with Microsoft and Anthropic contracts totaling $88.4 billion. The company recently secured $3.1 billion in convertible notes, with Nvidia as a key investor. Nscale faces high customer concentration, a going-concern note, and dependence on a few suppliers. Goldman Sachs, J.P. Morgan, and Morgan Stanley are lead underwriters.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
