Observed Signal · Aug 25, 2026 · Partnership · Source: https://martechseries.com/feed/ · Impact: 4/5 · Sentiment: Positive
Cisco Expands Secure AI Factory with NVIDIA for Rack-Scale
Cisco announced an expansion of its Secure AI Factory through a partnership with NVIDIA and Supermicro to deliver rack-scale, high-density AI computing solutions for enterprises, neoclouds, and sovereign clouds. The offering adds Supermicro liquid- and air-cooled servers validated as part of Cisco’s full-stack Secure AI Factory architecture, supports trillion-parameter training and high-throughput inference, and is NVIDIA Cloud Partner (NCP) compliant. Cisco says the solution integrates Cisco Silicon One and NVIDIA Spectrum‑X networking, Cisco Nexus One orchestration, and new Cisco Validated Infrastructure Services aligned with NVIDIA Infrastructure Services to simplify deployment, improve observability, and reduce deployment risk. Executives from Cisco and NVIDIA framed the expansion as enabling faster time-to-value, stronger security, and operational simplicity for large-scale AI deployments.
Major infrastructure partnership (Cisco + NVIDIA + Supermicro) expands validated, rack-scale AI architectures for enterprise and sovereign cloud deployments, accelerating large-model training/inference adoption and reducing deployment risk; important for enterprise AI infrastructure planning.
Marktsignale zu Cisco in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Cisco announced an expansion of its Secure AI Factory through a partnership with NVIDIA and Supermicro.
- Cisco will offer Supermicro liquid- and air-cooled rack-scale GPU systems validated and sold as part of Cisco’s AI infrastructure portfolio.
- The solution is NVIDIA Cloud Partner (NCP) compliant and targets enterprise, neocloud, and sovereign cloud customers for trillion-parameter training and high-throughput inference.
- Cisco integrates Cisco Silicon One front-end switches and NVIDIA Spectrum-X based back-end switches unified by Cisco Nexus One in the reference architecture.
- Cisco introduced Cisco Validated Infrastructure Services (CVIS) aligned with NVIDIA Infrastructure Services (NVIS) and is investing in a large-scale AI Lab to certify and test AI infrastructure.
Verknüpfte Unternehmen
4 verknüpfte Unternehmen“Today, Cisco is expanding the Secure AI Factory with NVIDIA, through a partnership with Supermicro, bringing its leadership in high-density,...”
““AI factories are revenue-generating infrastructure, where compute produces intelligence, and intelligence drives revenue,” said Justin Boit...”
“PR Newswire, a Cision company, is the premier global provider of multimedia platforms and distribution that marketers, corporate communicato...”
“MarTech Series is a leading publishing platform that provides daily updates on marketing technology news, in-depth interviews with industry ...”
Ontology Mapping & Concepts
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Samsung investiert 1 Mrd. Dollar in KI-Infrastruktur-Firma Helix
Samsung Electronics und fünf Tochtergesellschaften investieren gemeinsam 1 Milliarde US-Dollar in Helix Digital Infrastructure, ein von KKR gegründetes und von Nvidia unterstütztes KI-Infrastrukturunternehmen. Samsung Electronics steuert 500 Millionen US-Dollar bei, den Rest übernehmen Samsung C&T, Samsung SDS, Samsung SDI, Samsung Life Insurance und Samsung Fire & Marine Insurance. Helix, geführt vom ehemaligen AWS-CEO Adam Selipsky, konzentriert sich auf Hyperscale-Rechenzentren, Stromerzeugung, Übertragung und Glasfasernetze. Die Investition ergänzt die bereits zugesagten über 10 Milliarden US-Dollar anderer Investoren wie KKR, Kuwait Investment Authority, Nvidia und Vistra. Der Schritt ermöglicht es Samsung, seine Halbleiter-, Kühlungs-, Rechenzentrumsbau- und Batteriekompetenzen zu nutzen, um im KI-Infrastrukturmarkt zu expandieren.
Modal Labs kurz vor 750-Millionen-Dollar-Runde bei 15,75 Milliarden Dollar Bewertung
Der KI-Inferenz-Infrastrukturanbieter Modal Labs steht kurz vor einer 750-Millionen-Dollar-Finanzierungsrunde unter der Leitung von Accel zu einer Bewertung von 15,75 Milliarden Dollar, wie eine Quelle berichtet. Dies würde die Bewertung von 4,65 Milliarden Dollar im Mai mehr als verdreifachen. Die Runde kommt inmitten einer starken Nachfrage nach Inferenzdiensten, wobei auch andere Startups wie Baseten, Fireworks und Fal höhere Bewertungen anstreben. Modal Labs wurde 2021 von Erik Bernhardsson und Akshat Bubna gegründet und bietet Infrastruktur zum Trainieren und Ausführen von KI-Modellen ohne Serververwaltung. Das Unternehmen hat im Mai die Marke von 300 Millionen Dollar annualisiertem Umsatz überschritten. Die Gespräche folgen auf einen Sicherheitsvorfall im Juli, bei dem Kundendaten kompromittiert wurden, aber die Plattform von Modal nicht betroffen war.
Sparse Attention in GLM-5.3 und ihre Auswirkungen auf DRAM-Speicher
Dieser Artikel analysiert die Auswirkungen von Sparse-Attention-Mechanismen, insbesondere DeepSeek Sparse Attention (DSA), die im GLM-5.3-Modell von Z.ai verwendet werden, auf den adressierbaren Gesamtmarkt (TAM) für DRAM-Speicher, einschließlich HBM und NAND. Es wird erklärt, dass Sparse Attention zwar KV-Cache-Speicher und Bandbreite während der Attention-Operation reduziert, jedoch nicht den Gesamtspeicherbedarf, da die Top-k-Auswahl den vollständigen Kontext im HBM erfordert. Der Artikel diskutiert Systemoptimierungen wie HiSparse, das KV-Cache auf Host-DRAM auslagert, um Kapazitätsengpässe zu überwinden. Er enthält auch detaillierte Leistungs- und Kostenvergleiche für das Serving von GLM-5.3 auf verschiedenen Hardware-Plattformen (GB200, GB300, MI355X) mit Inferenz-Engines wie Dynamo-SGLang, Dynamo-TRT-LLM und ATOM, wobei Kosteneffizienz und Interaktivitäts-Kompromisse hervorgehoben werden. Die Analyse umfasst einen tiefen Einblick in die Architektur von GLM-5, einschließlich Lightning Indexer, MLA-Konfiguration und Post-Training-Pipeline.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
