Beobachtetes Signal · 14. Juli 2026 · Partnership · Quelle: CNBC Technology · Relevanz: 4/5 · Sentiment: Positiv

Apple verhandelt mit PrismML über On‑Device‑KI-Komprimierung

Zusammenfassung des Signals

Apple führt frühe Gespräche mit dem Caltech-Spinout PrismML, das von Khosla Ventures unterstützt wird. Das Startup hat komprimierte Versionen des Open-Source-Modells Qwen von Alibaba veröffentlicht, die die Größe von rund 54 GB auf unter 4 GB reduzieren. Durch die Reduzierung interner Werte auf wenige Zustände soll ein Modell mit 27 Milliarden Parametern auf dem iPhone 15 oder neueren Geräten laufen können, was Geschwindigkeit und Energieeffizienz steigert. PrismML hat zwei komprimierte Modellvarianten kostenlos veröffentlicht und eine Seed-Finanzierung von 16,25 Millionen US-Dollar eingesammelt. Analysten betonen die potenziellen Auswirkungen auf Siri, den lokalen Energieverbrauch und globale Chip-Märkte, weisen jedoch darauf hin, dass Praxistests im großen Maßstab die tatsächliche Effizienz bestätigen müssen.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Sollte sich die Kompressionstechnologie von PrismML bewähren, könnte dies großformatige Modell-Inferenz direkt auf Endgeräten ermöglichen, was Siri-Funktionen, Cloud-Infrastrukturkosten, den lokalen Energiehaushalt und die Datenschutzstrategie von Apple maßgeblich beeinflusst.

SIGNAL RADAR

Marktsignale zu Apple in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • Apple befindet sich in frühen Gesprächen mit PrismML zur Evaluierung komprimierter KI-Modelle für On‑Device-Anwendungen.
  • PrismML hat Alibabas Qwen-Modell von ca. 54 GB auf unter 4 GB verkleinert, um 27-Milliarden-Parameter-Modelle auf dem iPhone 15 und neueren Geräten lauffähig zu machen.
  • PrismML ist ein Spin-out des Caltech, welches die zugrundeliegenden Patente exklusiv lizenziert hat.
  • Das Startup hat im März eine Seed-Runde über 16,25 Millionen US-Dollar abgeschlossen und zwei komprimierte Modellvarianten veröffentlicht.
  • PrismML beansprucht einen 10- bis 15-fach geringeren Speicherbedarf sowie eine 6- bis 8-fach höhere Geschwindigkeit bei geringen Performance-Abstrichen.

Verknüpfte Unternehmen

11 verknüpfte Unternehmen

“Apple is in talks with a small Silicon Valley company that says it can shrink powerful artificial intelligence models enough to run directly...”

“PrismML, a Khosla Ventures-backed spinout from the California Institute of Technology, publicly released compressed versions of Alibaba’s op...”

“Apple is trying to make Siri more competitive with assistants from OpenAI and Anthropic while keeping more personal information and AI proce...”

“Apple is trying to make Siri more competitive with assistants from OpenAI and Anthropic while keeping more personal information and AI proce...”

“Hassibi said Google’s open-source Gemma model is next in the pipeline, followed by much larger models, including those from frontier labs th...”

“PrismML is releasing two compressed versions of the model for free. They are designed to run on everyday devices, including iPhones, MacBook...”

“Micron shares plunged in March after Google published its TurboQuant paper on cutting memory use without hurting model performance, though t...”

“Phil Solis, who leads IDC’s research on client processors, said power consumption may be the biggest open question....”

“Tarun Pathak, research director at Counterpoint Research, said the model’s performance on lengthy prompts, battery consumption during multit...”

“Morgan Stanley estimates Apple’s average dynamic random access memory cost per bit could rise roughly 190% year over year in fiscal 2027......”

Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: CNBC Technology•Veröffentlicht: 14. Juli 2026
Ursprünglicher Berichttitel: “Apple in talks with startup that shrinks AI models to run on an iPhone”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

AI Infrastructure17. Sept. 2026

PrismML bringt kompaktes Bonsai 2 27B LLM für On-Device AI

Das KI-Startup PrismML hat Bonsai 2 27B vorgestellt, ein stark komprimiertes Large Language Model, das für den Einsatz auf PCs und High-End-Smartphones optimiert ist. Die Technologie komprimiert das Modell Qwen3.8 27B von Alibaba auf lediglich 5,9 GB – eine neun- bis zehnfache Reduktion des Speicherbedarfs – bei Erhalt von 98 Prozent der ursprünglichen Benchmark-Performance. PrismML wurde von Forschern des Caltech gegründet und wird von CEO Babak Hassibi geführt. Das Startup sicherte sich eine Seed-Finanzierung in Höhe von 22,25 Millionen US-Dollar unter Führung von Khosla Ventures, Cerberus Capital und dem Caltech. Die proprietäre ternäre Gewichtskompression reduziert Gewichte auf +1, -1 oder 0. PrismML beabsichtigt, dieses Verfahren in den kommenden Monaten auf noch größere Modelle anzuwenden. Medienberichten zufolge befindet sich das Unternehmen zudem in ersten Gesprächen mit Apple.

Signal analysieren
Large Language Models (LLM) & AI15. Juli 2026

Alibabas Qwen AI wird in Apple Intelligence integriert

Die chinesische Cyberspace-Verwaltung hat Apple Intelligence für den chinesischen Markt freigegeben, nachdem Apple entsprechende Partnerschaften zur Integration lokaler KI-Funktionen geschlossen hat. Alibaba bestätigte, dass das Qwen-Modell künftig in Apple Intelligence auf iOS, iPadOS, macOS und visionOS in China integriert wird, nannte jedoch noch keinen Zeitplan. Gleichzeitig hat PrismML komprimierte Versionen des Open-Source-Modells Qwen veröffentlicht, die es ermöglichen, eine Variante mit 27 Milliarden Parametern auf dem iPhone 15 und neueren Geräten auszuführen. Auch Baidu arbeitet nach eigenen Angaben mit Apple an Features für chinesische iPhones; zudem strebt Baidus KI-Chip-Sparte Kunlunxin offenbar einen Börsengang in Hongkong mit einer Bewertung von bis zu 50 Milliarden US-Dollar an. Die Nachrichten führten zu deutlichen Kursgewinnen bei Alibaba und Baidu und beenden vorerst Verzögerungen bei der regulatorischen Prüfung von KI-Anbietern durch Apple.

Signal analysieren
Large Language Models (LLM) & AI28. Juni 2026

On-Device-KI wird praxistauglich: Apple und Google setzen neue Maßstäbe

Apple und Google haben On-Device-Foundation-Modelle etabliert, die die Ökonomie, den Datenschutz und die Verfügbarkeit von LLM-Funktionen grundlegend verändern. Apples auf der WWDC am 8. Juni vorgestellte AFM-3-Generation nutzt eine sparsame Aktivierungsstrategie, bei der von rund 20 Milliarden Parametern im Flash-Speicher nur 1 bis 4 Milliarden pro Anfrage aktiv sind. Googlesto stellt die Gemma-4-Familie bereit, die durch Per-Layer-Embeddings und Mixture-of-Experts-Architekturen extrem kleine aktive Footprints erzielt. Edge-Varianten laufen offline auf Geräten wie Raspberry Pi oder NVIDIA Jetson Orin Nano. Da Apple zudem sein Framework für Drittanbieter- und Open-Modelle öffnet sowie Agenten-Primitives und lokale semantische Suche integriert, verlagern sich zahlreiche Features von kostenpflichtigen Cloud-Inferenzdiensten hin zu kostenfreien, privaten Ausführungen auf dem Endgerät.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.