Beobachtetes Signal · 25. Mai 2026 · Pricing Update · Quelle: t3n · Relevanz: 3/5 · Sentiment: Positiv

Deepseek macht 75-Prozent-Preissenkung für V4-Pro dauerhaft

Zusammenfassung des Signals

Der chinesische KI-Entwickler Deepseek hat bekannt gegeben, dass der temporäre Rabatt von 75 Prozent auf sein neues Flaggschiffmodell Deepseek V4-Pro dauerhaft gilt. Die API-Preise für Input-Token wurden auf 0,003625 bis 0,435 US-Dollar pro Million gesenkt (zuvor 0,0145 bis 1,74 US-Dollar), während Output-Token nun 0,87 US-Dollar pro Million kosten (zuvor 3,48 US-Dollar). Damit positioniert sich Deepseek deutlich unter westlichen Wettbewerbern wie OpenAI mit GPT-5 und Anthropic mit Claude Opus 4.7. Der Schritt zielt auf Enterprise-Kunden ab, die extrem große Kontextfenster benötigen. Während dies zu erheblichen Kosteneinsparungen für Großanwender führen kann, warnen Beobachter US- und europäischer Unternehmen vor geopolitischen und technischen Risiken bei der Datenübermittlung an einen chinesischen Anbieter.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Eine dauerhafte, massive Preissenkung eines Foundation-Model-Anbieters verändert die Kosten- und TCO-Dynamik für den Enterprise-KI-Einsatz grundlegend und beeinflusst die Anbieterauswahl für KI-gestützte MarTech-Anwendungen, auch wenn geopolitische Adoptionshürden die unmittelbare, branchenweite Breitenwirkung dämpfen.

SIGNAL RADAR

Marktsignale zu DeepSeek in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • Deepseek kündigte die Modellfamilie V4 (V4-Pro und V4-Flash) am 24.04.2026 an.
  • Der ursprünglich temporäre Preisnachlass von 75 Prozent für V4-Pro wurde dauerhaft fixiert.
  • Die API-Preise für Deepseek V4-Pro liegen nun bei 0,003625 bis 0,435 US-Dollar pro Million Input-Token (zuvor bis zu 1,74 US-Dollar) und 0,87 US-Dollar pro Million Output-Token (zuvor 3,48 US-Dollar).
  • Vergleichspreise westlicher Anbieter laut The Next Web: OpenAI GPT-5 berechnet rund 2,50 US-Dollar (Input) und 10 US-Dollar (Output); Anthropic Claude Opus 4.7 verlangt etwa 5 US-Dollar (Input) und 25 US-Dollar (Output) pro Million Token.
  • Deepseek positioniert V4-Pro gezielt für Enterprise-Kunden mit hohem Bedarf an großen Kontextfenstern und Long-Context-Processing.
Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: t3n•Veröffentlicht: 25. Mai 2026
Ursprünglicher Berichttitel: “Deepseek: Aggressiver Preisnachlass setzt Anthropic und OpenAI unter Druck”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

Large Language Models (LLM) & AI4. Juni 2026

DeepSeek dringt in US-Unternehmensbudgets für Künstliche Intelligenz vor

Der chinesische Anbieter DeepSeek taucht erstmals in US-Unternehmenszahlungen auf, wie der Trendreport von Ramp für Juni 2026 zeigt. Dieser Schritt folgt auf die dauerhafte Preissenkung des V4-Pro-Modells um 75 Prozent im Mai, wodurch die Preise für gecachte Inputs bei rund 0,025 RMB pro Million Token liegen – etwa ein Prozent der vergleichbaren Kosten von Anthropic. Während Ramp betont, dass monatliche Trendlisten keinen definitiven Marktanteilsbeweis darstellen, unterstreicht das gleichzeitige Auftreten von Inferenz-Plattformen wie Fireworks AI, fal AI, DeepInfra und dem GPU-Anbieter Vast.ai den Aufbau einer breiten Kostenoptimierungs-Infrastruktur. Dies steht im Einklang mit Daten von OpenRouter vom Mai, wonach chinesische Modelle die Entwickler-Routing-Volumina dominierten. Diese Entwicklung verdeutlicht den zunehmenden Preisdruck auf US-amerikanische Premium-Anbieter im Enterprise-Segment.

Signal analysieren
Model Release5. Dez. 2025

DeepSeek V3.2 erreicht Gemini-3-Niveau bei stark gesunkenen Kosten

DeepSeek hat die Modelle V3.2 und V3.2-Speciale veröffentlicht, die Spitzenleistungen im Reasoning auf dem Niveau von Gemini-3.0-Pro und führenden GPT-Klassen bei drastisch reduzierten Inferenzkosten beanspruchen. Ein neuer Aufmerksamkeitsmechanismus senkt die Token-Verarbeitungskosten um rund 70 Prozent auf etwa 0,70 US-Dollar pro Million Tokens. Die Version V3.2 hält das Reasoning über mehrere externe Tool-Aufrufe hinweg aufrecht, wodurch die Zuverlässigkeit von Agenten-Workflows steigt, während die Speciale-Variante bei Wettbewerben Bestwerte erzielte. Benchmarks wie AIME 2025 und Terminal Bench 2.0 zeigen starke Ergebnisse bei Mathematik- und Coding-Agenten-Aufgaben im Vergleich zu GPT-5-High. DeepSeek stellt die Modelle unter einer MIT-Lizenz frei zur Verfügung, räumt jedoch ein, dass Token-Effizienz und Weltwissen hinter proprietären Alternativen zurückbleiben. Der Marktbericht fasst zudem Praxistipps zur KI-Preisgestaltung zusammen, die die Kundenbindung über reine Preispunkte stellen.

Signal analysieren
Large Language Models (LLM) & AI24. Apr. 2026

DeepSeek stellt Vorschau auf Open-Source-LLM V4 vor

DeepSeek hat am 24. April 2026 den lang erwarteten Nachfolger DeepSeek V4 in den Varianten Pro und Flash als Open-Source Large Language Model mit einer neuen Architektur und 1,6 Billionen Parametern veröffentlicht. Das Modell erzielt signifikante Leistungssteigerungen beim logischen Schließen, in der Mathematik sowie in MINT-Disziplinen und unterstützt Kontextfenster von bis zu einer Million Token bei gleichzeitig reduzierten Rechen- und Speicherkosten. DeepSeek positioniert V4 Pro bei Programmieraufgaben als deutlich kostengünstiger im Vergleich zu OpenAI GPT-5.5. Der Rollout umfasst zudem eine strategische Partnerschaft mit Huawei zur Nutzung von Ascend-950-Supernode-Clustern, wodurch die Abhängigkeit von Nvidia und AMD verringert werden soll. Die Marktreaktion fällt jedoch verhaltener aus als beim R1-Durchbruch im Jahr 2025.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.