DeepSeek sichert 75% für immer: V4-Pro wird die günstigste Frontier AI API auf dem Markt

Zusammenfassung der Nachrichten
DeepSeek, das KI-Forschungslabor hinter einem der kostengünstigsten großen Sprachmodelle der Welt, gab am 22. Mai 2026 (UTC) bekannt, dass sein 75%iger Rabatt auf die V4-Pro API dauerhaft wird – eine Entscheidung, die eine neue Phase im globalen Wettbewerb um KI-Preise markiert und die Eintrittsbarriere für Entwickler, die auf Modellen der Spitzenklasse aufbauen, drastisch senkt.
Hintergrund: Von der Promotion zur Politik
Als DeepSeek Ende April 2026 das V4-Pro-Modell auf den Markt brachte, führte es als zeitlich begrenzte Promotion einen Einführungsrabatt von 75% auf den API-Zugang ein. Damals sollte der Rabatt am 31. Mai 2026 um 15:59 UTC auslaufen. Weniger als einen Monat später, am 22. Mai 2026 (UTC), aktualisierte DeepSeek seine offizielle API-Dokumentation und gab eine öffentliche Erklärung ab, die bestätigte, dass der rabattierte Preis nach Ablauf des Aktionszeitraums zum neuen permanenten Standardpreis wird.
Die Entscheidung fiel etwa einen Monat nach der Einführung der V4-Generation und überraschte viele Beobachter, die erwarteten, dass die Preise auf ihr ursprüngliches Niveau zurückkehren würden, bevor eine längerfristige Neupreisgestaltung angekündigt wurde.
Neue Preisaufschlüsselung
Die permanenten Preise für DeepSeek-V4-Pro positionieren das Modell als eine der erschwinglichsten Spitzen-KI-APIs, die derzeit verfügbar sind:
- Cache-Hit Eingabe-Tokens: 0,003625 $ pro Million Tokens (zuvor 0,0145 $)
- Cache-Miss Eingabe-Tokens: 0,435 $ pro Million Tokens (zuvor 1,74 $)
- Ausgabe-Tokens: 0,87 $ pro Million Tokens (zuvor 3,48 $)
In chinesischen Yuan umgerechnet entspricht dies einem Bereich von 0,025 bis 6 Yuan pro Million Tokens, verglichen mit dem früheren Bereich von 0,1 bis 24 Yuan. Die pauschale Reduzierung stellt eine präzise Kürzung um 75% auf jeder Preistufe dar. Laut einer Analyse von The Decoder vom 23. Mai 2026 (Eastern Time) liegt der Preis für Ausgabe-Tokens von DeepSeek nun mindestens 34 Mal unter dem von OpenAIs GPT-5.5 bei vergleichbaren Fähigkeitsniveaus.
Technologie hinter der Preisverschiebung
Ein wichtiger technischer Faktor, der der Preissenkung zugrunde liegt, ist die Optimierung der DeepSeek V4-Serie für die Ascend KI-Beschleuniger-Hardware von Huawei. Im Gegensatz zu früheren DeepSeek-Generationen, die hauptsächlich auf Nvidia-GPUs liefen, wurde die V4-Familie von Grund auf neu entwickelt, um die Ascend 950 und 950PR KI-Superknoten-Architekturen zu nutzen.
Als V4 im April 2026 erstmals veröffentlicht wurde, erklärte DeepSeek, dass die API-Preise voraussichtlich stark sinken würden, sobald Huawei Ascend 950 Superknoten in großen Mengen verfügbar seien, was laut Unternehmensprognosen in der zweiten Jahreshälfte 2026 der Fall sein würde. Die Entscheidung, den Rabatt vor diesem Lieferausbau dauerhaft zu machen, deutet darauf hin, dass DeepSeek ausreichend Vertrauen in seine Infrastrukturkostenentwicklung gewonnen hat, um sich jetzt für die niedrigere Preisstufe zu entscheiden.
DeepSeek hat die genaue Beziehung zwischen der Verfügbarkeit von Ascend-Hardware und der permanenten Preisentscheidung nicht öffentlich bekannt gegeben, aber der Zeitpunkt stimmt mit breiteren Berichten über den verstärkten Einsatz von Huawei Ascend 950 in der KI-Branche überein.
Wettbewerbslandschaft
Die permanente Preissenkung verschafft DeepSeek-V4-Pro eine einzigartig vorteilhafte Position gegenüber seinen Konkurrenzmodellen. Zu den neuen Preisen unterbietet V4-Pro die führenden Alternativen auf breiter Front:
- OpenAI GPT-5: Deutlich höhere Kosten für Ausgabe-Tokens
- Anthropic Claude Opus 4.7: Höhere Preise pro Token bei vergleichbaren Reasoning-Stufen
- Google Gemini 3.5 Flash: Die Ausgabe-Preise von DeepSeek-V4-Pro bleiben auch gegenüber Flash-Tier-Modellen niedriger
Der South China Morning Post berichtete am 24. Mai 2026 (Eastern Time), dass DeepSeek-V4-Pro nach der Ankündigung der permanenten Preissenkung die globalen "Preis-Leistungs"-Rankings anführte, basierend auf Benchmark-Leistung im Verhältnis zu den Kosten pro Token.
Auswirkungen auf Entwickler und Industrie
Für Entwickler und Unternehmen beseitigt die Dauerhaftigkeit des Rabatts eine große Planungsunsicherheit. Teams, die DeepSeek-V4-Pro als kostensparende Alternative evaluiert hatten, aber aufgrund der vorübergehenden Natur der Aktionspreise zögerten, können nun Produktionssysteme mit größerer Zuversicht in die Kostenstabilität aufbauen.
Bloomberg berichtete am 23. Mai 2026 (Eastern Time), dass die Maßnahme weithin als Eskalation des anhaltenden KI-Preiskriegs interpretiert wird. In den letzten Monaten haben mehrere große KI-Anbieter als Reaktion auf den Wettbewerbsdruck ihre API-Preise gesenkt. DeepSeeks Schritt, eine dauerhafte Senkung um 75% bei einem Flaggschiffmodell festzulegen, erhöht die Erwartungen der Entwickler an die Preisgestaltung von Spitzen-KI.
Die Ankündigung ist auch als Signal für die breitere KI-Infrastrukturwirtschaft bemerkenswert. Wenn hochleistungsfähige Inferenz zu Preisen unter einem Dollar pro Million Tokens zum Marktstandard wird, könnte dies die Einführung von KI in kostenempfindlichen Sektoren wie Bildungstechnologie, Entwicklertools und Kleinunternehmensanwendungen beschleunigen.
Was kommt als Nächstes
DeepSeek hat angegeben, dass die offizielle Preisanpassung nach Abschluss des Aktionszeitraums am 31. Mai 2026 um 15:59 UTC in Kraft tritt. Nach diesem Datum werden die dauerhaft reduzierten Preise die Standardtarife in der API-Dokumentation sein. Entwickler, die derzeit von den Aktionspreisen profitieren, werden keine Unterbrechung oder Änderung ihrer Abrechnungssätze erfahren.
Das Unternehmen hat keine weiteren Preisänderungen oder zusätzliche Modellveröffentlichungen im Zusammenhang mit dieser Entscheidung angekündigt, obwohl die Spekulationen in der Entwicklergemeinschaft darüber andauern, wann V4-Pro einen Nachfolger erhalten wird und ob ähnliche dauerhafte Rabattstrategien für zukünftige Modellgenerationen gelten werden.