DeepSeek verdoppelt den Umsatz trotz vervielfachter Preise: Das Ende der Billig-API

Seit August kostet DeepSeek ein Mehrfaches, der Umsatz steigt trotzdem auf eine Milliarde Dollar im Jahr. Was das für KI-Budgets heißt.

Laptop mit stark steigendem Kostendiagramm neben Rechnung, Taschenrechner und Tischuhr

DeepSeek galt lange als der Anbieter, der die Preise für große Sprachmodelle nach unten drückt. Jetzt zeigt sich, dass die Kunden auch dann bleiben, wenn es teurer wird. Nach einem Bericht von The Information vom 24. September 2026 hat das chinesische KI-Unternehmen seinen hochgerechneten Jahresumsatz auf rund eine Milliarde US-Dollar gesteigert, nach zuvor etwa 500 Millionen. Und das, obwohl DeepSeek seine Schnittstellenpreise Mitte August um ein Mehrfaches angehoben hat.

DeepSeek selbst hat die Zahlen nicht kommentiert. Sie stammen aus einer Quelle, wurden aber von mehreren Wirtschaftsmedien übernommen, darunter PYMNTS und The Next Web.

Was sich im August geändert hat

Seit dem 16. August 2026 rechnet DeepSeek nach Tageszeit ab. Werktags gelten zwei Spitzenzeitfenster, nach deutscher Sommerzeit von 3 bis 6 Uhr und von 8 bis 12 Uhr. In dieser Zeit gilt der volle Preis, außerhalb davon die Hälfte. Beim Spitzenmodell V4-Pro stieg der Preis für eine Million ausgegebene Token von 0,87 auf 1,98 Dollar in der Nebenzeit und 3,96 Dollar in der Spitzenzeit, also auf das 2,3- bis 4,5-Fache. Noch stärker zog der Preis für zwischengespeicherte Eingaben an: um das 6- bis 12-Fache.

Begründet hat DeepSeek den Schritt damit, Ressourcen vernünftiger verteilen zu wollen. Die Rechenkapazität ist knapp. Mark Tauschek vom Analysehaus Info-Tech fasste die Logik gegenüber InfoWorld knapp zusammen:

Wenn die Nachfrage steigt, steigen die Preise, weil das Angebot knapp wird.

Mit dem im September erschienenen DeepSeek V4.1-Flash gibt es wieder ein günstigeres Modell: 0,15 bis 0,30 Dollar je Million Eingabe-Token und 0,60 bis 1,20 Dollar je Million Ausgabe-Token. Das liegt aber immer noch beim Zwei- bis Vierfachen des Ausgabepreises, den das Flash-Modell vor August hatte.

Serverschränke in einem Rechenzentrum

Die Zahlen hinter dem Wachstum

Laut The Information erzielt DeepSeek im Schnittstellengeschäft eine Bruttomarge von 82,9 Prozent, die Preise liegen also weit über den Kosten. Von Januar bis Juli 2026 setzte das Unternehmen nach Angaben von The Next Web 475 Millionen Yuan um, etwa zehnmal so viel wie im Vorjahreszeitraum.

Parallel verhandelt DeepSeek eine Finanzierungsrunde über 50 Milliarden Yuan bei einer Bewertung von 500 Milliarden Yuan, umgerechnet rund 70 Milliarden Dollar. Sie soll bis Ende Oktober abgeschlossen werden, danach ist ein Börsengang an der Shanghaier Technologiebörse STAR Market geplant.

Ein Muster, kein Einzelfall

DeepSeek steht mit dieser Entwicklung nicht allein. Die großen Anbieter investieren Hunderte Milliarden in Rechenzentren und müssen diese Ausgaben wieder hereinholen. Günstige Einstiegspreise dienen dazu, Marktanteile zu gewinnen, dauerhaft garantiert sind sie nicht. Gleichzeitig sinken die Kosten pro Leistungseinheit durch neue Modellgenerationen weiter. Für Anwender heißt das: Preise bewegen sich in beide Richtungen, und oft schneller, als ein Projekt läuft.

Für europäische Unternehmen kommt bei DeepSeek der Datenschutz hinzu. Die Berliner Datenschutzbeauftragte hat die DeepSeek-App bereits 2025 bei Apple und Google als rechtswidrig gemeldet, weil Daten nach China übermittelt werden und ein EU-Vertreter fehlt. Italien sperrt den Dienst seit Januar 2025. Die Schnittstelle für personenbezogene Daten zu nutzen, ist damit kaum belastbar abzusichern. Anders sieht es bei den offenen Gewichten aus: Die Modelle stehen weiter auf Hugging Face bereit und lassen sich selbst betreiben, wegen ihrer Größe allerdings nur auf entsprechend ausgestatteten Servern.

Was das für Ihr Unternehmen heißt

  • Kalkulieren Sie nicht mit Tiefstpreisen. Wer eine Automatisierung auf Basis eines Aktionspreises durchrechnet, sollte das Zwei- bis Dreifache als Stresstest einplanen. Trägt sich das Projekt dann noch, ist es solide.
  • Halten Sie das Modell austauschbar. Eine Anwendung, die über eine Zwischenschicht oder einen OpenAI-kompatiblen Endpunkt angebunden ist, lässt sich bei einer Preiserhöhung in Tagen statt Wochen umstellen.
  • Nutzen Sie Zeitfenster und Zwischenspeicher bewusst. Stapelverarbeitung, die nachts oder außerhalb von Spitzenzeiten läuft, kostet bei tageszeitabhängigen Tarifen die Hälfte. Wiederkehrende Anweisungen lassen sich oft zwischenspeichern.
  • Setzen Sie Budgetgrenzen und Alarme. Monatliche Obergrenzen und Benachrichtigungen bei Ausreißern verhindern, dass eine Preisänderung erst mit der Rechnung auffällt.
  • Trennen Sie nach Schutzbedarf. Für personenbezogene oder vertrauliche Daten kommen chinesische Schnittstellen kaum infrage. Offene Modelle auf eigener oder europäischer Infrastruktur sind hier die Alternative.

Wenn Sie wissen möchten, wie belastbar die Kostenrechnung Ihrer KI-Anwendungen ist und wie Sie sich gegen Preissprünge absichern, sprechen Sie uns an.

Richard von Rüden
Über den Autor Richard von Rüden Senior Entwickler & AI Engineer

Seit über 15 Jahren entwickle ich Websites und Apps und beschäftige mich intensiv mit KI-Automatisierung sowie Datenschutz. In meinen Artikeln teile ich aktuelle News, fundiertes Fachwissen und Erfahrungen aus zahlreichen Projekten.

Kostenlose Beratung
← Zurück zu den News