Anmelden
Alle KI-News
KI-News · 26. April 2026

DeepSeek V4: Frontier-Performance zum Bruchteil der Kosten

Bild: cnbc.com

Die Top-Story der letzten Tage ist nicht mehr Google, OpenAI oder Anthropic, sondern eine chinesische Open-Source-Firma: DeepSeek hat seine V4-Modelle als Preview veroeffentlicht und liefert damit Frontier-Niveau zu Preisen, die den US-Anbietern weh tun. CNBC, Bloomberg und Forbes haben die Story am 24. bis 26. April aufgegriffen. Forbes nennt es schlicht: "Das naechste KI-Rennen geht um Effizienz."

Die harten Zahlen

  • Zwei Modelle: V4-Pro-Max mit 1,6 Billionen Parametern und V4 Flash mit 284 Milliarden Parametern, beide als Mixture-of-Experts gebaut
  • 1 Million Token Kontext-Fenster in beiden Varianten
  • V4 Flash kostet 0,14 USD pro 1 Million Input-Tokens. Zum Vergleich: Claude Sonnet liegt bei rund 3 USD, GPT-5 bei rund 1,50 USD pro Million Input-Tokens
  • Open Source. Beide Modellgewichte sind verfuegbar, jeder kann sie selbst hosten
  • Performance laut Benchmark-Reports vergleichbar mit Top-Modellen aus den USA

Warum das spannend ist

Der eigentliche Punkt ist nicht die schiere Groesse, sondern das Preis-Leistungs-Verhaeltnis. Wenn ein chinesisches Modell mit Open-Source-Gewichten auf dem Niveau von Closed-Source-Frontier-Modellen liefert und dabei zehn- bis zwanzigmal guenstiger pro Token ist, kippt die Preis-Logik des gesamten Marktes. Anthropic, OpenAI und Google koennen ihre Premium-Preise nur halten, solange ihr Qualitaetsvorsprung sichtbar ist. DeepSeek frisst genau diesen Vorsprung auf.

Forbes formuliert es so: das naechste Jahr entscheidet sich nicht mehr ueber Modellgroesse, sondern ueber Effizienz pro Token. Bloomberg und SCMP heben hervor, dass DeepSeek von Huawei-Chips unterstuetzt wird, also unabhaengig von Nvidia-Lieferketten skalieren kann. Das ist auch geopolitisch ein Signal.

Was das fuer dich als Unternehmer bedeutet

  • Plane KI-Kosten konservativer. Wer heute Claude oder GPT in einem Produkt verbaut, muss sich klarmachen, dass die Preise in den naechsten 6 bis 12 Monaten unter Druck kommen koennen. Vertrags-Lock-ins ueber drei Jahre sind ein Risiko, nicht eine Sicherheit.
  • Open-Source-Modelle gehoeren auf den Tisch. Wer KI in eigene Produkte einbaut und dabei sensible Daten verarbeitet, kann V4 selbst hosten. Auf eigener Hardware oder bei einem deutschen Cloud-Anbieter, ohne dass Daten an OpenAI oder Anthropic gehen.
  • Die Lernkurve fuer kleine Teams flacht ab. Mit V4 Flash bekommst du Frontier-Qualitaet zu Preisen, die fuer experimentelles Bauen taugen. Was vor sechs Monaten noch ein Enterprise-Budget brauchte, laesst sich jetzt im Hobby-Account testen.
  • Vorsicht mit dem Hype. "Preview" heisst Preview. Latenz, Stabilitaet und Tooling-Integration sind bei einem frischen Open-Source-Release oft anders als bei kommerziellen Anbietern. Fuer produktive Workloads erstmal pruefen, nicht blind umstellen.

Quellen


Manuell zusammengefasst aus oeffentlich zugaenglichen Quellen. Keine Rechts- oder Fachberatung.

Was meinst du dazu?

Mitreden im Lab

Kommentieren können Mitglieder. Die Mitgliedschaft ist kostenlos und bringt dir Tutorials, Werkzeuge und den Stammtisch.

Weitere Meldungen