DeepSeek-V4-Pro & V4-Flash werden mit einem Kontext von 1 M und einer Ausgabe von $0.28/M geliefert.

5. Juli 2026, 18:04

DeepSeek ist zurück und zielt direkt auf die Agenten-Community. Die neue V4-Serie besteht aus zwei Open-Weight-MoE-Modellen — V4-Pro (1,6 T gesamt, 49 B aktiv) und V4-Flash (284 B gesamt, 13 B aktiv) — die beide standardmäßig mit einem Kontextfenster von einer Million-Token ausgeliefert werden. Kein Premium‑Tier. Das Fundament.

Was es eigentlich ist

Dies sind API‑aufrufbare Frontier-Modelle, die für langfristige agentenbasierte Arbeit gebaut wurden — Codierungsschleifen, mehrstufige Werkzeugnutzung, die Art von Aufgabe, die Kontext verschlingt und nie loslässt. V4-Pro-Max erreicht 80,6 % bei SWE-bench Verified, die beste Open-Weight-Bewertung, gleichauf mit Gemini 3.1 Pro. V4-Flash erreicht beim Pro‑Modell bei einfacheren Agenten-Aufgaben dieselbe Leistung bei 12‑fach geringeren Kosten, sodass die meisten Nutzer Flash einsetzen und nur bei Bedarf auf das stärkere Modell umsteigen.

Warum es wichtig ist

Der Preis ist die Waffe. Flash wird mit $0.14 /M Eingabe und $0.28 /M Ausgabe angegeben; die Cache-Hit-Rate von Pro sinkt auf $0.003625 /M — brutal für Agenten-Schleifen, die jede Runde denselben Kontext erneut senden. DeepSeek hat zudem eine Spitzen-Stunden-Aufschlag-Preisgestaltung eingeführt und soll $7,4 Mrd. bei einer Bewertung von über $50 Mrd. eingenommen haben. Das Vorgehen ist dasselbe wie bei V3: Die Model-Schicht zu commodifizieren, alle dazu zwingen, über die Kosten zu konkurrieren. Langzeit-Kontext-Agenten sind jetzt deutlich günstiger.