📰 News

DeepSeek V4: Neue KI-Modelle mit 1 Million Token Kontext zu Kampfpreisen

Kurz gesagt: DeepSeek hat die Modelle V4 Flash und V4 Pro über die eigene API veröffentlicht, bestätigt durch die offizielle Preis- und Modelldokumentation. Beide verarbeiten bis zu 1 Million Token Kontext und liefern bis zu 384.000 Token Ausgabe, unterstützen Tool-Calls und sind über eine Anthropic-kompatible Schnittstelle ansprechbar. Die Preise liegen mit 0,14 US-Dollar je 1 Million Input-Token beim günstigeren Flash-Modell deutlich unter dem, was westliche Anbieter derzeit aufrufen.

DeepSeek V4: Neue KI-Modelle mit 1 Million Token Kontext zu Kampfpreisen

Symbolbild: KI-generiert

Wer lange Dokumente, ganze Software-Projekte oder umfangreiche Gesprächsverläufe mit einer KI verarbeiten will, kennt das Problem: Die meisten Modelle vergessen den Anfang eines Textes, sobald er eine gewisse Länge überschreitet, oder das Ganze wird teuer, weil jeder verarbeitete Textabschnitt bezahlt werden muss. Genau an dieser Stelle setzt die jüngste Veröffentlichung des chinesischen KI-Anbieters DeepSeek an.

Laut der offiziellen Preis- und Modelldokumentation auf api-docs.deepseek.com sind zwei neue Modelle nun regulär über die DeepSeek-API nutzbar: V4 Flash und V4 Pro. Beide verarbeiten ein Kontextfenster von bis zu 1 Million Token - das entspricht grob mehreren hundert Seiten Text in einem einzigen Durchlauf - und können bis zu 384.000 Token als Antwort ausgeben. Beide Modelle unterstützen strukturierte JSON-Ausgaben sowie Tool-Calls, mit denen ein Modell etwa externe Programme oder Datenbanken ansteuern kann, und sind über eine zur Anthropic-Schnittstelle kompatible API erreichbar - das erleichtert Entwicklern, bestehende Anwendungen ohne größeren Umbau auf DeepSeek umzustellen.

Der eigentliche Unterschied liegt beim Preis

Am auffälligsten ist die Kostenseite: Für das schnellere Modell V4 Flash verlangt DeepSeek laut eigener Dokumentation 0,14 US-Dollar je 1 Million Input-Token, wenn der Text noch nicht zwischengespeichert wurde, und nur 0,0028 US-Dollar bei einem Cache-Treffer. Die Ausgabe kostet 0,28 US-Dollar je 1 Million Token. Das leistungsfähigere V4 Pro liegt mit 0,435 US-Dollar je 1 Million Input-Token beziehungsweise 0,87 US-Dollar für die Ausgabe zwar höher, bewegt sich damit aber weiterhin deutlich unterhalb der Preisspannen, die für vergleichbar leistungsfähige Modelle westlicher Anbieter aufgerufen werden. DeepSeek weist in der Dokumentation zudem auf künftig mögliche Spitzenzeiten-Tarife hin, bei denen die Preise zeitweise steigen könnten - ein fester Termin dafür ist bislang nicht genannt.

Was das für Nutzer bedeutet

Für alle, die eigene Anwendungen mit KI-Anbindung bauen oder große Textmengen automatisiert auswerten lassen - etwa lange Vertragswerke, komplette Codebasen oder umfangreiche Recherchen -, senkt das die Einstiegshürde spürbar: Ein Kontextfenster dieser Größe war bislang meist nur bei deutlich teureren Modellen verfügbar. Wer bereits Anwendungen auf Basis der Anthropic-API betreibt, kann die neuen Modelle durch die kompatible Schnittstelle vergleichsweise unkompliziert testen. Wie sich die Qualität der Antworten gegenüber etablierten Anbietern im Alltag tatsächlich schlägt, lässt sich anhand der Preisliste allein nicht beurteilen - das zeigt sich erst in der praktischen Nutzung. Klar ist aber: DeepSeek untermauert mit V4 Flash und V4 Pro erneut seinen Ruf als besonders günstige Alternative im KI-Markt.

Quelle & Einordnung: Anlass dieser Meldung: DeepSeek API-Dokumentation (api-docs.deepseek.com), Diskussion auf r/LocalLLaMA. Text, Bewertung und Bild sind unsere eigene, unabhängige Einordnung – wir geben keine fremden Inhalte im Wortlaut wieder.
🤖 Transparenz: Recherche und Text dieser Meldung entstehen mit KI-Werkzeugen. Themenauswahl, Einordnung und Veröffentlichung verantwortet die Redaktion – verantwortlich im Sinne des § 18 Abs. 2 MStV ist Jörg Schock.

← Alle News