DeepSeek aktualisiert V4-Pro-Modell mit 1M Kontext und 384K Ausgabefähigkeit

DeepSeek hat das Modell deepseek-v4-pro auf die Version DeepSeek-V4-Pro-0813 aktualisiert. Laut den derzeit veröffentlichten Informationen gab es bei diesem Update keine Preisänderung. Obwohl DeepSeek zuvor angekündigt hatte, die Preise für die API-Dienste in naher Zukunft insgesamt zu erhöhen, bleiben die aktuellen Preise für die verschiedenen Stufen unverändert.

Kernspezifikationen des Updates DeepSeek-V4-Pro-0813

In Bezug auf die Kernspecifikationen unterstützt deepseek-v4-pro eine Kontextlänge von 1M und eine maximale Ausgabelänge von 384K Token. Es unterstützt sowohl den Non-Thinking- als auch den Thinking-Modus, wobei der Thinking-Modus standardmäßig aktiviert ist. Für die Verarbeitung von langen Codebasen, die Analyse umfangreicher Dokumente und Agentenaufgaben, die eine kontinuierliche Ausführung vieler Schritte erfordern, bedeutet das 1M Kontextfenster und die maximale Ausgabe von 384K, dass der Inhalt, der bei einem einzelnen Aufruf verarbeitet und generiert werden kann, erheblich ist, was die Kosten für mehrfache Aufteilungen und Zusammenfügungen reduziert.

In Bezug auf die unterstützenden Funktionen deckt deepseek-v4-pro die aktuellen Anforderungen an die Entwicklung von Agenten weitgehend ab. Das Modell unterstützt JSON Output, Tool Calls, Responses API und Anthropic API und bietet zudem Beta-Funktionen für das Fortsetzen von Dialogpräfixen und FIM-Vervollständigung, wobei die FIM-Vervollständigung nur im Non-Thinking-Modus verwendet werden kann.

Was die API-Integrationsmethoden betrifft, so ist deepseek-v4-pro sowohl mit OpenAI als auch mit Anthropic kompatibel, sodass Entwickler je nach ihrem Technologiestack flexibel den Integrationsweg wählen können. Preislich liegt der aktuelle Abrechnungsstandard von deepseek-v4-pro bei 0,025 Yuan für Cache-Hit-Eingaben, 3 Yuan für Cache-Miss-Eingaben und 6 Yuan für Ausgaben pro Million Token.

Preis- und Leistungsvergleich der Pro-Version von DeepSeek

Im Vergleich dazu liegen die Preise für die gleiche Serie, deepseek-v4-flash, bei 0,02 Yuan für Cache-Hit-Eingaben, 1 Yuan für Cache-Miss-Eingaben und 2 Yuan für Ausgaben pro Million Token. Das bedeutet, dass die Preise der Pro-Version für die beiden Hauptabrechnungspunkte, Cache-Miss-Eingaben und Ausgaben, jeweils das Dreifache der Preise der Flash-Version betragen. Obwohl der absolute Preis der Pro-Version höher ist als der der Flash-Version, bleibt das Preis-Leistungs-Verhältnis pro Token aufgrund des größeren Kontextfensters und der höheren Ausgabefähigkeit wettbewerbsfähig.

Die beiden Versionen unterscheiden sich auch in den Parallelitätsbeschränkungen. Die Parallelitätsbeschränkung von deepseek-v4-flash beträgt 2500, während die von deepseek-v4-pro 500 beträgt. Aus dieser Konfigurationsdifferenz lässt sich ableiten, dass Flash klarer auf hochfrequente, großangelegte Aufruf-Szenarien ausgerichtet ist, die schnelle Antworten und viele parallele Anfragen erfordern; während Pro die Ressourcen weiter auf anspruchsvollere Aufgaben konzentriert und die Tiefe und Komplexität einzelner Aufrufe priorisiert.

stone
stone