Agenten-Upgrade, Build 0731

DeepSeek V4 Flash online, Pay-per-Use

DeepSeek V4 Flash ist die kostengünstige Hälfte der V4-Familie: etwa 284 Milliarden Gesamtparameter mit nur 13 Milliarden aktiven Parametern pro Token, einem Kontextfenster von 1 Million Tokens und hybrider Aufmerksamkeit, entwickelt für lange Agentenläufe. Der am 31. Juli 2026 veröffentlichte Build 0731 behielt die gleiche Architektur bei und überarbeitete das Post-Training. DeepSeek berichtet, dass er nun in neun Agenten-Benchmarks seinen eigenen V4-Pro-Preview übertrifft. Auf avots.ai nutzen Sie es Pay-per-Use, ohne DeepSeek-Konto und ohne Abonnement, und dasselbe Guthaben deckt auch Claude Opus 5, GPT-5.6, Gemini und über 40 Bild-, Video- und Musikmodelle ab.

DeepSeek V4 Flash jetzt nutzen ✦ Preise ansehen
Spezifikationen

DeepSeek V4 Flash auf einen Blick

284B gesamt, 13B aktiv

Eine spärliche Mischung von Experten: Nur etwa 13 Milliarden Parameter werden pro Token aktiviert, weshalb es schnell antwortet und so wenig kostet.

1M Token Kontext

Eine volle Million Tokens in einer Konversation, mit sehr großen Ausgaben, sodass ganze Repositories und Dokumentensätze in einem einzigen Durchlauf passen.

0,14 USD rein, 0,28 USD raus

Pro Million Tokens auf DeepSeeks eigener Liste, mit zwischengespeicherten Eingaben zu 0,0028 USD, sodass wiederholter Kontext in Agenten-Schleifen fast kostenlos ist.

82.7 Terminal-Bench 2.1

DeepSeek meldete für den Build 0731, zusammen mit 70.3 auf Toolathlon verified und 76.7 auf Cybergym.

Index-Score 50

Auf dem unabhängigen Artificial Analysis Intelligence Index, gegenüber einem Median von 25 für vergleichbare Modelle.

Text rein, Text raus

Keine Bildeingabe bei diesem Modell. Für Screenshots und Scans wechseln Sie zu Qwen3.7 oder Gemini mit demselben Guthaben.

Reale Zahlen

V4 Flash neben V4-Pro und Qwen3.7 Flash

 DeepSeek V4 FlashDeepSeek V4-ProQwen3.7 Flash
Preis pro 1M rein / raus$0.14 / $0.28$0.435 / $0.87$0.03 / $0.13
Parameter284B gesamt, 13B aktivetwa 1.6T gesamt, 49B aktivnicht veröffentlicht
Kontextfenster1M Tokens1M Tokens1M Tokens
Terminal-Bench 2.182.7nicht veröffentlichtnicht veröffentlicht
Toolathlon verified70.3nicht veröffentlichtnicht veröffentlicht
Bildeingabeneinneinja
Auf avots.aiPay-per-UsePay-per-UsePay-per-Use

Agenten-Scores werden vom Anbieter gemeldet und sind sehr empfindlich gegenüber dem Testsystem, daher sollten sie als Richtung, nicht als Urteil betrachtet werden. Unzweifelhaft ist der Preisunterschied: Flash läuft zu etwa einem Drittel des Preises von V4-Pro pro Token, und Qwen3.7 Flash unterbietet beide und bietet zusätzlich Bildeingabe. Alle drei befinden sich im selben Auswahlmenü.

Was ist neu

Was der Build 0731 geändert hat

Gleicher Kern, neues Training

Identische Architektur und Größe wie der Preview-Build. Alle Verbesserungen stammen aus überarbeitetem Post-Training, nicht aus einem neuen Basismodell.

Agentenverhalten zuerst

DeepSeek meldet 54.4 auf DeepSWE, 54.2 auf NL2Repo und 25.2 auf Agents' Last Exam, sein bisher stärkstes Agenten-Set.

Günstiger wiederholter Kontext

Cache-Hit-Eingaben zu 0,0028 USD pro Million Tokens machen Tool-Schleifen, die denselben Prompt erneut senden, wirklich günstig.

Anstrengungsstufen

Hoher und maximaler Denkaufwand werden unterstützt, sodass Sie nur bei den Anrufen mehr nachdenken, die es erfordern.

V4 Flash auf avots ausprobieren
Drei Schritte

DeepSeek V4 Flash nutzen

Konto erstellen

Registrieren Sie sich auf app.avots.ai mit E-Mail, Google oder Telegram. Dauert eine Minute.

Ab 0,99 EUR aufladen

1.000 Tokens kosten 0,99 EUR. Kein Plan zur Auswahl, keine Verlängerung, das Guthaben bleibt, bis Sie es nutzen.

V4 Flash auswählen

Wählen Sie DeepSeek V4 Flash im Modell-Auswahlmenü, oder lassen Sie Agent Avots für Sie routen. Jede Antwort zeigt ihre Token-Kosten an.

Registrieren und starten
Ein Guthaben

Wo Sie DeepSeek V4 Flash nutzen können

Web-App

app.avots.ai auf Desktop und Mobilgeräten, keine Installation erforderlich.

Telegram

V4 Flash in @AvotsAIbot, gleiches Guthaben, von jedem Telefon aus.

MCP

Nutzen Sie es innerhalb von Claude Desktop, Cursor oder Cline über den MCP-Server.

DeepSeek V4 Flash für unter einem Euro testen

1.000 Tokens kosten 0,99 EUR, und eine Flash-Antwort kostet nur wenige davon. Dasselbe Guthaben schaltet Claude Opus 5, GPT-5.6, Gemini, Veo Video und Nano Banana Bilder frei, ohne jegliches Abonnement.

Registrieren und chatten ✦
Anleitungen

Verwandte Seiten

DeepSeek V4

Die gesamte Familie, V4-Pro und V4-Flash, offene Gewichte und 1M Kontext.

KI-Chat-Modelle Hub

Jedes LLM auf avots.ai und welches für welche Aufgabe am besten geeignet ist.

Qwen3.7

Alibabas Max-, Plus- und Flash-Stufen, 1M Kontext, Vision bei den kleinen Modellen.

Kimi K3

Moonshots führendes offenes Modell, Nummer eins im Coding, 1M Kontext.

Claude Opus 5

Anthropic's neuestes Flaggschiff, 1M Kontext, 96% SWE-bench Verified.

ChatGPT Alternative

Was man anstelle von ChatGPT Plus verwenden kann und wie ein Guthaben es ersetzt.

avots.ai betreibt über 40 KI-Modelle für Chat, Bild, Video und Audio mit einem Guthaben. Die vollständige Liste finden Sie auf der Tools-Seite oder öffnen Sie die App und beginnen Sie mit der Erstellung.

Alle Modellseiten durchsuchen App öffnen
FAQ

Fragen zu DeepSeek V4 Flash

Was ist DeepSeek V4 Flash?
DeepSeek V4 Flash ist das kleine, schnelle Mitglied der DeepSeek V4 Familie: ein Mixture-of-Experts-Modell mit etwa 284 Milliarden Gesamtparametern und nur 13 Milliarden aktiven Parametern pro Token, einem Kontextfenster von 1 Million Tokens sowie Text-Ein- und -Ausgabe. Es wurde für Coding-Assistenten, Tool-Calling und lange Agenten-Schleifen entwickelt, bei denen Geschwindigkeit und Preis wichtiger sind als absolute Spitzen-Argumentationsfähigkeit.
Was hat sich im Build 0731 geändert?
DeepSeek hat den V4-Flash-0731 Build am 31. Juli 2026 veröffentlicht. Die Architektur und Größe haben sich nicht geändert, nur das Post-Training wurde überarbeitet, und die Verbesserungen liegen im Agentenverhalten und Tool-Calling. DeepSeek meldet für diesen Build 82.7 auf Terminal-Bench 2.1, 70.3 auf Toolathlon verified und 76.7 auf Cybergym.
Wie viel kostet DeepSeek V4 Flash?
DeepSeek listet 0,14 USD pro Million Eingabe-Tokens und 0,28 USD pro Million Ausgabe-Tokens, mit zwischengespeicherten Eingaben zu 0,0028 USD. Der unabhängige Artificial Analysis Index beziffert die gemischten Kosten auf etwa 0,06 USD pro Million Tokens. Auf avots.ai zahlen Sie nicht pro Million: Sie laden ab 0,99 EUR für 1.000 avots Tokens auf, und jede Antwort zeigt ihre Kosten an, bevor sie ausgeführt wird.
Flash oder V4-Pro, welches soll ich wählen?
Wählen Sie Flash für große Mengen: Agenten-Schleifen, Refactoring über viele Dateien hinweg, Chats, die sich sofort anfühlen sollen, alles, wo Sie denselben langen Kontext immer wieder senden. Wählen Sie V4-Pro für die schwierigsten einzelnen Antworten, wo seine 1,6 Billionen Parameter und der 93.5 LiveCodeBench-Score den höheren Preis rechtfertigen. Beide befinden sich im selben Auswahlmenü mit einem Guthaben, sodass Sie mitten in der Aufgabe wechseln können.
Kann DeepSeek V4 Flash Bilder lesen?
Nein. V4 Flash nimmt Text entgegen und gibt Text aus. Wenn Sie Screenshots oder Scans senden müssen, wechseln Sie im selben Auswahlmenü zu Qwen3.7, Gemini oder GPT-5.6. Ein avots.ai Guthaben deckt alle diese Modelle sowie Bild-, Video- und Musikmodelle ab.
Auf avots ausprobieren ✦
Erstellen starten