284B gesamt, 13B aktiv
Eine spärliche Mischung von Experten: Nur etwa 13 Milliarden Parameter werden pro Token aktiviert, weshalb es schnell antwortet und so wenig kostet.
DeepSeek V4 Flash ist die kostengünstige Hälfte der V4-Familie: etwa 284 Milliarden Gesamtparameter mit nur 13 Milliarden aktiven Parametern pro Token, einem Kontextfenster von 1 Million Tokens und hybrider Aufmerksamkeit, entwickelt für lange Agentenläufe. Der am 31. Juli 2026 veröffentlichte Build 0731 behielt die gleiche Architektur bei und überarbeitete das Post-Training. DeepSeek berichtet, dass er nun in neun Agenten-Benchmarks seinen eigenen V4-Pro-Preview übertrifft. Auf avots.ai nutzen Sie es Pay-per-Use, ohne DeepSeek-Konto und ohne Abonnement, und dasselbe Guthaben deckt auch Claude Opus 5, GPT-5.6, Gemini und über 40 Bild-, Video- und Musikmodelle ab.
Eine spärliche Mischung von Experten: Nur etwa 13 Milliarden Parameter werden pro Token aktiviert, weshalb es schnell antwortet und so wenig kostet.
Eine volle Million Tokens in einer Konversation, mit sehr großen Ausgaben, sodass ganze Repositories und Dokumentensätze in einem einzigen Durchlauf passen.
Pro Million Tokens auf DeepSeeks eigener Liste, mit zwischengespeicherten Eingaben zu 0,0028 USD, sodass wiederholter Kontext in Agenten-Schleifen fast kostenlos ist.
DeepSeek meldete für den Build 0731, zusammen mit 70.3 auf Toolathlon verified und 76.7 auf Cybergym.
Auf dem unabhängigen Artificial Analysis Intelligence Index, gegenüber einem Median von 25 für vergleichbare Modelle.
Keine Bildeingabe bei diesem Modell. Für Screenshots und Scans wechseln Sie zu Qwen3.7 oder Gemini mit demselben Guthaben.
| DeepSeek V4 Flash | DeepSeek V4-Pro | Qwen3.7 Flash | |
|---|---|---|---|
| Preis pro 1M rein / raus | $0.14 / $0.28 | $0.435 / $0.87 | $0.03 / $0.13 |
| Parameter | 284B gesamt, 13B aktiv | etwa 1.6T gesamt, 49B aktiv | nicht veröffentlicht |
| Kontextfenster | 1M Tokens | 1M Tokens | 1M Tokens |
| Terminal-Bench 2.1 | 82.7 | nicht veröffentlicht | nicht veröffentlicht |
| Toolathlon verified | 70.3 | nicht veröffentlicht | nicht veröffentlicht |
| Bildeingabe | nein | nein | ja |
| Auf avots.ai | Pay-per-Use | Pay-per-Use | Pay-per-Use |
Agenten-Scores werden vom Anbieter gemeldet und sind sehr empfindlich gegenüber dem Testsystem, daher sollten sie als Richtung, nicht als Urteil betrachtet werden. Unzweifelhaft ist der Preisunterschied: Flash läuft zu etwa einem Drittel des Preises von V4-Pro pro Token, und Qwen3.7 Flash unterbietet beide und bietet zusätzlich Bildeingabe. Alle drei befinden sich im selben Auswahlmenü.
Identische Architektur und Größe wie der Preview-Build. Alle Verbesserungen stammen aus überarbeitetem Post-Training, nicht aus einem neuen Basismodell.
DeepSeek meldet 54.4 auf DeepSWE, 54.2 auf NL2Repo und 25.2 auf Agents' Last Exam, sein bisher stärkstes Agenten-Set.
Cache-Hit-Eingaben zu 0,0028 USD pro Million Tokens machen Tool-Schleifen, die denselben Prompt erneut senden, wirklich günstig.
Hoher und maximaler Denkaufwand werden unterstützt, sodass Sie nur bei den Anrufen mehr nachdenken, die es erfordern.
Registrieren Sie sich auf app.avots.ai mit E-Mail, Google oder Telegram. Dauert eine Minute.
1.000 Tokens kosten 0,99 EUR. Kein Plan zur Auswahl, keine Verlängerung, das Guthaben bleibt, bis Sie es nutzen.
Wählen Sie DeepSeek V4 Flash im Modell-Auswahlmenü, oder lassen Sie Agent Avots für Sie routen. Jede Antwort zeigt ihre Token-Kosten an.
app.avots.ai auf Desktop und Mobilgeräten, keine Installation erforderlich.
V4 Flash in @AvotsAIbot, gleiches Guthaben, von jedem Telefon aus.
Nutzen Sie es innerhalb von Claude Desktop, Cursor oder Cline über den MCP-Server.
Die OpenAI-kompatible API nutzt Ihren bestehenden Client, ein Schlüssel für jedes Modell.
1.000 Tokens kosten 0,99 EUR, und eine Flash-Antwort kostet nur wenige davon. Dasselbe Guthaben schaltet Claude Opus 5, GPT-5.6, Gemini, Veo Video und Nano Banana Bilder frei, ohne jegliches Abonnement.
Registrieren und chatten ✦Die gesamte Familie, V4-Pro und V4-Flash, offene Gewichte und 1M Kontext.
Jedes LLM auf avots.ai und welches für welche Aufgabe am besten geeignet ist.
Alibabas Max-, Plus- und Flash-Stufen, 1M Kontext, Vision bei den kleinen Modellen.
Moonshots führendes offenes Modell, Nummer eins im Coding, 1M Kontext.
Anthropic's neuestes Flaggschiff, 1M Kontext, 96% SWE-bench Verified.
Was man anstelle von ChatGPT Plus verwenden kann und wie ein Guthaben es ersetzt.
avots.ai betreibt über 40 KI-Modelle für Chat, Bild, Video und Audio mit einem Guthaben. Die vollständige Liste finden Sie auf der Tools-Seite oder öffnen Sie die App und beginnen Sie mit der Erstellung.