284B au total, 13B actifs
Un mélange d'experts épars: seulement environ 13 milliards de paramètres s'activent par jeton, c'est pourquoi il répond rapidement et coûte si peu.
DeepSeek V4 Flash est la moitié économique de la famille V4: environ 284 milliards de paramètres au total avec seulement 13 milliards actifs par jeton, une fenêtre de contexte d'un million de jetons et une attention hybride conçue pour les longues exécutions d'agents. La version 0731, publiée le 31 juillet 2026, a conservé le même corps et a refait le post-entraînement, et DeepSeek rapporte qu'elle bat désormais sa propre préversion V4-Pro sur neuf benchmarks d'agents. Sur avots.ai, vous l'exécutez en paiement à l'usage, sans compte DeepSeek et sans abonnement, et le même solde couvre également Claude Opus 5, GPT-5.6, Gemini et plus de 40 modèles d'image, de vidéo et de musique.
Un mélange d'experts épars: seulement environ 13 milliards de paramètres s'activent par jeton, c'est pourquoi il répond rapidement et coûte si peu.
Un million de jetons complets dans une conversation, avec de très grandes sorties, de sorte que des référentiels entiers et des ensembles de documents tiennent en un seul passage.
Par million de jetons sur la propre liste de DeepSeek, avec une entrée en cache à 0,0028 USD, de sorte que le contexte répété dans les boucles d'agents est presque gratuit.
DeepSeek a rapporté pour la version 0731, ainsi que 70.3 sur Toolathlon vérifié et 76.7 sur Cybergym.
Sur l'indice indépendant Artificial Analysis Intelligence, contre une médiane de 25 pour des modèles comparables.
Pas d'entrée d'image sur celui-ci. Pour les captures d'écran et les scans, passez à Qwen3.7 ou Gemini sur le même solde.
| DeepSeek V4 Flash | DeepSeek V4-Pro | Qwen3.7 Flash | |
|---|---|---|---|
| Prix par 1M en entrée / sortie | $0.14 / $0.28 | $0.435 / $0.87 | $0.03 / $0.13 |
| Paramètres | 284B au total, 13B actifs | environ 1.6T au total, 49B actifs | non publié |
| Fenêtre de contexte | 1M de jetons | 1M de jetons | 1M de jetons |
| Terminal-Bench 2.1 | 82.7 | non publié | non publié |
| Toolathlon vérifié | 70.3 | non publié | non publié |
| Entrée d'image | non | non | oui |
| Sur avots.ai | paiement à l'usage | paiement à l'usage | paiement à l'usage |
Les scores d'agent sont rapportés par le fournisseur et très sensibles au harnais, il faut donc les traiter comme une direction, pas un verdict. Ce qui n'est pas en doute, c'est l'écart de prix: Flash fonctionne à environ un tiers du prix de V4-Pro par jeton, et Qwen3.7 Flash est moins cher que les deux tout en ajoutant l'entrée d'image. Les trois se trouvent dans le même sélecteur.
Architecture et taille identiques à la version préliminaire. Tous les gains proviennent d'un post-entraînement refait, et non d'un nouveau modèle de base.
DeepSeek rapporte 54.4 sur DeepSWE, 54.2 sur NL2Repo et 25.2 sur Agents' Last Exam, son ensemble d'agents le plus puissant à ce jour.
L'entrée en cache à 0,0028 USD par million de jetons rend les boucles d'outils qui renvoient la même invite vraiment bon marché.
Les efforts de raisonnement élevés et maximaux sont pris en charge, de sorte que vous ne consacrez plus de réflexion qu'aux appels qui en ont besoin.
Inscrivez-vous sur app.avots.ai avec votre e-mail, Google ou Telegram. Cela prend une minute.
1 000 jetons coûtent 0,99 EUR. Pas de plan à choisir, pas de renouvellement, le solde reste là jusqu'à ce que vous l'utilisiez.
Choisissez DeepSeek V4 Flash dans le sélecteur de modèles, ou laissez Agent Avots router pour vous. Chaque réponse affiche son coût en jetons.
app.avots.ai sur ordinateur et mobile, aucune installation nécessaire.
V4 Flash dans @AvotsAIbot, même solde, depuis n'importe quel téléphone.
Utilisez-le dans Claude Desktop, Cursor ou Cline via le serveur MCP.
L'API compatible OpenAI utilise votre client existant, une seule clé pour chaque modèle.
1 000 jetons coûtent 0,99 EUR et une réponse Flash en coûte une poignée. Le même solde débloque Claude Opus 5, GPT-5.6, Gemini, la vidéo Veo et les images Nano Banana, sans aucun abonnement.
S'inscrire et discuter ✦La famille complète, V4-Pro et V4-Flash, poids ouverts et contexte 1M.
Chaque LLM sur avots.ai et lequel choisir par tâche.
Les niveaux Max, Plus et Flash d'Alibaba, contexte 1M, vision sur les petits.
Le modèle ouvert de pointe de Moonshot, numéro un en codage, contexte 1M.
Le nouveau fleuron d'Anthropic, contexte 1M, 96% SWE-bench Verified.
Ce qu'il faut utiliser à la place de ChatGPT Plus et comment un seul solde le remplace.
avots.ai exécute plus de 40 modèles d'IA pour le chat, l'image, la vidéo et l'audio sur un seul solde. Consultez la liste complète sur la page Outils ou ouvrez l'application et commencez à créer.