284B totali, 13B attivi
Una mixture of experts sparsa: solo circa 13 miliardi di parametri si attivano per token, ecco perché risponde velocemente e costa così poco.
DeepSeek V4 Flash è la metà economica della famiglia V4: circa 284 miliardi di parametri totali con solo 13 miliardi attivi per token, una finestra di contesto di 1 milione di token e attenzione ibrida costruita per lunghe esecuzioni di agenti. La build 0731, rilasciata il 31 luglio 2026, ha mantenuto lo stesso corpo e ha rifatto il post-training, e DeepSeek riporta che ora supera la sua anteprima V4-Pro in nove benchmark di agenti. Su avots.ai lo esegui pagando per uso, senza un account DeepSeek e senza abbonamento, e lo stesso saldo copre anche Claude Opus 5, GPT-5.6, Gemini e oltre 40 modelli di immagini, video e musica.
Una mixture of experts sparsa: solo circa 13 miliardi di parametri si attivano per token, ecco perché risponde velocemente e costa così poco.
Un milione di token in una conversazione, con output molto grandi, così interi repository e set di documenti si adattano in un singolo passaggio.
Per milione di token sull'elenco di DeepSeek, con input in cache a 0,0028 USD, quindi il contesto ripetuto nei cicli degli agenti è quasi gratuito.
DeepSeek ha riportato per la build 0731, insieme a 70,3 su Toolathlon verificato e 76,7 su Cybergym.
Sull'indice indipendente Artificial Analysis Intelligence Index, contro una mediana di 25 per modelli comparabili.
Nessun input di immagine su questo. Per screenshot e scansioni passa a Qwen3.7 o Gemini con lo stesso saldo.
| DeepSeek V4 Flash | DeepSeek V4-Pro | Qwen3.7 Flash | |
|---|---|---|---|
| Prezzo per 1M in / out | $0.14 / $0.28 | $0.435 / $0.87 | $0.03 / $0.13 |
| Parametri | 284B totali, 13B attivi | circa 1.6T totali, 49B attivi | non pubblicato |
| Finestra di contesto | 1M token | 1M token | 1M token |
| Terminal-Bench 2.1 | 82.7 | non pubblicato | non pubblicato |
| Toolathlon verificato | 70.3 | non pubblicato | non pubblicato |
| Input immagine | no | no | sì |
| Su avots.ai | paga per uso | paga per uso | paga per uso |
I punteggi degli agenti sono riportati dal fornitore e molto sensibili all'ambiente di test, quindi trattali come un'indicazione, non un verdetto. Ciò che non è in dubbio è il divario di prezzo: Flash funziona a circa un terzo del costo di V4-Pro per token, e Qwen3.7 Flash è più economico di entrambi aggiungendo l'input di immagini. Tutti e tre si trovano nello stesso selettore.
Architettura e dimensioni identiche alla build di anteprima. Tutto ciò che è stato guadagnato deriva da un post-training rifatto, non da un nuovo modello base.
DeepSeek riporta 54,4 su DeepSWE, 54,2 su NL2Repo e 25,2 su Agents' Last Exam, il suo set di agenti più forte finora.
L'input con cache a 0,0028 USD per milione di token rende i cicli di strumenti che rispediscono lo stesso prompt davvero economici.
Sono supportati sforzi di ragionamento elevati e massimi, così spendi più tempo a pensare solo sulle chiamate che lo richiedono.
Iscriviti su app.avots.ai con email, Google o Telegram. Ci vuole un minuto.
1.000 token costano 0,99 EUR. Nessun piano da scegliere, nessun rinnovo, il saldo rimane lì finché non lo usi.
Scegli DeepSeek V4 Flash nel selettore del modello, oppure lascia che Agent Avots faccia il routing per te. Ogni risposta mostra il costo in token.
app.avots.ai su desktop e mobile, nessuna installazione necessaria.
V4 Flash in @AvotsAIbot, stesso saldo, da qualsiasi telefono.
Usalo all'interno di Claude Desktop, Cursor o Cline tramite il server MCP.
L'API compatibile OpenAI accetta il tuo client esistente, una chiave per ogni modello.
1.000 token costano 0,99 EUR e una risposta Flash costa solo una manciata di essi. Lo stesso saldo sblocca Claude Opus 5, GPT-5.6, Gemini, i video Veo e le immagini Nano Banana, senza alcun abbonamento.
Iscriviti e chatta ✦L'intera famiglia, V4-Pro e V4-Flash, pesi aperti e contesto da 1M.
Ogni LLM su avots.ai e quale scegliere per ogni attività.
I livelli Max, Plus e Flash di Alibaba, contesto da 1M, visione sui più piccoli.
Il modello open frontier di Moonshot, numero uno nella codifica, contesto da 1M.
L'ultimo fiore all'occhiello di Anthropic, contesto da 1M, 96% SWE-bench Verified.
Cosa usare al posto di ChatGPT Plus e come un unico saldo lo sostituisce.
avots.ai esegue oltre 40 modelli AI per chat, immagini, video e audio con un unico saldo. Consulta l'elenco completo sulla pagina Strumenti o apri l'app e inizia a creare.