MoE open-weight
Mixture-of-experts sotto licenza MIT. V4-Pro ha circa 1.6T parametri totali con 49B attivi, V4-Flash ha 284B totali con 13B attivi.
DeepSeek V4 è la famiglia di modelli mixture-of-experts open-weight che ha reso DeepSeek la più grande fonte di token su OpenRouter. È disponibile in due dimensioni, V4-Pro per i ragionamenti e la programmazione più complessi, e V4-Flash per lavori veloci e ad alto volume, entrambi con un contesto di 1 milione di token. Su avots.ai li utilizzi pagando per uso, senza abbonamento, e lo stesso saldo copre anche Claude Opus 5, GPT-5.6, Gemini e oltre 40 modelli di immagini, video e musica.
Mixture-of-experts sotto licenza MIT. V4-Pro ha circa 1.6T parametri totali con 49B attivi, V4-Flash ha 284B totali con 13B attivi.
Entrambe le varianti hanno una finestra di contesto predefinita di 1 milione di token con un output fino a 384k, sufficiente per interi repository e documenti lunghi in un unico passaggio.
DeepSeek Sparse Attention con compressione token-wise. Con un contesto di 1M, V4-Pro utilizza circa il 27 percento del calcolo di inferenza e il 10 percento della cache KV di V3.2.
V4-Pro con il massimo sforzo di ragionamento raggiunge un LiveCodeBench Pass@1 di 93.5 e circa l'80.6 percento su SWE-bench Verified.
V4-Pro costa circa 0.44 USD in input e 0.87 USD in output per milione di token, V4-Flash circa 0.14 e 0.28.
V4 si concentra sul ragionamento testuale e sul codice. Per l'input di immagini, abbinalo a Gemini o GPT-5.6 con lo stesso saldo avots.
| Benchmark di programmazione | DeepSeek V4-Pro | Gemini 3.1 Pro | Claude Opus 4.6 Max |
|---|---|---|---|
| LiveCodeBench Pass@1 (massimo sforzo) | 93.5 | 91.7 | 88.8 |
| SWE-bench Verified | circa 80.6% | forte | alto |
| Finestra di contesto | 1M token | 1M token | 200K token |
| Pesi | aperti, MIT | chiusi | chiusi |
| Prezzo per 1M in / out | $0.44 / $0.87 | $2 / $12 | più alto |
Nella valutazione di programmazione di DeepSeek, V4-Pro con il massimo sforzo di ragionamento supera LiveCodeBench, davanti a Gemini 3.1 Pro e Claude Opus 4.6 Max, a una frazione del prezzo e con pesi aperti. I numeri provengono dalle note di rilascio di DeepSeek e da articoli indipendenti.
Iscriviti su app.avots.ai con email, Google o Telegram. Ci vuole un minuto.
1.000 token costano 0.99 EUR. Nessun piano da scegliere, nessun rinnovo, il saldo rimane lì finché non lo usi.
Scegli un modello DeepSeek V4 nel selettore, o lascia che Agent Avots faccia il routing per te. Ogni risposta mostra il costo in token.
app.avots.ai su desktop e mobile, nessuna installazione necessaria.
DeepSeek V4 in @AvotsAIbot, stesso saldo, da qualsiasi telefono.
Usalo all'interno di Claude Desktop, Cursor o Cline tramite il server MCP.
L'API compatibile OpenAI accetta il tuo client esistente, una chiave per ogni modello.
1.000 token costano 0.99 EUR e le risposte di DeepSeek V4 costano una frazione di centesimo. Lo stesso saldo sblocca Claude Opus 5, GPT-5.6, Gemini, Kimi K3, video Veo e immagini Nano Banana.
Iscriviti e chatta ✦Ogni LLM su avots.ai e quale scegliere per ogni attività.
Il modello di programmazione open-weight di Z.ai, contesto da 1M, licenza MIT. Disponibile ora.
Il modello open all'avanguardia di Moonshot, numero uno nella programmazione, contesto da 1M.
I nuovi livelli Sol, Terra e Luna di OpenAI, contesto da 1M. Disponibile ora.
Cosa usare al posto di ChatGPT Plus e come un unico saldo lo sostituisce.
Google contro OpenAI, attività per attività, testati con un unico saldo.
avots.ai esegue oltre 40 modelli AI per chat, immagini, video e audio con un unico saldo. Vedi l'elenco completo sulla pagina Strumenti o apri l'app e inizia a creare.