284B total, 13B ativos
Uma mistura esparsa de especialistas: apenas cerca de 13B parâmetros são ativados por token, por isso responde rapidamente e custa tão pouco.
DeepSeek V4 Flash é a metade barata da família V4: cerca de 284B parâmetros totais com apenas 13B ativos por token, uma janela de contexto de 1 milhão de tokens e atenção híbrida construída para longas execuções de agente. A compilação 0731, lançada em 31 de julho de 2026, manteve o mesmo corpo e refez o pós-treinamento, e a DeepSeek relata que agora supera o seu próprio V4-Pro preview em nove benchmarks de agente. Em avots.ai, você o executa pagando por uso, sem conta DeepSeek e sem assinatura, e o mesmo saldo também cobre Claude Opus 5, GPT-5.6, Gemini e mais de 40 modelos de imagem, vídeo e música.
Uma mistura esparsa de especialistas: apenas cerca de 13B parâmetros são ativados por token, por isso responde rapidamente e custa tão pouco.
Um milhão de tokens completos numa única conversa, com saídas muito grandes, para que repositórios inteiros e conjuntos de documentos caibam numa única passagem.
Por milhão de tokens na própria lista da DeepSeek, com entrada em cache a 0,0028 USD, para que o contexto repetido em ciclos de agente seja quase gratuito.
DeepSeek relatou para a compilação 0731, juntamente com 70.3 no Toolathlon verificado e 76.7 no Cybergym.
No índice independente Artificial Analysis Intelligence, contra uma mediana de 25 para modelos comparáveis.
Sem entrada de imagem neste. Para capturas de ecrã e digitalizações, mude para Qwen3.7 ou Gemini com o mesmo saldo.
| DeepSeek V4 Flash | DeepSeek V4-Pro | Qwen3.7 Flash | |
|---|---|---|---|
| Preço por 1M entrada / saída | $0.14 / $0.28 | $0.435 / $0.87 | $0.03 / $0.13 |
| Parâmetros | 284B total, 13B ativos | cerca de 1.6T total, 49B ativos | não publicado |
| Janela de contexto | 1M tokens | 1M tokens | 1M tokens |
| Terminal-Bench 2.1 | 82.7 | não publicado | não publicado |
| Toolathlon verificado | 70.3 | não publicado | não publicado |
| Entrada de imagem | não | não | sim |
| Em avots.ai | pague por uso | pague por uso | pague por uso |
As pontuações do agente são reportadas pelo fornecedor e muito sensíveis ao arnês, por isso trate-as como uma direção, não um veredicto. O que não está em dúvida é a diferença de preço: o Flash funciona a cerca de um terço do V4-Pro por token, e o Qwen3.7 Flash supera ambos, adicionando entrada de imagem. Todos os três estão no mesmo seletor.
Arquitetura e tamanho idênticos à compilação de pré-visualização. Tudo o que foi ganho veio de um pós-treino refeito, não de um novo modelo base.
DeepSeek relata 54.4 no DeepSWE, 54.2 no NL2Repo e 25.2 no Agents' Last Exam, o seu conjunto de agentes mais forte até agora.
A entrada de cache a 0,0028 USD por milhão de tokens torna os ciclos de ferramentas que reenviam o mesmo prompt genuinamente baratos.
São suportados esforços de raciocínio alto e máximo, para que gaste mais tempo a pensar apenas nas chamadas que precisam.
Registe-se em app.avots.ai com e-mail, Google ou Telegram. Leva um minuto.
1.000 tokens custam 0,99 EUR. Sem plano para escolher, sem renovação, o saldo fica lá até o usar.
Escolha DeepSeek V4 Flash no seletor de modelos, ou deixe o Agente Avots encaminhar por si. Cada resposta mostra o seu custo em tokens.
app.avots.ai em desktop e mobile, sem necessidade de instalação.
V4 Flash em @AvotsAIbot, mesmo saldo, de qualquer telefone.
Use-o dentro do Claude Desktop, Cursor ou Cline através do servidor MCP.
A API compatível com OpenAI usa o seu cliente existente, uma chave para cada modelo.
1.000 tokens custam 0,99 EUR e uma resposta Flash custa um punhado deles. O mesmo saldo desbloqueia Claude Opus 5, GPT-5.6, Gemini, vídeo Veo e imagens Nano Banana, sem qualquer subscrição.
Registe-se e converse ✦A família completa, V4-Pro e V4-Flash, pesos abertos e contexto de 1M.
Todos os LLM em avots.ai e qual escolher por tarefa.
Os níveis Max, Plus e Flash da Alibaba, contexto de 1M, visão nos pequenos.
O modelo aberto de fronteira da Moonshot, número um em codificação, contexto de 1M.
O mais recente carro-chefe da Anthropic, contexto de 1M, 96% SWE-bench Verificado.
O que usar em vez do ChatGPT Plus e como um saldo o substitui.
avots.ai executa mais de 40 modelos de IA para chat, imagem, vídeo e áudio com um único saldo. Veja a lista completa na página de Ferramentas ou abra a aplicação e comece a criar.