Atualização do agente, compilação 0731

DeepSeek V4 Flash online, pague por uso

DeepSeek V4 Flash é a metade barata da família V4: cerca de 284B parâmetros totais com apenas 13B ativos por token, uma janela de contexto de 1 milhão de tokens e atenção híbrida construída para longas execuções de agente. A compilação 0731, lançada em 31 de julho de 2026, manteve o mesmo corpo e refez o pós-treinamento, e a DeepSeek relata que agora supera o seu próprio V4-Pro preview em nove benchmarks de agente. Em avots.ai, você o executa pagando por uso, sem conta DeepSeek e sem assinatura, e o mesmo saldo também cobre Claude Opus 5, GPT-5.6, Gemini e mais de 40 modelos de imagem, vídeo e música.

Use DeepSeek V4 Flash agora ✦ Ver preços
Especificações

DeepSeek V4 Flash em resumo

284B total, 13B ativos

Uma mistura esparsa de especialistas: apenas cerca de 13B parâmetros são ativados por token, por isso responde rapidamente e custa tão pouco.

Contexto de 1M tokens

Um milhão de tokens completos numa única conversa, com saídas muito grandes, para que repositórios inteiros e conjuntos de documentos caibam numa única passagem.

0,14 USD entrada, 0,28 USD saída

Por milhão de tokens na própria lista da DeepSeek, com entrada em cache a 0,0028 USD, para que o contexto repetido em ciclos de agente seja quase gratuito.

82.7 Terminal-Bench 2.1

DeepSeek relatou para a compilação 0731, juntamente com 70.3 no Toolathlon verificado e 76.7 no Cybergym.

Pontuação do índice 50

No índice independente Artificial Analysis Intelligence, contra uma mediana de 25 para modelos comparáveis.

Entrada de texto, saída de texto

Sem entrada de imagem neste. Para capturas de ecrã e digitalizações, mude para Qwen3.7 ou Gemini com o mesmo saldo.

Números reais

V4 Flash ao lado de V4-Pro e Qwen3.7 Flash

 DeepSeek V4 FlashDeepSeek V4-ProQwen3.7 Flash
Preço por 1M entrada / saída$0.14 / $0.28$0.435 / $0.87$0.03 / $0.13
Parâmetros284B total, 13B ativoscerca de 1.6T total, 49B ativosnão publicado
Janela de contexto1M tokens1M tokens1M tokens
Terminal-Bench 2.182.7não publicadonão publicado
Toolathlon verificado70.3não publicadonão publicado
Entrada de imagemnãonãosim
Em avots.aipague por usopague por usopague por uso

As pontuações do agente são reportadas pelo fornecedor e muito sensíveis ao arnês, por isso trate-as como uma direção, não um veredicto. O que não está em dúvida é a diferença de preço: o Flash funciona a cerca de um terço do V4-Pro por token, e o Qwen3.7 Flash supera ambos, adicionando entrada de imagem. Todos os três estão no mesmo seletor.

O que há de novo

O que a compilação 0731 mudou

Mesmo corpo, novo treino

Arquitetura e tamanho idênticos à compilação de pré-visualização. Tudo o que foi ganho veio de um pós-treino refeito, não de um novo modelo base.

Comportamento do agente em primeiro lugar

DeepSeek relata 54.4 no DeepSWE, 54.2 no NL2Repo e 25.2 no Agents' Last Exam, o seu conjunto de agentes mais forte até agora.

Contexto repetido barato

A entrada de cache a 0,0028 USD por milhão de tokens torna os ciclos de ferramentas que reenviam o mesmo prompt genuinamente baratos.

Níveis de esforço

São suportados esforços de raciocínio alto e máximo, para que gaste mais tempo a pensar apenas nas chamadas que precisam.

Experimente o V4 Flash em avots
Três passos

Como usar o DeepSeek V4 Flash

Crie uma conta

Registe-se em app.avots.ai com e-mail, Google ou Telegram. Leva um minuto.

Carregue a partir de 0,99 EUR

1.000 tokens custam 0,99 EUR. Sem plano para escolher, sem renovação, o saldo fica lá até o usar.

Escolha V4 Flash

Escolha DeepSeek V4 Flash no seletor de modelos, ou deixe o Agente Avots encaminhar por si. Cada resposta mostra o seu custo em tokens.

Registe-se e comece
Um saldo

Onde pode usar o DeepSeek V4 Flash

Aplicação web

app.avots.ai em desktop e mobile, sem necessidade de instalação.

Telegram

V4 Flash em @AvotsAIbot, mesmo saldo, de qualquer telefone.

MCP

Use-o dentro do Claude Desktop, Cursor ou Cline através do servidor MCP.

Experimente o DeepSeek V4 Flash por menos de um euro

1.000 tokens custam 0,99 EUR e uma resposta Flash custa um punhado deles. O mesmo saldo desbloqueia Claude Opus 5, GPT-5.6, Gemini, vídeo Veo e imagens Nano Banana, sem qualquer subscrição.

Registe-se e converse ✦
Guias

Páginas relacionadas

DeepSeek V4

A família completa, V4-Pro e V4-Flash, pesos abertos e contexto de 1M.

Qwen3.7

Os níveis Max, Plus e Flash da Alibaba, contexto de 1M, visão nos pequenos.

Kimi K3

O modelo aberto de fronteira da Moonshot, número um em codificação, contexto de 1M.

Claude Opus 5

O mais recente carro-chefe da Anthropic, contexto de 1M, 96% SWE-bench Verificado.

avots.ai executa mais de 40 modelos de IA para chat, imagem, vídeo e áudio com um único saldo. Veja a lista completa na página de Ferramentas ou abra a aplicação e comece a criar.

Navegar por todas as páginas de modelos Abrir a aplicação
FAQ

Perguntas sobre DeepSeek V4 Flash

O que é DeepSeek V4 Flash?
DeepSeek V4 Flash é o membro pequeno e rápido da família DeepSeek V4: um modelo de mistura de especialistas com cerca de 284B parâmetros totais e apenas 13B ativos por token, uma janela de contexto de 1 milhão de tokens e entrada e saída de texto. É construído para assistentes de codificação, chamadas de ferramentas e longos ciclos de agente onde a velocidade e o preço importam mais do que o raciocínio de pico absoluto.
O que mudou na compilação 0731?
DeepSeek lançou a compilação V4-Flash-0731 em 31 de julho de 2026. A arquitetura e o tamanho não mudaram, apenas o pós-treinamento foi refeito, e os ganhos estão no comportamento do agente e na chamada de ferramentas. DeepSeek relata 82.7 no Terminal-Bench 2.1, 70.3 no Toolathlon verificado e 76.7 no Cybergym para essa compilação.
Quanto custa o DeepSeek V4 Flash?
DeepSeek lista 0,14 USD por milhão de tokens de entrada e 0,28 USD por milhão de tokens de saída, com entrada em cache a 0,0028 USD. O índice independente Artificial Analysis coloca o seu custo combinado perto de 0,06 USD por milhão de tokens. Em avots.ai, não paga por milhão: carrega a partir de 0,99 EUR por 1.000 tokens avots e cada resposta mostra o seu custo antes de ser executada.
Flash ou V4-Pro, qual devo escolher?
Escolha Flash para volume: ciclos de agente, refatorações em muitos ficheiros, chat que precisa de ser instantâneo, qualquer coisa onde envie o mesmo contexto longo repetidamente. Escolha V4-Pro para as respostas únicas mais difíceis, onde o seu corpo de parâmetros de 1.6T e a pontuação de 93.5 no LiveCodeBench justificam o preço mais alto. Ambos estão no mesmo seletor com um único saldo, para que possa alternar a meio da tarefa.
O DeepSeek V4 Flash lê imagens?
Não. O V4 Flash recebe texto e devolve texto. Se precisar de enviar capturas de ecrã ou digitalizações, mude para Qwen3.7, Gemini ou GPT-5.6 no mesmo seletor. Um saldo avots.ai cobre todos eles, além de modelos de imagem, vídeo e música.
Experimente em avots ✦
Comece a criar