284B total, 13B activos
Una mezcla dispersa de expertos: solo unos 13B de parámetros se activan por token, por eso responde rápido y cuesta tan poco.
DeepSeek V4 Flash es la mitad económica de la familia V4: aproximadamente 284B de parámetros totales con solo 13B activos por token, una ventana de contexto de 1 millón de tokens y atención híbrida diseñada para ejecuciones largas de agentes. La versión 0731, lanzada el 31 de julio de 2026, mantuvo el mismo cuerpo y rehizo el post-entrenamiento, y DeepSeek informa que ahora supera a su propia vista previa de V4-Pro en nueve puntos de referencia de agentes. En avots.ai lo ejecutas con pago por uso, sin cuenta de DeepSeek y sin suscripción, y el mismo saldo también cubre Claude Opus 5, GPT-5.6, Gemini y más de 40 modelos de imagen, video y música.
Una mezcla dispersa de expertos: solo unos 13B de parámetros se activan por token, por eso responde rápido y cuesta tan poco.
Un millón de tokens completos en una conversación, con salidas muy grandes, para que repositorios y conjuntos de documentos enteros quepan en una sola pasada.
Por millón de tokens en la lista propia de DeepSeek, con entrada en caché a 0.0028 USD, por lo que el contexto repetido en bucles de agente es casi gratuito.
DeepSeek informó para la versión 0731, junto con 70.3 en Toolathlon verificado y 76.7 en Cybergym.
En el índice independiente Artificial Analysis Intelligence Index, frente a una mediana de 25 para modelos comparables.
No hay entrada de imagen en este. Para capturas de pantalla y escaneos, cambia a Qwen3.7 o Gemini con el mismo saldo.
| DeepSeek V4 Flash | DeepSeek V4-Pro | Qwen3.7 Flash | |
|---|---|---|---|
| Precio por 1M de entrada / salida | $0.14 / $0.28 | $0.435 / $0.87 | $0.03 / $0.13 |
| Parámetros | 284B total, 13B activos | aproximadamente 1.6T total, 49B activos | no publicado |
| Ventana de contexto | 1M de tokens | 1M de tokens | 1M de tokens |
| Terminal-Bench 2.1 | 82.7 | no publicado | no publicado |
| Toolathlon verificado | 70.3 | no publicado | no publicado |
| Entrada de imagen | no | no | sí |
| En avots.ai | pago por uso | pago por uso | pago por uso |
Las puntuaciones de agente son reportadas por el proveedor y muy sensibles al arnés, así que trátalas como una dirección, no como un veredicto. Lo que no está en duda es la brecha de precios: Flash funciona a aproximadamente un tercio de V4-Pro por token, y Qwen3.7 Flash es más económico que ambos, además de añadir entrada de imagen. Los tres están en el mismo selector.
Arquitectura y tamaño idénticos a la versión previa. Todo lo ganado provino de un post-entrenamiento rehecho, no de un nuevo modelo base.
DeepSeek informa 54.4 en DeepSWE, 54.2 en NL2Repo y 25.2 en Agents' Last Exam, su conjunto de agentes más fuerte hasta la fecha.
La entrada de caché a 0.0028 USD por millón de tokens hace que los bucles de herramientas que reenvían el mismo prompt sean realmente económicos.
Se admiten esfuerzos de razonamiento alto y máximo, por lo que dedicas más pensamiento solo a las llamadas que lo necesitan.
Regístrate en app.avots.ai con correo electrónico, Google o Telegram. Lleva un minuto.
1,000 tokens cuestan 0.99 EUR. Sin plan a elegir, sin renovación, el saldo permanece hasta que lo uses.
Selecciona DeepSeek V4 Flash en el selector de modelos, o deja que Agent Avots te dirija. Cada respuesta muestra su coste en tokens.
app.avots.ai en escritorio y móvil, no requiere instalación.
V4 Flash en @AvotsAIbot, mismo saldo, desde cualquier teléfono.
Úsalo dentro de Claude Desktop, Cursor o Cline a través del servidor MCP.
La API compatible con OpenAI acepta tu cliente existente, una clave para cada modelo.
1,000 tokens cuestan 0.99 EUR y una respuesta de Flash cuesta solo unos pocos. El mismo saldo desbloquea Claude Opus 5, GPT-5.6, Gemini, video Veo e imágenes Nano Banana, sin suscripción en ningún lugar.
Regístrate y chatea ✦La familia completa, V4-Pro y V4-Flash, pesos abiertos y contexto de 1M.
Cada LLM en avots.ai y cuál elegir por tarea.
Niveles Max, Plus y Flash de Alibaba, contexto de 1M, visión en los pequeños.
El modelo abierto de frontera de Moonshot, número uno en codificación, contexto de 1M.
El nuevo buque insignia de Anthropic, contexto de 1M, 96% SWE-bench verificado.
Qué usar en lugar de ChatGPT Plus y cómo un saldo lo reemplaza.
avots.ai ejecuta más de 40 modelos de IA para chat, imagen, video y audio con un solo saldo. Consulta la lista completa en la página de Herramientas o abre la aplicación y empieza a crear.