O maior modelo da Alibaba
2.4 triliões de parâmetros, apresentado na World AI Conference em Xangai e lançado a 3 de agosto de 2026.
Qwen3.8 Max é o maior modelo da Alibaba até agora: 2.4 triliões de parâmetros numa mistura de especialistas, entrada de texto, imagens e vídeo, um milhão de tokens de contexto. Foi lançado a 3 de agosto de 2026, e a versão de 2 de setembro aprimorou a codificação em projetos de escala de engenharia e execuções longas de agentes autónomos. Em avots.ai, usa Qwen3.8 Max e o económico Qwen3.8 Flash pagando por uso, sem plano, e o mesmo saldo também cobre GPT-6 Astra, Claude Fable 5.1, Gemini e mais de 40 modelos de imagem, vídeo e música.
| Qwen3.8 Max | Qwen3.8 Flash | Qwen3.7 Max | |
|---|---|---|---|
| Melhor para | grandes projetos de codificação, agentes longos, visão | trabalho em volume, documentos, análise de vídeo | o anterior modelo principal |
| Preço por 1M entrada / saída | $2 / $6 | $0.15 / $0.47 | $2 / $6 |
| Janela de contexto | 1M tokens | 1M tokens | 1M tokens |
| Saída máxima | 131k tokens | 131k tokens | 65k tokens |
| Entrada | texto, imagens, vídeo | texto, imagens, vídeo | texto |
| Em avots.ai | pague por uso | pague por uso | pague por uso |
O número é a geração, o nome é a camada: Max é o modelo principal de 2.4 triliões de parâmetros, Flash é a camada multimodal rápida a um décimo terceiro do preço. Ambos leem vídeo. Mude livremente, um saldo cobre toda a família Qwen.
2.4 triliões de parâmetros, apresentado na World AI Conference em Xangai e lançado a 3 de agosto de 2026.
Max e Flash leem imagens e vídeo nativamente: descreva um clipe, extraia factos de uma gravação, leia gráficos e documentos longos.
A versão de 2 de setembro visa projetos de software de escala de engenharia e execuções de desenvolvimento autónomo mais longas, com visão mais forte.
Uma base de código inteira ou uma transcrição de vídeo longa numa única conversa, e respostas duas vezes mais longas do que o Qwen3.7 permitia.
Registe-se em app.avots.ai com e-mail, Google ou Telegram. Demora um minuto.
1.000 tokens custam 0.99 EUR. Sem plano para escolher, sem renovação, o saldo fica lá até o usar.
Escolha uma camada Qwen3.8 no seletor de modelos, ou deixe o Agente Avots encaminhar a tarefa para si. Cada resposta mostra o seu custo em tokens.
app.avots.ai em desktop e mobile, sem necessidade de instalação.
Qwen3.8 em @AvotsAIbot, o mesmo saldo, de qualquer telefone.
Use-o dentro do Claude Desktop, Cursor ou Cline através do servidor MCP.
A API compatível com OpenAI aceita o seu cliente existente, uma chave para cada modelo.
1.000 tokens custam 0.99 EUR e uma resposta do Qwen3.8 Flash custa alguns deles. O mesmo saldo desbloqueia Max, GPT-6 Astra, Claude Fable 5.1, Gemini, vídeo Veo e imagens Nano Banana.
Registar e conversar ✦Todos os LLMs em avots.ai e qual escolher por tarefa.
A geração anterior: Max, Plus e Flash, ainda no seletor.
MoE de peso aberto, contexto de 1M, pontuações de codificação LiveCodeBench de topo.
Modelo aberto de fronteira da Moonshot, número um em codificação, contexto de 1M.
O novo modelo principal da OpenAI e o seu modo Pro, pague por uso.
O que usar em vez do ChatGPT Plus e como um saldo o substitui.
avots.ai executa mais de 40 modelos de IA para chat, imagem, vídeo e áudio com um único saldo. Veja a lista completa na página Ferramentas ou abra a aplicação e comece a criar.