Guias do Gemma 4
Kimi K3 vs Qwen 3.8: O Que Está Confirmado e o Que Não Está (Julho de 2026)

Kimi K3 vs Qwen 3.8: o que está confirmado e o que não está
Três dias após o lançamento do Kimi K3 pela Moonshot AI, a equipe Qwen da Alibaba apresentou em preview o Qwen3.8-Max-Preview — um modelo de 2,4 trilhões de parâmetros que descreve como igualando desempenho frontier e ficando "segundo apenas ao Fable 5." O timing não é coincidência: o Qwen 3.8 chegou diretamente ao ciclo de notícias que o Kimi K3 criou, e o próprio enquadramento da Alibaba o posiciona como resposta direta ao momentum do K3.
Aqui está a pegadinha para quem tenta comparar os dois de fato: o Qwen 3.8 não tem um único benchmark verificado independentemente publicado até o momento desta redação. A alegação da Alibaba de "segundo apenas ao Fable 5" é posicionamento da empresa, não resultado de leaderboard. Este guia expõe exatamente o que está confirmado em cada modelo, o que ainda é apenas alegação, e o que isso significa se você precisa escolher um hoje.

Resposta rápida
- Kimi K3 tem histórico real e testável agora: preços publicados, resultado #1 em leaderboard executado independentemente (LMArena Frontend Code Arena) e dados de benchmark de terceiros da Artificial Analysis.
- Qwen 3.8 é um preview com quase nada verificado independentemente ainda: sem janela de contexto publicada, sem preço de API por token, e zero pontuações de benchmark de terceiros. As alegações de desempenho da Alibaba são linguagem de marketing não confirmada.
- Se você precisa de um modelo que possa avaliar e implantar hoje, Kimi K3 é o único dos dois com informação pública suficiente para isso.
- Se você está apenas monitorando o espaço, Qwen 3.8 vale acompanhar quando a Alibaba publicar números reais — mas ainda não há nada para testar.
- Nenhum dos dois tem pesos abertos para download ainda. Os do K3 são esperados para 27 de julho de 2026; os do Qwen 3.8 são prometidos "em breve" sem data.
Por que esta comparação está em alta — e por que a maioria das versões está errada
"Qwen 3.8 vs Kimi K3" é um dos termos de busca de IA que mais crescem esta semana, o que faz sentido: dois dos maiores modelos open-weight já anunciados foram lançados com três dias de diferença. Mas como o Qwen 3.8 ainda é um preview sem benchmarks públicos, qualquer artigo que afirme mostrar pontuações head-to-head entre os dois está ou citando marketing não verificado do vendor como fato ou inventando números que ainda não existem. Não vamos fazer isso. Abaixo está o que cada empresa realmente confirmou, com fontes em cobertura primária, com as lacunas deixadas visivelmente abertas em vez de encobertas.
Timing de lançamento e posicionamento
| Kimi K3 | Qwen 3.8 (Qwen3.8-Max-Preview) | |
|---|---|---|
| Fornecedor | Moonshot AI | Alibaba (equipe Qwen) |
| Anunciado | 16 de julho de 2026 | 19 de julho de 2026 |
| Status | Disponível via API, app e OpenRouter | Apenas preview, via Token Plan / Qoder / QoderWork |
| Posicionamento | Generalista frontier open-weight, otimizado para agentes | Flagship multimodal, posicionado como perseguindo o momentum do Kimi K3 |
| Enquadramento próprio do vendor | "Maior modelo open-weight lançado até hoje" | "Iguala modelos frontier, fica atrás apenas do Fable 5" (não verificado) |
O lançamento do Qwen 3.8 parece resposta direta ao Kimi K3: a Alibaba manteve seus flagships Max fechados e só via API até o Qwen3.7-Max (lançado em maio de 2026), e o Qwen 3.8 é o primeiro dessa linha que a Alibaba disse que será open-weight — o mesmo movimento que a Moonshot fez com o K3, dias após o K3 dominar o ciclo de notícias.
O que está realmente confirmado em cada modelo
| Kimi K3 | Qwen 3.8 | |
|---|---|---|
| Parâmetros totais | 2,8 trilhões | 2,4 trilhões (número de destaque; não verificado independentemente) |
| Parâmetros ativos / config MoE | 16 de 896 experts ativos por token | Não divulgado |
| Janela de contexto | 1.048.576 tokens (~1M) | Não publicada |
| Entrada multimodal | Compreensão nativa de imagem | Imagens, vídeo e documentos (primeiro modelo multimodal >1T da Alibaba) |
| Preço de API | $3,00 / MTok entrada, $15,00 / MTok saída, $0,30 / MTok em cache | Não publicado — acesso preview a "10% do preço padrão" via Token Plan, sem taxa standalone divulgada |
| Dados de benchmark independentes | Sim — Artificial Analysis Intelligence Index (57), LMArena Frontend Code Arena (#1, votado independentemente pela comunidade) | Nenhum publicado |
| Pesos abertos | Prometidos, esperados para 27 de julho de 2026 | Prometidos "em breve," sem data, sem repositório Hugging Face ainda |
| Licença | Estilo Modified MIT (planejada) | Não confirmada |
A lacuna nessa tabela é toda a história agora. Kimi K3 tem um preço que você pode colocar em um modelo de gasto e um resultado de leaderboard executado por terceiros. Qwen 3.8 tem uma contagem de parâmetros e uma frase de copy de marketing.
O único sinal real do Qwen 3.8: o que ele diz sobre a Moonshot
Mesmo sem benchmarks, o lançamento do Qwen 3.8 é informativo por outro motivo: é um data point sobre quão seriamente os concorrentes estão levando o Kimi K3. A Moonshot AI supostamente ultrapassou $300 milhões em receita recorrente anual em junho de 2026 e está preparando um IPO, segundo reportagem da Bloomberg citada junto ao anúncio do Qwen 3.8. A Alibaba apresentando em preview um flagship open-weight de 2,4T — quebrando seu padrão passado de manter modelos Max fechados — três dias após o lançamento do K3 é reação competitiva, não coincidência. Se você está tentando ler o mercado em vez de escolher um modelo hoje, esse é o sinal mais confiável do que as alegações de benchmark de qualquer uma das empresas.
Histórico verificado independentemente do Kimi K3
Como o Qwen 3.8 ainda não tem dados comparáveis, aqui está o que foi de fato verificado no Kimi K3 por partes além da Moonshot:
- LMArena Frontend Code Arena — leaderboard votado pela comunidade e executado independentemente, não benchmark de vendor. K3 foi do #18 ao #1 em horas após o lançamento, à frente do Claude Fable 5, e ficou em primeiro em 6 de 7 domínios de frontend.
- Artificial Analysis — avaliador independente — pontuou K3 em 57 no Intelligence Index (v4.1), à frente do Claude Opus 4.8 (56) e atrás do Claude Fable 5 (60), e mediu separadamente Elo de trabalho de conhecimento de longo horizonte privado de 1.547 para K3, salto de +732 pontos sobre Kimi K2.6.
- Eficiência de custo: Artificial Analysis colocou custo por tarefa do K3 em aproximadamente $0,94, ligeiramente abaixo dos $1,04 do GPT-5.6 Sol na mesma avaliação privada.
Nada disso garante que K3 é "melhor" do que o que quer que o Qwen 3.8 pontue quando tiver números reais — mas é a diferença entre avaliável e ainda-não-avaliável.
Uma complicação de curto prazo: Kimi K3 está com capacidade limitada agora
Vale saber se você está decidindo qual testar esta semana: a Moonshot pausou novas assinaturas Kimi K3 em 19 de julho de 2026, após demanda empurrar perto dos limites de capacidade de GPU dentro de 48 horas do lançamento. Assinantes existentes e clientes de API não são afetados, e a Moonshot está reabrindo novos cadastros em lotes — detalhes completos em por que o Kimi K3 esgotou. Se você está tentando obter acesso hands-on a uma conta nova especificamente pelo app consumer esta semana, esse é um obstáculo prático real que o Qwen 3.8 atualmente não tem, simplesmente porque o programa preview do Qwen 3.8 é menor e mais novo.
Qual usar agora
Use Kimi K3 se:
- Você precisa de um modelo que possa avaliar hoje com preços reais e dados de benchmark verificados independentemente.
- Seu workload é coding agentic, geração de frontend ou uso de ferramentas de longo horizonte — categorias onde os resultados verificados independentemente do K3 são mais fortes.
- Você pode trabalhar dentro (ou esperar) a pausa atual de assinatura, ou está acessando pela API e OpenRouter ainda abertas.
Acompanhe Qwen 3.8, mas não se comprometa ainda, se:
- Você quer uma segunda opção open-weight de vendor diferente para redundância — mas não pode montar um plano de avaliação real até a Alibaba publicar preços, janela de contexto e dados de benchmark.
- Tratamento multimodal de documentos/vídeo na escala da Alibaba é especificamente valioso para você e você está disposto a esperar o lançamento open-weight e números reais.
Não confie em nenhum artigo que afirme números hard de benchmark head-to-head entre estes dois modelos hoje — se o Qwen 3.8 não os publicou, esse conteúdo está ou citando alegações não verificadas do vendor como fato ou fabricando figuras.
O que verificar depois
- Pontuações de benchmark do Qwen 3.8 da Artificial Analysis ou avaliador independente comparável.
- Preço oficial de API por token do Qwen 3.8 fora da taxa promocional preview do Token Plan.
- Janela de contexto e configuração active-parameter/MoE do Qwen 3.8.
- Lançamentos open-weight de ambos os modelos — o do K3 é esperado para 27 de julho de 2026; o do Qwen 3.8 ainda não tem data confirmada.
Atualizaremos esta comparação com números reais conforme a Alibaba publicar, em vez de preencher estimativas agora.
FAQ
O Qwen 3.8 é melhor que o Kimi K3? Desconhecido até o momento desta redação. A Alibaba afirma que Qwen 3.8 é "segundo apenas ao Fable 5," mas não publicou nenhuma pontuação de benchmark independente ou auto-relatada para sustentar isso. Kimi K3 tem resultados verificados independentemente (LMArena Frontend Code Arena, Artificial Analysis) que o Qwen 3.8 atualmente não tem.
O Qwen 3.8 é maior que o Kimi K3? Não — Qwen 3.8 é reportado com 2,4 trilhões de parâmetros totais, versus 2,8 trilhões do Kimi K3. K3 permanece o maior dos dois pela contagem de parâmetros de destaque.
O Qwen 3.8 é open source? A Alibaba disse que pesos abertos virão "em breve," mas até o momento desta redação não há repositório Hugging Face, sem data de lançamento confirmada, e sem licença confirmada para Qwen 3.8. Kimi K3 está em estado pendente similar, mas com data comprometida específica: 27 de julho de 2026.
Quanto custa usar o Qwen 3.8? A Alibaba não publicou preço de API por token standalone para Qwen 3.8. Acesso preview está disponível via Token Plan, Qoder e QoderWork da Alibaba a "10% do preço padrão," mas isso é taxa promocional de preview, não preço de produção publicado.
Por que a Alibaba lançou Qwen 3.8 logo após Kimi K3? O timing — três dias após o lançamento do K3 — mais o enquadramento explícito "segundo apenas ao Fable 5" da Alibaba e sua ruptura com manter modelos Max fechados, parece resposta competitiva direta ao momentum de lançamento do Kimi K3 e crescimento reportado da Moonshot AI (cerca de $300M ARR em junho de 2026) e preparações de IPO.
Posso usar Qwen 3.8 agora? Apenas em preview, via Token Plan, Qoder ou QoderWork da Alibaba. Ainda não há acesso geral de API ou download open-weight.
Guias relacionados
Guias relacionados
Continue no cluster do Gemma 4 com o proximo guia que combina com a decisao que voce esta tomando agora.

Kimi K3 vs Claude: Fable 5 e Opus 4.8 Comparados
O Kimi K3 supera o Claude Opus 4.8 em preço e na maioria dos benchmarks, mas o Claude Fable 5 ainda lidera em engenharia frontier. Veja exatamente onde cada modelo vence, com fontes da Artificial Analysis e números de cada vendor.

Por Que o Kimi K3 Esgotou? A Pausa de Capacidade de GPU Explicada
Kimi K3 não foi descontinuado nem "esgotou" de fato — a Moonshot pausou novos cadastros de assinatura após a demanda atingir a capacidade de GPU em 48 horas após o lançamento. Veja o que isso significa se você está tentando obter acesso agora.

Kimi K3: O Modelo Open-Weight de 2,8T da Moonshot AI Explicado
O Kimi K3 da Moonshot AI foi lançado em 16 de julho de 2026 como um modelo open-weight de 2,8 trilhões de parâmetros que supera o Claude Opus 4.8 em vários benchmarks. Aqui está o que ele realmente é, o que ainda falta e como testá-lo hoje.
Ainda decidindo o que ler depois?
Volte para o hub de guias para navegar por comparacoes de modelos, tutoriais de configuracao e paginas de planejamento de hardware.
