TLDR
- O Kimi K2.6 é o novo modelo de destaque de código aberto da Moonshot AI, lançado em 20 de abril de 2026.
- É um modelo de 1 trilhão de parâmetros com 32B ativos. Ele usa uma arquitetura Mixture-of-Experts (MoE) com 384 experts.
- O modelo tem uma janela de contexto de 256K tokens, é nativamente multimodal e consegue entender entradas de texto, imagem e vídeo).
- Ele vem com quatro modos de operação: Instant, Thinking, Agent e Agent Swarm — cada um otimizado para diferentes perfis de tarefa.
- O Agent Swarm foi apresentado pela primeira vez no Kimi K2.5 e agora escala para 300 subagentes paralelos e mais de 4.000 chamadas de ferramentas coordenadas, e graças a isso o modelo consegue rodar sessões de programação de mais de 12 horas sem supervisão.
- Ele é lançado com pesos abertos sob a Modified MIT License no Hugging Face.
- Nos benchmarks, o Kimi K2.6 mostra desempenho de ponta, especialmente para um modelo de código aberto. No Humanity's Last Exam com ferramentas ele marca 54,0%, no SWE-Bench Pro marca 58,6% e no BrowseComp em modo swarm marca 83,2%.
- Você pode conversar com o Kimi K2.6 agora mesmo na Overchat AI.
O que há de novo no Kimi K2.6
O Kimi K2.6 é uma evolução incremental do K2.5, mas o modelo traz vários recursos novos construídos sobre a mesma arquitetura MoE.
Arquitetura Mixture-of-Experts. O modelo conta com 1 trilhão de parâmetros no total, com 32 bilhões ativos por consulta, distribuídos entre 384 experts. Isso mantém o custo de inferência próximo ao de um modelo de 32B, ao mesmo tempo em que dá ao K2.6 a capacidade de raciocínio de um sistema de um trilhão de parâmetros.
Atenção MLA. A Multi-head Latent Attention reduz o consumo de memória durante a inferência de contexto longo — uma das principais razões pelas quais o K2.6 consegue sustentar 256K tokens de contexto sem disparar os custos.
Swarms de 300 agentes (contra 100 no K2.5). O K2.6 triplica o número máximo de subagentes que podem ser coordenados em paralelo. Um único orquestrador pode executar dinamicamente mais de 4.000 etapas coordenadas — contra cerca de 30 a 50 antes).
Claw Groups é um novo recurso em prévia de pesquisa que estende os swarms de agentes para sistemas heterogêneos abertos. Os usuários podem conectar agentes de outros dispositivos, rodando outros modelos, cada um com suas próprias ferramentas e memória — com o K2.6 atuando como coordenador.
Entrada de vídeo nativa. O K2.6 aceita conteúdo de vídeo diretamente pela API, além de texto e imagens. Esse é um recurso experimental disponível, por enquanto, apenas pela API oficial da Moonshot.
Quantização INT4 (QAT) entrega um ganho de velocidade de cerca de 2× no modo de baixa latência, sem perda de qualidade mensurável. Isso é útil para quem quer rodar o modelo localmente.
Otimizador Muon. O K2.6 foi treinado usando o otimizador Muon da Moonshot, que, segundo a equipe, oferece cerca de 2× mais eficiência computacional em comparação com a referência padrão AdamW — uma das principais razões pelas quais o K2.6 custa uma fração do que o Claude ou o GPT custam em tarefas comparáveis. Falaremos mais sobre isso adiante.
O Kimi K2.6 foi desenvolvido pela Moonshot AI, um laboratório de IA sediado em Pequim e fundado em 2023. A empresa opera com apenas (cerca de) 300 funcionários. A Moonshot chamou atenção logo cedo com seu chatbot Kimi de contexto gigantesco em 2024, e sua reputação na comunidade de código aberto foi consolidada com o lançamento do Kimi K2 em meados de 2025 — o primeiro modelo agentivo de pesos abertos com um trilhão de parâmetros.
Quão bom é o Kimi K2.6?
Nos benchmarks divulgados publicamente, o Kimi K2.6 é o líder claro do código aberto ou se posiciona dentro da elite dos modelos de fronteira, incluindo os de código fechado.
| Benchmark |
Kimi K2.6 |
GPT-5.4 (xhigh) |
Claude Opus 4.6 (max) |
Gemini 3.1 Pro (thinking high) |
| HLE-Full com ferramentas |
54,0% |
52,1% |
53,0% |
51,4% |
| SWE-Bench Pro |
58,6% |
57,7% |
53,4% |
54,2% |
| Terminal-Bench 2.0 |
66,7% |
65,4% |
65,4% |
68,5% |
| LiveCodeBench v6 |
89,6% |
— |
88,8% |
— |
| BrowseComp (Agent Swarm) |
86,3% |
— |
— |
— |
Programação. O SWE-Bench Verified em 80,2% iguala ou supera o Claude Opus 4.6.
Raciocínio e conhecimento. O AIME 2026 em 96,4% é quase perfeito em um benchmark de matemática de competição que era brutal para os modelos há apenas um ano.
Relatos do mundo real. A Vercel testou o modelo e relatou uma melhora de mais de 50% no seu benchmark interno de Next.js em relação ao K2.5. A Blackbox é outra empresa que teve acesso antecipado ao Kimi K2.6 e, segundo eles, ele detecta bugs profundos que "normalmente exigiriam um tempo considerável de desenvolvimento para serem descobertos".
Onde acessar o Kimi K2.6
Overchat AI. A Overchat AI é uma plataforma tudo-em-um que dá acesso ao Kimi K2.6 junto com o Claude Opus 4.7, o GPT-5.4, o Gemini 3.1 Pro e dezenas de outros modelos de ponta, tudo em uma única conta.
Canais oficiais da Moonshot.
- Kimi.com — chatbot web com os quatro modos
- App Kimi — iOS e Android
- Kimi Code CLI — agente de programação no terminal em kimi.com/code
- API da Moonshot — endpoints compatíveis com OpenAI e Anthropic em platform.moonshot.ai
Rode localmente. Os pesos completos do modelo estão disponíveis publicamente no Hugging Face sob a Modified MIT License, então você pode rodar o modelo no seu próprio sistema, pelo provedor de sua preferência.
Alternativas ao Kimi K2.6
Se o Kimi K2.6 não for ideal para o seu caso de uso, estes são os modelos comparáveis mais próximos:
- Claude Opus 4.7. O modelo de destaque atual da Anthropic. Mais forte em confiabilidade ao seguir instruções em inglês e em consistência de contexto extremamente longo, mas de código fechado e 5× mais caro.
- GPT-5.4. O modelo de destaque da OpenAI. Comparável na maioria dos benchmarks de programação, com um ecossistema corporativo mais amplo, de código fechado.
- DeepSeek V4. Concorrente chinês de código aberto previsto para chegar nas próximas semanas. Forte em benchmarks brutos de programação; primeiro modelo de fronteira a rodar inferência no chip Huawei Ascend 950PR.
- Gemini 3.1 Pro. O modelo de destaque do Google. Lidera no Terminal-Bench 2.0 e tem uma janela de contexto de 2M tokens, mas é de código fechado e atrelado ao ecossistema do Google Cloud.
- Kimi K2.5. O modelo de destaque anterior da Moonshot, ainda disponível e cerca de 15 a 20 pontos atrás do K2.6 em benchmarks agentivos, mas mais barato de rodar em hardware próprio.
FAQ
O Kimi K2.6 é gratuito?
Sim — você também pode usar o Kimi K2.6 gratuitamente na Overchat AI sem instalar nada. O acesso via API é pago, mas com preço bem abaixo dos concorrentes de código fechado.
O Kimi K2.6 é de código aberto?
É sim. Os pesos são publicados sob uma Modified MIT License, que permite uso comercial, modificação e redistribuição. Essa é uma das licenças mais permissivas do espaço de pesos abertos — significativamente mais aberta do que a licença Llama da Meta, por exemplo.
Como o Kimi K2.6 se compara ao Claude Opus 4.6 e ao GPT-5.4?
Na maioria dos benchmarks agentivos, o K2.6 iguala ou supera ligeiramente os dois. No HLE com ferramentas, no SWE-Bench Pro e no LiveCodeBench v6, ele lidera. Os modelos de código fechado ainda levam vantagem em cadeias de instruções muito longas em inglês e em algumas formas de escrita criativa, mas a diferença diminuiu a ponto de o trade-off entre preço e abertura importar mais do que a capacidade bruta para a maioria das equipes.
O Kimi K2.6 pode rodar localmente?
Sim, embora não com folga em hardware de consumidor. O modelo completo de 1 trilhão de parâmetros precisa de um servidor com bastante memória.
O que é o Agent Swarm?
O Agent Swarm é o recurso de destaque do K2.6. Um único agente orquestrador — o próprio K2.6 — cria até 300 subagentes especializados que trabalham em paralelo em diferentes partes de uma tarefa maior. Isso pode reduzir o tempo de execução em 4 a 5 vezes em algumas tarefas, como longas sessões autônomas de programação
Quanto custa o Kimi K2.6 pela API?
O K2.5 foi lançado a US$ 0,60 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída. A Moonshot não publicou preços atualizados para o K2.6 até 22 de abril de 2026, mas a empresa historicamente manteve os preços estáveis entre atualizações menores de versão. Para se ter uma ideia, isso é cerca de 5 vezes mais barato que o Claude Opus 4.6 e 8 vezes mais barato que o GPT-5.4 para volumes de saída comparáveis.
Conclusão
O Kimi K2.6 é, até agora, o argumento mais forte de que a IA agentiva de código aberto alcançou a fronteira do código fechado. Ele iguala o Claude Opus 4.6 e o GPT-5.4 na maioria dos benchmarks, lidera vários deles entre os agentivos, custa uma fração do que eles custam para rodar e é distribuído sob uma licença aberta e permissiva. Para desenvolvedores que constroem agentes de programação de longo horizonte, assistentes de pesquisa ou sistemas multiagentes, o Kimi K2.6 agora merece estar na lista de finalistas — não como alternativa de reserva de código aberto, mas como opção principal.
Experimente o Kimi K2.6 agora mesmo na Overchat AI.
Principais conclusões
- O Kimi K2.6 foi lançado em 20 de abril de 2026 como o novo modelo de ponta de código aberto.
- Ele conta com uma arquitetura Mixture-of-Experts de 1 trilhão de parâmetros, com 32B de parâmetros ativos, janela de contexto de 256K e entrada multimodal nativa.
- O recurso Agent Swarm é o destaque — agora ele pode criar até 300 subagentes paralelos e executar mais de 4.000 etapas coordenadas.
- O modelo foi lançado com pesos abertos sob a Modified MIT License.
- O preço da API não havia sido publicado até o momento da redação deste texto, mas, se projetarmos a partir do K2.5, o K2.6 será cerca de 5× mais barato que o Claude Opus 4.6, por exemplo.
- Para testá-lo gratuitamente, acesse a página do modelo Kimi K2.6 na Overchat AI.