O Que É o Kimi K2? O LLM Aberto da Moonshot AI Explicado
Last Updated:
2026-06-09
O Que É o Kimi K2? O LLM Aberto da Moonshot AI Explicado
Acabamos de adicionar as variantes Kimi K2 e Kimi K2 Turbo ao Overchat AI. Kimi K2 e Kimi K2 Turbo. Esse modelo gerou muito burburinho no Reddit, com vários usuários chamando-o de melhor modelo de IA disponível e elogiando sua capacidade de resolver problemas e de escrever.
Vamos mergulhar fundo nesse modelo, compará-lo com outros como o GPT 5 e o Gemini 2.5 Pro e ver como ele se sai nos benchmarks. Também vamos descobrir o que o torna tão bom.
O Kimi K2 é um modelo gigantesco do tipo mistura de especialistas (mixture-of-experts) da MoonShot (sediada em Pequim e financiada pela Alibaba), com 32 bilhões de parâmetros ativados, 1 trilhão de parâmetros no total e treinamento em 15,5 trilhões de tokens.
A variante principal, Kimi K2 Thinking, supera o GPT-5 e o Claude Sonnet 4.5 em vários benchmarks — marcando 44,9% no Humanity's Last Exam contra 41,7% do GPT-5, e ficando em segundo lugar no AIME 2025 em novembro de 2025.
O K2 consegue executar de 200 a 300 chamadas de ferramentas em sequência sem instrução humana, o que o torna excepcional para fluxos de trabalho agênticos, pesquisas em várias etapas e tarefas autônomas de longa duração.
No BrowseComp (navegação na web e raciocínio sobre informações difíceis de encontrar), o K2 marcou 60,2% contra 54,9% do GPT-5, destacando-se em pesquisa aprofundada.
Em programação, o K2 marcou 71,3% no SWE-bench Verified e 83,1% no LiveCodeBench V6, lidando com a compreensão de repositórios inteiros e a resolução de issues reais do GitHub.
O preço da API é de US$ 0,60 por milhão de tokens de entrada — de 75% a 90% mais barato que o GPT-5 e o Claude Sonnet 4.5.
Ao contrário do GPT-5 e do Claude Sonnet 4.5, que perderam um pouco do brilho criativo conforme ganharam capacidade de raciocínio, o K2 atinge um equilíbrio melhor — produzindo textos com bem mais personalidade e um tom no estilo do Medium.
O K2 já está disponível no Overchat AI, e os usuários do Overchat Pro têm conversas ilimitadas tanto com o Kimi K2 quanto com o Kimi K2 Turbo.
O que é o Kimi K2?
O Kimi K2 é mais um modelo gigantesco do tipo mistura de especialistas (MoE) vindo da China. Ele foi desenvolvido pela MoonShot, uma empresa de pesquisa sediada em Pequim e financiada pela Alibaba.
Assim como o DeepSeek V3.1, o novo modelo é impressionante: oferece 32 bilhões de parâmetros ativados e 1 trilhão de parâmetros no total, treinados em 15,5 trilhões de tokens.
Existem duas versões principais.
Kimi K2 (Base/Instruct)
Kimi K2 Thinking
O modelo K2 Thinking é o mais notável, já que supera o GPT-5 e o Claude Sonnet 4.5 em vários benchmarks. Por exemplo, ele marcou 44,9% no Humanity's Last Exam, contra 41,7% do GPT-5.
Há muito burburinho em torno desses novos modelos de IA por causa de suas capacidades agênticas. O Kimi K2, por exemplo, consegue usar de 200 a 300 ferramentas em sequência sem instrução humana.
Isso o torna útil para empresas. Mas há muito mais nesses modelos do que isso. Eles também são ótimos em tarefas do dia a dia e baratos de executar.
O preço da API do Kimi K2, por exemplo, é de US$ 0,60 por milhão de tokens de entrada, o que é de 75% a 90% mais barato que o GPT-5 e o Claude Sonnet 4.5. É por isso que conseguimos oferecer chat de IA ilimitado com o Kimi K2 para os usuários do Overchat Pro!
Curiosidade: a família Kimi pode ter passado despercebida, mas ela é, na verdade, responsável por vários pioneirismos mundiais. O Kimi, por exemplo, foi lançado publicamente em 16 de novembro de 2023 e, na época, era o primeiro modelo público do mundo a oferecer suporte a um contexto de 128.000 tokens.
Benchmarks do Kimi K2
De acordo com o AIME 2025, por exemplo, o Kimi K2 Thinking aparece como o segundo modelo de geração de texto mais avançado em novembro de 2025.
Benchmark
Kimi K2 Thinking
GPT-5
Claude Sonnet 4.5
Gemini 2.5 Pro
Grok 4
HLE (com ferramentas)
44,9%
41,7%
32,0%
18,8%*
~50,7%
BrowseComp
60,2%
54,9%
24,1%
–
–
GPQA Diamond
85,7%
84,5%
~78–80%
84,0%
87,5%
AIME 2025
~94,6%
~94,6%
49,5%
86,7%
100%
SWE-Bench Verified
71,3%
–
77,2%
63,8%
69,1–75%
LiveCodeBench v6
83,1%
–
–
70,4%
–
Se você quiser um detalhamento mais completo dos benchmarks, dê uma olhada na publicação do blog de pesquisa da Moonshot sobre o Kimi K2 — vale a leitura e ela se aprofunda bem mais nas capacidades agênticas do modelo, caso isso seja algo que desperte sua curiosidade. Não vamos abordar muito esse ponto aqui, já que é um tema mais avançado.
Melhores casos de uso do Kimi K2
Vamos falar do que o Kimi faz de melhor.
1. Pesquisa
A capacidade do K2 de executar de 200 a 300 chamadas de ferramentas sem receber novas instruções o torna excepcional para fluxos de pesquisa em várias etapas. Na avaliação BrowseComp, que testa a habilidade de navegar na web e raciocinar sobre informações difíceis de encontrar, o K2 marcou 60,2%, superando os 54,9% do GPT-5.
2. Qualquer tarefa complexa
O K2 costuma fazer perguntas de esclarecimento antes de agir e consegue explorar vários caminhos de solução em paralelo. O modelo também é notavelmente bom em pensar sozinho nos problemas e traçar um plano de ação claro para responder à sua pergunta ou tarefa.
Quando você pergunta algo ao K2 ou lhe atribui uma tarefa, veja o que acontece nos bastidores:
Por meio desse processo de raciocínio interno, o Kimi determina a forma mais eficaz de resolver o seu problema.
Para deixar claro, todos os modelos de raciocínio — incluindo o Gemini 2.5 Pro, o Claude Opus 4.1 e o GPT-5 — usam uma abordagem parecida. No entanto, o raciocínio do Kimi é particularmente nítido, o que lhe permite ser excepcionalmente preciso.
3. Escrever código pronto para produção
O K2 marcou 71,3% no teste SWE-bench Verified, que avalia o raciocínio agêntico e as capacidades de programação. Isso indica sua capacidade de compreender repositórios inteiros e resolver issues reais do GitHub. O K2 também lidera no LiveCodeBench V6 com 83,1%, o que o torna ideal para gerar estruturas de código complexas. Além disso, para fluxos de trabalho via API, ele é de 75% a 90% mais barato que a maioria dos modelos "ocidentais" de peso, a US$ 0,60 por milhão de tokens de entrada.
4. Fluxos autônomos de longa duração
O K2 Thinking é treinado de ponta a ponta para intercalar raciocínio em cadeia de pensamento (chain-of-thought) com chamadas de função, viabilizando fluxos autônomos de pesquisa, programação e escrita que duram centenas de etapas sem perder o rumo, segundo a Hugging Face.
5. Análise de dados
A Moonshot anunciou planos de integrar o K2 a aplicações de modelagem financeira e pretende aproveitar a capacidade de raciocínio do modelo. Com sua janela de contexto de 256K e a habilidade de raciocinar ao longo de centenas de etapas, o K2 se destaca na análise de grandes conjuntos de dados e na síntese de insights.
Desempenho do Kimi K2 na escrita
Vamos falar do uso do Kimi K2 para escrever em uma seção à parte, porque há, na verdade, uma surpresa quando o assunto é a capacidade de escrita desse modelo.
De forma anedótica, muitos usuários perceberam que, quando o GPT-5 e o Claude Sonnet 4.5 ficaram especialmente fortes em lógica e raciocínio, eles pareceram perder um pouco do brilho criativo — os ganhos em capacidade analítica e programação muitas vezes vinham à custa da criatividade e da expressividade.
Para quem depende da IA para escrever, isso foi um grande revés no fluxo de trabalho. O Kimi K2, porém, parece atingir um equilíbrio melhor — ele é visivelmente mais completo.
De qual texto você gosta mais?
Nossa opinião: nenhum dos dois é perfeito, mas a versão do Kimi tem uma certa graça e lembra o tipo de conteúdo que você encontraria no Medium, o que é bom.
Para ser justo, ela não soa totalmente humana e ainda tem aquele toque de IA. Mas, de novo, nenhum modelo disponível comercialmente consegue soar humano sem uma edição pesada.
Conclusão
Acabamos de adicionar o Kimi K2 ao Overchat AI, e este é um dos modelos de geração de texto mais avançados do mundo. Ele supera o GPT 5, o Gemini 2.5 Pro e o Claude Sonnet na maioria dos benchmarks. Ao mesmo tempo, os usuários dizem que ele também escreve melhor que esses modelos, o que é raro, já que os modelos de raciocínio tendem a sacrificar a qualidade da escrita criativa em troca de lógica e precisão.
Além disso, o Kimi K2 é muito mais barato que outros modelos de ponta — por isso, os usuários do Overchat Pro têm conversas ilimitadas com o Kimi.