/
O que é o DeepSeek R2: o melhor modelo de IA que está por vir em 2025?
Last Updated:
2026-06-09

O que é o DeepSeek R2: o melhor modelo de IA que está por vir em 2025?

Depois que a startup chinesa DeepSeek chocou todo mundo com o R1 – um modelo de IA que se igualou ao melhor da OpenAI custando 97% menos para operar –, os rumores sobre o seu próximo lançamento não param de circular. 

O DeepSeek R2 promete ir ainda mais longe, possivelmente rodando em chips chineses de altíssima eficiência no lugar das GPUs da Nvidia.

Esse modelo pode redefinir todo o setor de IA e dar a palavra final no debate entre DeepSeek e ChatGPT.

Por que o DeepSeek R2 é tão importante?

Relatórios vazados sugerem que o DeepSeek R2 é um modelo gigantesco, com 1,2 trilhão de parâmetros, que de algum modo usa apenas 78 bilhões de parâmetros por vez, o que o torna incrivelmente eficiente.

Se esses rumores forem verdadeiros, o R2 pode custar apenas US$ 0,07 por milhão de tokens de entrada e US$ 0,27 por milhão de tokens de saída — compare isso com os US$ 15 e US$ 60 que a OpenAI cobra, respectivamente, pelo modelo o1, que é tão caro de operar que fica praticamente restrito a usuários da API e assinantes do plano Max.

Na prática, isso significa que estamos falando de uma IA potencialmente tão inteligente quanto o melhor e mais cobiçado modelo da OpenAI, mas que custa menos do que o GPT 4.1-nano, um dos modelos mais baratos da OpenAI atualmente.

O que é o DeepSeek R2?

O DeepSeek R2 é o modelo de linguagem de grande porte de última geração da DeepSeek, uma startup chinesa de IA.

Aspecto Detalhes
Principais capacidades • Raciocínio complexo em vários idiomas
• Programação e depuração avançadas
• Compreensão de imagens e visão computacional
• Suporte multimodal (texto, imagens, áudio e vídeo básico)
Por que ele é tão importante? O R2 deve igualar o desempenho do GPT-o1, mas custando 97% menos para operar
Como ele foi treinado? Ele foi treinado ao longo de 45 dias com 5,2 petabytes de dados de treinamento, incluindo conjuntos de dados especializados de finanças, direito e patentes
Que arquitetura ele usa? Ele usa uma arquitetura MoE com 1,2 trilhão de parâmetros no total e 78 bilhões ativos por vez.
Qual é o desempenho dele? • 89,7% no C-Eval 2.0 (o benchmark de IA mais rigoroso da China)
• 92,4% de precisão em tarefas de visão do COCO
• Iguala ou supera o desempenho do GPT-o1 e do Claude Opus
Quanto custa para operar? • US$ 0,07 por milhão de tokens de entrada
• US$ 0,27 por milhão de tokens de saída
Quando ele será lançado? Em algum momento de 2025

Ele se baseia no sucesso do R1, que provou que não é preciso ter bilhões em recursos de computação para criar uma IA de ponta. Da mesma forma, o R2 quer ser ainda mais poderoso e, ao mesmo tempo, continuar sendo econômico.

O modelo foi projetado para dar conta de tudo, do raciocínio e da programação mais complexos à compreensão de imagens e de vários idiomas em nível de falante nativo.

Curiosamente, enquanto o R1 foi treinado em milhares de GPUs Nvidia H100 e H200, o R2 estaria sendo desenvolvido com os chips Ascend 910B da Huawei, e o treinamento aparentemente levou apenas 45 dias. Isso não é nada no mundo do treinamento de IA.

Segundo os rumores, o modelo foi treinado com 5,2 petabytes de dados, incluindo conjuntos de dados especializados de finanças, direito e patentes, alcançou 89,7% no C-Eval 2.0 — o benchmark de IA mais rigoroso da China — e atinge 92,4% de precisão em tarefas de visão usando o conjunto de dados COCO.

Em que o DeepSeek R2 vai se destacar?

Segundo os rumores, o DeepSeek R2 será especialmente forte em 3 frentes:

  1. Programação
  2. Compreensão de vários idiomas
  3. Processamento de diferentes tipos de entrada

Programação

O modelo supostamente entende não só a sintaxe, mas também a arquitetura de software, consegue depurar bases de código complexas e atua no nível de um desenvolvedor sênior.

Em resumo, o R2 pode superar os melhores modelos de IA para programação e, ao mesmo tempo, ser um modelo de uso geral.

O que isso significa na prática? Você pode pedir que ele escreva um script em Python, explique um erro em Rust, refatore um código em JavaScript e ajude com algumas tarefas de casa — e ele dá conta de tudo.

Compreensão de vários idiomas

Você já percebeu que fazer perguntas à IA em idiomas que não o inglês às vezes resulta em respostas menos elaboradas? Não é o caso do DeepSeek R2, que, segundo os rumores, mantém toda a sua capacidade de raciocínio em vários idiomas. 

Para os bilhões de pessoas que não têm o inglês como idioma principal, isso pode significar finalmente ter acesso a uma IA que funciona tão bem para elas quanto o Claude Sonnet 4 funciona para quem fala inglês.

Leia uma análise do Claude Sonnet 4.

Processamento de diferentes tipos de entrada

O modelo supostamente lida com imagens, áudio e compreensão básica de vídeo, tudo em um único sistema unificado. Isso significa que você pode mostrar uma foto e fazer perguntas sobre ela, pedir que ele analise tabelas e gráficos ou até mesmo descreva o que está acontecendo em um trecho de vídeo.

Por exemplo, você pode enviar uma captura de tela de um código com erro, pedir ao R2 que explique a falha, fazer com que ele gere um diagrama mostrando a correção e, em seguida, criar a documentação — tudo em uma única conversa. 

Os primeiros exemplos mostram que o modelo consegue entender relações visuais complexas, ler texto em imagens e até gerar visualizações básicas com base em dados.

Não chega a ser um pacote completo de IA tudo em um, mas, ainda assim, é bastante versátil.

As inovações de treinamento do DeepSeek R2

O desempenho impressionante descrito acima foi alcançado graças a várias inovações no método de treinamento. Veja as técnicas que sabemos que eles usaram para treinar esse modelo:

Modelagem Generativa de Recompensa (GRM)

A DeepSeek desenvolveu algo que ela chama de Modelagem Generativa de Recompensa, e é mais ou menos como ensinar a IA a corrigir a própria lição de casa. Em vez de precisar de milhares de pessoas para dizer ao modelo o que é bom ou ruim, a GRM permite que o próprio modelo gere o seu feedback durante o treinamento. 

Diz-se que a GRM leva a uma compreensão mais sutil, porque o modelo desenvolve a própria noção do que funciona em vez de apenas memorizar as preferências humanas.

Ajuste por Crítica com Princípios Próprios

Antes de dar uma resposta, o R2 basicamente se pergunta: "Isso está correto? Isso é útil? Daria para ser mais claro?". Essa autorreflexão acontece em milissegundos, mas torna o modelo mil vezes mais preciso.

Arquitetura híbrida de Mistura de Especialistas (MoE)

É uma arquitetura parecida com a usada no Gemini 2.5 Pro. E, se você já usou esse modelo, sabe o quanto ele é bom. 

Como essa arquitetura funciona? É justamente por causa dela que o R2 consegue ser tão imenso e, ao mesmo tempo, tão eficiente. Quando você pede que ele programe, ele ativa os especialistas em programação. Quando você muda de assunto e começa a falar sobre história, outros especialistas entram em ação enquanto os de programação ficam em repouso.  No total, em vez de usar todos os 1,2 trilhão de parâmetros em cada tarefa, ele ativa apenas cerca de 78 bilhões.

É por isso que ele pode custar apenas US$ 0,07 por 1 milhão de tokens de entrada (se os rumores estiverem mesmo corretos).

Da Nvidia para os chips da Huawei

A DeepSeek teria treinado o R2 usando os chips Ascend 910B da Huawei no lugar das GPUs da Nvidia, o que é uma notícia simplesmente enorme para o mundo da IA.

Depois que os EUA restringiram o acesso da China a chips avançados, muita gente achou que o desenvolvimento de IA chinês ficaria paralisado. Em vez disso, a DeepSeek pode ter acabado de provar que a Nvidia é superestimada.

Relatórios sugerem que esses sistemas movidos a tecnologia da Huawei alcançaram 91% de eficiência em comparação com clusters semelhantes de Nvidia A100. Para a Nvidia, cujo preço das ações disparou com a demanda por IA, isso pode significar o fim do seu quase monopólio, e os investidores já se preparam para uma forte queda.

Além disso, a DeepSeek teria construído toda uma cadeia de suprimentos nacional para hardware de IA, produzindo  tudo, de módulos de memória a sistemas de resfriamento, internamente, dentro da própria China, para escapar de eventuais restrições futuras. E, se a DeepSeek der certo, outras gigantes chinesas de tecnologia podem tentar copiar essa abordagem.

Para os consumidores, isso provavelmente significa que veremos modelos de IA bem mais interessantes vindos da China, mesmo depois do lançamento do R2 (estamos de olho em você, Alibaba — esqueça o Qwen 3, chegou a hora do Qwen 4).

Como o R2 será usado no mundo real?

Grandes fabricantes chineses como Haier, Hisense e TCL já integraram a IA da DeepSeek em tudo, de geladeiras a aspiradores robôs, mas as aplicações mais interessantes estão na robótica.

Robôs domésticos movidos pela DeepSeek poderiam entender o ambiente ao redor, se adaptar a mudanças e dar conta de solicitações complexas com várias etapas.

Imagine dizer ao seu aspirador robô: "limpe tudo, menos perto do gato que está dormindo, e deixe a cozinha por último porque estou cozinhando".

Devo me preocupar com privacidade ao usar o R2?

A DeepSeek é uma empresa chinesa, e todos os dados de seus aplicativos vão para servidores na China. Isso significa que, ao usar o DeepSeek, seus dados ficam sujeitos às leis de dados chinesas. Vale a pena ter isso em mente.

Se você não quiser isso, sempre pode rodar o DeepSeek no seu próprio hardware. Afinal, a DeepSeek disponibiliza seus modelos em código aberto — você pode baixá-los e executá-los totalmente offline.

Você pode imaginar que rodar um modelo avançado exige um PC bem parrudo, e, em geral, estaria certo. Mas, graças à eficiência do R2, dá para rodá-lo de forma realista em um dispositivo de nível doméstico. 

A contrapartida está na comodidade e na facilidade de uso.

Quando o DeepSeek R2 será lançado?

A DeepSeek tem ficado estranhamente quieta sobre a data oficial de lançamento do R2, mas a fábrica de rumores sugere que ele pode sair nas próximas semanas ou meses.

A empresa tem um histórico de lançamentos surpresa, tendo lançado o R1 com pouco aviso prévio e impacto máximo.

Veja alguns sinais que vale a pena ficar de olho e que podem indicar que o R2 está prestes a chegar:

  • Aumento das contratações na sede da DeepSeek, em Hangzhou
  • Surgimento de nova documentação da API no GitHub
  • Instabilidades suspeitas nos serviços existentes, o que pode indicar atualizações de infraestrutura.

Alguns desenvolvedores chegam a afirmar que identificaram referências ao modelo R2 em registros de API vazados.

Uma coisa é certa: quando o R2 chegar, não será um lançamento discreto, mas uma verdadeira reviravolta no mercado.

PERGUNTAS FREQUENTES

O que é o DeepSeek R2?

O DeepSeek R2 é o próximo modelo de IA de última geração da startup chinesa DeepSeek, projetado para competir com o GPT o1 e o Claude Opus custando 97% menos para operar.

Quando o DeepSeek R2 será lançado?

O DeepSeek R2 será lançado em algum momento de 2025. A DeepSeek não anunciou uma data oficial, mas o aumento da atividade e os vazamentos apontam para um lançamento iminente, possivelmente dentro de semanas ou meses.

O que torna o DeepSeek R2 diferente de outros modelos de IA, como o GPT-4?

Os principais diferenciais do R2 são a sua eficiência de custo extrema, já que custa apenas US$ 0,07 contra US$ 15 por milhão de tokens de entrada, em comparação com o GPT-o1 de especificações semelhantes. Ele também é de código aberto e usa técnicas de treinamento inovadoras, como a Modelagem Generativa de Recompensa.

Quais empresas estão usando a tecnologia de IA da DeepSeek?

A Overchat AI usa o DeepSeek, junto com outros modelos, para oferecer chats de IA inteligentes online. Fabricantes chineses como Haier, Hisense e TCL Electronics integraram a IA da DeepSeek a produtos de consumo: TVs inteligentes, eletrodomésticos e aspiradores robôs.

A DeepSeek está buscando a Inteligência Artificial Geral (AGI)?

Sim, a DeepSeek afirma abertamente que alcançar a AGI é seu objetivo de longo prazo. Eles priorizaram a pesquisa em vez da receita e recusaram grandes ofertas de investimento para manter a independência na busca dessa visão.