Em 5 de agosto de 2025, a Anthropic lançou o Claude Opus 4.1, descrevendo-o como um substituto direto do Opus 4.
O número da versão já diz muito. Diferentemente do GPT-5, esta é uma atualização incremental. O modelo mantém a mesma janela de contexto de 200.000 tokens do anterior, com 32.000 tokens de saída, mas ganha uma capacidade ampliada de raciocínio, que agora pode usar até 64.000 tokens em tarefas complexas.
Você pode usá-lo pela Overchat AI e pelos planos Claude Pro, Max, Team e Enterprise, além da API da Anthropic com o identificador de modelo claude-opus-4-1-20250805, do Amazon Bedrock e do Vertex AI do Google Cloud.
Para quem desenvolve com o Claude Code, a integração via linha de comando dá acesso direto aos recursos do modelo pelo terminal. Isso faz diferença para os engenheiros que querem usar IA sem sair do ambiente de desenvolvimento.
Benchmarks do Claude Opus 4.1
Os ganhos de desempenho em relação ao Opus 4, que já era um dos modelos de IA de ponta, são modestos — pelo menos no papel.
Veja como o desempenho mudou entre o Claude Opus 4 e o 4.1:
SWE-bench Verified: 72,5% → 74,5%
Terminal-Bench: 39,2% → 43,3%.
Competição de matemática AIME 2025: 75,5% → 78,0%.
GPQA Diamond (nível de pós-graduação): 79,6% → 80,9%.
Vale notar que parte do feedback do mundo real aponta um ganho de desempenho maior do que o indicado pelos benchmarks.
Os testes internos da Windsurf mostraram que a evolução do Opus 4 para o 4.1 equivale a um ganho de um desvio padrão completo no benchmark deles para desenvolvedores juniores. É o mesmo nível de melhoria que eles observaram entre o Sonnet 3.7 e o Sonnet 4.
Isso levanta uma questão: o modelo é realmente tão melhor assim? Tudo indica que as maiores melhorias de desempenho estão em tarefas avançadas de programação e em raciocínio agêntico, mas você vai precisar testá-lo por conta própria para ver se ele melhorou no seu caso de uso específico.
No que o Claude Opus 4.1 é melhor?
O recurso mais impressionante é a capacidade de reorganizar código em vários arquivos. O GitHub destacou "ganhos de desempenho especialmente notáveis" nessa área, enquanto o Rakuten Group relatou que o modelo se destaca em identificar correções exatas dentro de grandes bases de código, sem fazer ajustes desnecessários nem introduzir novos bugs.
Nos testes deles, o Rakuten descobriu que as tarefas foram concluídas 50% mais rápido.
O modelo agora é muito preciso e segue bem as instruções. Segundo a Cursor, o Opus 4.1, junto com o Sonnet 4, apresenta as melhores habilidades de programação e uma compreensão mais aprofundada de código complexo. Isso muda fundamentalmente a forma como o agente deles funciona. O modelo entende quando não deve mexer no código. Essa é uma habilidade crucial, que separa as ferramentas úteis daquelas que criam mais problemas do que resolvem.
Na mesma linha, a escrita criativa também melhorou e agora deve soar mais natural.
A Anthropic chama isso de "personagens ricos e profundos". O resultado deve parecer menos robótico — ainda que continue claramente gerado por IA —, mas com menos construções estranhas e menos padrões repetitivos.
Quanto custa o Claude Opus 4.1?
Os preços são os mesmos do Opus 4:
US$ 15 por milhão de tokens de entrada
US$ 75 por milhão de tokens de saída.
Isso o torna um dos modelos mais caros disponíveis.
Normalmente, custa de US$ 7 a US$ 8 para resolver tarefas complexas de programação. Se você usar bastante o modelo, pode acabar pagando até US$ 2.500 por mês.
Se você quer experimentar o Opus 4.1 sem gastar muito, dá para conversar com esse modelo na Overchat AI por US$ 4,99 por semana.
Segurança do Claude Opus 4.1
A Anthropic usa o Claude Opus 4.1 dentro do seu Padrão de Segurança de IA de Nível 3 (ASL-3). As métricas de segurança mostram melhorias significativas sem deixar o produto mais difícil de usar. O modelo atinge uma taxa de recusa de 98,76% para solicitações que violam as regras, acima dos 97,27% do Opus 4, mantendo apenas 0,08% de recusa para solicitações que não são prejudiciais.
Há uma queda de 25% na cooperação quando se trata de usos realmente mal-intencionados, em comparação com a versão anterior.
As melhorias de segurança não reduzem as capacidades. Não se trata da abordagem cautelosa vista em lançamentos anteriores mais focados em segurança.
Limitações
O Claude Opus 4.1 parece um bom lançamento, mas vale falar dos possíveis problemas.
Em primeiro lugar, algumas pessoas dizem que o modelo é "criativo demais para código comum". Ou seja, ele cria soluções excessivamente engenhosas para problemas mais simples, em vez de seguir padrões já consolidados. Isso pode dificultar a manutenção do código que ele gera.
Em segundo lugar, o modelo é bem lento. O GPT-5 leva vantagem para responder perguntas simples, o que o torna a melhor opção quando você precisa de respostas rápidas.
Por fim, o custo alto significa que você só deve usá-lo em situações nas quais o desempenho superior compensa a despesa. A US$ 75 por milhão de tokens de saída, é preciso ter cuidado para saber quando usar este modelo em vez de opções mais acessíveis.
FAQ
O que é o Claude Opus 4.1?
O Claude Opus 4.1 é o modelo de IA mais recente da Anthropic, lançado em 5 de agosto de 2025 como substituto direto do Opus 4. É uma atualização incremental que entrega melhor desempenho pelo mesmo preço, com melhorias especialmente em programação e na execução autônoma de tarefas.
Quando devo usar o Claude Opus 4.1?
Use o Claude Opus 4.1 em problemas complexos, de várias etapas, que exigem análise cuidadosa, como:
Refatoração de código em vários arquivos
Tarefas longas de pesquisa
Depuração de grandes bases de código
Criação de documentação técnica
Para consultas simples ou quando a velocidade é importante, modelos mais baratos e rápidos, como o Sonnet 4 ou o GPT-5, podem ser melhores.
Quanto custa o Claude Opus 4.1?
Custa US$ 15 a cada milhão de tokens de entrada e US$ 75 a cada milhão de tokens de saída. O processamento em lote oferece 50% de desconto. Na prática, tarefas complexas de programação custam entre US$ 7 e US$ 8 cada uma. Em fluxos de desenvolvimento intensos, o custo pode chegar a US$ 2.500 por mês.
Onde posso usar o Claude Opus 4.1?
O Claude Opus 4.1 está disponível pela Overchat AI e pelo Claude Pro, além da API da Anthropic (identificador de modelo: claude-opus-4-1-20250805), do Amazon Bedrock, do Vertex AI do Google Cloud e do Claude Code para fluxos de trabalho no terminal.
Que melhorias o Claude Opus 4.1 traz em relação ao Opus 4?
As maiores melhorias estão em programação (um aumento de 2% no SWE-bench), no desempenho do Terminal-Bench e no raciocínio matemático. O Rakuten testou este modelo no mundo real e descobriu que as tarefas foram concluídas 50% mais rápido.
Conclusão
A marca está perfeita para o Claude Opus 4.1. É uma pequena atualização de um modelo que já é muito popular, especialmente entre as empresas.
A maioria dos benchmarks teve melhorias de cerca de um a dois pontos percentuais, mas alguns usuários relataram ganhos bem maiores no desempenho do dia a dia. Como diz o ditado: "Prometa menos e entregue mais." É assim que a Anthropic vem construindo seus modelos, e aqui não é diferente.
Mas, segundo a Anthropic, virão "melhorias significativas" em breve — talvez um Claude 5? Vai ser muito interessante ver como esse futuro lançamento se compara ao GPT-5. Por enquanto, temos mais um modelo novo que está à altura!