/
gpt-oss: os primeiros modelos de peso aberto da OpenAI
Last Updated:
2026-06-09

gpt-oss: os primeiros modelos de peso aberto da OpenAI

A OpenAI lançou seus primeiros modelos de linguagem de peso aberto desde o GPT-2, em 2019 — uma grande mudança de rumo para a empresa.

Os dois novos modelos são:

  • Gpt-oss-120b
  • Gpt-oss-20b

O ecossistema de IA de peso aberto sempre foi dominado por Meta, Mistral AI e DeepSeek. Mas agora a OpenAI entra nessa disputa. Depois de anos oferecendo seus produtos principalmente pela API e pela interface do ChatGPT, esta é uma nova forma de personalizar o comportamento do GPT.

Como são os dois novos modelos?

  • O gpt-oss-120b é o modelo aberto mais importante da OpenAI. Ele foi projetado para uso em data centers e em hardware de consumo de ponta.
  • O gpt-oss-20b é um modelo menor, o que facilita o acesso de mais pessoas, já que ele funciona bem na maioria dos computadores.

Os dois modelos foram pensados para rodar localmente, mas você também pode usar ambos no Overchat AI.

Ambos contam com o seguinte:

  • A licença Apache 2.0, que permite criar livremente, sem restrições sobre como você pode usar ou compartilhar o software.
  • Esforço de raciocínio configurável — você ajusta facilmente o nível de detalhamento do raciocínio (baixo, médio ou alto).
  • Acesso completo ao processo de raciocínio do modelo, o que torna a depuração mais simples.
  • Quantização MXFP4 nativa, que permite reduzir o tamanho do modelo mantendo um bom desempenho.

Na prática, o gpt-oss-120b roda em uma única GPU H100. Já o gpt-oss-20b roda com 16 GB de memória — em um MacBook Pro M1, por exemplo. 

Benchmarks do gpt-oss

Nos benchmarks, os resultados são bastante competitivos.

  • No MMLU, o gpt-oss-120b atinge 90,0%, enquanto o gpt-oss-20b chega a 85,3%, em comparação com o modelo proprietário o3 da OpenAI, que faz 93,4%.
  • No GPQA Diamond, as pontuações são de 80,1% e 71,5%, respectivamente.

O desempenho em matemática também é bom: os dois modelos acertam mais de 96% das respostas nos testes AIME 2024 e 2025. Essa habilidade matemática torna os modelos ótimos para computação científica e análise de dados.

A OpenAI conseguiu deixar os modelos muito eficientes, o que resolve um dos principais problemas dos modelos abertos: facilitar a execução em diferentes níveis de hardware.

A empresa trabalhou com grandes fabricantes de hardware, incluindo Nvidia, AMD, Cerebras e Groq, para garantir a compatibilidade com diferentes arquiteturas de chip. Isso é especialmente importante para clientes corporativos que querem usar o modelo em ambientes computacionais variados, como infraestrutura em nuvem e dispositivos de borda.

Onde acessar o gpt-oss-20b e o gpt-oss-120b

A melhor forma de ver como os modelos básicos respondem é no Overchat AI. Primeiro, crie uma conta gratuita. Depois, faça login e escolha a versão do modelo que quer usar. Pronto: você já pode conversar com os novos modelos da OpenAI por uma interface de chatbot familiar.

Os modelos também estão disponíveis em vários lugares, então o acesso é rápido.

  • Hugging Face e GitHub são os principais repositórios, sob os termos de licenciamento Apache 2.0.
  • Você pode usar o LM Studio e o Ollama para implantações em desktop.
  • Amazon, Baseten e Microsoft oferecem soluções de hospedagem em nuvem.

Para que esses modelos servem?

Os modelos gpt-oss foram projetados para tarefas agênticas. Isso significa que eles conseguem usar ferramentas e executar raciocínios complexos com várias etapas.

Ambos os modelos dão conta de:

  • Integração com busca na web
  • Execução de código em Python
  • Chamada de funções
  • Saídas estruturadas
  • Processamento por cadeia de raciocínio (chain-of-thought)

O menor, gpt-oss-20b, pode ajudar você no seu notebook. Ele consegue pesquisar seus arquivos, escrever documentos e auxiliar em tarefas de programação. O maior, gpt-oss-120b, é melhor para aplicações mais exigentes, como análise de dados, pesquisa e tarefas de raciocínio complexo que precisam de mais poder de processamento.

Nessa mesma linha, o uso mais comum dos modelos provavelmente vai ser quando um desenvolvedor quiser ajustar a forma como o GPT se comporta.

Por exemplo, você pode fazer o fine-tuning dos dois modelos com seus próprios dados e, ao contrário das soluções baseadas em API (em que as opções de personalização são limitadas), esses modelos dão controle total sobre os parâmetros.

Além disso, você também pode ajustar o esforço exigido no processo de raciocínio.

  • Use o nível baixo para respostas rápidas
  • médio para um desempenho equilibrado
  • alto para tarefas analíticas complexas

Escolha a melhor opção de acordo com suas necessidades específicas e seus requisitos de latência.

Conclusão

Depois de seis anos oferecendo apenas produtos fechados e baseados em API, a OpenAI lançou dois novos modelos de peso aberto. O gpt-oss-120b e o gpt-oss-20b podem rodar no seu hardware e ser totalmente personalizados para tarefas específicas. Essa é a resposta da OpenAI à concorrência de Meta, Mistral e outras empresas que dominavam o espaço de peso aberto. Os modelos têm bom desempenho nos testes e dão conta de problemas complexos, uso de ferramentas e tarefas de programação.

Você pode testar os dois modelos agora mesmo no Overchat AI. Primeiro, crie uma conta gratuita. Depois, selecione um dos modelos na interface.