Descrição
A OpenAI está lançando gpt-oss-120b e gpt-oss-20b, dois modelos de linguagem de peso aberto de última geração que oferecem forte desempenho no mundo real a baixo custo. Esses modelos estão disponíveis sob a flexível licença Apache 2.0 e superam modelos abertos de tamanho semelhante em tarefas de raciocínio. Eles demonstram fortes capacidades de uso de ferramentas e são otimizados para implantação eficiente em hardware de consumo.
O modelo gpt-oss-120b alcança quase paridade com o OpenAI o4-mini em benchmarks de raciocínio principais, enquanto opera de forma eficiente em uma única GPU de 80 GB. O modelo gpt-oss-20b oferece resultados semelhantes ao OpenAI o3-mini em benchmarks comuns e pode ser executado em dispositivos de borda com apenas 16 GB de memória. Isso o torna ideal para casos de uso em dispositivos, inferência local ou iteração rápida sem infraestrutura cara. Ambos os modelos também apresentam bom desempenho em uso de ferramentas, chamadas de função com poucos exemplos e raciocínio em cadeia.
A segurança é fundamental para a abordagem da OpenAI ao lançar modelos, especialmente para modelos abertos. Os modelos gpt-oss passaram por um treinamento e avaliações de segurança abrangentes, garantindo que atendam a altos padrões de segurança. A OpenAI também colaborou com parceiros iniciais para explorar aplicações no mundo real, fornecendo esses modelos para capacitar desenvolvedores, empresas e governos a executar e personalizar IA em sua própria infraestrutura.
Os modelos gpt-oss foram treinados usando técnicas avançadas de pré-treinamento e pós-treinamento, com foco em raciocínio, eficiência e usabilidade em vários ambientes de implantação. Cada modelo é um Transformer que aproveita a mistura de especialistas para otimizar o desempenho. Os modelos suportam três níveis de raciocínio — baixo, médio e alto — permitindo que os desenvolvedores ajustem o desempenho com base em suas necessidades.
Os pesos de ambos os modelos estão disponíveis para download gratuito no Hugging Face e vêm nativamente quantizados em MXFP4. Isso permite um uso eficiente da memória, tornando os modelos flexíveis e fáceis de executar localmente ou através de provedores de terceiros. A OpenAI está comprometida em promover um ecossistema saudável de modelos abertos, incentivando desenvolvedores e pesquisadores a experimentar e inovar com essas ferramentas poderosas.
Destaques de gpt-oss
Modelos de peso aberto
Licença Apache 2.0
Fortes capacidades de raciocínio
Suporte ao uso de ferramentas
Personalizável
Implantação eficiente
Suporta inferência local
Arquitetura de mistura de especialistas
Primeiros passos com gpt-oss
Acessar modelo: Visite o site da OpenAI para acessar gpt-oss.
Autenticar: Configure uma conta se necessário para acesso ao modelo.
Configurar ambiente: Prepare seu ambiente de desenvolvimento para integração.
Integrar via API: Use a API fornecida para integrar gpt-oss em sua aplicação.
Otimizar: Ajuste os parâmetros do modelo para desempenho com base em seu caso de uso específico.
Casos de uso de gpt-oss
- IA em dispositivo
- Inferência local
- Iteração rápida
- Integração de ferramentas
- Soluções de IA personalizadas






