GPT-OSS 120B
Modelo aberto da OpenAI com 120B de parâmetros em arquitetura mixture-of-experts (apenas ~5B ativos por token), servido com quantização MXFP4 nativa. Raciocínio forte e janela de 128K tokens — o maior contexto do catálogo de texto da Norlen.
id | gpt-oss-120b |
| Tipo | Chat / texto |
| Contexto | 128K tokens |
| Disponível em | Starter, Standard, Pro |
Quando usar
Seção intitulada “Quando usar”- Tarefas que exigem raciocínio passo a passo e mais profundidade
- Documentos e conversas longas (até 128K de contexto)
- Assistentes de propósito geral com qualidade de ponta
Para respostas curtas e rápidas, prefira Gemma 4 12B. Para código, Qwen3 Coder.
Exemplo
Seção intitulada “Exemplo”resp = client.chat.completions.create( model="gpt-oss-120b", messages=[{"role": "user", "content": "Explique passo a passo por que o céu é azul."}],)print(resp.choices[0].message.content)curl https://api.norlen.io/v1/chat/completions \ -H "Authorization: Bearer $NORLEN_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"gpt-oss-120b","messages":[{"role":"user","content":"Por que o céu é azul?"}]}'Parâmetros completos em Chat completions.