Pular para o conteúdo

Gemma 4 31B

Modelo multimodal da família Gemma (Google), de 31B parâmetros — além de chat, entende imagens (visão). Use para descrever fotos, ler texto em imagens, analisar gráficos e diagramas, ou raciocinar sobre conteúdo visual.

idgemma-4-31b
TipoChat / texto + visão
Disponível emStarter, Standard, Pro
  • Perguntas sobre uma imagem (o que há na foto, leitura de texto/recibos, gráficos)
  • Chat de uso geral com qualidade acima do gemma-4-12b
  • Fluxos que misturam texto e imagem na mesma conversa

A imagem entra no content como image_url (URL pública ou data URL base64) — igual ao padrão OpenAI Vision.

resp = client.chat.completions.create(
model="gemma-4-31b",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "O que há nesta imagem?"},
{"type": "image_url", "image_url": {"url": "https://exemplo.com/foto.jpg"}},
],
}],
)
print(resp.choices[0].message.content)