Whisper large-v3
Modelo de transcrição (speech-to-text) da OpenAI, large-v3 — multilíngue e robusto a ruído. Converte áudio em texto pelo endpoint /v1/audio/transcriptions.
id | whisper-large-v3 |
| Tipo | Transcrição (fala → texto) |
| Formatos | wav, mp3, m4a, ogg, webm, flac (até 25MB) |
| Disponível em | Starter, Standard, Pro |
Exemplo
Seção intitulada “Exemplo”with open("audio.mp3", "rb") as f: resp = client.audio.transcriptions.create( model="whisper-large-v3", file=f, language="pt", )print(resp.text)curl https://api.norlen.io/v1/audio/transcriptions \ -H "Authorization: Bearer $NORLEN_API_KEY" \ -F file="@audio.mp3" -F model="whisper-large-v3" -F language="pt"Detalhes do endpoint em Áudio (voz).