Pular para o conteúdo

Whisper large-v3

Modelo de transcrição (speech-to-text) da OpenAI, large-v3 — multilíngue e robusto a ruído. Converte áudio em texto pelo endpoint /v1/audio/transcriptions.

idwhisper-large-v3
TipoTranscrição (fala → texto)
Formatoswav, mp3, m4a, ogg, webm, flac (até 25MB)
Disponível emStarter, Standard, Pro
with open("audio.mp3", "rb") as f:
resp = client.audio.transcriptions.create(
model="whisper-large-v3", file=f, language="pt",
)
print(resp.text)

Detalhes do endpoint em Áudio (voz).