Pular para o conteúdo

Áudio (voz)

Dois endpoints de voz, compatíveis com o padrão OpenAI Audio:

  • Transcrição (STT)POST /v1/audio/transcriptions (modelo whisper-large-v3)
  • Síntese de voz (TTS)POST /v1/audio/speech (modelo qwen3-tts)
https://api.norlen.io/v1/audio/transcriptions
https://api.norlen.io/v1/audio/speech
Authorization: Bearer SUA_API_KEY

Envie um arquivo de áudio (wav, mp3, m4a, ogg, webm, flac — até 25MB) e receba o texto. multipart/form-data.

CampoTipoObrigatórioDescrição
filearquivosimO áudio a transcrever
modelstringsimwhisper-large-v3
languagestringnãoCódigo ISO (ex.: pt, en) — acelera e melhora a precisão
Terminal window
curl https://api.norlen.io/v1/audio/transcriptions \
-H "Authorization: Bearer $NORLEN_API_KEY" \
-F file="@audio.mp3" \
-F model="whisper-large-v3" \
-F language="pt"
{ "text": "O texto transcrito do áudio." }

Converte texto em áudio (wav). application/json.

CampoTipoObrigatórioDescrição
modelstringsimqwen3-tts
inputstringsimO texto a falar (até 2000 caracteres)
voicestringnãoUma das vozes abaixo (padrão ryan)

Vozes: ryan, aiden, eric, dylan, uncle_fu (masculinas) · serena, vivian, sohee, ono_anna (femininas). Suporta português e mais 9 idiomas; a voz se adapta ao idioma do texto.

Terminal window
curl https://api.norlen.io/v1/audio/speech \
-H "Authorization: Bearer $NORLEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-tts",
"input": "Olá! Esta é a voz da Norlen.",
"voice": "ryan"
}' \
--output fala.wav

Os bytes do áudio (audio/wav) — salve em arquivo ou toque diretamente.