> ## Documentation Index
> Fetch the complete documentation index at: https://veniceai-mintlify-f533effe.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Modelos de fala para texto

> Modelos de fala para texto da Venice para transcrever áudio com suporte multilíngue, timestamps e endpoint /audio/transcriptions compatível com OpenAI.

<div id="model-search-placeholder" data-filter="asr">
  Use o valor `id` como o parâmetro `model` nas requisições à API. 5 modelos disponíveis atualmente.

  | Modelo                | ID                            | Por segundo de áudio | Privacidade |
  | --------------------- | ----------------------------- | -------------------- | ----------- |
  | ElevenLabs Scribe V2  | `elevenlabs/scribe-v2`        | \$0.0002             | Anonimizado |
  | Parakeet ASR          | `nvidia/parakeet-tdt-0.6b-v3` | \$0.0001             | Privado     |
  | Whisper Large V3      | `openai/whisper-large-v3`     | \$0.0001             | Privado     |
  | Wizper (Whisper v3)   | `fal-ai/wizper`               | \$0.0001             | Privado     |
  | xAI Speech to Text v1 | `stt-xai-v1`                  | \$0.0000             | Anonimizado |
</div>

***

## Uso

Modelos de fala para texto transcrevem áudio falado em texto escrito. Eles são acessados pela [API de transcrições de áudio](/api-reference/endpoint/audio/transcriptions).

### Formatos de áudio suportados

`mp3`, `mp4`, `mpeg`, `mpga`, `m4a`, `wav`, `webm`, `flac`, `ogg`

### Formatos de resposta

| Formato        | Descrição                                                  |
| -------------- | ---------------------------------------------------------- |
| `json`         | Padrão. Retorna `{ "text": "..." }`.                       |
| `text`         | Texto transcrito puro.                                     |
| `srt`          | Formato de legenda SubRip com timestamps.                  |
| `vtt`          | Formato de legenda WebVTT com timestamps.                  |
| `verbose_json` | Resposta completa com timestamps por segmento e metadados. |

<Note>
  A cobrança é por segundo de áudio de entrada. Veja a [API de transcrições de áudio](/api-reference/endpoint/audio/transcriptions) para exemplos de requisição e detalhes dos parâmetros.
</Note>
