Outros Provedores
ElevenLabs, Mistral, Deepgram, Google Cloud e endpoints personalizados
Além de OpenAI e Groq, o motor Your API Key (Sua Chave de API) suporta ElevenLabs, Mistral, Deepgram, Google Cloud Speech-to-Text e qualquer endpoint compatível com a API da OpenAI que seja seu.
Todos são configurados no mesmo lugar: Settings → Transcription (Configurações → Transcrição) → motor Your API Key → escolha o provedor na linha Provider (Provedor) → cole a chave → Test Connection (Testar Conexão). O resumo do próprio app vale para todos: a chave é criptografada e guardada localmente, as chamadas vão direto do Speakly para o provedor (e não pelos servidores do Speakly), o provedor cobra pelo uso e é preciso conexão com a internet.
ElevenLabs
- Crie uma chave em elevenlabs.io/app/developers/api-keys
- Cole em ElevenLabs API Key — começa com
sk_ - Clique em Test Connection e aguarde "API key is valid"
Não há seletor de modelo: o cartão do provedor traz o rótulo Scribe v1 e o painel informa "Model: Scribe v1 - ElevenLabs' speech-to-text model with support for 99 languages, speaker diarization, and audio event detection." A ElevenLabs também é o único provedor que dá à Transcrição ao Vivo um stream de verdade em tempo real; todos os outros motores usam o caminho em blocos.
Mistral (Voxtral)
- Crie uma chave em console.mistral.ai/api-keys
- Cole em Mistral API Key
- Clique em Test Connection
- Escolha um modelo em Model — a lista é buscada na sua conta Mistral quando a chave é válida; o padrão é
voxtral-mini-latest
Deepgram
- Crie uma chave em console.deepgram.com/settings/api-keys
- Cole em Deepgram API Key
- Clique em Test Connection
- Escolha um modelo em Model — também buscado na sua conta; o padrão guardado é
nova-2
O painel observa: "Free tier includes $200 credit."
Google Cloud Speech-to-Text
- Abra console.cloud.google.com/apis/credentials
- Ative a Speech-to-Text API nesse projeto
- Crie uma API key em Credentials — começa com
AIza - Cole em Google Cloud API Key e clique em Test Connection
- Escolha um modelo em Speech-to-Text Model
O Google é o único provedor cuja lista de modelos é curada dentro do Speakly: Default (Recommended) (selecionado no início), Latest Short, Latest Long, Command & Search, Phone Call, Video. Os dois modelos Latest vêm com o aviso do app "limited language support (mainly EN, ES, FR, DE, IT, JA, KO, ZH)", então mantenha Default a não ser que você precise de um modelo específico.
Endpoint personalizado compatível com OpenAI
O provedor Custom aponta o Speakly para qualquer serviço que implemente a API de transcrição da OpenAI — o painel dá os exemplos: "Connect to any service that implements the OpenAI Whisper API format, such as LocalAI, vLLM, or your own hosted endpoint."
- Selecione Custom na linha Provider
- Base URL: a raiz da API, por exemplo
https://api.example.com/v1 - API Key: o token que o seu endpoint espera
- Model Name: o id do modelo a pedir —
whisper-1por padrão, "e.g., whisper-1, whisper-large-v3" - Clique em Test Connection; "Configuration valid" significa que os três campos foram salvos
- Clear (Limpar) apaga base URL, chave e nome do modelo