Provedores de LLM
Configure provedores de IA para pós-processamento
O pós-processamento roda a sua regra de Custom Prompts correspondente sobre o texto transcrito, usando um LLM. Ele é configurado em Settings → Post-Processing (Configurações → Pós-Processamento).
Dois modos
- Ollama (Local) — com o selo 100% Offline: "Private local LLM processing on your device".
- Your API Key — com o selo BYOK: você fornece uma chave de um dos provedores de nuvem abaixo.
Provedores BYOK
Escolha um em Provider:
- Groq — Ultra-fast inference
- OpenAI — GPT models
- Anthropic — Claude models
- Google Gemini — Fast & cheap
- Mistral — European, GDPR
- OpenRouter — 100+ models
- Cerebras — Ultra-fast
As listas de modelos são buscadas, nunca fixas no código
O Speakly não traz nenhuma lista de nomes de modelos. Cole uma chave válida e ele pergunta ao provedor quais modelos a sua conta pode usar, preenchendo a lista com essa resposta. Se um modelo que você tinha salvo desaparecer do provedor, o Speakly troca por um que ainda existe em vez de falhar com um 404.
Enquanto não houver uma chave válida, o campo mostra uma mensagem em vez da lista:
Add a valid API key to load available models.— ainda sem chaveLoading models…— a busca está em andamentoNo models found — check that your API key is valid.— o provedor rejeitou a chave
Padrões em uma instalação nova
- Ollama Endpoint:
http://127.0.0.1:11434 - Model Name (Ollama):
llama3 - Modelo da OpenAI:
gpt-5.6-luna - Modelo do Groq:
openai/gpt-oss-120b
Anthropic, Google Gemini, Mistral, OpenRouter e Cerebras não têm padrão embutido — o modelo é escolhido a partir da lista buscada, depois que a sua chave estiver configurada.
Usando o Ollama
- Instale o Ollama em ollama.com.
- Rode
ollama servee depoisollama pull llama3. - Em Settings → Post-Processing, escolha Ollama (Local).
- Deixe Ollama Endpoint em
http://127.0.0.1:11434e informe em Model Name o modelo que você baixou. - Clique em Test Connection. O resultado é Connected ou Connection failed.