Provedores de LLM

Configure provedores de IA para pós-processamento

O pós-processamento roda a sua regra de Custom Prompts correspondente sobre o texto transcrito, usando um LLM. Ele é configurado em Settings → Post-Processing (Configurações → Pós-Processamento).

Dois modos

  • Ollama (Local) — com o selo 100% Offline: "Private local LLM processing on your device".
  • Your API Key — com o selo BYOK: você fornece uma chave de um dos provedores de nuvem abaixo.

Provedores BYOK

Escolha um em Provider:

  • Groq — Ultra-fast inference
  • OpenAI — GPT models
  • Anthropic — Claude models
  • Google Gemini — Fast & cheap
  • Mistral — European, GDPR
  • OpenRouter — 100+ models
  • Cerebras — Ultra-fast

As listas de modelos são buscadas, nunca fixas no código

O Speakly não traz nenhuma lista de nomes de modelos. Cole uma chave válida e ele pergunta ao provedor quais modelos a sua conta pode usar, preenchendo a lista com essa resposta. Se um modelo que você tinha salvo desaparecer do provedor, o Speakly troca por um que ainda existe em vez de falhar com um 404.

Enquanto não houver uma chave válida, o campo mostra uma mensagem em vez da lista:

  • Add a valid API key to load available models. — ainda sem chave
  • Loading models… — a busca está em andamento
  • No models found — check that your API key is valid. — o provedor rejeitou a chave

Padrões em uma instalação nova

  • Ollama Endpoint: http://127.0.0.1:11434
  • Model Name (Ollama): llama3
  • Modelo da OpenAI: gpt-5.6-luna
  • Modelo do Groq: openai/gpt-oss-120b

Anthropic, Google Gemini, Mistral, OpenRouter e Cerebras não têm padrão embutido — o modelo é escolhido a partir da lista buscada, depois que a sua chave estiver configurada.

Usando o Ollama

  1. Instale o Ollama em ollama.com.
  2. Rode ollama serve e depois ollama pull llama3.
  3. Em Settings → Post-Processing, escolha Ollama (Local).
  4. Deixe Ollama Endpoint em http://127.0.0.1:11434 e informe em Model Name o modelo que você baixou.
  5. Clique em Test Connection. O resultado é Connected ou Connection failed.
Use 127.0.0.1, não localhost
A própria nota de configuração do app diz para usar 127.0.0.1 em vez de localhost para evitar problemas de conexão, e ele reescreve um endpoint salvo com localhost para 127.0.0.1 ao carregar.
Provedores de LLM — Speakly