Voltar para a documentaçãoConceitos principais

Modelos

Escolher o motor de raciocínio de uma execução: o seletor de modelo por thread, os limites do plano e o roteamento de provedores.

Última atualização em 17 de setembro de 2026 · 4 min read

Um modelo é o motor de raciocínio por trás de uma execução. O Okou cuida das ferramentas, do contexto e do procedimento; o modelo faz o pensamento. Qual deles está em jogo afeta qualidade, velocidade e quantos créditos uma execução consome.

O modelo mora na thread de chat

O seletor de modelo fica ao lado do campo de chat e controla o modelo daquele chat. A escolha é salva na thread, não no agente e não no workflow.

  • Um chat novo começa pelo seu padrão de membro e recorre ao padrão do espaço de trabalho quando você não definiu um.
  • Trocar o modelo no meio do chat vale para a próxima execução da thread; uma execução já em andamento termina com o modelo com que começou.
  • Um chat de automation fixa seu modelo quando é criado, e os disparos seguintes reutilizam esse modelo.
  • No Slack, o comando /okou model vincula o modelo para a próxima thread que você abrir — veja Slack.

Agentes e workflows não têm, de propósito, configuração de modelo própria. A thread é o único lugar para olhar.

O que está disponível

O catálogo completo, com o que cada modelo faz bem e quanto custa em relação aos outros, está na página Models. Ele abrange modelos de raciocínio de fronteira, modelos mais baratos para alto volume e modelos dedicados de imagem e vídeo, e muda conforme novos modelos são lançados.

Duas regras de plano:

  • Free inclui três modelos. Eles bastam para criar um agente, conectar ferramentas e rodar trabalho de verdade.
  • Pro, Team e Enterprise abrem a lista completa.

Os administradores escolhem em Settings → Models quais desses modelos os membros podem de fato selecionar e qual é o padrão do espaço de trabalho.

Onde a inferência roda

Um modelo pode ser roteado de mais de um jeito, e a rota é definida pela política do espaço de trabalho, não pelo seletor:

  • Built-in — o Okou roda o modelo e isso é cobrado nos créditos do espaço de trabalho. Nada para conectar.
  • Sua própria assinatura — cada membro conecta a própria conta Claude ou Codex e as execuções dele passam por ali.
  • Uma chave de provedor compartilhada ou um gateway — um administrador fornece a credencial uma vez para o espaço de trabalho.

Trazer seu próprio provedor é um recurso de plano pago. Seja qual for a rota do modelo, chamadas de ferramentas, geração e armazenamento continuam sendo cobrados em créditos do Okou.

O seletor escolhe um modelo. Ele não substitui a rota que a política atribuiu a esse modelo.

Como escolher

  • Case o modelo com a tarefa, não com a tabela de preços. Um modelo barato numa execução agêntica longa pode custar mais que um caro, porque precisa de mais passos para chegar lá.
  • Use um modelo barato para volume. Triagem, classificação e pré-filtragem em massa raramente precisam de um modelo de fronteira.
  • Use um modelo de fronteira para julgamento. Trabalho de horizonte longo, código e tudo em que uma resposta errada sai cara.
  • Defina um padrão de membro para o modelo com que você quer que a maioria dos chats comece, em vez de mexer no seletor toda vez.

Solução de problemas

O que você vêO que fazer
Selected model is not availableO modelo da thread não é utilizável sob a política atual do espaço de trabalho ou a conexão de provedor. Escolha outro modelo no campo de chat, ou reconecte o provedor em Settings → Models.
Um modelo que você esperava está faltandoAdministradores controlam a disponibilidade por espaço de trabalho. No Free, só aparecem os três modelos incluídos.
Créditos caindo mais rápido que o esperadoVeja em qual modelo a thread está. As taxas diferem bastante entre os níveis.

O que vem a seguir

  • Veja Credits & billing para como a escolha do modelo aparece na conta.
  • Veja Chat para a thread à qual o modelo está preso.