Um modelo é o motor de raciocínio por trás de uma execução. O Okou cuida das ferramentas, do contexto e do procedimento; o modelo faz o pensamento. Qual deles está em jogo afeta qualidade, velocidade e quantos créditos uma execução consome.
O modelo mora na thread de chat
O seletor de modelo fica ao lado do campo de chat e controla o modelo daquele chat. A escolha é salva na thread, não no agente e não no workflow.
- Um chat novo começa pelo seu padrão de membro e recorre ao padrão do espaço de trabalho quando você não definiu um.
- Trocar o modelo no meio do chat vale para a próxima execução da thread; uma execução já em andamento termina com o modelo com que começou.
- Um chat de automation fixa seu modelo quando é criado, e os disparos seguintes reutilizam esse modelo.
- No Slack, o comando /okou model vincula o modelo para a próxima thread que você abrir — veja Slack.
Agentes e workflows não têm, de propósito, configuração de modelo própria. A thread é o único lugar para olhar.
O que está disponível
O catálogo completo, com o que cada modelo faz bem e quanto custa em relação aos outros, está na página Models. Ele abrange modelos de raciocínio de fronteira, modelos mais baratos para alto volume e modelos dedicados de imagem e vídeo, e muda conforme novos modelos são lançados.
Duas regras de plano:
- Free inclui três modelos. Eles bastam para criar um agente, conectar ferramentas e rodar trabalho de verdade.
- Pro, Team e Enterprise abrem a lista completa.
Os administradores escolhem em Settings → Models quais desses modelos os membros podem de fato selecionar e qual é o padrão do espaço de trabalho.
Onde a inferência roda
Um modelo pode ser roteado de mais de um jeito, e a rota é definida pela política do espaço de trabalho, não pelo seletor:
- Built-in — o Okou roda o modelo e isso é cobrado nos créditos do espaço de trabalho. Nada para conectar.
- Sua própria assinatura — cada membro conecta a própria conta Claude ou Codex e as execuções dele passam por ali.
- Uma chave de provedor compartilhada ou um gateway — um administrador fornece a credencial uma vez para o espaço de trabalho.
Trazer seu próprio provedor é um recurso de plano pago. Seja qual for a rota do modelo, chamadas de ferramentas, geração e armazenamento continuam sendo cobrados em créditos do Okou.
O seletor escolhe um modelo. Ele não substitui a rota que a política atribuiu a esse modelo.
Como escolher
- Case o modelo com a tarefa, não com a tabela de preços. Um modelo barato numa execução agêntica longa pode custar mais que um caro, porque precisa de mais passos para chegar lá.
- Use um modelo barato para volume. Triagem, classificação e pré-filtragem em massa raramente precisam de um modelo de fronteira.
- Use um modelo de fronteira para julgamento. Trabalho de horizonte longo, código e tudo em que uma resposta errada sai cara.
- Defina um padrão de membro para o modelo com que você quer que a maioria dos chats comece, em vez de mexer no seletor toda vez.
Solução de problemas
| O que você vê | O que fazer |
|---|---|
| Selected model is not available | O modelo da thread não é utilizável sob a política atual do espaço de trabalho ou a conexão de provedor. Escolha outro modelo no campo de chat, ou reconecte o provedor em Settings → Models. |
| Um modelo que você esperava está faltando | Administradores controlam a disponibilidade por espaço de trabalho. No Free, só aparecem os três modelos incluídos. |
| Créditos caindo mais rápido que o esperado | Veja em qual modelo a thread está. As taxas diferem bastante entre os níveis. |
O que vem a seguir
- Veja Credits & billing para como a escolha do modelo aparece na conta.
- Veja Chat para a thread à qual o modelo está preso.

