Como o ClawAI funciona
Desde a criação de uma conta até a leitura de uma resposta, e tudo o que há entre esses dois pontos: como um modelo é escolhido, o que ele recebe para trabalhar, e como seu uso é contabilizado.
Última revisão 2026-07-25
Tudo isso em oito etapas
Cada uma delas tem sua própria seção logo abaixo.
Crie uma conta. um endereço de e-mail e uma senha. O plano gratuito começa imediatamente, sem necessidade de cartão.
Escolha um plano. gratuito para começar; planos pagos a partir de $5 por mês aumentam sua cota e desbloqueiam os modelos maiores e os modos multimodelo.
Comece uma conversa. digite uma mensagem, anexe arquivos opcionalmente, e escolha um modelo ou deixe no modo Automático.
O ClawAI escolhe o modelo. a mensagem é classificada e roteada para um modelo que lida bem com esse tipo de trabalho.
O contexto é montado. memórias relevantes, pacotes de contexto anexados e as partes importantes dos seus arquivos são adicionadas ao prompt.
A resposta é transmitida. o texto chega conforme é gerado, com tempos em tempo real e, quando o modelo o expõe, seu raciocínio.
Você vê o que aconteceu. qual modelo respondeu, por que foi escolhido, quanto custou, e exatamente qual contexto recebeu.
O uso é contabilizado. o custo é medido em relação à sua cota em tokens normalizados por custo e exibido na sua página de uso.
Criando uma conta e escolhendo um plano
Cadastro
Um endereço de e-mail e uma senha são tudo o que você precisa. Não há conta de provedor para criar, chave de API para colar, nem nada para instalar — o ClawAI cuida do relacionamento com os provedores por você.
Os planos
Sete níveis, do gratuito ao Unlimited por $200 por mês. Todo plano pago acessa todos os modelos; o que muda é quanto você pode usar e quais modos multimodelo são desbloqueados.
- Free — $0. Uma pequena cota diária, modelos de nível básico, e uma execução de teste de Comparação, Juiz e Pesquisa.
- Starter $5, Plus $10, Pro $20 por mês. Cotas crescentes, com modelos premium e cotas maiores de Comparação e Juiz conforme você sobe de nível.
- Team $50, Scale $100 por mês. Comparação, Juiz, Crítico e Pesquisa ilimitados, além de muito mais conexões de espaço de trabalho.
- Unlimited $200 por mês. Conversas e mensagens ilimitadas, com um limite de uso justo em modelos premium sobre o qual você é avisado antes de atingi-lo.
Pague anualmente e você paga por dez meses em vez de doze. Você pode trocar de plano ou cancelar a qualquer momento — um upgrade se aplica imediatamente, um downgrade no início do seu próximo período de faturamento.
Os modelos que você pode acessar
Uma assinatura, todas as famílias abaixo. Você pode alternar entre elas dentro de uma única conversa.
- Anthropic Claude
- Raciocínio cuidadoso, documentos longos, e a revisão de código mais confiável do catálogo.
- Claude Opus 5 · Claude Sonnet 5 · Claude Fable 5
- OpenAI GPT
- Ampla capacidade geral, com forte uso de ferramentas e saída estruturada.
- GPT-5 · GPT-5 mini
- Google Gemini
- Janelas de contexto enormes, respostas rápidas, e entrada nativa de imagem, áudio e vídeo.
- Gemini 3 Pro · Gemini 3 Flash
- Moonshot Kimi
- Análise de contexto longo e trabalho agêntico a baixo custo.
- Kimi K2
- Zhipu GLM
- Raciocínio bilíngue forte, com um modo de pensamento explícito.
- GLM-5.1
- Alibaba Qwen
- Excelente geração de código em uma ampla variedade de tamanhos de modelo.
- Qwen3
- DeepSeek
- Matemática, algoritmos e derivações passo a passo.
- DeepSeek V3.2
- xAI Grok
- Respostas conversacionais rápidas, com conhecimento de eventos recentes.
- Grok 4
- Amazon Bedrock
- Modelos hospedados na AWS para equipes que já padronizaram a Amazon.
- Nova Pro · Bedrock-hosted Claude
Quais modelos um plano pode acessar depende do nível: modelos básicos no Free, tudo, incluindo os maiores modelos de fronteira, a partir do Pro. Novos modelos são adicionados conforme os provedores os lançam.
Como o ClawAI decide qual modelo responde
No modo Automático, cada mensagem é classificada antes de ser enviada. Estas são as categorias que mais mudam o resultado:
- Código
- escrever, revisar, refatorar ou depurar código vai para os modelos com o histórico mais forte em programação.
- Raciocínio complexo
- problemas com várias etapas, provas, decisões de arquitetura, e qualquer coisa em que errar sai caro.
- Escrita
- redigir, editar e reescrever, onde o tom e a legibilidade importam mais do que a profundidade bruta de raciocínio.
- Dados e documentos
- entradas longas, planilhas e relatórios, roteados para os modelos com as maiores janelas de contexto.
- Imagens
- pedidos para gerar ou interpretar uma imagem vão para um modelo que realmente sabe lidar com pixels.
- Perguntas do dia a dia
- perguntas factuais curtas e edições rápidas vão para um modelo rápido e barato — a maioria das mensagens cai aqui.
Você sempre pode substituir a escolha
Escolha um modelo no seletor e ele será usado para aquela conversa até você mudar. Você também pode inclinar o modo Automático para velocidade, profundidade de raciocínio ou custo, o que mantém a classificação por mensagem, mas muda o que ela otimiza. Seja qual for a sua escolha, a resposta informa qual modelo a produziu.
Usando mais de um modelo ao mesmo tempo
Para trabalhos em que uma única resposta não basta, os planos pagos desbloqueiam modos que colocam vários modelos no mesmo prompt.
- Comparação
- um prompt para até cinco modelos, respostas lado a lado, com latência e contagem de tokens de cada um.
- Consenso
- vários modelos respondem e o ClawAI sintetiza uma única resposta a partir do que eles têm em comum, sinalizando onde divergem.
- Escalonamento
- comece com algo barato e rápido, e suba automaticamente para um modelo mais forte apenas quando a resposta não for boa o suficiente.
- Best-of-N
- gere várias respostas candidatas e mantenha a que obtiver a maior pontuação.
- Juiz e Crítico
- um modelo independente pontua a resposta em relação a critérios explícitos, e uma passagem do Crítico descreve por escrito o que está fraco e por quê.
O Free dá a você uma execução de teste de Comparação, Juiz e Pesquisa. Os planos pagos têm cotas mensais que aumentam com o nível, e Team e acima não têm limite. Reparo, Verificação, Pacotes de funções e Pipelines completam o conjunto nos planos mais altos.
O que o modelo recebe além da sua mensagem
Três camadas de contexto duradouro podem ser montadas em um prompt, todas sob seu controle.
- Memória
- fatos, preferências e instruções que valem a pena carregar entre conversas. Os candidatos vão para uma fila de aprovação em vez de serem salvos silenciosamente.
- Pacotes de contexto
- coleções nomeadas de texto, arquivos, links e referências de memória reutilizáveis que você anexa a uma conversa quando são relevantes.
- Arquivos
- os documentos enviados são fragmentados e indexados, para que apenas os trechos relevantes à sua pergunta sejam trazidos.
Memória e contexto são opções por conversa. Quando ativadas, a resposta traz um recibo listando exatamente quais memórias, itens de pacote e trechos de arquivo foram usados, e quanto do orçamento de tokens cada um consumiu.
O que toda resposta informa
Um roteamento que você não pode inspecionar é apenas uma caixa-preta com um marketing melhor. Toda resposta carrega o seu próprio registro.
- O modelo
- o provedor e a versão exata do modelo que produziu a resposta, incluindo quando um fallback assumiu no lugar da primeira escolha.
- Por que esse modelo
- a classificação, a pontuação de confiança e os motivos por trás da decisão de roteamento.
- Quanto custou
- tokens de entrada e saída, latência, e a cota consumida em termos normalizados por custo.
- O que ele viu
- as memórias, itens de pacote de contexto e trechos de arquivo montados no prompt, na ordem em que apareceram.
- Onde você está
- sua página de uso reúne tudo isso em saldos diários e mensais, detalhados por modelo.
Tudo isso fica visível no momento em que você lê a resposta, não em um relatório que você precisa solicitar.
Como o uso é contabilizado
Um único número cobre todos os modelos, e ele permanece justo entre modelos cujos preços diferem em mais de uma ordem de grandeza.
Tokens normalizados por custo
Um token de um modelo de fronteira caro consome mais da sua cota do que um token de um modelo barato e rápido, na proporção do que ele realmente custa. Assim, um único número de cota funciona qualquer que seja o modelo usado, e você nunca é penalizado por escolher a ferramenta certa para a tarefa.
- Modelos leves
- modelos rápidos e baratos consomem devagar. Um dia de perguntas curtas quase não move o número.
- Modelos intermediários
- os modelos de uso geral ficam no meio. É aqui que a maior parte do trabalho contínuo se concentra.
- Modelos de fronteira
- os maiores modelos de raciocínio consomem mais rápido. Vale a pena para problemas difíceis, um desperdício para conversa fiada — que é exatamente para isso que serve o roteamento Automático.
As janelas
- Diária
- reinicia a cada 24 horas, então um dia pesado nunca compromete o restante do mês.
- Semanal
- suaviza picos de uso nos níveis mais altos, onde um limite diário sozinho seria muito rígido.
- Mensal
- o número principal do seu plano, reiniciando junto com o seu período de faturamento.
Você pode ver o saldo nas três janelas a qualquer momento. Quando você atinge uma delas, o ClawAI informa qual limite foi, quanto resta nas outras e quando ele reinicia.
No plano Unlimited, conversas e mensagens realmente não têm limite. Os modelos de fronteira premium têm um limite de uso justo, para que uma única conta não acumule custos ilimitados de provedor — você é avisado claramente ao se aproximar dele, nunca interrompido sem aviso.
Para empresas
Se a sua empresa não pode enviar dados a um provedor de modelos terceirizado, o ClawAI pode ser implantado dentro da sua própria rede, executando modelos de peso aberto no seu próprio hardware. Nada sai da sua infraestrutura. O dimensionamento é feito por projeto, não vendido como um plano.
Comece no plano gratuito
Um minuto para se cadastrar, sem necessidade de cartão. Faça algumas perguntas, execute uma Comparação, e veja se o roteamento se justifica.