Saltar para o conteúdo principal

Como o ClawAI funciona

Desde a criação de uma conta até a leitura de uma resposta, e tudo o que há entre esses dois pontos: como um modelo é escolhido, o que ele recebe para trabalhar, e como seu uso é contabilizado.

Última revisão 2026-07-25

Tudo isso em oito etapas

Cada uma delas tem sua própria seção logo abaixo.

  1. Crie uma conta. um endereço de e-mail e uma senha. O plano gratuito começa imediatamente, sem necessidade de cartão.

  2. Escolha um plano. gratuito para começar; planos pagos a partir de $5 por mês aumentam sua cota e desbloqueiam os modelos maiores e os modos multimodelo.

  3. Comece uma conversa. digite uma mensagem, anexe arquivos opcionalmente, e escolha um modelo ou deixe no modo Automático.

  4. O ClawAI escolhe o modelo. a mensagem é classificada e roteada para um modelo que lida bem com esse tipo de trabalho.

  5. O contexto é montado. memórias relevantes, pacotes de contexto anexados e as partes importantes dos seus arquivos são adicionadas ao prompt.

  6. A resposta é transmitida. o texto chega conforme é gerado, com tempos em tempo real e, quando o modelo o expõe, seu raciocínio.

  7. Você vê o que aconteceu. qual modelo respondeu, por que foi escolhido, quanto custou, e exatamente qual contexto recebeu.

  8. O uso é contabilizado. o custo é medido em relação à sua cota em tokens normalizados por custo e exibido na sua página de uso.

Criando uma conta e escolhendo um plano

Cadastro

Um endereço de e-mail e uma senha são tudo o que você precisa. Não há conta de provedor para criar, chave de API para colar, nem nada para instalar — o ClawAI cuida do relacionamento com os provedores por você.

Os planos

Sete níveis, do gratuito ao Unlimited por $200 por mês. Todo plano pago acessa todos os modelos; o que muda é quanto você pode usar e quais modos multimodelo são desbloqueados.

  • Free — $0. Uma pequena cota diária, modelos de nível básico, e uma execução de teste de Comparação, Juiz e Pesquisa.
  • Starter $5, Plus $10, Pro $20 por mês. Cotas crescentes, com modelos premium e cotas maiores de Comparação e Juiz conforme você sobe de nível.
  • Team $50, Scale $100 por mês. Comparação, Juiz, Crítico e Pesquisa ilimitados, além de muito mais conexões de espaço de trabalho.
  • Unlimited $200 por mês. Conversas e mensagens ilimitadas, com um limite de uso justo em modelos premium sobre o qual você é avisado antes de atingi-lo.

Pague anualmente e você paga por dez meses em vez de doze. Você pode trocar de plano ou cancelar a qualquer momento — um upgrade se aplica imediatamente, um downgrade no início do seu próximo período de faturamento.

Os modelos que você pode acessar

Uma assinatura, todas as famílias abaixo. Você pode alternar entre elas dentro de uma única conversa.

Anthropic Claude
Raciocínio cuidadoso, documentos longos, e a revisão de código mais confiável do catálogo.
Claude Opus 5 · Claude Sonnet 5 · Claude Fable 5
OpenAI GPT
Ampla capacidade geral, com forte uso de ferramentas e saída estruturada.
GPT-5 · GPT-5 mini
Google Gemini
Janelas de contexto enormes, respostas rápidas, e entrada nativa de imagem, áudio e vídeo.
Gemini 3 Pro · Gemini 3 Flash
Moonshot Kimi
Análise de contexto longo e trabalho agêntico a baixo custo.
Kimi K2
Zhipu GLM
Raciocínio bilíngue forte, com um modo de pensamento explícito.
GLM-5.1
Alibaba Qwen
Excelente geração de código em uma ampla variedade de tamanhos de modelo.
Qwen3
DeepSeek
Matemática, algoritmos e derivações passo a passo.
DeepSeek V3.2
xAI Grok
Respostas conversacionais rápidas, com conhecimento de eventos recentes.
Grok 4
Amazon Bedrock
Modelos hospedados na AWS para equipes que já padronizaram a Amazon.
Nova Pro · Bedrock-hosted Claude

Quais modelos um plano pode acessar depende do nível: modelos básicos no Free, tudo, incluindo os maiores modelos de fronteira, a partir do Pro. Novos modelos são adicionados conforme os provedores os lançam.

Como o ClawAI decide qual modelo responde

No modo Automático, cada mensagem é classificada antes de ser enviada. Estas são as categorias que mais mudam o resultado:

Código
escrever, revisar, refatorar ou depurar código vai para os modelos com o histórico mais forte em programação.
Raciocínio complexo
problemas com várias etapas, provas, decisões de arquitetura, e qualquer coisa em que errar sai caro.
Escrita
redigir, editar e reescrever, onde o tom e a legibilidade importam mais do que a profundidade bruta de raciocínio.
Dados e documentos
entradas longas, planilhas e relatórios, roteados para os modelos com as maiores janelas de contexto.
Imagens
pedidos para gerar ou interpretar uma imagem vão para um modelo que realmente sabe lidar com pixels.
Perguntas do dia a dia
perguntas factuais curtas e edições rápidas vão para um modelo rápido e barato — a maioria das mensagens cai aqui.

Você sempre pode substituir a escolha

Escolha um modelo no seletor e ele será usado para aquela conversa até você mudar. Você também pode inclinar o modo Automático para velocidade, profundidade de raciocínio ou custo, o que mantém a classificação por mensagem, mas muda o que ela otimiza. Seja qual for a sua escolha, a resposta informa qual modelo a produziu.

Usando mais de um modelo ao mesmo tempo

Para trabalhos em que uma única resposta não basta, os planos pagos desbloqueiam modos que colocam vários modelos no mesmo prompt.

Comparação
um prompt para até cinco modelos, respostas lado a lado, com latência e contagem de tokens de cada um.
Consenso
vários modelos respondem e o ClawAI sintetiza uma única resposta a partir do que eles têm em comum, sinalizando onde divergem.
Escalonamento
comece com algo barato e rápido, e suba automaticamente para um modelo mais forte apenas quando a resposta não for boa o suficiente.
Best-of-N
gere várias respostas candidatas e mantenha a que obtiver a maior pontuação.
Juiz e Crítico
um modelo independente pontua a resposta em relação a critérios explícitos, e uma passagem do Crítico descreve por escrito o que está fraco e por quê.

O Free dá a você uma execução de teste de Comparação, Juiz e Pesquisa. Os planos pagos têm cotas mensais que aumentam com o nível, e Team e acima não têm limite. Reparo, Verificação, Pacotes de funções e Pipelines completam o conjunto nos planos mais altos.

O que o modelo recebe além da sua mensagem

Três camadas de contexto duradouro podem ser montadas em um prompt, todas sob seu controle.

Memória
fatos, preferências e instruções que valem a pena carregar entre conversas. Os candidatos vão para uma fila de aprovação em vez de serem salvos silenciosamente.
Pacotes de contexto
coleções nomeadas de texto, arquivos, links e referências de memória reutilizáveis que você anexa a uma conversa quando são relevantes.
Arquivos
os documentos enviados são fragmentados e indexados, para que apenas os trechos relevantes à sua pergunta sejam trazidos.

Memória e contexto são opções por conversa. Quando ativadas, a resposta traz um recibo listando exatamente quais memórias, itens de pacote e trechos de arquivo foram usados, e quanto do orçamento de tokens cada um consumiu.

O que toda resposta informa

Um roteamento que você não pode inspecionar é apenas uma caixa-preta com um marketing melhor. Toda resposta carrega o seu próprio registro.

O modelo
o provedor e a versão exata do modelo que produziu a resposta, incluindo quando um fallback assumiu no lugar da primeira escolha.
Por que esse modelo
a classificação, a pontuação de confiança e os motivos por trás da decisão de roteamento.
Quanto custou
tokens de entrada e saída, latência, e a cota consumida em termos normalizados por custo.
O que ele viu
as memórias, itens de pacote de contexto e trechos de arquivo montados no prompt, na ordem em que apareceram.
Onde você está
sua página de uso reúne tudo isso em saldos diários e mensais, detalhados por modelo.

Tudo isso fica visível no momento em que você lê a resposta, não em um relatório que você precisa solicitar.

Como o uso é contabilizado

Um único número cobre todos os modelos, e ele permanece justo entre modelos cujos preços diferem em mais de uma ordem de grandeza.

Tokens normalizados por custo

Um token de um modelo de fronteira caro consome mais da sua cota do que um token de um modelo barato e rápido, na proporção do que ele realmente custa. Assim, um único número de cota funciona qualquer que seja o modelo usado, e você nunca é penalizado por escolher a ferramenta certa para a tarefa.

Modelos leves
modelos rápidos e baratos consomem devagar. Um dia de perguntas curtas quase não move o número.
Modelos intermediários
os modelos de uso geral ficam no meio. É aqui que a maior parte do trabalho contínuo se concentra.
Modelos de fronteira
os maiores modelos de raciocínio consomem mais rápido. Vale a pena para problemas difíceis, um desperdício para conversa fiada — que é exatamente para isso que serve o roteamento Automático.

As janelas

Diária
reinicia a cada 24 horas, então um dia pesado nunca compromete o restante do mês.
Semanal
suaviza picos de uso nos níveis mais altos, onde um limite diário sozinho seria muito rígido.
Mensal
o número principal do seu plano, reiniciando junto com o seu período de faturamento.

Você pode ver o saldo nas três janelas a qualquer momento. Quando você atinge uma delas, o ClawAI informa qual limite foi, quanto resta nas outras e quando ele reinicia.

No plano Unlimited, conversas e mensagens realmente não têm limite. Os modelos de fronteira premium têm um limite de uso justo, para que uma única conta não acumule custos ilimitados de provedor — você é avisado claramente ao se aproximar dele, nunca interrompido sem aviso.

Para empresas

Se a sua empresa não pode enviar dados a um provedor de modelos terceirizado, o ClawAI pode ser implantado dentro da sua própria rede, executando modelos de peso aberto no seu próprio hardware. Nada sai da sua infraestrutura. O dimensionamento é feito por projeto, não vendido como um plano.

Comece no plano gratuito

Um minuto para se cadastrar, sem necessidade de cartão. Faça algumas perguntas, execute uma Comparação, e veja se o roteamento se justifica.