Toda plataforma de IA oferece modelos de capacidade diferente — e, entre o mais barato e o mais forte de cada fabricante, a diferença de preço hoje passa de 50 vezes. Essa escolha, que na aula chamamos de "escolher o cérebro", é a que mais afeta a qualidade percebida do resultado e a que mais afeta a conta no fim do mês. A regra que funciona no escritório é simples de enunciar e difícil de manter: o modelo barato como padrão da casa; o forte como exceção justificada pela tarefa — nunca pela marca, nunca pelo hábito. Este mapa organiza a decisão por tarefa jurídica, não por fabricante, e explica por que o consumo vem menos do modelo que você escolhe e mais do contexto que você entrega.
Estagiário ou sênior: a analogia que resolve 80% dos casos
A comparação que usamos em sala é a de delegar: você entrega um plano a um estagiário ou a um profissional sênior? Os modelos mais simples respondem mais rápido, consomem menos e bastam para tarefas de execução com regra clara. Os mais avançados raciocinam melhor, sustentam instruções longas e produzem melhor em tarefas abertas — e consomem mais.
Ninguém delega a tese do recurso ao estagiário. Ninguém paga hora de sênior para separar os anexos por data. A IA segue a mesma lógica — com uma vantagem: aqui você pode trocar de "profissional" a cada tarefa, sem custo de troca.
Quanto custa cada camada hoje
Os preços abaixo são os das páginas oficiais dos fabricantes para uso via API, por milhão de tokens (um token é pouco menos que uma palavra em português), conferidos em 2 de setembro de 2026. Nos planos de assinatura do chat você não paga por token, mas a hierarquia é a mesma — e o consumo do seu limite segue essa proporção.
Camada | Exemplos (fabricante) | Preço aprox. (entrada / saída, por milhão de tokens) | Para que serve no escritório |
|---|---|---|---|
Leve / rápido | Claude Haiku 4.5 (Anthropic) · Gemini 3.5 Flash-Lite (Google) · GPT-5.6 Luna (OpenAI) | US$ 1 / 5 · US$ 0,30 / 2,50 · US$ 0,20 / 1,20 | Triagem, classificação, extração de dados de documento, resumo de leitura, formatação, primeira passada em volume |
Intermediário | Claude Sonnet 5 · Gemini 3.7 Flash | US$ 2 / 10 · US$ 0,75 / 3,75 (promocional até 31/12/2026) | Rascunho de peça simples, revisão contra checklist, e-mails ao cliente, análise de um contrato padrão |
Forte | Claude Opus 5 · Gemini 3.1 Pro | US$ 5 / 25 · US$ 2 / 12 | Tese, peça que vai protocolada, comparação de versões longas, análise de processo inteiro, estratégia |
Topo | Claude Fable 5.1 | US$ 10 / 50 | Raciocínio longo e tarefas de agente de muitas etapas — a exceção da exceção |
Duas leituras dessa tabela. Primeira: o piso caiu. A OpenAI cortou 80% do preço do GPT-5.6 Luna em julho e o tornou o modelo padrão do plano gratuito em agosto; o Google pratica preço promocional no 3.7 Flash. A capacidade que era "topo de linha" há um ano está descendo para a camada barata. Segunda: a saída custa cerca de cinco vezes a entrada em todas as camadas — um modelo que escreve muito custa mais que um que lê muito. Pedir resposta objetiva não é estilo, é economia.
Os preços mudam com frequência. A régua de custo do escritório — e por que o painel do fornecedor não mostra a conta antes — está em quanto custa IA no escritório: a conta real.
O mapa por tarefa jurídica
O erro comum é escolher o modelo pela importância do caso. O critério certo é a natureza da tarefa:
Roda no barato (padrão da casa):
Ler 200 páginas e devolver a ficha do processo (partes, datas, pedidos, valores)
Classificar e-mails e mensagens que chegaram no dia
Extrair dados de um lote de documentos para uma planilha
Transcrever e resumir uma reunião
Reformatar, traduzir termos, ajustar tom de um texto já escrito
Primeira passada de busca num acervo próprio
Exige o forte (exceção justificada):
A tese — o argumento que sustenta a peça
A peça que vai protocolada, na revisão final contra a jurisprudência que você conferiu
Comparar duas versões de um contrato de 40 páginas e classificar cada mudança por risco
Analisar um processo inteiro procurando contradições e lacunas, não só resumindo
Uma estratégia de caso com várias hipóteses
Depende do que você entrega (a variável escondida):
A mesma pergunta com um contexto de 3 páginas roda bem no barato; com 300 páginas, o forte erra menos porque sustenta a instrução ao longo do documento.
Há uma armadilha na direção contrária: o modelo barato que exige três tentativas custa mais que o forte que acerta de primeira — em dinheiro e no seu tempo. Se você está reescrevendo o prompt pela terceira vez, o problema pode ser o cérebro, não o comando.
Por que o consumo vem do contexto, não do modelo
Um esclarecimento que damos na aula porque gera confusão: o que consome o seu limite não é a skill nem o agente que você instalou — é o contexto: tudo que a IA precisa ler para responder. Um pedido de dez linhas com um anexo de 500 páginas é caro em qualquer modelo. Um pedido de dez linhas sem anexo é barato em qualquer modelo.
Daí três hábitos que valem mais que trocar de fabricante:
Peça o plano antes da execução. Em tarefa longa, mande o modelo listar o que vai fazer e só depois executar. Você corrige a rota antes de gastar — e descobre se ele leu a premissa obrigatória ou pulou.
Perceba o limite da janela antes de perder o trabalho. Todo modelo tem um tamanho máximo de "memória de trabalho" (hoje, 1 milhão de tokens nos modelos atuais da Anthropic, 200 mil no Haiku). Quando a conversa fica longa demais, o modelo começa a esquecer o começo — e o que ele "já leu" pode não estar salvo em lugar nenhum. Salve o que importa em arquivo; abra conversa nova quando o contexto contaminar.
Mande pesquisar em vez de perguntar. Quando o tema exige fonte, o modo de pesquisa (que consulta e cita) vale mais que a resposta de memória — em qualquer camada.
"A IA ficou pior" — ou você mudou de cérebro sem perceber?
Boa parte das reclamações de "piorou" nasce de troca silenciosa de modelo: o aplicativo muda o padrão, o plano gratuito passa a usar outro cérebro, ou você abriu a conversa no modelo leve sem notar. Antes de concluir que o fornecedor degradou o serviço, confira qual modelo está selecionado — e leia a IA ficou pior: o que acontece e o que fazer, que separa o que é bug documentado do que é percepção.
A regra do escritório em uma linha
Defina por escrito, na base de conhecimento da casa: modelo leve como padrão; forte só nas tarefas da lista de exceção; toda peça que vai protocolada passa pelo forte e pela sua revisão. Isso tira a decisão do humor de cada um e faz a conta fechar. Se você ainda compara fabricantes em vez de tarefas, o guia melhor inteligência artificial para profissionais do Direito é o mapa por marca; este aqui é o mapa por trabalho. Os dois se encontram no guia geral de IA no Direito. E se quiser aprender o método completo — skills, agentes e a escolha do cérebro em cada etapa — é o que fazemos na Formação em IA para o mundo jurídico.
Fontes
Anthropic — Models overview (preços e janela de contexto por modelo)
Material do curso Formação em IA para o mundo jurídico — ebook da Imersão de Marketing, módulo 3 (revisão de 28/07/2026) e tutoria de 28/08/2026




