/

IA na Prática

Qual “cérebro” para qual tarefa: o mapa do que roda no modelo barato e do que exige o forte

Qual “cérebro” para qual tarefa: o mapa do que roda no modelo barato e do que exige o forte

Por Leo Toco

·

·

12

min de leitura

·

Atualizado em

EM RESUMO

Modelos de IA custam de US$ 0,20 a US$ 50 por milhão de tokens. Um mapa por tarefa jurídica: o que roda no barato, o que exige o forte e a regra da casa.

Toda plataforma de IA oferece modelos de capacidade diferente — e, entre o mais barato e o mais forte de cada fabricante, a diferença de preço hoje passa de 50 vezes. Essa escolha, que na aula chamamos de "escolher o cérebro", é a que mais afeta a qualidade percebida do resultado e a que mais afeta a conta no fim do mês. A regra que funciona no escritório é simples de enunciar e difícil de manter: o modelo barato como padrão da casa; o forte como exceção justificada pela tarefa — nunca pela marca, nunca pelo hábito. Este mapa organiza a decisão por tarefa jurídica, não por fabricante, e explica por que o consumo vem menos do modelo que você escolhe e mais do contexto que você entrega.

Estagiário ou sênior: a analogia que resolve 80% dos casos

A comparação que usamos em sala é a de delegar: você entrega um plano a um estagiário ou a um profissional sênior? Os modelos mais simples respondem mais rápido, consomem menos e bastam para tarefas de execução com regra clara. Os mais avançados raciocinam melhor, sustentam instruções longas e produzem melhor em tarefas abertas — e consomem mais.

Ninguém delega a tese do recurso ao estagiário. Ninguém paga hora de sênior para separar os anexos por data. A IA segue a mesma lógica — com uma vantagem: aqui você pode trocar de "profissional" a cada tarefa, sem custo de troca.

Quanto custa cada camada hoje

Os preços abaixo são os das páginas oficiais dos fabricantes para uso via API, por milhão de tokens (um token é pouco menos que uma palavra em português), conferidos em 2 de setembro de 2026. Nos planos de assinatura do chat você não paga por token, mas a hierarquia é a mesma — e o consumo do seu limite segue essa proporção.

Camada

Exemplos (fabricante)

Preço aprox. (entrada / saída, por milhão de tokens)

Para que serve no escritório

Leve / rápido

Claude Haiku 4.5 (Anthropic) · Gemini 3.5 Flash-Lite (Google) · GPT-5.6 Luna (OpenAI)

US$ 1 / 5 · US$ 0,30 / 2,50 · US$ 0,20 / 1,20

Triagem, classificação, extração de dados de documento, resumo de leitura, formatação, primeira passada em volume

Intermediário

Claude Sonnet 5 · Gemini 3.7 Flash

US$ 2 / 10 · US$ 0,75 / 3,75 (promocional até 31/12/2026)

Rascunho de peça simples, revisão contra checklist, e-mails ao cliente, análise de um contrato padrão

Forte

Claude Opus 5 · Gemini 3.1 Pro

US$ 5 / 25 · US$ 2 / 12

Tese, peça que vai protocolada, comparação de versões longas, análise de processo inteiro, estratégia

Topo

Claude Fable 5.1

US$ 10 / 50

Raciocínio longo e tarefas de agente de muitas etapas — a exceção da exceção

Duas leituras dessa tabela. Primeira: o piso caiu. A OpenAI cortou 80% do preço do GPT-5.6 Luna em julho e o tornou o modelo padrão do plano gratuito em agosto; o Google pratica preço promocional no 3.7 Flash. A capacidade que era "topo de linha" há um ano está descendo para a camada barata. Segunda: a saída custa cerca de cinco vezes a entrada em todas as camadas — um modelo que escreve muito custa mais que um que lê muito. Pedir resposta objetiva não é estilo, é economia.

Os preços mudam com frequência. A régua de custo do escritório — e por que o painel do fornecedor não mostra a conta antes — está em quanto custa IA no escritório: a conta real.

O mapa por tarefa jurídica

O erro comum é escolher o modelo pela importância do caso. O critério certo é a natureza da tarefa:

Roda no barato (padrão da casa):

  • Ler 200 páginas e devolver a ficha do processo (partes, datas, pedidos, valores)

  • Classificar e-mails e mensagens que chegaram no dia

  • Extrair dados de um lote de documentos para uma planilha

  • Transcrever e resumir uma reunião

  • Reformatar, traduzir termos, ajustar tom de um texto já escrito

  • Primeira passada de busca num acervo próprio

Exige o forte (exceção justificada):

  • A tese — o argumento que sustenta a peça

  • A peça que vai protocolada, na revisão final contra a jurisprudência que você conferiu

  • Comparar duas versões de um contrato de 40 páginas e classificar cada mudança por risco

  • Analisar um processo inteiro procurando contradições e lacunas, não só resumindo

  • Uma estratégia de caso com várias hipóteses

Depende do que você entrega (a variável escondida):

  • A mesma pergunta com um contexto de 3 páginas roda bem no barato; com 300 páginas, o forte erra menos porque sustenta a instrução ao longo do documento.

Há uma armadilha na direção contrária: o modelo barato que exige três tentativas custa mais que o forte que acerta de primeira — em dinheiro e no seu tempo. Se você está reescrevendo o prompt pela terceira vez, o problema pode ser o cérebro, não o comando.

Por que o consumo vem do contexto, não do modelo

Um esclarecimento que damos na aula porque gera confusão: o que consome o seu limite não é a skill nem o agente que você instalou — é o contexto: tudo que a IA precisa ler para responder. Um pedido de dez linhas com um anexo de 500 páginas é caro em qualquer modelo. Um pedido de dez linhas sem anexo é barato em qualquer modelo.

Daí três hábitos que valem mais que trocar de fabricante:

  1. Peça o plano antes da execução. Em tarefa longa, mande o modelo listar o que vai fazer e só depois executar. Você corrige a rota antes de gastar — e descobre se ele leu a premissa obrigatória ou pulou.

  2. Perceba o limite da janela antes de perder o trabalho. Todo modelo tem um tamanho máximo de "memória de trabalho" (hoje, 1 milhão de tokens nos modelos atuais da Anthropic, 200 mil no Haiku). Quando a conversa fica longa demais, o modelo começa a esquecer o começo — e o que ele "já leu" pode não estar salvo em lugar nenhum. Salve o que importa em arquivo; abra conversa nova quando o contexto contaminar.

  3. Mande pesquisar em vez de perguntar. Quando o tema exige fonte, o modo de pesquisa (que consulta e cita) vale mais que a resposta de memória — em qualquer camada.

"A IA ficou pior" — ou você mudou de cérebro sem perceber?

Boa parte das reclamações de "piorou" nasce de troca silenciosa de modelo: o aplicativo muda o padrão, o plano gratuito passa a usar outro cérebro, ou você abriu a conversa no modelo leve sem notar. Antes de concluir que o fornecedor degradou o serviço, confira qual modelo está selecionado — e leia a IA ficou pior: o que acontece e o que fazer, que separa o que é bug documentado do que é percepção.

A regra do escritório em uma linha

Defina por escrito, na base de conhecimento da casa: modelo leve como padrão; forte só nas tarefas da lista de exceção; toda peça que vai protocolada passa pelo forte e pela sua revisão. Isso tira a decisão do humor de cada um e faz a conta fechar. Se você ainda compara fabricantes em vez de tarefas, o guia melhor inteligência artificial para profissionais do Direito é o mapa por marca; este aqui é o mapa por trabalho. Os dois se encontram no guia geral de IA no Direito. E se quiser aprender o método completo — skills, agentes e a escolha do cérebro em cada etapa — é o que fazemos na Formação em IA para o mundo jurídico.

Fontes

CONTINUE APRENDENDO

Formação, imersões e materiais gratuitos de IA para o Direito

Tudo o que ensinamos — inclusive os materiais abertos — está reunido em um só lugar.

Conhecer o Jurídico Ágil

PERGUNTAS FREQUENTES

O que os advogados mais perguntam

O que os advogados mais perguntam

O que significa "escolher o cérebro" na IA?

É escolher qual modelo vai executar a tarefa. Cada plataforma oferece modelos de capacidade diferente: os simples são rápidos e baratos; os avançados raciocinam melhor e consomem mais. A escolha muda mais o resultado do que o texto do comando.

Qual modelo de IA devo usar para escrever uma petição?

O rascunho e a estrutura podem sair de um modelo intermediário. A tese e a revisão final da peça que vai protocolada pedem o modelo forte — e a sua conferência de cada citação na fonte, em qualquer modelo.

O modelo barato erra mais?

Em tarefas de execução com regra clara — extrair, classificar, resumir — a diferença é pequena. Em tarefas abertas e com contexto longo, o forte erra menos porque sustenta a instrução ao longo do documento. O erro é usar o barato onde a tarefa é aberta, ou o forte onde a tarefa é mecânica.

Por que a minha conta de IA subiu se eu uso o modelo barato?

Porque o consumo vem do contexto, não do modelo. Anexos grandes, conversas longas e respostas extensas gastam em qualquer camada. Respostas objetivas e conversas novas quando o assunto muda reduzem a conta mais do que trocar de fabricante.

Quanto custa o modelo mais forte em relação ao mais barato?

Nas páginas oficiais conferidas em setembro de 2026, o intervalo vai de US$ 0,20 (GPT-5.6 Luna, entrada) a US$ 50 (Claude Fable 5.1, saída) por milhão de tokens — mais de 50 vezes entre os extremos. Nos planos de assinatura você não paga por token, mas o consumo do limite segue a mesma proporção.

O que é a janela de contexto e por que ela importa?

É o tamanho máximo de texto que o modelo consegue "ter em mente" de uma vez. Quando a conversa passa desse limite, ele começa a esquecer o início. Por isso trabalho longo se salva em arquivo — e conversa que "contaminou" se recomeça, em vez de discutir com a ferramenta.

Devo pagar o plano mais caro para ter o modelo forte?

Depende do volume de tarefas de exceção. Para a maioria dos escritórios pequenos, o plano intermediário com disciplina de uso — leve como padrão, forte só na lista de exceção — resolve. O plano alto compensa quando a exceção vira rotina.

CONTINUE COM A GENTE

Leve o método adiante

Leve o método adiante

Imersões ao vivo e a Formação em IA aplicada ao Direito — o caminho completo está no Jurídico Ágil.

Conhecer a Formação em IA

Conteúdo educativo, em conformidade com o Provimento 205/2021 da OAB.

Leo Toco

Fundador do Jurídico Ágil, professor e consultor de IA e Gestão Ágil para o mercado jurídico. Mais de 15.000 alunos e 300+ agentes jurídicos criados.

juridicoagil.com →

NEWSLETTER SEMANAL

A análise da semana no seu e-mail

A análise da semana no seu e-mail

Os movimentos de IA que importam para o jurídico — resumidos e comentados, direto ao ponto.

Gratuita. 1 e-mail por semana — cancele quando quiser.