Quanto custa um agente de IA em 2026: a conta mudou em 7 de outubro

Mulher de camisa azul-petróleo atrás do balcão de uma pequena loja de roupas, concentrada, conferindo um orçamento impresso de uma página: a mão direita segura uma caneta azul e traça uma linha azul sobre uma das linhas cinzas do papel; o dedo indicador esquerdo apoia a folha ao lado. Um celular com a tela apagada está sobre o balcão à esquerda; ao fundo, araras de roupas desfocadas e luz natural de janela. Nenhum texto legível no papel ou na tela.

Quanto custa um agente de IA? Em outubro de 2026, a resposta honesta é: depende de quatro linhas da conta, e uma delas acabou de cair 90%. No dia 7 de outubro, a Anthropic lançou o Claude Haiku 5.5 cobrando US$ 0,10 por milhão de tokens de entrada, contra US$ 1,00 do modelo anterior. Isso muda a parte “inteligência” da conta. Não muda setup, plataforma nem a tarifa do WhatsApp, que é onde o dinheiro do pequeno negócio realmente vai.

Este artigo mostra as quatro linhas, faz a conta de um exemplo hipotético de 500 conversas por mês e termina com uma ficha para ler qualquer proposta de agência ou SaaS sem cair em “está tudo incluso”. Nenhum número aqui vem de teste próprio; todos têm fonte e data de leitura.

A conta de um agente tem quatro linhas, e uma delas caiu 90%

Quando uma agência manda uma proposta de “agente de IA por R$ 1.200 por mês”, ela está somando pelo menos quatro coisas diferentes. Separe antes de comparar:

  • Setup: o trabalho humano de desenhar o fluxo, escrever as instruções, conectar o CRM ou a planilha e testar. Pago uma vez, em geral o maior valor da conta.
  • Plataforma e mensalidade: a ferramenta onde o agente roda (um orquestrador como n8n ou Make, um SaaS de atendimento, a hospedagem) mais a manutenção de quem ajusta o que quebra.
  • Tokens do modelo: o que a empresa de IA (Anthropic, OpenAI, Google) cobra por texto lido e escrito. É a única linha cobrada em dólar por token, e a única que caiu em 7 de outubro.
  • Canal: a tarifa do WhatsApp por conversa ou mensagem, cobrada pela Meta e pelo provedor, que explicamos em como o WhatsApp API cobra em outubro de 2026.

Se você ainda está decidindo se precisa de um agente ou de um chatbot de fluxo fixo, vale ler antes o que é um agente de IA, porque a diferença muda a conta: chatbot de botões quase não consome tokens.

O que a Anthropic anunciou em 7 de outubro

Na página de lançamento do Claude Haiku 5.5 (lida em 8 de outubro de 2026), a Anthropic publica a tabela de preços por 1 milhão de tokens. Os valores são em dólar; a coluna de até 100.000 tokens de prompt é a que vale para praticamente qualquer atendimento ao cliente:

Por 1 milhão de tokens (US$) Haiku 5.5 (até 100k) Haiku 5.5 (acima de 100k) Haiku 4.5 Sonnet 5.5
Entrada 0,10 0,50 1,00 2,00
Saída 0,50 2,50 5,00 10,00
Leitura de cache 0,01 0,05 0,10 0,10
Gravação de cache 0,125 0,625 1,25 2,50

Em texto, a própria Anthropic afirma que o Haiku 5.5 “custa em média cerca de 75% menos” que o Haiku 4.5, sendo 90% mais barato para pedidos de até 100.000 tokens e 50% mais barato acima disso; segundo ela, 90% dos pedidos ao Haiku 4.5 ficavam na primeira faixa. No mesmo anúncio, a leitura de cache do Sonnet 5.5 caiu de US$ 0,20 para US$ 0,10 por milhão, o que, nas palavras da empresa, deixa o Sonnet “cerca de 20% mais barato na maioria das tarefas agênticas”. Também entrou um crédito mensal de API para assinantes: US$ 100 no Max 5x, US$ 200 no Max 20x e até US$ 500 compartilhado no Team.

A empresa posiciona o Haiku 5.5 para tarefas de alto volume e sensíveis a custo, como resumos, classificação, consultas e suporte ao cliente ao vivo, e diz que, para tarefas agênticas complexas de programação (as que ela mede no Terminal-Bench 4.0), Sonnet 5.5 e Opus 5.5 continuam sendo escolhas melhores; o Haiku 5.5 fica com tarefas de escopo mais restrito. Isso é a afirmação dela sobre o próprio produto, não uma medição nossa.

Calculadora: 500 conversas por mês, com a fórmula aberta

O exemplo a seguir é inteiramente hipotético. As premissas estão declaradas para você trocar pelos seus números:

  • 500 conversas por mês no WhatsApp.
  • Cerca de 8 respostas do agente por conversa.
  • Cada resposta lê, em média, 2.000 tokens (instruções do agente mais o histórico da conversa) e escreve 150 tokens.
  • Câmbio de aproximadamente R$ 5,00 por dólar (PTAX de venda de 7 de outubro de 2026: R$ 4,9935). Todo valor em R$ abaixo é estimativa.

A fórmula é sempre a mesma: tokens ÷ 1.000.000 × preço por milhão.

Por conversa: 8 × 2.000 = 16.000 tokens de entrada e 8 × 150 = 1.200 tokens de saída. Por mês: 500 × 16.000 = 8.000.000 tokens de entrada e 500 × 1.200 = 600.000 tokens de saída.

  • Haiku 5.5: entrada 8.000.000 ÷ 1.000.000 × 0,10 = US$ 0,80; saída 600.000 ÷ 1.000.000 × 0,50 = US$ 0,30. Total: US$ 1,10 por mês, cerca de R$ 5,50. Por conversa: US$ 0,0022, pouco mais de 1 centavo de real.
  • Haiku 4.5 (antes de 7 de outubro): entrada 8 × 1,00 = US$ 8,00; saída 0,6 × 5,00 = US$ 3,00. Total: US$ 11,00 por mês, cerca de R$ 55. Por conversa: US$ 0,022, cerca de R$ 0,11.
  • Sonnet 5.5: entrada 8 × 2,00 = US$ 16,00; saída 0,6 × 10,00 = US$ 6,00. Total: US$ 22,00 por mês, cerca de R$ 110. Por conversa: US$ 0,044, cerca de R$ 0,22.

Repare na ordem de grandeza. Um guia brasileiro de julho de 2026 estimava o custo de tokens entre R$ 0,05 e R$ 0,38 por interação simples; com o Haiku 5.5 e as premissas acima, a conversa inteira de 8 respostas fica em torno de 1 centavo, ou pouco mais de 0,1 centavo por interação. A planilha envelheceu em três meses.

O uso real varia, e para os dois lados. Instruções longas, consulta a documentos e histórico de semanas sobem os tokens de entrada; já o cache de prompt derruba o preço das instruções repetidas para US$ 0,01 por milhão no Haiku 5.5, e a conta pode ficar abaixo do exemplo. Se uma resposta precisar de vários passos internos (consultar estoque, conferir agenda, redigir), cada passo é um pedido novo e multiplica a entrada. Nada disso tira a conclusão: com 500 conversas por mês, os tokens cabem em uma nota de R$ 10 ou de R$ 100, e não são a linha que decide o orçamento.

Onde o dinheiro realmente vai

Se tokens custam centavos, por que a proposta chega em milhares de reais? Porque as outras três linhas não caíram.

Setup. É trabalho humano: entender o processo, escrever as regras, integrar sistema, testar com clientes reais. Três páginas brasileiras que publicam faixas, lidas em 8 de outubro de 2026 e citadas aqui sem endosso, dão uma ideia da dispersão: a Eupresa IA fala em setup à parte de R$ 0 a R$ 5.000 na maioria dos cenários e de R$ 10.000 ou mais para agente sob medida com regras próprias; a IA do Brasil cita projeto simples entre R$ 2.000 e R$ 5.000 e intermediário com CRM entre R$ 5.000 e R$ 10.000; o Algoritmo Diário coloca um agente de WhatsApp com IA e CRM entre R$ 8.000 e R$ 25.000 de implementação. A diferença entre esses números é o tamanho do que precisa ser desenhado, não o modelo de IA.

Plataforma e manutenção. Aqui entram categorias, não preços fixos: um orquestrador (n8n, Make ou similar) ou um SaaS de atendimento com IA embutida, a hospedagem, o banco de dados e a pessoa que ajusta as respostas quando o cardápio, a política de troca ou o horário mudam. As mesmas três páginas citam operação mensal entre R$ 150 e R$ 800 em ferramentas (IA do Brasil), R$ 300 a R$ 1.200 por mês para agente com API e orquestrador (Eupresa) e R$ 800 a R$ 2.500 por mês de operação (Algoritmo Diário). Leia cada uma com a data em mente: as três foram escritas ou atualizadas antes do corte de 7 de outubro, e a parte de tokens dentro delas já está defasada.

Canal. A tarifa do WhatsApp é cobrada pela Meta e pelo provedor segundo regras próprias, e independe do modelo de IA que você usa; as regras vigentes estão detalhadas no artigo sobre a cobrança do WhatsApp API. Nas premissas do exemplo acima, em que os tokens de uma conversa custam cerca de 1 centavo, qualquer tarifa de canal de alguns centavos por conversa já passa a conta de inteligência.

Quando o modelo barato não serve

Barato não é sinônimo de adequado, e a própria Anthropic desenha o limite. Três situações em que vale pagar mais caro por token, ou simplesmente não automatizar:

  • Tarefas longas e de várias etapas. Um agente que lê o pedido, consulta o estoque, calcula frete, negocia prazo e fecha a venda executa uma cadeia de decisões. A Anthropic só compara os modelos em tarefas de programação, mas a lógica é a mesma: quanto mais passos e decisões encadeadas, mais vale um modelo maior. No exemplo acima, trocar para o Sonnet 5.5 multiplica a linha de tokens por 20, e ela ainda assim fica em cerca de R$ 110 por mês.
  • Decisões com risco. Reembolso, cancelamento de contrato, orientação sobre saúde, promessa de prazo. O custo de um erro não está na fatura da API; está no cliente perdido ou na reclamação formal.
  • Quando uma pessoa precisa revisar. Todo agente precisa de um ponto em que para e chama alguém. Cada passagem para humano custa salário, não token, e é a linha mais fácil de esquecer na planilha. O artigo sobre o que liberar para o agente e quando chamar alguém trata exatamente desse desenho.

A economia de 7 de outubro reduz o custo de errar barato: dá para rodar um agente simples por um mês, medir quantas conversas ele resolve sozinho e só então decidir se vale subir de modelo ou de escopo.

Como ler uma proposta

Com as quatro linhas em mãos, qualquer proposta fica legível. Antes de assinar, peça para o fornecedor preencher isto por escrito:

  • Setup: valor fechado, o que está incluído (fluxos, integrações, testes) e o que é cobrado à parte.
  • Mensalidade: o que ela cobre (plataforma, hospedagem, horas de ajuste) e o que acontece se o volume dobrar.
  • Tokens: quem paga a conta da IA, se está embutida na mensalidade, qual modelo é usado e qual o preço por milhão de tokens que serve de base. Se a resposta for “é o modelo mais barato” sem nome, pergunte o nome.
  • Canal: se a tarifa do WhatsApp está na proposta ou será cobrada direto pela Meta e pelo provedor, e em qual conta vai cair.
  • O que está fora: manutenção depois do primeiro mês, novas integrações, retreinamento quando o negócio muda.

Uma proposta que não separa essas linhas não está necessariamente errada, mas impede comparação. Os outros critérios, como quem é o dono dos dados e o que acontece se a parceria acabar, estão em o que avaliar antes de contratar IA para pequenos negócios.

Perguntas frequentes

Um agente de IA pode custar zero?

Os tokens, quase. No exemplo de 500 conversas por mês com o Haiku 5.5, a conta fica em cerca de US$ 1,10. O que não custa zero é o trabalho humano de desenhar, integrar, testar e manter, mais a tarifa do canal. Se alguém oferece um agente “de graça”, esses custos estão em outro lugar: no seu tempo, numa mensalidade de plataforma ou numa limitação do que o agente faz.

O corte de preço vale para qualquer empresa de IA?

Não. O corte de 7 de outubro é da Anthropic, para os modelos Claude Haiku 5.5 e, no cache, Sonnet 5.5. Preços de OpenAI e Google não foram conferidos neste artigo; se a sua proposta usa outro modelo, peça a tabela oficial dele, com data.

Preciso trocar de modelo agora?

Se o seu agente roda no Haiku 4.5 e faz tarefas simples de atendimento, a Anthropic publicou um guia de migração e a diferença de preço é de 90% na faixa de até 100.000 tokens. Se ele roda em um modelo maior porque a tarefa exige, a troca pode piorar o resultado. A decisão é técnica, não só financeira, e quem mantém o agente deve testar antes.

Quanto custa um agente de IA no WhatsApp, então?

Em 2026, a resposta realista para um pequeno negócio é: setup de alguns milhares de reais segundo as faixas de mercado citadas acima, mensalidade de plataforma e manutenção na casa das centenas, tarifa do WhatsApp conforme as regras da Meta e do provedor, e tokens na casa dos centavos por conversa. Quem vende “por conversa” ou “por mensagem” está embutindo as quatro linhas em um número só; vale pedir a abertura.

Fontes