Quanto custa um agente de IA em 2026: a conta mudou em 7 de outubro
Quanto custa um agente de IA? Em outubro de 2026, a resposta honesta é: depende de quatro linhas da conta, e uma delas acabou de cair 90%. No dia 7 de outubro, a Anthropic lançou o Claude Haiku 5.5 cobrando US$ 0,10 por milhão de tokens de entrada, contra US$ 1,00 do modelo anterior. Isso muda a parte “inteligência” da conta. Não muda setup, plataforma nem a tarifa do WhatsApp, que é onde o dinheiro do pequeno negócio realmente vai.
Este artigo mostra as quatro linhas, faz a conta de um exemplo hipotético de 500 conversas por mês e termina com uma ficha para ler qualquer proposta de agência ou SaaS sem cair em “está tudo incluso”. Nenhum número aqui vem de teste próprio; todos têm fonte e data de leitura.
A conta de um agente tem quatro linhas, e uma delas caiu 90%
Quando uma agência manda uma proposta de “agente de IA por R$ 1.200 por mês”, ela está somando pelo menos quatro coisas diferentes. Separe antes de comparar:
- Setup: o trabalho humano de desenhar o fluxo, escrever as instruções, conectar o CRM ou a planilha e testar. Pago uma vez, em geral o maior valor da conta.
- Plataforma e mensalidade: a ferramenta onde o agente roda (um orquestrador como n8n ou Make, um SaaS de atendimento, a hospedagem) mais a manutenção de quem ajusta o que quebra.
- Tokens do modelo: o que a empresa de IA (Anthropic, OpenAI, Google) cobra por texto lido e escrito. É a única linha cobrada em dólar por token, e a única que caiu em 7 de outubro.
- Canal: a tarifa do WhatsApp por conversa ou mensagem, cobrada pela Meta e pelo provedor, que explicamos em como o WhatsApp API cobra em outubro de 2026.
Se você ainda está decidindo se precisa de um agente ou de um chatbot de fluxo fixo, vale ler antes o que é um agente de IA, porque a diferença muda a conta: chatbot de botões quase não consome tokens.
O que a Anthropic anunciou em 7 de outubro
Na página de lançamento do Claude Haiku 5.5 (lida em 8 de outubro de 2026), a Anthropic publica a tabela de preços por 1 milhão de tokens. Os valores são em dólar; a coluna de até 100.000 tokens de prompt é a que vale para praticamente qualquer atendimento ao cliente:
| Por 1 milhão de tokens (US$) | Haiku 5.5 (até 100k) | Haiku 5.5 (acima de 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| Entrada | 0,10 | 0,50 | 1,00 | 2,00 |
| Saída | 0,50 | 2,50 | 5,00 | 10,00 |
| Leitura de cache | 0,01 | 0,05 | 0,10 | 0,10 |
| Gravação de cache | 0,125 | 0,625 | 1,25 | 2,50 |
Em texto, a própria Anthropic afirma que o Haiku 5.5 “custa em média cerca de 75% menos” que o Haiku 4.5, sendo 90% mais barato para pedidos de até 100.000 tokens e 50% mais barato acima disso; segundo ela, 90% dos pedidos ao Haiku 4.5 ficavam na primeira faixa. No mesmo anúncio, a leitura de cache do Sonnet 5.5 caiu de US$ 0,20 para US$ 0,10 por milhão, o que, nas palavras da empresa, deixa o Sonnet “cerca de 20% mais barato na maioria das tarefas agênticas”. Também entrou um crédito mensal de API para assinantes: US$ 100 no Max 5x, US$ 200 no Max 20x e até US$ 500 compartilhado no Team.
A empresa posiciona o Haiku 5.5 para tarefas de alto volume e sensíveis a custo, como resumos, classificação, consultas e suporte ao cliente ao vivo, e diz que, para tarefas agênticas complexas de programação (as que ela mede no Terminal-Bench 4.0), Sonnet 5.5 e Opus 5.5 continuam sendo escolhas melhores; o Haiku 5.5 fica com tarefas de escopo mais restrito. Isso é a afirmação dela sobre o próprio produto, não uma medição nossa.
Calculadora: 500 conversas por mês, com a fórmula aberta
O exemplo a seguir é inteiramente hipotético. As premissas estão declaradas para você trocar pelos seus números:
- 500 conversas por mês no WhatsApp.
- Cerca de 8 respostas do agente por conversa.
- Cada resposta lê, em média, 2.000 tokens (instruções do agente mais o histórico da conversa) e escreve 150 tokens.
- Câmbio de aproximadamente R$ 5,00 por dólar (PTAX de venda de 7 de outubro de 2026: R$ 4,9935). Todo valor em R$ abaixo é estimativa.
A fórmula é sempre a mesma: tokens ÷ 1.000.000 × preço por milhão.
Por conversa: 8 × 2.000 = 16.000 tokens de entrada e 8 × 150 = 1.200 tokens de saída. Por mês: 500 × 16.000 = 8.000.000 tokens de entrada e 500 × 1.200 = 600.000 tokens de saída.
- Haiku 5.5: entrada 8.000.000 ÷ 1.000.000 × 0,10 = US$ 0,80; saída 600.000 ÷ 1.000.000 × 0,50 = US$ 0,30. Total: US$ 1,10 por mês, cerca de R$ 5,50. Por conversa: US$ 0,0022, pouco mais de 1 centavo de real.
- Haiku 4.5 (antes de 7 de outubro): entrada 8 × 1,00 = US$ 8,00; saída 0,6 × 5,00 = US$ 3,00. Total: US$ 11,00 por mês, cerca de R$ 55. Por conversa: US$ 0,022, cerca de R$ 0,11.
- Sonnet 5.5: entrada 8 × 2,00 = US$ 16,00; saída 0,6 × 10,00 = US$ 6,00. Total: US$ 22,00 por mês, cerca de R$ 110. Por conversa: US$ 0,044, cerca de R$ 0,22.
Repare na ordem de grandeza. Um guia brasileiro de julho de 2026 estimava o custo de tokens entre R$ 0,05 e R$ 0,38 por interação simples; com o Haiku 5.5 e as premissas acima, a conversa inteira de 8 respostas fica em torno de 1 centavo, ou pouco mais de 0,1 centavo por interação. A planilha envelheceu em três meses.
O uso real varia, e para os dois lados. Instruções longas, consulta a documentos e histórico de semanas sobem os tokens de entrada; já o cache de prompt derruba o preço das instruções repetidas para US$ 0,01 por milhão no Haiku 5.5, e a conta pode ficar abaixo do exemplo. Se uma resposta precisar de vários passos internos (consultar estoque, conferir agenda, redigir), cada passo é um pedido novo e multiplica a entrada. Nada disso tira a conclusão: com 500 conversas por mês, os tokens cabem em uma nota de R$ 10 ou de R$ 100, e não são a linha que decide o orçamento.
Onde o dinheiro realmente vai
Se tokens custam centavos, por que a proposta chega em milhares de reais? Porque as outras três linhas não caíram.
Setup. É trabalho humano: entender o processo, escrever as regras, integrar sistema, testar com clientes reais. Três páginas brasileiras que publicam faixas, lidas em 8 de outubro de 2026 e citadas aqui sem endosso, dão uma ideia da dispersão: a Eupresa IA fala em setup à parte de R$ 0 a R$ 5.000 na maioria dos cenários e de R$ 10.000 ou mais para agente sob medida com regras próprias; a IA do Brasil cita projeto simples entre R$ 2.000 e R$ 5.000 e intermediário com CRM entre R$ 5.000 e R$ 10.000; o Algoritmo Diário coloca um agente de WhatsApp com IA e CRM entre R$ 8.000 e R$ 25.000 de implementação. A diferença entre esses números é o tamanho do que precisa ser desenhado, não o modelo de IA.
Plataforma e manutenção. Aqui entram categorias, não preços fixos: um orquestrador (n8n, Make ou similar) ou um SaaS de atendimento com IA embutida, a hospedagem, o banco de dados e a pessoa que ajusta as respostas quando o cardápio, a política de troca ou o horário mudam. As mesmas três páginas citam operação mensal entre R$ 150 e R$ 800 em ferramentas (IA do Brasil), R$ 300 a R$ 1.200 por mês para agente com API e orquestrador (Eupresa) e R$ 800 a R$ 2.500 por mês de operação (Algoritmo Diário). Leia cada uma com a data em mente: as três foram escritas ou atualizadas antes do corte de 7 de outubro, e a parte de tokens dentro delas já está defasada.
Canal. A tarifa do WhatsApp é cobrada pela Meta e pelo provedor segundo regras próprias, e independe do modelo de IA que você usa; as regras vigentes estão detalhadas no artigo sobre a cobrança do WhatsApp API. Nas premissas do exemplo acima, em que os tokens de uma conversa custam cerca de 1 centavo, qualquer tarifa de canal de alguns centavos por conversa já passa a conta de inteligência.
Quando o modelo barato não serve
Barato não é sinônimo de adequado, e a própria Anthropic desenha o limite. Três situações em que vale pagar mais caro por token, ou simplesmente não automatizar:
- Tarefas longas e de várias etapas. Um agente que lê o pedido, consulta o estoque, calcula frete, negocia prazo e fecha a venda executa uma cadeia de decisões. A Anthropic só compara os modelos em tarefas de programação, mas a lógica é a mesma: quanto mais passos e decisões encadeadas, mais vale um modelo maior. No exemplo acima, trocar para o Sonnet 5.5 multiplica a linha de tokens por 20, e ela ainda assim fica em cerca de R$ 110 por mês.
- Decisões com risco. Reembolso, cancelamento de contrato, orientação sobre saúde, promessa de prazo. O custo de um erro não está na fatura da API; está no cliente perdido ou na reclamação formal.
- Quando uma pessoa precisa revisar. Todo agente precisa de um ponto em que para e chama alguém. Cada passagem para humano custa salário, não token, e é a linha mais fácil de esquecer na planilha. O artigo sobre o que liberar para o agente e quando chamar alguém trata exatamente desse desenho.
A economia de 7 de outubro reduz o custo de errar barato: dá para rodar um agente simples por um mês, medir quantas conversas ele resolve sozinho e só então decidir se vale subir de modelo ou de escopo.
Como ler uma proposta
Com as quatro linhas em mãos, qualquer proposta fica legível. Antes de assinar, peça para o fornecedor preencher isto por escrito:
- Setup: valor fechado, o que está incluído (fluxos, integrações, testes) e o que é cobrado à parte.
- Mensalidade: o que ela cobre (plataforma, hospedagem, horas de ajuste) e o que acontece se o volume dobrar.
- Tokens: quem paga a conta da IA, se está embutida na mensalidade, qual modelo é usado e qual o preço por milhão de tokens que serve de base. Se a resposta for “é o modelo mais barato” sem nome, pergunte o nome.
- Canal: se a tarifa do WhatsApp está na proposta ou será cobrada direto pela Meta e pelo provedor, e em qual conta vai cair.
- O que está fora: manutenção depois do primeiro mês, novas integrações, retreinamento quando o negócio muda.
Uma proposta que não separa essas linhas não está necessariamente errada, mas impede comparação. Os outros critérios, como quem é o dono dos dados e o que acontece se a parceria acabar, estão em o que avaliar antes de contratar IA para pequenos negócios.
Perguntas frequentes
Um agente de IA pode custar zero?
Os tokens, quase. No exemplo de 500 conversas por mês com o Haiku 5.5, a conta fica em cerca de US$ 1,10. O que não custa zero é o trabalho humano de desenhar, integrar, testar e manter, mais a tarifa do canal. Se alguém oferece um agente “de graça”, esses custos estão em outro lugar: no seu tempo, numa mensalidade de plataforma ou numa limitação do que o agente faz.
O corte de preço vale para qualquer empresa de IA?
Não. O corte de 7 de outubro é da Anthropic, para os modelos Claude Haiku 5.5 e, no cache, Sonnet 5.5. Preços de OpenAI e Google não foram conferidos neste artigo; se a sua proposta usa outro modelo, peça a tabela oficial dele, com data.
Preciso trocar de modelo agora?
Se o seu agente roda no Haiku 4.5 e faz tarefas simples de atendimento, a Anthropic publicou um guia de migração e a diferença de preço é de 90% na faixa de até 100.000 tokens. Se ele roda em um modelo maior porque a tarefa exige, a troca pode piorar o resultado. A decisão é técnica, não só financeira, e quem mantém o agente deve testar antes.
Quanto custa um agente de IA no WhatsApp, então?
Em 2026, a resposta realista para um pequeno negócio é: setup de alguns milhares de reais segundo as faixas de mercado citadas acima, mensalidade de plataforma e manutenção na casa das centenas, tarifa do WhatsApp conforme as regras da Meta e do provedor, e tokens na casa dos centavos por conversa. Quem vende “por conversa” ou “por mensagem” está embutindo as quatro linhas em um número só; vale pedir a abertura.
Fontes
- Anthropic, “Introducing Claude Haiku 5.5”, 7 de outubro de 2026, lida em 8 de outubro de 2026: anthropic.com/claude-haiku-5-5.
- Tabela de preços da plataforma Claude, lida em 8 de outubro de 2026: platform.claude.com/docs/en/about-claude/pricing.
- Câmbio: PTAX de venda do Banco Central, 7 de outubro de 2026, R$ 4,9935.
- Faixas de mercado (terceiros, sem endosso, lidas em 8 de outubro de 2026): Eupresa IA (atualizada em 6 de outubro de 2026), Algoritmo Diário (10 de julho de 2026) e IA do Brasil (atualizada em 18 de setembro de 2026).
