Procure “quanto custa um agente de IA para WhatsApp” e você vai encontrar faixas: tanto a tanto por mês, com tabela bonita e três planos. O número costuma estar até próximo da realidade de mercado — o problema é outro.
Ele descreve uma das três camadas da conta. E a camada que ele descreve é justamente a que menos varia entre fornecedores.
Este artigo separa as três, diz qual delas tem tarifa publicada hoje, qual ainda não tem e como você encontra o número que vale para a sua empresa em vez do que vale para o texto de alguém.
Camada 1: o que a Meta cobra
Esta é a camada que ninguém controla e que quase todo comparativo omite. Ela é cobrada por mensagem, e desde 1º de julho de 2025 o modelo é esse — não por conversa, como ainda se lê por aí.
Dentro dela existe uma bifurcação que só apareceu em 2026, e é importante entender porque ela muda a conta conforme quem escreve a resposta.
Se quem responde é o agente da própria Meta
Desde 1º de agosto de 2026, mensagens do Meta Business Agent são cobradas por token:
“Effective August 1, 2026, Meta will charge on a per-token basis for Meta Business Agent messages.”
A tarifa é US$ 2,00 por 1 milhão de tokens, global, igual para qualquer país. A cobrança reflete o consumo para ler a mensagem do usuário e para gerar a resposta, e a documentação estima 20 mil a 25 mil tokens por mensagem — algo entre 4 e 5 centavos de dólar por mensagem.
Essa é, hoje, a única tarifa desta camada que dá para citar com fonte primária. Ela está publicada, é global e não depende de negociação.
Se quem responde é um humano ou uma IA de terceiro
Aí a mensagem entra como mensagem de serviço. E mensagem de serviço é gratuita desde novembro de 2024 — até outubro deste ano:
“Effective October 1, 2026, Meta will charge for service messages, which have not been charged since November 2024.”
A mudança é real e está documentada. O preço, não. Quando este artigo foi escrito, as tarifas de serviço ainda não tinham sido publicadas — a Meta se comprometeu a divulgá-las até 1º de setembro de 2026.
Então vale o aviso direto: qualquer valor por mensagem de serviço que você encontrar hoje em blog, proposta ou calculadora não veio da documentação da Meta. Foi estimado por alguém. Pode até acertar, mas não é fonte. Tratamos a mudança inteira em a Meta vai cobrar mensagens de serviço a partir de outubro.
E existe uma regra que impede a conta de dobrar
Essa é a boa notícia da camada 1: os dois caminhos não se somam. Uma mensagem não-template é cobrada como mensagem do Meta Business Agent ou como mensagem de serviço, nunca as duas.
Ou seja, ninguém paga token e serviço pela mesma resposta. O detalhamento, com os exemplos da própria Meta, está em como funciona a cobrança por token.
E os templates, que continuam existindo
Tudo acima vale dentro da janela de atendimento. Fora dela — para iniciar conversa, retomar quem sumiu, avisar de algo — o custo é de template, cobrado por categoria: marketing, utilidade ou autenticação.
Aqui mora a maior distorção de custo do WhatsApp brasileiro: no Brasil, a diferença entre a tarifa de marketing e a de utilidade é de aproximadamente nove vezes. O mesmo disparo, para a mesma base, no mesmo dia, custa nove vezes mais se o template foi classificado como marketing. Por isso a categoria do template é decisão de orçamento, não de burocracia.
Camada 2: a licença da plataforma
Essa é a camada que as tabelas de preço descrevem. É o software que fica entre o seu time e a API: fila, histórico, funil, relatórios, integrações — e, cada vez mais, o agente de IA em si.
Ela varia por fornecedor e por porte da operação, e é a única das três em que faz sentido negociar. Não vamos publicar faixa de mercado aqui, por um motivo simples: número de licença alheia envelhece em semanas e serve mais para parecer completo do que para ajudar.
O que vale dizer é o que costuma esconder custo dentro dela:
- cobrança por atendente — cresce quando a equipe cresce, o que é justo, mas precisa entrar na projeção;
- cobrança por conversa ou por mensagem além da tarifa da Meta — se existir, é margem do fornecedor sobre a camada 1, e você tem o direito de ver as duas separadas;
- limite de automações ou de integrações no plano de entrada;
- cobrança de implantação e de treinamento;
- custo para sair — o que acontece com o número e o histórico se você trocar de fornecedor, assunto de trocar de fornecedor da API.
A pergunta que resolve essa camada numa frase: “o que exatamente aumenta a minha fatura no mês que vem?”
Camada 3: o modelo de IA, quando ele é cobrado à parte
Essa camada só existe às vezes, e é a mais mal explicada das três.
Se a sua plataforma usa um modelo de terceiro cobrado por token, esse consumo é um custo real — e ele pode estar embutido na licença ou vir separado, medido por uso. As duas formas são legítimas. O que não é legítimo é você descobrir qual delas é a sua só na segunda fatura.
Repare que, se você usa o Meta Business Agent, esta camada e a camada 1 se fundem: o token que você paga é o da Meta. Se você usa o agente de uma plataforma, a camada 1 cobra serviço e a camada 3 cobra o modelo. São arquiteturas diferentes, com contas diferentes — e é por isso que duas propostas podem parecer distantes sem que nenhuma esteja errada.
Como fazer a sua conta de verdade
Sem tabela inventada, com o que existe:
1. Descubra a sua tarifa real. Ela está no rate card dentro do WhatsApp Manager, na sua conta, na sua moeda, por categoria. Desde 1º de julho de 2026 a Meta iniciou a localização de faturamento no Brasil, e contas elegíveis passaram a ser faturadas em reais — então o rate card da sua conta é ainda mais necessário do que era.
2. Conte conversas, não mensagens, primeiro. Quantos clientes falam com você por mês? Desses, quantos você inicia (template) e quantos iniciam eles (janela)?
3. Agora conte mensagens por conversa. Essa é a variável que quase ninguém acompanha e que multiplica tudo a partir de outubro. Uma conversa que resolve em quatro mensagens custa um terço de uma que resolve em doze.
4. Some a licença e pergunte o que a faz subir.
5. Pergunte, explicitamente, se o modelo de IA é cobrado à parte.
Feito isso, você tem uma projeção que resiste a outubro. Sem isso, você tem uma linha na planilha que vai furar exatamente quando a gratuidade das mensagens de serviço acabar.
A economia que a IA traz de verdade
Vale desfazer uma promessa mal formulada. “IA reduz custo de mensagem” é falso: a mensagem custa o que custa, e a partir de outubro custa nos dois modelos.
O que a IA faz, quando é bem montada, é outra coisa — e é melhor:
- resolve em menos mensagens, porque responde certo de primeira em vez de fazer três perguntas para descobrir o que o cliente quer;
- evita template desnecessário, respondendo dentro da janela em vez de deixar a conversa morrer e ter que reabrir depois pagando;
- não deixa conversa sem resposta, que é o custo invisível maior que todos os outros somados — porque ele não aparece na fatura, aparece na venda que não aconteceu.
Ou seja: a partir de outubro, eficiência de conversa vira linha de orçamento. Quem tratar isso como qualidade de atendimento vai ver na fatura.
Onde a gente entra
O AtendeChat é parceiro oficial da Meta, e a nossa parte nessa conta é a camada 2 — com a diferença de que a gente mostra as três.
Na prática: colocamos seu número na API Oficial, com vários atendentes, fila, histórico centralizado, funil em kanban, relatórios e integração com seus sistemas, e conduzimos com você a verificação de negócio, o registro do número e a aprovação dos templates — inclusive a briga de classificar como utilidade o que não precisa ser marketing, que é onde mora a economia de nove vezes.
Se você quer a conta da sua operação, com o seu volume e a sua tarifa, fale com a gente. A gente monta a projeção junto com você, separando o que é da Meta do que é nosso — que é como essa conta deveria ser apresentada sempre.