As três contas
Na conexão não oficial (QR Code) não existe a conta da Meta, mas também não existem campanhas, reengajamento e conversões. Veja Qual conexão escolher.
O que mudou na Meta em 01/10/2026
Desde 1º de outubro de 2026, a Meta cobra toda mensagem de serviço: qualquer mensagem que não é template, enviada dentro da janela de 24h, seja escrita por uma pessoa ou por uma IA de terceiros, como o agente da Zatten. Antes, essas respostas eram grátis. Pela página da Meta, o valor da mensagem de serviço é o mesmo da mensagem de utilidade no mesmo país. Na prática: cada resposta que o agente manda no WhatsApp oficial é uma mensagem cobrada pela Meta. Templates (marketing, utilidade e autenticação) continuam cobrados como antes. Mensagens dentro da janela grátis de quem chega por anúncio Click-to-WhatsApp continuam sem cobrança de entrega.Exemplo resolvido
Os números abaixo são ilustrativos. Preços consultados em 06/10/2026 em openrouter.ai/api/v1/models e na página de preços de mensagens de serviço da Meta. Câmbio ilustrativo de R$ 5,40 por dólar. Confira sempre os valores atuais antes de apresentar a um cliente.
openai/gpt-5.4-mini no OpenRouter, que custava US 4,50 por milhão de tokens de saída na data da consulta.
1. Tokens de uma conversa típica
A cada mensagem do lead, o agente chama o modelo uma vez, e cada chamada reenvia o prompt, a descrição das ferramentas e o histórico da conversa. Por isso a entrada pesa muito mais que a saída.2. Custo de IA por conversa
3. Custo da Meta por conversa
A própria página da Meta usa, como exemplo, US$ 0,0068 por mensagem de utilidade no Brasil (valor de 01/07/2026), que é também o valor da mensagem de serviço. Com 8 respostas do agente: 8 × US 0,0544 ≈ R$ 0,29 por conversa.**4. Por mês, com 1.000 contatos
Supondo uma conversa por contato no mês:
Templates de follow-up e campanhas são somados à parte, pelo preço da categoria de cada um.
O que faz o custo subir ou descer
- O modelo. Entre modelos, o preço por token varia mais de 10 vezes. Um modelo maior só vale se a qualidade for necessária. Veja Escolher o modelo.
- O tamanho do prompt e das ferramentas. Vão em toda chamada. Um prompt de 10.000 tokens custa três vezes mais que um de 3.000, a conversa inteira.
- O cache de prompt. A parte fixa do prompt costuma entrar em cache no provedor e custar bem menos. Por isso o custo real tende a ser menor que a conta acima. O prompt da Zatten é fixo de propósito para aproveitar o cache.
- Conversas longas. O histórico cresce a cada troca. O resumo automático limita isso. Veja Conversas longas.
- Ferramentas. Cada ferramenta chamada é mais uma chamada ao modelo na mesma mensagem.
- Segmentação. Dividir a resposta em várias mensagens no WhatsApp não muda o custo da IA, mas cada pedaço é uma mensagem cobrada pela Meta. Veja Segmentação e voz.
Onde ver o gasto real
- Métricas do projeto: tokens e gasto em dólar da IA, mensagens enviadas e recebidas. Veja Métricas.
- Painel do provedor: o consumo da chave na OpenAI ou no OpenRouter.
- Meta Business Suite: as mensagens cobradas e a fatura da conta do WhatsApp Business.
Armadilhas
- Conta da Meta sem forma de pagamento: as respostas do agente param de ser entregues.
- Comparar só o preço por token: um modelo barato que precisa de três chamadas para resolver pode sair mais caro que um modelo melhor que resolve em uma.
- Esquecer as mensagens de serviço: desde 01/10/2026, um agente que responde muito no WhatsApp oficial gera custo na Meta mesmo sem nenhum template.
Para saber mais
- Quanto cobrar do cliente final: montar o preço a partir destes custos.
- Estimar o custo de IA de um cliente: a conta com dados reais.
- Providers: OpenAI e OpenRouter.
- Meta: preços, mensagens de serviço cobradas desde 01/10/2026, tabela pública.
- OpenRouter: modelos (JSON), cache de prompt. OpenAI: preços.
- Termos para buscar: “per-message pricing WhatsApp”, “service messages pricing”, “free entry point”, “price per million tokens”, “prompt caching”.