whatsappautomacaocustoschatwootn8nvpsself-hosted

Quanto custa automatizar atendimento no WhatsApp? Os componentes de custo de um stack próprio

Douglas Haruo 10 min 05/09/2026

Automatizar atendimento no WhatsApp com stack próprio custa, de infraestrutura fixa, a partir de ~€6,50/mês de VPS. A API oficial da Meta cobra R$ 0 para responder mensagens que o cliente inicia, porque a janela de atendimento de 24 horas é gratuita. E o LLM, o modelo de linguagem, custa centavos por conversa. O componente que domina a conta não aparece em fatura nenhuma: é a manutenção, as horas de alguém que responde pelo stack. É ela que decide quando um SaaS pronto, contratado por assinatura, sai mais barato. Para muita empresa, a resposta certa é justamente não montar nada disso.

Este post desmonta a conta componente por componente. A matéria-prima é um stack que operamos em produção, ou seja, o conjunto de peças de software que sustenta o atendimento. São o Chatwoot CE como caixa de entrada, um serviço próprio em Fastify com Postgres como cérebro do robô e o n8n para tarefas agendadas. Tudo roda numa VPS Hetzner atrás de Cloudflare Tunnel, com LLM via OpenRouter. Mas o post é anatomia de custo para quem está avaliando, não catálogo de serviço. Todos os preços abaixo são públicos e foram conferidos em 25/08/2026 nas fontes citadas. Tabela de preço é perecível, e a data importa tanto quanto o número.


Quais são os quatro componentes da conta?

  1. Infraestrutura fixa: a VPS (o servidor alugado), o IP, o domínio. Mensal, previsível, pequeno.
  2. Tarifa da Meta: por mensagem. O desenho da tarifa favorece exatamente o caso do robô que responde.
  3. LLM: variável por conversa. A ordem de grandeza é centavo, não real.
  4. Manutenção: horas de gente. É o único componente sem preço de tabela, e o que costuma decidir a comparação com SaaS.

Quem vende automação apresenta os três primeiros. Quem opera sabe que o quarto manda na conta.

Quanto custa a infraestrutura fixa?

O software da camada de atendimento tem licença R$ 0: Chatwoot Community Edition, n8n self-hosted (rodando na sua própria máquina) e o que você mesmo escrever. O custo fixo real é a máquina onde isso roda.

Preços da Hetzner Cloud em 25/08/2026 (hetzner.com/cloud, linha compartilhada, sem impostos):

PlanovCPU / RAM / discoTráfego inclusoPreço
CX232 vCPU / 4 GB / 40 GB NVMe20 TB€5,99/mês
CX334 vCPU / 8 GB / 80 GB NVMe20 TB€8,99/mês

Somam-se €0,50/mês pelo IPv4 primário (docs.hetzner.com). O túnel que publica os serviços sem abrir porta nenhuma cabe no plano gratuito do Cloudflare Zero Trust. A anatomia dessa caixa tem um post próprio. Domínio é à parte e varia por TLD.

Dimensionamento honesto: o Chatwoot é o item pesado do conjunto, com Rails, Postgres, Redis e workers. Em 4 GB ele roda apertado junto com n8n e um serviço de bot. Com 8 GB, o mesmo conjunto tem folga. Ou seja: a infraestrutura fixa de um stack completo fica entre €6,49 e €9,49 por mês nos preços de hoje. Se a empresa já tem uma VPS rodando outras coisas, o custo marginal é ainda menor.

Quando a Meta cobra por mensagem?

Aqui mora o mal-entendido mais caro do tema. Desde 01/07/2025 a Meta cobra a API oficial do WhatsApp por mensagem, não mais por conversa. E o desenho da tarifa é generoso com quem responde:

  • Mensagem recebida: grátis. Cliente escrevendo para a empresa não custa nada.
  • Responder dentro da janela de 24 horas: grátis. Cada mensagem do cliente abre (e renova) uma janela de atendimento. Dentro dela, a página oficial de preços diz textualmente que a empresa “pode responder com mensagens de serviço, que não são cobradas”. Templates de utilidade enviados em resposta dentro da janela também são gratuitos (página de preços da plataforma, consultada em 25/08/2026).
  • Anúncio click-to-WhatsApp abre 72 horas gratuitas de conversa. É o anúncio que leva direto para a conversa no WhatsApp.

Consequência prática: um robô que responde o que os clientes perguntam paga R$ 0 de tarifa Meta. Esse é o caso típico de atendimento. O que custa é a mensagem proativa, iniciada pela empresa fora de janela, sempre via template aprovado, ou seja, um modelo de mensagem pré-aprovado. Na tabela oficial vigente para o Brasil (rate card de 01/07/2026, linkado em developers.facebook.com/docs/whatsapp/pricing, baixado em 25/08/2026):

Categoria de template (Brasil)Preço por mensagem
Utility (confirmação, aviso de pedido)US$ 0,0068
Authentication (código de login)US$ 0,0068
MarketingUS$ 0,0625

Três avisos que valem dinheiro:

  1. Essa tabela muda. A Meta já tem revisão de tarifas anunciada com vigência em 01/10/2026, com os novos números publicados até 01/09/2026 (updates de pricing). O anúncio atual nomeia mercados específicos, mas serve de lembrete: a tabela se move. Não trate nenhum número deste post como permanente, nem o R$ 0 da janela. Planeje com a tabela do dia, não com a promessa de ontem.
  2. A tarifa existe em BRL também. A Meta publica o rate card em mais de uma moeda. Para operação brasileira, confira a versão em real.
  3. Intermediário cobra por cima. Indo direto na Cloud API oficial, a tarifa acima é a tarifa. Alguns provedores intermediários cobram taxa própria por mensagem, às vezes inclusive nas recebidas. Isso destrói a economia de um robô que vive de responder. Leia a tabela do intermediário antes de assinar.

Quanto custa o LLM por conversa?

O preço de LLM é público, cobrado por token, o pedaço de texto que o modelo processa, e por modelo. Via OpenRouter, um gateway único para vários provedores, esta é a tabela de 25/08/2026 (openrouter.ai/models) para modelos típicos de atendimento:

ModeloEntrada / saída (US$ por 1M tokens)Conversa-exemplo
openai/gpt-4o-mini0,15 / 0,60~US$ 0,006
google/gemini-2.5-flash0,30 / 2,50~US$ 0,014
anthropic/claude-haiku-4.51,00 / 5,00~US$ 0,04
anthropic/claude-sonnet-4.63,00 / 15,00~US$ 0,12

A conversa-exemplo é ilustrativa, com as premissas à mostra: 10 trocas, ~3.000 tokens de entrada por turno (prompt de sistema + histórico reenviado a cada chamada) e ~200 tokens de resposta. Dá 30 mil tokens de entrada e 2 mil de saída no total. Mil conversas dessas no mês custam de ~US$ 6 (modelo pequeno) a ~US$ 120 (modelo de ponta). A ordem de grandeza é essa: centavos por conversa. E o número é sensível a duas escolhas suas: o tamanho do modelo e a disciplina com o contexto.

Dá para comprimir o lado da entrada com prompt caching, o reaproveitamento do trecho que se repete. Num agente, quase todo o payload de cada chamada é prefixo estável. Medimos isso em produção antes de ligar o cache, e a lição de lá vale aqui: meça o seu prefixo antes de assumir o desconto.

Qual é o custo que não aparece na fatura?

Manutenção. É o componente que nenhuma página de preço mostra e o que separa a planilha otimista da operação real. Operar esse stack significa, de forma recorrente:

  • Atualizações. Chatwoot e n8n lançam versões em ritmo constante. Ficar para trás tem custo de segurança; atualizar tem custo de atenção.
  • Backup que restaura. Backup sem teste de restore é fé, não backup. E o backup precisa avisar quando não rodou. O desenho com dead-man switch que usamos existe porque o nosso ficou 14 dias morto sem ninguém notar.
  • Monitoramento e incidente. De fora (uptime), de dentro (disco, containers), e alguém que acorda quando quebra.
  • A esteira da Meta. Token que expira, webhook que precisa de app publicado, versões de API com prazo, tarifa que muda (ver acima). A plataforma se move, e alguém acompanha.
  • A esteira dos modelos. LLM é deprecado, preço muda, comportamento muda entre versões. O robô que ninguém reavalia degrada em silêncio.
  • O robô em si. Prompt, regras, limites do que o agente pode fazer sozinho. Automação de atendimento não é projeto que termina; é operação que continua.

Não vou inventar um número de horas. Depende do stack, do volume e de quem opera. O ponto é outro: orce este componente explicitamente antes de decidir. Se ninguém no time pode ser dono disso, o resto da conta não importa.

Quando um SaaS pronto sai mais barato?

Com frequência. Este post não é um argumento de que stack próprio sempre ganha. O SaaS de atendimento embute exatamente o componente dominante: a manutenção vira problema do fornecedor, junto com hospedagem, interface, atualizações e suporte. A comparação honesta:

O SaaS tende a ganhar quando:

  • Não há ninguém técnico para ser dono do stack. Este critério sozinho encerra a discussão.
  • O fluxo é padrão (menu, FAQ, encaminhar para humano) e as ferramentas prontas já o cobrem.
  • O valor está em começar esta semana, não em controlar a arquitetura.
  • O volume é pequeno demais para diluir o custo fixo de aprender e operar a plataforma.

O stack próprio tende a ganhar quando:

  • Já existe engenharia na casa e infraestrutura rodando, então o custo marginal da caixa é quase zero.
  • A automação precisa integrar sistemas internos que nenhum SaaS conhece.
  • Há requisito de controle de dados (LGPD, dados de saúde, financeiro) que favorece operar a própria caixa.
  • A mesma operação atende várias contas ou clientes. O custo fixo se dilui, e a margem do SaaS por assento começa a pesar.

Não vou ancorar preços de SaaS de terceiros aqui. Mudam rápido, e cada ferramenta cobra por um eixo diferente: por atendente, por contato, por mensagem. Em vez disso, ficam as perguntas que fazem a comparação ser justa na sua planilha. A tarifa da Meta é repassada ou embutida com markup? A cobrança é por atendente, por contato ou por mensagem? O LLM está incluso ou é add-on? Os dados saem se você quiser sair?

A conta, lado a lado

ComponenteNaturezaOrdem de grandeza (25/08/2026)
VPS + IPv4fixo mensal€6,49–€9,49/mês (Hetzner CX23/CX33 + IP)
Túnel / bordafixoplano gratuito (Cloudflare Zero Trust)
Software (Chatwoot CE, n8n, código próprio)licença R$ 0o custo é operar, não licenciar
Tarifa Metavariável por mensagemR$ 0 respondendo na janela de 24h; US$ 0,0068–0,0625/msg proativa (Brasil)
LLMvariável por conversa~US$ 0,006–0,12 por conversa no exemplo acima
Manutençãohoras de genteo componente dominante, sem preço de tabela

O resumo que você leva

  1. A infraestrutura fixa é pequena: €6,49–€9,49/mês de VPS + IP cobre Chatwoot + n8n + um serviço de bot (preços Hetzner de 25/08/2026).
  2. A Meta cobra por mensagem desde 01/07/2025, e responder é grátis: mensagem recebida e resposta dentro da janela de 24h custam R$ 0. Só a mensagem proativa via template paga (Brasil: US$ 0,0068 utility, US$ 0,0625 marketing).
  3. Tabela de tarifa é perecível: a Meta já tem revisão anunciada com vigência em 01/10/2026 (números até 01/09/2026). Decida com a tabela do dia.
  4. LLM custa centavos por conversa. O número responde ao tamanho do modelo e à disciplina de contexto, com prompt caching comprimindo a entrada.
  5. Manutenção é o componente dominante e o único sem preço público. Orce-o explicitamente, com nome de responsável.
  6. SaaS ganha com frequência. Sem dono técnico, com fluxo padrão ou com pressa, é a resposta certa. Stack próprio ganha quando engenharia, integração e controle de dados já estão na mesa.

Quer a conta feita para o seu caso?

A auditoria de R$ 1.500 responde em sete dias onde o seu dinheiro está vazando e o que mexer primeiro, com o relatório escrito na sua mão. Se a resposta certa for não contratar ninguém, ela também sai ali.

Ver a auditoria de R$ 1.500 →