- “Agente grátis” geralmente é só um protótipo: funciona enquanto seu computador está ligado e sem número oficial.
- Operação real exige: número verificado/registrado, provedor de API, VPS 24/7 e regras de janela de conversa.
- A conta cresce por volume: em baixo volume, o fixo (VPS + provedor) pesa; em alto volume, a cobrança da Meta + tokens vira o centro.
- A partir de out/2026, mudanças de precificação/políticas podem alterar a matemática: trate custo por conversa como variável e monitore mensalmente.
- Erro clássico: subir bot com número “não oficial”/gambiarras e tomar bloqueio — e perder histórico/continuidade.
1) Separe: protótipo (brincar) vs operação (rodar 24/7)
Protótipo é quando você testa fluxo e prompt com WhatsApp Web, automações locais ou ferramentas que dependem do seu computador. Operação é quando o atendimento não pode cair: precisa de API oficial, servidor e governança (logs, limites, opt-in). Quase todo tutorial “grátis” é sobre protótipo — a conta chega quando você tenta colocar em produção.
2) Liste os 4 blocos de custo (fixo + variável)
Pense em quatro blocos: (A) número oficial + provedor (mensal e/ou setup), (B) servidor/VPS (mensal), (C) cobrança do WhatsApp (normalmente por janela de conversa ou categoria, depende das regras vigentes), (D) IA (tokens do modelo + ferramentas como transcrição/voz, se usar). Some fixos e projete variáveis por volume.
3) Estime o fixo mínimo (sem inventar milagre)
Faixa típica (varia por provedor e região): VPS simples para automação e webhooks costuma ficar em uma faixa mensal “baixa a média”; provedores de API do WhatsApp costumam ter mensalidade e/ou taxa de número; e ainda há custo de ferramentas (monitoramento, banco de dados) se você profissionalizar. Se o seu volume é pequeno, esses fixos podem ser a maior parte do gasto.
4) Modele o variável: janelas de conversa + tokens
O WhatsApp cobra conforme regras da Meta (e isso muda). Em muitos cenários, a cobrança é por janela de conversa (ex.: 24h) e categoria; em outros, pode haver cobrança por mensagem/template. Some a isso os tokens do modelo (quanto mais contexto e anexos, mais caro). Uma automação “educada” reduz custo: respostas curtas, busca em base (RAG) e escalonamento humano quando necessário.
5) Decida: montar você mesmo vs contratar pronto (ponto de virada)
Montar você mesmo costuma compensar quando você precisa de personalização, integrações e controle fino (CRM, estoque, financeiro, SLA). Contratar pronto costuma ganhar quando você quer previsibilidade, suporte e tempo de implantação — especialmente em volume baixo a médio. O ponto de virada é: quanto custa seu tempo + risco de queda/bloqueio vs a economia por conversa em escala.
6) Não caia no erro do número “não oficial” (e do bloqueio)
Gambiarras com número pessoal, automação por WhatsApp Web ou envio fora das políticas podem resultar em bloqueio. Além de parar o atendimento, você pode perder continuidade, reputação e ter retrabalho para migrar para um número oficial. Se é atendimento de negócio, trate número e opt-in como infraestrutura, não como detalhe.
A conta real do “agente de IA grátis”: onde ela aparece
Quando alguém diz “fiz um agente de IA no WhatsApp de graça”, quase sempre está falando de um desses cenários: (1) demo local que responde enquanto o notebook está ligado; (2) automação por WhatsApp Web; (3) número não oficial. Isso é ótimo para aprender e validar fluxo — mas não é operação.
Na operação, você paga para manter três coisas sempre de pé: um canal oficial (número e API), um servidor (webhook/integrações) e a inteligência (tokens). E ainda precisa lidar com as regras de janela de conversa e mensagens de template.
A tese aqui é simples: separar custo de brincar (barato, frágil) do custo de operar (fixo + variável). Sem essa separação, você compara maçã com laranja — e a surpresa vem no primeiro mês em produção.
Quanto custa cada componente (faixas típicas, sem promessa)
Como os preços variam por provedor, região, modelo de IA e políticas da Meta, o melhor é pensar em faixas e dependências. Use a tabela abaixo como checklist de orçamento: você troca o “achismo” por uma planilha que dá para defender internamente.
| Componente | O que é | Custo (como costuma ser cobrado) | O que mais muda o preço |
|---|---|---|---|
| Número oficial + provedor (BSP) | Canal oficial para enviar/receber via API (WhatsApp Business Platform), geralmente via provedor | Mensalidade e/ou taxa de ativação; alguns cobram por volume/recursos | Provedor escolhido, recursos (multiusuário, templates, relatórios), suporte e SLA |
| Cobrança da Meta (conversa/mensagem/template) | Custo variável do WhatsApp conforme política vigente (janelas e categorias) | Variável por conversa/janela, categoria e/ou mensagens de template (depende das regras do período) | Volume, mix de templates vs conversa dentro da janela, e mudanças de política (atenção especial a out/2026) |
| Servidor/VPS 24/7 | Infra para webhooks, filas, banco e integrações (CRM/ERP) rodarem sem depender do seu PC | Mensal (fixo), aumenta com CPU/RAM e disponibilidade | Picos, número de integrações, necessidade de fila/observabilidade, redundância |
| IA (LLM) + ferramentas | Tokens do modelo para entender e responder; extras como transcrição de áudio, OCR, embeddings | Variável por uso (tokens) e por recurso (áudio/imagem/busca) | Tamanho do contexto, anexos, RAG bem/ mal-feito, taxa de escalonamento para humano |
| Camada de produto (opcional, mas comum) | Painel de atendimento, tags, roteamento, auditoria, LGPD, logs | Mensal (licenças/usuários) ou desenvolvimento | Número de atendentes, compliance, relatórios e integrações |
O que muda a matemática a partir de out/2026 (e como se proteger)
O ponto sensível é a cobrança do WhatsApp (Meta): ela não é “um preço eterno por mensagem” que você define uma vez e esquece. Políticas e modelos de precificação mudam — e mudanças anunciadas para períodos como out/2026 podem alterar o custo unitário e o incentivo entre template vs conversa dentro da janela.
Como se proteger na prática: (1) modele custo por conversa/janela como variável e atualize mensalmente; (2) registre métricas simples (conversas por dia, % fora da janela, % que exige template, tempo médio); (3) desenhe fluxo para reduzir reaberturas desnecessárias e mensagens longas; (4) mantenha fallback para humano quando a conversa “estoura” custo e risco.
O ponto de virada: montar você mesmo vs contratar pronto
A pergunta não é só “qual fica mais barato”, e sim “qual dá menos risco e menos retrabalho no seu cenário”. Em volume baixo, o custo fixo (VPS + provedor + ferramentas) pesa, e soluções prontas podem vencer pela previsibilidade e velocidade.
Em volume mais alto, o variável (cobrança do WhatsApp + tokens) domina. Aí, construir com mais controle pode compensar: você otimiza prompt, reduz contexto, usa RAG para não enviar textos enormes, faz cache de respostas, cria triagem e limita o que vai para o modelo mais caro.
Sinal prático de que está na hora de profissionalizar (mesmo com volume médio): você depende de integrações (CRM/ERP), precisa de auditoria/LGPD, ou já sofreu com instabilidade/bloqueio em solução improvisada.
- Se você precisa só de FAQ + triagem e tem pouco volume: comece com operação oficial mínima e foco em fluxo.
- Se você precisa integrar pedidos, pagamentos, suporte técnico e múltiplos atendentes: trate como sistema (fila, logs, escalonamento).
- Se seu bot manda muita mensagem “à toa”: revise o desenho antes de trocar de modelo — quase sempre o problema é fluxo, não IA.
Erro clássico que dá bloqueio: número “não oficial” e automação frágil
O erro que mais custa caro não é pagar tokens demais: é colocar atendimento de negócio em cima de um número que não é tratado como canal oficial, ou de uma automação que depende do WhatsApp Web. Funciona… até não funcionar.
Quando bloqueia, você perde mais do que mensagens: perde continuidade do atendimento, histórico útil para o time, confiança do cliente e tempo de recuperação. Se a operação é séria, comece pelo básico certo: número oficial, opt-in claro, templates bem aprovados (quando aplicável) e limites respeitados.
Perguntas frequentes
Dá para ter agente de IA no WhatsApp sem pagar API?
Por que preciso de VPS se posso rodar no meu PC?
O que exatamente o WhatsApp cobra: por mensagem ou por conversa?
Qual o mínimo para não tomar bloqueio?
Leia também
Como usar IA para atendimento no WhatsApp: passo a passo (2026)
Guia prático para colocar IA respondendo clientes no seu WhatsApp: escolher a ferramenta certa, montar a base de conhecimento, testar e evitar erros de LGPD.
Ler →
Como criar um agente de IA sem saber programar (passo a passo 2026)
Aprenda a criar seu primeiro agente de IA sem escrever uma linha de código: escolha da ferramenta, definição de papel, ferramentas e teste, num passo a passo prático pt-BR.
Ler →
Agente de IA
O que é agente de IA, como funciona e exemplos práticos para leigos. Diferença entre agente de IA e chatbot simples explicada de forma clara.
Ler →
Chatbot vs agente de IA: qual a diferença e quando usar cada um
Chatbot responde, agente de IA executa. Veja a diferença real entre os dois, uma tabela lado a lado, exemplos e quando cada um compensa no seu negócio.
Ler →