Responder mais rápido no WhatsApp: respostas rápidas e IA

, Editorial Team

Responder mais depressa não é escrever mais depressa. Como as respostas rápidas por atalho, as sugestões de resposta com IA via /ai e o resumo automático de tickets reduzem o tempo de primeira resposta, o que a janela de 24 horas tem a ver com isso e a partir de que plano existe a IA.

TL;DR

Responder mais depressa no WhatsApp não é uma questão de escrever mais depressa. Três ferramentas fazem o trabalho: respostas rápidas por atalho para as frases que se repetem sempre, uma sugestão de resposta com IA que aparece com um simples /ai, e um resumo automático assim que o caso é encerrado. Não é enviado nada sem um clique.

As três estão no mesmo campo de texto onde a sua equipa já escreve, e funcionam tanto no WhatsApp como no correio eletrónico, live chat e Telegram. A caixa de entrada partilhada está incluída a partir do plano Basic, as funcionalidades de IA a partir do Professional. E uma data para marcar no calendário: a partir de 1 de outubro de 2026, também a sua resposta dentro da janela de 24 horas passa a custar dinheiro.

Porque é que uma resposta rápida no WhatsApp pesa mais do que no email

Uma mensagem de WhatsApp chega a um sítio diferente de um email. Fica na mesma lista da mensagem da irmã ou do combinado do grupo de amigos, e nessa lista vigora outra noção de tempo. Quem escreve ali vê pelos vistos duplos que a mensagem chegou e foi lida. A espera torna-se visível, e em minutos, não em dias úteis.

Depois há uma razão que nada tem a ver com sensação e tudo a ver com as regras da Meta: depois da mensagem de um cliente, tem 24 horas em que pode responder livremente. Passado esse prazo, essa janela fecha-se, e a pergunta rápida transforma-se num processo com modelo aprovado. A rapidez no WhatsApp não é, por isso, apenas uma questão de serviço, é o caminho mais simples.

O indicador por trás disto chama-se tempo de primeira resposta: o tempo entre a pergunta do cliente e a primeira reação da sua equipa. Pode medir-se, por canal e por período, e é exatamente por isso que também pode melhorar-se. O que este artigo mostra são os três gestos que mais contribuem para isso, sem que ninguém precise de escrever mais depressa.

Quanto tempo pode responder livremente no WhatsApp?

24 horas, contadas a partir da última mensagem do cliente. Dentro deste prazo escreve-se livremente: texto, imagens, mensagens de voz, documentos, como em qualquer conversa. Cada nova mensagem do cliente reinicia o prazo. Esta janela de 24 horas é a regra mais importante nas trocas comerciais no WhatsApp, e a maioria dos mal-entendidos surge porque as equipas não a conhecem.

Fechada a janela, só resta um modelo de mensagem, ou seja, um texto que a Meta reviu e aprovou antecipadamente. Funciona de forma fiável, mas demora mais, é menos pessoal e custa dinheiro: em Portugal, um modelo Utility, por exemplo uma confirmação de marcação, fica em 0,0142 € por mensagem.

O que hoje não custa nada, e o que muda a partir de 1 de outubro de 2026. As mensagens recebidas são gratuitas de forma permanente, isso não muda. A resposta livre dentro da janela aberta também é gratuita até 30 de setembro de 2026. A partir de 1 de outubro de 2026, a Meta passa a cobrar essas respostas, bem como as mensagens Utility dentro da janela, à tarifa Utility do respetivo mercado. Os valores exatos serão comunicados pela Meta até 1 de setembro de 2026, por isso não indicamos aqui um número. Todos os preços atuais estão na tabela de preços da Meta.

Na prática, isto significa duas coisas. Primeiro: quem responde dentro da janela sai sempre mais barato do que quem a deixa fechar e depois tem de enviar um modelo. Segundo: a partir de outubro, cada mensagem desnecessária é uma linha na fatura. Uma resposta que responde por completo à pergunta logo à primeira já não é apenas melhor serviço, é também mais barata do que três mensagens seguidas.

Respostas rápidas: escrever uma vez as frases que se repetem sempre

Uma grande parte das perguntas recebidas repete-se. Horário de funcionamento, custos de envio, onde estacionar, onde está a fatura. As respostas rápidas, também chamadas respostas guardadas, são blocos de texto prontos exatamente para estes casos. Escreve-se a frase uma vez com cuidado, dá-se-lhe um atalho, e a partir daí fica disponível no campo de texto com um simples toque de tecla.

Há dois caminhos até lá. Quem tem o atalho de cabeça escreve-o diretamente, por exemplo /greeting, e a resposta aparece no campo de texto. Quem não o tem de cabeça escreve apenas a barra / e recebe a lista de respostas prontas para consultar. Os novos colegas não precisam assim de decorar atalhos, só precisam de uma tecla.

Não confundir com um modelo de mensagem do WhatsApp. A resposta rápida é um bloco de texto interno da equipa: não precisa de aprovação, pode ser alterada de imediato, mas só pode ser usada dentro da janela de 24 horas, porque conta como uma mensagem livre. O modelo de mensagem é o oposto: revisto pela Meta, mas por isso também pode ser entregue fora da janela. Ambos têm o seu lugar, e confundir os dois custa tempo.

No campo de texto há ainda mais três comandos, todos a começar com a mesma barra. Um resumo:

Os comandos rápidos no campo de texto: o que fazem e o aspeto que têm.
ComandoO que aconteceExemplo
/Mostra as respostas prontas para consultarEscrever a barra e depois filtrar
/atalhoInsere diretamente uma resposta pronta através do atalho/greeting
/aiGera uma sugestão de resposta com IA/ai e Enter
/suggestAlias de /ai, com o mesmo efeito/suggest e Enter
/kbPesquisa na base de conhecimento/kb repor palavra-passe
/noteRegista uma nota interna na conversa/note Cliente prefere email
@Transfere a conversa a meio para um colega@ e escolher o nome

Cinco respostas rápidas chegam para começar, e são quase sempre as mesmas cinco: saudação, horário de funcionamento, informação de preços, proposta de marcação e o pedido do número de encomenda. Quem precisar de mais, percebe isso sozinho ao fim de uma semana.

O campo de mensagem na caixa de entrada partilhada do SendSeven: uma barra escrita abre a lista de respostas prontas, e por baixo estão os comandos para sugestão de IA, base de conhecimento e nota interna

Um sinal abre a lista. Representação: SendSeven.

Sugestões de resposta com IA: um rascunho com um toque de tecla

As respostas rápidas ajudam enquanto a pergunta volta com as mesmas palavras. Assim que um cliente formula a mesma coisa de outra forma, ou pergunta duas coisas ao mesmo tempo, já nenhum bloco serve. É exatamente aí que entra a sugestão de resposta com IA: escreve-se /ai e prime-se Enter, e a plataforma constrói um rascunho a partir das mensagens atuais da conversa e da base de conhecimento.

A sugestão aparece diretamente na conversa, com referências às fontes e uma pontuação de confiança que mostra o quão segura a IA está: verde a partir de 70 por cento, amarelo entre 40 e 69 por cento, vermelho abaixo de 40 por cento. A cor é uma instrução de trabalho. Verde significa ler e enviar, amarelo significa verificar antes, vermelho significa escrever a resposta de raiz, porque aparentemente não há nada adequado na base de conhecimento.

Depois há três opções: Aceitar coloca o texto no campo de resposta, Editar permite alterá-lo antes de enviar, Rejeitar fecha a sugestão e a resposta é escrita de raiz. Importante para quem fica apreensivo nesta parte: nada é enviado automaticamente. A sugestão é um rascunho, o clique final fica sempre com a pessoa.

Se não for preciso um rascunho completo, mas apenas uma informação, ajuda o /kb. Um /kb repor palavra-passe pesquisa a base de conhecimento e devolve respostas diretas a partir da própria documentação, com referências aos artigos correspondentes e uma indicação de quão bem o resultado corresponde. Um clique em «Inserir» transfere a informação para a mensagem.

Até que ponto isto ajuda já foi estudado. Um estudo de Brynjolfsson, Li e Raymond para o National Bureau of Economic Research acompanhou mais de 5.000 colaboradores de suporte que passaram a ter um assistente de IA com sugestões de resposta. Resolveram, em média, mais 14 por cento de pedidos por hora, e o efeito foi maior junto dos colaboradores novos e menos experientes, quase desaparecendo entre os mais experientes (fonte: NBER Working Paper 31161, 2023). É aqui que uma ferramenta destas se torna interessante para pequenos negócios: eleva o colaborador temporário de sábado a um nível que normalmente exige anos de experiência.

O que acontece aos dados. As funcionalidades de IA funcionam por adesão voluntária. Vêm desativadas por predefinição e são ativadas, ou voltadas a desativar, de forma consciente nas definições da conta. O processamento ocorre sobretudo na UE; com a IA ativa, o pedido passa pelo Google Vertex AI com localização de dados na UE ou nos EUA, protegido por cláusulas contratuais-tipo da UE. O fornecedor de IA garante contratualmente que as conversas, mensagens e documentos não são usados para treinar modelos. Cada cliente tem os seus próprios recursos de IA, separados dos restantes, e dados de faturação ou palavras-passe nunca são transmitidos à IA. Os detalhes estão na política de privacidade.

A qualidade das sugestões depende de uma única coisa: o que está na base de conhecimento. Um negócio que respondeu bem às suas vinte perguntas mais frequentes obtém bons rascunhos. Quem se limita a carregar um PDF recebe avaliações amarelas e vermelhas. Quem trabalha com vários temas pode separar os conteúdos em sub-bases de conhecimento, para que a sugestão de vendas não cite a documentação de reclamações. Como se organiza uma base de conhecimento está descrito no guia da base de conhecimento, e o funcionamento no dia a dia está no caso de uso sobre sugestões de resposta com IA.

Resumo do caso: a transferência sem ter de reler tudo

O segundo grande devorador de tempo não está em escrever, está em ler. Uma conversa prolonga-se por três dias, muda de responsável a meio, e quem a assume começa por percorrer quarenta mensagens para perceber do que se trata. É exatamente para isto que existe o resumo automático.

Ativa-se uma vez em Definições → Definições de IA, com a opção «Resumir automaticamente os tickets fechados». A partir daí, a plataforma gera sozinha um resumo nos detalhes do ticket sempre que este é fechado, e esse resumo contém quatro elementos: o problema inicial do cliente, os pontos-chave da discussão, a solução ou o resultado e as ações pendentes ou tarefas de acompanhamento.

A utilidade nota-se no contacto seguinte. Se o mesmo cliente escrever de novo daqui a duas semanas, o colega lê três parágrafos em vez de quarenta mensagens. O mesmo vale na transferência dentro de um caso em curso, por exemplo quando o colega da parte técnica entra depois: começa já com contexto, não com uma pergunta. Como isto funciona na prática está no caso de uso sobre resumos automáticos.

Há ainda um segundo efeito, que só se nota ao fim de várias semanas. Um ticket resolvido pode ser marcado como material de treino. A IA retira daí pares de pergunta e resposta e guarda-os na base de conhecimento. Quanto mais casos reais ali estiverem, melhores ficam as sugestões em casos semelhantes. O trabalho de hoje facilita o trabalho do próximo trimestre, sem que ninguém tenha de escrever documentação.

Três passos no SendSeven: uma sugestão de resposta com IA com pontuação de confiança verde e as opções Aceitar, Editar e Rejeitar, depois a transferência para um colega e, no final, o resumo automático do ticket fechado

Sugestão, transferência, resumo: o mesmo caso em três passos. Representação: SendSeven.

Resposta rápida, sugestão de IA ou bot?

As três ferramentas resolvem problemas diferentes, e o erro mais comum é começar pela mais trabalhosa. A regra prática é curta: se a pergunta volta com as mesmas palavras, usa-se uma resposta rápida. Se a mesma questão surge com formulações diferentes, usa-se a sugestão de IA. Se for preciso que algo aconteça às 23 horas sem que haja ninguém disponível, é preciso um bot.

Que ferramenta usar quando: resposta rápida, sugestão de resposta com IA e bot em comparação.
 Resposta rápidaSugestão de IABot
Adequa-se apergunta sempre igual, resposta sempre igualmesma questão com formulação diferentepedidos fora do horário de funcionamento
Quem enviacolaborador, com um toque de teclacolaborador, depois de rever o rascunhoa plataforma, sem colaborador
Esforço inicialcinco minutos por blocopreencher a base de conhecimentodefinir o fluxo e a regra de transferência
Melhora comafinação manualmais conteúdo e mais tickets resolvidosanálise das desistências
A partir de que planoBasicProfessionalProfessional
Limitesó ajuda em repetição exataprecisa de conteúdo bem tratadofunciona nos canais de chat, não em SMS e Browser Push

Na ordem está a recomendação: primeiro as respostas rápidas, porque funcionam de imediato e não custam mais do que cinco minutos de reflexão. Depois a base de conhecimento, porque sustenta a sugestão de IA. E só depois um bot, porque exige decidir o que responde sozinho e quando transfere para uma pessoa. O que é um bot e onde está o seu limite está explicado em O que é um chatbot de IA?; os vários níveis da automatização do apoio ao cliente completam o quadro.

Quem responde: atribuição, caixas de entrada e transferência

Uma ferramenta não acelera nada se não for claro quem é responsável. Num telemóvel de loja, ou olha toda a gente para a conversa, ou não olha ninguém, e as duas situações saem caras. Na caixa de entrada partilhada, cada conversa fica associada a uma pessoa: é atribuída, e a questão da responsabilidade fica resolvida.

A meio da conversa, transfere-se com @ para um colega, sem que o cliente note nada ou tenha de repetir a pergunta. Junto com o resumo do ponto anterior, isto transforma-se numa passagem de testemunho limpa, em vez de uma explicação repetida no corredor.

Quando a equipa cresce, entram caixas de entrada próprias: as vendas veem as vendas, a oficina vê a oficina, e ninguém se perde em processos alheios. Estas caixas de entrada próprias estão disponíveis a partir do plano Professional, sem custo adicional. Já os membros de equipa ilimitados e os oito canais estão incluídos em todos os planos, mesmo no mais pequeno. O funcionamento completo para equipas com vários utilizadores fica para um artigo à parte; a configuração da caixa de entrada partilhada está descrita no guia da caixa de entrada partilhada.

O que automatizar, em vez de escrever mais depressa

Há respostas que não deveriam ser dadas por uma pessoa. A primeira é a reação a uma mensagem às 22 horas. Uma mensagem de boas-vindas, que diz que a mensagem chegou e quando alguém vai responder, não custa paciência ao cliente nem um minuto à equipa. Uma mensagem de ausência fora do horário de funcionamento tem o mesmo efeito. Ambas fazem parte das automatizações disponíveis a partir do plano Professional.

A segunda categoria são as informações que se repetem sempre e para as quais já ninguém precisa de estar sentado à conversa: horário de funcionamento, morada, lista de preços, estado do pedido. Um bot responde a isto a qualquer hora do dia e transfere assim que o caso se torna individual. O que um bot consegue fazer e onde deve entrar a transferência está na página sobre bots de IA.

E depois, medir. Sem um número, «agora respondemos mais depressa» fica apenas uma sensação. A análise mostra o tempo médio de primeira resposta e o tempo de resolução em todos os canais, além do tempo de resposta por canal, para ficar visível onde realmente há atrasos. Para a IA existe uma vista própria: quantas sugestões por colaborador foram aceites, editadas ou rejeitadas, e como o tempo de resposta muda com e sem IA. Muitas sugestões rejeitadas sobre o mesmo tema não são um problema da IA, são uma lacuna na base de conhecimento.

A partir de que plano há IA, e quanto custa uma resposta?

A caixa de entrada partilhada, com respostas rápidas, atribuição e transferência incluídas, está disponível a partir do plano de entrada Basic: 49 € por mês, com 2.500 mensagens enviadas incluídas, e depois em média 0,02 € por mensagem. As mensagens recebidas não contam para este volume.

As funcionalidades de IA, ou seja, sugestões de resposta, pesquisa /kb e o resumo automático, estão incluídas a partir do plano Professional: 79 € por mês, também com 2.500 mensagens incluídas e 0,02 € depois disso. Não existe um extra de IA separado para adicionar. Um pedido de IA é cobrado ao mesmo preço unitário de uma mensagem e conta para o mesmo volume incluído.

As tarifas de mensagens da Meta correm à parte. No SendSeven, a Meta cobra as suas tarifas diretamente e ao preço de tabela. Para a plataforma vigora um preço fixo por mensagem, nunca uma percentagem sobre a lista de preços da Meta. Quem quiser ver a conta completa encontra-a em Criar uma conta WhatsApp Business: requisitos e custos, e todos os planos estão na página de preços.

Configurado em 30 minutos

A ordem é mais importante do que a totalidade. Quem fizer os três primeiros passos e parar por aí já ganhou algo. Os passos um a quatro funcionam a partir do plano Basic, os passos cinco a sete precisam do Professional, porque é aí que estão a base de conhecimento e a IA.

  1. Escrever as cinco perguntas mais frequentes. Sem adivinhar: consultar o histórico de conversas das últimas duas semanas. Dez minutos.
  2. Criar cinco respostas rápidas e dar-lhes atalhos curtos e claros, que até um colega novo consiga adivinhar. A configuração passo a passo está no guia de respostas rápidas.
  3. Ativar uma mensagem de boas-vindas que diga quando alguém vai responder. Uma frase basta, e pode ser honesta.
  4. Definir a responsabilidade: quem trata do WhatsApp de manhã, quem trata à tarde? As conversas recebidas devem ser atribuídas, não observadas em conjunto.
  5. Preencher a base de conhecimento com as vinte perguntas mais frequentes. É este o passo que torna as sugestões de IA boas ou apenas medianas, e o único que demora um pouco mais.
  6. Ativar as funcionalidades de IA nas definições e trabalhar um dia inteiro só com /ai, para ganhar sensibilidade à pontuação de confiança.
  7. Ativar o resumo automático em Definições → Definições de IA e, ao fim de duas semanas, verificar na análise se o tempo de primeira resposta desceu.

Perguntas frequentes

Qual é a diferença entre uma resposta rápida e um modelo de mensagem do WhatsApp?

Uma resposta rápida é um bloco de texto interno da equipa. Não precisa de aprovação, pode ser alterada a qualquer momento e conta como uma mensagem livre, por isso só funciona dentro da janela de 24 horas. Um modelo de mensagem tem de ser aprovado antecipadamente pela Meta, mas por isso também pode ser entregue depois de a janela fechar. Em resumo: resposta rápida para rapidez na conversa, modelo de mensagem para o contacto a seguir.

A IA envia respostas aos clientes por conta própria?

Não. Uma sugestão aparece na conversa e só passa para o campo de resposta depois de ser aceite; o envio é sempre feito com um clique do colaborador. Pode ser editada antes ou simplesmente rejeitada. Quem quiser que algo aconteça sem um colaborador não precisa de uma sugestão de resposta, precisa de um bot, configurado propositadamente para isso.

Onde são processados os pedidos de IA, e alguém treina modelos com as nossas conversas?

O processamento ocorre sobretudo na UE; com a IA ativa, o pedido passa pelo Google Vertex AI com localização de dados na UE ou nos EUA, protegido por cláusulas contratuais-tipo da UE. O fornecedor de IA garante contratualmente que as conversas, mensagens e documentos não são usados para treinar modelos. As funcionalidades de IA vêm desativadas por predefinição e são ativadas de forma consciente nas definições da conta. Cada conta tem os seus próprios recursos de IA, separados dos restantes. Dados de faturação e palavras-passe nunca são transmitidos à IA.

A partir de que plano existem as funcionalidades de IA?

A partir do Professional, ou seja, a partir de 79 € por mês. As sugestões de resposta, a pesquisa /kb e o resumo automático de tickets estão incluídos, sem extra adicional. A caixa de entrada partilhada com respostas rápidas, atribuição e transferência já está disponível a partir do Basic, desde 49 € por mês. Membros de equipa ilimitados e os oito canais estão incluídos em todos os planos.

O que acontece quando as 24 horas terminam?

Nesse momento o WhatsApp deixa de permitir mensagens livres, e só é possível voltar a contactar o cliente através de um modelo de mensagem aprovado pela Meta. Este chega de forma fiável, mas custa dinheiro: em Portugal, por exemplo, 0,0142 € por um modelo Utility. Se o cliente responder, a janela volta a abrir-se por mais 24 horas.

A partir de 1 de outubro de 2026, muda alguma coisa nos custos das respostas?

Sim. Até 30 de setembro de 2026, a resposta livre dentro da janela de 24 horas aberta é gratuita. A partir de 1 de outubro de 2026, a Meta passa a cobrar essas respostas, bem como as mensagens Utility dentro da janela, à tarifa Utility do respetivo mercado. Os valores exatos serão comunicados pela Meta até 1 de setembro de 2026. As mensagens recebidas continuam gratuitas de forma permanente.

Conclusão

Responder depressa no WhatsApp não é uma questão de velocidade a escrever, é uma questão de três configurações. As respostas rápidas tratam da repetição, a sugestão de IA trata do trabalho de formulação, o resumo trata da releitura. As três estão no mesmo campo de texto, e as três deixam a decisão final com a pessoa.

Quem começar hoje, começa com cinco respostas rápidas e uma mensagem de boas-vindas, preenche depois a base de conhecimento e só então ativa a IA. O plano mais adequado está na página de preços. E 1 de outubro de 2026 merece um lugar no calendário, porque a partir dessa data cada mensagem conta, incluindo a própria.