Atraso na resposta: por que o bot espera antes de responder
As pessoas raramente escrevem uma pergunta em uma única mensagem. Mandam uma frase, depois um complemento, depois o ponto de interrogação. Se o bot respondesse cada mensagem na hora, o cliente receberia três respostas para uma só ideia. O Atraso na resposta é a janela de espera que transforma essas mensagens em uma única pergunta. Este guia explica como a janela funciona, de onde vêm as respostas duplicadas e qual valor escolher.
O que essa configuração faz
O Atraso na resposta fica nas configurações do bot, na seção de comportamento. Ele define a pausa entre a mensagem do cliente e a resposta do bot: de 0 segundos a 15 minutos; o padrão é 10 segundos. Durante a pausa acontecem duas coisas.
- As mensagens são unidas. Tudo o que o cliente envia enquanto a janela está aberta é reunido em uma única solicitação. O bot lê a ideia inteira, não só o primeiro pedaço
- O bot parece menos bot. Uma resposta instantânea entrega a automação; uma pausa de alguns segundos parece uma pessoa lendo a mensagem
Como funciona a janela de espera
A primeira mensagem do cliente inicia um temporizador igual ao atraso. Cada mensagem seguinte que chega antes de o tempo acabar é somada à mesma solicitação, e o bot continua esperando. Quando o tempo termina, o bot gera uma única resposta para tudo o que reuniu. Uma mensagem que chega depois de a janela fechar inicia um novo temporizador e uma nova resposta.
| Hora | Cliente | Bot (atraso de 15 segundos) |
|---|---|---|
| 00:01 | "oi, vocês entregam" | Temporizador iniciado |
| 00:10 | "na zona norte" | Somado à mesma solicitação, continua esperando |
| 00:16 | "?" | A janela fechou às 00:16. A primeira resposta já está sendo preparada; o "?" abre uma nova janela e recebe uma segunda resposta |
Por que o bot às vezes responde duas vezes
É a situação da tabela: o cliente manda o último pedaço um segundo depois de a janela fechar. O bot já começou a responder a primeira parte e trata o resto como uma pergunta nova. O resultado são duas respostas seguidas, muitas vezes quase iguais. Não é um erro do roteiro: a janela simplesmente foi mais curta do que a digitação do cliente.
Respostas duplicadas são mais prováveis no Telegram e no WhatsApp, onde as pessoas escrevem em rajadas curtas, e menos prováveis no widget do site, onde a mensagem costuma ser escrita de uma vez.
Como escolher o atraso
| Valor | Quando faz sentido | Contrapartida |
|---|---|---|
| 0 a 5 segundos | Widget do site, bots de perguntas frequentes, clientes que esperam resposta imediata | Respostas duplicadas ocasionais quando alguém escreve em pedaços |
| 10 a 15 segundos | O padrão. Serve para a maioria das conversas no Telegram e no WhatsApp | Uma pausa curta que ainda parece natural |
| 30 a 60 segundos | Conversas pessoais em que o bot responde em seu nome, clientes que digitam devagar ou mandam áudios | O cliente espera mais, mas cada ideia é reunida em uma única solicitação |
| 2 a 15 minutos | Conversas frias ou de baixa prioridade em que um ritmo humano importa mais do que velocidade | O cliente pode achar que não há ninguém; combine com uma saudação no roteiro |
A escolha se resume ao que importa mais para você: a reação imediata do bot ou uma conversa limpa, sem repetições. Se velocidade é essencial e seus clientes raramente escrevem "em seguida", alguns duplicados são um custo aceitável. Se você vê duas respostas seguidas com frequência, aumente o atraso para 30 a 60 segundos: o bot fica em silêncio um pouco mais, mas reúne em uma só ideia até as mensagens digitadas devagar.
Configurações relacionadas
- Se você não responder… no horário do bot é outro temporizador: decide se o bot entra em ação quando sua equipe fica em silêncio por 1 a 30 minutos. O Atraso na resposta é aplicado depois dessa decisão
- Número máximo de respostas limita quantas respostas o bot dá em uma conversa. Respostas duplicadas contam para esse limite
- Reativação de conversas congeladas envia acompanhamentos após horas ou dias de silêncio e não tem relação com o atraso
O atraso gasta tokens?
Não. Os tokens são gastos na resposta gerada. Unir várias mensagens em uma solicitação costuma economizar tokens, porque o bot responde uma vez em vez de várias.
O atraso pode ser diferente por canal?
O atraso pertence ao bot. Para ter um bot rápido no site e um mais lento no Telegram, duplique o bot, mude o atraso e atribua cada cópia à sua conta.
O atraso vale quando um operador responde?
Não. O atraso afeta apenas as respostas do próprio bot. Depois de uma resposta manual, o bot fica em silêncio nessa conversa até você devolvê-la ao bot.
Veja também
Experimente o BotB2B grátis
O cadastro leva um minuto e os tokens iniciais são por nossa conta. Configure tudo com este guia.