Glossário
Latência de resposta
Tempo entre a pergunta do visitante e o início da resposta do agente. Abaixo de um segundo a conversa flui; acima de três, a taxa de abandono sobe rápido, porque a pessoa percebe a espera.
Latência se mede do fim da pergunta do visitante até o primeiro token da resposta: não até o fim dela, porque uma resposta transmitida em streaming começa a ser lida antes de terminar.
Os limiares são comportamentais, não técnicos: abaixo de um segundo passa por instantâneo, perto de dois por reflexão, acima de três ou quatro a pessoa troca de aba. Em voz, a janela tolerável é mais ou menos metade disso.
A maior parte do orçamento vai para busca e geração, o que torna isso principalmente uma decisão de projeto: quantas fontes consultar, quantas verificações rodar, se transmite em streaming. Perseguir os últimos 200ms normalmente custa mais do que retorna; fechar a distância entre quatro segundos e um é o que de fato move conversão.
Comece a conversa hoje
Lance um agente de IA que qualifica leads e agenda reuniões a qualquer hora. No ar em menos de dez minutos.
Demonstração guiada · seu agente no ar em menos de 10 minutos


