- Segmentação: divide a resposta em várias mensagens curtas, uma frase por mensagem, com “digitando…” e uma pausa entre elas. Parece mais com uma pessoa escrevendo.
- Voz (ElevenLabs): quando o lead manda áudio, o agente responde em áudio, com uma voz da ElevenLabs.
Segmentação
Onde fica no painel
Em Agente, abra Configurações avançadas e ligue Segmentação (“Dividir respostas longas”). Vale na hora, sem publicar. Projetos criados em branco nascem com ela ligada.Como a resposta é dividida
A divisão é feita a cada fim de frase: depois de um ponto final (.) ou de
uma exclamação (!) seguidos de espaço ou quebra de linha. Não depende do tamanho
da resposta: uma resposta de três frases vira três mensagens.
Exemplo:
O ritmo do envio
Para cada parte, em ordem:- mostra “digitando…” ao lead (só na conexão oficial e na coexistência);
- espera 25 milissegundos por caractere daquela parte (uma frase de 80 caracteres espera 2 segundos);
- envia a parte.
Quanto custa
Na conexão oficial e na coexistência, cada parte é uma mensagem cobrada pela Meta. Desde 01/10/2026 a Meta cobra também as mensagens de serviço, que são as respostas dentro da janela de 24h. Uma resposta dividida em 4 partes custa 4 mensagens. Na conexão não oficial, não há cobrança da Meta. Os tokens da IA não mudam: o agente escreve uma resposta só. Veja Quanto custa operar um projeto e a página de preços da Meta em “Para saber mais”.Quando usar
- Ligue quando o tom é de conversa e as respostas são curtas (2 a 4 frases). Escreva no prompt “responda em até 3 frases curtas”.
- Desligue quando o agente manda explicações longas, listas de passos ou orçamentos: muitas mensagens seguidas cansam o lead e multiplicam o custo na Meta.
Voz (ElevenLabs)
Quando o agente responde em áudio
Só quando as três condições valem:- o lote que o agente está respondendo tem pelo menos um áudio do lead;
- a voz está ligada;
- a chave de API e o ID da voz da ElevenLabs estão preenchidos.
eleven_multilingual_v2 da ElevenLabs, e é enviada como mensagem de áudio. Não
sai texto junto e a segmentação não se aplica.
Se o lead escreveu texto, a resposta é texto, mesmo com a voz ligada.
Se a geração do áudio falha (chave inválida, limite de uso da ElevenLabs, voz não
encontrada), a Zatten grava o erro no chat e envia a resposta em texto.
Onde configurar
O builder do LangChain Agent não tem tela para a voz. Configure pelo template do projeto, no blocollm_attendant (veja “Pelo MCP”). Projetos migrados do motor
antigo mantêm o que estava configurado lá.
Para obter os dados:
- Crie uma conta na ElevenLabs e gere uma chave de API.
- Escolha ou crie uma voz na biblioteca da ElevenLabs e copie o ID da voz (Voice ID).
- Grave os dois no projeto e ligue a voz.
Escrever para ser ouvido
O agente escreve a mesma resposta, sem saber se ela vai virar áudio. Links, listas, emojis e números longos soam mal quando lidos em voz alta. Quando a voz estiver ligada, acrescente ao prompt:[Áudio transcrito] é como o LangChain Agent marca o texto de um áudio
transcrito. Veja Mídia: áudio, imagem e PDF.
Pelo MCP
As duas ficam no blocollm_attendant e gravam na hora (não criam versão do
agente).
Armadilhas
- Segmentação divide toda resposta, não só as longas. Cada frase terminada em ponto vira uma mensagem.
- Cada parte é cobrada pela Meta na conexão oficial e na coexistência. Respostas longas com segmentação multiplicam o custo.
- Pergunta não separa. “Tudo bem? Posso ajudar.” sai numa mensagem só; “Tudo bem. Posso ajudar?” sai em duas.
- Segmentação soma com o buffer na demora percebida. O lead espera o buffer e depois as pausas entre as partes.
- O chat de teste não mostra a segmentação nem a voz. Elas são aplicadas na entrega pelo WhatsApp. Teste num número real.
- Voz ligada sem chave ou sem ID da voz não faz nada, e não há aviso.
- Áudio com link é lido em voz alta e o lead não consegue clicar. Oriente o prompt.
- Lote misto: se o lead mandou texto e áudio no mesmo lote, a resposta sai em áudio.
Perguntas frequentes
Posso controlar onde a resposta é dividida?
Posso controlar onde a resposta é dividida?
Indiretamente, pelo prompt. Cada frase terminada em ponto ou exclamação vira uma
mensagem. Para juntar duas ideias numa mensagem, peça frases ligadas por vírgula.
A voz funciona com a conexão não oficial?
A voz funciona com a conexão não oficial?
Sim. O áudio é gerado pela Zatten e enviado pela conexão do projeto, qualquer que
seja.
O agente pode mandar áudio quando o lead escreve texto?
O agente pode mandar áudio quando o lead escreve texto?
Não. A voz só age quando o lote tem áudio do lead.
Para saber mais
- Como o agente funciona
- Buffer de mensagens
- Quanto custa operar um projeto
- Janela de 24h
- Meta, preços do WhatsApp: https://developers.facebook.com/documentation/business-messaging/whatsapp/pricing
- Meta, mensagens de serviço (cobradas desde 01/10/2026): https://developers.facebook.com/documentation/business-messaging/whatsapp/pricing/non-template-messages
- ElevenLabs, texto para fala: https://elevenlabs.io/docs/capabilities/text-to-speech
- ElevenLabs, chave de API: https://elevenlabs.io/docs/api-reference/authentication
- ElevenLabs, preços: https://elevenlabs.io/pricing