Glossário de IA no atendimento: 30 termos que aparecem em toda proposta
Se a proposta que você recebeu tem cinco siglas por parágrafo, este texto traduz.
- LLM é o motor; prompt é a instrução; RAG é como ele consulta os seus dados.
- Janela de 24h e template são regras do WhatsApp, não do fornecedor.
- Alucinação é resposta inventada com aparência de certeza — o risco central do setor.
- Handoff é a passagem para humano: a peça que mais define a experiência.
Proposta de agente de IA costuma vir cheia de sigla. Este glossário traduz os termos que realmente aparecem — na ordem em que você vai encontrá-los.
Fundamentos
IA generativa — sistemas que produzem texto, imagem ou áudio novos, em vez de escolher entre respostas prontas.
LLM (modelo de linguagem de grande escala) — o motor que interpreta e escreve texto. É o que está por trás de ChatGPT, Claude e similares.
Agente de IA — sistema que usa um LLM, mantém contexto, consulta dados e executa ações. Diferente de chatbot de fluxo.
Chatbot tradicional — fluxo pré-programado com menu e respostas fixas. Trava fora do roteiro.
Prompt — a instrução dada ao modelo.
Prompt de sistema — a instrução base, permanente: identidade, escopo, limites, tom. Detalhes em prompt de sistema.
Token — unidade de medida de texto para o modelo, aproximadamente pedaços de palavra. Cobrança de uso costuma ser por token.
Janela de contexto — quanto texto cabe em uma chamada ao modelo. Estourar significa perder o começo da conversa.
Temperatura — parâmetro de variabilidade da resposta. Baixa para atendimento (previsível), alta para criação.
Alucinação — resposta inventada com aparência de certeza. O risco central em atendimento.
Dados e conhecimento
Base de conhecimento — onde vive a informação da empresa: preço, política, prazo, catálogo.
RAG — a técnica de buscar trechos da base e enviá-los ao modelo antes de ele responder. É o que ancora a resposta nos seus dados. Explicado em o que é RAG.
Embedding — representação numérica de um texto que permite buscar por significado, não só por palavra exata.
Vetor / banco vetorial — onde os embeddings ficam armazenados para busca.
Chunk — pedaço em que um documento é dividido para ser recuperado. Chunk mal cortado é causa comum de resposta truncada.
Fine-tuning — ajustar o próprio modelo com dados. Raramente necessário em atendimento: RAG resolve melhor e mais barato.
API oficial (Cloud API) — a via autorizada pela Meta para empresas. Comparação em API oficial x não oficial.
Janela de 24 horas — período em que você responde livremente após mensagem do cliente. Detalhes em a janela de 24 horas.
Template (HSM) — mensagem com texto pré-aprovado, necessária para iniciar conversa fora da janela.
Categoria de template — utilidade, marketing ou autenticação. Afeta custo e aprovação.
Opt-in — permissão da pessoa para receber mensagens. Ver opt-in no WhatsApp.
Qualidade do número — classificação baseada em bloqueios e denúncias. Baixa reduz o limite de envio.
BSP — provedor autorizado que intermedia o acesso à API.
Operação
Handoff — passagem da conversa para um humano. A peça que mais define a experiência. Ver handoff.
Escalonamento — subir a conversa para um nível com mais alçada.
Fila — conversas aguardando atendimento humano.
Multiatendimento — vários atendentes no mesmo número, com histórico compartilhado.
Omnichannel — canais diferentes com histórico unificado.
Taxa de resolução — percentual resolvido sem humano. Só vale medida por desfecho.
Régua de follow-up — sequência programada de contatos.
Integração
API — porta que um sistema abre para outro consultar ou agir.
Webhook — o sistema avisando quando algo acontece. Ver API, webhook e integração.
Endpoint — endereço específico dentro de uma API.
Ambiente de homologação — cópia de teste, separada da produção. Exigir sempre.
Conformidade
LGPD — Lei Geral de Proteção de Dados. Ver IA e LGPD no atendimento.
Dado sensível — saúde, biometria, origem racial, convicção religiosa, entre outros. Regime mais rígido.
Base legal — a hipótese que autoriza tratar o dado. Consentimento é uma delas, não a única.
Retenção — por quanto tempo o dado é guardado. Precisa ter prazo.
Operador — quem trata dados em nome de outra empresa. Normalmente o fornecedor do agente.
Recebeu uma proposta e não entendeu?
A Fluxo Inteligente explica o escopo em português — e diz o que é essencial e o que é enfeite.
Perguntas frequentes
Qual a diferença entre chatbot e agente de IA?
O que é alucinação e por que ela importa tanto?
O que é token e por que aparece no preço?
Qual a diferença entre API e webhook?
O que significa HSM ou template no WhatsApp?
Quer um agente de IA atendendo no seu WhatsApp?
Conte o seu cenário e a gente mostra, com número, o que dá pra automatizar no seu atendimento.
Falar no WhatsApp: (19) 99615-5951Anny Peixoto
Lidera design e social selling na Fluxo Inteligente. Trabalha na ponta em que a IA encontra o cliente: tom de voz, roteiro de conversa e a experiência que faz um atendimento automatizado parecer atendimento de gente boa. Escreve sobre aplicação de IA por nicho.

