Todos Fundamentos Nichos Cases Decisão
FundamentosReferência

Glossário de IA no atendimento: 30 termos que aparecem em toda proposta

Se a proposta que você recebeu tem cinco siglas por parágrafo, este texto traduz.

Por Anny Peixoto, Designer e Social SellingPublicado em 9 min de leitura
Em resumo
  • LLM é o motor; prompt é a instrução; RAG é como ele consulta os seus dados.
  • Janela de 24h e template são regras do WhatsApp, não do fornecedor.
  • Alucinação é resposta inventada com aparência de certeza — o risco central do setor.
  • Handoff é a passagem para humano: a peça que mais define a experiência.

Proposta de agente de IA costuma vir cheia de sigla. Este glossário traduz os termos que realmente aparecem — na ordem em que você vai encontrá-los.

Fundamentos

IA generativa — sistemas que produzem texto, imagem ou áudio novos, em vez de escolher entre respostas prontas.

LLM (modelo de linguagem de grande escala) — o motor que interpreta e escreve texto. É o que está por trás de ChatGPT, Claude e similares.

Agente de IA — sistema que usa um LLM, mantém contexto, consulta dados e executa ações. Diferente de chatbot de fluxo.

Chatbot tradicional — fluxo pré-programado com menu e respostas fixas. Trava fora do roteiro.

Prompt — a instrução dada ao modelo.

Prompt de sistema — a instrução base, permanente: identidade, escopo, limites, tom. Detalhes em prompt de sistema.

Token — unidade de medida de texto para o modelo, aproximadamente pedaços de palavra. Cobrança de uso costuma ser por token.

Janela de contexto — quanto texto cabe em uma chamada ao modelo. Estourar significa perder o começo da conversa.

Temperatura — parâmetro de variabilidade da resposta. Baixa para atendimento (previsível), alta para criação.

Alucinação — resposta inventada com aparência de certeza. O risco central em atendimento.

Dados e conhecimento

Base de conhecimento — onde vive a informação da empresa: preço, política, prazo, catálogo.

RAG — a técnica de buscar trechos da base e enviá-los ao modelo antes de ele responder. É o que ancora a resposta nos seus dados. Explicado em o que é RAG.

Embedding — representação numérica de um texto que permite buscar por significado, não só por palavra exata.

Vetor / banco vetorial — onde os embeddings ficam armazenados para busca.

Chunk — pedaço em que um documento é dividido para ser recuperado. Chunk mal cortado é causa comum de resposta truncada.

Fine-tuning — ajustar o próprio modelo com dados. Raramente necessário em atendimento: RAG resolve melhor e mais barato.

WhatsApp

API oficial (Cloud API) — a via autorizada pela Meta para empresas. Comparação em API oficial x não oficial.

Janela de 24 horas — período em que você responde livremente após mensagem do cliente. Detalhes em a janela de 24 horas.

Template (HSM) — mensagem com texto pré-aprovado, necessária para iniciar conversa fora da janela.

Categoria de template — utilidade, marketing ou autenticação. Afeta custo e aprovação.

Opt-in — permissão da pessoa para receber mensagens. Ver opt-in no WhatsApp.

Qualidade do número — classificação baseada em bloqueios e denúncias. Baixa reduz o limite de envio.

BSP — provedor autorizado que intermedia o acesso à API.

Operação

Handoff — passagem da conversa para um humano. A peça que mais define a experiência. Ver handoff.

Escalonamento — subir a conversa para um nível com mais alçada.

Fila — conversas aguardando atendimento humano.

Multiatendimento — vários atendentes no mesmo número, com histórico compartilhado.

Omnichannel — canais diferentes com histórico unificado.

Taxa de resolução — percentual resolvido sem humano. Só vale medida por desfecho.

Régua de follow-up — sequência programada de contatos.

Integração

API — porta que um sistema abre para outro consultar ou agir.

Webhook — o sistema avisando quando algo acontece. Ver API, webhook e integração.

Endpoint — endereço específico dentro de uma API.

Ambiente de homologação — cópia de teste, separada da produção. Exigir sempre.

Conformidade

LGPD — Lei Geral de Proteção de Dados. Ver IA e LGPD no atendimento.

Dado sensível — saúde, biometria, origem racial, convicção religiosa, entre outros. Regime mais rígido.

Base legal — a hipótese que autoriza tratar o dado. Consentimento é uma delas, não a única.

Retenção — por quanto tempo o dado é guardado. Precisa ter prazo.

Operador — quem trata dados em nome de outra empresa. Normalmente o fornecedor do agente.

Recebeu uma proposta e não entendeu?

A Fluxo Inteligente explica o escopo em português — e diz o que é essencial e o que é enfeite.

Perguntas frequentes

Qual a diferença entre chatbot e agente de IA?
Chatbot tradicional segue um fluxo pré-programado: menu, opção, resposta fixa. Agente de IA interpreta linguagem natural, mantém contexto da conversa e pode consultar sistemas para agir. Na prática, o primeiro trava fora do roteiro; o segundo lida com pergunta que ninguém previu.
O que é alucinação e por que ela importa tanto?
É quando o modelo produz uma resposta plausível mas falsa. Em atendimento isso é grave porque a resposta sai com o nome da sua empresa e vira promessa. Combate-se com base de conhecimento boa, instrução explícita de dizer 'não sei' e handoff configurado.
O que é token e por que aparece no preço?
Token é a unidade em que o texto é medido pelo modelo — aproximadamente pedaços de palavra. A cobrança de uso do modelo costuma ser por token processado. Por isso prompt inchado e histórico sem resumo aumentam o custo: mais texto enviado, mais tokens.
Qual a diferença entre API e webhook?
API é o agente perguntando ao seu sistema ('tem esse produto?'). Webhook é o seu sistema avisando o agente ('o pedido foi faturado'). Um puxa informação; o outro empurra evento. Operações completas usam os dois.
O que significa HSM ou template no WhatsApp?
É uma mensagem com texto pré-aprovado pela Meta, necessária para iniciar conversa fora da janela de 24 horas. Não dá para alterar o corpo livremente — só preencher variáveis. Cada template pertence a uma categoria (utilidade, marketing, autenticação), o que afeta custo e aprovação.

Quer um agente de IA atendendo no seu WhatsApp?

Conte o seu cenário e a gente mostra, com número, o que dá pra automatizar no seu atendimento.

Falar no WhatsApp: (19) 99615-5951

Anny Peixoto

Designer e Social Selling

Lidera design e social selling na Fluxo Inteligente. Trabalha na ponta em que a IA encontra o cliente: tom de voz, roteiro de conversa e a experiência que faz um atendimento automatizado parecer atendimento de gente boa. Escreve sobre aplicação de IA por nicho.

Leia também