Quanto custa trocar atendimento humano por tokens? O caso Vivara em números, e onde dá para gastar bem menos

A Vivara conta que seu agente de IA resolve 75% dos atendimentos. Fizemos a conta de quanto isso muda no custo da operação e mostramos por que separar as decisões da conversa derruba o custo da IA.

· 6 min de leitura · Equipe Logo17

Em setembro, a Vivara contou em matéria da Consumidor Moderno como o Vick, seu agente de IA no WhatsApp, mudou a operação de atendimento. Os números divulgados pela empresa chamam atenção:

  • o agente resolve sozinho 75% dos atendimentos; os outros 25% vão para uma equipe especializada;
  • os contatos sobre “status do pedido” caíram de 40% para 10 a 14% do total;
  • na Black Friday de 2025, com o agente no segundo mês de operação, o volume subiu mais de 50% e o repasse para pessoas ficou 13% abaixo do ano anterior;
  • o CSAT ficou em 80 pontos.

A pergunta que todo gestor faz em seguida é: quanto isso vale em dinheiro? A matéria não traz volume, tamanho de equipe nem custo, então montamos um modelo com premissas explícitas. Ajuste para a sua operação e a conta se ajusta.

Premissas

Premissa Valor
Custo total de um atendente (salário, encargos, benefícios, supervisão, ferramentas e infraestrutura) R$ 4.800 por mês
Atendimentos por atendente no WhatsApp, com conversas simultâneas 600 por mês
Custo por atendimento humano cerca de R$ 8
Volume de exemplo 50 mil atendimentos por mês

A troca: pessoas por tokens

Com o agente resolvendo 75%, o volume que chega às pessoas cai de 50 mil para 12,5 mil atendimentos por mês. A equipe equivalente vai de algo como 83 para 21 atendentes, e o custo de pessoas, de R$ 400 mil para R$ 100 a 140 mil por mês (os casos que sobram são os difíceis, que levam mais tempo).

Mas o mais importante não é a média do mês, é o pico. Custo de pessoas é fixo e dimensionado pela demanda mais alta: na Black Friday, é contratar e treinar temporários. Custo de IA é variável: cresce com o volume, sem contratação. No caso da Vivara, sem o agente as pessoas teriam recebido 1,5 vez o volume do ano anterior; com ele, receberam 0,87. São cerca de 42% menos atendimentos humanos exatamente no pico, que é onde o custo fixo mais pesa.

Quanto custa o lado da IA

Aqui aparece um detalhe que quase ninguém separa: um agente de IA não faz uma coisa só. Numa conversa típica de atendimento, ele:

  1. entende o motivo do contato;
  2. decide se resolve sozinho ou se passa para uma pessoa;
  3. busca dados (o pedido, a fatura, o protocolo);
  4. escreve as respostas;
  5. no fim, tabula o atendimento.

Nos agentes montados só com LLM (os modelos que geram texto), todas essas etapas passam pelo LLM, a cada mensagem, com o histórico da conversa inteiro no contexto. Uma conversa de umas dez mensagens consome facilmente 40 mil tokens de entrada.

Só que as etapas 1, 2 e 5 não precisam escrever nada. São decisões com resposta numa lista: qual o motivo, resolve ou transfere, qual tabulação. É exatamente o trabalho de um modelo de decisão, como o L17 Decide e o L17 Qualifica: leem o texto uma vez e devolvem a escolha com a probabilidade de cada opção, em dezenas de milissegundos, por cerca de R$ 0,0002 por decisão.

E a etapa 3, em boa parte dos casos, também não precisa de LLM: “onde está meu pedido” se responde com o dado do sistema num modelo de mensagem. O LLM fica só onde é preciso escrever de verdade.

A conta, por conversa

Estimativa de custo de tokens por conversa resolvida pela IA, com preços típicos de mercado para um LLM intermediário e para um LLM de ponta:

Arquitetura LLM intermediário LLM de ponta
Agente só com LLM: todas as etapas no LLM, ~40 mil tokens por conversa ~R$ 0,10 ~R$ 0,80
Decisões com modelo especializado + LLM só onde precisa escrever (em ~40% das conversas, com contexto menor) ~R$ 0,02 ~R$ 0,13

Para 37,5 mil conversas por mês (os 75% do exemplo), isso é a diferença entre R$ 30 mil e R$ 5 mil por mês com um LLM de ponta. Cerca de seis vezes menos, e com três ganhos que não aparecem na tabela:

  • velocidade: a decisão sai em milissegundos, não em segundos, e a primeira resposta ao cliente chega antes;
  • controle: a resposta é sempre uma das opções previstas, nunca um texto inventado;
  • probabilidade calibrada: o “passar para a pessoa” deixa de ser uma regra fixa e vira um limite de confiança. Acima dele, a IA resolve; abaixo, transfere. É assim que se chega aos 75% sem sacrificar o CSAT.

Uma ressalva honesta

O custo técnico é pequeno em qualquer das arquiteturas, perto dos R$ 8 de um atendimento humano. Na prática, o que mais pesa na conta da IA costuma ser o modelo de cobrança do fornecedor: há plataformas que cobram por atendimento resolvido pela IA (a Intercom, por exemplo, anuncia US$ 0,99 por resolução). Por isso, ao comparar propostas, a pergunta certa é: quanto custa cada atendimento resolvido pela IA, comparado ao custo do atendimento humano na sua operação? E vale perguntar também quais etapas usam LLM e quais não precisariam.

O que o caso ensina

  1. Medir o motivo do contato veio antes do resultado. Só dá para dizer que “status do pedido” caiu de 40% para 14% porque o motivo era medido. Tabulação confiável é pré-requisito, não detalhe.
  2. O resultado aparece no pico. A melhor métrica não é a média do mês, é quanto de pessoas você deixou de precisar na Black Friday.
  3. Nem toda etapa precisa de LLM. Separar decisão de conversa deixa a IA mais barata, mais rápida e mais previsível.

Como disse a própria Vivara: “Com a IA, sem uma base estruturada de dados, a gente só escala um dado ruim.”

Fontes

Os valores de custo são estimativas da Logo17 a partir das premissas acima, não números divulgados pela Vivara ou por seus fornecedores. Os números do caso são os informados pela empresa.

IA no atendimento custo do atendimento agentes de IA System One L17 Qualifica L17 Decide

// consultoria Logo17

Quer um modelo treinado para a sua operação?

Em 30 minutos mapeamos onde a IA decide sozinha e onde precisa de gente. Sem compromisso.

Diagnóstico gratuito

// newsletter

Receba os próximos conteúdos

Artigos e materiais sobre IA no atendimento, no máximo duas vezes por mês. Sem spam; você cancela quando quiser.

Continue lendo