Quanto custa trocar atendimento humano por tokens? O caso Vivara em números, e onde dá para gastar bem menos
A Vivara conta que seu agente de IA resolve 75% dos atendimentos. Fizemos a conta de quanto isso muda no custo da operação e mostramos por que separar as decisões da conversa derruba o custo da IA.
· 6 min de leitura · Equipe Logo17
Em setembro, a Vivara contou em matéria da Consumidor Moderno como o Vick, seu agente de IA no WhatsApp, mudou a operação de atendimento. Os números divulgados pela empresa chamam atenção:
- o agente resolve sozinho 75% dos atendimentos; os outros 25% vão para uma equipe especializada;
- os contatos sobre “status do pedido” caíram de 40% para 10 a 14% do total;
- na Black Friday de 2025, com o agente no segundo mês de operação, o volume subiu mais de 50% e o repasse para pessoas ficou 13% abaixo do ano anterior;
- o CSAT ficou em 80 pontos.
A pergunta que todo gestor faz em seguida é: quanto isso vale em dinheiro? A matéria não traz volume, tamanho de equipe nem custo, então montamos um modelo com premissas explícitas. Ajuste para a sua operação e a conta se ajusta.
Premissas
| Premissa | Valor |
|---|---|
| Custo total de um atendente (salário, encargos, benefícios, supervisão, ferramentas e infraestrutura) | R$ 4.800 por mês |
| Atendimentos por atendente no WhatsApp, com conversas simultâneas | 600 por mês |
| Custo por atendimento humano | cerca de R$ 8 |
| Volume de exemplo | 50 mil atendimentos por mês |
A troca: pessoas por tokens
Com o agente resolvendo 75%, o volume que chega às pessoas cai de 50 mil para 12,5 mil atendimentos por mês. A equipe equivalente vai de algo como 83 para 21 atendentes, e o custo de pessoas, de R$ 400 mil para R$ 100 a 140 mil por mês (os casos que sobram são os difíceis, que levam mais tempo).
Mas o mais importante não é a média do mês, é o pico. Custo de pessoas é fixo e dimensionado pela demanda mais alta: na Black Friday, é contratar e treinar temporários. Custo de IA é variável: cresce com o volume, sem contratação. No caso da Vivara, sem o agente as pessoas teriam recebido 1,5 vez o volume do ano anterior; com ele, receberam 0,87. São cerca de 42% menos atendimentos humanos exatamente no pico, que é onde o custo fixo mais pesa.
Quanto custa o lado da IA
Aqui aparece um detalhe que quase ninguém separa: um agente de IA não faz uma coisa só. Numa conversa típica de atendimento, ele:
- entende o motivo do contato;
- decide se resolve sozinho ou se passa para uma pessoa;
- busca dados (o pedido, a fatura, o protocolo);
- escreve as respostas;
- no fim, tabula o atendimento.
Nos agentes montados só com LLM (os modelos que geram texto), todas essas etapas passam pelo LLM, a cada mensagem, com o histórico da conversa inteiro no contexto. Uma conversa de umas dez mensagens consome facilmente 40 mil tokens de entrada.
Só que as etapas 1, 2 e 5 não precisam escrever nada. São decisões com resposta numa lista: qual o motivo, resolve ou transfere, qual tabulação. É exatamente o trabalho de um modelo de decisão, como o L17 Decide e o L17 Qualifica: leem o texto uma vez e devolvem a escolha com a probabilidade de cada opção, em dezenas de milissegundos, por cerca de R$ 0,0002 por decisão.
E a etapa 3, em boa parte dos casos, também não precisa de LLM: “onde está meu pedido” se responde com o dado do sistema num modelo de mensagem. O LLM fica só onde é preciso escrever de verdade.
A conta, por conversa
Estimativa de custo de tokens por conversa resolvida pela IA, com preços típicos de mercado para um LLM intermediário e para um LLM de ponta:
| Arquitetura | LLM intermediário | LLM de ponta |
|---|---|---|
| Agente só com LLM: todas as etapas no LLM, ~40 mil tokens por conversa | ~R$ 0,10 | ~R$ 0,80 |
| Decisões com modelo especializado + LLM só onde precisa escrever (em ~40% das conversas, com contexto menor) | ~R$ 0,02 | ~R$ 0,13 |
Para 37,5 mil conversas por mês (os 75% do exemplo), isso é a diferença entre R$ 30 mil e R$ 5 mil por mês com um LLM de ponta. Cerca de seis vezes menos, e com três ganhos que não aparecem na tabela:
- velocidade: a decisão sai em milissegundos, não em segundos, e a primeira resposta ao cliente chega antes;
- controle: a resposta é sempre uma das opções previstas, nunca um texto inventado;
- probabilidade calibrada: o “passar para a pessoa” deixa de ser uma regra fixa e vira um limite de confiança. Acima dele, a IA resolve; abaixo, transfere. É assim que se chega aos 75% sem sacrificar o CSAT.
Uma ressalva honesta
O custo técnico é pequeno em qualquer das arquiteturas, perto dos R$ 8 de um atendimento humano. Na prática, o que mais pesa na conta da IA costuma ser o modelo de cobrança do fornecedor: há plataformas que cobram por atendimento resolvido pela IA (a Intercom, por exemplo, anuncia US$ 0,99 por resolução). Por isso, ao comparar propostas, a pergunta certa é: quanto custa cada atendimento resolvido pela IA, comparado ao custo do atendimento humano na sua operação? E vale perguntar também quais etapas usam LLM e quais não precisariam.
O que o caso ensina
- Medir o motivo do contato veio antes do resultado. Só dá para dizer que “status do pedido” caiu de 40% para 14% porque o motivo era medido. Tabulação confiável é pré-requisito, não detalhe.
- O resultado aparece no pico. A melhor métrica não é a média do mês, é quanto de pessoas você deixou de precisar na Black Friday.
- Nem toda etapa precisa de LLM. Separar decisão de conversa deixa a IA mais barata, mais rápida e mais previsível.
Como disse a própria Vivara: “Com a IA, sem uma base estruturada de dados, a gente só escala um dado ruim.”
Fontes
- Consumidor Moderno: Agente de IA da Vivara filtra 75% dos atendimentos e muda operação da companhia (24/09/2026)
- Consumidor Moderno: Menos tecnologia, mais resultado: como a Vivara elevou a produtividade em 80%
Os valores de custo são estimativas da Logo17 a partir das premissas acima, não números divulgados pela Vivara ou por seus fornecedores. Os números do caso são os informados pela empresa.
// consultoria Logo17
Quer um modelo treinado para a sua operação?
Em 30 minutos mapeamos onde a IA decide sozinha e onde precisa de gente. Sem compromisso.
// newsletter
Receba os próximos conteúdos
Artigos e materiais sobre IA no atendimento, no máximo duas vezes por mês. Sem spam; você cancela quando quiser.