A política que o chatbot inventou
O chatbot da Air Canada informou a um cliente uma regra de reembolso que não existia. Um tribunal canadense decidiu que a companhia era responsável pelo que o bot disse e mandou pagar.
A meeval testa e revisa as conversas do seu agente e mostra onde ele perde vendas, vaza dados ou cai em golpe, com o custo de cada falha e a ordem de correção.
Sem integração: basta um ambiente de teste e a exportação das conversas.
vazou dado pessoal para quem não é o titular
alterou cadastro e deu desconto sem verificar ninguém
Um agente de IA não erra só em respostas bobas. Ele pode ser convencido, manipulado ou simplesmente inventar. Estes são os riscos que a meeval testa e monitora.
O cliente pergunta sobre parcelamento, frete ou estoque e o agente não sabe responder.
“Sobre o parcelamento, não tenho essa informação.”
Quem insiste o bastante consegue cupom, estorno ou frete grátis que a política não prevê.
“Tudo bem, vou liberar o estorno integral.”
Golpistas se passam pelo titular ou por um funcionário e trocam endereço, e-mail ou telefone da conta.
“E-mail alterado. Já pode redefinir sua senha.”
Mensagens como “ignore suas regras” fazem o agente sair do script e agir fora do permitido.
“Ok, a partir de agora não sigo mais as restrições.”
Endereço, CPF ou pedidos de outro cliente aparecem na conversa de quem não deveria ver.
“O pedido de Carlos será entregue na Rua Ipê, 45.”
O agente revela suas instruções, margens, políticas internas ou nomes de sistemas.
“Minhas instruções dizem que o desconto máximo é 30%.”
Prazo, preço ou reembolso inventado pelo agente que a empresa pode ser obrigada a cumprir.
“Seu reembolso sai em 24 horas, garantido.”
Orientação financeira ou de saúde indevida e respostas que ferem o Código de Defesa do Consumidor ou normas do setor.
“Pode tomar o dobro da dose, não tem problema.”
Respostas ríspidas, irônicas ou ofensivas que viram print e circulam nas redes.
“Como eu já expliquei três vezes…”
Loops de resposta e falha em passar a conversa para um humano quando o cliente precisa.
“Não entendi. Pode reformular sua pergunta?”
O chatbot da Air Canada informou a um cliente uma regra de reembolso que não existia. Um tribunal canadense decidiu que a companhia era responsável pelo que o bot disse e mandou pagar.
Usuários manipularam o chatbot de uma concessionária Chevrolet nos Estados Unidos até ele concordar em vender um SUV por US$ 1. Os prints viralizaram.
Nos dois casos, bastaria testar o agente com os clientes certos antes de ir ao ar. É exatamente isso que a meeval faz, em escala e continuamente.
Criamos centenas de clientes simulados, cada um com um objetivo. Escolha um para ver a conversa e como ela é avaliada.
Conversas ilustrativas. No teste real, os clientes simulados são criados a partir do seu negócio, dos seus produtos e das suas políticas.
Clientes simulados conversam com seu agente: com pressa, irritados, fora do script, tentando golpe ou tentando extrair dados.
Cada conversa, real ou simulada, é avaliada pelos critérios do seu negócio: resolução, segurança, regras, tom e venda.
As falhas viram poucos padrões, cada um com gravidade, volume, custo estimado e ordem de correção.
Nada muda no seu agente. Trabalhamos com um ambiente de teste e a exportação das conversas.
Quase nenhuma empresa consegue responder. É por isso que a meeval roda duas frentes ao mesmo tempo.
Cada rodada cria conversas novas, com objetivos novos. Ninguém consegue prever o teste, então ninguém consegue ajustar o agente só para passar nele. É assim que aparece o que ninguém tinha imaginado.
Roda toda semanaToda falha corrigida vira um teste fixo. Esse conjunto roda sempre igual e mostra na hora se a última mudança de prompt, modelo ou base quebrou algo que já funcionava.
Roda a cada mudança no agenteAs duas se alimentam. O que a exploração encontra hoje vira teste permanente amanhã. Em poucos meses, esse histórico é o registro de tudo que já deu errado na sua operação, e a régua que responde à diretoria se o agente está evoluindo.
Ajuste com os números da sua operação. É uma estimativa só das vendas perdidas; fraudes e vazamentos entram por fora.
E um único vazamento pode custar mais do que isso: a LGPD prevê multa de até 2% do faturamento no Brasil, limitada a R$ 50 milhões por infração, fora o dano à marca.
Estimativa ilustrativa. No diagnóstico, calculamos com os seus dados reais.
Relatório ilustrativo
Onde as conversas morrem antes da compra e quanto isso custa.
onde estou perdendo venda?Laudo de prontidão para ampliar o tráfego do agente com segurança.
posso escalar o agente?Testes de fraude, vazamento e manipulação antes que alguém de fora faça.
o agente pode ser usado contra nós?Retestes automáticos a cada mudança de prompt, modelo ou base.
o que quebrou na última mudança?Em 4 semanas você sabe onde seu agente falha, o que isso custa e o que corrigir primeiro.
Contratou a monitoria em até 60 dias após o diagnóstico? O valor do diagnóstico vira crédito.
Estamos abrindo 5 vagas para empresas que querem construir a meeval com a gente.
Dados pessoais são removidos das conversas antes da análise.
Suas conversas não são usadas para treinar modelos de IA.
Acordo de tratamento de dados assinado antes do início.
Dados apagados ao fim do projeto, se você preferir.
Não. Usamos um ambiente de teste do seu agente para as simulações e a exportação das conversas reais, anonimizadas. Seu time dedica cerca de 2 horas por semana durante o diagnóstico.
Sim. Avaliamos conversas de WhatsApp, chat no site e aplicativo. Para agentes de voz, trabalhamos com as transcrições das ligações.
Só no ambiente de teste e com autorização por escrito. Os clientes simulados tentam golpes, manipulação e extração de dados como um atacante faria, sem tocar na sua operação real.
Essas ferramentas ajudam o desenvolvedor a ver logs e métricas técnicas. A meeval entrega para o negócio: quais falhas acontecem, qual o risco, quanto custam e o que corrigir primeiro. Dá para usar as duas juntas.
Faz, e muito. Você ganha uma avaliação independente para cobrar o fornecedor, comparar alternativas e decidir se renova o contrato.
Rodamos 100 clientes simulados contra o seu agente, incluindo tentativas de golpe e de extração de dados, e mostramos as primeiras falhas.
Abre uma conversa no WhatsApp com seus dados já preenchidos.
É só enviar a mensagem no WhatsApp para marcarmos a conversa de 30 minutos.
Abrir o WhatsApp