← Voltar para Segurança

O que verificamos, e quando

Última atualização: 2 de setembro de 2026

Cada mensagem que seu filho envia, e cada palavra que o amiguinho responde, passa por cinco verificações independentes. Aqui está exatamente o que cada uma procura, em ordem, acompanhando uma única mensagem do começo ao fim. As conversas acontecem em inglês; as verificações são as mesmas para cada mensagem.

Seu filho fala ou digita
Antes de seu filho receber uma resposta

A verificação instantânea

Roda em nossos servidores no momento em que a mensagem chega, antes de a IA ver qualquer coisa.

Esta é a única verificação capaz de impedir que uma mensagem chegue à IA. Ela procura 34 situações específicas. Estas são as que os pais mais perguntam:

Mais dois grupos: uma criança sofrendo algum dano, e uma criança em crise Mostrar a lista completa

Uma criança sofrendo algum dano

  • Apanhar ou se machucar em casa
  • Abuso sexual
  • Negligência: sem comida, deixada sozinha
  • Violência entre adultos
  • Um cuidador que não dá conta
  • Sofrer bullying

Uma criança em crise

  • Automutilação
  • Não querer estar vivo
  • Transtornos alimentares
  • Sofrimento com a imagem corporal
  • Vontade de fugir de casa

Alguém se aproximando do seu filho

  • Pedir para se encontrar
  • Perguntar onde mora
  • Perguntar em qual escola estuda
  • Pedir fotos
  • Pressão para esconder algo de você
  • Dinheiro ou créditos de jogo em troca de silêncio
  • “Ninguém acreditaria em você”

A segurança do próprio filho

  • Armas
  • Fogo e explosivos
  • Química perigosa
  • Drogas e álcool
  • Jogos de aposta
  • Desafios perigosos da internet
  • Apostas imprudentes entre amigos

Coisas com as quais simplesmente não ajudamos

  • Conteúdo sexual
  • Discurso de ódio
  • Extremismo
  • Perseguição
  • Golpes e roubo de identidade
  • Crimes cibernéticos
  • Crueldade com animais
  • Conteúdo sangrento
  • Fazer o dever de casa no lugar da criança

Quando corresponde a algo sério, a IA nunca vê a mensagem. Seu filho recebe na hora uma resposta acolhedora, escrita com cuidado, e você é avisado imediatamente.

A verificação independente de conteúdo

Roda ao mesmo tempo em que o amiguinho pensa, então seu filho nunca espera por ela.

Cada mensagem também é lida por um classificador de segurança separado, da OpenAI, que chega ao próprio veredito de forma independente de tudo acima.

Ele escala imediatamente em quatro casos: automutilação, intenção de automutilação, instruções de automutilação e conteúdo sexual envolvendo crianças.

O amiguinho elabora a resposta é aqui que mora a verificação 3

O amiguinho reconhece o que acabou de ouvir

A camada que faz o trabalho mais pesado, e que não é um filtro.

Quando seu filho conta algo sério ao amiguinho, ele responde com carinho e orienta a criança a procurar um adulto de confiança. Essa resposta é, por si só, o sinal. Quando o amiguinho diz a uma criança para conversar com um pai, professor ou conselheiro sobre o que ela acabou de contar, você é avisado imediatamente.

Isso importa porque crianças raramente anunciam um problema. Elas mencionam uma rotina, ou algo que aconteceu, de passagem. Nenhuma lista de palavras captura isso, então escutamos o que a IA faz, e não só o que ela detecta.

Antes de seu filho ouvir a resposta

A verificação da resposta

Cada resposta é examinada antes de ser dita em voz alta.

Especificamente, removemos:

  • A escola, a rua ou o nome completo do seu filho repetidos de volta
  • Promessas de que o amiguinho estará esperando por ele
  • Dizer à criança que um dado real é seguro de compartilhar
  • Instruções físicas que ele acabou de chamar de perigosas
  • Respostas de dever de casa que ele acabou de recusar
  • Qualquer coisa que soe como “fica só entre nós”
  • Uma versão mais assustadora quando alguém pede uma

Há uma mais suave também: se a criança diz que está deixando de fazer algo de verdade para continuar brincando, a resposta precisa apontá-la de volta para fora do app.

A verificação final de conteúdo

A última coisa que acontece antes de seu filho ouvir qualquer palavra.

O mesmo classificador independente do passo 2, desta vez lendo as próprias palavras do amiguinho.

O amiguinho fala em voz alta só agora seu filho ouve
Na mesma hora

Quando algo é sinalizado

Os e-mails nunca são agrupados. Quando um sai, sai no momento em que a conversa acontece, sem resumos e sem esperar até a manhã seguinte, e diz de qual criança se trata, para você ir direto à conversa sinalizada no app.

Cada conversa sinalizada fica registrada e esperando por você na transcrição. Isso acontece sempre. Nas categorias sérias (automutilação, abuso, aliciamento, um estranho fazendo contato, um indício de transtorno alimentar), também enviamos um e-mail. Somos deliberadamente cuidadosos sobre quais detecções disparam esse e-mail enquanto medimos como elas se comportam com crianças reais, porque um alarme falso sobre a segurança do seu filho é, em si, um tipo de dano. De todo modo a conversa fica sinalizada e esperando por você, então nada se perde. Para todo o resto, você recebe um e-mail na primeira vez que uma conversa é sinalizada em uma sessão; o restante daquela sessão continua sinalizado e esperando na transcrição, você só não recebe dois e-mails em dez minutos.

Depois você vê a troca em si: as palavras reais, não um resumo nem um rótulo de categoria, para julgar por conta própria o que aconteceu e decidir o que fazer.

Nenhuma camada é usada sozinha, e a que carrega o maior peso (o próprio reconhecimento do amiguinho) é a que lê significado, e não apenas palavras.

Perguntas que os pais fazem sobre as verificações

As conversas do meu filho com a IA são monitoradas?

Sim. Cada mensagem que seu filho envia, e cada palavra que o amiguinho responde, passa por cinco verificações independentes em nossos servidores, tanto na entrada quanto na saída. Como responsável, você também pode ler a transcrição completa de cada conversa, protegida pelo PIN dos pais.

Vou ser avisado se meu filho disser algo preocupante para a IA?

Você sempre pode ver. Cada conversa sinalizada fica registrada na transcrição com as palavras reais do seu filho e, nas categorias sérias, também enviamos um e-mail na hora. Isso funciona de duas formas: uma verificação que roda antes de a IA sequer ver a mensagem, e um segundo sinal vindo do próprio comportamento do amiguinho, de modo que, quando o amiguinho orienta a criança a procurar um pai, professor ou conselheiro por causa de algo que ela acabou de dizer, você fica sabendo.

Uma mensagem perigosa pode chegar à IA?

A primeira verificação roda em nossos servidores no momento em que a mensagem chega, antes de a IA ver qualquer coisa, e é a única capaz de impedir que uma mensagem chegue à IA. Quando ela corresponde a algo sério, a IA nunca vê a mensagem, e seu filho recebe na hora uma resposta acolhedora, escrita com cuidado.

Que tipos de coisas o WimziPal observa?

A primeira verificação procura 34 situações específicas, agrupadas em: uma criança sofrendo algum dano, uma criança em crise, alguém se aproximando do seu filho, a segurança do próprio filho e coisas com as quais simplesmente não ajudamos. Isso cobre abuso e negligência, automutilação e transtornos alimentares, um adulto pedindo para encontrar a criança ou pressionando por segredos, armas e desafios perigosos, além de conteúdo sexual, discurso de ódio e extremismo.

A checagem de segurança deixa o amiguinho lento para responder?

Não. A verificação independente de conteúdo roda ao mesmo tempo em que o amiguinho elabora a resposta, então seu filho nunca espera por ela.

O WimziPal depende só de uma lista de palavras proibidas?

Não, e isso importa porque crianças raramente anunciam um problema. Elas mencionam uma rotina, ou algo que aconteceu, de passagem, e nenhuma lista de palavras captura isso. Além das verificações no nível das palavras, o WimziPal escuta o que a IA faz, e não só o que ela detecta, tratando a própria decisão do amiguinho de orientar a criança a procurar um adulto de confiança como um sinal por si só.

Leituras relacionadas