Golpes com IA seguem em alta: Voz e vídeo não bastam mais
Deepfakes são mídias sintéticas criadas com inteligência artificial que simulam de forma realista a voz ou a imagem de uma pessoa. No caso das fraudes recentes, bandidos coletam áudios ou vídeos de redes sociais às vezes apenas poucos segundos e usam algoritmos de síntese para gerar falas novas da vítima. O TSE definiu “deepfake” como conteúdo que cria, reproduz ou altera a voz ou a imagem de alguém de modo muito realista. Assim, ver ou ouvir “ao vivo” não garante que seja alguém de verdade na linha: A clonagem de voz por IA tem avançado tanto que detectar somente na intuição não basta.

O que são deep fakes de voz e vídeo?
Deepfakes são mídias sintéticas criadas com inteligência artificial que simulam de forma realista a voz ou a imagem de uma pessoa. No caso das fraudes recentes, bandidos coletam áudios ou vídeos de redes sociais às vezes apenas poucos segundos e usam algoritmos de síntese para gerar falas novas da vítima. O TSE definiu “deepfake” como conteúdo que cria, reproduz ou altera a voz ou a imagem de alguém de modo muito realista. Assim, ver ou ouvir “ao vivo” não garante que seja alguém de verdade na linha: A clonagem de voz por IA tem avançado tanto que detectar somente na intuição não basta.
Como funciona a clonagem de voz com IA
A clonagem de voz começa reunindo amostras da fala da pessoa-alvo, vídeos, áudios em redes sociais, gravações de onde o sistema extrai características de timbre, ritmo e entonação. Modelos neurais de síntese de voz (text-to-speech) então aprendem esses padrões e geram falas completamente novas. A capacidade de imitar evoluiu rápido: em 2016 eram necessários cerca de 20 minutos de amostra para um clone razoável; em 2018 bastavam poucos segundos. Hoje há ferramentas comerciais que produzem áudios muito convincentes com trechos curtos e baixo custo. Em 2023, pesquisadores da McAfee reportaram que apenas três segundos de áudio já bastaram para gerar um clone com 85% de semelhança com a voz original. Isso significa que gravações curtas em redes sociais ou chamadas não mais garantem exclusividade de voz.
Já os deepfakes de vídeo usam técnicas semelhantes para alterar rostos ou sincronizar movimentos labiais em gravações. Em golpes divulgados no Brasil, foram usados não apenas áudios falsos, mas também vídeos manipulados, tornando o golpe mais crível. Por exemplo, em um caso no Mato Grosso do Sul, a mãe de um comprador de carro recebeu um vídeo de IA com aparência da filha falando, enquanto a voz clonada autorizava o pagamento por Pix. Assim, combinar imagem e áudio de forma convincente se tornou realidade e uma séria ameaça para a segurança digital.
Por que os golpistas usam deep fakes
Criminosos exploram principalmente a confiança e a urgência emocional. Eles recorrem à engenharia social: Coletam informações de redes sociais (nomes de parentes, fotos, profissões, viagens) e usam números de telefone diferentes para abordar a vítima. Em seguida, utilizam IA para dar voz (e até imagem) à história fabricada. Como observa a especialista Luiza Faccin, “hoje já é possível produzir áudios e vídeos manipulados capazes de reproduzir de maneira muito convincente a voz e a aparência de uma pessoa”. O objetivo não é invadir sistemas bancários, mas manipular a própria vítima para que ela autorize a transferência sozinha. Basta uma explicação emocionalmente plausível como “sou eu, em apuros” para quebrar a cautela: “não precisamos de uma falsificação perfeita, precisamos de uma explicação plausível”, afirmam especialistas. Quem ouve uma voz conhecida aflita tende a ajudar antes de questionar a veracidade.
As estratégias comuns envolvem criar cenários de emergência urgentes (acidente de carro, sequestro fake, problemas policiais) e pedir dinheiro com sigilo. A vítima costuma ser orientada a não contar a ninguém (“não fala para a mãe”) e a enviar dinheiro por Pix a contas de terceiros, tornando difícil o rastreamento. Em levantamentos globais, quase metade das pessoas diz que atenderia a um áudio de parente pedindo dinheiro, especialmente se a história parecer real (acidente de carro, por exemplo). No Brasil, casos reais ilustram isso: uma idosa chegou a receber um áudio com a voz do neto pedindo 28 mil via Pix antes que a vítima percebesse a fraude.
Sinais de alerta e como desconfiar
Alguns indícios ajudam a reconhecer possíveis deepfakes antes de cair no golpe. Ouça com atenção e fique alerta a:
– Tom de voz ou palavras estranhas: Clones podem soar “muito perfeitos” ou sofrer erros sutis. O espectrograma (análise técnica) mostra que vozes sintéticas têm timbre diferente, mas ouvidos atentos percebem hesitações estranhas e entonações robóticas. Uma palavra fora de contexto ou gírias desconectadas do habitual já podem ser sinal de alerta.
– Qualidade do áudio: Vozes clonadas às vezes soam excessivamente nítidas, sem ruídos de fundo característicos, ou com pausas estranhas entre as palavras. Essas “áreas limpas” no espectro são comuns em deepfakes.
– Urgência excessiva: Se a história parece muito apressada ou dramática (“meu celular quebrou, preciso de dinheiro agora!”), pode ser uma armadilha. Golpes de voz geralmente usam prazos curtos e muita pressão emocional.
– Número estranho: Desconfie se o pedido vier de um número de telefone novo ou desconhecido, especialmente se alegarem que “este é meu novo chip” ou “meu celular ficou sem sinal”.
– Pedido de segredo: Golpes pedem para não envolverem outros familiares, sob o pretexto de não preocupar ninguém. Essa insistência em sigilo é sinal de alerta.
– Transferência a conta de terceiro: Atenção se pedirem para fazer Pix para uma conta diferente da usual ou de uma pessoa que você não conhece. Isso dificulta reverter o golpe.
– Desconfie de recusa de videochamada: Muitos golpistas inventam desculpas para não fazer vídeo chamada (“minha câmera está quebrada”, “não consigo ligar no WhatsApp agora”) para esconder que a voz ou a imagem não corresponde de verdade ao golpista.
– Valores elevados: Ofertas muito acima do comum ou exigência de grande quantia em dinheiro devem ser encarados com desconfiança imediata.
Segundo especialistas, a presença de vários desses sinais combinados aumenta a certeza de golpe. Os itens acima são baseados em casos reais reportados, como o Golpe do Pix com voz de familiar, em que a vítima relatou urgência incomum, número novo e justificativas desconexas.
Como se proteger e agir
Para não ser enganado, a melhor recomendação é validar o contato por outro canal. Por exemplo, desligue e ligue novamente para o número antigo e conhecido da pessoa que estaria ligando. Se ela não atender, tente falar com outro parente antes de enviar qualquer quantia. Criar palavras-chave ou códigos pré-combinados em família (como “cor de camisa” ou outra senha verbal) pode barrar pedidos falsos: solicite sempre essa senha caso alguém peça dinheiro. Essas medidas não são infalíveis sozinhas, mas dificultam muito a ação dos fraudadores.
Outras dicas: Mantenha senhas e perfis privados nas redes sociais para reduzir a quantidade de “matéria-prima” (gravações, vídeos e informações) que os golpistas podem usar. Evite compartilhar áudios e imagens de crianças e jovens publicamente. Se um pagamento já foi feito sob suspeita, avise imediatamente o banco e registre boletim de ocorrência. No aplicativo bancário, cheque sempre o destinatário do Pix se a conta não pertencer ao parente de confiança, é quase certo que é golpe.
Em resumo, a voz ou a imagem digital por si só não provam identidade. Como alerta o serviço de comunicação: “Reconhecer a voz deixou de ser prova de que a pessoa está do outro lado”. Nunca atenda pedidos urgentes de dinheiro sem confirmação. Se tiver dúvidas, entre em contato por outro meio (ligação de um telefone conhecido, mensagem por app de confiança) para validar a história. Esse cuidado simples pode impedir prejuízos sérios.
Conclusão
A inteligência artificial ampliou as ferramentas de fraude: deepfakes de voz e vídeo tornaram golpes ainda mais difíceis de desconfiar à primeira vista. No entanto, a tecnologia também expõe padrões que os humanos podem notar: hesitações estranhas, ausência de imperfeições, solicitações emocionalmente forçadas e números desconhecidos. Manter a prudência e sempre verificar por outros canais é fundamental. O golpe se sustenta na urgência e na confiança e retira delas a credibilidade. Em vez de reagir apenas ao ouvir uma voz conhecida, esteja sempre pronto para perguntar “é mesmo você?” de outra maneira. Essas práticas simples ajudam a garantir que a IA dos golpistas não seja mais convincente que o bom senso humano.
Fontes: Notícias e estudos recentes mostram o rápido crescimento de fraudes com IA no Brasil. Relatos de especialistas e veículos de imprensa apontam como apenas segundos de áudio são usados em clonagens, e listam sinais de alerta e métodos de prevenção. Consulte também as orientações oficiais (bancos e polícia) sobre golpes de Pix e uso de deepfakes.




