Cidadania Italiana

Deepfake de áudio: basta 3 segundos de voz e €30

Deepfakes de áudio podem ser gerados a partir de 3 segundos de voz real e custo baixo (~30€). Crescem fraudes, clonagem vocal e uso indevido de celebridades.

Deepfake de áudio: basta 3 segundos de voz e €30
Foto: Charles W. Price, Editor in chief (Public domain)

Meta description: Deepfakes de áudio podem ser gerados a partir de 3 segundos de voz real e custo baixo (~30€). Crescem fraudes, clonagem vocal e uso indevido de celebridades.

A tecnologia capaz de reproduzir vozes humanas com fidelidade a partir de apenas três segundos de gravação e por um custo indicado de cerca de €30 vem ampliando fraudes, clonagem vocal e usos indevidos de celebridades, segundo reportagem da ANSA que cita empresas de segurança e especialistas do setor. Além de aplicações legítimas, como acessibilidade em cinema, especialistas alertam para o aumento de golpes por engenharia social e ataques direcionados a instituições financeiras e figuras públicas.

O que a reportagem relata

  • A partir de três segundos de áudio real é possível criar uma réplica convincente da voz de uma pessoa; o valor médio indicado para gerar a voz sintética pode ficar em torno de 30 euros, segundo a matéria da ANSA.
  • A tecnologia tem usos positivos — por exemplo, para a recriação de vozes em projetos culturais e de acessibilidade — mas também facilita fraudes e manipulações.

    "Deepfake de áudio pode ser criado com três segundos de voz e custar cerca de €30", segundo a ANSA.

Casos e exemplos citados

  • Uso legítimo: a recriação da voz do ator Val Kilmer em um filme, citada como exemplo de aplicação para fins artísticos e de acessibilidade, quando a tecnologia é usada para recuperar linhas de diálogo de atores com limitações vocais.
  • Fraudes: a reportagem menciona um ataque que envolveu a clonagem de voz usada contra um manager do banco Fideuram, além de manipulações envolvendo celebridades, onde vozes falsificadas foram empregadas para criar conteúdos enganosos ou pressionar financeiramente alvos.
  • Reação institucional: a primeira‑ministra Giorgia Meloni registrou sua voz no Escritório de Propriedade Intelectual da União Europeia (EUIPO) como medida preventiva para se defender de falsificações geradas por IA, segundo a ANSA.

Dados e tendências segundo o setor

  • O relatório citado pela ANSA, com dados da empresa de cibersegurança McAfee, aponta crescimento expressivo do fenômeno:
    • 900% de aumento em deepfakes (vídeo, foto e áudio) em um ano.
    • Tentativas de fraude cresceram mais de 3.000%; ataques aumentaram 700% ano a ano em 2026.
    • Crimes ligados à clonagem vocal e deepfake de áudio registraram aumento de 1.300%, segundo os números do setor citados.
  • Essas métricas indicam não apenas maior capacidade técnica, mas também escalabilidade comercial e criminal da síntese de voz barata.

Riscos e implicações

  • Criminosos usam clonagem vocal para golpes de engenharia social: pedidos falsos de transferência, instruções a subordinados ou pressões a familiares de vítimas.
  • A disponibilização de serviços de síntese por baixo custo reduz barreiras de entrada para atacantes, ampliando o número e a sofisticação das fraudes.
  • Além do dano financeiro, há risco reputacional para figuras públicas, empresas e instituições — vozes falsificadas podem ser usadas para manipular opinião, extorquir ou induzir decisões.
  • Medidas tecnológicas de detecção evoluem, mas spécialistes alertam que autenticação multifatorial e protocolos de verificação adicionais permanecem essenciais.

Relevância para brasileiros e descendentes de italianos

  • As ameaças de deepfake de áudio não são limitadas pela fronteira: brasileiros e comunidades de descendentes de italianos podem ser alvos de golpes semelhantes, especialmente quando há relações financeiras, burocráticas ou pessoais transnacionais.
  • Empresas financeiras, gestores e figuras públicas no Brasil enfrentam riscos análogos aos citados na Itália; golpes por chamada de voz ou mensagens com gravações manipuladas já registraram incidentes em vários países.
  • Medidas preventivas recomendadas incluem:
    • adoção de autenticação por múltiplos fatores nas operações sensíveis;
    • protocolos internos que exijam confirmações por canais distintos (por exemplo, mensagem escrita ou verificação presencial) antes de autorizar transferências;
    • gravação e documentação de comunicações críticas;
    • atenção a sinais típicos de deepfake (entonação atípica, pausas estranhas, inconsistências contextuais).
  • Para quem acompanha processos de cidadania italiana ou mantém contatos na Itália, é prudente verificar identidades por canais oficiais e estar atento a solicitações financeiras por voz ou áudio. Notícias sobre o tema e medidas oficiais relacionadas à Itália podem ser acompanhadas em Notícias da Itália e em pautas sobre Vida na Itália.

Conclusão

A combinação de amostras curtas de voz e custos baixos para gerar áudio sintético torna os deepfakes de áudio uma ameaça crescente para segurança cibernética, fraudes financeiras e proteção da imagem pública. Enquanto a tecnologia oferece benefícios legítimos, especialistas e autoridades recomendam medidas preventivas e protocolos robustos de verificação para reduzir riscos.

Fonte: ANSA

Leia também