
Les escroqueries utilisant l'intelligence artificielle pour imiter la voix de membres de la famille ou de contacts proches se répandent à l'échelle mondiale, avec des cas récents montrant leur impact économique et émotionnel sur les victimes.
Ce type de fraude, connu sous le nom de vishing, combine des technologies de clonage vocal avec des techniques d'ingénierie sociale pour générer des tromperies de plus en plus difficiles à détecter.
L'un des cas les plus récents est survenu lorsqu'une femme d'Argentine a reçu un message vocal via WhatsApp depuis le compte d'un ami. Dans l'audio, la voix - apparemment authentique - offrait la possibilité d'acheter des dollars à bon prix et pressait de concrétiser la transaction.

Convaincue de la véracité du message, la victime a transféré une somme importante d'argent. Cependant, en essayant de coordonner la livraison, elle a cessé de recevoir des réponses. Par la suite, elle a constaté que son contact n'avait jamais envoyé ces enregistrements.
L'enquête, menée par un bureau spécialisé dans les crimes numériques, a déterminé que les messages avaient été générés par intelligence artificielle. L'analyse technique a permis de confirmer que la voix avait été clonée avec une grande précision dans son ton et son timbre, après avoir accédé à des enregistrements précédents du contact usurpé.
Ce type de fraude n'est pas isolé. Au cours des dernières années, le clonage vocal via l'IA s'est consolidé comme un outil utilisé par les cybercriminels.

Avec seulement quelques secondes d'audio - obtenues depuis les réseaux sociaux, messages ou vidéos - il est possible de recréer une voix synthétique capable d'imiter une personne réelle. À partir de là, les escrocs envoient des messages ou passent des appels en simulant être des membres de la famille ou des connaissances.
Le mécanisme est généralement complété par des techniques supplémentaires, comme le “caller ID spoofing”, qui permet de falsifier le numéro de téléphone à partir duquel l'appel est passé. De cette manière, la tromperie devient encore plus convaincante, car l'appareil de la victime affiche le contact réel à l'écran.
Une fois la communication établie, les délinquants font appel à l'urgence pour éviter que la victime ne vérifie la situation. Ils demandent des transferts d'argent sous prétexte d'urgences médicales, d'accidents ou de problèmes légaux. Ce composant émotionnel est clé pour le succès de l'escroquerie.

Des cas similaires ont été signalés dans différents pays. Aux États-Unis, par exemple, des fraudes ont été documentées où des criminels ont cloné la voix de fils ou de petits-enfants pour demander de l'argent urgent à des membres de la famille, dans ce qui est connu comme le “grandparent scam”. Dans l'un de ces épisodes, un homme a transféré 25 000 dollars après avoir reçu un appel où il a entendu ce qu'il croyait être la voix de son fils.
Des incidents ont également été signalés où les escroqueries visaient des entreprises. Dans ces cas, les attaquants imitent la voix de dirigeants pour ordonner des transferts depuis des départements financiers, une modalité connue sous le nom de “CEO fraud”. Même des entreprises comme Ferrari ont été la cible de tentatives de ce type, qui dans certains cas ont été détectées à temps.
Face à la sophistication de ces pratiques, les spécialistes avertissent que la prévention est le principal outil de défense. Actuellement, il n'existe pas de systèmes capables d'identifier en temps réel si une voix a été générée par intelligence artificielle lors d'un appel ou d'un message.

Parmi les recommandations les plus efficaces, il y a l'établissement d'un mot de passe entre les membres de la famille. Ce mécanisme permet de vérifier l'authenticité d'une communication en cas d'urgence. Si la personne qui appelle ne peut pas fournir ce mot de passe, il est probable qu'il s'agisse d'une tentative de fraude.
D'autres mesures incluent de couper la communication et de rappeler le numéro habituel du contact, de confirmer la situation avec d'autres membres de la famille et d'éviter de réaliser des transferts d'argent sous pression. Il est également conseillé de se méfier des messages générant de l'urgence ou de l'anxiété.
Les avancées de l'intelligence artificielle ont transformé la voix en un élément vulnérable dans l'écosystème digital. Ce qui pendant des années était un signe de confiance peut aujourd'hui être répliqué avec précision par des outils technologiques. Dans ce contexte, la vérification par des moyens alternatifs devient clé pour éviter de tomber dans ce type de tromperies.

L'expansion de ces escroqueries reflète comment la technologie peut être utilisée à la fois pour innover et pour commettre des délits. Face à cela, la sensibilisation et l'adoption de comportements préventifs sont essentielles pour réduire les risques dans un environnement de plus en plus complexe.