L'acteur de doublage japonais Kenjiro Tsuda, connu pour avoir interprété Kento Nanami dans l'anime Jujutsu Kaisen et pour sa participation dans des titres tels que Yu-Gi-Oh!, a porté TikTok devant la justice japonaise pour le présumé usage non autorisé d'une voix créée par intelligence artificielle imitant la sienne. L'artiste a affirmé qu'un compte anonyme avait profité de son ton baryton pour narrer des vidéos sur les légendes urbaines, l'occultisme et les phénomènes paranormaux.
Selon la plainte, le profil a publié au moins 188 vidéos depuis juillet 2024 et a réuni plus de 200 000 abonnés. Tsuda a affirmé qu'il n'avait jamais autorisé la reproduction synthétique de sa voix et que le contenu cherchait à tirer parti de sa reconnaissance commerciale. Le compte, identifié comme « Nanami » et associé visuellement au personnage que l'acteur interprète dans Jujutsu Kaisen, aurait obtenu des revenus mensuels compris entre 500 000 et 750 000 yens (entre 80 000 et 120 000 USD).
La justice japonaise a reconnu la demande de Kenjiro Tsuda
Le Tribunal de district de Tokyo a reconnu que la voix d'une personne peut bénéficier d'une protection juridique selon un critère similaire au droit à l'image lorsqu'elle est utilisée sans autorisation pour exploiter sa valeur commerciale. La juge Aya Takahashi a soutenu que « la voix humaine symbolise la personnalité individuelle, tout comme le portrait d'une personne », selon le document judiciaire cité par Associated Press.
La décision faisait suite à la plainte déposée par Kenjiro Tsuda contre TikTok concernant les vidéos d'un compte anonyme qui, selon l'acteur, utilisait une réplique générée par intelligence artificielle de sa voix. Le profil diffusait des récits sur les légendes urbaines, l'occultisme et les phénomènes paranormaux, et combinait ces narrations avec une image liée à Kento Nanami, le personnage de Jujutsu Kaisen pour lequel Tsuda prête sa voix.
La justice a estimé que l'utilisation d'une voix dans le but d'exploiter l'attrait commercial de son titulaire peut constituer une violation de ses droits à l'image. La juge a indiqué que cette protection s'applique lorsque l'objectif est d'exploiter de manière exclusive la célébrité ou la reconnaissance associées à cette voix, selon The Guardian. TikTok avait fait valoir qu'il s'agissait d'une voix masculine générique et que la supposée ressemblance avec Tsuda dépendait d'une appréciation subjective.
Malgré la reconnaissance judiciaire, le tribunal a rejeté la demande de retrait des vidéos. Selon EFE et Associated Press, le compte avait déjà été supprimé lors de la publication du jugement, il n'y avait donc plus de contenu actif sur lequel ordonner une mesure de retrait.
L’affaire a mis en lumière une lacune réglementaire au Japon. Les voix ne bénéficient pas d’une protection spécifique dans la législation sur le droit d’auteur ni d’une réglementation autonome équivalente au droit à l’image. Toutefois, le ministère de la Justice japonais a averti, dans des directives diffusées le 7 août, que la création de vidéos utilisant des voix similaires à celles d’acteurs ou de comédiens de doublage et le tirage de revenus de ce contenu peuvent porter atteinte aux droits. La décision en faveur de Tsuda est la première dans le pays à lier expressément la clonation de voix par intelligence artificielle à la protection de l’identité personnelle.
Cas similaires et sanctions pour clonation de voix
Cette réclamation a des antécédents dans d’autres juridictions, où des artistes ont recouru à la justice pour empêcher l’utilisation de leurs voix, images et traits distinctifs par l’intelligence artificielle.
En Inde, l’acteur Anil Kapoor a obtenu une mesure conservatoire de la Haute Cour de Delhi en septembre 2023. La décision interdit à diverses personnes et plateformes d’utiliser sans autorisation son nom, son image, sa voix et d’autres éléments de son identité à des fins commerciales. L’ordre incluait également l’utilisation de l’intelligence artificielle, des deepfakes, des GIF et des techniques de manipulation numérique. Le tribunal a soutenu que « l’utilisation illégale du nom, de la voix, des dialogues ou de l’image d’une personne » à des fins commerciales « ne peut être tolérée », a indiqué le média local Live Law.
Dans le Tennessee, aux États-Unis, une norme spécifique contre l’exploitation non autorisée des voix par la technologie existe depuis le 1er juillet 2024. La Loi sur la sécurité de l’image, de la voix et de la ressemblance, connue sous le nom de ELVIS Act, reconnaît que toute personne dispose d’un droit patrimonial sur l’utilisation de sa voix. La norme autorise les poursuites civiles contre quiconque publie, distribue ou met à la disposition du public une voix ou une réplique vocale sans consentement, en sachant qu’elle est dépourvue d’autorisation. Elle prévoit également la responsabilité de ceux qui distribuent des outils créés principalement pour produire des répliques non autorisées.
En Californie, la législation protège depuis des années l’utilisation commerciale non autorisée de la voix. Une réforme approuvée en 2024 a renforcé cette couverture pour les interprètes face aux répliques numériques : les contrats autorisant une clonation de voix doivent identifier concrètement l’usage prévu et bénéficier d’un conseil juridique ou syndical. En l’absence de ces conditions, la clause contractuelle peut être nulle, selon le pouvoir législatif de l’État.