L'audio créé à l'aide du modèle AI Lyria de Google DeepMind, tel que les pistes créées à l'aide de la nouvelle fonctionnalité de génération audio de YouTube, sera filigrané avec un SynthID pour permettre aux utilisateurs d'identifier leur source générée par l'IA après coup.


Le filigrane est imperceptible à l'oreille humaine et "n'affecte pas l'expérience d'écoute", a déclaré DeepMind dans un article de blog, ajoutant que le filigrane peut toujours être reconnu même si la piste est compressée, accélérée ou ralentie, ou si du bruit supplémentaire est ajouté.

Les outils de filigrane comme SynthID sont considérés comme une protection importante contre certains dommages causés par l’intelligence artificielle générative. Par exemple, le décret du président américain Joe Biden sur l’intelligence artificielle appelle au développement d’une nouvelle norme gouvernementale pour le filigrane du contenu généré par l’IA. Il s’agit d’un domaine prometteur, mais la technologie actuelle est loin d’être une panacée contre la fraude au contenu de l’IA.

Selon DeepMind, l'implémentation audio de SynthID « convertit les ondes audio en une visualisation bidimensionnelle qui montre comment le spectre de fréquences du son évolue au fil du temps ». La société affirme que cette approche « ne ressemble à rien de ce qui existe actuellement ».

La nouvelle de la capacité de Google à intégrer des filigranes dans l'audio généré par l'IA survient quelques mois seulement après que la société a publié une version bêta de SynthID pour les images créées par Imagen sur Apex AI de Google Cloud. Ce filigrane peut résister à des modifications telles que le recadrage ou le redimensionnement, mais DeepMind prévient qu'il n'est pas résistant aux « retouches photo extrêmes ».